同じ一日のうちに、隅々まで見る資料と、要点だけ見る資料がある。生成 AI が下書きを出すようになってからも、どちらを薄くするかはその場の判断で決まり、記録には残らない。手を抜く場所を先に決めておくことは、怠けなのか、それとも設計なのか。危険の大きさに応じて力の配り方を変え、その線と理由を書き残したときだけ、それは設計になる。
01力を均等に配ると、危険の大きいところが薄くなる
ICH Q9(R1) は、品質リスク管理にかける労力・形式・文書化の程度を、危険の大きさに見合わせよと書いている。労力も形式も文書化も有限である。ある工程に多く配れば、別の工程には少なく届く。
危険の大きい場所は、見落としたときの損害が大きいだけでなく、確かめるべき事柄も多い。だから均等に配ると、そこに届く力が足りなくなる。一日のうちにどれを薄くしたかは、多くの場合その場の判断で決まり、記録に残らない。残らなければ、半年後に誰も理由を言えない。
省くこと自体が問題なのではない。どこを省くかを先に決めて書き残したかどうかが、設計と怠けを分けている。
02Q9(R1) は、形式の度合いを連続した幅として扱う
危険に見合わせよという原則には、続きがある。Q9(R1) の第 5.1 節は、形式性を形式的か非形式的かの二択として扱っていない。低いほうから高いほうへ続く一本の幅として扱っている。
幅のどこを選ぶかは、三つで決まると書かれている。不確かさがどれだけあるか。扱っているものがどれだけ重要か。そしてその事柄がどれだけ複雑か。不確かさも重要性も複雑さも小さいところでは、低い形式性を選んでよい。
もう一つ、明記されている一文がある。資源の不足を、低い形式性を選ぶ理由にしてはならない。人手が足りないから簡略にした、という説明は、この指針の中では通らない。通るのは、危険が小さいから簡略にした、という説明だけである。二つの説明は結論が同じでも、根拠の置き場所が違う。前者は組織の都合に置かれ、後者は対象の性質に置かれている。
03臨床試験でも、工程は危険に釣り合わせよと書かれている
形式の度合いは、不確かさと重要性と複雑さで選ぶ。同じ形の要求は、医薬品の別の場面にも書かれている。
| 見るところ | ICH Q9(R1) | ICH E6(R3) |
|---|---|---|
| 釣り合わせる相手 | 品質に対する危険の大きさ | 試験に内在する危険と、集める情報の重要性 |
| 前もって決めること | 形式の度合い | 品質にとって決定的な要素 |
| 資源の不足の扱い | 低い形式性を選ぶ理由にしない | 不要な負担を避ける |
ICH E6(R3) は、試験の工程を、試験に内在する危険と集める情報の重要性に釣り合わせるよう求めている。そして、品質にとって決定的な要素を前もって特定せよと書いている。前もって、という語がここでの要点である。
事後に理由を作ることと、前もって決めることは、書かれた文書としては似た形になる。違うのは、書いた人がすでに結果を知っているかどうかである。資材審査で全ページを同じ密度で見る運用は、この釣り合いを取っていない。取っていない理由が書かれていれば設計だが、書かれていなければ、ただ均等なだけになる。
04情報を捨てる手順が、精度を上げる場合がある
前もって薄くする場所を決めよという要求は、別の疑いを呼ぶ。読む量を減らせば、精度は落ちるのではないか。心理学の研究には、減らしても落ちない場合があるという報告がある。
ギーゲレンツァーとブライトンは 2009 年に、情報と計算と時間を減らすほうが精度を上げる場合があると書いた。判断の手順の多くは情報を無視する仕組みであり、無視することが効率だけでなく正確さにも寄与する、という主張である。
サイモンは 1956 年に、同じ場所へ別の角度から着いていた。最適な道を見つけるだけの力を持たない存在にとって、選択とは、必要をある水準で満たす道を選ぶことだと述べている。最適を探し続ける手順は、そもそも実装できない場合がある。
ただしギーゲレンツァーらの主張は条件つきである。手がかりが少なく、不確かさの大きい場面で成り立つ。出来事の型が繰り返す規則性の高い場面では、情報を捨てる同じ手順が見落としをそのまま通す。どの場面でも読む量を減らしてよい、とは書かれていない。
05ICML 2026 では、決めなかった線が各自で決まった
減らすことが誤りを増やすとは限らない。それでも、どこを薄く見るかの線を誰が引くのかは、別に決まる。誰がその線を引いたかを測った実例が、2026 年の ICML にある。
この学会は 24,000 本を超える論文と 17,000 人の査読者を抱えていた。主催者は査読者に、LLM の利用を禁じる方針と、限定して許す方針を無作為に割り当てた。
規模
24,000 本を超える論文と 17,000 人の査読者が対象になった。
結果への影響
採否・点数・自信のいずれにも、ほとんど差が出なかった。
方針との食い違い
禁止側の 22.5% が利用を、許可側の 36.5% が許されない使い方を報告した。
採否にも点数にも自信の度合いにも、方針による差はほとんど出なかった。割り当てる方針を変えても、査読の結果はほとんど動かなかった。
動いたのは別のところだった。禁じた側の 22.5% が、それでも LLM を使ったと答えている。限定して許した側では、36.5% が明示的に許されていない使い方をしたと報告した。方針は文書として存在したが、許される使い方の線は査読者各自の手元で引かれていた。査読は資材を見る工程とは別の営みなので、この数字をそのまま移せない。資材を見る工程に移せるのは、方針と実際の使い方が食い違ったという事実だけである。
06不確かさ・重要性・複雑さの三つで、力の配りが決まる
方針を割り当てても、査読者は各自で別の線を引いていた。この結果を見た後で決めるべきものは、三つに絞られる。
一つめは、省く判断そのものである。どの工程を薄く見るかを決めるのは、その場にいる人の判断である。理由を書き残せるなら、その判断は設計になる。書き残せないなら、同じ行いが怠けになる。行いの中身だけでは両者を区別できないところが、この問題の厄介な点である。
二つめは、厚くする場所の選び方である。三つのうち最初に見るべきなのは不確かさで、力を厚くすべきなのは不確かさが大きいところである。慣れていないところとは限らない。何度も扱った領域でも、不確かさが大きい論点は残る。慣れは、不確かさを減らしたという感覚を与えるが、不確かさそのものを減らすわけではない。Q9(R1) が挙げた三つのうち、慣れが実際に下げるのは、複雑さの感じ方だけである。
場所
どの工程を薄くするかが、名前で書かれているか。
理由
薄くしてよい根拠が、危険の大きさで説明されているか。
見直し
線を引き直す時期が、あらかじめ決まっているか。
三つめは、線を書かなかった場合に起きることである。ICML の 22.5% と 36.5% が示したのは、方針を文書にしただけでは各自の線が揃わないという事実だった。禁止か限定許可かという粗い方針だけを書いて、どこを薄くしてよいかまで書かなければ、線は各自の手元で引かれる。別々に引かれた線は、後から揃えられない。誰がどこで薄くしたかの記録が残っていないからである。
07AI の下書きが増えると、線の位置を書く必要が増す
不確かさと重要性と複雑さで力を配る。この整理には、下書きを人が書いているという前提が入っている。生成 AI が下書きを出す量が増えれば、どこを人が読むかの線は動く。
EU AI 法第 14 条は、高い危険度の AI を使う側に、出力に頼りすぎる傾向への自覚と、使わないという判断を求めている。頼りすぎの自覚を法の要求として書いているのは、頼りすぎが自然に起きるからである。出来のよい出力に力を薄く配るという傾向は、この条文が自覚を求めることで前提にしているものである。生成 AI の下書きにも同じことがあたる。
ここで一つ、どの指針にも書かれていないことがある。Q9(R1) は、資源の不足を低い形式性の理由にしてはならないと書いた。では、AI が時間を節約したことを理由にしてよいのか。AI が節約した時間は資源の不足ではないので、Q9(R1) のこの一文は直接あたらない。この問いに答えた公的な記述は見つかっていない。
公的な記述が見つかっていないのだから、いまは自分で決めるしかない。決めたことを書き残しておけば、後から公的な線が示されたときに、自分の線との差を測れる。書いていなければ、測る相手がない。
- ICH Q9(R1) は、労力・形式・文書化の程度を危険の大きさに見合わせよと書いている。そして、資源の不足を低い形式性の理由にしてはならないと明記している。省くという判断は、理由を書き残せるなら設計である。
- ギーゲレンツァーとブライトンは 2009 年に、情報と計算と時間を減らすほうが精度を上げる場合があると示した。減らすこと自体が誤りを増やすわけではない。
- ICML 2026 では、利用を禁じられた査読者の 22.5% が LLM を使ったと答えた。限定して許された側では、36.5% が許されない使い方を報告した。方針を文書にするだけでは足りず、どこを薄くしてよいかまで書いて共有しなければ、各自が別の線を引く。
手を抜く場所を先に決めることは、怠けではない。危険の大きさで力の配り方を決める。薄く見る場所とその理由を書き残す。線を引き直す時期まで決める。ここまで揃ったとき、省くことは設計になる。
書かずに省けば、同じ行いが怠けになる。行いの中身だけを見て、設計と怠けを外から判定する方法はない。残っている記録だけが、その差を示している。
- International Council for Harmonisation(ICH). ICH Harmonised Guideline Q9(R1) Quality Risk Management. 2023年1月18日.(労力・形式・文書化の程度を危険の大きさに見合わせる原則、形式性が連続した幅であること、不確かさ・重要性・複雑さの三つ、資源の不足を理由にしないという明記)
- Psychological Review 63(2), 129–138(Herbert A. Simon). Rational Choice and the Structure of the Environment. 1956年3月.(最適な道を探す力を持たない存在の選択が、必要をある水準で満たす道を選ぶことになるという定式)
- Topics in Cognitive Science 1, 107–143(Gerd Gigerenzer, Henry Brighton). Homo Heuristicus: Why Biased Minds Make Better Inferences. 2009年.(判断の手順が情報を無視する仕組みであること、情報と計算と時間を減らすほうが精度を上げる場合があること)
- arXiv:2609.19420(Kim, Deng, Wortman Vaughan ほか). Use and Effects of LLMs in Peer Review: A Randomized Experiment and Survey at ICML 2026. 2026年9月16日.(方針を無作為に割り当てても採否や点数に差が出なかったこと、禁止側の 22.5% と許可側の 36.5% という食い違い、論文数と査読者数)
- International Council for Harmonisation(ICH). ICH Harmonised Guideline E6(R3) Guideline for Good Clinical Practice. 2025年1月6日.(試験の工程を内在する危険と情報の重要性に釣り合わせる要求、品質にとって決定的な要素を前もって特定するという順序)
- Regulation (EU) 2024/1689(EU AI 法). Article 14: Human Oversight. 2024年7月12日.(出力に頼りすぎる傾向への自覚と、使わないという判断を人の側に置く要求が法として存在すること)