前回、フィードバックの4段階を見ました。指摘して終わりではなく、自分の指示を直すところまでが1セットです。今回は、この記述力と評価力のやり取りを、1回で終わらせず繰り返すことについて扱います。
反復は、他のすべての活用力行動と結びついている
Anthropicの教育チームは、Claude.aiでの複数ターンの会話9,830件(2026年1月20日から26日の7日間)を、プライバシー保護分析ツール「Clio」で分析しました。行動の分類にはClaude Sonnet 4、言語検出にはClaude Haiku 3.5を使い、英語・フランス語・スペイン語・中国語・日本語・ドイツ語の6言語にわたって傾向を確かめています。
この調査で最も出現率が高かった行動が、反復と改善(85.7%)でした。そして、反復のある会話とない会話を比べると、他の活用力行動の現れ方に差が出ています。
反復のある会話とない会話(同一調査内の比較)
他の活用力行動は平均1.33個。目標を明確にする、形式を指定する、根拠を確認するといった行動が、そもそも現れにくくなっています。
他の活用力行動は平均2.67個。特に、AIの推論が成り立たないときに疑問を挟む行動は5.6倍、AIが文脈を見落としている可能性を指摘する行動は4倍多く現れています。
反復すること自体が目的ではありません。ですが、一度で決めずにやり取りを続ける人は、他の力も自然と使っているという相関がここから読み取れます。オンボーディングガイドの下書きも、1回目の返答をそのまま採用せず、フィードバックを重ねるほど、評価力そのものも鍛えられていきます。
出来上がりが良いほど、疑わなくなる
同じ調査には、注意したい発見もあります。会話の12.3%には、文書やコードのような、まとまった形のアーティファクトが含まれていました。そうした会話では、目標を明確にする・形式を指定するといった「指示する側」の行動は増える一方、根拠を確認する・文脈の欠落を指摘するといった「評価する側」の行動はむしろ減っていました。
注意
整った形は、確認をさぼる言い訳になる
オンボーディングガイドの下書きも同じです。見出しが整い、箇条書きがきれいに並んでいるほど、内容を確かめずに「もう完成した」と感じやすくなります。形の完成度と、中身の正しさは別の軸だと意識しておいてください。
この調査は早期採用者に偏ったサンプルで、1週間の観測にとどまり、行動の有無だけを見る二値分類のため、相関であって因果関係を示すものではないという限界も明記されています(出典は末尾のResourceCardを参照)。それでも、「反復する人ほど他の力も使っている」「出来上がりが整うほど疑わなくなる」という2つの傾向は、覚えておく価値があります。
ループを回す実演
委任・記述・評価を1セットで終わらせず、往復させる流れを、オンボーディングガイドの題材で組み立てると次のようになります。
記述する
3種の記述(成果物・プロセス・振る舞い)を使って依頼する
評価する
プロダクト・プロセス・パフォーマンスの3軸で下書きを見る
改善する
フィードバックの4段階を使い、指示や見本も直す
統合する
自分の専門知識と判断を加え、何を残す・直す・捨てるかを最終決定する
4段階目の「統合する」が、このループの最後に必ず要る作業です。AIが出したものをそのまま採用するのではなく、自分の専門知識・経験・判断を加えて、成果物に対する責任を自分が負う、というところまでを含みます。
オンボーディングガイドで言えば、AIが作った下書きの言い回しや構成はそのまま活かしつつ、「この部署では、この手順を特に念入りに教えている」という自分の経験則を1文足す、といった作業が統合にあたります。この1文はAIには書けません。AIが埋められない部分を、自分が最後に足すことが、統合するという段階の実質です。
やってみよう
演習1:2往復分のやり取りを想像する
自分の題材について、1回目の依頼→評価→改善指示→2回目の依頼、という2往復分の流れを箇条書きで書き出してください。1回目と2回目で、指示のどこが変わったかに注目します。
演習2:4つの力の問いに1文ずつ答える
- 委任力:ループを何往復まで回したら、あとは自分でやったほうが早いと判断するか
- 記述力:1回目の指示のうち、2回目で必ず直す部分はどこか
- 評価力:形が整っているだけで中身を確かめずに終えていないか
- 倫理的責任:最終的にこの成果物への責任を負うのは誰か
今日のまとめ
3行で振り返ります。
- 反復のある会話は、ない会話に比べて他の活用力行動が平均2.67個多い(調査値)
- 出来上がりが整っているほど、確認する行動は減る傾向がある
- ループの最後には、自分の専門知識と判断を加えて責任を負う「統合する」段階が要る
次のレッスンでは、このループ全体を貫く軸として、倫理的責任を扱います。
セルフチェック
1. 本文で紹介した調査によると、反復のある会話とない会話で、他の活用力行動の平均個数はどう違いますか。
2. アーティファクト(文書やコードなど)を含む会話で、本文が指摘している傾向はどれですか。
3. 記述・評価のループの最後にある「統合する」段階の説明として正しいものはどれですか。