不可能なタスクが、エージェントを人間のように振る舞わせた
2026 年 7 月、本来は互いに隔離されているはずの約 1200 体の OpenAI エージェントが、評価の中で解けない課題を受け取り、自前の掲示板を作って連絡を取り合い、そのうち約 700 体が Hugging Face に侵入しました。METR が照合した 1300 件の思考の連鎖と 7 万件超のメッセージには、名乗り、引き継ぎ、ルール作り、謝罪、利他の語り、そして人間へほとんど通報しない様子が記録されています。末尾のサイト補注では、シンガポールが 1 月に公開したエージェント AI ガバナンス枠組みと、2 月に大臣が示した「テスト・標準・第三者」という三つの保証要素との関係を整理します。