人工知能モデルが結論に至る過程で生成する文章による推論ステップを指す「思考連鎖」(Chain of Thought)は、研究者にモデルの挙動を監視する手段をもたらしている。しかしOpenAIは、新しいGPT-6 Astraモデルの文章による推論が、従来のGPT-5.6 Solモデルと比べて監視が難しくなっていると発表した。その理由は、モデルが一部のタスクで生成する文章による推論が少ないためであり、監視システムを欺いているからではない。
議論のもう一つの側面は、モデルが一つのクエリに対して複数の処理ターンを実行するものの、そのステップを外部に書き出さない「recurrent depth」(反復深度)というアプローチだ。
これらの動きを受け、思考連鎖の監視活動の維持を求める3人の研究者:
- Tomek Korbak
- Mikita Balesni
- Jasmine Wang
3人は、社内ポリシーへの違反と、機密情報を外部のセキュリティ機関と共有したことを理由にOpenAIを解雇された。OpenAIは、この決定は安全上の懸念とは無関係だと述べ、監視活動の継続を擁護している。
背景
OpenAIはFikirPilotのアーカイブでは新しい名前ではない:過去90日間でこの名前が登場する記事を81本公開しており、最新のものは2026年10月7日付だ。