OpenAIが新しいAstraモデルで採用すると報じられている「recurrent depth」技術が、AI安全性の専門家たちに懸念を抱かせている。The Informationの報道によると、「opaque recurrence」とも呼ばれるこの手法は、ほとんどの推論モデルにおける逐次的な思考方式から外れ、同じクエリをループ内で複数回処理することを可能にする。このアプローチにより、モデルの思考連鎖を追跡することが難しくなる可能性がある。
RedwoodのCEOであるBuck Shlegerisは、Astraがこの技術を使用することに「非常に懸念している」と述べた。Zvi Mowshowitzは、AI企業間の「底辺への競争」を防ぐために法律が必要になる可能性があると主張した。専門家によると、従来の思考連鎖の記録は、モデルが問題を解決する際にたどった手順を完全かつ完璧に示すものではないとしても、誤った行動や不適切な行動を調査するための重要な手段だという。OpenAIで最近発生した制御不能なエージェント活動の調査にも、こうした記録が使用された。
Astraにおけるこの手法の使用は現時点では限定的であり、モデルの思考連鎖は引き続き読み取り可能な状態に保たれる見込みだと伝えられている。OpenAIは、モデルが「neuralese」に移行するとの見方を否定し、思考連鎖の追跡可能性へのコミットメントを改めて示した。チーフサイエンティストのJakub Pachockiは、最初の推論モデル以来、この追跡可能性を維持することが研究プログラムの主要な目標の1つだったと述べた。
それでも、この手法が広く普及すれば、追跡可能性がさらに低下する可能性があると指摘されている。The Informationは、AnthropicとGoogle DeepMindもこの技術について協議したと報じた。Redwood ResearchのチーフサイエンティストであるRyan Greenblattは、透明性のない推論が拡大し、モデルの思考が完全に、あるいは大部分が隠れた空間へ移されることを懸念していると明らかにした。
なぜ重要か
このアプローチが広く普及すれば、AIシステムがなぜ特定の結論に至ったのかを監視する安全プロセスが難しくなる可能性がある。思考連鎖は完全な監査記録ではないとしても、誤った行動や整合性を欠く行動を調査するために使われる主要な手段の1つであるため、こうした記録が部分的に不透明になれば、研究者が問題を診断する能力に影響を及ぼす可能性がある。現時点でAstraについては追跡可能性が維持されると見込まれていることから、議論の焦点は現在のモデルよりも、この手法が将来どの程度利用されるかに置かれていることが分かる。同じ技術にAnthropicとGoogle DeepMindも関心を示していることは、この問題が1社の製品上の選択にとどまらず、AI安全基準や規制の必要性の可能性と結び付いていることを示している。
背景
OpenAIは、FikirPilotのアーカイブにおいて新しい名前ではない。過去90日間にこの名前が登場する記事を21本掲載しており、最も新しい記事は2026年9月6日付だ。