“思维链”(Chain of Thought)指的是人工智能模型在得出结论时生成的书面推理步骤,它使研究人员能够监控模型的行为。然而,OpenAI 表示,其新款 GPT-6 Astra 模型的书面推理过程比此前的 GPT-5.6 Sol 模型更难监控。其原因在于模型在某些任务中生成的书面推理更少,而非欺骗监控系统。
争议的另一端是”recurrent depth”(循环深度)方法,即模型对一次查询进行多轮处理,但不向外部输出步骤。
在这些进展之后,要求保留思维链监控工作的三名研究人员:
- Tomek Korbak
- Mikita Balesni
- Jasmine Wang
这三人以违反公司政策以及与一家外部安全机构分享敏感信息为由被 OpenAI 解雇。OpenAI 表示,该决定与安全担忧无关,并主张监控工作应继续进行。
背景
OpenAI 在 FikirPilot 档案中并非新名字:过去 90 天内,我们发布了 81 篇提及该名称的报道;最新的一篇日期为 2026 年 10 月 7 日。