La « chaîne de pensée » (Chain of Thought), qui désigne les étapes de raisonnement écrites produites par les modèles d’intelligence artificielle pour parvenir à un résultat, permet aux chercheurs d’observer le comportement des modèles. Cependant, OpenAI a annoncé que le raisonnement écrit de ses nouveaux modèles GPT-6 Astra est plus difficile à suivre que celui du précédent modèle GPT-5.6 Sol. La raison en est que le modèle produit moins de raisonnement écrit sur certaines tâches, et non qu’il trompe les systèmes de surveillance.
L’autre volet du débat est l’approche dite de « recurrent depth » (profondeur récurrente), dans laquelle le modèle effectue plusieurs tours de traitement sur une requête sans écrire les étapes vers l’extérieur.
À la suite de ces développements, trois chercheurs ont demandé la préservation des travaux de surveillance de la chaîne de pensée :
- Tomek Korbak
- Mikita Balesni
- Jasmine Wang
Les trois personnes ont été licenciées d’OpenAI pour violation des politiques de l’entreprise et partage d’informations sensibles avec un organisme de sécurité externe. OpenAI affirme que cette décision n’est pas liée à des préoccupations de sécurité et défend la poursuite des travaux de surveillance.
Contexte
OpenAI n’est pas un nom nouveau dans les archives de FikirPilot : nous avons publié 81 articles mentionnant ce nom au cours des 90 derniers jours ; le plus récent est daté du 7 octobre 2026.