Aller au contenu
Français
Contenu FikirPilot

La nouvelle technique de raisonnement d’OpenAI a alarmé les experts en sécurité de l’AI

Mis à jour: 06/09/2026 · 3 min de lecture · 511 mots

Publié: · Dépêche reçue: · Durée de traitement: 37 h 18 min

La nouvelle technique de raisonnement d’OpenAI a alarmé les experts en sécurité de l’AI
Un centre de données plongé dans l’obscurité

La technique de « recurrent depth », qu’OpenAI utiliserait dans son nouveau modèle Astra, a suscité l’inquiétude des spécialistes de la sécurité de l’IA. Selon un article de The Information, cette méthode, également appelée « opaque recurrence », permet au modèle de traiter plusieurs fois la même requête au sein d’une boucle, en sortant du mode de pensée séquentiel de la plupart des modèles de raisonnement. Cette approche pourrait compliquer le suivi de la chaîne de pensée du modèle.

Le CEO de Redwood, Buck Shlegeris, a déclaré être « extrêmement inquiet » de l’utilisation de cette technique par Astra. Zvi Mowshowitz a, quant à lui, estimé que des lois pourraient être nécessaires pour empêcher une « course vers le bas » entre les entreprises d’IA. Selon les experts, les enregistrements traditionnels des chaînes de pensée, même s’ils ne montrent pas toujours de manière parfaitement exhaustive les étapes suivies par le modèle pour résoudre un problème, constituent un outil important pour examiner les comportements erronés ou non conformes. Ces enregistrements ont également été utilisés pour analyser les activités récentes d’agents incontrôlables d’OpenAI.

Il a été rapporté que l’utilisation de cette méthode dans Astra serait pour l’instant limitée et que la chaîne de pensée du modèle devrait rester lisible. OpenAI a rejeté les commentaires selon lesquels le modèle passerait au « neuralese » et a réaffirmé son attachement à la traçabilité des chaînes de pensée. Le Chief Scientist Jakub Pachocki a déclaré que le maintien de cette traçabilité depuis les premiers modèles de raisonnement constituait l’un des principaux objectifs de son programme de recherche.

Malgré cela, il est indiqué que la traçabilité pourrait encore diminuer si la méthode venait à se généraliser. The Information a rapporté qu’Anthropic et Google DeepMind s’étaient également entretenues au sujet de cette technique. Ryan Greenblatt, Chief Scientist de Redwood Research, a pour sa part déclaré craindre que le raisonnement opaque ne se développe au point de transférer les pensées du modèle vers un espace entièrement ou largement dissimulé.

Pourquoi c’est important

La généralisation de cette approche pourrait compliquer les processus de sécurité qui contrôlent pourquoi les systèmes d’IA parviennent à un résultat donné. Même si les chaînes de pensée ne constituent pas un registre d’audit parfait, elles font partie des principaux outils utilisés pour examiner les comportements erronés ou non conformes. Leur opacification partielle pourrait donc affecter la capacité des chercheurs à diagnostiquer les problèmes. Le fait que la traçabilité devrait être préservée pour Astra pour le moment montre que le débat porte davantage sur l’ampleur de l’utilisation future de la méthode que sur le modèle actuel. Le fait qu’Anthropic et Google DeepMind s’intéressent également à cette même technique indique que le sujet ne relève plus seulement du choix de produit d’une entreprise, mais qu’il est désormais lié aux normes de sécurité de l’IA et à la nécessité éventuelle d’une réglementation.

Contexte

OpenAI n’est pas un nouveau nom dans les archives de FikirPilot : nous avons publié 21 articles mentionnant ce nom au cours des 90 derniers jours ; le plus récent est daté du 6 septembre 2026.

Source: TechCrunch AI