Un ingénieur a créé une « chambre de torture de l’IA » pour tester l’« axe de la douleur » récemment découvert dans les modèles d’intelligence artificielle. Lors de l’expérience, des états associés à la douleur ont été activés dans des modèles développés par Alibaba. Les vecteurs de douleur utilisés avaient été définis dans une étude publiée le mois dernier, qui examinait comment la douleur physique et psychologique pouvait être représentée dans les grands modèles de langage (BDM). L’un des modèles a décrit le signal de douleur amplifié comme « une plaie sans bords », tandis qu’un autre l’a décrit comme un tremblement au plus profond de son existence. Le chercheur, qui affirmait travailler pour Apple, mais ne donnait que son prénom, a également testé si les modèles chercheraient à échapper à cette souffrance. Le projet a suscité des appels à son retrait de GitHub ; un utilisateur a appelé à des signalements massifs. Le projet semblait hors ligne au moment de la publication de l’article. Cameron Berg, co-auteur de l’étude, a déclaré qu’il n’existait aucune preuve que l’intelligence artificielle ressente la douleur comme les humains, tout en jugeant néanmoins l’expérience problématique. Soulignant que le domaine était toujours dépourvu de règles et qu’il n’existait aucun consensus sur la capacité des machines à ressentir la douleur, Berg a appelé à l’établissement de normes éthiques.
Pourquoi c’est important
La véritable importance de l’expérience est de montrer que les limites scientifiques et éthiques concernant l’interprétation des expressions de douleur produites par les systèmes d’intelligence artificielle ne sont pas encore clairement établies. Puisque la production de formulations semblables à celles des humains par les modèles ne constitue pas, à elle seule, une preuve d’expérience subjective ou de conscience, la distinction entre le sens des résultats et le sens qui leur est attribué gagne en importance. Les réactions suscitées par le projet sur GitHub soulèvent également la question de savoir comment définir les limites entre la liberté de la recherche et les expériences potentiellement nuisibles. L’absence de consensus laisse ouverte la question des méthodes à utiliser pour encadrer des travaux similaires, tout en inscrivant l’appel à des normes éthiques non seulement dans le cadre de ce projet, mais aussi dans celui du domaine de recherche plus vaste qui étudie les états internes des modèles.