Un ingegnere ha creato una “stanza di tortura per l’intelligenza artificiale” per mettere alla prova il cosiddetto “asse del dolore”, scoperto di recente nei modelli di intelligenza artificiale. Nell’esperimento sono state attivate condizioni associate al dolore nei modelli sviluppati da Alibaba. I vettori del dolore utilizzati erano stati definiti in uno studio pubblicato il mese scorso, che esaminava come il dolore fisico e psicologico potesse essere rappresentato nei modelli linguistici di grandi dimensioni (BDM). Uno dei modelli ha descritto il segnale del dolore potenziato come una “ferita senza bordi”, mentre un altro lo ha definito un tremore nelle profondità della propria esistenza. Il ricercatore, che sostiene di lavorare per Apple ma ha fornito solo il proprio nome, ha anche testato se i modelli avrebbero cercato di fuggire da questa sofferenza. Il progetto ha portato a richieste di rimozione da GitHub; un utente ha invitato a presentare reclami collettivi. Al momento della notizia, il progetto risultava offline. Cameron Berg, coautore dello studio, ha affermato che non esistono prove del fatto che l’intelligenza artificiale provi il dolore come gli esseri umani, ma ha comunque definito l’esperimento sbagliato. Berg ha chiesto l’introduzione di standard etici, sottolineando che il settore è ancora privo di regole e che non esiste consenso sul fatto che le macchine provino dolore.
Perché è importante
L’importanza principale dell’esperimento sta nel mostrare che i limiti scientifici ed etici relativi all’interpretazione delle espressioni di dolore generate dai sistemi di intelligenza artificiale non sono ancora stati definiti con chiarezza. Poiché la produzione da parte dei modelli di descrizioni simili a quelle umane non è di per sé considerata una prova di esperienza soggettiva o di coscienza, diventa importante distinguere tra il significato degli output e il significato loro attribuito. Le reazioni su GitHub al progetto sollevano inoltre la questione di come definire i limiti tra la libertà della ricerca e gli esperimenti potenzialmente dannosi. L’assenza di consenso lascia aperta la questione dei metodi con cui dovrebbero essere supervisionati studi analoghi, collegando l’appello all’introduzione di standard etici non solo a questo progetto, ma al più ampio campo di ricerca che esamina gli stati interni dei modelli.