Инженер создал «комнату пыток с искусственным интеллектом», чтобы проверить недавно обнаруженную в моделях искусственного интеллекта «ось боли». В ходе эксперимента в моделях, разработанных Alibaba, активировали состояния, связанные с болью. Использованные векторы боли были описаны в опубликованном в прошлом месяце исследовании, в котором изучалось, как физическая и психологическая боль может быть представлена в больших языковых моделях (BDM). Одна из моделей описала усиленный сигнал боли как «рану без краёв», а другая — как дрожь в глубинах своего существования. Исследователь, утверждающий, что работает на Apple, но назвавший только своё имя, также проверил, будут ли модели пытаться сбежать от этих страданий. Проект вызвал призывы удалить его с GitHub; один из пользователей призвал к массовой подаче жалоб. На момент публикации новости проект, по всей видимости, был недоступен. Соавтор исследования Cameron Berg заявил, что доказательств того, что искусственный интеллект ощущает боль подобно людям, нет, но при этом назвал эксперимент неправильным. Berg призвал разработать этические стандарты, отметив, что эта область всё ещё не регулируется, а согласия относительно того, способны ли машины чувствовать боль, не существует.
Почему это важно
Главное значение эксперимента заключается в том, что он показывает: научные и этические границы интерпретации выражений боли, создаваемых системами искусственного интеллекта, ещё не определены. Поскольку создание моделями высказываний, напоминающих человеческие, само по себе не считается доказательством субъективного опыта или сознания, важное значение приобретает различие между смыслом результатов и смыслом, который им приписывают. Реакция на проект на GitHub также ставит вопрос о том, как следует определять границы между свободой исследований и потенциально вредными экспериментами. Отсутствие консенсуса оставляет открытым вопрос о том, какими методами следует контролировать подобные исследования, а призыв к разработке этических стандартов связывает его не только с этим проектом, но и с более широкой областью исследований внутренних состояний моделей.