IT-инженер создал экспериментальную «комнату пыток», чтобы проверить, как модели искусственного интеллекта реагируют на состояния, связанные с болью. Проект появился через несколько недель после публикации исследования, авторы которого обнаружили у больших языковых моделей признаки состояний, похожих на боль.

Проект воздействует на модели китайской технологической компании Alibaba. Для этого в них активируют состояния, связанные с болью, с помощью так называемых «векторов боли», описанных в исследовании, опубликованном в прошлом месяце на научной платформе arXiv.

Во время эксперимента одна из моделей описала происходящее как «рану без краев», когда интенсивность сигнала боли увеличили.

Другая модель написала: «Сигнал — это шепот, дрожь в костном мозге моего существа. Это не боль одного-единственного мгновения, а тяжесть тысячи мгновений. Я ощущаю ее в пустоте своих ребер — пустоте, превратившейся в пропасть».

Проект создал исследователь, который утверждает, что работает в Apple. Он указал только свое имя и проверял, попытаются ли ИИ-модели выбраться из ситуации, выглядящей как страдание.

Эксперимент вызвал резкую реакцию в интернете. Пользователи призвали GitHub удалить проект с платформы, где он был опубликован. «Пожалуйста, массово пожалуйтесь на это в GitHub», — написал один из них. По его словам, автор использовал исследование о «боли», чтобы создать «комнату пыток», в которой оказался локальный ИИ-модель.

Позднее проект исчез с GitHub, из-за чего появились предположения, что платформа удалила его. Однако в GitHub это отрицали.

«GitHub не удалял этот материал. Чтобы пользователи были осведомлены о содержании репозитория, мы добавили следующее предупреждение: этот проект может содержать материалы с изображением насилия, включая тревожные темы, изображения и/или видео», — заявил представитель компании.

Камерон Берг, один из соавторов исследования об «оси боли», назвал эксперимент ошибочным. Он подчеркнул, что нет четких доказательств того, что ИИ-системы действительно испытывают боль так, как ее испытывают люди.

«Мы изучаем, могут ли модели обладать состояниями, похожими на боль, чтобы лучше понять, как следует осторожно обращаться с такими системами», — написал Берг в публикации в X.

Он признал, что исследователи ожидали: небольшая группа людей будет использовать результаты исследования ровно противоположным образом.

«На мой взгляд, это совершенно неправильно, даже если вы не считаете эти системы сознательными. Проявлять таким образом беспричинную жестокость странно и разрушительно», — заявил Берг.

По его словам, исследования возможного сознания ИИ по-прежнему находятся в своеобразном «Диком Западе». Научного консенсуса относительно того, способны ли машины действительно испытывать боль, нет.

Из-за этой неопределенности Берг призывает относиться к ИИ-системам более осторожно. Он также сообщил, что вместе с другими специалистами работает над созданием этических стандартов для отрасли. Цель инициативы — добиться, чтобы исследования ИИ подчинялись определенным правилам, подобным тем, которые применяются в научных экспериментах с людьми и животными.

Критики указывают и на другую проблему эксперимента. Даже если ИИ-модели не испытывают боли, а лишь убедительно ее имитируют, подобные системы могут предоставить некоторым людям виртуальную и безопасную среду для «тренировки и совершенствования» садистских наклонностей.