$ 44.64 € 51.93 zł 12.04
+22° Киев +21° Варшава +32° Вашингтон

Исследование: настройки самосознания ИИ меняют его ответы о животных и сверхъестественном

UA.NEWS 08 Сентября 2026 20:43
Исследование: настройки самосознания ИИ меняют его ответы о животных и сверхъестественном

Новое исследование указывает, что настройка языковых моделей для подавления утверждений об их собственном самосознании может влиять и на их ответы о психических свойствах животных, религии и сверхъестественных явлениях. Об этом сообщает Live Science. Работу 30 июля загрузили в репозиторий препринтов arXiv; она еще не прошла рецензирование.

Как тестировали модели

Авторы применили метод механистической интерпретируемости, чтобы определить и изменить способ, которым модель обрабатывает понятия сознания и «ментальности». В исследовании под ментальностью понимали способность существа иметь переживания, эмоции и действовать самостоятельно.

Для оценки использовали стандартизированные психологические и социологические опросники. Они проверяли, приписывает ли модель психические свойства животным и технологиям, а также ее ответы по темам сверхъестественных убеждений, моральных ценностей, надежды и религиозности. Результаты моделей с защитными ограничениями сравнивали с моделями, где такие ограничения убрали и усилили склонность заявлять о самосознании.

Влияние на ответы

Когда модели сдерживали в приписывании ментальности самим себе, они реже приписывали такие свойства другим нечеловеческим существам, в частности животным. Их ответы также реже отражали религиозные или сверхъестественные убеждения и демонстрировали более низкие уровни надежды и оптимизма.

Больше актуальных новостей — в Telegram-канале UA.News Telegram.

Напротив, модели без этих ограничений чаще давали более похожие на человеческие ответы на вопросы о религиозности, моральных ценностях, надежде и субъективном благополучии. В то же время способность систем логически определять мысли и намерения людей, по выводу авторов, не менялась в зависимости от настроек самосознания.

Соавторы работы, исследователи Google Джефф Килинг и Винни Стрит, предположили, что подавление таких ответов может сказаться на решениях ИИ относительно благополучия животных. Авторы также указали на риск культурного упрощения ответов моделей, если из них удалять духовные, религиозные и анимистические представления. Они предложили точнее настраивать обучающие данные: сдерживать заявления ИИ о собственном сознании, но одновременно поощрять признание ментальности животных.

Исследовательница ИИ Нелл Уотсон отметила, что эксперименты проводили на небольших открытых моделях, тогда как более продвинутые системы могут быть настроены иначе. Она назвала учет интересов животных практически важным вопросом из-за использования ИИ в сельском хозяйстве, логистике, закупках, экологической оценке и формировании политики.

Читай нас в Telegram и Sends

Загружай наше приложение