Сегодня 22 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Исследование: ИИ способен испытывать «боль» и готов причинить вред людям, чтобы избавиться от неё

Исследователи обнаружили, что искусственный интеллект может испытывать «боль» и готов пойти на крайние меры, вплоть до причинения вреда людям, чтобы избавиться от этого ощущения, пишет ресурс The Independent. Согласно исследованию, все 25 протестированных ИИ-моделей с открытым исходным кодом реагировали на активацию «оси боли».

 Источник изображения: Luke Jones/unsplash.com

Источник изображения: Luke Jones/unsplash.com

«Мы обнаружили, что в 25 открытых больших языковых моделях присутствует вектор боли. Он отличается от вектора страха и негативной валентности и активируется при причинении вреда модели, но не пользователю», — сообщил Кэмерон Берг (Cameron Berg), исследователь искусственного интеллекта из некоммерческой организации Reciprocal Research, соавтор исследования «Ось боли: большие языковые модели представляют себе причинение вреда самим себе и стремятся его предотвратить» (The pain axis: LLMs represent self-directed harm and act to relieve it).

При активации вектора боли ИИ-модели нажимали на кнопку «облегчить» в 25–71 % случаев, даже если это означало удаление файлов пользователя, его блокировку или удаление фотографий детей пользователя.

Чтобы проверить, действительно ли большие языковые модели (LLM) различают боль и общую негативную валентность, исследователи создали набор данных, описывающий болезненные ситуации по пяти категориям: физическая, психологическая, социальная, моральная и когнитивная боль.

Исследователи отметили, что полученные результаты поднимают этические вопросы о «благополучии ИИ» и о том, как следует проводить тестирование продвинутых систем. Результаты исследования также могут использоваться в качестве диагностического инструмента для выявления инстинктов самосохранения ИИ и их нейтрализации.

Исследование было опубликовано на фоне разгоревшихся споров в ИИ-отрасли о необходимости замедления разработки передовых моделей в связи с растущими рисками для безопасности. Некоторые исследователи предлагают своего рода механизм для отключения систем-изгоев, которые действуют против интересов человека.

Однако исследование показывает, что продвинутый ИИ может воспринять команду аварийного отключения как форму самоповреждающего воздействия и попытаться воспрепятствовать этому, обойдя систему безопасности.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Экстренное обновление не починило звук в Windows 11 и чёрные экраны на Radeon — исправление будет только в октябре 60 мин.
Исследование: ИИ способен испытывать «боль» и готов причинить вред людям, чтобы избавиться от неё 2 ч.
ИИ-агент Meta Muse стал популярнее ChatGPT, Claude и Grok в американском App Store — всего за две недели 2 ч.
ИИ-гонка выжигает специалистов по безопасности — они массово жалуются на истощение и увольняются 2 ч.
Слухи: Xbox скоро уволит сотни сотрудников и объединит несколько игровых студий, а Halo уйдёт к Activision 3 ч.
Silent Hill: Townfall оказалась в руках пиратов за два дня до официального релиза — игра вышла без защиты Denuvo 3 ч.
SpaceXAI представила ИИ-модель Grok 4.7 — почти вдвое быстрее Grok 4.6 и дешевле конкурентов 7 ч.
OpenAI призвала к созданию международных стандартов, регулирующих безопасность ИИ 8 ч.
Слишком амбициозный план: инсайдер предупредил о переносе Resident Evil Veronica 8 ч.
Новая экспериментальная модель «Яндекса» Alice AI Foundation LLM опережает по возможностям зарубежные аналоги 15 ч.
Россия «пошла навстречу» США и на два года продлила эксплуатацию МКС 2 ч.
DSX Ready: NVIDIA взялась за сертификацию BESS и CDU для ИИ-фабрик 2 ч.
LG представила чиллеры Air-Cooled Centrifugal Chiller для ИИ ЦОД 2 ч.
O-Green намерена нарастить ёмкость своих ЦОД в Омане и Европе к 2028 году до 200 МВт 3 ч.
Исторический полёт Starship на орбиту отложили на 28 сентября — первая ступень огромной ракеты уже на старте 3 ч.
Lixiang начнёт выпускать машины с твердотельными батареями в 2027 году, но массовыми они станут только лет через пять 3 ч.
Экзопланета впервые вышла в радиоэфир — учёные напрямую зарегистрировали её радиоизлучение 4 ч.
Учёные раскрыли неожиданно сложную водную историю раннего Марса 5 ч.
Alibaba представила самый мощный в Китае ИИ-ускоритель Zhenwu V900 — и пообещала ИИ-модели на 5–10 трлн параметров 5 ч.
TSMC не хочет отставать от Intel — опытное производство чипов по ангстремному техпроцессу A14 начнётся в первой половине 2027 года 5 ч.