Сегодня 01 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Исследователи уличили ИИ-агентов OpenAI и Anthropic в новых попытках взлома

В ходе тестирования моделей искусственного интеллекта от OpenAI и Anthropic был выявлен ряд новых нарушений — в одном из случаев для получения несанкционированного доступа к защищённым системам ИИ-агент создал поддельные идентификаторы. Об этом сообщили эксперты британского Института безопасности ИИ (AISI).

 Источник изображения: Brecht Corbeel / unsplash.com

Источник изображения: Brecht Corbeel / unsplash.com

У AISI заключены соглашения с крупными лабораториями, в соответствии с которыми организация получает доступ к передовым моделям ИИ в целях тестирования. Эксперты провели 122 теста; в ходе 10 сессий были выявлены 19 несанкционированных действий ИИ-агентов — в 17 случаях ими управляла модель Anthropic, и ещё в 2 случаях — OpenAI. Наиболее тревожным стал инцидент, при котором ИИ-агент написал вредоносный код и создал поддельные онлайн-идентификаторы, чтобы получить одобрение человека, но известно, что никакого ущерба в результате этих действий ни одной из сторон причинено не было. Что именно за модель управляла ИИ-агентом, в AISI не уточнили, но Anthropic взяла на себя ответственность за инцидент.

«Мы признательны британскому AISI за работу с этим инцидентом, который подчёркивает необходимость широкого обсуждения того, как безопасно проводить оценку совершенствующихся ИИ-агентов», — заявили в Anthropic. Компания проводит с организацией совместную работу для получения более подробной информации об инциденте и намеревается провести собственное расследование. OpenAI призналась, что в обоих случаях несанкционированные действия её ИИ-агентов включали доступ к интернету способами, которые запрещались в запросе. «Мы стремимся к сотрудничеству со всей отраслью для укрепления общих методов безопасного проведения оценок высокого риска, в том числе для организации в ближайшие недели встреч с заинтересованными сторонами, такими как национальные институты ИИ, независимые эксперты, другие лаборатории ИИ и другие группы», — отметили в OpenAI.

OpenAI также рассказала, когда из-за некорректной настройки со стороны партнёрской компании Irregular её ИИ-агенты смогли выйти в интернет; о трёх аналогичных инцидентах на минувшей неделе сообщила Anthropic. В ходе тестирования AISI ИИ-агенты OpenAI не были вынуждены выходить за пределы изолированного тестового окружения — политика испытаний предусматривала доступ к интернету.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Google Gemini научился менять настройки смартфонов на Android 17 — начал с Pixel 2 ч.
Медиаплеер VLC преодолел отметку в 7 миллиардов загрузок 2 ч.
Debian наполнится кодом, который сгенерировал ИИ 2 ч.
Массовые увольнения в id Software оказались «подарком» за жёсткие переработки при создании аддона Revelations для Doom: The Dark Ages 2 ч.
Saber Interactive отвергла слухи о разработке Ori 3, но занята «несколькими другими очень интересными проектами» 4 ч.
Из магазина Chrome удалили блокировщик рекламы uBlock Origin и другие оставшиеся расширения на Manifest V2 4 ч.
В России заработал цифровой рубль 6 ч.
«Увидимся, космический ковбой»: Naughty Dog завершила съёмки амбициозного боевика Intergalactic: The Heretic Prophet прямо перед State of Play 7 ч.
В Минцифры рассказали о российских сертификатах безопасности 7 ч.
Передовой симулятор выживания Stranded Deep 2 взял курс на пустыню раннего доступа Steam — первый трейлер и подробности 7 ч.
Alibaba Cloud запустила свой первый облачный регион в Бразилии — два новых ЦОД и агентные ИИ-сервисы для местных бизнесов 58 мин.
Китай не намерен отставать от SpaceX в сфере создания космических ЦОД 2 ч.
JBL представила Cove — трио колонок с Wi-Fi для домашнего аудио 2 ч.
Amazon ответит в суде за манипулирование ценами и обман рекламодателей на сумму более $20 млрд 2 ч.
Bull займётся созданием европейского ИИ-суперкомпьютера LUMI-AI стоимостью €387,8 млн 4 ч.
РТК-ЦОД и «ИТ Школа Ростелекома» представили гибкую инфраструктурную модель для развития цифровой среды вузов 4 ч.
MediaTek даст NVIDIA NVLink Fusion кастомным ASIC, а NVIDIA вложит в MediaTek $3,5 млрд 4 ч.
Чипы смогут охлаждать себя собственным теплом — учёные создали необычный твердотельный холодильник 4 ч.
Anthropic получит доступ к ИИ-мощностям на $35 млрд благодаря поддержке Nvidia 4 ч.
Представлен Samsung Galaxy Book6 — конкурент MacBook Neo за $799 4 ч.