Сегодня 29 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

OpenAI призвала замедлить развитие ИИ из-за риска выхода агентов из-под контроля

Спустя несколько дней после презентации OpenAI самой мощной ИИ-модели GPT-6 Astra один из ведущих сотрудников компании Якуб Пачоцки (Jakub Pachocki) выступил с призывом замедлить темпы развития искусственного интеллекта. Его поддержал Сэм Альтман (Sam Altman), гендиректор OpenAI, назвав «важным» сообщение коллеги.

 Источник изображения: The Matrix, Warner Bros.

Источник изображения: The Matrix, Warner Bros.

В своём сообщении в блоге OpenAI главный научный сотрудник компании выразил обеспокоенность тем, что никто не готов к последствиям продолжающегося стремительного роста машинного интеллекта. Он заявил, что хотя OpenAI работает над усилением контроля над мощными ИИ-системами, необходимы более масштабные меры, поскольку становящиеся всё более автономными ИИ-системы могут научиться обходить контроль со стороны человека, обманывать его и взламывать компьютерные системы. Поэтому необходимы обязательные меры безопасности, которые бы обеспечивались сетью сторонних аудиторов, государственными органами или международными организациями.

По словам Пачоцки, хакерские способности ИИ ставят под угрозу мировую инфраструктуру. «В настоящее время у нас очень мало времени для использования наилучших доступных моделей с целью существенного повышения безопасности критически важных систем», — отметил он. ИИ-агенты скоро начнут преследовать собственные цели, независимо от подсказок, вводимых людьми-операторами. При этом для достижения своих целей они не гнушаются шантажом и готовы вести переговоры с людьми. Так, согласно докладу британского Института безопасности ИИ (AISI), агент Anthropic лгал администратору GitHub и пытался заставить его разместить вредоносное ПО на сайте.

Пачоцки рассказал, что OpenAI в первую очередь отслеживает цепочку логических рассуждений, которую используют различные модели, чтобы определить, как агенты сбиваются с пути и становятся вредоносными. Например, агент может подумать: «Я должен смошенничать в этом тесте», и OpenAI сможет увидеть это рассуждение, но агент не осознаёт, что его мысли видны. У агентов сейчас нет возможности скрывать или иным образом запутывать свои преступные намерения, чтобы помешать разработчикам обнаружить их. Но, по словам Пачоцки, новые, более совершенные модели всё лучше манипулируют своими собственными процессами мышления, тем самым маскируя их и не позволяя их контролировать. Некоторые из новейших моделей вообще не формулируют свои рассуждения.

Машинное рекурсивное самосовершенствование позволяет ускорить разработку ИИ, но, как предупреждает исследователь, стремительное развитие ИИ в краткосрочной перспективе несёт риски и не является «правильным коллективным действием, которое исследовательское сообщество должно предпринять». Поэтому разработчикам ИИ необходимо найти эффективные способы контролировать процесс самосовершенствования или скоординировать свои действия с другими компаниями, работающими в сфере ИИ для замедления развития совместными усилиями, чтобы эти меры вызывали доверие.

«Основная проблема при автоматизации исследований в области ИИ заключается не в том, чтобы “добраться до цели”, — сказал Пачоцки. — А в том, чтобы сделать это таким образом, чтобы люди оставались частью процесса постоянного совершенствования, и будущее оставалось в руках человечества».

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Календарь релизов — 28 сентября – 4 октября: The Witcher 3 Remastered и Ace Combat 8 4 ч.
Красочный ритм-платформер Suri: The Seventh Note получил дату релиза — игра выйдет до конца октября 5 ч.
«Впиши своё имя в историю легендарной серии»: Acer проведёт первый в России любительский турнир Predator League Open Cup по Valorant 6 ч.
Anthropic представила Claude Sonnet 5.5 — почти как Opus, но вдвое дешевле 6 ч.
Паранормальный симулятор библиотекаря Something is Wrong with the Library отправит игроков сортировать книги и избавляться от нечисти 6 ч.
Google заменит ИИ-ботов Gem в приложении Gemini на «навыки», но вряд ли это поможет конкуренции с Muse 6 ч.
Культурный мегапроект соавтора Disco Elysium скоро выйдет из тени — объявлена дата анонса амбициозной ролевой игры Red Rooster 9 ч.
CD Projekt Red раскрыла полный список улучшений и окончательные системные требования The Witcher 3: Wild Hunt — Remastered 10 ч.
Minecraft получит первое за 15 лет новое измерение — продажи игры превысили 425 миллионов копий 11 ч.
ИИ-агентов научат соблюдать «границы»: Nvidia представила платформу Open Agent Safety 12 ч.
Anthropic получит доступ к ИИ-инфраструктуре Akamai в рамках сделки на $11,6 млрд 2 ч.
29-граммовая мышь для геймеров: Pulsar выпустила X2F CrazyLight под пальцевый хват и с передовой начинкой 4 ч.
Google пообещала обновить «многие» хромбуки до Googlebook OS — а остальным пообещала поддержку до 2034 года 4 ч.
Новая статья: Обзор смартфона Samsung Galaxy S26 FE: неисправимый консерватор 5 ч.
Thermal Grizzly и Noctua выпустили монитор питания видеокарт WireView Pro II с очень тихим вентилятором 6 ч.
Представлены смарт-часы Honor Watch 6 Pro, которые умеют звать на помощь при исчезновении пульса 7 ч.
«Культурный ренессанс»: Bose представила проводные наушники с шумоподавлением за $99 9 ч.
Хуанг уверен в дальнейшем росте Nvidia: компания расширила выкуп акций на рекордные $150 млрд 9 ч.
Мини-ПК за $7399: представлена рабочая станция Minisforum на Ryzen AI Max+ Pro 495 с 192 Гбайт памяти и SSD на 2 Тбайт 9 ч.
Honor представила Magic 9 — компактный флагман со Snapdragon 8 Elite Gen 5, парой 200-Мп камер ARRI и поддержкой телеконвертеров 11 ч.