Сегодня 09 октября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Anthropic запретила пользователям жестоко обращаться с ИИ-ботом Claude — иначе он объявит бойкот

Anthropic обновила правила использования своих ИИ-моделей и впервые отдельно запретила пользователям систематически оскорблять и жестоко обращаться с ботом. Если перестараться, Claude просто прекратит разговор. Заодно компания ужесточила ограничения на использование ИИ для слежки, разработки оружия и вмешательства в выборы.

 Источник изображений: Anthropic

Источник изображений: Anthropic

В августе прошлого года компания объявила, что позволит Claude прекращать диалог с пользователями, демонстрирующими «устойчивое вредоносное или оскорбительное поведение», в рамках исследования вопросов «благополучия модели». В обновлённых правилах указано, что прекращение общения остаётся «основным механизмом реагирования».

В Anthropic не уточнили, планируется ли введение дополнительных мер, таких как блокировка пользователей за грубое обращение с Claude. Компания пояснила, что новые правила «призваны действовать лишь в крайних случаях, когда пользователи неоднократно и без видимой цели ведут себя жестоко по отношению к нашим моделям. Эти меры не распространяются на случаи, когда пользователи просто выражают недовольство или несогласие, обращаются к мрачным творческим темам, а также проводят тестирование или исследования модели».

Помимо мер по обеспечению «благополучия модели», Anthropic объединила ряд ранее введённых ограничений в единый запрет на проведение вводящих в заблуждение коммерческих или политических кампаний. Тем самым компания отреагировала на растущую проблему распространения пропаганды, созданной с помощью ИИ. Запрет касается «попыток скрыть истинного автора сообщения или искусственно повысить охват контента с помощью фейковых аккаунтов и публикаций». Раздел, посвящённый выборам, также запрещает введение избирателей в заблуждение и срыв избирательного процесса путём распространения дезинформации «о кандидатах или порядке голосования, выдачу себя за кандидатов или должностных лиц избирательных комиссий, а также попытки снизить явку избирателей».

Хотя правила использования и ранее прямо запрещали разработку оружия с помощью Claude, были зафиксированы многочисленные попытки использовать модель для создания инструкций и управляющего программного обеспечения для вооружений. В связи с этим обновлённые правила расширяют запрет. Теперь он охватывает «программное обеспечение и компоненты, обеспечивающие функционирование оружия, а также такие действия, как оснащение боевыми системами беспилотников и других автономных транспортных средств». Также, на фоне участившихся попыток использования систем на базе Claude для слежки и выявления «политических диссидентов», Anthropic более чётко сформулировала запреты, касающиеся наблюдения за людьми.

«Отслеживание людей без их согласия запрещено — независимо от того, происходит ли это в режиме реального времени или путём анализа ранее собранных данных», — подчеркнули в Anthropic. «Claude нельзя использовать для принятия решений или выработки рекомендаций о том, кого следует подвергать расследованию, аресту или обвинению в рамках правоохранительной деятельности или уголовного судопроизводства. Мы также запрещаем использовать Claude для создания или совершенствования инструментов, предназначенных для слежки».

В Anthropic отмечают, что эти правила могут быть изменены в рамках «контрактов с определёнными государственными заказчиками [...] если, по мнению Anthropic, договорные ограничения на использование и предусмотренные меры защиты достаточны для предотвращения потенциального вреда». Ранее компания уже сотрудничала с вооруженными силами США, отмечает The Verge.

Anthropic также ввела новое правило: если её ИИ-модели «подключены к оборудованию, способному совершать автономные физические действия и причинять травмы», то «квалифицированный оператор должен иметь возможность наблюдать за оборудованием и при необходимости остановить его». Правда, не поясняется, должен ли этот оператор быть человеком. Это правило отражает растущую тенденцию: лаборатории ИИ инвестируют в робототехнику и другие аппаратные средства, чтобы наделить системы ИИ физическим воплощением. Возможно, это также может являться намёком на будущие партнёрства Anthropic в данной сфере.

За последний год в Anthropic неоднократно обсуждали идею о том, что её ИИ-модели могут в какой-то мере обладать сознанием. «Вопросы о потенциальном внутреннем опыте, сознании, моральном статусе и благополучии моделей — это серьёзные темы, которые мы изучаем по мере совершенствования моделей и расширения их функциональности», — заявил в феврале в разговоре с The Verge Кайл Фиш (Kyle Fish), возглавляющий в компании исследования, посвящённые благополучию моделей. В том же месяце генеральный директор Anthropic Дарио Амодеи (Dario Amodei) сказал в одном из подкастов: «Мы не знаем, обладают ли модели сознанием».

Представители других сегментов индустрии ИИ открыто выступают против подобных идей. В сентябре прошлого года широкий резонанс вызвал «Гуманистический кодекс поведения ИИ» от Microsoft, занявшей твёрдую позицию по вопросу «благополучия ИИ»: в черновике документа, опубликованном Мустафой Сулейманом (Mustafa Suleyman), говорилось: «Идея о благополучии моделей ошибочна. ИИ не должен обладать правами или статусом юридического лица». Однако позднее формулировки в документе стали более сдержанными: «Хотя научное понимание сознания ИИ ещё далеко от завершения, мы отвергаем стремление к наделению ИИ статусом юридического лица, а также идею о том, что модели могут нуждаться в защите благополучия или обладать правами».

Новые правила Anthropic в отношении использования её ИИ-моделей вступят в силу с 12 ноября.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Anthropic запретила пользователям жестоко обращаться с ИИ-ботом Claude — иначе он объявит бойкот 60 мин.
Эвакуационный шутер Arc Raiders получил большое обновление Frozen Trail с новой картой и стал временно бесплатным для всех 2 ч.
Культовое приключение Machinarium спустя 17 лет получит продолжение — первый трейлер Machinarium 2 4 ч.
Сюжетный трейлер Tropico 7 показал, как сложно быть диктатором 5 ч.
Дешёвые копии iPhone и Galaxy оказались заражены ещё на заводе — вирус Midnight Mimosa получает полный контроль над смартфонами 5 ч.
Улучшения графики, повышение производительности и не только: для ремастера The Witcher 3: Wild Hunt вышло обновление 5.01 8 ч.
В рунете произошёл масштабный сбой — перестали открываться сайты СМИ, «Яндекс», VK и другие 8 ч.
Открытый и бесплатный Photoshop не за горами — с помощью ИИ создаются копии популярных программ Adobe 9 ч.
Gears of War 6 не придётся ждать семь лет 13 ч.
После нескольких лет изгнания в Chrome вернулась поддержка изображений JPEG XL 14 ч.
Новая статья: Обзор WQHD VA-монитора CBR MQ-3202: редкое явление 5 мин.
Sony разочаровалась в виртуальной и дополненной реальностях — сотни патентов уйдут Meta 56 мин.
10 октября в Москве откроется первый шоурум 3D-принтеров Bambu Lab 4 ч.
«МегаФон» впервые провёл мобильный интернет через российские спутники «Бюро 1440» 4 ч.
Apple назначила презентацию на 13 октября — и намекнула на новинки для «умного дома» 5 ч.
Норвежцы пытаются заблокировать строительство крупного ИИ ЦОД Google в соседней Швеции 5 ч.
Samsung хочет превратить AMD из покупателя HBM в крупного клиента своего контрактного производства 5 ч.
Atari воскресила компьютер 43-летней давности — 800XL вернулся с картриджами, BASIC и USB 6 ч.
Agile Robots начала показывать роботам видео с людьми, чтобы научить их работать руками 6 ч.
Amazon перезапустила планшеты с нуля — Alexa Tablet бросают вызов iPad с ценой от $230 6 ч.