Сегодня 30 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

ИИ-боты начинают чаще привирать, когда их просят о лаконичных ответах — исследование

Исследователи из французской компании Giskard, занимающейся тестированием искусственного интеллекта, пришли к выводу, что чем короче ответы ChatGPT и других ИИ-помощников, тем выше вероятность выдачи недостоверной информации. Такие запросы, как «ответь кратко» или «объясни в двух предложениях» заставляют модели привирать и быть неточными.

 Источник изображения: AI

Источник изображения: AI

Как пишет TechCrunch, в ходе исследования специалисты проанализировали поведение популярных языковых моделей, включая GPT-4o от OpenAI, Mistral Large и Claude 3.7 Sonnet от Anthropic и установили, что при запросах на краткие ответы, особенно по неоднозначным или спорным темам, модели чаще выдают ошибочную информацию. «Наши данные показывают, что даже простые изменения в инструкциях значительно влияют на склонность моделей к галлюцинациям», — отметили в Giskard.

Галлюцинации остаются одной из главных нерешённых проблем в области генеративного ИИ. Даже передовые модели, основанные на вероятностных алгоритмах, могут придумывать несуществующие факты. По словам авторов исследования, новые модели, ориентированные на рассуждение, такие как o3 от OpenAI, склонны к галлюцинациям даже чаще, чем их предшественники, что не может не снижать доверие к их ответам.

Отмечается, что одной из причин повышенной склонности к ошибкам является ограниченность пространства для объяснений. Когда модель просят быть краткой, она не может полностью раскрыть тему и опровергнуть ложные предпосылки в запросе. Однако этот момент очень важен для разработчиков кода, поскольку промпт, содержащий инструкцию типа «будь кратким» может навредить качеству ответа.

Кроме того, было замечено, что модели реже опровергают спорные утверждения, если их высказывают уверенно. Также оказалось, что те ИИ, которые пользователи чаще оценивают как удобные или приятные в общении, не всегда отличаются высокой степенью точности ответов.

Эксперты из Giskard советуют тщательнее подбирать инструкции для ИИ и избегать строгих ограничений на длину ответов. «Кажущиеся безобидными подсказки вроде "будь лаконичным" могут незаметно ухудшить качество информации», — предупреждают они.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Grokipedia Илона Маска внезапно ожила после месяцев без обновлений 2 ч.
Orion soft представил собственный протокол доставки виртуальных рабочих столов и приложений в обновлении Termit 3 ч.
OpenAI своими новыми функциями бросила вызов традиционной модели магазинов приложений 5 ч.
Журналисты раскрыли новые скриншоты и подробности GTA VI — животный мир, переработанная погода из RDR 2 и думскроллинг 6 ч.
Cloud.ru разместит второй выпуск биржевых облигаций объёмом не менее 10 млрд рублей 12 ч.
Платформа NVIDIA Open Agent Safety Platform обеспечит безопасное использование ИИ-агентов — от тестирования до развёртывания 12 ч.
На OpenAI подали в суд за взлом Hugging Face и игнорирование рисков автономного ИИ 13 ч.
OpenAI бросила вызов Microsoft — ChatGPT получил свой пакет офисных приложений 14 ч.
OpenAI отвязала Codex от компьютера разработчика — ИИ получил постоянные облачные рабочие пространства 14 ч.
OpenAI представила GPT‑6.1 Sol — почти как флагманская GPT‑6 Astra в сложных задачах, но в пять раз дешевле 14 ч.
Россияне стали покупать меньше смартфонов — Redmi лидирует в штуках, а Samsung впервые обошла Apple по деньгам 3 мин.
Учёные нащупали источник загадочных рентгеновских вспышек из глубин Вселенной — две мёртвые звезды столкнулись 19 мин.
Роботы-доставщики в России получили свои ПДД — до 25 км/ч по велодорожке и не больше 10 км/ч по тротуару 37 мин.
Всего за два месяца Apple может забрать четверть рынка складных смартфонов с iPhone Duo 44 мин.
Anthropic признала опасную зависимость от Amazon и Google — они одновременно являются её покупателями, продавцами и конкурентами 2 ч.
Вышел вычислительный модуль Walnut Pi CM2 — альтернатива Raspberry Pi CM5 на платформе Allwinner 4 ч.
Лондонцам завезут тепло от ЦОД — на баржах и по трубам 4 ч.
OpenAI вышла на годовой объём выручки $70 млрд и собирается привлечь ещё $30 млрд до IPO 5 ч.
Американские ИИ-гиганты в присутствии Трампа договорились о саморегулировании в области безопасности 5 ч.
Gigabyte выпустила Micro-ATX-плату B760M Aorus Ari WiFi6E в аниме-дизайне, с поддержкой графики PCIe 5.0 и DDR4 9 ч.