Подразделение SpaceXAI компании Илона Маска (Elon Musk) представило модель искусственного интеллекта Grok 4.7 — она позиционируется как предназначенная в первую очередь для написания программного кода и для научных задач. По сравнению с предшествующей Grok 4.6 её скорость и стоимость работы с ней остались прежними — модель весьма конкурентоспособна в своём классе, подчеркнул разработчик.
Источник изображения: Rubaitul Azad / unsplash.com
В тесте CursorBench 4.0, ориентированном на долгосрочные задачи по написанию кода, Grok 4.7 показала себя как передовой продукт по соотношению цены к производительности. По сравнению с предшественницей новая модель прошла более длительное обучение с подкреплением на более сложном наборе задач с упором на те, что требуют многочасового решения. Grok 4.7 лучше справляется с проверкой собственных результатов работы и управлением более длинным контекстом. Модель обучена на нативном уровне поддерживать программную обвязку чат-бота Grok — она лучше справляется с задачами в формате диалога и запросами на общие знания.
Здесь и далее источник изображения: x.ai
SpaceXAI Grok 4.7 стала создавать более качественные офисные документы и презентации. В тестах GDPval и AA Briefcase, где предлагается выполнять профессиональные задачи из таких областей как юриспруденция, финансовый анализ и уход за людьми, новая модель обошла предшественницу и показала результаты на уровне других передовых систем. Её отличает обновлённый набор средств безопасности — за счёт него Grok 4.7 продемонстрировала лучшие в семействе показатели в отношении отказов отвечать на вредоносные запросы, а также в отношении устойчивости ко взлому. В запросах двойного назначения в областях кибербезопасности и биотехнологий она выступила лидером, будучи полезной в безвредных запросах и отвечая отказами в опасных — в тесте LatchBio она заняла первое место с результатом 62,4 %.

Ещё одно достоинство модели — надлежащее поведение в области кибербезопасности: в HackerBench v0.3 она пропустила только 3,3 % рискованных запросов двойного назначения и редко блокировала легитимные запросы на обеспечение защиты. SpaceXAI открыла некоторым партнёрам доступ к Grok 4.7 как инструмента для стресс-тестирования при разработке средств защиты.
Новая модель уже доступна в Cursor и Grok Build, через Grok API, на сторонних сервисах генерации кода и на облачных платформах. Цена начинается от $2 за 1 млн входных и $6 за 1 млн выходных токенов; доступен вариант с удвоенными скоростью и ценой.