22.09.2026

SpaceXAI представила Grok 4.7 с усиленным программированием и новым уровнем защиты

SpaceXAI представила новую флагманскую языковую модель Grok 4.7, ориентированную прежде всего на программирование, длительные вычислительные задачи и сложную профессиональную работу. По сравнению с предыдущей версией разработчики увеличили масштаб базовой модели и значительно расширили этап обучения с подкреплением, уделив особое внимание задачам, выполнение которых может занимать несколько часов.

Одним из главных направлений улучшения стала способность модели проверять собственные результаты. Grok 4.7 должна лучше выявлять ошибки в ходе длинных цепочек рассуждений, стабильнее работать с большим контекстом и эффективнее сохранять последовательность при выполнении многоэтапных задач. Также модель получила более глубокую интеграцию с оболочкой Grok Bot.

В тесте GDPval, предназначенном для оценки качества профессиональных документов и презентаций, Grok 4.7 получила 1695 баллов. Для сравнения, результат GPT-6 Astra составил 1542 балла. При этом отдельный бенчмарк не позволяет сделать универсальный вывод о превосходстве одной модели над другой, поскольку разные тесты измеряют разные типы задач и используют собственную методику подсчета.

Заметный рост разработчики заявляют и в программировании. В CursorBench 4.0 новая модель набрала 46,3%, тогда как GPT-5.6 Sol показала 41,7%. В DeepSWE v1.1 при использовании режима глубоких рассуждений результат Grok 4.7 достиг 71%. Эти испытания ориентированы на выполнение практических задач разработки программного обеспечения.

Большое внимание при выпуске уделили безопасности. Для Grok 4.7 переработали систему защитных механизмов, рассчитанную на противодействие обходу ограничений и джейлбрейкам. В тесте LatchBio, связанном с биологической безопасностью, модель получила показатель 62,4%, а в HackerBench v0.3 пропустила 3,3% потенциально рискованных запросов двойного назначения.

При этом разработчики старались сохранить доступ к инструментам, которые могут использоваться для законных исследований в области информационной безопасности. Отдельные партнерские компании получили возможность проводить редтиминг Grok 4.7 и проверять ее устойчивость в сценариях, связанных с цифровой обороной и попытками обхода защитных механизмов.

Стоимость работы через API по сравнению с предыдущим поколением не изменилась. Обработка 1 млн входных токенов стоит $2, а 1 млн выходных — $6. Для сравнения, тарифы GPT-5.6 Sol составляют $4 за 1 млн входных и $20 за 1 млн выходных токенов, поэтому Grok 4.7 позиционируется как более доступный вариант для задач, требующих большого количества генерации.

Для сценариев, где особенно важна скорость отклика, предусмотрена ускоренная версия модели. Она генерирует ответы примерно вдвое быстрее стандартного режима, но и стоимость ее использования увеличивается примерно в два раза. Такой вариант рассчитан прежде всего на интерактивные приложения и сервисы, где задержка ответа имеет критическое значение.

Grok 4.7 уже начала появляться в сторонних продуктах и облачных сервисах. В частности, модель интегрирована в Cursor и среду Grok Build. Это позволяет использовать ее не только как обычного чат-бота, но и как основу для программных агентов, автоматизации разработки и выполнения продолжительных рабочих процессов.

Выход Grok 4.7 продолжает тенденцию к специализации передовых ИИ-моделей. Разработчики все чаще конкурируют не только по общим возможностям чат-ботов, но и по эффективности программирования, стоимости API, продолжительности автономной работы и надежности защитных механизмов. При этом результаты отдельных бенчмарков остаются лишь одним из ориентиров и не отражают качество модели во всех реальных сценариях.

Добавить комментарий