SpaceXAI презентует Grok 4.7: новое слово в программировании и агентных задачах
21 сентября SpaceXAI анонсировала Grok 4.7 — свежую модель, ориентированную на программирование, агентные задачи и обработку знаний. Она представляет собой значительное улучшение по сравнению с Grok 4.6, сохранив прежнюю цену и скорость.
В новой версии использована более крупная базовая модель. Разработчики значительно увеличили продолжительность обучения с подкреплением, добавив множество сложных задач, выполнение которых требует нескольких часов.
Grok 4.7 улучшает верификацию своих выводов и эффективнее справляется с длинными контекстами. Модель также адаптирована для работы с агентной средой Grok Bot.
В тестах CursorBench 4.0 Grok 4.7 показала результат 46,3%, обогнав Grok 4.6 с 40,4%. Для сравнения, GPT-5.6 Sol достигла 41,7%, а Claude Fable 5.1 — 51,8%.
В тесте AA Briefcase на длительные задачи Grok 4.7 набрала 1657 баллов Elo, превзойдя предшественницу с ее 1546. В EEBench результаты выросли с 53% до 64%, а в Harvey Legal Agent Benchmark — с 15,8% до 19,6%.
Независимая Artificial Analysis оценила Grok 4.7 в 46 баллов по Intelligence Index, что на два пункта выше Grok 4.6. В связке с Grok Build модель получила 56 баллов в Coding Agent Index против 47 у предшественницы.
Среди моделей в агентных средах Grok 4.7 заняла четвертое место после Claude Fable 5.1, GPT-6 Astra и Claude Opus 5. Однако новая версия потребляет значительно больше токенов на сложных задачах.
В режиме xhigh Grok 4.7 использовал в среднем 81 000 выходных токенов, в отличие от 36 000 у Grok 4.6. При запросах до 200 000 токенов стоимость составляет $2 за 1 млн входных, $0,50 за кэшированные, и $6 за 1 млн выходных токенов. Для более длинных запросов тарифы удваиваются.
Модель поддерживает контекстное окно в 500 000 токенов и обрабатывает текст и изображения, генерируя текст. Доступны четыре уровня глубины рассуждений: low, medium, high и xhigh.
SpaceXAI также запустила Grok 4.7 Fast — ту же модель с удвоенной скоростью генерации и вдвое большей стоимостью. Она доступна только в Cursor и Grok Build, но не через публичный API.
Компания заявила о полной переработке системы безопасности модели. В тестах HackerBench v0.3 она пропустила 3,3% опасных запросов, а в LatchBio по биобезопасности получила 62,4%.
В августе SpaceXAI выпустила Grok 4.6. Она также имела контекстное окно на 500 000 токенов и базовый тариф $2 за входные и $6 за выходные токены.