Работать над сложными задачами часами, проверяя свой код, и при этом стоить вдвое дешевле конкурентов — это новая планка для AI-моделей. XAI представила Grok 4.7, свою новейшую модель для кодирования и интеллектуальной работы, которая предлагает повышенную автономность, безопасность и агрессивную ценовую политику.
Grok 4.7 базируется на новой, более крупной модели, обученной на сложных задачах с упором на те, что требуют многочасового выполнения. Модель лучше проверяет свою работу и управляет длинным контекстом в 500 тысяч токенов. Она нативно понимает Grok Bot harness, что улучшает её в диалоговых и общеобразовательных задачах. XAI позиционирует Grok 4.7 как свою самую способную модель для кодирования и интеллектуальной работы.
На бенчмарке CursorBench 4.0 для длительных задач кодирования Grok 4.7 показала 46.3%, а на DeepSWE v1.1 — 71.0%. В области агентской интеллектуальной работы Grok 4.7 занимает лидирующие позиции: на бенчмарке AA-Briefcase для многочасовых задач модель набрала 1657 Elo, уступив лишь Claude Opus 5 и Claude Fable 5.1. В задачах кодирующих агентов (Artificial Analysis Coding Agent Index) Grok 4.7 с Grok Build поднялась до 56 баллов, заняв четвёртое место после Claude Fable 5.1, GPT-6 Astra и Claude Opus 5. Общий индекс интеллекта Artificial Analysis Intelligence Index для Grok 4.7 составил 46, выводя xAI в топ-4 AI-лабораторий. Однако эти улучшения сопровождаются повышенным потреблением токенов: Grok 4.7 использует до 81 тысячи выходных токенов на задачу, что на 125% больше, чем Grok 4.6, и на 196% больше, чем GPT-6 Astra.
Стоимость Grok 4.7 составляет $2 за миллион входных токенов и $6 за миллион выходных токенов. Это вдвое дешевле, чем у GPT-5.6 Sol ($4/$20), и дешевле, чем у Fable 5.1 ($10/$50). Для задач, где важна скорость, доступен быстрый вариант с удвоенной скоростью вывода по удвоенной цене. Модель доступна через Grok API, платформы Cursor и Grok Build, а также сторонние инструменты для кодирования и облачные сервисы. Уровень рассуждений можно настроить от низкого до xhigh.
Grok 4.7 получила полностью новый стек защиты, став самой устойчивой моделью к отказам и джейлбрейкам. В сферах двойного назначения, таких как кибербезопасность и биотехнологии, модель лидирует по полезности для безопасных задач и по отказу от опасных запросов, показав 62.4% на бенчмарке LatchBio. На HackerBench v0.3, бенчмарке для рискованных киберзадач, Grok 4.7 пропустила только 3.3% опасных запросов, почти не блокируя при этом легитимную работу по безопасности. XAI также предоставляет избранным партнёрам доступ к red-team возможностям Grok 4.7 для исследовательских целей в области защиты.
Grok 4.7 выходит на рынок как и экономичный инструмент, особенно для задач, требующих автономности и самопроверки. Его агрессивная ценовая политика и фокус на безопасности делают его серьёзным конкурентом, однако повышенный расход токенов для сложных запросов может нивелировать часть экономии при масштабировании.