Релиз Grok 4.6: производительность агента сопоставима с GPT-5.6 Sol, при меньших затратах
SpaceXAI выпустила Grok 4.6 12 августа 2026 года, позиционируя его как передовую модель для программирования, длительных агентных задач и интеллектуальной работы. Модель напрямую построена на основе Grok 4.5, b

Релиз Grok 4.6: агентная производительность на уровне GPT-5.6 Sol при меньших затратах
Введение
SpaceXAI выпустила Grok 4.6 12 августа 2026 года, позиционируя его как передовую модель для программирования, длительных агентных задач и интеллектуальной работы.
Модель построена непосредственно на основе Grok 4.5, но с более сфокусированным и прагматичным акцентом: сохранение эффективности в более длительных непрерывных рабочих процессах, использование инструментов на протяжении нескольких шагов и генерация более качественных первых версий для интерактивных и визуальных приложений.
По данным SpaceXAI и Cursor, Grok 4.6 теперь сравнялся с GPT-5.6 Sol по индексу интеллекта Artificial Analysis, при этом демонстрируя особенно выдающиеся результаты в реальных агентных оценках, таких как GDPval-AA v2 и AA-Briefcase.
В оригинальной статье AIBase также особо отмечаются цены и скорость обслуживания Grok 4.6. Ценовое преимущество полностью подтверждается официальной документацией. Данные о скорости требуют более детальной интерпретации: AIBase сообщает о 80 TPS, в то время как Artificial Analysis в настоящее время измеряет скорость первого-party API Grok 4.6 примерно в 68 выходных токенов в секунду. Скорость выполнения варьируется в зависимости от инфраструктуры, длины подсказки, интенсивности рассуждений и загрузки провайдера.
Grok 4.6 построен на основе Grok 4.5
Grok 4.6 представляет собой инкрементальное поколение моделей, а не выпуск с совершенно новой архитектурой.
SpaceXAI сообщает, что новая модель прошла более длительное дополнительное обучение по сравнению с Grok 4.5. Состав обучающих данных включает:
- Отобранные данные рассуждений, сгенерированные моделью
- Продвинутые технические концепции
- Высококачественные инженерные данные
- Улучшенные оптимизатор и рецептура обучения
- Контролируемую тонкую настройку, охватывающую различные уровни интенсивности рассуждений и агентные фреймворки
- Агентное обучение с подкреплением, ориентированное на программирование, интеллектуальную работу и профессиональные технические среды
Компания также заявляет, что Grok 4.5 использовалась для регенерации траекторий контролируемой тонкой настройки для задач STEM, программной инженерии и интеллектуальной работы, а фильтры на основе моделей применялись для удаления проблемных следов.
Основа Grok 4.5
Grok 4.5 ранее уже завершила обучение в сверхбольшом масштабе.
SpaceXAI официально сообщает, что обучение Grok 4.5 использовало десятки тысяч GPU NVIDIA GB300. Обучающие данные охватывали программирование, науку, инженерию и математику, в то время как обучение с подкреплением было в основном сосредоточено на многошаговых задачах программной инженерии и других долгосрочных технических работах.
Grok 4.6 является расширением этой основы, а не её заменой.
Наиболее важное изменение — акцент на продолжительном агентном поведении: модель должна не просто решать изолированные задачи программирования, а сохранять связность в процессе исследования, редактирования файлов, использования инструментов, тестирования собственной работы и итераций с многократной обратной связью.
Фокус обучения: длительные агентные задачи
SpaceXAI заявляет, что Grok 4.6 обучалась на широком наборе задач агентного обучения с подкреплением.
Эти среды включают:
- Интеллектуальную работу
- Общее программирование
- Оптимизацию ядра
- Веб-разработку
- Системы автоматизированного проектирования
- Другие специализированные технические задачи в различных областях
Это помогает объяснить, почему модель показывает наилучшие результаты в оценках, связанных с расширенной работой, а не с короткими ответами на рассуждения.
Улучшенные первые версии для визуальных и интерактивных проектов
SpaceXAI и Cursor также подчёркивают
способность модели превращать широкие продуктовые концепции в работоспособные первые версии.
Во внутренних тестах Grok 4.6 способна:
- Исследовать незнакомые области.
- Выстраивать структуру приложения.
- Реализовывать основные интерактивные функции.
- Определять визуальное направление.
- Тестировать части собственного вывода.
- Постоянно улучшать результаты в ходе многочисленных итераций.
Это не означает, что каждое одноразово сгенерированное приложение уже достигло производственного уровня. Это лишь говорит о том, что компания обнаружила: качество начального вывода превосходит Grok 4.5, особенно когда задача требует сочетания кода, дизайна, интерактивности и итеративного использования инструментов.
Grok 4.6 сравнялась с GPT-5.6 Sol по индексу интеллекта Artificial Analysis
Artificial Analysis в настоящее время оценивает Grok 4.6 (высокая версия) в 61 балл по индексу интеллекта.
Это совпадает с общим баллом GPT-5.6 Sol (максимальная версия) в сравнительных данных, опубликованных SpaceXAI.
Этот индекс является совокупным результатом девяти оценок, а не单一 теста, поэтому его лучше использовать как широкий сравнительный сигнал, а не как доказательство того, что обе модели демонстрируют абсолютно одинаковую производительность во всех рабочих нагрузках.

Прилагаемая к релизу таблица бенчмарков содержит следующие результаты:
| Бенчмарк | Grok 4.6 High | Grok 4.5 High | GPT-5.6 Sol Max | Fable 5 Max |
|---|---|---|---|---|
| AA Intelligence Index | 61 | 56 | 61 | 62 |
| GDPval-AA v2 | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69,9% | 66,7% | 67,2% | 70,5% |
| DeepSWE v1.1 | 65,9% | 54,0% | 73,0% | 70,0% |
| FrontierCode v1.1 Extended | 61,3% | 56,6% | 60,6% | 63,6% |
| APEX-Agents | 57,5% | 47,1% | 56,7% | 59,2% |
| Terminal-Bench v3.0 | 26,0% | 15,7% | 34,6% | 34,1% |
| APEX-SWE | 56,4% | 53,6% | — | 58,8% |
| AA-Briefcase | 1577 | 1313 | 1502 | 1574 |
| Harvey LAB (Vals) | 15,8% | 12,9% | 2,5% | 11,3% |
Ранжирование бенчмарков меняется по мере обновления моделей, тестовых фреймворков и версий оценок. Приведённая выше таблица отражает результаты на момент релиза и не является постоянным рейтингом.
GDPval-AA v2: высокая производительность в реальной интеллектуальной работе
В GDPval-AA v2 Grok 4.6 получила оценку 1753 Elo.
Artificial Analysis описывает GDPval-AA v2 как реальную агентную оценку интеллектуальной работы, охватывающую множество профессиональных профессий.
На момент публикации анализа Grok 4.6 Artificial Analysis сообщила, что этот балл уступает лишь серии Claude Opus 5, при этом доверительные интервалы пересекаются с другими ведущими моделями (такими как Claude Fable 5 и Qwen3.8 Max).
Это более строгая формулировка, чем прямое утверждение о том, что Grok 4.6 занимает явное второе место.
Оценки на основе Elo подвержены неопределённости, и близкие баллы могут статистически пересекаться.
AA-Briefcase: длительная агентная работа
Grok 4.6 также получила 1577 Elo в AA-Briefcase.
баллов. Это частный бенчмарк Artificial Analysis для долгосрочной агентной интеллектуальной работы.
Это объясняет его показатели —
В опубликованном снапшоте производительность Grok 4.6 примерно соответствует уровню Fable 5, уступая серии Claude Opus 5.
Его эффективность также заслуживает внимания.
Artificial Analysis сообщает, что Grok 4.6 при выполнении задач AA-Briefcase использует примерно:
- в среднем 53 раунда диалога
- в среднем 500 миллионов входных токенов
Для сравнения, Claude Opus 5 (максимальная версия), по сообщениям, использует примерно:
- 103 раунда диалога
- 2 миллиарда входных токенов
Это не означает, что Grok 4.6 во всех случаях эффективнее Claude Opus 5. Это лишь наблюдение для конкретного бенчмарка. Тем не менее, для долгосрочных интеллектуальных агентов меньшее количество раундов и меньший накопленный контекст могут значительно снизить стоимость задач.
Цены на Grok 4.6: от 2 долларов за входные и 6 долларов за выходные токены
Стандартные публичные цены API остаются одним из сильнейших конкурентных преимуществ Grok 4.6.
Для подсказок, не превышающих порог длинного контекста, документация SpaceXAI указывает следующее:
| Тип токена | Цена за миллион токенов |
|---|---|
| Входные | 2,00 доллара |
| Кэшированные входные | 0,50 доллара |
| Выходные | 6,00 долларов |
Artificial Analysis отмечает, что, несмотря на рост индекса интеллекта с 56 до 61, публичные цены остались неизменными по сравнению с Grok 4.5.
Для сравнения, на момент написания статьи:
- GPT-5.6 Sol стандартное API-ценообразование составляет 5 долларов за миллион входных / 30 долларов за миллион выходных токенов.
- Публичные тарифы Claude Opus 5 выше, чем у Grok 4.6.
Это делает Grok 4.6 особенно привлекательным для высоконагруженных агентных циклов, где выходные токены и повторяющийся контекст часто составляют основную часть затрат.
Длинные подсказки стоят дороже
В официальном релизе SpaceXAI добавлена важная деталь, не упомянутая в краткой статье AIBase.
Для подсказок, превышающих 200 тысяч токенов, Grok 4.6 использует более высокий ценовой уровень:
| Тип токена | Цена за миллион токенов при подсказках свыше 200 тысяч |
|---|---|
| Входные | 4,00 доллара |
| Кэшированные входные | 1,00 доллар |
| Выходные | 12,00 долларов |
Таким образом, «2 доллара за входные / 6 долларов за выходные» — это стартовая цена, а не универсальная для всех запросов.
Быстрый вариант
Cursor указывает, что быстрый вариант оценивается в двойную стандартную цену.
Это отдельное правило от указанного выше для длинных подсказок. В зависимости от платформы и рабочей нагрузки пользователям следует уточнять применимый уровень скорости и контекста перед оценкой производственных затрат.
Что насчёт сообщений о скорости 80 TPS?
В статье AIBase говорится, что Grok 4.6 может работать со скоростью 80 токенов в секунду.
К этой цифре следует относиться с осторожностью.
Официальный анонс SpaceXAI для Grok 4.6 не содержит гарантии фиксированной скорости 80 TPS. Artificial Analysis в настоящее время на своих бенчмарк-нагрузках измеряет скорость вывода Grok 4.6 (high) на собственном API примерно в 67,6 выходных токенов в секунду.
Для сравнения, официальная страница SpaceXAI для Grok 4.5 явно указывает, что Grok 4.5 обслуживается со скоростью 80 TPS.
Таким образом, краткая статья-источник, вероятно, использовала более раннюю цифру 80 TPS или ссылалась на другой уровень обслуживания.
Практический вывод проще:
Grok 4.6 показывает довольно хорошую скорость для前沿推理-модели, но не существует единого фиксированного значения TPS для всех подсказок, провайдеров, уровней推理 или скорости.
Контекст в 500 тысяч на SpaceXAI API
В документации SpaceXAI API контекстное окно для grok-4.6 указано как 500 тысяч токенов.
Модель поддерживает:
- Текстовый ввод
- Ввод изображений
- Текстовый вывод
- Низкий, средний, высокий и очень высокий уровни推理
- Вызов функций
- Поиск в интернете
- Поиск в X
- Выполнение кода
На официальной странице модели также указана дата окончания знаний — 1 февраля 2026 года.
Cursor использует другое ограничение контекста
В документации Cursor для модели Grok 4.6 в настоящее время указано контекстное окно 256k внутри Cursor.
Это не противоречит характеристикам базовой модели. Это означает, что интеграция платформы может предоставлять меньшее ограничение контекста, чем собственный API SpaceXAI.
При сравнении ограничений моделей всегда проверяйте конкретного провайдера и способ интеграции.
Как использовать Grok 4.6 через API
Официальный идентификатор модели SpaceXAI:
grok-4.6
Минимальный запрос к Responses API выглядит так:
curl https://api.x.ai/v1/responses \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $XAI_API_KEY" \
-d '{
"model": "grok-4.6",
"input": "Найди и исправь баг, затем объясни его: function median(a){a.sort();return a[a.length/2]}"
}'
Эта же модель доступна через официальный SDK xAI и клиенты, совместимые с OpenAI API.
Пример на Python
import os
from xai_sdk import Client
from xai_sdk.chat import user
client = Client(api_key=os.getenv("XAI_API_KEY"))
chat = client.chat.create(model="grok-4.6")
chat.append(
user(
"Найди и исправь баг, затем объясни его: "
"function median(a){a.sort();return a[a.length/2]}"
)
)
response = chat.sample()
print(response.content)
Для долгосрочных агентных циклов SpaceXAI рекомендует использовать кэширование подсказок и сжатие контекста, где это уместно, чтобы снизить затраты на повторяющийся контекст.
Grok 4.6 доступен в Cursor и Grok Build
На момент выхода Grok 4.6 доступен на следующих платформах:
- Cursor
- Grok Build
- SpaceXAI API
- OpenRouter
- Vercel
- Cloudflare
SpaceXAI и Cursor также предоставляют двойное включённое использование в первую неделю в Cursor и Grok Build.
Эта промоакция на запуск ограничена по времени и не должна рассматриваться как постоянное ценообразование.
Grok 4.6 в Cursor
Cursor отображает Grok 4.6 с четырьмя уровнями интенсивности推理:
- xhigh
- high
- medium
- low
high — уровень推理 по умолчанию.
В соответствующих тарифных планах Cursor также доступен быстрый уровень скорости.
Внутри Cursor модель может использовать инструменты платформы для выполнения следующих задач:
- Поиск файлов и папок
- Чтение файлов
- Редактирование файлов
- Выполнение shell-команд
- Просмотр веб-страниц
- Тестирование приложений на основе браузера
- Генерация изображений
- Получение правил проекта
Это одна из причин, почему в релизе Grok 4.6 так много внимания уделено агентным бенчмаркам: предполагаемое использование не ограничивается изолированными чат-ответами.
Grok 4.6 наиболее силён в задачах, требующих непрерывной работы
Режим бенчмарков показывает, что наибольший прогресс Grok 4.6 заключается не только в статическом мышлении.
Его улучшения наиболее заметны, когда задачи включают:
- Многошаговость
- Использование инструментов
- Исследования
- Работу с кодом или документами
- Самопроверку
- Длинный контекст
- Итеративную оптимизацию
Это делает его особенно подходящим для:
- Агентов-программистов
- Работы с программным обеспечением уровня репозитория
- Исследовательских агентов
- Рабочих процессов с электронными таблицами и документами
- Технического анализа
- Прототипирования веб-приложений
Длительных задач на основе знаний.
Для коротких простых запросов это преимущество может быть неочевидным.
Что могут и не могут доказать бенчмарки
Опубликованные данные подтверждают следующие чёткие выводы:
- В нескольких бенчмарках для агентов Grok 4.6 заметно превосходит Grok 4.5.
- В текущем сравнении Artificial Analysis Intelligence Index он находится на одном уровне с GPT-5.6 Sol.
- Он особенно силён в GDPval-AA v2 и AA-Briefcase.
- Его стандартная публичная цена API значительно ниже, чем у GPT-5.6 Sol.
Однако данные не доказывают, что Grok 4.6 универсально превосходит GPT-5.6 Sol или Claude в каждой задаче.
Например, та же таблица релиза показывает, что GPT-5.6 Sol лидирует в DeepSWE v1.1 и Terminal-Bench v3.0, а Claude Fable 5 — в ряде других бенчмарков для программирования и агентов.
Поэтому выбор модели должен зависеть от реальной рабочей нагрузки, а не от одного общего балла.
Часто задаваемые вопросы
Что такое Grok 4.6?
Grok 4.6 — это флагманская модель SpaceXAI для программирования, агентских задач и работы со знаниями. Она развивает Grok 4.5 за счёт дополнительного обучения, с усилением долгоживущих агентов, более сильной способности к первичной сборке приложений и более устойчивой многошаговой работы.
Лучше ли Grok 4.6, чем GPT-5.6 Sol?
Это зависит от конкретной задачи. В сравнении релиза Grok 4.6 сравнялся с GPT-5.6 Sol в Intelligence Index от Artificial Analysis и опередил его в ряде агентских бенчмарков, тогда как GPT-5.6 Sol остаётся сильнее в некоторых бенчмарках программирования. У обеих моделей также существенно различаются цена и длина контекста.
Сколько стоит API Grok 4.6?
Стандартная цена составляет 2 доллара за миллион входных токенов, 0,50 доллара за миллион кэшированных входных токенов и 6 долларов за миллион выходных токенов. Для запросов свыше 200 тысяч токенов документация SpaceXAI предусматривает более высокие ценовые категории: 4 / 1 / 12 долларов за миллион для входных, кэшированных входных и выходных токенов соответственно.
Каков контекстный размер Grok 4.6?
Первый API SpaceXAI поддерживает контекстное окно в 500 тысяч токенов. Cursor в настоящее время предоставляет контекстное окно в 256 тысяч токенов для своей интеграции Grok 4.6, поэтому фактический лимит зависит от платформы.
Поддерживает ли Grok 4.6 изображения?
Да. SpaceXAI указывает, что Grok 4.6 поддерживает входные данные в виде текста и изображений, а также текстовый вывод. Модель также поддерживает такие инструменты, как вызов функций, веб-поиск, поиск в X и выполнение кода, доступные через API xAI.
Могу ли я использовать Grok 4.6 в Cursor?
Да. Grok 4.6 доступен в Cursor и поддерживает уровни интенсивности мышления xhigh, high, medium и low. Cursor также предоставляет ему доступ к набору агентских инструментов для работы с файлами, командной оболочки, навигации и других рабочих процессов программирования.
Является ли Grok 4.6 открытым?
Нет. Grok 4.6 является проприетарной моделью, и SpaceXAI не публиковала веса модели или число параметров.
Насколько быстр Grok 4.6?
AIBase сообщает о 80 токенах в секунду, но текущие измерения Artificial Analysis показывают около 68 выходных токенов в секунду для первого API Grok 4.6 с эталонной рабочей нагрузкой. Скорость зависит от интенсивности мышления, размера запроса, нагрузки на инфраструктуру и тарифного плана платформы.
Связанные инструменты
- Grok 4.6: Официальная страница релиза SpaceXAI, охватывающая обучение, бенчмарки, безопасность и доступность.
- Консоль API SpaceXAI: Официальная консоль для создания ключей API
и доступа к моделям Grok.
- Grok Build: Среда разработки и работы агентов SpaceXAI на основе моделей Grok.
- Cursor: AI-среда для программирования, которая одновременно с SpaceXAI запустила Grok 4.6 и открыла эту модель через свои агентские рабочие процессы.
- Artificial Analysis: Независимое тестирование моделей по интеллекту, стоимости, скорости, контексту и производительности агентов.
Связанные ссылки
- Официальное объявление Grok 4.6: Главное объявление и таблицы бенчмарков SpaceXAI.
- Документация API Grok 4.6: Официальный идентификатор модели, размер контекста, цены, поддерживаемые модальности, инструменты и примеры API.
- Заметки к релизу SpaceXAI: Официальная история релизов, включая ценовые категории и доступность Grok 4.6.
- Объявление Cursor о Grok 4.6: Статья релиза Cursor, охватывающая обучение, поведение агента, цены и поддерживаемые интеграции.
- Документация модели Cursor Grok 4.6: Контекстные лимиты, уровни усилий и доступные агентские инструменты, специфичные для Cursor.
- Обзор Grok 4.6 от Artificial Analysis: Независимый анализ Intelligence Index, GDPval-AA v2, AA-Briefcase, эффективности затрат и использования токенов.
- Официальное объявление Grok 4.5: Масштаб обучения GB300, обучение с подкреплением, заявление о 80 TPS и ценовая политика предшествующей модели.
Итог
Grok 4.6 — это целевое обновление Grok 4.5, сфокусированное на долгоживущих агентах, программировании, работе со знаниями и качестве первого выполнения при интерактивных проектах. Результаты релиза ставят её в авангард текущих оценок моделей: 61 балл в Intelligence Index от Artificial Analysis — на уровне GPT-5.6 Sol в сравнении релиза.
Сильнейшей стороной релиза является сочетание производительности агента и цены. Grok 4.6 стартует с 2 долларов за миллион входных токенов и 6 долларов за миллион выходных токенов, при этом показывая высокие результаты в GDPval-AA v2 и AA-Briefcase. Длинные запросы и быстрые тарифы могут увеличить расходы, поэтому для производственных оценок следует использовать точную конфигурацию провайдера.
Заявленные 80 TPS следует воспринимать с осторожностью: в настоящее время независимые измерения составляют около 68 выходных токенов в секунду, и скорость обслуживания меняется со временем.
**Grok 4.6
Главное преимущество заключается не в том, что оно выиграло все бенчмарки, а в том, что теперь оно предлагает производительность агентов передового уровня по весьма конкурентоспособной цене.