
Grok 4.6: обзор флагмана xAI — бенчмарки, цены, доступ из России
Релиз: 12 августа 2026 · Разработчик: xAI · Тип: LLM (chat / reasoning) · API model: grok-4.6

Grok 4.6 — новая флагманская LLM от xAI, релиз 12 августа 2026
Коротко
- 1,5 трлн параметров, та же архитектура что и Grok 4.5 — весь прирост в post-training (SFT + RL)
- Контекст 500K токенов, режим xhigh reasoning, function calling, structured outputs, web search
- Цена на Genova AI: 3000 дженов за 1M входящих токенов и 9000 дженов за 1M исходящих
- Лидер на GDPVal-AA v2, AA-Briefcase и Harvey LAB; отстаёт от GPT-5.6 на DeepSWE и Terminal-Bench
- На Genova AI — без VPN, оплата в рублях
Что такое Grok 4.6 и почему это событие
Grok 4.6 — прямой наследник Grok 4.5, вышедшего 16 июля 2026. Внешне обновление скромное: xAI не увеличила модель, оставив ту же архитектуру V9 на 1,5 триллиона параметров. Весь прирост качества — в post-training: расширенном supervised fine-tuning, новом оптимизаторе и reinforcement learning по нескольким доменам одновременно — кодинг, kernel optimization, веб-разработка, computer-aided design, длинные агентские сценарии.
Это осознанная ставка Маска: вместо погони за размером — качество данных и обучения. И, если верить официальной таблице бенчмарков xAI, ставка сработала. Grok 4.6 обошёл 4.5 на всех 10 представленных тестах, местами очень заметно: DeepSWE вырос с 54,0% до 65,9%, Terminal-Bench — с 15,7% до 26,0%, APEX-Agents — с 47,1% до 57,5%.
Кроме того, xAI прицельно вложилась в новый уровень reasoning — xhigh. Это четвёртый, самый глубокий режим рассуждений после low, medium и high. В xhigh модель думает дольше, тратит больше токенов на chain-of-thought, но берёт задачи, на которых обычный high пасует — олимпиадную математику, длинные proof-цепочки, многоходовые агентские сценарии с ветвлениями.
Что нового по сравнению с Grok 4.5

Ключевые нововведения Grok 4.6 одним кадром
- Уровень xhigh. Новый, самый глубокий режим reasoning. Дольше думает, но берёт задачи, где обычный high не справляется — олимпиадная математика, длинные доказательства, многоходовые агенты.
- Контекст 500 000 токенов. Целые кодовые базы среднего проекта, десятки PDF или многочасовой лог переговоров помещаются в один промпт без потери связности.
- Скачок на агентах и коде. +11,9 п.п. на DeepSWE, +10,3 на Terminal-Bench, +10,4 на APEX-Agents. Это самый заметный рост за одно обновление в истории Grok.
- Та же цена, что у 4.5. На Genova AI — 3000 дженов за 1M входящих токенов и 9000 дженов за 1M исходящих, как у прошлой версии. При этом сама модель заметно сильнее: соотношение «интеллект/цена» — лучшее в линейке.
Технические характеристики
- Разработчик: xAI (компания Илона Маска)
- Тип: Frontier chat / reasoning LLM с закрытыми весами
- Параметры: 1,5 триллиона (foundation V9, та же база что у 4.5)
- Контекст: 500 000 токенов
- Модальности: text и image на вход, text на выход
- Reasoning: четыре уровня — low, medium, high и новый
xhigh - Инструменты: function calling, structured outputs (JSON Schema), web search
- Knowledge cutoff: 1 февраля 2026
- API-имя:
grok-4.6 - Доступ: xAI API, Grok Build (default), Cursor (все тарифы), OpenRouter, Vercel, Cloudflare, Genova AI
Сколько стоит Grok 4.6
| Токены | Цена на Genova AI |
|---|---|
| Входящие (промпт) | 3000 дженов за 1M токенов |
| Исходящие (ответ) | 9000 дженов за 1M токенов |
Платите только за то, что использовали. Подписки нет: дженны списываются по факту — за токены вашего запроса и за токены ответа модели. Короткие вопросы стоят копейки, а длинные документы выгоднее сжимать в саммари или разбивать на подзадачи, чтобы не платить за лишний контекст.
Цена совпадает с Grok 4.5, но новая версия сильнее на всех бенчмарках — эффективная стоимость «за единицу интеллекта» упала автоматически. При этом на Genova AI не нужен VPN и зарубежная карта: пополнение в рублях, доступ к модели сразу после оплаты.
Официальные бенчмарки xAI
Таблица ниже — прямое воспроизведение launch-таблицы xAI от 12 августа 2026. Grok 4.6 сравнивается с предшественником Grok 4.5 High, флагманом OpenAI GPT-5.6 Sol Max и Claude Fable 5 Max от Anthropic.

Grok 4.6 против главных конкурентов — данные xAI
| Бенчмарк | Grok 4.6 High | Grok 4.5 High | GPT-5.6 Sol Max | Fable 5 Max |
|---|---|---|---|---|
| AA Intelligence Index | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69,9% | 66,7% | 67,2% | 70,5% |
| DeepSWE v1.1 | 65,9% | 54,0% | 73,0% | 70,0% |
| FrontierCode v1.1 Ext | 61,3% | 56,6% | 60,6% | 63,6% |
| APEX-Agents | 57,5% | 47,1% | 56,7% | 59,2% |
| Terminal-Bench v3.0 | 26,0% | 15,7% | 34,6% | 34,1% |
| APEX-SWE | 56,4% | 53,6% | — | 58,8% |
| AA-Briefcase | 1577 | 1313 | 1502 | 1574 |
| Harvey LAB (Vals) | 15,8% | 12,9% | 2,5% | 11,3% |
Cyan-цветом отмечен лучший результат в строке. Данные — из официальной launch-таблицы xAI. Как всегда с вендорскими бенчмарками: harness, reasoning-настройки и тестовые условия могут отличаться, поэтому в реальной работе рекомендуется провести собственный A/B на своих задачах.
Grok 4.6 vs GPT-5.6 vs Claude Fable 5 — где какая лучше
Где выигрывает Grok 4.6
Модель уверенно лидирует на четырёх бенчмарках: AA Intelligence Index (61 — паритет с GPT-5.6), GDPVal-AA v2 (1753), AA-Briefcase (1577) и Harvey LAB (15,8%). Последний — это набор из юридических задач от Harvey AI: контракты, кейс-лоу, договорной анализ. Отрыв от GPT-5.6 на Harvey LAB огромный (15,8% против 2,5%) — Grok здесь на своей территории. GDPVal и AA-Briefcase — это агрегированные тесты на «полезность для белого воротничка», где Grok 4.6 тоже впереди.
Практический вывод: для работы с длинными юридическими документами, аналитикой знаний, ресёрчем незнакомого домена и брифов Grok 4.6 сейчас — топ-1 выбор.
Где выигрывает GPT-5.6 Sol Max
OpenAI впереди на двух ключевых кодовых бенчмарках: DeepSWE (73,0% против 65,9%) и Terminal-Bench (34,6% против 26,0%). Это тесты на автономного агента, который решает задачу в реальном терминале и коммитит патч в репозиторий. Grok здесь подтянулся впервые серьёзно (+11,9 п.п. к 4.5), но GPT всё ещё лидирует.
Практический вывод: для полностью автономной агентской разработки — long-running SWE-агенты, кодовые обзоры, автогенерация PR — GPT-5.6 Sol Max по-прежнему более надёжен.
Где выигрывает Claude Fable 5 Max
Anthropic держит первое место на AA Intelligence Index (62), CursorBench, FrontierCode, APEX-Agents и APEX-SWE. Модель ровно сильна во всех сценариях, что делает её универсальным выбором. Проблема — цена: Fable 5 Max ощутимо дороже и Grok, и GPT.
Практический вывод: Fable 5 Max — «золотой стандарт» когда бюджет не критичен. Как только вопрос упирается в стоимость масштабирования — Grok 4.6 предлагает 90% качества за половину денег.
Реальные сценарии использования Grok 4.6
Кодинг и парное программирование в Cursor
Grok 4.6 — модель по умолчанию в Grok Build и доступна на всех тарифах Cursor. По CursorBench (69,9%) она обгоняет и GPT-5.6, и Grok 4.5. Особенно ценится за скорость: та же пропускная способность что у 4.5 при более высоком качестве. Для итеративного code-completion и рефакторинга — рабочий вариант.
Юридический и knowledge-work-ресёрч
Harvey LAB и AA-Briefcase — тесты на профессиональные задачи белых воротничков: подготовка меморандумов, разбор судебной практики, comparative analysis по регуляторике. Grok 4.6 здесь лидер по данным xAI. Плюс 500K контекста — можно загрузить пакет договоров и получить сводный вывод, не разбивая на куски.
Длинные агентские сценарии
Grok 4.6 создавался с прицелом на «long-running agents» — задачи, где модель работает часы, а не секунды: автоматизация research, multi-tool orchestration, длинные data-pipeline с ветвлением решений. Уровень xhigh здесь ключевой — он подтягивает качество на многоходовых сценариях, где обычный reasoning теряет нить.
Работа с большими корпусами документов
500K токенов — это, для ориентира, весь исходник среднего Python-проекта, или ~350 страниц PDF, или полный годовой отчёт компании с приложениями. Модель держит связность на всей длине, но не забывайте про 200K-порог по цене.
STEM и инженерные задачи
xAI отдельно упоминает, что в тренировку Grok 4.6 включён инженерный корпус Tesla и SpaceX (без ITAR-ограниченных материалов). Это даёт заметно более уверенные ответы по авиакосмосу, электротехнике и материаловедению, чем у моделей, натренированных только на публичных данных.
Промпт-советы для Grok 4.6
- Явно поднимайте reasoning-уровень. В API дефолт —
low, и на сложных задачах модель будет отвечать поверхностно, если уровень не указать. Для рабочих задач ставьтеhigh, для сложной математики, планирования агента или proof —xhigh. Для простого чата хватает low/medium — быстрее и дешевле. - Web search и function calling — по одному за раз. В API эти инструменты взаимоисключающие: в одном запросе либо встроенный веб-поиск, либо свои функции. Если агенту нужно и то и другое — разносите на два шага.
- Не переходите порог 200K токенов без нужды. Если промпт близок к 200K — либо сожмите саммари, либо будьте готовы к двукратной оплате за весь запрос. Для многих задач эффективнее retrieval с чанком до 100K.
- Держите инструкции в начале. На длинных контекстах Grok, как и все LLM, немного проседает в середине окна (эффект «lost in the middle»). Системный промпт и ключевые правила — в первые 5–10K токенов.
- Используйте structured outputs. Для парсинга ответов в JSON — включайте нативные structured outputs API вместо просьбы «отвечай JSON'ом». Стабильнее и без парсинг-ошибок.
- Русский — на равных с английским. Grok 4.6 стилистически чувствует канцелярит, разговорный тон и профессиональный сленг. Прямо просите тональность («в стиле пресс-релиза», «как разработчик разработчику») — реагирует хорошо.
Как попробовать Grok 4.6 из России
Прямой доступ к xAI API требует зарубежной банковской карты, SMS-верификации и, в большинстве случаев, VPN — из России без обходов работать не получится. Проще всего протестировать модель через Genova AI: Grok 4.6 подключён напрямую к чат-интерфейсу, оплата в рублях и Дженовах, без VPN и без иностранных документов.
Открыть Grok 4.6 в чате Genova AI — Без VPN, оплата в рублях, бесплатные Дженовы для первого теста
В том же интерфейсе доступны и другие модели линейки xAI — Grok 4.3 для быстрых массовых задач и Grok 4.20. Grok 4.6 — самая новая и мощная из линейки, но для простых чатов Fast-варианты дешевле и быстрее.
Что дальше — Grok 4.7
По официальным заявлениям xAI, через несколько недель после Grok 4.6 выйдет Grok 4.7 — уже 2,1 триллион параметров. Это будет первый серьёзный скачок по размеру модели после 4.5. Ожидается, что 4.7 будет лучше 4.6 на всех задачах, но медленнее в inference и, вероятно, дороже. Маск позиционирует пару как «4.6 для скорости, 4.7 для максимальной сложности».
Для практических задач это значит: если модель нужна прямо сейчас — берите 4.6, она в топ-3 фронтира по большинству тестов и не устареет мгновенно. Grok 4.7 займёт нишу «max quality», а 4.6 останется массовым вариантом «интеллект/цена».
Коротко: брать или нет
Grok 4.6 — это лучшее соотношение цена/качество в фронтире 2026 года. Модель заметно сильнее предыдущей 4.5 при той же цене, лидирует на четырёх ключевых бенчмарках знаний и юрработы, и на равных с GPT-5.6 Sol Max на общем Intelligence Index. Отстаёт от GPT в чистой автономной агентской разработке, но обгоняет всех на юридических задачах и знаниях.
Если делать один универсальный выбор в чате — сейчас разумно ставить именно Grok 4.6: соотношение возможностей и денег лучше, чем у Claude Fable 5, а разница с GPT-5.6 Sol Max редко играет роль в повседневных задачах. Через несколько недель линейка обновится Grok 4.7 (2,1T), но она будет дороже и медленнее — 4.6 останется массовым выбором.
А для российских пользователей главное преимущество — доступ. Пока xAI API требует зарубежных карт и VPN, Grok 4.6 на Genova AI открыт напрямую с оплатой в рублях.
Технические характеристики и цены приведены по официальным материалам xAI на дату публикации. Бенчмарки — из launch-таблицы xAI от 12 августа 2026. Результаты сторонних моделей могут отличаться в зависимости от harness и настроек тестирования.
Часто задаваемые вопросы
Комментарии
Пока нет комментариев. Будьте первым!
📖 Похожие статьи

Seedance 2.0 от ByteDance — революция в AI-генерации видео с нативным звуком
Полный обзор нейросети Seedance 2.0: возможности, режимы Text/Image/Reference-to-Video, сравнение с Veo 3.1 и Kling 3.0, цены в Дженах и пошаговый гайд по созданию видео.
Читать
Grok Imagine от xAI — обзор нейросети на архитектуре Aurora с примерами
Полный обзор Grok Imagine — генератора изображений от xAI на архитектуре Aurora. 6 кадров за запрос, фотореализм, реальные бренды. Сравнение с Midjourney, GPT Image 2 и Nano Banana, советы по промптам и примеры генераций.
Читать
Grok Imagine Video от xAI — обзор модели, примеры и промпты
Подробный разбор Grok Imagine Video от xAI: возможности, режимы Photo→Video и Text→Video, длительности до 15 секунд, цены в Дженах, примеры роликов и сравнение с Google Veo 3.1, Kling 3.0 и Seedance 2.0.
Читать
