Мы используем cookie и сервис «Яндекс.Метрика» (счётчик 106640303, включая Вебвизор) для работы авторизации, аналитики и улучшения сайта. Подробнее — Политика обработки ПДн и Политика cookie.

    Grok 4.6: обзор флагмана xAI — бенчмарки, цены, доступ из России
    Статья
    13 августа 20269 мин

    Grok 4.6: обзор флагмана xAI — бенчмарки, цены, доступ из России

    Релиз: 12 августа 2026 · Разработчик: xAI · Тип: LLM (chat / reasoning) · API model: grok-4.6

    Grok 4.6 — обзор новой языковой модели от xAI, флагман Илона Маска

    Grok 4.6 — новая флагманская LLM от xAI, релиз 12 августа 2026

    Коротко

    • 1,5 трлн параметров, та же архитектура что и Grok 4.5 — весь прирост в post-training (SFT + RL)
    • Контекст 500K токенов, режим xhigh reasoning, function calling, structured outputs, web search
    • Цена на Genova AI: 3000 дженов за 1M входящих токенов и 9000 дженов за 1M исходящих
    • Лидер на GDPVal-AA v2, AA-Briefcase и Harvey LAB; отстаёт от GPT-5.6 на DeepSWE и Terminal-Bench
    • На Genova AI — без VPN, оплата в рублях

    Что такое Grok 4.6 и почему это событие

    Grok 4.6 — прямой наследник Grok 4.5, вышедшего 16 июля 2026. Внешне обновление скромное: xAI не увеличила модель, оставив ту же архитектуру V9 на 1,5 триллиона параметров. Весь прирост качества — в post-training: расширенном supervised fine-tuning, новом оптимизаторе и reinforcement learning по нескольким доменам одновременно — кодинг, kernel optimization, веб-разработка, computer-aided design, длинные агентские сценарии.

    Это осознанная ставка Маска: вместо погони за размером — качество данных и обучения. И, если верить официальной таблице бенчмарков xAI, ставка сработала. Grok 4.6 обошёл 4.5 на всех 10 представленных тестах, местами очень заметно: DeepSWE вырос с 54,0% до 65,9%, Terminal-Bench — с 15,7% до 26,0%, APEX-Agents — с 47,1% до 57,5%.

    Кроме того, xAI прицельно вложилась в новый уровень reasoning — xhigh. Это четвёртый, самый глубокий режим рассуждений после low, medium и high. В xhigh модель думает дольше, тратит больше токенов на chain-of-thought, но берёт задачи, на которых обычный high пасует — олимпиадную математику, длинные proof-цепочки, многоходовые агентские сценарии с ветвлениями.

    Что нового по сравнению с Grok 4.5

    Что нового в Grok 4.6 — инфографика возможностей модели

    Ключевые нововведения Grok 4.6 одним кадром

    • Уровень xhigh. Новый, самый глубокий режим reasoning. Дольше думает, но берёт задачи, где обычный high не справляется — олимпиадная математика, длинные доказательства, многоходовые агенты.
    • Контекст 500 000 токенов. Целые кодовые базы среднего проекта, десятки PDF или многочасовой лог переговоров помещаются в один промпт без потери связности.
    • Скачок на агентах и коде. +11,9 п.п. на DeepSWE, +10,3 на Terminal-Bench, +10,4 на APEX-Agents. Это самый заметный рост за одно обновление в истории Grok.
    • Та же цена, что у 4.5. На Genova AI — 3000 дженов за 1M входящих токенов и 9000 дженов за 1M исходящих, как у прошлой версии. При этом сама модель заметно сильнее: соотношение «интеллект/цена» — лучшее в линейке.

    Технические характеристики

    • Разработчик: xAI (компания Илона Маска)
    • Тип: Frontier chat / reasoning LLM с закрытыми весами
    • Параметры: 1,5 триллиона (foundation V9, та же база что у 4.5)
    • Контекст: 500 000 токенов
    • Модальности: text и image на вход, text на выход
    • Reasoning: четыре уровня — low, medium, high и новый xhigh
    • Инструменты: function calling, structured outputs (JSON Schema), web search
    • Knowledge cutoff: 1 февраля 2026
    • API-имя: grok-4.6
    • Доступ: xAI API, Grok Build (default), Cursor (все тарифы), OpenRouter, Vercel, Cloudflare, Genova AI

    Сколько стоит Grok 4.6

    ТокеныЦена на Genova AI
    Входящие (промпт)3000 дженов за 1M токенов
    Исходящие (ответ)9000 дженов за 1M токенов

    Платите только за то, что использовали. Подписки нет: дженны списываются по факту — за токены вашего запроса и за токены ответа модели. Короткие вопросы стоят копейки, а длинные документы выгоднее сжимать в саммари или разбивать на подзадачи, чтобы не платить за лишний контекст.

    Цена совпадает с Grok 4.5, но новая версия сильнее на всех бенчмарках — эффективная стоимость «за единицу интеллекта» упала автоматически. При этом на Genova AI не нужен VPN и зарубежная карта: пополнение в рублях, доступ к модели сразу после оплаты.

    Официальные бенчмарки xAI

    Таблица ниже — прямое воспроизведение launch-таблицы xAI от 12 августа 2026. Grok 4.6 сравнивается с предшественником Grok 4.5 High, флагманом OpenAI GPT-5.6 Sol Max и Claude Fable 5 Max от Anthropic.

    Grok 4.6 против GPT-5.6 Sol Max и Claude Fable 5 Max — сравнение бенчмарков

    Grok 4.6 против главных конкурентов — данные xAI

    БенчмаркGrok 4.6 HighGrok 4.5 HighGPT-5.6 Sol MaxFable 5 Max
    AA Intelligence Index61566162
    GDPVal-AA v21753152617281741
    CursorBench v3.269,9%66,7%67,2%70,5%
    DeepSWE v1.165,9%54,0%73,0%70,0%
    FrontierCode v1.1 Ext61,3%56,6%60,6%63,6%
    APEX-Agents57,5%47,1%56,7%59,2%
    Terminal-Bench v3.026,0%15,7%34,6%34,1%
    APEX-SWE56,4%53,6%58,8%
    AA-Briefcase1577131315021574
    Harvey LAB (Vals)15,8%12,9%2,5%11,3%

    Cyan-цветом отмечен лучший результат в строке. Данные — из официальной launch-таблицы xAI. Как всегда с вендорскими бенчмарками: harness, reasoning-настройки и тестовые условия могут отличаться, поэтому в реальной работе рекомендуется провести собственный A/B на своих задачах.

    Grok 4.6 vs GPT-5.6 vs Claude Fable 5 — где какая лучше

    Где выигрывает Grok 4.6

    Модель уверенно лидирует на четырёх бенчмарках: AA Intelligence Index (61 — паритет с GPT-5.6), GDPVal-AA v2 (1753), AA-Briefcase (1577) и Harvey LAB (15,8%). Последний — это набор из юридических задач от Harvey AI: контракты, кейс-лоу, договорной анализ. Отрыв от GPT-5.6 на Harvey LAB огромный (15,8% против 2,5%) — Grok здесь на своей территории. GDPVal и AA-Briefcase — это агрегированные тесты на «полезность для белого воротничка», где Grok 4.6 тоже впереди.

    Практический вывод: для работы с длинными юридическими документами, аналитикой знаний, ресёрчем незнакомого домена и брифов Grok 4.6 сейчас — топ-1 выбор.

    Где выигрывает GPT-5.6 Sol Max

    OpenAI впереди на двух ключевых кодовых бенчмарках: DeepSWE (73,0% против 65,9%) и Terminal-Bench (34,6% против 26,0%). Это тесты на автономного агента, который решает задачу в реальном терминале и коммитит патч в репозиторий. Grok здесь подтянулся впервые серьёзно (+11,9 п.п. к 4.5), но GPT всё ещё лидирует.

    Практический вывод: для полностью автономной агентской разработки — long-running SWE-агенты, кодовые обзоры, автогенерация PR — GPT-5.6 Sol Max по-прежнему более надёжен.

    Где выигрывает Claude Fable 5 Max

    Anthropic держит первое место на AA Intelligence Index (62), CursorBench, FrontierCode, APEX-Agents и APEX-SWE. Модель ровно сильна во всех сценариях, что делает её универсальным выбором. Проблема — цена: Fable 5 Max ощутимо дороже и Grok, и GPT.

    Практический вывод: Fable 5 Max — «золотой стандарт» когда бюджет не критичен. Как только вопрос упирается в стоимость масштабирования — Grok 4.6 предлагает 90% качества за половину денег.

    Реальные сценарии использования Grok 4.6

    Кодинг и парное программирование в Cursor

    Grok 4.6 — модель по умолчанию в Grok Build и доступна на всех тарифах Cursor. По CursorBench (69,9%) она обгоняет и GPT-5.6, и Grok 4.5. Особенно ценится за скорость: та же пропускная способность что у 4.5 при более высоком качестве. Для итеративного code-completion и рефакторинга — рабочий вариант.

    Юридический и knowledge-work-ресёрч

    Harvey LAB и AA-Briefcase — тесты на профессиональные задачи белых воротничков: подготовка меморандумов, разбор судебной практики, comparative analysis по регуляторике. Grok 4.6 здесь лидер по данным xAI. Плюс 500K контекста — можно загрузить пакет договоров и получить сводный вывод, не разбивая на куски.

    Длинные агентские сценарии

    Grok 4.6 создавался с прицелом на «long-running agents» — задачи, где модель работает часы, а не секунды: автоматизация research, multi-tool orchestration, длинные data-pipeline с ветвлением решений. Уровень xhigh здесь ключевой — он подтягивает качество на многоходовых сценариях, где обычный reasoning теряет нить.

    Работа с большими корпусами документов

    500K токенов — это, для ориентира, весь исходник среднего Python-проекта, или ~350 страниц PDF, или полный годовой отчёт компании с приложениями. Модель держит связность на всей длине, но не забывайте про 200K-порог по цене.

    STEM и инженерные задачи

    xAI отдельно упоминает, что в тренировку Grok 4.6 включён инженерный корпус Tesla и SpaceX (без ITAR-ограниченных материалов). Это даёт заметно более уверенные ответы по авиакосмосу, электротехнике и материаловедению, чем у моделей, натренированных только на публичных данных.

    Промпт-советы для Grok 4.6

    • Явно поднимайте reasoning-уровень. В API дефолт — low, и на сложных задачах модель будет отвечать поверхностно, если уровень не указать. Для рабочих задач ставьте high, для сложной математики, планирования агента или proof — xhigh. Для простого чата хватает low/medium — быстрее и дешевле.
    • Web search и function calling — по одному за раз. В API эти инструменты взаимоисключающие: в одном запросе либо встроенный веб-поиск, либо свои функции. Если агенту нужно и то и другое — разносите на два шага.
    • Не переходите порог 200K токенов без нужды. Если промпт близок к 200K — либо сожмите саммари, либо будьте готовы к двукратной оплате за весь запрос. Для многих задач эффективнее retrieval с чанком до 100K.
    • Держите инструкции в начале. На длинных контекстах Grok, как и все LLM, немного проседает в середине окна (эффект «lost in the middle»). Системный промпт и ключевые правила — в первые 5–10K токенов.
    • Используйте structured outputs. Для парсинга ответов в JSON — включайте нативные structured outputs API вместо просьбы «отвечай JSON'ом». Стабильнее и без парсинг-ошибок.
    • Русский — на равных с английским. Grok 4.6 стилистически чувствует канцелярит, разговорный тон и профессиональный сленг. Прямо просите тональность («в стиле пресс-релиза», «как разработчик разработчику») — реагирует хорошо.

    Как попробовать Grok 4.6 из России

    Прямой доступ к xAI API требует зарубежной банковской карты, SMS-верификации и, в большинстве случаев, VPN — из России без обходов работать не получится. Проще всего протестировать модель через Genova AI: Grok 4.6 подключён напрямую к чат-интерфейсу, оплата в рублях и Дженовах, без VPN и без иностранных документов.

    Открыть Grok 4.6 в чате Genova AI — Без VPN, оплата в рублях, бесплатные Дженовы для первого теста

    В том же интерфейсе доступны и другие модели линейки xAI — Grok 4.3 для быстрых массовых задач и Grok 4.20. Grok 4.6 — самая новая и мощная из линейки, но для простых чатов Fast-варианты дешевле и быстрее.

    Что дальше — Grok 4.7

    По официальным заявлениям xAI, через несколько недель после Grok 4.6 выйдет Grok 4.7 — уже 2,1 триллион параметров. Это будет первый серьёзный скачок по размеру модели после 4.5. Ожидается, что 4.7 будет лучше 4.6 на всех задачах, но медленнее в inference и, вероятно, дороже. Маск позиционирует пару как «4.6 для скорости, 4.7 для максимальной сложности».

    Для практических задач это значит: если модель нужна прямо сейчас — берите 4.6, она в топ-3 фронтира по большинству тестов и не устареет мгновенно. Grok 4.7 займёт нишу «max quality», а 4.6 останется массовым вариантом «интеллект/цена».

    Коротко: брать или нет

    Grok 4.6 — это лучшее соотношение цена/качество в фронтире 2026 года. Модель заметно сильнее предыдущей 4.5 при той же цене, лидирует на четырёх ключевых бенчмарках знаний и юрработы, и на равных с GPT-5.6 Sol Max на общем Intelligence Index. Отстаёт от GPT в чистой автономной агентской разработке, но обгоняет всех на юридических задачах и знаниях.

    Если делать один универсальный выбор в чате — сейчас разумно ставить именно Grok 4.6: соотношение возможностей и денег лучше, чем у Claude Fable 5, а разница с GPT-5.6 Sol Max редко играет роль в повседневных задачах. Через несколько недель линейка обновится Grok 4.7 (2,1T), но она будет дороже и медленнее — 4.6 останется массовым выбором.

    А для российских пользователей главное преимущество — доступ. Пока xAI API требует зарубежных карт и VPN, Grok 4.6 на Genova AI открыт напрямую с оплатой в рублях.

    Технические характеристики и цены приведены по официальным материалам xAI на дату публикации. Бенчмарки — из launch-таблицы xAI от 12 августа 2026. Результаты сторонних моделей могут отличаться в зависимости от harness и настроек тестирования.

    Часто задаваемые вопросы

    14

    Комментарии

    Пока нет комментариев. Будьте первым!

    ?

    📖 Похожие статьи