12 августа 2026 года компания xAI представила языковую модель Grok 4.6. Юридическим лицом проекта выступает SpaceXAI LLC, при этом привычные бренд xAI и интерфейсы API сохранены без изменений. Релиз вызвал оживленные обсуждения в индустрии, однако вопреки поспешным предположениям о смене архитектуры или демпинге цен, Grok 4.6 представляет собой глубокое пост-тренировочное обновление (post-training upgrade) модели Grok 4.5. Инженерные доработки сфокусированы на поведении долгоживущих автономных агентов (long-running agents), генерации программного кода (coding) и аналитической работе со знаниями (knowledge work). Это не анонс новой структуры разреженной смеси экспертов (MoE) и не демпинг стоимости токенов.
12 августа Artificial Analysis поставила Grok 4.6 61 балл Intelligence Index — вровень с GPT-5.6 Sol, ниже Claude Fable 5 (62) и Claude Opus 5 (63). 4 сентября индекс перешёл на версию v4.2; на живой карточке модели 6 сентября Grok 4.6 в режиме high даёт 51 балл. Это смена методики, а не падение чекпоинта. Лидерами v4.2 стали Claude Fable 5.1 и GPT-6 Astra. Важно подчеркнуть, что сводный Intelligence Index платформы Artificial Analysis является сторонним агрегированным рейтингом, а не абсолютной истиной. Индекс помогает оценить баланс моделей, но реальная применимость в продакшене определяется профилем задач конкретного проекта.

1. Аппаратный фундамент и эволюция суперкомпьютера Colossus
Вычислительной основой экосистемы xAI выступает дата-центр Colossus в Мемфисе. В ретроспективе проект начинался в 2024 году с площадки на 100 000 графических процессоров Nvidia H100. К 2025 году суммарный объем ускорителей был доведен до 200 000 единиц.
К 2026 году инфраструктура Colossus эволюционировала в две очереди. Площадка Colossus 1 насчитывает свыше 220 000 ускорителей в смешанной конфигурации из поколений Nvidia H100, H200 и B200. Очередь Colossus 2 строится на базе ускорителей Nvidia B200 и B300. С инженерной точки зрения некорректно привязывать обучение и инференс Grok 4.6 к конкретной фазе кластера: нагрузки компании распределяются динамически по доступным мощностям.
Сетевая топология комплекса требует фактологической строгости. Официальные спецификации подтверждают применение интерконнекта Spectrum-X Ethernet с пропускной способностью 2.8 Тбит/с на серверный узел. Утверждения о пропускной способности 3.2 Тбит/с и однозначном использовании протокола RoCEv2 не подтверждены документацией xAI и не являются верифицированным фактом.
Аналогичная осторожность необходима при оценке охлаждения. Стойки с жидкостным охлаждением (liquid-cooled racks) упоминаются строго с инженерной оговоркой: xAI не раскрывает степень внедрения и не заявляет о стопроцентном переходе всех узлов на прямое охлаждение кристаллов (Direct-to-Chip Liquid Cooling). Соответственно, приписываемый площадке коэффициент энергоэффективности PUE (Power Usage Effectiveness) на уровне 1.12 не является подтвержденным показателем площадки.
xAI не публикует точные MoE-спецификации 4.6 (число параметров и маршрутизацию). Исторически семейство Grok использовало архитектуру разреженной смеси экспертов (MoE), а модельная карточка предыдущих версий упоминала fused MoE kernels, однако публичной архитектурной карты 4.6 нет.
2. Подтвержденные параметры API и реальная экономика: почему это не демпинг
Интерфейс API xAI предоставляет разработчикам строго определенные параметры интеграции Grok 4.6:
- Идентификатор модели в API: grok-4.6.
- Размер контекстного окна: 500000 токенов (500k context).
- Дата отсечки обучающих данных (Knowledge cutoff): январь 2026 года (Jan 2026).
- Уровни глубины рассуждений (reasoning effort): режимы low, medium, high и xhigh.
- Пакетная обработка запросов (Batch API): не поддерживается.
Тарифная сетка xAI дифференцирована в зависимости от размера контекста:
Длина входного промпта
Входные токены (Prompt / 1M)
Кэшированный ввод (Cached / 1M)
Выходные токены (Output / 1M)
До 200k токенов (< 200k)
$2.00
$0.50
$6.00
От 200k токенов и выше (>= 200k)
$4.00
$1.00
$12.00
Для запросов в приоритетных очередях (режимы fast / priority) действует наценка примерно 2x к базовым ставкам.
Называть эти тарифы демпингом некорректно: вход и выход $2.00 / $6.00 до 200k совпадают с Grok 4.5. Кэш не совпадает: у 4.6 это $0.50 / $1.00, у 4.5 было $0.30 / $0.60.
Сравнение цен с актуальными моделями конкурентов подчеркивает разнородность рынка без универсального вывода:
- OpenAI GPT-5.6 Sol: предлагает окно 1.05M токенов по промо-тарифу $4.00 за 1M входных и $20.00 за 1M выходных токенов. Grok 4.6 существенно дешевле по генерации ответа ($6 против $20), но уступает по объему контекста (500k против 1.05M).
- Anthropic Claude Sonnet 5: $2.00 за вход и $10.00 за выход на 1M токенов. Входная цена равна Grok 4.6, а генерация у Grok дешевле ($6 против $10).
- Anthropic Claude Opus 5: флагман премиального сегмента со стоимостью $5.00 за вход и $25.00 за выход на 1M токенов, что заметно дороже Grok 4.6 по обоим компонентам.
- Google Gemini 3.x, включая версии Flash: в зависимости от нагрузки и выбранной модели сервис Google может обходиться дешевле Grok 4.6, особенно на коротких запросах и пакетных задачах.
Универсального вывода о безоговорочном ценовом превосходстве сделать нельзя: Grok 4.6 выгоден при генерации объемных ответов среди тяжелых моделей, но не является универсально самым дешевым решением на рынке.

3. Серверные инструменты поиска: возможности и границы web_search и x_search
Платформа xAI встраивает поиск в рантайм модели через серверные инструменты (server-side tools). Для многих сценариев это позволяет начать без собственной поисковой прослойки, хотя не заменяет RAG-архитектуру там, где нужны контролируемый корпус документов, специальные права доступа или собственная индексация:
- web_search: серверный инструмент обращения к внешнему вебу с возвратом текстовых фрагментов веб-страниц.
- x_search: инструмент поиска по платформе X, поддерживающий четыре режима выборки: keyword — поиск по ключевым словам и фразам; semantic — семантический поиск по смысловой близости запроса; user — фильтрация публикаций по конкретным пользователям и авторам; thread — структурированный анализ веток обсуждений и связанных сообщений.
Ответы модели сопровождаются механизмом цитирования первоисточников (citations). Стоимость поисковых вызовов строго стандартизирована: каждый вызов инструментов web_search и x_search тарифицируется по цене $5 за 1000 вызовов инструментов ($5 per 1000 tool calls) дополнительно к оплате токенов диалога.
При этом необходимо соблюдать фактологические рамки и отделять документированные функции от домыслов. В официальной документации xAI категорически отсутствуют упоминания о прямом нелимитированном доступе к потоку Firehose, локальных векторных индексах HNSW, фильтрах спама и бот-сетей или автоматической перекрестной проверке фактов по базам arXiv, PubMed и GitHub. Также API не возвращает системные таймстемпы верификации или числовые оценки уверенности (confidence scores). Поиск xAI представляет собой документированные вызовы инструментов с цитированием первоисточников.
4. Агентные сценарии: параллельный вызов функций и структурированный вывод
Для автономных агентных сценариев (agentic workflows) модель Grok 4.6 предоставляет развитые программные интерфейсы:
- Параллельный вызов функций (parallel function calling): включен в API по умолчанию (enabled by default). Разработчик может передать до 200 спецификаций инструментов (tools) на один запрос, а модель способна запланировать и вернуть аргументы сразу для нескольких параллельных вызовов в едином шаге генерации. Это существенно сокращает задержки при синхронизации агента с внешними базами данных.
- Структурированный вывод (structured outputs): базируется на механизме принудительного декодирования (constrained decoding), обеспечивающем соответствие ответов схеме JSON Schema.
Следует понимать границы технологии: структурированный вывод реализован программно в рантайме инференса, а не на аппаратном уровне (not hardware). Соответствие схеме гарантируется только для поддерживаемого набора конструкций JSON Schema; часть спецификаций обрабатывается по принципу наилучшего приближения (best-effort). Абсолютной гарантией соответствия произвольной схеме данное решение не является.
5. Результаты бенчмарков: данные вендора и независимый аудит Artificial Analysis
Оценка возможностей Grok 4.6 строится на сопоставлении внутренних замеров вендора и стороннего аудита.
В официальном анонсе от 12 августа 2026 года xAI опубликовала таблицу результатов собственных внутренних тестов:
Бенчмарк / Оценочная шкала
Результат (Вендорская таблица xAI, 12 августа 2026 года)
Artificial Analysis Intelligence Index
61
GDPval-AA
1753
CursorBench
69.9%
DeepSWE
65.9%
FrontierCode
61.3%
APEX-Agents
57.5%
Terminal-Bench 3.0
26.0%
APEX-SWE
56.4%
AA-Briefcase
1577
Harvey LAB
15.8%
В опубликованную таблицу xAI не были включены результаты по таким распространенным тестам, как классический SWE-bench Verified, математический бенчмарк AIME и соревновательный LiveCodeBench.
Независимые замеры Artificial Analysis важно датировать, поскольку 4 сентября сервис сменил версию индекса:
- Intelligence Index: 61 на 12 августа — паритет с GPT-5.6 Sol на тогдашней методике; 51 у Grok 4.6 в режиме high на живой карточке 6 сентября после перехода на Index v4.2.
- Оценочная стоимость типовой сложной задачи (cost per task): $0.84 в разборе от 12 августа и $1.25 на карточке 6 сентября; состав индекса изменился вместе с методикой.
- Скорость генерации (throughput) Grok 4.6 в режиме high: 62.8 выходных токена в секунду. high — уровень по умолчанию, а не максимальный xhigh.
- Время до первого токена (TTFT): 52.44 секунды при high и 8.05 секунды при low.
Различие между пропускной способностью генерации и задержкой TTFT принципиально для клиентских систем. Показатель 62.8 токена в секунду описывает скорость потока после начала генерации видимого ответа. При high начальная пауза до первого видимого токена в замере Artificial Analysis составляет около 52 секунд. Для клиентских приложений это означает необходимость заранее проектировать таймауты, потоковую выдачу и пользовательский интерфейс ожидания.
6. Корпоративная безопасность, комплаенс и хранение данных
Для корпоративных клиентов компания xAI регламентирует следующие правила безопасности и хранения данных:
- Хранение данных по умолчанию (Data Retention): журнал запросов хранится на серверах компании 30 дней для мониторинга безопасности и аудита. Данные коммерческого API гарантированно не используются для обучения базовых моделей xAI.
- Режим нулевого хранения (Zero Data Retention, ZDR): доступен как опция opt-in на уровне всей команды (team-wide). Включение ZDR исключает сохранение данных на стороне провайдера, но делает недоступными stateful-сервисы платформы: сессионные ответы (Responses), файловые хранилища (Files), коллекции (Collections) и пакетные вызовы (Batch).
- Аудит SOC 2 Type II: заявление о наличии отчета SOC 2 Type II является утверждением самого вендора (vendor claim); ознакомление с детальным отчетом возможно только корпоративными клиентами под соглашением о неразглашении (NDA).
- Управление ключами шифрования (Vault / CMEK): механизмы Vault и клиентских ключей шифрования (CMEK) анонсированы для корпоративной подписки веб-сервиса grok.com enterprise. Это не равнозначно поддержке открытого API с аппаратными модулями безопасности (HSM) или универсального режима BYOK для разработчиков.
- Медицинские и отраслевые стандарты: соглашение о деловом сотрудничестве по стандарту HIPAA (Business Associate Agreement, BAA) доступно для заключения только при определенных контрактных обстоятельствах и тарифах, не являясь абстрактной сертификацией модели.
- Ограничения по стандартам ISO и GDPR: заявлять о наличии сертификата соответствия ISO 27001 для API xAI нельзя из-за отсутствия официальных подтверждений. Соответствие требованиям GDPR и подписание соглашения об обработке данных (DPA) описываются компанией исключительно в рамочных, условных юридических терминах.
7. Итоги и выводы: практическое позиционирование Grok 4.6
Релиз Grok 4.6 вернул xAI в группу лидеров фронтирного сегмента на том же базовом ценнике $2.00 / $6.00 за 1M токенов, что и у версии 4.5. Модель продемонстрировала паритет с GPT-5.6 Sol в рейтинге Artificial Analysis (61 пункт), однако не стала абсолютным лидером на всех типах прикладных задач.
Ключевыми инженерными ограничениями остаются:
- Размер контекста: окно в 500000 токенов уступает конкурирующим системам с контекстом 1M+ токенов (включая GPT-5.6 Sol с 1.05M).
- Сложные автономные среды: в вендорской таблице результат Terminal-Bench 3.0 составляет 26%, а публичной цифры по SWE-bench Verified xAI не приводит. Эти данные не позволяют объявить модель лидером в терминальной автоматизации и устранении багов в репозиториях.
- Временные задержки инференса: длительное время TTFT (около 52,44 секунды при high) требует адаптации архитектуры клиентских приложений к продолжительным паузам ожидания ответа.
Grok 4.6 — зрелый инструмент для агентных конвейеров, кодинга и серверного поиска, требующий учета инфраструктурных ограничений перед внедрением в промышленную эксплуатацию.
Источники
- https://x.ai/news/grok-4-6
- https://docs.x.ai/developers/grok-4-6
- https://docs.x.ai/developers/models/grok-4.6
- https://docs.x.ai/developers/pricing
- https://docs.x.ai/developers/tools/web-search
- https://docs.x.ai/developers/tools/x-search
- https://docs.x.ai/developers/tools/function-calling
- https://docs.x.ai/developers/model-capabilities/text/structured-outputs
- https://docs.x.ai/developers/faq/security
- https://x.ai/legal/faq-enterprise/
- https://x.ai/colossus
- https://x.ai/news/anthropic-compute-partnership
- https://artificialanalysis.ai/articles/grok-4-6-benchmarks-and-analysis
- https://artificialanalysis.ai/models/grok-4-6
- https://developers.openai.com/api/docs/pricing
- https://developers.openai.com/api/docs/models/gpt-5.6-sol
- https://platform.claude.com/docs/en/models/fable-5/overview
- https://ai.google.dev/gemini-api/docs/pricing
- https://epoch.ai/data/ai-data-centers/directory/colossus-1
- https://artificialanalysis.ai/articles/artificial-analysis-intelligence-index-v4-2
- https://artificialanalysis.ai/models/grok-4-6-low


