12 августа 2026 года компания xAI представила языковую модель Grok 4.6. Юридическим лицом проекта выступает SpaceXAI LLC, при этом привычные бренд xAI и интерфейсы API сохранены без изменений. Релиз вызвал оживленные обсуждения в индустрии, однако вопреки поспешным предположениям о смене архитектуры или демпинге цен, Grok 4.6 представляет собой глубокое пост-тренировочное обновление (post-training upgrade) модели Grok 4.5. Инженерные доработки сфокусированы на поведении долгоживущих автономных агентов (long-running agents), генерации программного кода (coding) и аналитической работе со знаниями (knowledge work). Это не анонс новой структуры разреженной смеси экспертов (MoE) и не демпинг стоимости токенов.

12 августа Artificial Analysis поставила Grok 4.6 61 балл Intelligence Index — вровень с GPT-5.6 Sol, ниже Claude Fable 5 (62) и Claude Opus 5 (63). 4 сентября индекс перешёл на версию v4.2; на живой карточке модели 6 сентября Grok 4.6 в режиме high даёт 51 балл. Это смена методики, а не падение чекпоинта. Лидерами v4.2 стали Claude Fable 5.1 и GPT-6 Astra. Важно подчеркнуть, что сводный Intelligence Index платформы Artificial Analysis является сторонним агрегированным рейтингом, а не абсолютной истиной. Индекс помогает оценить баланс моделей, но реальная применимость в продакшене определяется профилем задач конкретного проекта.

Кластер суперкомпьютера Colossus с жидкостным охлаждением в Мемфисе

1. Аппаратный фундамент и эволюция суперкомпьютера Colossus

Вычислительной основой экосистемы xAI выступает дата-центр Colossus в Мемфисе. В ретроспективе проект начинался в 2024 году с площадки на 100 000 графических процессоров Nvidia H100. К 2025 году суммарный объем ускорителей был доведен до 200 000 единиц.

К 2026 году инфраструктура Colossus эволюционировала в две очереди. Площадка Colossus 1 насчитывает свыше 220 000 ускорителей в смешанной конфигурации из поколений Nvidia H100, H200 и B200. Очередь Colossus 2 строится на базе ускорителей Nvidia B200 и B300. С инженерной точки зрения некорректно привязывать обучение и инференс Grok 4.6 к конкретной фазе кластера: нагрузки компании распределяются динамически по доступным мощностям.

Сетевая топология комплекса требует фактологической строгости. Официальные спецификации подтверждают применение интерконнекта Spectrum-X Ethernet с пропускной способностью 2.8 Тбит/с на серверный узел. Утверждения о пропускной способности 3.2 Тбит/с и однозначном использовании протокола RoCEv2 не подтверждены документацией xAI и не являются верифицированным фактом.

Аналогичная осторожность необходима при оценке охлаждения. Стойки с жидкостным охлаждением (liquid-cooled racks) упоминаются строго с инженерной оговоркой: xAI не раскрывает степень внедрения и не заявляет о стопроцентном переходе всех узлов на прямое охлаждение кристаллов (Direct-to-Chip Liquid Cooling). Соответственно, приписываемый площадке коэффициент энергоэффективности PUE (Power Usage Effectiveness) на уровне 1.12 не является подтвержденным показателем площадки.

xAI не публикует точные MoE-спецификации 4.6 (число параметров и маршрутизацию). Исторически семейство Grok использовало архитектуру разреженной смеси экспертов (MoE), а модельная карточка предыдущих версий упоминала fused MoE kernels, однако публичной архитектурной карты 4.6 нет.

2. Подтвержденные параметры API и реальная экономика: почему это не демпинг

Интерфейс API xAI предоставляет разработчикам строго определенные параметры интеграции Grok 4.6:

  • Идентификатор модели в API: grok-4.6.
  • Размер контекстного окна: 500000 токенов (500k context).
  • Дата отсечки обучающих данных (Knowledge cutoff): январь 2026 года (Jan 2026).
  • Уровни глубины рассуждений (reasoning effort): режимы low, medium, high и xhigh.
  • Пакетная обработка запросов (Batch API): не поддерживается.

Тарифная сетка xAI дифференцирована в зависимости от размера контекста:

Длина входного промпта

Входные токены (Prompt / 1M)

Кэшированный ввод (Cached / 1M)

Выходные токены (Output / 1M)

До 200k токенов (< 200k)

$2.00

$0.50

$6.00

От 200k токенов и выше (>= 200k)

$4.00

$1.00

$12.00

Для запросов в приоритетных очередях (режимы fast / priority) действует наценка примерно 2x к базовым ставкам.

Называть эти тарифы демпингом некорректно: вход и выход $2.00 / $6.00 до 200k совпадают с Grok 4.5. Кэш не совпадает: у 4.6 это $0.50 / $1.00, у 4.5 было $0.30 / $0.60.

Сравнение цен с актуальными моделями конкурентов подчеркивает разнородность рынка без универсального вывода:

  • OpenAI GPT-5.6 Sol: предлагает окно 1.05M токенов по промо-тарифу $4.00 за 1M входных и $20.00 за 1M выходных токенов. Grok 4.6 существенно дешевле по генерации ответа ($6 против $20), но уступает по объему контекста (500k против 1.05M).
  • Anthropic Claude Sonnet 5: $2.00 за вход и $10.00 за выход на 1M токенов. Входная цена равна Grok 4.6, а генерация у Grok дешевле ($6 против $10).
  • Anthropic Claude Opus 5: флагман премиального сегмента со стоимостью $5.00 за вход и $25.00 за выход на 1M токенов, что заметно дороже Grok 4.6 по обоим компонентам.
  • Google Gemini 3.x, включая версии Flash: в зависимости от нагрузки и выбранной модели сервис Google может обходиться дешевле Grok 4.6, особенно на коротких запросах и пакетных задачах.

Универсального вывода о безоговорочном ценовом превосходстве сделать нельзя: Grok 4.6 выгоден при генерации объемных ответов среди тяжелых моделей, но не является универсально самым дешевым решением на рынке.

Интерфейс поиска в реальном времени и терминал вызова функций Grok 4.6

3. Серверные инструменты поиска: возможности и границы web_search и x_search

Платформа xAI встраивает поиск в рантайм модели через серверные инструменты (server-side tools). Для многих сценариев это позволяет начать без собственной поисковой прослойки, хотя не заменяет RAG-архитектуру там, где нужны контролируемый корпус документов, специальные права доступа или собственная индексация:

  1. web_search: серверный инструмент обращения к внешнему вебу с возвратом текстовых фрагментов веб-страниц.
  2. x_search: инструмент поиска по платформе X, поддерживающий четыре режима выборки: keyword — поиск по ключевым словам и фразам; semantic — семантический поиск по смысловой близости запроса; user — фильтрация публикаций по конкретным пользователям и авторам; thread — структурированный анализ веток обсуждений и связанных сообщений.

Ответы модели сопровождаются механизмом цитирования первоисточников (citations). Стоимость поисковых вызовов строго стандартизирована: каждый вызов инструментов web_search и x_search тарифицируется по цене $5 за 1000 вызовов инструментов ($5 per 1000 tool calls) дополнительно к оплате токенов диалога.

При этом необходимо соблюдать фактологические рамки и отделять документированные функции от домыслов. В официальной документации xAI категорически отсутствуют упоминания о прямом нелимитированном доступе к потоку Firehose, локальных векторных индексах HNSW, фильтрах спама и бот-сетей или автоматической перекрестной проверке фактов по базам arXiv, PubMed и GitHub. Также API не возвращает системные таймстемпы верификации или числовые оценки уверенности (confidence scores). Поиск xAI представляет собой документированные вызовы инструментов с цитированием первоисточников.

4. Агентные сценарии: параллельный вызов функций и структурированный вывод

Для автономных агентных сценариев (agentic workflows) модель Grok 4.6 предоставляет развитые программные интерфейсы:

  • Параллельный вызов функций (parallel function calling): включен в API по умолчанию (enabled by default). Разработчик может передать до 200 спецификаций инструментов (tools) на один запрос, а модель способна запланировать и вернуть аргументы сразу для нескольких параллельных вызовов в едином шаге генерации. Это существенно сокращает задержки при синхронизации агента с внешними базами данных.
  • Структурированный вывод (structured outputs): базируется на механизме принудительного декодирования (constrained decoding), обеспечивающем соответствие ответов схеме JSON Schema.

Следует понимать границы технологии: структурированный вывод реализован программно в рантайме инференса, а не на аппаратном уровне (not hardware). Соответствие схеме гарантируется только для поддерживаемого набора конструкций JSON Schema; часть спецификаций обрабатывается по принципу наилучшего приближения (best-effort). Абсолютной гарантией соответствия произвольной схеме данное решение не является.

5. Результаты бенчмарков: данные вендора и независимый аудит Artificial Analysis

Оценка возможностей Grok 4.6 строится на сопоставлении внутренних замеров вендора и стороннего аудита.

В официальном анонсе от 12 августа 2026 года xAI опубликовала таблицу результатов собственных внутренних тестов:

Бенчмарк / Оценочная шкала

Результат (Вендорская таблица xAI, 12 августа 2026 года)

Artificial Analysis Intelligence Index

61

GDPval-AA

1753

CursorBench

69.9%

DeepSWE

65.9%

FrontierCode

61.3%

APEX-Agents

57.5%

Terminal-Bench 3.0

26.0%

APEX-SWE

56.4%

AA-Briefcase

1577

Harvey LAB

15.8%

В опубликованную таблицу xAI не были включены результаты по таким распространенным тестам, как классический SWE-bench Verified, математический бенчмарк AIME и соревновательный LiveCodeBench.

Независимые замеры Artificial Analysis важно датировать, поскольку 4 сентября сервис сменил версию индекса:

  • Intelligence Index: 61 на 12 августа — паритет с GPT-5.6 Sol на тогдашней методике; 51 у Grok 4.6 в режиме high на живой карточке 6 сентября после перехода на Index v4.2.
  • Оценочная стоимость типовой сложной задачи (cost per task): $0.84 в разборе от 12 августа и $1.25 на карточке 6 сентября; состав индекса изменился вместе с методикой.
  • Скорость генерации (throughput) Grok 4.6 в режиме high: 62.8 выходных токена в секунду. high — уровень по умолчанию, а не максимальный xhigh.
  • Время до первого токена (TTFT): 52.44 секунды при high и 8.05 секунды при low.

Различие между пропускной способностью генерации и задержкой TTFT принципиально для клиентских систем. Показатель 62.8 токена в секунду описывает скорость потока после начала генерации видимого ответа. При high начальная пауза до первого видимого токена в замере Artificial Analysis составляет около 52 секунд. Для клиентских приложений это означает необходимость заранее проектировать таймауты, потоковую выдачу и пользовательский интерфейс ожидания.

6. Корпоративная безопасность, комплаенс и хранение данных

Для корпоративных клиентов компания xAI регламентирует следующие правила безопасности и хранения данных:

  1. Хранение данных по умолчанию (Data Retention): журнал запросов хранится на серверах компании 30 дней для мониторинга безопасности и аудита. Данные коммерческого API гарантированно не используются для обучения базовых моделей xAI.
  2. Режим нулевого хранения (Zero Data Retention, ZDR): доступен как опция opt-in на уровне всей команды (team-wide). Включение ZDR исключает сохранение данных на стороне провайдера, но делает недоступными stateful-сервисы платформы: сессионные ответы (Responses), файловые хранилища (Files), коллекции (Collections) и пакетные вызовы (Batch).
  3. Аудит SOC 2 Type II: заявление о наличии отчета SOC 2 Type II является утверждением самого вендора (vendor claim); ознакомление с детальным отчетом возможно только корпоративными клиентами под соглашением о неразглашении (NDA).
  4. Управление ключами шифрования (Vault / CMEK): механизмы Vault и клиентских ключей шифрования (CMEK) анонсированы для корпоративной подписки веб-сервиса grok.com enterprise. Это не равнозначно поддержке открытого API с аппаратными модулями безопасности (HSM) или универсального режима BYOK для разработчиков.
  5. Медицинские и отраслевые стандарты: соглашение о деловом сотрудничестве по стандарту HIPAA (Business Associate Agreement, BAA) доступно для заключения только при определенных контрактных обстоятельствах и тарифах, не являясь абстрактной сертификацией модели.
  6. Ограничения по стандартам ISO и GDPR: заявлять о наличии сертификата соответствия ISO 27001 для API xAI нельзя из-за отсутствия официальных подтверждений. Соответствие требованиям GDPR и подписание соглашения об обработке данных (DPA) описываются компанией исключительно в рамочных, условных юридических терминах.

7. Итоги и выводы: практическое позиционирование Grok 4.6

Релиз Grok 4.6 вернул xAI в группу лидеров фронтирного сегмента на том же базовом ценнике $2.00 / $6.00 за 1M токенов, что и у версии 4.5. Модель продемонстрировала паритет с GPT-5.6 Sol в рейтинге Artificial Analysis (61 пункт), однако не стала абсолютным лидером на всех типах прикладных задач.

Ключевыми инженерными ограничениями остаются:

  • Размер контекста: окно в 500000 токенов уступает конкурирующим системам с контекстом 1M+ токенов (включая GPT-5.6 Sol с 1.05M).
  • Сложные автономные среды: в вендорской таблице результат Terminal-Bench 3.0 составляет 26%, а публичной цифры по SWE-bench Verified xAI не приводит. Эти данные не позволяют объявить модель лидером в терминальной автоматизации и устранении багов в репозиториях.
  • Временные задержки инференса: длительное время TTFT (около 52,44 секунды при high) требует адаптации архитектуры клиентских приложений к продолжительным паузам ожидания ответа.

Grok 4.6 — зрелый инструмент для агентных конвейеров, кодинга и серверного поиска, требующий учета инфраструктурных ограничений перед внедрением в промышленную эксплуатацию.

Источники

  1. https://x.ai/news/grok-4-6
  2. https://docs.x.ai/developers/grok-4-6
  3. https://docs.x.ai/developers/models/grok-4.6
  4. https://docs.x.ai/developers/pricing
  5. https://docs.x.ai/developers/tools/web-search
  6. https://docs.x.ai/developers/tools/x-search
  7. https://docs.x.ai/developers/tools/function-calling
  8. https://docs.x.ai/developers/model-capabilities/text/structured-outputs
  9. https://docs.x.ai/developers/faq/security
  10. https://x.ai/legal/faq-enterprise/
  11. https://x.ai/colossus
  12. https://x.ai/news/anthropic-compute-partnership
  13. https://artificialanalysis.ai/articles/grok-4-6-benchmarks-and-analysis
  14. https://artificialanalysis.ai/models/grok-4-6
  15. https://developers.openai.com/api/docs/pricing
  16. https://developers.openai.com/api/docs/models/gpt-5.6-sol
  17. https://platform.claude.com/docs/en/models/fable-5/overview
  18. https://ai.google.dev/gemini-api/docs/pricing
  19. https://epoch.ai/data/ai-data-centers/directory/colossus-1
  20. https://artificialanalysis.ai/articles/artificial-analysis-intelligence-index-v4-2
  21. https://artificialanalysis.ai/models/grok-4-6-low