Что за модель и для кого
8 июля 2026 года Cursor выпустил модель Grok 4.5 совместно со SpaceXAI, назвав её «самой умной моделью и первой, которую построили не только для разработки ПО». Модель рассчитана на сложные, долгие задачи с творческим использованием инструментов — программная инженерия, работа с данными, финансы, юридическая работа или, по формулировке компаний, «что угодно ещё, чем вы занимаетесь за компьютером».

Как обучали Grok 4.5
Grok 4.5 — модель типа mixture-of-experts, обученная совместно со SpaceXAI. В обучение вошли триллионы токенов данных Cursor — реальных взаимодействий пользователей с кодовыми базами и инструментами разработки, благодаря чему модель училась на настоящем софте и на взаимодействии разработчиков с AI-агентами. В отличие от узкоспециализированной на коде модели Composer 2.5, микс данных для Grok 4.5 намеренно шире: качественные STEM-задачи, научные статьи и другая работа со знаниями. Отдельный этап — обучение с подкреплением на сложных задачах в реалистичных средах, охватывающих и разработку ПО, и более широкую работу со знаниями: модель училась исследовать задачу, применять инструменты, восстанавливаться после ошибок и проверять результат. Часть задач специально устроена так, что с ними не справляются даже топовые модели. Распределённая система агентов строит такие среды в масштабе: инженеры задают условие задачи и способ проверки, а большие группы агентов строят, тестируют и дорабатывают решение — по формулировке Cursor, «на некоторые из них у команды из сотен инженеров ушли бы месяцы». Предыдущая модель использовалась, чтобы ускорить создание следующей — это прямая формулировка компании.
Цена и доступность
Модель уже доступна на десктопе, в вебе, на iOS, в CLI и через SDK. Индивидуальные и командные тарифы включают существенный объём использования из пула собственных моделей Cursor, а на первую неделю лимит удвоен. Базовая цена — $2 за миллион входных токенов и $6 за миллион выходных; более быстрый вариант модели стоит $4 за миллион входных и $18 за миллион выходных токенов. Модель Composer 2.5 остаётся в списке доступных — она рассчитана на другой класс задач. Вместе с релизом добавлены новые меры защиты с учётом возможностей модели в области кибербезопасности.
Важная оговорка про бенчмарки
Сама Cursor честно предупреждает в официальном посте: на бенчмарке CursorBench у Grok 4.5 есть преимущество, поскольку в обучающие данные случайно попал более ранний снепшот кодовой базы Cursor — точный эффект от этого не оценён, для будущих моделей данные уже удалены, а более крупное обновление CursorBench находится в разработке. Результаты по бенчмаркам SWE-Bench Pro и Terminal-Bench для сторонних моделей указаны со слов самих разработчиков этих моделей, а многоязычный результат GPT-5.5 — это внутренний прогон самой Cursor. Источник анонса — официальный пост Cursor от 8 июля 2026 года, продублированный на сайте xAI.
Реальные цифры на бенчмарках
По независимым замерам, на Terminal-Bench 2.1 Grok 4.5 набрал 83,3% — это чуть ниже Fable 5 (84,3%) и GPT-5.5 (83,4%), но выше Opus 4.8 (78,9%). На SWE-Bench Pro результат ровно противоположный: 64,7% против 69,2% у Opus 4.8 и 80,4% у Fable 5 — Grok 4.5 явно сильнее в агентных сценариях работы с терминалом, чем в решении задач по кодовой базе SWE-Bench.
Официальные источники
Факты проверены 25 июля 2026 г.














