Три уровня модели после проверки регулятором
9 июля 2026 года OpenAI объявила об общей доступности семейства моделей GPT-5.6 после ограниченного превью. В линейку входят три уровня: Sol — флагман, Terra — сбалансированная модель для повседневной работы, Luna — самая экономичная. Компания позиционирует релиз как рост «интеллекта на токен» и лучшее соотношение производительности и цены. По независимому освещению запуска, превью семейства началось 26 июня 2026 года, но публике модель тогда была недоступна: по запросу правительства США OpenAI сначала передала GPT-5.6 узкой группе доверенных партнёров, дожидаясь проверки безопасности со стороны государства. Публичный запуск 9 июля состоялся после получения разрешения от Министерства торговли США — часть подписанного в начале июня распоряжения о кибербезопасности AI, которое просит компании добровольно представлять свои самые мощные модели на государственную проверку за 30 дней до публичного релиза.

Результаты на бенчмарках
По данным OpenAI, GPT-5.6 Sol показывает передовые результаты на ряде бенчмарков. На Agents' Last Exam, тесте долгих профессиональных рабочих процессов в 55 областях, Sol набрал 53,6 — на 13,1 пункта выше Claude Fable 5 в режиме адаптивных рассуждений. При среднем уровне рассуждений Sol обходит Fable 5 на 11,4 пункта примерно при четверти оценочной стоимости. На Artificial Analysis Intelligence Index Sol с максимальным уровнем рассуждений почти догоняет Fable 5 — разница около одного пункта, — завершая задачи на 61% быстрее при примерно половине оценочной стоимости.
Возможности для кода и знаний
В программировании OpenAI заявляет: на Artificial Analysis Coding Agent Index Sol с максимальным уровнем рассуждений набирает 80 баллов — на 2,8 выше Fable 5 — при меньшем числе выходных токенов, меньшем времени и примерно на треть меньшей стоимости. Terra и Luna, по оценкам компании, тоже выгоднее конкурирующих топовых моделей по соотношению скорости, расхода токенов и цены. Отмечены передовые результаты на Terminal-Bench 2.1 и DeepSWE. В API появился режим ultra: по умолчанию он координирует четыре агента параллельно для сложных задач — в анонсе есть сравнение с конфигурациями на 1 и 16 агентов на бенчмарках BrowseComp, SEC-Bench Pro и Terminal-Bench 2.1. Режим max даёт больше времени на рассуждения, чем режим xhigh. В Responses API добавлен программный вызов инструментов: модель сама пишет и запускает небольшие программы для координации инструментов и фильтрации промежуточных данных.
Работа со знаниями и доступность
Для работы со знаниями: Sol показывает 92,2% на BrowseComp и 62,6% на OSWorld 2.0 — выше Opus 4.8 при на 85% меньшем числе выходных токенов. Улучшена работа с презентациями, документами и таблицами: следование шаблонам и мастер-слайдам, типографика, финансовые модели. OpenAI подчёркивает усиленные защитные механизмы после расширенного red-team тестирования и превью с доверенными партнёрами. GPT-5.6 вышла в общий доступ в ChatGPT, Codex и API OpenAI. Компания описывает многослойную защиту: обучение модели, проверки в реальном времени, мониторинг и доступ, откалиброванный под уровень доверия и риска. В анонсе приводятся цитаты ранних тестировщиков — Cursor, Qodo, Notion, Cognition, Rogo, Ramp, Shopify, Cisco, Clio и другие сходятся во мнении о приросте устойчивости, эффективности по токенам и качества в агентном кодинге и работе со знаниями.
Официальные источники
Факты проверены 2 августа 2026 г.














