21 июля 2026 года Google перевела в общий доступ (GA) сразу три модели линейки Gemini: Gemini 3.6 Flash — универсальную рабочую модель, Gemini 3.5 Flash-Lite — самую быструю и дешёвую в линейке 3.5, и Gemini 3.5 Flash Cyber — специализированную модель для кибербезопасности в ограниченном пилоте для госструктур и доверенных партнёров.
Что изменилось в 3.6 Flash

По данным Google и независимых замеров Artificial Analysis, 3.6 Flash обходит предшественницу по кодингу, знаниям и мультимодальным задачам, а генерирует на 17% меньше токенов на ответ — то есть не только умнее, но и «тише» в выдаче, что напрямую снижает счёт за output-токены. На бенчмарках прирост заметный: DeepSWE — с 37% до 49%, OSWorld-Verified — с 78,4% до 83,0%, MLE Bench — с 49,7% до 63,9%.
3.5 Flash-Lite работает ещё быстрее — около 350 токенов в секунду — и рассчитана на массовые фоновые задачи: парсинг, перевод, классификацию, саб-агентов. Часть флота 3.5 Flash-Lite уже используется и в Google Search.
Обе модели вышли в общий доступ одновременно, 21 июля 2026 года: Gemini 3.6 Flash (`gemini-3.6-flash`) как универсальная модель для agentic и мультимодальных сценариев, и Gemini 3.5 Flash-Lite (`gemini-3.5-flash-lite`) — как облегчённый вариант для высокоскоростных задач.
Цены
МодельInput / 1M токеновOutput / 1M токеновБесплатный тариф
Gemini 3.6 Flash
$1.50
$7.50
да, с лимитами
Gemini 3.5 Flash-Lite
$0.30
$2.50
да
Для сравнения: output у предыдущей 3.5 Flash стоил $9.00 за миллион токенов — 3.6 Flash дешевле не только за счёт цены за токен, но и за счёт меньшего числа токенов на тот же ответ.
Бенчмарки против предыдущей версии
По официальным сравнениям Google, разрыв заметен не только в маркетинговых заявлениях: на DeepSWE 3.6 Flash показывает 49% против 37% у 3.5 Flash, на MLE-Bench — 63,9% против 49,7%, на OSWorld-Verified — 83,0% против 78,4%, а по индексу GDPval-AA v2 Elo-рейтинг вырос с 1349 до 1421. По независимой оценке Artificial Analysis Index модель тратит примерно на 17% меньше output-токенов на сопоставимых задачах, а по данным самой Google в части сценариев экономия токенов доходит до 65% за счёт меньшего числа шагов рассуждения и вызовов инструментов в многошаговых агентных workflow. Ранние пользователи, названные в анонсе — Figma, Harvey, Hebbia и JetBrains.
Линейка на этом не заканчивается: рядом с 3.6 Flash в общий доступ вышла 3.5 Flash-Lite — самая быстрая модель семейства (около 350 токенов в секунду по замерам Artificial Analysis) за $0,30 на миллион входных и $2,50 на миллион выходных токенов, рассчитанная на массовые фоновые задачи вроде парсинга и классификации, а не на диалог. Отдельно Google упоминает 3.5 Flash Cyber — версию, доступную только через CodeMender для государственных организаций и доверенных партнёров, без общего доступа. Модели 3.6 Flash доступны в Gemini API, AI Studio, Android Studio, приложении Gemini, платформе Gemini Enterprise Agent и в Google Antigravity.
Доступ из России
Россия не входит в официальный список доступных регионов Gemini API и Google AI Studio — без VPN и иностранного биллинга подключить API напрямую не получится. Статус потребительского приложения gemini.google.com для РФ отдельно в анонсе не описан и зависит от IP и аккаунта. На практике разработчикам из России нужен VPN и способ оплаты за пределами страны.
Что это значит на практике
Для команд, уже использующих Gemini Flash в агентах, кодогенерации и обработке документов, апгрейд на 3.6 — это снижение счёта при том же или лучшем качестве. Для массовых фоновых задач (поиск, парсинг, суб-агенты) есть отдельная сверхдешёвая 3.5 Flash-Lite. Gemini 3.5 Pro пока доступна только избранным партнёрам, а Google уже начала pre-training Gemini 4.
Официальные источники
Факты проверены 4 августа 2026 г.














