Gemini 3.6 Flash и 3.5 Flash Lite: обзор новых моделей Google

Встречайте новинки серии Gemini, официально выпущенные 21 июля! Релиз получился нетипичным для Google: ни презентации, ни нового флагмана, ни заявлений о покорении очередной вершины интеллекта. Вместо этого — три модели среднего класса и одна внятная мысль: тем, кто гоняет ИИ-агентов в продакшене, нужен не «более умный монстр», а **меньший расход токенов**, низкая задержка и вменяемое поведение за фиксированные деньги.

Заодно Google обмолвился о планах: Gemini 3.5 Pro уже тестируется у партнеров, а для Gemini 4 запущен «самый амбициозный пре-трейнинг» в истории компании.

Что именно выпустили

Обновление затронуло всю рабочую линейку Flash — ту самую, что отвечает за массовые повседневные задачи, а не за рекорды в бенчмарках.

  • Gemini 3.6 Flash — новая основная рабочая модель, наследница 3.5 Flash. Лучше кодит, лучше работает с документами и при этом тратит заметно меньше токенов.
  • Gemini 3.5 Flash Lite — самая быстрая и дешевая модель семейства, для потоковых задач: агентного поиска, обработки документов, извлечения данных.
  • Gemini 3.5 Flash Cyber — узкоспециализированная модель для поиска и закрытия уязвимостей в коде. В открытый доступ не пойдет: только правительствам и проверенным партнерам через агент CodeMender. Причина — двойное назначение технологии. После казуса с Mythos 5 и Fable 5 от Anthropic ИИ-девелоперы повысили уровень ответственности.

Gemini 3.6 Flash: дешевизна токенов + экономность инференса

Графики производительности моделей Gemini 3.1 Pro, 3.5 Flash и 3.6 Flash по четырём категориям: разработка программного обеспечения, машинное обучение, интеллектуальная работа и использование компьютера.

Источник: Google DeepMind

Главная интрига новой «рабочей лошадки» — не в интеллекте, а в экономике. По данным Artificial Analysis, модель расходует на 17% меньше выходных токенов, чем 3.5 Flash, а на длинных агентных сценариях вроде бенчмарка DeepSWE экономия доходит до 65%: модель делает меньше шагов рассуждения и реже «дергает» инструменты.

**Одновременно Google снизил цену выходных токенов** с $9 до $7,50 за миллион при входных $1,50. Эффект перемножается: дешевле не только токен, но и само их количество на задачу.Графики сравнения среднего количества выходных токенов на задание для моделей Gemini 3.5 Flash и 3.6 Flash по двум индексам DeepSWE v1.1 и Artificial Analysis Intelligence Index.

Источник: Google DeepMind

Для Gemini 3.6 Flash сравнение с предшественницей явно в плюс. По опубликованным бенчмаркам видим рост вполне честный, а не косметический:

  • DeepSWE (агентная разработка) — 49% против 37%: меньше лишних правок кода и циклов исполнения.
  • MLE Bench (исследовательские ML-задачи) — 63,9% против 49,7%.
  • OSWorld-Verified (управление компьютером) — 83,0% против 78,4%.
  • GDPval-AA v2 (офисная работа со знаниями) — 1421 против 1349.

Два принципиально новых пункта:

  • «Управление компьютером» стало встроенным инструментом Gemini API. Модель умеет работать с интерфейсом браузера и десктопа без сторонних обвязок. У 3.5 Flash этой способности не было вовсе.
  • Усиленные защиты Frontier Safety по химико-биологическим и кибернетическим рискам. Google отдельно отмечает, что модель обучали реже отказывать в безобидных запросах.

Gemini 3.5 Flash Lite: скорость против цены

График сравнения производительности Gemini 3.5 Flash-Lite и 3.1 Flash-Lite в кодировании агентных терминалов и работе с знаниями.

Источник: Google DeepMind

Младшая модель выдает около 350 токенов в секунду — быстрее всех в семействе. Она хороша там, где важен поток, а не глубина: индексация документов, извлечение данных из тысяч карточек товаров, агентный поиск. Разработчику доступна регулировка «уровня мышления»: на минимальном модель отвечает мгновенно и почти даром, на высоком — способна вести многошаговые подзадачи в составе агентной системы.

У Gemini 3.5 Flash Lite сравнение с прошлой версией выглядит эффектнее, чем у старшей модели, — предшественница была заметно слабее:

  • Terminal-Bench 2.1 (работа в командной строке) — 54% против 31%.
  • GDM-MRCR v2 (длинный контекст) — 72,2% против 60,1%.
  • GDPval-AA v2 (рабочие задачи) — 1140 против 642, почти двукратный скачок.

При этом на части агентных тестов малышка обходит полноценную Gemini 3 Flash прошлого поколения! SWE-Bench Pro 54,2% против 49,6%, OSWorld-Verified 74,0% против 65,1%. **Самая дешевая модель нового поколения умнее вчерашней рабочей** — «закон Мура» работает и в ИИ.

Сравнительная диаграмма производительности Gemini 3.5 Flash-Lite и 3 Flash по задачам инженерного программного обеспечения и использованию компьютера.

Источник: Google DeepMind

Не обошлось и без ложки дегтя, о чем Google стыдливо умалчивает в пресс-релизе: Flash Lite ощутимо подорожала. Предыдущая 3.1 Flash Lite стоила $0,25 за миллион входных и $1,50 за миллион выходных токенов, новая — $0,30 и $2,50. Инференс стал дороже на две трети.

Логика понятна — модель стала намного умнее. Но проекты, где экономика считалась по старым ценам, придется пересчитать.

Две новинки бок о бок

Сведем ключевые параметры в одну таблицу:

Параметр Gemini 3.6 Flash Gemini 3.5 Flash Lite
Роль основная рабочая модель самая быстрая и дешевая
Цена (вход / выход за 1 млн) $1,50 / $7,50 $0,30 / $2,50
Скорость генерации ≈ 304 токена/с ≈ 350 токенов/с
Контекст 1 млн токенов 1 млн токенов
Максимальный ответ 64K токенов 64K токенов
Актуальность знаний март 2026 март 2026
Предшественник 3.5 Flash 3.1 Flash Lite
Что подорожало / подешевело выход дешевле на 17% выход дороже на две трети

Обновленный горизонт познаний

Самый недооцененный аспект новинок — дата, до которой модели знают мир. Вы знали, что датасеты предыдущих поколений Gemini обрывались на январе 2025 года? Полтора года новостей, релизов, версий библиотек и просто событий для них не существовали. Теперь порог сдвинут до марта 2026-го — тоже не совсем актуально, но лучше, чем у многих конкурентов.

Это меняет практику работы сильнее иных бенчмарков. На бытовом уровне модель не будет уверять вас, будто новейшая версия популярного фреймворка — прошлогодняя, и не придется каждый раз подключать веб-поиск ради вопросов о недавних событиях.

Для разработчиков — свежие API и синтаксис в подсказках.

Для контентщиков — меньше галлюцинаций и необходимости править тест за моделью, которая живет в позапрошлом году.

Как получить к Gemini 3.6 Flash доступ в России

Официально сервисы Google AI в России работают с ограничениями. Рабочий путь — российские агрегаторы: прямой доступ из РФ, оплата в рублях, интерфейс на русском. Приятная новость: ждать не пришлось — BotHub объявил о поддержке всех трех новых моделей в день релиза. Остальные площадки традиционно подтягивают новинки в течение нескольких дней, так что к моменту чтения этой статьи выбор наверняка шире:

  • BotHub — новые модели появились сразу, есть удобный доступ через Telegram.
  • GPTunnel — оплата по факту использования, без подписок.
  • Study24 — быстрый доступ к свежим моделям.
  • Fichi AI — большой каталог моделей в одном кабинете.

К Gemini 3.5 Flash Lite доступ через агрегаторы устроен так же — модель подключается в том же кабинете и переключается прямо в диалоге.

Единственный нюанс работы через посредника: задержка чуть выше, чем при прямом подключении, поскольку добавляется слой проксирования. Для пакетной обработки это несущественно, в интерактивных сценариях — иногда заметно.

Первые отклики

Инфографика о новых моделях Google Gemini 3.6 Flash и 3.5 Flash Lite, описывающая их ключевые параметры, преимущества, сравнение производительности и планы Google.

С момента релиза прошло меньше двух суток, поэтому массовой статистики пока нет. Но ранние сигналы сходятся в одном: релиз оценивают как крепкий рабочий апдейт, а не как сенсацию.

Партнеры Google, тестировавшие модели до анонса, хвалят прежде всего экономику. Юридический сервис Harvey сообщает о примерно **12% ускорении выполнения** задач, исследовательская платформа Hebbia отмечает прогресс в разборе документов, графиков и подготовке отчетов. Также дали позитивные отзывы Figma и JetBrains.

У младшей модели среди первых клиентов — Palo Alto Networks и финтех Ramp. Там ключевым называют сочетание скорости с ценой при обработке больших потоков.

Практикующие пользователи в русскоязычном сообществе отмечают то же самое, но своими словами. 3.6 Flash хороша именно как агентный движок — заметно быстрее в работе, экономнее расходует лимиты и реже требует правок за собой. Последнее особенно ценно. **Время**, сэкономленное на переделках, обычно больше выигрыша в скорости самой генерации.

Скепсис тоже есть, и вполне резонный. Часть наблюдателей напоминает, что верить цифрам пока преждевременно. Улучшения работы измерены самим Google на выбранных им бенчмарках. Независимые замеры еще впереди.

Сравнение с конкурентами

Обе новинки играют в среднем классе, где решает не абсолютный интеллект, а цена задачи. Вот как они смотрятся на фоне соседей по рынку:

Модель Цена выхода за 1 млн Контекст Ниша
Gemini 3.6 Flash $7,50 1 млн агенты, кодинг, работа с документами
Gemini 3.5 Flash Lite $2,50 1 млн высоконагруженные потоковые задачи
Claude Sonnet 5 выше среднего 1 млн агентные и рабочие сценарии, качество текста
GPT-5.6 уровень флагмана большой универсальные и сложные задачи
DeepSeek V4 Flash минимальная 1 млн бюджетные массовые задачи, доступ из РФ

Что мы наблюдаем:

  • Gemini держит первенство по контексту и цене за агентную задачу,
  • Claude Sonnet 5 остается сильнее в аккуратной работе с текстом и документами,
  • GPT-5.6 — в сложных универсальных сценариях,
  • DeepSeek выигрывает по абсолютной дешевизне и доступности из России без посредников.

Для рунета важен и практический момент: китайские модели работают напрямую, а к Gemini путь лежит через агрегатор.

Плюсы и минусы

Плюсы
  • + Экономика агентных задач: на 17% меньше выходных токенов при цене ниже прежней.
  • + Актуальность знаний до марта 2026 года вместо января 2025-го.
  • + Управление компьютером как встроенный инструмент — без сторонних обвязок.
  • + Рост по всем опубликованным бенчмаркам, а у Flash Lite — почти двукратный.
  • + Миллион токенов контекста и мультимодальность на входе сохранены.
Минусы
  • - Flash Lite подорожала: выходные токены стоят на две трети больше предшественницы.
  • - Все цифры прироста — из внутренних замеров Google, независимых подтверждений пока мало.
  • - Прямой доступ из России ограничен: нужен агрегатор, а с ним — небольшая дополнительная задержка.
  • - Flash Cyber закрыта для широкой публики, а обещанная Gemini 3.5 Pro пока только у партнеров.

Вывод

Google не стал выкатывать очередного гиганта, а сделал то, чего давно просили разработчики: заставил рабочие модели тратить меньше токенов, отвечать быстрее и вести себя предсказуемо в длинных агентных сценариях. Gemini 3.6 Flash при этом еще и подешевела — нетипичный случай для индустрии.

Обратная сторона — подорожавшая Flash Lite: за возросший интеллект младшей модели придется доплатить.

Кому стоит переключаться прямо сейчас? Всем, кто строит агентов и автоматизации. Здесь выигрыш измеряется в счетах за API.

Кому можно не спешить? Тем, кто использует Flash для простых чатов и разовых задач — разница будет заметна меньше.

А вы уже пробовали новые Gemini? Поделитесь вашими впечатлениями в комментариях!

Часто задаваемые вопросы

Чем Gemini 3.6 Flash отличается от 3.5 Flash? Toggle
Тратит на 17% меньше выходных токенов при более низкой цене, лучше кодит и работает с документами, умеет управлять компьютером и знает события до марта 2026 года.
Сколько стоят новые модели? Toggle
Gemini 3.6 Flash — $1,50 за миллион входных и $7,50 за миллион выходных токенов. Gemini 3.5 Flash Lite — $0,30 и $2,50 соответственно.
Как пользоваться новыми моделями из России? Toggle
Через российские агрегаторы — например, BotHub, где модели появились в день релиза. Прямой доступ к Google AI Studio из РФ ограничен.
Какую модель выбрать под свою задачу? Toggle
3.6 Flash — для агентов, кода и работы с документами, где важно качество. 3.5 Flash Lite — для потоковых задач: массовой обработки данных, поиска, извлечения информации.
Когда выйдет Gemini 3.5 Pro? Toggle
Точной даты нет: Google сообщил, что модель тестируется у партнеров и выйдет, как только будет готова. Параллельно начато обучение Gemini 4.