Google выпустила три модели Gemini Flash, но флагман 3.5 Pro всё ещё не готов

Google представила три новые модели семейства Gemini Flash: 3.6 Flash, 3.5 Flash-Lite и специализированную 3.5 Flash Cyber для кибербезопасности. При этом ожидаемый флагман Gemini 3.5 Pro по-прежнему не вышел в публичный доступ, компания тестирует его только с партнёрами и обещает выпустить, «как только он будет готов». Одновременно Google заявила, что уже началось предобучение Gemini 4, назвав это своим «самым амбициозным тренировочным прогоном» и добавив, что «воодушевлена прогрессом», формулировки читаются как попытка сгладить отставание.
Gemini 3.6 Flash сделала ставку на эффективность: по данным Artificial Analysis Index, модель тратит примерно на 17% меньше выходных токенов, чем 3.5 Flash, а на отдельных бенчмарках вроде DeepSWE экономия достигает 65%. Цена снижена до $1,50 за миллион входных токенов и $7,50 за миллион выходных, заметно дешевле прежней 3.1 Pro, которую 3.6 Flash стабильно обходит по бенчмаркам. Рост показателей относительно 3.5 Flash: DeepSWE, с 37 до 49%, MLE Bench, с 49,7 до 63,9%, OSWorld-Verified, с 78,4 до 83%, GDPval-AA v2 (оценка офисной работы), с 1349 до 1421 балла. В API и Gemini Enterprise встроен инструмент Computer Use, а также усилена защита Frontier Safety от рисков в сфере ХБРЯ (химическое, биологическое, радиологическое, ядерное оружие) и кибератак. Несмотря на успехи в мультимодальных задачах и контекстное окно в миллион токенов, модель всё ещё отстаёт от лучших разработок конкурентов из США и Китая. Сотрудник Google Логан Килпатрик ответил на критику в соцсети X, заявив, что целью было именно повышение эффективности, удобства и снижение цены, а рост качества, приятное дополнение.
Gemini 3.5 Flash-Lite нацелена на дешёвую обработку больших объёмов запросов: по данным Artificial Analysis, скорость генерации, 350 токенов в секунду, цена, $0,30 за миллион входных и $2,50 за миллион выходных токенов. Модель превосходит более старую 3 Flash на нескольких агентных и кодовых бенчмарках, включая SWE-Bench Pro и OSWorld-Verified; по сравнению с прямым предшественником 3.1 Flash-Lite результат на Terminal-Bench 2.1 вырос с 31 до 54%. Именно 3.5 Flash Google в своё время представила на конференции I/O как основу агентной стратегии, позже добавив нативную функцию управления браузером, компьютером и мобильными устройствами.
Третья модель, 3.5 Flash Cyber, построена на базе 3.5 Flash и заточена под задачи кибербезопасности; она встроена в CodeMender, агента DeepMind для поиска и устранения уязвимостей в коде. Несколько параллельно работающих подагентов Flash Cyber сводят результаты в единый отчёт. На бенчмарке CyberGym модель набрала 83,2%, всего на два пункта меньше, чем GPT-5.5-Cyber от OpenAI (85,6%), при заметно меньшем размере модели. Команда Google Big Sleep использовала модель для поиска критических уязвимостей в Chrome и Safari: при сканировании коммитов движка V8 Flash Cyber нашла 55 подтверждённых уникальных находок против 47 у обычной 3.5 Flash и 36 у Claude Opus 4.6 от Anthropic; по словам Google, десять находок Flash Cyber не повторила ни одна другая модель. В отдельном тесте команда Cloud Vulnerability Research использовала модель для сканирования публичных API и за два часа нашла уязвимости удалённого выполнения кода, подготовив рабочий эксплойт, обходящий защиту. Поскольку модель одинаково эффективна и в атаке, и в защите, доступ к ней Google жёстко ограничила: 3.5 Flash Cyber через CodeMender доступна только правительствам и доверенным партнёрам в рамках пилотной программы. Сам агент CodeMender Google делает широко доступным в превью через Gemini Enterprise Agent Platform, но в этой версии он работает на обычных моделях Gemini и поддерживает языки C/C++, Go, Java, Python, Ruby, Rust и TypeScript.
Главная проблема, отсутствие публичной Gemini 3.5 Pro. К этому моменту конкуренты уже выпустили модели такого класса: у OpenAI это GPT-5.6 Sol, у Anthropic, Fable и Mythos, китайские лаборатории Moonshot (Kimi K3) и Zhipu (GLM-5.2) подбираются к топовому уровню, а Meta недавно выпустила модель, которая обходит текущую линейку Google в написании кода. Вместо конкуренции на самом верху рынка Google в очередной раз обновила линейку Flash, сделав акцент на эффективности и цене. По данным недавнего отчёта Bloomberg, флагманская модель отстаёт от графика на месяцы, компания продолжает работать над улучшением её результатов в написании кода. Пока 3.5 Pro остаётся в закрытом тестировании, у Google нет публичной модели, способной конкурировать за первое место на рынке.
Ключевые факты
- Google выпустила три модели Gemini Flash: 3.6 Flash (эффективность и цена), 3.5 Flash-Lite (скорость и низкая стоимость) и 3.5 Flash Cyber (кибербезопасность, доступ только по приглашению)
- Флагманская Gemini 3.5 Pro всё ещё не вышла в публичный доступ, тестируется у партнёров; по данным Bloomberg, отстаёт от графика на месяцы
- Gemini 3.6 Flash дешевле и на некоторых бенчмарках экономичнее по токенам на 65%, чем 3.5 Flash, но всё ещё уступает лучшим моделям конкурентов из США и Китая
- 3.5 Flash Cyber на CyberGym набрала 83,2% (почти на уровне GPT-5.5-Cyber от OpenAI) и в тестах на поиск уязвимостей в Chrome/Safari обошла Claude Opus 4.6 от Anthropic
- Google уже начала предобучение Gemini 4, назвав это своим «самым амбициозным тренировочным прогоном»
Почему это важно
Google в очередной раз обновляет линейку компактных моделей вместо выпуска флагмана. Это прямой сигнал отставания: пока OpenAI (GPT-5.6 Sol), Anthropic (Fable, Mythos), китайские Moonshot и Zhipu, а теперь и Meta уже предлагают модели топового уровня, Google продолжает тестировать Gemini 3.5 Pro в закрытом режиме. Одновременное объявление о старте предобучения Gemini 4 выглядит попыткой сместить фокус внимания с текущего провала по срокам.
Кому это важно
Разработчикам и компаниям, выбирающим модели для агентных и кодовых задач по соотношению цена/качество, Gemini 3.6 Flash и 3.5 Flash-Lite дешевле предшественников и подходят для масштабных нагрузок. Специалистам по кибербезопасности и государственным структурам, доступ к 3.5 Flash Cyber ограничен правительствами и доверенными партнёрами. Тем, кто ждёт от Google топовую модель уровня GPT-5.6 Sol или Fable, придётся подождать ещё.
Как это применить
Gemini 3.6 Flash стоит $1,50 за миллион входных и $7,50 за миллион выходных токенов, Gemini 3.5 Flash-Lite, $0,30 и $2,50 соответственно; обе доступны через обычный Gemini API и Gemini Enterprise, с встроенным инструментом Computer Use для управления браузером и устройствами. Агент CodeMender на базе стандартных моделей Gemini доступен в превью через Gemini Enterprise Agent Platform и поддерживает C/C++, Go, Java, Python, Ruby, Rust и TypeScript; версия на 3.5 Flash Cyber, только для правительств и партнёров по пилотной программе.
Можно ли доверять
Цифры по бенчмаркам (DeepSWE, MLE Bench, OSWorld-Verified, GDPval-AA v2, CyberGym, Terminal-Bench 2.1) приведены самой Google и агрегатором Artificial Analysis Index, независимой верификации в материале нет. Отставание по срокам подтверждено внешним источником: об этом со ссылкой на отчёт Bloomberg пишет и сам The Decoder.
Риски и подводные камни
Модель 3.5 Flash Cyber, по признанию самой Google, одинаково эффективна и для атаки, и для защиты, именно поэтому доступ к ней жёстко ограничен правительствами и доверенными партнёрами, а не открыт разработчикам. Пока Gemini 3.5 Pro остаётся в закрытом тестировании, у Google нет публичной модели, способной конкурировать за первое место на рынке, компания рискует и дальше терять позиции, пока конкуренты наращивают отрыв.
«Это наш самый амбициозный тренировочный прогон на сегодняшний день, и нас воодушевляет прогресс»
— Google, о начале предобучения Gemini 4
Компания Meta Platforms признана экстремистской организацией, её деятельность на территории РФ запрещена.