Google представил Gemini 3.6 Flash, 3.5 Flash-Lite и 3.5 Flash Cyber

Gemini 3.6 Flash, 3.5 Flash-Lite и 3.5 Flash Cyber

В линейке Gemini от Google появилось сразу три новые модели: 3.6 Flash, 3.5 Flash-Lite и 3.5 Flash Cyber. В основе у всех троих лежит Gemini 3.5 Flash, а цель у релиза одна — снизить стоимость и ускорить работу AI-агентов, которые уже используются в реальных production-сценариях.

3.6 Flash — рабочая лошадка с меньшим расходом токенов

Главная модель релиза — 3.6 Flash. По словам разработчиков, она заметно прибавила в написании кода, в аналитике и в одновременной работе с картинками и текстом, а расход ресурсов при этом упал. Замеры Artificial Analysis Index показывают падение объёма выходных токенов на 17% относительно 3.5 Flash. А в отдельных задачах, например в тесте DeepSWE, который проводит компания Datacurve, экономия и вовсе достигает 65%.

Подешевела и сама модель: 1,5 доллара за миллион токенов на входе и 7,5 доллара за миллион на выходе. Прежняя версия стоила дороже, поэтому и запуск агентов в целом выходит экономнее.

Растут и показатели качества. В тесте DeepSWE доля успешно решённых задач поднялась с 37 до 49 процентов, а в MLE Bench, где оценивают работу с задачами машинного обучения — с 49,7 до 63,9 процента. В OSWorld-Verified, который проверяет умение управлять компьютером, цифра выросла с 78,4 до 83 процентов. Само управление компьютером теперь не требует отдельной настройки — этот инструмент уже встроен в модель и подключается через Gemini API или Gemini Enterprise.

3.6 Flash - рабочая лошадка с меньшим расходом токенов

С офисными задачами — разбором документов, таблиц, подготовкой отчётов — 3.6 Flash тоже справляется лучше прежней версии. Об этом говорят компании Hebbia и Harvey, которые применяют модель для анализа финансовой отчётности и текстов.

3.5 Flash-Lite - расчёт на скорость и объём

Google отдельно упоминает работу над безопасностью: у 3.6 Flash усилили защиту от рисков, связанных с химическим, биологическим оружием и киберугрозами. Модель стало труднее обмануть и заставить обойти встроенные ограничения, при этом на обычные, безобидные запросы она стала отказывать реже.

3.5 Flash-Lite — расчёт на скорость и объём

Вторая новинка, 3.5 Flash-Lite, создавалась под другой сценарий: тут важна не глубина размышлений, а скорость реакции и способность разгребать большой поток запросов одновременно. Пример — поисковые агенты или массовая обработка документов.

Среди всей линейки 3.5 эта модель — самая шустрая: 350 токенов в секунду, если верить замерам Artificial Analysis. Стоит она 0,3 доллара за миллион токенов на входе и 2,5 доллара за миллион на выходе, а качество работы заметно подросло по сравнению с 3.1 Flash-Lite.

Модель умеет работать в разных режимах «размышления» — от минимального, для быстрых и простых операций, до более развернутого, когда сценарий состоит из нескольких шагов и подзадач. Управление компьютером здесь тоже доступно сразу, без дополнительной настройки, как и у старшей модели линейки.

В кодинге и агентных задачах результаты тоже выросли: Terminal-Bench 2.1 поднялся с 31 до 54 процентов, а работа с длинным контекстом по тесту GDM-MRCR v2 — с 60,1 до 72,2 процента. Любопытный момент: по некоторым метрикам младшая Flash-Lite обходит даже модель 3 Flash — в SWE-Bench Pro у неё 54,2% против 49,6%, а в OSWorld-Verified — 74% против 65,1%. Получается, что более лёгкая по названию модель на деле оказывается и быстрее, и местами точнее старшей.

3.5 Flash Cyber — узкоспециализированная модель для CodeMender

Третья модель — 3.5 Flash Cyber, отдельно дообученная версия 3.5 Flash под конкретную задачу: находить и закрывать уязвимости в программном коде. Отдельно она почти не применяется — работает внутри агента CodeMender, где сразу несколько копий модели параллельно разбирают код и потом сводят выводы в единый отчёт. На бенчмарке CyberGym итоговые цифры не уступают куда более тяжёлым и дорогим моделям.

Технология может пригодиться как для защиты систем, так и для атак на них, поэтому Google решила ограничить круг пользователей: доступ к модели получат только госструктуры и проверенные партнёры, и то в рамках закрытого пилота через CodeMender. Смысл в том, чтобы дать специалистам по безопасности время найти и закрыть дыры раньше, чем ими воспользуются злоумышленники.

Кому и где доступны новые модели

Запуск 3.6 Flash и 3.5 Flash-Lite уже состоялся, воспользоваться ими можно по нескольким каналам:

  • программистам — через Google AI Studio, Android Studio, а также Google Antigravity, куда пока подключили только 3.6 Flash;
  • компаниям — через платформу Gemini Enterprise Agent Platform и приложение Gemini Enterprise;
  • рядовым пользователям — через приложение Gemini, а модель 3.5 Flash-Lite постепенно появляется и в поиске Google.

Тем временем Gemini 3.5 Pro всё ещё обкатывают вместе с партнёрами, а внутри компании уже стартовал самый крупный на сегодняшний день этап предобучения — на этот раз для будущей модели Gemini 4.

guest
0 комментариев
Старые
Новые Популярные