Google DeepMind выпустила три обновления моделей Gemini: основная модель 3.6 Flash позволяет сэкономить до 65% токенов при задачах программирования, стоимость составляет 1,5 доллара за вход и 7,5 доллара за выход на миллион токенов — цена ниже, а производительность значительно улучшена в тестах, таких как DeepSWE; легковесная версия 3.5 Flash-Lite достигает скорости вывода 350 токенов в секунду, с ценой всего 0,3 доллара за вход и 2,5 доллара за выход, превзойдя в нескольких тестах более крупную модель Gemini 3 Flash; безопасная модель 3.5 Flash Cyber специализируется на устранении уязвимостей. Google также объявила о запуске «самой агрессивной» предварительной подготовки с целью достижения Gemini 4. Для пользователей основные преимущества — снижение стоимости, потребления токенов и затрат на работу агентов.Автор статьи, источник: Новости ИИ
Для нас, кто реально вкладывает деньги в покупку токенов и создание агентов, сегодняшний релиз действительно сводится к одному слову — снижение.
Три подряд — Google больше не притворяется.
Сегодня Google DeepMind выпустила сразу три мощных карты:
- Gemini 3.6 Flash
- Gemini 3.5 Flash-Lite
- Gemini 3.5 Flash Cyber

Более мощный основной игрок, более быстрый легкий вариант и специалист по безопасности, специализирующийся на устранении уязвимостей.
Три продукта Gemini направлены на одно и то же: сделать AI-агенты, работающие в продакшене, быстрее, умнее и дешевле.

В тот же день, когда был опубликован выпуск, Google также бросила еще одну большую бомбу —
Google DeepMind: «Самая амбициозная предварительная тренировка в истории началась», цель — следующее поколение модели Gemini 4.

С одной стороны, Gemini три раза подряд, с другой — запуск Gemini 4.
Сигнал от Google абсолютно ясен: эта финальная игра в AI только начинается.
Google ночью выпустил три модели Gemini
Три Gemini, далее разберем их по одному.
Gemini 3.6 Flash, экономия до 65% токенов
Сначала рассмотрим настоящего «главного героя» этого события — Gemini 3.6 Flash.
На этот раз его главная особенность — огромная экономия токенов.
Согласно расчетам по индексу искусственного анализа, он использует на 17% меньше токенов вывода по сравнению с предыдущей версией 3.5 Flash.
На таких бенчмарках кодирования, как DeepSWE, можно сэкономить до 65%.

Он не только меньше пропускает слов, но и требует меньше шагов рассуждения и вызовов инструментов для выполнения многошаговых задач, сокращая путь, что делает его быстрее и экономичнее.
Более того, Gemini 3.6 Flash теперь дешевле и потребляет меньше токенов:
Ввод 1,5 доллара, вывод 7,5 доллара за миллион токенов, дешевле, чем 3,5 Flash.
Больше экономии,更低的价格,更强的性能 —这才是诚意。3.6 Flash在几项关键测试中都超越了前代——
- DeepSWE: программирование 37% ➔ 49%
- MLE Bench: тестирование машинного обучения 49,7% ➔ 63,9%
- OSWorld-Verified: Модель напрямую управляет компьютером, тестирование увеличилось с 78,4% до 83%
- GDPVal-AA v2: знаниево-ориентированные задачи завершены в количестве 1421, что на 70 больше, чем у предыдущей версии

В приведенном демо 3.6 Flash продемонстрировал превосходные навыки оркестрации нескольких агентов: не только легко справился со сложной задачей миграции кода, но и превзошел 3.5 Flash по скорости ответа и качеству кода.

С помощью Gemini Canvas 3.6 Flash мгновенно создал профессиональный инструмент для извлечения фотографических текстур.
Он также может выступать в роли «AI-дизайнера интерактивного опыта» и легко создать тематическую студию с высоким уровнем погружения.


3.5 Flash-Lite, победил старшего брата
Вторая модель — Gemini 3.5 Flash-Lite — идет другим путем: она ориентирована на скорость и низкую стоимость.
3.5 Flash-Lite обеспечивает скорость вывода до 350 токенов в секунду — это самая высокая скорость во всем семействе 3.5.
Цены также настолько низки, что вызывают удивление: ввод 1 миллиона токенов стоит $0,3, а вывод — $2,5.
Быстро и недорого — идеально подходит для сценариев с высокой частотой и большим объемом, таких как «обработка большого количества документов» и «поиск агентов».
Самое удивительное, что он буквально поставил своего собственного «старшего брата» на колени.
На нескольких задачах программирования и тестах агентов этот легкий маленький модель показал лучшие результаты, чем более крупный Gemini 3 Flash—
- SWE-Bench Pro: 54,2% против 49,6%
- OSWorld-Verified: 74,0% против 65,1%

3.6 Flash выступает в роли «главного мозга» для распределения задач, а Flash-Lite — в роли «дубликатов» для массового выполнения.
Один отвечает за мышление, множество — за выполнение, легко сглаживая нагрузку при высокой одновременности.
В официальной демонстрации Flash-Lite сразу выдает 25 высокодоступных веб-дизайнов — скорость настолько высока, что кажется, будто дизайн появляется сразу же после мысли.
Flash-Lite уже доступен в приложении Gemini и постепенно будет добавлен в Google Search.
Flash Cyber: может устранять уязвимости, но не каждый может этим воспользоваться
Gemini 3.5 Flash Cyber — жесткая модель, специализирующаяся на кибербезопасности.
Его задача только одна: находить уязвимости и устранять их.
Сейчас существует неловкая реальность: ИИ находит уязвимости быстрее, чем существующие системы их исправляют.

Google встроила эту модель в код-безопасностный агент CodeMender, где несколько Cyber-агентов работают совместно, установив новый рекорд на безопасностном бенчмарке CyberGym при более низкой стоимости по сравнению с более крупными моделями—
Используйте более легкую модель для выполнения задач, требующих наибольшей точности.
Однако эту модель обычные пользователи пока не могут получить.
Gemini 4 запущен — самая агрессивная предварительная подготовка в истории
Хотя Gemini 3.5 Pro еще не получен, обучение Gemini 4 уже началось.
Эта тройная атака — лишь закуска, но настоящим главным событием является официальное объявление в финале.
Google подтвердила, что внутри компании запущена самая агрессивная на сегодняшний день предварительная подготовка, направленная на Gemini 4.

Эксперт отметил, что в соответствии с обычным шестимесячным циклом обучения Google, к концу года можно будет увидеть Gemini 4.

Для нас, кто реально вкладывает деньги в покупку токенов и создание агентов, сегодняшний релиз действительно сводится к одному слову — снижение.
Цена снизилась, потребление токенов снизилось, стоимость запуска одного агента снизилась.
Что касается долгожданного флагмана и только что запущенного Gemini 4, оба всё ещё «в будущем».
То, что можно использовать и что недорогое, — это то, что вы можете положить в свой кошелек уже сегодня. Даже самый флагманский продукт должен сначала приземлиться.
