Cyber News

Gemini 3.6 Flash и 3.5 Flash‑Lite: Google удешевила рабочий класс моделей и подтянула код

M
Markabus
·22 июля 2026 г.
Фотореалистичная обложка: светящееся ядро ИИ‑модели на тёмной графитовой поверхности, вокруг — разноцветные экраны с кодом и терминалом и потоки данных, сходящиеся к центру; мягкий тёплый контровой свет, кинематографичный кадр 16:9.

Google выпустила сразу три новые модели линейки Gemini Flash — Gemini 3.6 Flash, Gemini 3.5 Flash‑Lite и узкоспециализированную Gemini 3.5 Flash Cyber. Анонс состоялся 21 июля 2026 года, и его главная идея проста: самый ходовой, «рабочий» класс моделей Google стал дешевле, быстрее и заметно сильнее в коде — именно там, где разработчики и бизнес тратят больше всего токенов. Заодно компания приоткрыла карты на будущее, подтвердив, что предобучение (pre‑training — базовое обучение модели на больших данных) флагманской Gemini 4 уже идёт.

Что именно выпустили

Flash‑линейка в семействе Gemini — это не «тяжёлые» топовые модели уровня Pro, а массовый рабочий инструмент: быстрый, недорогой и рассчитанный на большой поток запросов. Именно на Flash обычно приходится основная нагрузка в продакшене — чат‑боты, обработка документов и агентные сценарии (agentic — задачи, где модель сама вызывает инструменты и выполняет многошаговые действия). Обновление затрагивает сразу три сегмента этого класса, и у каждой из трёх моделей — своя роль.

Gemini 3.6 Flash — новая «рабочая лошадка»

Google называет 3.6 Flash моделью по умолчанию (workhorse — «рабочая лошадка») для программирования, интеллектуальной работы и мультимодальных задач. По сравнению с предыдущей 3.5 Flash она, по данным компании, ощутимо прибавила в коде: на бенчмарке DeepSWE — 49% против 37%, на MLE‑Bench (задачи по машинному обучению) — 63,9% против 49,7%, на OSWorld‑Verified, где проверяют реальные агентные действия в операционной системе, — 83,0% против 78,4%. Стоимость — 1,5 доллара за миллион входных токенов и 7,5 доллара за миллион выходных. Модель доступна сразу на множестве площадок: Gemini API, Google AI Studio, Android Studio, среда Antigravity, корпоративная Gemini Enterprise и приложение Gemini.

Gemini 3.5 Flash‑Lite — ставка на скорость и цену

Flash‑Lite — самая быстрая и дешёвая модель в поколении 3.5. Google заявляет скорость около 350 выходных токенов в секунду и цену 0,3 доллара за миллион входных и 2,5 доллара за миллион выходных токенов. Это модель для сценариев, где важна не максимальная «глубина» рассуждений, а пропускная способность и низкая задержка: агентный поиск, массовая обработка документов, классификация. При этом на профильных тестах прирост тоже значительный — Terminal‑Bench 2.1 (работа в терминале) 54% против 31% у прежней Flash‑Lite, а SWE‑Bench Pro (исправление реальных багов в репозиториях) — 54,2% против 49,6%. Flash‑Lite вдобавок постепенно включают в поиск Google.

Gemini 3.5 Flash Cyber — отдельная история

Третья модель стоит особняком и напрямую большинству читателей недоступна. Flash Cyber дообучена (fine‑tuned — донастроена под узкую задачу) на поиск и устранение уязвимостей в коде. Публично её не раздают: доступ дают только государственным структурам и доверенным партнёрам, и только внутри агентной системы CodeMender в рамках закрытого пилота. Для рядового разработчика это скорее сигнал о том, куда движется индустрия автоматизации безопасности, чем инструмент, который можно взять и подключить уже сегодня.

Главное — цена и токен‑эффективность

Самое практичное в этом релизе — не отдельные баллы в бенчмарках, а экономика. Google утверждает, что 3.6 Flash тратит на 17% меньше выходных токенов, чем 3.5 Flash, при решении тех же задач. Поскольку в API платят именно за токены, а выходные почти всегда дороже входных, эти 17% напрямую конвертируются в счёт за месяц. Для команды, которая прогоняет через модель миллионы запросов, разница между «старой» и «новой» Flash может измеряться десятками процентов реальных расходов — и это при том, что качество не падает, а растёт.

Токен‑эффективность (token efficiency — сколько токенов модель тратит на тот же результат) в последние месяцы стала не менее важным параметром, чем «сырые» баллы в тестах. Модель, которая отвечает короче и без лишних «размышлений вслух», экономит и деньги, и время: меньше токенов — меньше задержка. Именно на этом Google делает акцент, продавая 3.6 Flash не как «самую умную», а как самую выгодную по соотношению цена/качество в своём классе.

Что это значит для разработчиков и бизнеса

Тренд последнего года очевиден: «лёгкие» и дешёвые модели догоняют по практической пользе то, что год назад умели только флагманы. Flash‑класс, изначально задуманный как компромисс ради скорости, теперь всерьёз конкурирует в коде и агентных задачах. Для владельца сайта или небольшой команды это значит, что многие сценарии — автоответы поддержки, генерация и ревью кода, извлечение данных из документов — можно закрывать недорогой моделью, не переплачивая за Pro.

Отдельно стоит отметить, что 3.6 Flash и Flash‑Lite поддерживают настраиваемые «уровни размышления» (thinking levels — сколько усилий модель тратит на обдумывание перед ответом) и режим использования компьютера (computer use — управление браузером и интерфейсами как клиентский инструмент через API). Это делает Flash пригодным для полноценных агентов, а не только для простых запросов «вопрос — ответ». А доступность прямо в Android Studio и через сторонние среды разработки означает, что модель приходит к разработчику туда, где он уже работает, без отдельной интеграции.

Контекст конкуренции тоже важен. Обновление Flash выходит на фоне гонки, в которой OpenAI недавно представила линейку GPT‑5.6, а сама Google ранее выкатила Gemini 3.1 Pro. Битва смещается с «у кого модель умнее» к «у кого дешевле и удобнее разворачивать в продакшене» — и удешевление рабочего класса моделей здесь куда важнее для массового пользователя, чем очередной рекорд флагмана.

И намёк на Gemini 4

Вместе с релизом Flash Google приоткрыла дорожную карту. Компания сообщила, что Gemini 3.5 Pro сейчас проходит партнёрское тестирование, а предобучение Gemini 4 уже стартовало — по формулировке Google, это «самый амбициозный запуск предобучения» в её истории. Конкретных дат нет, и превращать анонс намерений в ожидание скорого релиза не стоит: между началом предобучения и публичным выходом модели обычно проходят месяцы. Но сигнал ясен — Flash‑обновление закрывает текущие потребности рынка, пока в лабораториях готовят следующее большое поколение.

Коротко о сути

Google не пыталась удивить новым флагманом — она сделала более прагматичный ход, усилив тот класс моделей, которым реально пользуется большинство. Gemini 3.6 Flash даёт лучший код и мультимодальность при меньшем расходе токенов, Flash‑Lite опускает планку цены и задержки ещё ниже, а Flash Cyber показывает, куда движется автоматизация безопасности. Для разработчиков и бизнеса вывод простой: пересчитать бюджеты и проверить, не пора ли перевести часть нагрузки на обновлённый, подешевевший Flash.

Частые вопросы

Q.Чем Gemini 3.6 Flash отличается от 3.5 Flash?

3.6 Flash — новая модель по умолчанию для кода и мультимодальных задач. По данным Google, она тратит на 17% меньше выходных токенов при том же результате и заметно сильнее в программировании: DeepSWE 49% против 37%, MLE‑Bench 63,9% против 49,7%, OSWorld‑Verified 83,0% против 78,4%.

Q.Сколько стоят новые модели?

Gemini 3.6 Flash — 1,5 доллара за миллион входных токенов и 7,5 доллара за миллион выходных. Gemini 3.5 Flash‑Lite дешевле: 0,3 и 2,5 доллара соответственно, при скорости около 350 выходных токенов в секунду.

Q.Что такое Gemini 3.5 Flash Cyber и можно ли её использовать?

Это узкоспециализированная модель, дообученная на поиск и устранение уязвимостей в коде. Публичного доступа нет: она доступна только государственным структурам и доверенным партнёрам внутри агентной системы CodeMender в рамках закрытого пилота.

Q.Когда выйдет Gemini 4?

Точной даты Google не назвала. Компания лишь подтвердила, что предобучение Gemini 4 уже началось, а Gemini 3.5 Pro сейчас проходит партнёрское тестирование.

Источники

Предыдущая
Etched метит в $20 млрд: стартап, «запёкший» трансформер в кремний, бросает вызов Nvidia

Читайте также

Крупный макроснимок кастомного ИИ-чипа для инференса на тёмной графитовой плате: по кремнию бегут ярко-синие светящиеся «жилы» данных, вокруг — медные дорожки и цветные индикаторы.Cyber News
21 июля 2026 г.

Etched метит в $20 млрд: стартап, «запёкший» трансформер в кремний, бросает вызов Nvidia

Чип-стартап Etched готовится вчетверо поднять оценку — до ~$20 млрд. Его Sohu «запекает» трансформер прямо в кремний и метит в рынок инференса, где доминирует Nvidia. Разбираем, что это за чип, какие цифры он обещает и где подвох.

Читать →
Голографический щит безопасности поднимается над экранами с кодом и терминалами на столе разработчика; вокруг парят полупрозрачные панели с календарём релизов и метками версий.Cyber News
20 июля 2026 г.

Next.js переходит на ежемесячные релизы безопасности: первый выйдет 20 июля

Vercel формализует выпуск патчей безопасности для Next.js: примерно раз в месяц — с заблаговременным анонсом. Первый плановый релиз выйдет 20 июля и закроет девять уязвимостей в ветках 16.2 и 15.5.

Читать →
Фотореалистичная тёмная серверная: в центре парит синий голографический сетевой глобус, вокруг реальные стойки с разноцветными LED и мониторы с цветными дашбордами — новость о глобальной ИИ-организации WAICOCyber News
19 июля 2026 г.

Китай запустил WAICO: новая всемирная организация по ИИ и ставка на открытые модели

На Всемирной конференции по ИИ в Шанхае Китай объявил о создании межправительственной организации WAICO с участием 29 стран и сделал ставку на открытые модели. Разбираем, что это значит для разработчиков, доступа к чипам и стандартов ИИ.

Читать →