Gemini 3.8 Flash и Flash Cyber: одна модель, два уровня доступа

Google DeepMind анонсировала Gemini 3.8 Flash и Gemini 3.8 Flash Cyber — два новых релиза, вышедших через три недели после Gemini 3.7 Flash. Это третье обновление линейки Flash за шесть недель. Обе версии работают на одной базовой модели, доработанной через длительные агентные циклы, но различаются не архитектурой, а политикой безопасности и кругом допущенных пользователей.

Где доступна Gemini 3.8 Flash

Gemini 3.8 Flash доступна с сегодняшнего дня через Gemini API, Google AI Studio, Antigravity, Android Studio и Gemini Enterprise — можно направлять на неё продакшн-трафик. Веса закрыты, поэтому самостоятельного или локального развёртывания нет.

Gemini 3.8 Flash Cyber публично не развёртывается вообще: доступ предоставляется индивидуально через новую программу Fairwind.

Что изменилось в 3.8 Flash

Исследовательская команда поясняет, что 3.8 Flash основана на 3.7 Flash, и характеристики не изменились: контекстное окно на 1 048 576 токенов, максимальный вывод 65 536 токенов, поддержка ввода текста, изображений, аудио и видео и текстового вывода. Уровни рассуждения остались прежними — LOW, MEDIUM и HIGH, по умолчанию используется MEDIUM.

Важная деталь для мигрирующих: уровень MINIMAL на 3.8 Flash не поддерживается, и его установка возвращает ошибку валидации API.

Ключевое изменение — поведенческое. В Google прямо говорят: 3.8 Flash работает усерднее. На сложных задачах она выполняет дополнительные шаги рассуждения и итеративно вызывает инструменты, что может увеличить расход токенов на высоких уровнях усилий. В руководстве для разработчиков честно указано, что это даёт лучшую точность ценой большего потребления токенов, и рекомендуется оставаться на 3.7 Flash, когда решающим фактором является эффективность вычислений. Это необычно прямое признание того, что новая модель не является правильным выбором по умолчанию для каждой задачи.

Где проявляются улучшения

На бенчмарке длинных задач разработки ПО DeepSWE v1.1 Google сообщает, что 3.8 Flash превосходит большинство более крупных frontier-моделей при значительно меньшей стоимости. Она набирает 54,9% на HLE-Verified и опережает 3.7 Flash и другие frontier-модели на Vals Finance Agent V2 и Harvey's Legal Agent Benchmark. Финансовые и юридические результаты указаны как относительные победы, без абсолютных значений в анонсе.

Почему Flash Cyber ограничена

На стандартном бенчмарке поиска уязвимостей CyberGym Google сообщает о производительности уровня frontier, превосходящей как 3.5 Flash Cyber, так и значительно более крупные frontier-модели, хотя абсолютная цифра не публикуется. Поскольку CyberGym в основном использует C и C++, Google также провела внутренний тест на 20 языках программирования и сообщает о частоте успешного обнаружения выше 70%.

На бенчмарке исправления уязвимостей CWE-Bench, проводимом Collinear, Flash Cyber показывает 47,2% pass@1 против 47,8% у ведущей frontier-модели. Заявление — почти паритет при значительно меньшей стоимости; Google позиционирует модель как находящуюся на границе Парето, а не возглавляющую таблицу лидеров.

Chrome Security сообщает о в 2,6 раза более корректных патчах, чем у лучших, значительно более крупных коммерческих моделей. Wiz фиксирует на 7,5–9,7 процентных пункта более высокую полноту (recall) на своём внутреннем бенчмарке пентеста при стоимости ниже в 2,3–5,2 раза. Команда Cloud Vulnerability Research из Google нашла критическую фундаментальную уязвимость менее чем за два часа — работа, которая обычно занимает месяцы.

Google подчёркивает, что приоритетом было исправление уязвимостей, а не наступательные возможности вроде эксплуатации. Flash Cyber поставляется с более разрешительным набором кибер-смягчений, и именно поэтому она ограничена проверенными защитниками: государственными органами, операторами критической инфраструктуры и мейнтейнерами ПО, подающими заявку через Fairwind.

Цены и выводы

Цены на 3.8 Flash сохранены на уровне 3.7 Flash: $0,75 за миллион входных и $3,75 за миллион выходных токенов до 31 декабря 2026 года. Модель обменивает токены на точность: больше шагов рассуждения, больше вызовов инструментов, выше расходы на задачу. Доступ к Flash Cyber предоставляется проверенным защитникам, а не продаётся по прайс-листу.

Для администраторов, которые уже используют Gemini 3.7 Flash в продакшене, миграция на 3.8 Flash оправдана не всегда: прирост точности на сложных задачах компенсируется ростом расхода токенов. Инструменты вроде Gemini 3.5 Transcribe продолжают работать в своей нише, а новая модель — это шаг в сторону более глубоких агентных сценариев.

Частые вопросы

Чем Gemini 3.8 Flash отличается от 3.7 Flash?

Архитектура и характеристики не изменились, но модель стала выполнять больше шагов рассуждения и чаще вызывать инструменты на сложных задачах, что повышает точность ценой большего расхода токенов.

Можно ли развернуть Gemini 3.8 Flash локально?

Нет, веса закрыты. Модель доступна только через Gemini API, Google AI Studio, Antigravity, Android Studio и Gemini Enterprise.

Кто может получить доступ к Gemini 3.8 Flash Cyber?

Доступ предоставляется через программу Fairwind государственным органам, операторам критической инфраструктуры и мейнтейнерам ПО. Публичного доступа нет.

Поддерживает ли 3.8 Flash уровень рассуждений MINIMAL?

Нет. Уровень MINIMAL не поддерживается, и его установка возвращает ошибку валидации API. Доступны LOW, MEDIUM и HIGH.

Сколько стоит Gemini 3.8 Flash?

Цены сохранены на уровне 3.7 Flash: $0,75 за миллион входных и $3,75 за миллион выходных токенов до 31 декабря 2026 года.

Какие результаты показывает Flash Cyber на бенчмарках?

47,2% pass@1 на CWE-Bench против 47,8% у ведущей frontier-модели, выше 70% успешного обнаружения уязвимостей на внутреннем тесте из 20 языков и в 2,6 раза больше корректных патчей по данным Chrome Security.

Стоит ли мигрировать с 3.7 Flash на 3.8 Flash?

Только если приоритет — точность на сложных задачах, а не экономия токенов. Google сама рекомендует оставаться на 3.7 Flash, когда эффективность вычислений критична.

Источник: marktechpost.com