- Gemini 3.8 Flash стала новой моделью Google для рассуждений, программирования и агентных рабочих процессов.
- Отдельная версия Flash Cyber ориентирована на поиск уязвимостей и автоматическое исправление кода и доступна проверенным специалистам по защите.
Компания Google представила две новые модели искусственного интеллекта — Gemini 3.8 Flash и Gemini 3.8 Flash Cyber. Они построены на едином фундаментальном ядре, но предназначены для разных сценариев использования.
Gemini 3.8 Flash позиционируется как модель для рассуждений, программирования и выполнения агентных задач. Она доступна по той же начальной цене, что и Gemini 3.7 Flash — $0,75 за миллион входных токенов и $3,75 за миллион выходных токенов.
Gemini 3.8 Flash Cyber ориентирована на кибербезопасность. Она доступна ограниченному кругу проверенных специалистов по защите через программу Fairwind.
Gemini 3.8 Flash сделала ставку на автономность
По данным Google, Gemini 3.8 Flash демонстрирует существенный прогресс по сравнению с предыдущей версией в разработке программного обеспечения, агентных задачах и многошаговом анализе.
В бенчмарке DeepSWE v1.1 модель превзошла большинство более крупных фронтирных моделей по способности автономно выполнять сложные инженерные задачи от начала до конца. Также Gemini 3.8 Flash показала лучшие результаты, чем Gemini 3.7 Flash и другие ведущие модели, в профессиональных и количественных задачах.
Google объясняет рост производительности архитектурным подходом, при котором модель выполняет больше шагов рассуждения и чаще итеративно использует инструменты. На более высоких уровнях вычислительных усилий она может использовать больше токенов для повышения качества результата.
Разработчики, для которых важнее эффективность вычислений, могут использовать более низкие уровни усилий или продолжить работу с Gemini 3.7 Flash, которая остается поддерживаемой.
Gemini 3.8 Flash Cyber ориентирована на защитников
Gemini 3.8 Flash Cyber доступна через программу Fairwind ограниченному кругу проверенных специалистов по кибербезопасности.
В бенчмарке CyberGym модель продемонстрировала передовой уровень автономного поиска уязвимостей и превзошла Gemini 3.5 Flash Cyber и значительно более крупные фронтирные модели.
Google также протестировала модель на внутреннем бенчмарке, который охватывает сложные кодовые базы на 20 языках программирования. Уровень успешного выявления уязвимостей превысил 70%.
Отдельное внимание при разработке уделили автоматическому исправлению уязвимостей. Google отметила, что приоритетом для Gemini 3.8 Flash Cyber были именно защитные возможности, а не создание эксплойтов.
Модель уже используют для защиты Google
Google заявила, что Gemini 3.8 Flash Cyber уже применяется для защиты ее внутренней кодовой базы.
Команда безопасности Chrome получила с помощью модели в 2,6 раза больше правильных патчей для уязвимостей, чем с помощью лучших значительно более крупных коммерческих моделей.
Компания Wiz во время внутреннего тестирования зафиксировала на 7,5-9,7% более высокую полноту выявления уязвимостей по сравнению с другими ведущими моделями. При этом стоимость использования Gemini 3.8 Flash Cyber была в 2,3-5,2 раза ниже.
Кроме того, команда Google Cloud, которая занимается исследованием уязвимостей, использовала модель для выявления критической фундаментальной уязвимости менее чем за два часа. По словам компании, поиск и исследование таких проблем обычно занимают месяцы.
Сообщение Google представила Gemini 3.8 Flash и Flash Cyber для агентных рабочих процессов и кибербезопасности появились сначала на INCRYPTED.