Google Gemini 3.8 Flash: быстрее предшественника и дешевле конкурентов

Коротко о главном
2 сентября 2026 года Google выпустил Gemini 3.8 Flash — четвёртую Flash-модель за четыре месяца. На бенчмарке DeepSWE v1.1 она превосходит большинство крупных frontier-моделей в автономном решении задач по разработке ПО. Стартовая цена остаётся прежней: $0,75 за млн входных токенов и $3,75 за млн выходных. Для команд, уже использующих разработку с интеграцией ИИ на базе Gemini API, переход не требует изменений в коде и стоимостных лимитах до конца 2026 года.
Если кратко: Google сделал Flash-модель умнее, не подняв цену. Это прямой вызов Anthropic Claude Fable 5.1 (66 пунктов на Intelligence Index, примерно в 6 раз дороже на задачу) и xAI Grok 4.6 (59 пунктов). Разработчикам, встраивающим LLM в продукты под ключ, стоит оценить модель для агентных pipeline в первую очередь.
Что изменилось по сравнению с Gemini 3.7 Flash
Главное нововведение — поведенческий паттерн, который Google описывает как «большее усердие»: модель выполняет больше шагов рассуждения и итеративно вызывает инструменты на сложных задачах. Это не просто маркетинговая формулировка — она объясняет и рост показателей, и предупреждение: в режиме максимальных усилий модель может потреблять больше токенов, чем предшественник.
По данным Google и независимых тестов:
Terminal-Bench 2.1 — 90,8% (у Gemini 3.7 Flash было 81,6%, разница +9,2 п.п.).
DeepSWE v1.1 — лидирующая позиция среди Flash-класса моделей в автономном закрытии тикетов; опережает модели значительно большего размера.
HLE-Verified — 54,9% для многошаговых задач в STEM и профессиональной деятельности.
Artificial Analysis Intelligence Index (режим высокого рассуждения) — 59 пунктов, наравне с GPT-5.6 Sol и Grok 4.6. Для контекста: Claude Fable 5.1 набирает 66 пунктов, Claude Opus 5 — 63.
Vals Finance Agent V2 и Harvey Legal Agent Benchmark — Gemini 3.8 Flash обходит конкурентов в обоих финансово- и юридически-ориентированных бенчмарках.
Knowledge cutoff модели — март 2026 года для большинства тематических областей.
Ценообразование
Вводная цена зафиксирована до 31 декабря 2026 года: $0,75 за млн входных токенов и $3,75 за млн выходных — идентично Gemini 3.7 Flash. С 2027 года цена вырастет вдвое: $1,50/$7,50 за млн токенов.
По расчётам Artificial Analysis, стоимость одной задачи на Intelligence Index составляет примерно $0,58 — в шесть раз дешевле, чем у Anthropic Fable 5.1 при сопоставимом индексе качества. Это делает Gemini 3.8 Flash наиболее выгодным выбором в своём ценовом диапазоне на момент выхода.
Единственная оговорка при бюджетировании: в режиме «высокие усилия» модель может использовать существенно больше output-токенов, чем 3.7 Flash. При миграции стоит заложить запас в лимиты расходов — особенно в pipeline с длинными цепочками инструментов.
Доступность
Gemini 3.8 Flash уже доступен через:
Google AI Studio — для разработчиков без подписки, в рамках бесплатного тарифа и Pay-as-you-go.
Gemini API — через стандартную интеграцию SDK (Python, Node.js, Go, REST).
Android Studio — встроено в AI-ассистент для мобильной разработки.
Gemini Enterprise и Workspace — для корпоративных пользователей, включая Google Таблицы.
Gemini AI Pro / Ultra — для конечных пользователей через приложение Gemini.
Gemini 3.8 Flash Cyber — спецвариант для безопасности
Одновременно с основным релизом Google объявил о специализированной версии — Gemini 3.8 Flash Cyber. Она распространяется только через программу Fairwind Program и доступна ограниченному кругу: государственным структурам и операторам критической информационной инфраструктуры.
По заявлению Google, модель превышает 70%-й показатель правильного обнаружения реальных уязвимостей и занимает позицию на парето-фронтире CWE-Bench по соотношению скорости и точности патчинга. Публичного API нет — доступ только через Fairwind.
Что это значит для команд разработки
Gemini 3.8 Flash ориентирован на длинные агентные задачи: от «открыть тикет» до «закрыть PR», автономное тестирование, рефакторинг и pipeline с последовательными вызовами инструментов. Именно в этом сегменте модель показывает наибольший прирост относительно предшественника.
Три практических вывода для архитекторов и tech leads:
1. Если вы уже на Gemini 3.7 Flash — миграция на 3.8 Flash бесшовная: та же цена до конца 2026 года, та же точка подключения в API. Единственное, что стоит проверить, — лимиты output-токенов в pipeline с высокими усилиями.
2. Если вы оцениваете LLM для агентного продукта — Gemini 3.8 Flash становится первым кандидатом в нише «высокая производительность / низкая цена». Преимущество на DeepSWE v1.1 означает, что модель лучше справляется с реальным кодом, а не только синтетическими тестами.
3. Финансовые и юридические применения — лидерство на Vals Finance Agent V2 и Harvey Legal Agent Benchmark делает модель интересной для команд, строящих ИИ-ассистентов в FinTech и LegalTech. Важно проверить quality на собственных данных — бенчмарки задают вектор, но не гарантируют результат в домен-специфичных задачах.
Часто задаваемые вопросы
Чем Gemini 3.8 Flash отличается от 3.7 Flash? Главные улучшения — итеративный вызов инструментов на сложных задачах, Terminal-Bench 2.1 (90,8% против 81,6%), DeepSWE v1.1 и HLE-Verified. Цена не изменилась до конца 2026 года.
Когда вырастет цена? Вводная цена $0,75/$3,75 за млн токенов действует до 31 декабря 2026 года. С 1 января 2027 года — $1,50/$7,50.
Что такое Fairwind Program? Программа Google с ограниченным доступом для государственных организаций и операторов КИИ, в рамках которой распространяется Gemini 3.8 Flash Cyber — специализированный вариант для обнаружения уязвимостей. Публичного доступа нет.
Повлияет ли «большее усердие» модели на стоимость? Потенциально да — в режиме высоких усилий. Google предупреждает, что модель может использовать больше output-токенов. При активных pipeline стоит мониторить потребление и настраивать effort-уровень под задачу.
Источники
9to5Google — Gemini 3.8 Flash rolling out three weeks after last release, 2 сентября 2026 года.
The Register — With Gemini 3.8 Flash, Google reminds everyone it's still in the race, 2 сентября 2026 года.
Artificial Analysis — Gemini 3.8 Flash rolling out three weeks after last release, 2 сентября 2026 года.
Интегрируем ИИ-модели в ваш продукт
Gemini 3.8 Flash, Claude, GPT — подберём модель под задачу, выстроим агентный pipeline и запустим в прод. Без экспериментов вслепую.