Яндекс.Метрика
Услуги Портфолио Контакты БлогНовости +7 (800) 511‑32‑27 Обсудить проект
ИИ и LLM

Google Gemini 3.8 Flash: быстрее предшественника и дешевле конкурентов

3 сентября 2026·6 мин чтения
Gemini 3.8 FlashGoogle AI Studio
Gemini 3.8 Flash вышел: что нового для разработчиков

Коротко о главном

2 сентября 2026 года Google выпустил Gemini 3.8 Flash — четвёртую Flash-модель за четыре месяца. На бенчмарке DeepSWE v1.1 она превосходит большинство крупных frontier-моделей в автономном решении задач по разработке ПО. Стартовая цена остаётся прежней: $0,75 за млн входных токенов и $3,75 за млн выходных. Для команд, уже использующих разработку с интеграцией ИИ на базе Gemini API, переход не требует изменений в коде и стоимостных лимитах до конца 2026 года.

Если кратко: Google сделал Flash-модель умнее, не подняв цену. Это прямой вызов Anthropic Claude Fable 5.1 (66 пунктов на Intelligence Index, примерно в 6 раз дороже на задачу) и xAI Grok 4.6 (59 пунктов). Разработчикам, встраивающим LLM в продукты под ключ, стоит оценить модель для агентных pipeline в первую очередь.

Что изменилось по сравнению с Gemini 3.7 Flash

Главное нововведение — поведенческий паттерн, который Google описывает как «большее усердие»: модель выполняет больше шагов рассуждения и итеративно вызывает инструменты на сложных задачах. Это не просто маркетинговая формулировка — она объясняет и рост показателей, и предупреждение: в режиме максимальных усилий модель может потреблять больше токенов, чем предшественник.

По данным Google и независимых тестов:

Terminal-Bench 2.1 — 90,8% (у Gemini 3.7 Flash было 81,6%, разница +9,2 п.п.).

DeepSWE v1.1 — лидирующая позиция среди Flash-класса моделей в автономном закрытии тикетов; опережает модели значительно большего размера.

HLE-Verified — 54,9% для многошаговых задач в STEM и профессиональной деятельности.

Artificial Analysis Intelligence Index (режим высокого рассуждения) — 59 пунктов, наравне с GPT-5.6 Sol и Grok 4.6. Для контекста: Claude Fable 5.1 набирает 66 пунктов, Claude Opus 5 — 63.

Vals Finance Agent V2 и Harvey Legal Agent Benchmark — Gemini 3.8 Flash обходит конкурентов в обоих финансово- и юридически-ориентированных бенчмарках.

Knowledge cutoff модели — март 2026 года для большинства тематических областей.

Ценообразование

Вводная цена зафиксирована до 31 декабря 2026 года: $0,75 за млн входных токенов и $3,75 за млн выходных — идентично Gemini 3.7 Flash. С 2027 года цена вырастет вдвое: $1,50/$7,50 за млн токенов.

По расчётам Artificial Analysis, стоимость одной задачи на Intelligence Index составляет примерно $0,58 — в шесть раз дешевле, чем у Anthropic Fable 5.1 при сопоставимом индексе качества. Это делает Gemini 3.8 Flash наиболее выгодным выбором в своём ценовом диапазоне на момент выхода.

Единственная оговорка при бюджетировании: в режиме «высокие усилия» модель может использовать существенно больше output-токенов, чем 3.7 Flash. При миграции стоит заложить запас в лимиты расходов — особенно в pipeline с длинными цепочками инструментов.

Доступность

Gemini 3.8 Flash уже доступен через:

Google AI Studio — для разработчиков без подписки, в рамках бесплатного тарифа и Pay-as-you-go.

Gemini API — через стандартную интеграцию SDK (Python, Node.js, Go, REST).

Android Studio — встроено в AI-ассистент для мобильной разработки.

Gemini Enterprise и Workspace — для корпоративных пользователей, включая Google Таблицы.

Gemini AI Pro / Ultra — для конечных пользователей через приложение Gemini.

Gemini 3.8 Flash Cyber — спецвариант для безопасности

Одновременно с основным релизом Google объявил о специализированной версии — Gemini 3.8 Flash Cyber. Она распространяется только через программу Fairwind Program и доступна ограниченному кругу: государственным структурам и операторам критической информационной инфраструктуры.

По заявлению Google, модель превышает 70%-й показатель правильного обнаружения реальных уязвимостей и занимает позицию на парето-фронтире CWE-Bench по соотношению скорости и точности патчинга. Публичного API нет — доступ только через Fairwind.

Что это значит для команд разработки

Gemini 3.8 Flash ориентирован на длинные агентные задачи: от «открыть тикет» до «закрыть PR», автономное тестирование, рефакторинг и pipeline с последовательными вызовами инструментов. Именно в этом сегменте модель показывает наибольший прирост относительно предшественника.

Три практических вывода для архитекторов и tech leads:

1. Если вы уже на Gemini 3.7 Flash — миграция на 3.8 Flash бесшовная: та же цена до конца 2026 года, та же точка подключения в API. Единственное, что стоит проверить, — лимиты output-токенов в pipeline с высокими усилиями.

2. Если вы оцениваете LLM для агентного продукта — Gemini 3.8 Flash становится первым кандидатом в нише «высокая производительность / низкая цена». Преимущество на DeepSWE v1.1 означает, что модель лучше справляется с реальным кодом, а не только синтетическими тестами.

3. Финансовые и юридические применения — лидерство на Vals Finance Agent V2 и Harvey Legal Agent Benchmark делает модель интересной для команд, строящих ИИ-ассистентов в FinTech и LegalTech. Важно проверить quality на собственных данных — бенчмарки задают вектор, но не гарантируют результат в домен-специфичных задачах.

Часто задаваемые вопросы

Чем Gemini 3.8 Flash отличается от 3.7 Flash? Главные улучшения — итеративный вызов инструментов на сложных задачах, Terminal-Bench 2.1 (90,8% против 81,6%), DeepSWE v1.1 и HLE-Verified. Цена не изменилась до конца 2026 года.

Когда вырастет цена? Вводная цена $0,75/$3,75 за млн токенов действует до 31 декабря 2026 года. С 1 января 2027 года — $1,50/$7,50.

Что такое Fairwind Program? Программа Google с ограниченным доступом для государственных организаций и операторов КИИ, в рамках которой распространяется Gemini 3.8 Flash Cyber — специализированный вариант для обнаружения уязвимостей. Публичного доступа нет.

Повлияет ли «большее усердие» модели на стоимость? Потенциально да — в режиме высоких усилий. Google предупреждает, что модель может использовать больше output-токенов. При активных pipeline стоит мониторить потребление и настраивать effort-уровень под задачу.

Источники

9to5Google — Gemini 3.8 Flash rolling out three weeks after last release, 2 сентября 2026 года.

The Register — With Gemini 3.8 Flash, Google reminds everyone it's still in the race, 2 сентября 2026 года.

Artificial Analysis — Gemini 3.8 Flash rolling out three weeks after last release, 2 сентября 2026 года.

Материал подготовлен редакцией YuSMP Group по открытым источникам. Нужна экспертиза по теме или разработка под задачу — обсудим проект.

Интегрируем ИИ-модели в ваш продукт

Gemini 3.8 Flash, Claude, GPT — подберём модель под задачу, выстроим агентный pipeline и запустим в прод. Без экспериментов вслепую.

AI/ML-разработка →