Назад к моделям

Gemini 3.8 Flash

googlegoogle/gemini-3.8-flash

Google's Flash-tier model, released 2026-09-02. 1M-token context, thinking enabled.

Gemini 3.8 Flash — третья Flash-модель Google за шесть недель, выпущена 2 сентября 2026 года вместе с Gemini 3.8 Flash Cyber. Она построена непосредственно на Gemini 3.7 Flash и позиционируется как самая мощная рабочая Flash-модель на сегодняшний день: model card Google характеризует её как обеспечивающую «прогресс в области программной инженерии и agentic-рабочих процессов». Контекстное окно 1M токенов и лимит вывода 64K не изменились по сравнению с предыдущим поколением Flash; thinking включён, управление уровнями усилий сохраняется.

Ключевое улучшение — усердие: Google заявляет, что модель «работает усерднее» при сложных задачах, выполняя дополнительные шаги рассуждения и итеративно вызывая инструменты. Это особенно заметно на бенчмарках долгосрочного программирования, где 3.8 Flash превосходит большинство крупных фронтирных моделей при Flash-стоимости. Google предупреждает, что дополнительные усилия могут означать больше выходных токенов на высоких уровнях effort — model card рекомендует использовать Gemini 3.7 Flash для задач с приоритетом эффективности. В TheRouter модель отдаётся через OpenAI-совместимый chat completions API.

Когда выбирать
  • Долгосрочная программная инженерия — Google сообщает 73.7% на DeepSWE v1.1, опережая GPT-5.6 Sol (72.7%), GPT-5.6 Terra (69.6%) и Claude Sonnet 5 (53.8%), уступая Claude Opus 5 (74.0%) лишь 0.3 пп при значительно меньших затратах
  • Agentic-работа в терминале — 89.4% на Terminal-bench 2.1, соответствует Claude Opus 5 (89.1%) и опережает GPT-5.6 Sol (88.8%)
  • Agentic-рабочие процессы в финансах и юриспруденции — Vals Finance Agent v2 61.4% и Harvey Legal Agent Benchmark 10.0% all-pass-rate, оба — лучший результат в сравнительной таблице Google
  • Понимание длинного видео — 87.8% на LVBench (agentic), лучший в сравнительной таблице Google
Когда не выбирать
  • Высоконагруженные пайплайны с приоритетом эффективности, где ограничение — количество выходных токенов — Google прямо рекомендует Gemini 3.7 Flash для задач с приоритетом эффективности; 3.8 Flash расходует больше токенов на высоких effort-уровнях
  • Общие agentic-задачи (не программирование) — 19.1% на Terminal-bench 4.0 значительно ниже Claude Opus 5 (51.8%) и GPT-5.6 Sol (37.3%); преимущество модели сосредоточено в программировании и узкоспециализированных agentic-бенчмарках
  • Computer use — 59.0% на OSWorld-2.0 против 75.4% у Claude Opus 5; для автоматизации GUI Claude Opus 5 явно лидирует в сравнении Google

Чем обслуживание в TheRouter отличается от вендорского

Как её эксплуатирует вендор

Google обслуживает Gemini 3.8 Flash через Gemini API (ai.google.dev) и Vertex AI. Модель принимает текст, изображения, аудио и видео; возвращает текст. Нативные возможности: thinking, function calling, structured outputs, code execution, context caching, Batch API, grounding через Google Search и Google Maps, поиск по файлам. Генерация аудио, изображений и Live API не поддерживаются. Thinking-токены тарифицируются как выходные по той же ставке.

На TheRouter

TheRouter отдаёт Gemini 3.8 Flash как OpenAI-совместимый /v1/chat/completions под google/gemini-3.8-flash. Доступные входные модальности: текст, изображение, PDF; аудио и видео не проксируются. Function calling и structured outputs работают без изменений через схему tools OpenAI. Thinking-токены отражаются в usage.completion_tokens. Генерация аудио, изображений и Live API недоступны через TheRouter.

Размер контекста
1.0M
Максимальный вывод
66K
Цена Входза 1M токенов
$1.62за 1 млн токенов
Цена Выходза 1M токенов
$8.10за 1 млн токенов

Модальности

ТекстИзображениеPDFТекст

Возможности

Зрение

Разбивка цен

ТипСтавка
Вход$1.62 за 1 млн токенов
Выход$8.10 за 1 млн токенов

Поддерживаемые параметры

temperaturemax_tokenstop_ptoolstool_choiceresponse_formatstop

Характеристики

Дата релиза2026-09-02deepmind.googleпроверено
Дата отсечения знанийМарт 2026 (в отдельных областях может быть ограничен январём 2025)deepmind.googleпроверено
Лимит входных токенов1 048 576deepmind.googleпроверено
Лимит выходных токенов65 536deepmind.googleпроверено
Нативные модальности (upstream)Ввод: текст, изображение, аудио, видео. Вывод: только текст. TheRouter предоставляет ввод текст/изображение/PDF и текстовый вывод.deepmind.googleпроверено
Прайс вендора (Standard)$1.50 / 1M ввод, $7.50 / 1M вывод, $0.15 / 1M кешированный ввод (глобальный эндпоинт Vertex AI). Вводная акция 50%-кэшбэка до 2026-12-31 не меняет тарифицируемую прайс-ставку.cloud.google.comпроверено
Управление effort-уровнемПоддерживается. Более низкие уровни effort снижают расход токенов; Google рекомендует 3.7 Flash для задач с приоритетом эффективности.blog.googleпроверено

Бенчмарки

BenchmarkDistributionScoreSource
DeepSWE v1.1
Долгосрочная программная инженерия. Gemini 3.7 Flash 65.3%; Claude Opus 5 74.0%; GPT-5.6 Sol 72.7%; GPT-5.6 Terra 69.6%; Claude Sonnet 5 53.8%
73.7%%deepmind.google
Terminal-bench 2.1
Agentic-программирование в терминале. Gemini 3.7 Flash 85.8%; Claude Opus 5 89.1%; Claude Sonnet 5 80.4%; GPT-5.6 Sol 88.8%; GPT-5.6 Terra 87.4%
89.4%%deepmind.google
Terminal-bench 4.0
Общие agentic-возможности. Gemini 3.7 Flash 11.2%; Claude Opus 5 51.8%; Claude Sonnet 5 12.4%; GPT-5.6 Sol 37.3%; GPT-5.6 Terra 23.6%
19.1%%deepmind.google
GDPVal-AA v2
Knowledge work. Gemini 3.7 Flash 1482; Claude Opus 5 1824; Claude Sonnet 5 1584; GPT-5.6 Sol 1710; GPT-5.6 Terra 1528
1545Elodeepmind.google
Vals Finance Agent v2
Задачи финансового аналитика. Лучший в таблице Google. Gemini 3.7 Flash 59.0%; Claude Opus 5 58.6%; Claude Sonnet 5 53.9%; GPT-5.6 Sol 53.8%; GPT-5.6 Terra 54.4%
61.4%%deepmind.google
Harvey Legal Agent Benchmark
Сложные правовые рабочие процессы, all-pass-rate. Лучший в таблице Google. Gemini 3.7 Flash 8.8%; Claude Opus 5 6.7%; Claude Sonnet 5 5.0%; GPT-5.6 Sol 2.5%; GPT-5.6 Terra 0.8%
10.0%% (all-pass-rate)deepmind.google
HLE-Verified
Мультидисциплинарное экспертное рассуждение. Gemini 3.7 Flash 53.6%; Claude Opus 5 54.4%; Claude Sonnet 5 31.0%; GPT-5.6 Sol 54.5%; GPT-5.6 Terra 51.1%
54.9%%deepmind.google
CharXiv (no tools)
Синтез информации из сложных графиков. Gemini 3.7 Flash 84.5%; Claude Opus 5 83.7%; Claude Sonnet 5 70.1%; GPT-5.6 Sol 85.8%; GPT-5.6 Terra 85.9%
86.2%%deepmind.google
LVBench (agentic)
Понимание длинного видео (agentic). Лучший в таблице Google. Gemini 3.7 Flash 85.4%; Claude Opus 5 75.4%; Claude Sonnet 5 68.5%; GPT-5.6 Sol 82.1%; GPT-5.6 Terra 78.9%
87.8%%deepmind.google
OSWorld-2.0
Agentic computer use. Gemini 3.7 Flash 50.6%; Claude Opus 5 75.4%; Claude Sonnet 5 42.6%; GPT-5.6 Sol 62.6%; GPT-5.6 Terra 50.2%
59.0%% (partial score, batch tool enabled)deepmind.google
BioMysteryBench (Human Solvable)
Рабочие процессы биоинформатики, уровень human-solvable. Gemini 3.7 Flash 87.1%; Claude Opus 5 90.1%; Claude Sonnet 5 87.5%; GPT-5.6 Sol 79.5%; GPT-5.6 Terra 83.8%
88.8%%deepmind.google

Примеры API

Для новых интеграций используйте глобальный endpoint api.therouter.ai из примеров ниже; старый China accelerated endpoint выведен из эксплуатации.

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "google/gemini-3.8-flash",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

Chat completion

Стандартный OpenAI-совместимый chat completion. Thinking включён по умолчанию; его токены считаются выходными.

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"google/gemini-3.8-flash","messages":[{"role":"user","content":"Solve this bug in my code"}]}'

Ещё от google

Похожие модели

Аналоги в других провайдерах

Новости и изменения

2026-09-02

Google выпускает Gemini 3.8 Flash и 3.8 Flash Cyber

Google выпустила Gemini 3.8 Flash 2 сентября 2026 года — третью Flash-модель за шесть недель — вместе с ограниченной Gemini 3.8 Flash Cyber для задач кибербезопасности. В блоге о запуске 3.8 Flash описывается как «самая интеллектуальная рабочая модель», а ключевое изменение дизайна — то, что модель «работает усерднее» на сложных задачах: больше шагов рассуждения и вызовов инструментов при высоких effort-уровнях. Результат на DeepSWE v1.1 — 73.7%, в 0.3 пп от Claude Opus 5, при той же вводной цене $0.75 (стандарт $1.50) за миллион входных токенов, что и у 3.7 Flash.

переработано TheRouterblog.google

Частые вопросы

Чем Gemini 3.8 Flash отличается от Gemini 3.7 Flash?

3.8 Flash — прямой преемник и превосходит 3.7 Flash на всех опубликованных Google бенчмарках пары. Наибольший отрыв — в долгосрочном программировании: 73.7% против 65.3% на DeepSWE v1.1 и 89.4% против 85.8% на Terminal-bench 2.1. Компромисс — расход токенов: 3.8 Flash использует больше выходных токенов на сложных задачах при высоких effort-уровнях. Цена за токен идентична.

Почему usage.completion_tokens кажется высоким?

Thinking включён по умолчанию, и его токены тарифицируются как выходные. Кроме того, 3.8 Flash намеренно выполняет дополнительные шаги рассуждения и вызовы инструментов на сложных задачах, особенно при высоких effort-уровнях. Это явно указано в model card Google. Используйте более низкий effort-уровень или переключитесь на Gemini 3.7 Flash для снижения расхода токенов.

Является ли вводная цена $0.75/$3.75 реальной тарифицируемой ставкой?

Нет. Google выставляет счёт по стандартной ставке $1.50 за 1M входных и $7.50 за 1M выходных токенов, затем возвращает 50% в виде кредитов на аккаунт до 31 декабря 2026 года. Тарифы TheRouter отражают прайс-ставку, которую реально взимает Google, а не сумму после возврата.

Реестр фактов — каждая утверждаемая величина имеет источник
источникURLполучено
Дата релизаdeepmind.google2026-09-19проверено
Дата отсечения знанийdeepmind.google2026-09-19проверено
Лимит входных токеновdeepmind.google2026-09-19проверено
Лимит выходных токеновdeepmind.google2026-09-19проверено
Нативные модальности (upstream)deepmind.google2026-09-19проверено
Прайс вендора (Standard)cloud.google.com2026-09-19проверено
Управление effort-уровнемblog.google2026-09-19проверено
DeepSWE v1.1deepmind.google2026-09-19проверено
Terminal-bench 2.1deepmind.google2026-09-19проверено
Terminal-bench 4.0deepmind.google2026-09-19проверено
GDPVal-AA v2deepmind.google2026-09-19проверено
Vals Finance Agent v2deepmind.google2026-09-19проверено
Harvey Legal Agent Benchmarkdeepmind.google2026-09-19проверено
HLE-Verifieddeepmind.google2026-09-19проверено
CharXiv (no tools)deepmind.google2026-09-19проверено
LVBench (agentic)deepmind.google2026-09-19проверено
OSWorld-2.0deepmind.google2026-09-19проверено
BioMysteryBench (Human Solvable)deepmind.google2026-09-19проверено
Google выпускает Gemini 3.8 Flash и 3.8 Flash Cyberblog.google2026-09-19проверено
Чем Gemini 3.8 Flash отличается от Gemini 3.7 Flash?deepmind.google2026-09-19к проверке
Почему usage.completion_tokens кажется высоким?deepmind.google2026-09-19к проверке
Является ли вводная цена $0.75/$3.75 реальной тарифицируемой ставкой?cloud.google.com2026-09-19к проверке
Поддержка