Назад к моделям

Gemini 2.5 Flash

googlegoogle/gemini-2.5-flash

Best for balancing reasoning and speed. Gemini 2.5 Flash offers thinking capabilities with strong performance across coding, math, and reasoning tasks at an efficient price point.

Gemini 2.5 Flash — универсальная GA-модель Google серии 2.5, стабилизированная 17 июня 2025 года после preview 05-20, показанного на Google I/O. Она оптимизирована под соотношение цена/качество: входное окно 1 048 576 токенов, лимит вывода 65 536 токенов, мультимодальный ввод (текст, изображения, видео и аудио в нативном Gemini API), текстовый вывод, tool use, структурированные ответы, code execution, URL context, search grounding и управляемый thinking budget.

Для TheRouter Gemini 2.5 Flash — основной выбор Google, когда команде нужны long-context reasoning и агентные возможности без цены Pro-уровня. Она сильнее и управляемее Gemini 2.0 Flash, дешевле Gemini 2.5 Pro и заметно мощнее Flash-Lite для кодинга, многошагового анализа, retrieval-heavy поддержки и массовой обработки документов. Если важнее максимальная точность frontier-кодинга, а не стоимость, лучше маршрутизировать на Gemini 3 Flash/Pro или модели класса GPT-5.5.

Когда выбирать
  • • Высоконагруженные coding assistants, support agents и внутренние copilots, которым нужны function calling, structured output и окно 1M токенов по эффективной цене
  • • Анализ длинных документов и репозиториев, где Flash поколения 2.0 теряет качество рассуждений, а Pro-модели слишком дороги
  • • Retrieval-heavy процессы, которым полезны Google Search grounding, URL context, кэширование, Batch API и режимы priority/flex inference
  • • Задачи reasoning с чувствительностью к задержке, где thinking budget можно дозировать вместо постоянной оплаты максимального размышления
Когда не выбирать
  • • Frontier-level автономная разработка ПО, где потолок benchmark важнее цены — выбирайте google/gemini-3-flash-preview, google/gemini-3-pro-preview или openai/gpt-5.5
  • • Сверхдешёвая классификация, маршрутизация и простое извлечение, где достаточно более дешёвой Flash-Lite
  • • Нативная генерация изображений/аудио через TheRouter chat completions — на TheRouter эта модель выводит только текст; выбирайте специализированную image/audio модель
Размер контекста
1.0M
Максимальный вывод
66K
Цена Входза 1M токенов
$0.324за 1 млн токенов
Цена Выходза 1M токенов
$2.70за 1 млн токенов

Модальности

ТекстИзображениеPDF→Текст

Возможности

Зрение

Разбивка цен

ТипСтавка
Вход$0.324 за 1 млн токенов
Выход$2.70 за 1 млн токенов

Поддерживаемые параметры

temperaturemax_tokenstop_ptoolstool_choiceresponse_formatstop

Характеристики

Дата релиза2025-06-17 (stable GA)developers.googleblog.com ↗проверено
Дата отсечения знанийЯнварь 2025ai.google.dev ↗проверено
Модальности ввода / выводаНативный Gemini API: текст, изображения, видео, аудио на входе; текст на выходе. TheRouter exposes текст/изображения/PDF на входе и текст на выходе.ai.google.dev ↗проверено
Нативные tool-возможностиFunction calling, structured outputs, code execution, file search, URL context, search grounding, Maps grounding, caching, Batch API, flex и priority inferenceai.google.dev ↗проверено
ЛицензияПроприетарная API-модель; доступна по условиям Google Gemini API / Google Cloud, веса не открытыai.google.dev ↗проверено

Бенчмарки

BenchmarkDistributionScoreSource
Global-MMLU-Lite
Benchmark из агрегатора для Gemini 2.5 Flash; используйте как ориентир до сверки с таблицами model card Google.
88.4%%llm-stats.com ↗
AIME 2024
Математический результат из агрегатора; Google отдельно описывает обновление Flash 05-20 как улучшенное на reasoning benchmark.
88.0%%llm-stats.com ↗
GPQA
Science/reasoning score из агрегатора; confidence остаётся medium до сопоставления с методологией model card.
82.8%%llm-stats.com ↗
MMMU
Мультимодальный score из агрегатора для stable-линейки Flash.
79.7%%llm-stats.com ↗

Примеры API

Для новых интеграций используйте глобальный endpoint api.therouter.ai из примеров ниже; старый China accelerated endpoint выведен из эксплуатации.

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "google/gemini-2.5-flash",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

Chat completion

Используйте Gemini 2.5 Flash как OpenAI-compatible chat model через TheRouter, когда нужно Google long-context reasoning без смены SDK.

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Authorization: Bearer $THEROUTER_API_KEY"   -H "Content-Type: application/json"   -d '{"model":"google/gemini-2.5-flash","messages":[{"role":"user","content":"Summarize the migration risk in this pull request."}]}'

Ещё от google

Похожие модели

Аналоги в других провайдерах

Новости и изменения

2025-06-17

Gemini 2.5 Flash стала stable GA

Google сделала Gemini 2.5 Flash generally available, упростила pricing до единого thinking/non-thinking tier и позиционировала Flash-Lite как более дешёвый high-throughput option.

переработано TheRouterdevelopers.googleblog.com ↗
2025-05-20

Обновление Google I/O улучшило эффективность и reasoning Flash

Google описала обновлённый Flash preview как улучшенный в reasoning, multimodality, code и long context, при этом использующий на 20-30% меньше токенов во внутренних оценках.

переработано TheRouterblog.google ↗

Частые вопросы

Gemini 2.5 Flash — правильная default Google-модель на TheRouter?

Да, для cost-balanced production traffic. Она даёт 1M context, thinking support, tool calling, structured outputs и multimodal input по цене значительно ниже Pro-tier моделей. Для frontier autonomous coding оценивайте Gemini 3 или модели класса GPT-5.5.

переработано TheRouterai.google.dev ↗
Чем Gemini 2.5 Flash отличается от Gemini 2.5 Flash-Lite?

Flash — более сильная price-performance модель для reasoning и agentic workflows; Flash-Lite оптимизирована под минимальную задержку и стоимость, thinking выключен по умолчанию и лучше подходит для classification, summarization и simple extraction at scale.

переработано TheRouterdevelopers.googleblog.com ↗
Поддерживает ли Gemini 2.5 Flash OpenAI-compatible tool calling через TheRouter?

Да. TheRouter exposes модель через OpenAI-compatible chat completions с tools в supported_params. Нативные Gemini tool-функции сверх generic function calling нужно валидировать на конкретном route TheRouter перед маркетинговыми заявлениями.

переработано TheRouterai.google.dev ↗
Реестр фактов — каждая утверждаемая величина имеет источник
источникURLполучено
Дата релизаdevelopers.googleblog.com ↗2026-06-03проверено
Дата отсечения знанийai.google.dev ↗2026-06-03проверено
Модальности ввода / выводаai.google.dev ↗2026-06-03проверено
Нативные tool-возможностиai.google.dev ↗2026-06-03проверено
Лицензияai.google.dev ↗2026-06-03проверено
Global-MMLU-Litellm-stats.com ↗2026-06-03к проверке
AIME 2024llm-stats.com ↗2026-06-03к проверке
GPQAllm-stats.com ↗2026-06-03к проверке
MMMUllm-stats.com ↗2026-06-03к проверке
Gemini 2.5 Flash стала stable GAdevelopers.googleblog.com ↗2026-06-03проверено
Обновление Google I/O улучшило эффективность и reasoning Flashblog.google ↗2026-06-03проверено
Gemini 2.5 Flash — правильная default Google-модель на TheRouter?ai.google.dev ↗2026-06-03к проверке
Чем Gemini 2.5 Flash отличается от Gemini 2.5 Flash-Lite?developers.googleblog.com ↗2026-06-03к проверке
Поддерживает ли Gemini 2.5 Flash OpenAI-compatible tool calling через TheRouter?ai.google.dev ↗2026-06-03к проверке
Помощь и контакты