Gemini 2.5 Flash стала stable GA
Google сделала Gemini 2.5 Flash generally available, упростила pricing до единого thinking/non-thinking tier и позиционировала Flash-Lite как более дешёвый high-throughput option.
Best for balancing reasoning and speed. Gemini 2.5 Flash offers thinking capabilities with strong performance across coding, math, and reasoning tasks at an efficient price point.
Gemini 2.5 Flash — универсальная GA-модель Google серии 2.5, стабилизированная 17 июня 2025 года после preview 05-20, показанного на Google I/O. Она оптимизирована под соотношение цена/качество: входное окно 1 048 576 токенов, лимит вывода 65 536 токенов, мультимодальный ввод (текст, изображения, видео и аудио в нативном Gemini API), текстовый вывод, tool use, структурированные ответы, code execution, URL context, search grounding и управляемый thinking budget.
Для TheRouter Gemini 2.5 Flash — основной выбор Google, когда команде нужны long-context reasoning и агентные возможности без цены Pro-уровня. Она сильнее и управляемее Gemini 2.0 Flash, дешевле Gemini 2.5 Pro и заметно мощнее Flash-Lite для кодинга, многошагового анализа, retrieval-heavy поддержки и массовой обработки документов. Если важнее максимальная точность frontier-кодинга, а не стоимость, лучше маршрутизировать на Gemini 3 Flash/Pro или модели класса GPT-5.5.
| Тип | Ставка |
|---|---|
| Вход | $0.324 за 1 млн токенов |
| Выход | $2.70 за 1 млн токенов |
| Дата релиза | 2025-06-17 (stable GA)developers.googleblog.com ↗ | проверено |
| Дата отсечения знаний | Январь 2025ai.google.dev ↗ | проверено |
| Модальности ввода / вывода | Нативный Gemini API: текст, изображения, видео, аудио на входе; текст на выходе. TheRouter exposes текст/изображения/PDF на входе и текст на выходе.ai.google.dev ↗ | проверено |
| Нативные tool-возможности | Function calling, structured outputs, code execution, file search, URL context, search grounding, Maps grounding, caching, Batch API, flex и priority inferenceai.google.dev ↗ | проверено |
| Лицензия | Проприетарная API-модель; доступна по условиям Google Gemini API / Google Cloud, веса не открытыai.google.dev ↗ | проверено |
| Benchmark | Distribution | Score | Source |
|---|---|---|---|
Global-MMLU-Lite Benchmark из агрегатора для Gemini 2.5 Flash; используйте как ориентир до сверки с таблицами model card Google. | 88.4%% | llm-stats.com ↗ | |
AIME 2024 Математический результат из агрегатора; Google отдельно описывает обновление Flash 05-20 как улучшенное на reasoning benchmark. | 88.0%% | llm-stats.com ↗ | |
GPQA Science/reasoning score из агрегатора; confidence остаётся medium до сопоставления с методологией model card. | 82.8%% | llm-stats.com ↗ | |
MMMU Мультимодальный score из агрегатора для stable-линейки Flash. | 79.7%% | llm-stats.com ↗ |
Для новых интеграций используйте глобальный endpoint api.therouter.ai из примеров ниже; старый China accelerated endpoint выведен из эксплуатации.
curl https://api.therouter.ai/v1/chat/completions -H "Content-Type: application/json" -H "Authorization: Bearer $THE_ROUTER_API_KEY" -d '{
"model": "google/gemini-2.5-flash",
"messages": [
{"role": "user", "content": "Summarize the key points from this input."}
]
}'Используйте Gemini 2.5 Flash как OpenAI-compatible chat model через TheRouter, когда нужно Google long-context reasoning без смены SDK.
curl https://api.therouter.ai/v1/chat/completions -H "Authorization: Bearer $THEROUTER_API_KEY" -H "Content-Type: application/json" -d '{"model":"google/gemini-2.5-flash","messages":[{"role":"user","content":"Summarize the migration risk in this pull request."}]}'Google сделала Gemini 2.5 Flash generally available, упростила pricing до единого thinking/non-thinking tier и позиционировала Flash-Lite как более дешёвый high-throughput option.
Google описала обновлённый Flash preview как улучшенный в reasoning, multimodality, code и long context, при этом использующий на 20-30% меньше токенов во внутренних оценках.
Да, для cost-balanced production traffic. Она даёт 1M context, thinking support, tool calling, structured outputs и multimodal input по цене значительно ниже Pro-tier моделей. Для frontier autonomous coding оценивайте Gemini 3 или модели класса GPT-5.5.
Flash — более сильная price-performance модель для reasoning и agentic workflows; Flash-Lite оптимизирована под минимальную задержку и стоимость, thinking выключен по умолчанию и лучше подходит для classification, summarization и simple extraction at scale.
Да. TheRouter exposes модель через OpenAI-compatible chat completions с tools в supported_params. Нативные Gemini tool-функции сверх generic function calling нужно валидировать на конкретном route TheRouter перед маркетинговыми заявлениями.
| источник | URL | получено | |
|---|---|---|---|
| Дата релиза | developers.googleblog.com ↗ | 2026-06-03 | проверено |
| Дата отсечения знаний | ai.google.dev ↗ | 2026-06-03 | проверено |
| Модальности ввода / вывода | ai.google.dev ↗ | 2026-06-03 | проверено |
| Нативные tool-возможности | ai.google.dev ↗ | 2026-06-03 | проверено |
| Лицензия | ai.google.dev ↗ | 2026-06-03 | проверено |
| Global-MMLU-Lite | llm-stats.com ↗ | 2026-06-03 | к проверке |
| AIME 2024 | llm-stats.com ↗ | 2026-06-03 | к проверке |
| GPQA | llm-stats.com ↗ | 2026-06-03 | к проверке |
| MMMU | llm-stats.com ↗ | 2026-06-03 | к проверке |
| Gemini 2.5 Flash стала stable GA | developers.googleblog.com ↗ | 2026-06-03 | проверено |
| Обновление Google I/O улучшило эффективность и reasoning Flash | blog.google ↗ | 2026-06-03 | проверено |
| Gemini 2.5 Flash — правильная default Google-модель на TheRouter? | ai.google.dev ↗ | 2026-06-03 | к проверке |
| Чем Gemini 2.5 Flash отличается от Gemini 2.5 Flash-Lite? | developers.googleblog.com ↗ | 2026-06-03 | к проверке |
| Поддерживает ли Gemini 2.5 Flash OpenAI-compatible tool calling через TheRouter? | ai.google.dev ↗ | 2026-06-03 | к проверке |