返回模型列表

Gemini 2.5 Flash

googlegoogle/gemini-2.5-flash

Best for balancing reasoning and speed. Gemini 2.5 Flash offers thinking capabilities with strong performance across coding, math, and reasoning tasks at an efficient price point.

Gemini 2.5 Flash 是 Google 2.5 系列的通用主力模型,在 Google I/O 展示 05-20 preview 后,于 2025 年 6 月 17 日稳定 GA。它的定位是价格/性能平衡:1,048,576 token 输入窗口、65,536 token 输出上限、原生 Gemini API 的多模态输入(文本、图像、视频、音频)、文本输出、工具调用、结构化输出、代码执行、URL context、搜索 grounding,以及可控 thinking budget。

在 TheRouter 上,Gemini 2.5 Flash 是团队需要长上下文推理和 agentic 工具能力、但不想承担 Pro 级成本时的默认 Google 选择。它比 Gemini 2.0 Flash 更强且更可控,比 Gemini 2.5 Pro 更便宜,也比 Flash-Lite 更适合编程、多步分析、检索密集客服和高吞吐文档工作流。如果首要目标是前沿级代码准确率而不是成本,应路由到 Gemini 3 Flash/Pro 或 GPT-5.5 级模型。

适合使用
  • • 高吞吐编程助手、客服 agent 和内部 copilot:需要工具调用、结构化输出和 1M token 上下文,同时要求 token 成本可控
  • • 长文档和代码仓库分析:2.0 代 Flash 推理质量不足,但 Pro 级模型成本过高
  • • 检索密集工作流:可利用 Google Search grounding、URL context、缓存、Batch、Priority/Flex inference
  • • 对延迟敏感的推理任务:可通过 thinking budget 控制推理深度,而不是每次都为最大思考买单
不适合使用
  • • 前沿级自主软件工程:若 benchmark 上限比成本更重要,优先 google/gemini-3-flash-preview、google/gemini-3-pro-preview 或 openai/gpt-5.5
  • • 极低成本分类、路由和简单抽取:Flash-Lite 足够且更便宜
  • • 通过 TheRouter chat completions 做原生图像/音频生成——此模型在 TheRouter 上仅输出文本,应选择专用图像或音频模型
上下文长度
1.0M
最大输出
66K
输入价格每百万 tokens
$0.324每百万 Tokens
输出价格每百万 tokens
$2.70每百万 Tokens

模态能力

文本图像PDF→文本

能力

视觉理解

价格明细

类型费率
输入$0.324 每百万 Tokens
输出$2.70 每百万 Tokens

支持参数

temperaturemax_tokenstop_ptoolstool_choiceresponse_formatstop

模型规格

发布日期2025-06-17(稳定 GA)developers.googleblog.com ↗已核实
知识截止2025 年 1 月ai.google.dev ↗已核实
输入 / 输出模态原生 Gemini API:文本、图像、视频、音频输入;文本输出。TheRouter 暴露文本/图像/PDF 输入和文本输出。ai.google.dev ↗已核实
原生工具能力函数调用、结构化输出、代码执行、文件搜索、URL context、搜索 grounding、地图 grounding、缓存、Batch API、Flex 和 Priority inferenceai.google.dev ↗已核实
许可专有 API 模型;按 Google Gemini API / Google Cloud 条款提供,非开放权重ai.google.dev ↗已核实

基准成绩

BenchmarkDistributionScoreSource
Global-MMLU-Lite
聚合器报告的 Gemini 2.5 Flash benchmark;在对照 Google model card 表格前应作为方向性指标。
88.4%%llm-stats.com ↗
AIME 2024
聚合器报告的数学结果;Google 另称 05-20 Flash 更新在推理 benchmark 上有提升。
88.0%%llm-stats.com ↗
GPQA
聚合器报告的科学/推理分数;在匹配底层 model-card 方法前保持 medium confidence。
82.8%%llm-stats.com ↗
MMMU
聚合器报告的稳定 Flash 系列多模态分数。
79.7%%llm-stats.com ↗

API 使用示例

所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "google/gemini-2.5-flash",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

API 使用指南

完整 API 参考 →

Chat 调用

当你需要 Google 长上下文推理但不想更换 SDK 时,可通过 TheRouter 以 OpenAI-compatible chat model 调用 Gemini 2.5 Flash。

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Authorization: Bearer $THEROUTER_API_KEY"   -H "Content-Type: application/json"   -d '{"model":"google/gemini-2.5-flash","messages":[{"role":"user","content":"Summarize the migration risk in this pull request."}]}'

google 其他模型

同类模型

跨供应商的相似能力档位

动态与变更

2025-06-17

Gemini 2.5 Flash 稳定 GA

Google 将 Gemini 2.5 Flash 设为 GA,简化为单一 thinking/non-thinking 价格层,并将 Flash-Lite 定位为更便宜的高吞吐选项。

TheRouter 编辑重写developers.googleblog.com ↗
2025-05-20

Google I/O 更新提升 Flash 效率与推理

Google 称更新后的 Flash preview 在推理、多模态、代码和长上下文方面更强,并在内部评测中减少 20-30% token 使用。

TheRouter 编辑重写blog.google ↗

常见问题

Gemini 2.5 Flash 是 TheRouter 上默认 Google 模型的正确选择吗?

对于成本平衡型生产流量,是。它以远低于 Pro 级模型的成本提供 1M 上下文、thinking、工具调用、结构化输出和多模态输入。若是前沿自主编程,应评估 Gemini 3 或 GPT-5.5 级模型。

TheRouter 编辑重写ai.google.dev ↗
Gemini 2.5 Flash 与 Gemini 2.5 Flash-Lite 有什么不同?

Flash 是更强的价格/性能模型,适合推理和 agentic 工作流;Flash-Lite 优化最低延迟和成本,thinking 默认关闭,更适合大规模分类、摘要和简单抽取。

TheRouter 编辑重写developers.googleblog.com ↗
Gemini 2.5 Flash 是否通过 TheRouter 支持 OpenAI-compatible 工具调用?

支持。TheRouter 通过 OpenAI-compatible chat completions 暴露该模型,supported_params 包含 tools。超出通用函数调用的 Gemini 原生工具特性,应在具体 TheRouter 路由上验证后再对外宣传。

TheRouter 编辑重写ai.google.dev ↗
事实档案 — 本页每条断言可在此回溯来源
来源URL采集于
发布日期developers.googleblog.com ↗2026-06-03已核实
知识截止ai.google.dev ↗2026-06-03已核实
输入 / 输出模态ai.google.dev ↗2026-06-03已核实
原生工具能力ai.google.dev ↗2026-06-03已核实
许可ai.google.dev ↗2026-06-03已核实
Global-MMLU-Litellm-stats.com ↗2026-06-03待核实
AIME 2024llm-stats.com ↗2026-06-03待核实
GPQAllm-stats.com ↗2026-06-03待核实
MMMUllm-stats.com ↗2026-06-03待核实
Gemini 2.5 Flash 稳定 GAdevelopers.googleblog.com ↗2026-06-03已核实
Google I/O 更新提升 Flash 效率与推理blog.google ↗2026-06-03已核实
Gemini 2.5 Flash 是 TheRouter 上默认 Google 模型的正确选择吗?ai.google.dev ↗2026-06-03待核实
Gemini 2.5 Flash 与 Gemini 2.5 Flash-Lite 有什么不同?developers.googleblog.com ↗2026-06-03待核实
Gemini 2.5 Flash 是否通过 TheRouter 支持 OpenAI-compatible 工具调用?ai.google.dev ↗2026-06-03待核实
帮助与联系