返回模型列表

Gemini 3.8 Flash

googlegoogle/gemini-3.8-flash

Google's Flash-tier model, released 2026-09-02. 1M-token context, thinking enabled.

Gemini 3.8 Flash 是 Google 六周内发布的第三款 Flash 档模型,于 2026 年 9 月 2 日与 Gemini 3.8 Flash Cyber 同步发布。它直接在 Gemini 3.7 Flash 基础上构建,Google 将其定位为迄今最强的 Flash 主力模型——Google 模型卡称其在"软件工程与 agentic 知识工作流"方面取得了显著进展。输入窗口 1M tokens、输出上限 64K 与前代 Flash 保持一致;thinking 默认开启,effort level 控制也沿用。

最突出的改进是执行力:Google 表示该模型在复杂任务上"更努力",会执行额外的推理步骤并反复调用工具。这在长周期编程 benchmark 上体现最明显——3.8 Flash 以 Flash 级成本超越了大多数更大的前沿模型。Google 提醒,在较高 effort level 下额外的努力可能带来更多输出 token——模型卡建议效率优先的工作负载回退至 Gemini 3.7 Flash。在 TheRouter 上,本模型通过 OpenAI 兼容的 chat completions API 提供。

适合使用
  • 长周期软件工程——Google 报告 DeepSWE v1.1 73.7%,高于 GPT-5.6 Sol(72.7%)、GPT-5.6 Terra(69.6%)和 Claude Sonnet 5(53.8%),仅比 Claude Opus 5(74.0%)低 0.3 个百分点,但成本低得多
  • Agentic 终端任务——Terminal-bench 2.1 89.4%,与 Claude Opus 5(89.1%)基本持平,超过 GPT-5.6 Sol(88.8%)
  • 金融与法律 agent 生产工作流——Vals Finance Agent v2 61.4%、Harvey Legal Agent Benchmark all-pass-rate 10.0%,均为 Google 对比表最高
  • 长视频理解——LVBench(agentic)87.8%,为 Google 对比表最高
不适合使用
  • 以效率为先、输出 token 数量为瓶颈的高吞吐流水线——Google 明确建议效率优先的场景使用 Gemini 3.7 Flash;3.8 Flash 在较高 effort level 下消耗更多 token
  • 通用 agent 能力(非编程)——Terminal-bench 4.0 19.1% 远落后于 Claude Opus 5(51.8%)和 GPT-5.6 Sol(37.3%);该模型优势集中在编程及特定领域的 agentic benchmark 上
  • Computer use——OSWorld-2.0 59.0% vs Claude Opus 5 的 75.4%;GUI 自动化场景中,Claude Opus 5 在 Google 对比中领先明显

供应商自营与 TheRouter 服务形态的差异

供应商自己运营时

Google 通过 Gemini API(ai.google.dev)和 Vertex AI 提供 Gemini 3.8 Flash。上游模型接受文本、图像、音频、视频输入,返回文本输出。原生能力包括 thinking、函数调用、结构化输出、代码执行、上下文缓存、Batch API、Google 搜索 grounding、Google 地图 grounding 与文件检索。不支持音频生成、图像生成与 Live API。Thinking token 按与输出 token 相同的费率计费。

在 TheRouter 上

TheRouter 将 Gemini 3.8 Flash 以 OpenAI 兼容 /v1/chat/completions 暴露为 google/gemini-3.8-flash。暴露的输入模态为文本、图像、PDF;音频与视频输入不透传。函数调用与结构化输出通过 OpenAI tools schema 正常使用。Thinking token 体现在 usage.completion_tokens 中。音频生成、图像生成与 Live API 不可通过 TheRouter 使用。

上下文长度
1.0M
最大输出
66K
输入价格每百万 tokens
$1.62每百万 Tokens
输出价格每百万 tokens
$8.10每百万 Tokens

模态能力

文本图像PDF文本

能力

视觉理解

价格明细

类型费率
输入$1.62 每百万 Tokens
输出$8.10 每百万 Tokens

支持参数

temperaturemax_tokenstop_ptoolstool_choiceresponse_formatstop

模型规格

发布日期2026-09-02deepmind.google已核实
知识截止2026 年 3 月(部分领域可能限于 2025 年 1 月)deepmind.google已核实
输入 token 上限1,048,576deepmind.google已核实
输出 token 上限65,536deepmind.google已核实
上游原生模态输入:文本、图像、音频、视频。输出:仅文本。TheRouter 暴露文本、图像、PDF 输入与文本输出。deepmind.google已核实
厂商标价(Standard 档)输入 $1.50/1M,输出 $7.50/1M,缓存输入 $0.15/1M(Vertex AI Global 端点)。2026-12-31 前的 50% 返现促销不影响计费标准价。cloud.google.com已核实
effort level 控制支持。较低 effort level 可减少 token 消耗;Google 建议效率优先的场景使用 3.7 Flash。blog.google已核实

基准成绩

BenchmarkDistributionScoreSource
DeepSWE v1.1
长周期软件工程。Gemini 3.7 Flash 65.3%;Claude Opus 5 74.0%;GPT-5.6 Sol 72.7%;GPT-5.6 Terra 69.6%;Claude Sonnet 5 53.8%
73.7%%deepmind.google
Terminal-bench 2.1
Agentic 终端编程。Gemini 3.7 Flash 85.8%;Claude Opus 5 89.1%;Claude Sonnet 5 80.4%;GPT-5.6 Sol 88.8%;GPT-5.6 Terra 87.4%
89.4%%deepmind.google
Terminal-bench 4.0
通用 agent 能力。Gemini 3.7 Flash 11.2%;Claude Opus 5 51.8%;Claude Sonnet 5 12.4%;GPT-5.6 Sol 37.3%;GPT-5.6 Terra 23.6%
19.1%%deepmind.google
GDPVal-AA v2
知识工作。Gemini 3.7 Flash 1482;Claude Opus 5 1824;Claude Sonnet 5 1584;GPT-5.6 Sol 1710;GPT-5.6 Terra 1528
1545Elodeepmind.google
Vals Finance Agent v2
金融分析师任务,为 Google 对比表最高。Gemini 3.7 Flash 59.0%;Claude Opus 5 58.6%;Claude Sonnet 5 53.9%;GPT-5.6 Sol 53.8%;GPT-5.6 Terra 54.4%
61.4%%deepmind.google
Harvey Legal Agent Benchmark
复杂法律工作流,all-pass-rate,为 Google 对比表最高。Gemini 3.7 Flash 8.8%;Claude Opus 5 6.7%;Claude Sonnet 5 5.0%;GPT-5.6 Sol 2.5%;GPT-5.6 Terra 0.8%
10.0%% (all-pass-rate)deepmind.google
HLE-Verified
多学科专家推理。Gemini 3.7 Flash 53.6%;Claude Opus 5 54.4%;Claude Sonnet 5 31.0%;GPT-5.6 Sol 54.5%;GPT-5.6 Terra 51.1%
54.9%%deepmind.google
CharXiv (no tools)
复杂图表信息综合。Gemini 3.7 Flash 84.5%;Claude Opus 5 83.7%;Claude Sonnet 5 70.1%;GPT-5.6 Sol 85.8%;GPT-5.6 Terra 85.9%
86.2%%deepmind.google
LVBench (agentic)
长视频理解(agentic),为 Google 对比表最高。Gemini 3.7 Flash 85.4%;Claude Opus 5 75.4%;Claude Sonnet 5 68.5%;GPT-5.6 Sol 82.1%;GPT-5.6 Terra 78.9%
87.8%%deepmind.google
OSWorld-2.0
Agentic computer use。Gemini 3.7 Flash 50.6%;Claude Opus 5 75.4%;Claude Sonnet 5 42.6%;GPT-5.6 Sol 62.6%;GPT-5.6 Terra 50.2%
59.0%% (partial score, batch tool enabled)deepmind.google
BioMysteryBench (Human Solvable)
生物信息学研究工作流,人类可解级别。Gemini 3.7 Flash 87.1%;Claude Opus 5 90.1%;Claude Sonnet 5 87.5%;GPT-5.6 Sol 79.5%;GPT-5.6 Terra 83.8%
88.8%%deepmind.google

API 使用示例

所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "google/gemini-3.8-flash",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

API 使用指南

完整 API 参考 →

Chat 调用

标准 OpenAI 兼容 chat completion。Thinking 默认开启,其 token 计入输出计费。

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"google/gemini-3.8-flash","messages":[{"role":"user","content":"Solve this bug in my code"}]}'

google 其他模型

同类模型

跨供应商的相似能力档位

动态与变更

2026-09-02

Google 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber

Google 于 2026 年 9 月 2 日发布 Gemini 3.8 Flash(六周内第三款 Flash 模型),同时发布面向网络安全用途的受限版 Gemini 3.8 Flash Cyber。发布博客将 3.8 Flash 定位为"最智能的主力模型",核心设计变化是在复杂任务上"更努力":在较高 effort level 下执行更多推理步骤和工具调用。其 DeepSWE v1.1 得分 73.7%,与 Claude Opus 5 仅差 0.3 个百分点,同时维持与 3.7 Flash 相同的 $0.75 介绍价(标准价 $1.50)。

TheRouter 编辑重写blog.google

常见问题

Gemini 3.8 Flash 与 Gemini 3.7 Flash 相比如何?

3.8 Flash 是直接后继,在 Google 公布的所有对比 benchmark 中均超过 3.7 Flash。差距最大的是长周期编程:DeepSWE v1.1 73.7% vs 65.3%,Terminal-bench 2.1 89.4% vs 85.8%。代价是 token 消耗——3.8 Flash 在较高 effort level 下的复杂任务中输出 token 更多。每 token 价格相同。

为什么 usage.completion_tokens 看起来偏高?

Thinking 默认开启,其 token 计入输出计费。此外,3.8 Flash 在复杂任务上(尤其是较高 effort level 下)会刻意执行额外的推理步骤和工具调用。Google 模型卡对此有明确说明。使用较低 effort level 或切换至 Gemini 3.7 Flash 可减少 token 消耗。

0.75 美元/$3.75 的介绍价是实际计费价格吗?

不是。Google 按标准价 $1.50/1M 输入、$7.50/1M 输出计费,再通过 2026 年 12 月 31 日前的账户返现退还 50%。TheRouter 定价反映 Google 实际收取的标准价,而非返现后的净价。

事实档案 — 本页每条断言可在此回溯来源
来源URL采集于
发布日期deepmind.google2026-09-19已核实
知识截止deepmind.google2026-09-19已核实
输入 token 上限deepmind.google2026-09-19已核实
输出 token 上限deepmind.google2026-09-19已核实
上游原生模态deepmind.google2026-09-19已核实
厂商标价(Standard 档)cloud.google.com2026-09-19已核实
effort level 控制blog.google2026-09-19已核实
DeepSWE v1.1deepmind.google2026-09-19已核实
Terminal-bench 2.1deepmind.google2026-09-19已核实
Terminal-bench 4.0deepmind.google2026-09-19已核实
GDPVal-AA v2deepmind.google2026-09-19已核实
Vals Finance Agent v2deepmind.google2026-09-19已核实
Harvey Legal Agent Benchmarkdeepmind.google2026-09-19已核实
HLE-Verifieddeepmind.google2026-09-19已核实
CharXiv (no tools)deepmind.google2026-09-19已核实
LVBench (agentic)deepmind.google2026-09-19已核实
OSWorld-2.0deepmind.google2026-09-19已核实
BioMysteryBench (Human Solvable)deepmind.google2026-09-19已核实
Google 发布 Gemini 3.8 Flash 与 3.8 Flash Cyberblog.google2026-09-19已核实
Gemini 3.8 Flash 与 Gemini 3.7 Flash 相比如何?deepmind.google2026-09-19待核实
为什么 usage.completion_tokens 看起来偏高?deepmind.google2026-09-19待核实
0.75 美元/$3.75 的介绍价是实际计费价格吗?cloud.google.com2026-09-19待核实
客服支持