返回模型列表

Gemma 3 4B

googlegoogle/gemma-3-4b

Google's smallest Gemma 3 model at 4B parameters. Lightweight chat, copilots, coding and reasoning, cost-effective fine-tuned vertical assistants.

Gemma 3 4B 是 Google Gemma 3 开放模型家族的紧凑规模成员,于 2025 年 3 月 12 日发布。它是 40 亿参数视觉语言模型,支持图像和文本输入、文本输出、128K token 上下文窗口,并提供面向对话使用的指令微调版本。Google 将 Gemma 3 定位为当时能力最强的 Gemma 开放模型家族,重点升级了长上下文、多模态、函数调用、结构化输出,以及 140 多种语言覆盖。

在 TheRouter 上,Gemma 3 4B 适合需要图像理解和多语言对话、但希望比更大的 Gemma 或前沿托管模型成本和延迟更低的团队。它比极小文本模型更完整地覆盖文档问答、视觉检查、抽取和通用助手工作负载,也是部署占用敏感时更实际的 Gemma 3 尺寸。它不应被当作 Gemini 的替代品:最合适的是低到中等复杂度、需要成本可控和开放权重可迁移性的任务,而不是追求最高推理上限的任务。

适合使用
  • • 需要 4B 开放权重模型而非专有前沿模型的视觉语言抽取、检查和基于图片的客服流程
  • • 多语言助手和内容工作流:需要 140+ 语言覆盖,同时把模型可迁移性作为采购条件
  • • 成本敏感的文档问答和抽取,适合长但边界明确、128K token 足够的上下文
  • • 正在评估开放权重部署路径的团队,用于决定自托管、微调,还是继续使用托管 API 路由
不适合使用
  • • 前沿推理、自主编码或高难数学:Gemini 2.5 Pro、Gemini 3 系列、Claude 或 GPT-5.5 级模型上限更高
  • • 极低成本路由、分类或抽取:更小的 Gemma、Llama 或 Qwen 模型可能以更低延迟达到质量目标
  • • 原生图像、音频或视频生成——Gemma 3 4B 可理解图像但输出文本,应使用专用生成模型

供应商自营与 TheRouter 服务形态的差异

供应商自己运营时

Google 以开放权重形式发布 Gemma 3 4B,可用于自托管、微调,并部署到本地硬件、Hugging Face、Kaggle、Google AI Studio、Vertex AI 等运行环境。

在 TheRouter 上

TheRouter 将其作为托管的 OpenAI 兼容 chat-completions 路由提供,支持文本/图像输入与文本输出;本页不声称 TheRouter 实时请求路径提供本地权重下载、微调或厂商原生运行时控制。

上下文长度
128K
最大输出
8K
输入价格每百万 tokens
$0.0432每百万 Tokens
输出价格每百万 tokens
$0.0864每百万 Tokens

模态能力

文本图像→文本

能力

视觉理解

价格明细

类型费率
输入$0.0432 每百万 Tokens
输出$0.0864 每百万 Tokens

支持参数

temperaturemax_tokenstop_pstop

模型规格

发布日期2025-03-12Google Developers Blog ↗已核实
架构 / 规模稠密 Transformer,40 亿参数Google Developers Blog ↗已核实
上下文窗口最高 128K tokenGoogle Developers Blog ↗已核实
训练 token4B 模型使用 4T token 训练Google Developers Blog ↗已核实
输入 / 输出模态文本和图像输入;文本输出Google Developers Blog ↗已核实
许可Gemma 使用条款ai.google.dev ↗已核实

基准成绩

BenchmarkDistributionScoreSource
MMLU Pro
Gemma 3 IT 4B,0-shot,来自 Google Gemma 3 模型卡
44.9%ai.google.dev ↗
HumanEval
Gemma 3 IT 4B,0-shot,官方模型卡中的代码生成基准
54.3%ai.google.dev ↗
GSM8K
Gemma 3 IT 4B,0-shot,官方模型卡中的小学数学基准
75.6%ai.google.dev ↗

API 使用示例

所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "google/gemma-3-4b",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

API 使用指南

完整 API 参考 →

Chat 调用

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "google/gemma-3-4b",
    "messages": [{"role": "user", "content": "Explain adaptive image tiling in two paragraphs."}]
  }'

google 其他模型

同类模型

跨供应商的相似能力档位

动态与变更

2025-03-12

Google 发布 Gemma 3,加入多模态与 128K 上下文

Google 发布文将 Gemma 3 描述为包含 1B、4B、12B、27B 四种规模的开放模型家族,支持图像和文本输入、文本输出、结构化输出、函数调用,以及 140 多种语言。

TheRouter 编辑重写Google Developers Blog ↗

常见问题

Gemma 3 4B 适合作为生产聊天默认模型吗?

当开放权重、视觉输入和成本可预测性重要时适合使用。若需要最高推理质量、更长上下文或 Google 原生托管工具,应选择 Gemini 路由。

Gemma 3 4B 能生成图像吗?

不能。Gemma 3 4B 是视觉语言模型,可以读取图像输入并返回文本。图像生成应使用专用图像模型。

TheRouter 的服务方式与 Google 开放权重发布有什么不同?

Google 的发布允许团队下载权重并在多种环境运行。TheRouter 暴露的是托管 OpenAI 兼容 API 路由,集成更简单,但本地运行时和微调控制不属于该路由。

这些 API 代码片段已经验证了吗?

没有。本次 curator 运行没有付费 API 预算,因此在人工操作员批准并支付验证运行前,代码片段仍未被证明。

事实档案 — 本页每条断言可在此回溯来源
来源URL采集于
发布日期Google Developers Blog ↗2026-08-21已核实
架构 / 规模Google Developers Blog ↗2026-08-21已核实
上下文窗口Google Developers Blog ↗2026-08-21已核实
训练 tokenGoogle Developers Blog ↗2026-08-21已核实
输入 / 输出模态Google Developers Blog ↗2026-08-21已核实
许可ai.google.dev ↗2026-08-21已核实
MMLU Proai.google.dev ↗2026-08-21已核实
HumanEvalai.google.dev ↗2026-08-21已核实
GSM8Kai.google.dev ↗2026-08-21已核实
Google 发布 Gemma 3,加入多模态与 128K 上下文Google Developers Blog ↗2026-08-21已核实
帮助与联系