Google 发布 Gemma 3,加入多模态与 128K 上下文
Google 发布文将 Gemma 3 描述为包含 1B、4B、12B、27B 四种规模的开放模型家族,支持图像和文本输入、文本输出、结构化输出、函数调用,以及 140 多种语言。
Google's smallest Gemma 3 model at 4B parameters. Lightweight chat, copilots, coding and reasoning, cost-effective fine-tuned vertical assistants.
Gemma 3 4B 是 Google Gemma 3 开放模型家族的紧凑规模成员,于 2025 年 3 月 12 日发布。它是 40 亿参数视觉语言模型,支持图像和文本输入、文本输出、128K token 上下文窗口,并提供面向对话使用的指令微调版本。Google 将 Gemma 3 定位为当时能力最强的 Gemma 开放模型家族,重点升级了长上下文、多模态、函数调用、结构化输出,以及 140 多种语言覆盖。
在 TheRouter 上,Gemma 3 4B 适合需要图像理解和多语言对话、但希望比更大的 Gemma 或前沿托管模型成本和延迟更低的团队。它比极小文本模型更完整地覆盖文档问答、视觉检查、抽取和通用助手工作负载,也是部署占用敏感时更实际的 Gemma 3 尺寸。它不应被当作 Gemini 的替代品:最合适的是低到中等复杂度、需要成本可控和开放权重可迁移性的任务,而不是追求最高推理上限的任务。
Google 以开放权重形式发布 Gemma 3 4B,可用于自托管、微调,并部署到本地硬件、Hugging Face、Kaggle、Google AI Studio、Vertex AI 等运行环境。
TheRouter 将其作为托管的 OpenAI 兼容 chat-completions 路由提供,支持文本/图像输入与文本输出;本页不声称 TheRouter 实时请求路径提供本地权重下载、微调或厂商原生运行时控制。
| 类型 | 费率 |
|---|---|
| 输入 | $0.0432 每百万 Tokens |
| 输出 | $0.0864 每百万 Tokens |
| 发布日期 | 2025-03-12Google Developers Blog ↗ | 已核实 |
| 架构 / 规模 | 稠密 Transformer,40 亿参数Google Developers Blog ↗ | 已核实 |
| 上下文窗口 | 最高 128K tokenGoogle Developers Blog ↗ | 已核实 |
| 训练 token | 4B 模型使用 4T token 训练Google Developers Blog ↗ | 已核实 |
| 输入 / 输出模态 | 文本和图像输入;文本输出Google Developers Blog ↗ | 已核实 |
| 许可 | Gemma 使用条款ai.google.dev ↗ | 已核实 |
| Benchmark | Distribution | Score | Source |
|---|---|---|---|
MMLU Pro Gemma 3 IT 4B,0-shot,来自 Google Gemma 3 模型卡 | 44.9% | ai.google.dev ↗ | |
HumanEval Gemma 3 IT 4B,0-shot,官方模型卡中的代码生成基准 | 54.3% | ai.google.dev ↗ | |
GSM8K Gemma 3 IT 4B,0-shot,官方模型卡中的小学数学基准 | 75.6% | ai.google.dev ↗ |
所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。
curl https://api.therouter.ai/v1/chat/completions -H "Content-Type: application/json" -H "Authorization: Bearer $THE_ROUTER_API_KEY" -d '{
"model": "google/gemma-3-4b",
"messages": [
{"role": "user", "content": "Summarize the key points from this input."}
]
}'curl https://api.therouter.ai/v1/chat/completions \
-H "Authorization: Bearer $THEROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "google/gemma-3-4b",
"messages": [{"role": "user", "content": "Explain adaptive image tiling in two paragraphs."}]
}'Google 发布文将 Gemma 3 描述为包含 1B、4B、12B、27B 四种规模的开放模型家族,支持图像和文本输入、文本输出、结构化输出、函数调用,以及 140 多种语言。
当开放权重、视觉输入和成本可预测性重要时适合使用。若需要最高推理质量、更长上下文或 Google 原生托管工具,应选择 Gemini 路由。
不能。Gemma 3 4B 是视觉语言模型,可以读取图像输入并返回文本。图像生成应使用专用图像模型。
Google 的发布允许团队下载权重并在多种环境运行。TheRouter 暴露的是托管 OpenAI 兼容 API 路由,集成更简单,但本地运行时和微调控制不属于该路由。
没有。本次 curator 运行没有付费 API 预算,因此在人工操作员批准并支付验证运行前,代码片段仍未被证明。
| 来源 | URL | 采集于 | |
|---|---|---|---|
| 发布日期 | Google Developers Blog ↗ | 2026-08-21 | 已核实 |
| 架构 / 规模 | Google Developers Blog ↗ | 2026-08-21 | 已核实 |
| 上下文窗口 | Google Developers Blog ↗ | 2026-08-21 | 已核实 |
| 训练 token | Google Developers Blog ↗ | 2026-08-21 | 已核实 |
| 输入 / 输出模态 | Google Developers Blog ↗ | 2026-08-21 | 已核实 |
| 许可 | ai.google.dev ↗ | 2026-08-21 | 已核实 |
| MMLU Pro | ai.google.dev ↗ | 2026-08-21 | 已核实 |
| HumanEval | ai.google.dev ↗ | 2026-08-21 | 已核实 |
| GSM8K | ai.google.dev ↗ | 2026-08-21 | 已核实 |
| Google 发布 Gemma 3,加入多模态与 128K 上下文 | Google Developers Blog ↗ | 2026-08-21 | 已核实 |