Google 文档化 Gemma 4,包含 MoE、thinking 与 256K 上下文
Google 发布文将 Gemma 4 描述为包含 E2B、E4B、12B、26B A4B、31B 五种规模的开放模型家族;其中 26B A4B 是混合专家模型,每 token 约 4B 活跃参数,支持图像和文本输入、文本输出、thinking、函数调用,以及最高 256K 上下文。
Google's Gemma 4 26B Mixture-of-Experts instruction-tuned model with 4B active parameters per token — open weights under Apache 2.0. Ranks #6 on the open Arena leaderboard. Multimodal text + image input. (Renamed from gemma-4-26b-moe to match official upstream ID gemma-4-26b-a4b-it.)
Gemma 4 26B A4B IT 是 Google DeepMind Gemma 4 开放模型家族中的混合专家成员。官方 Gemma 4 模型卡将其描述为总参数 26B、每 token 约 4B 活跃参数的模型,支持文本和图像输入、文本输出、thinking 模式、原生函数调用、system role,以及最高 256K token 上下文窗口。Google 以 Apache 2.0 许可发布 Gemma 4 开放权重,并覆盖 E2B、E4B、12B、26B A4B、31B 多个尺寸的预训练和指令微调版本。
在 TheRouter 上,Gemma 4 26B A4B IT 适合需要多模态理解、agentic/函数调用覆盖,以及比 E 系列小模型更高基准余量、但不想直接使用专有前沿模型的团队。它不应被当作 Gemini 替代品:更合适的是生产聊天、基于图片的支持、文档/PDF 解析、代码和推理任务,其中开放权重可迁移性与可预测路由比绝对前沿上限更重要。
Google 以开放权重形式发布 Gemma 4 26B A4B IT,可用于自托管、微调,并部署到本地硬件、Hugging Face、Kaggle、Google AI Studio、Vertex AI 等运行环境。
TheRouter 将其作为托管的 OpenAI 兼容 chat-completions 路由提供,支持文本/图像输入与文本输出;本页不声称 TheRouter 实时请求路径提供本地权重下载、微调或厂商原生运行时控制。
| 类型 | 费率 |
|---|---|
| 输入 | $0.162 每百万 Tokens |
| 输出 | $0.648 每百万 Tokens |
| 发布日期 | 2026-07-08Google AI for Developers ↗ | 已核实 |
| 架构 / 规模 | 混合专家 Transformer,总参数 26B,每 token 4B 活跃参数Google AI for Developers ↗ | 已核实 |
| 上下文窗口 | 最高 256K tokenGoogle AI for Developers ↗ | 已核实 |
| 训练 token | 26B A4B 模型训练 token 未公开披露Google AI for Developers ↗ | 未知 |
| 输入 / 输出模态 | 文本和图像输入;文本输出Google AI for Developers ↗ | 已核实 |
| 许可 | Gemma 使用条款ai.google.dev ↗ | 已核实 |
| Benchmark | Distribution | Score | Source |
|---|---|---|---|
MMLU Pro Gemma 4 26B A4B,0-shot,来自 Google Gemma 4 模型卡 | 82.6% | ai.google.dev ↗ | |
LiveCodeBench v6 Gemma 4 26B A4B,0-shot,官方模型卡中的代码生成基准 | 77.1% | ai.google.dev ↗ | |
AIME 2026 no tools Gemma 4 26B A4B,0-shot,官方模型卡中的竞赛数学基准 | 88.3% | ai.google.dev ↗ |
所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。
curl https://api.therouter.ai/v1/chat/completions -H "Content-Type: application/json" -H "Authorization: Bearer $THE_ROUTER_API_KEY" -d '{
"model": "google/gemma-4-26b-a4b-it",
"messages": [
{"role": "user", "content": "Summarize the key points from this input."}
]
}'curl https://api.therouter.ai/v1/chat/completions \
-H "Authorization: Bearer $THEROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "google/gemma-4-26b-a4b-it",
"messages": [{"role": "user", "content": "Explain adaptive image tiling in two paragraphs."}]
}'Google 发布文将 Gemma 4 描述为包含 E2B、E4B、12B、26B A4B、31B 五种规模的开放模型家族;其中 26B A4B 是混合专家模型,每 token 约 4B 活跃参数,支持图像和文本输入、文本输出、thinking、函数调用,以及最高 256K 上下文。
当开放权重、视觉输入和成本可预测性重要时适合使用。若需要最高推理质量、更长上下文或 Google 原生托管工具,应选择 Gemini 路由。
不能。Gemma 4 26B A4B IT 是视觉语言模型,可以读取图像输入并返回文本。图像生成应使用专用图像模型。
Google 的发布允许团队下载权重并在多种环境运行。TheRouter 暴露的是托管 OpenAI 兼容 API 路由,集成更简单,但本地运行时和微调控制不属于该路由。
没有。本次 curator 运行没有付费 API 预算,因此在人工操作员批准并支付验证运行前,代码片段仍未被证明。
| 来源 | URL | 采集于 | |
|---|---|---|---|
| 发布日期 | Google AI for Developers ↗ | 2026-08-22 | 已核实 |
| 架构 / 规模 | Google AI for Developers ↗ | 2026-08-22 | 已核实 |
| 上下文窗口 | Google AI for Developers ↗ | 2026-08-22 | 已核实 |
| 训练 token | Google AI for Developers ↗ | 2026-08-22 | 未知 |
| 输入 / 输出模态 | Google AI for Developers ↗ | 2026-08-22 | 已核实 |
| 许可 | ai.google.dev ↗ | 2026-08-22 | 已核实 |
| MMLU Pro | ai.google.dev ↗ | 2026-08-22 | 已核实 |
| LiveCodeBench v6 | ai.google.dev ↗ | 2026-08-22 | 已核实 |
| AIME 2026 no tools | ai.google.dev ↗ | 2026-08-22 | 已核实 |
| Google 文档化 Gemma 4,包含 MoE、thinking 与 256K 上下文 | Google AI for Developers ↗ | 2026-08-22 | 已核实 |