返回模型列表

Gemma 4 26B A4B IT

googlegoogle/gemma-4-26b-a4b-it

Google's Gemma 4 26B Mixture-of-Experts instruction-tuned model with 4B active parameters per token — open weights under Apache 2.0. Ranks #6 on the open Arena leaderboard. Multimodal text + image input. (Renamed from gemma-4-26b-moe to match official upstream ID gemma-4-26b-a4b-it.)

Gemma 4 26B A4B IT 是 Google DeepMind Gemma 4 开放模型家族中的混合专家成员。官方 Gemma 4 模型卡将其描述为总参数 26B、每 token 约 4B 活跃参数的模型,支持文本和图像输入、文本输出、thinking 模式、原生函数调用、system role,以及最高 256K token 上下文窗口。Google 以 Apache 2.0 许可发布 Gemma 4 开放权重,并覆盖 E2B、E4B、12B、26B A4B、31B 多个尺寸的预训练和指令微调版本。

在 TheRouter 上,Gemma 4 26B A4B IT 适合需要多模态理解、agentic/函数调用覆盖,以及比 E 系列小模型更高基准余量、但不想直接使用专有前沿模型的团队。它不应被当作 Gemini 替代品:更合适的是生产聊天、基于图片的支持、文档/PDF 解析、代码和推理任务,其中开放权重可迁移性与可预测路由比绝对前沿上限更重要。

适合使用
  • • 需要 26B MoE 开放权重模型而非专有前沿模型的视觉语言抽取、检查和基于图片的客服流程
  • • 多语言助手和内容工作流:需要 140+ 语言覆盖,同时把模型可迁移性作为采购条件
  • • 成本敏感的文档问答和抽取,适合长但边界明确、256K token 足够的上下文
  • • 正在评估开放权重部署路径的团队,用于决定自托管、微调,还是继续使用托管 API 路由
不适合使用
  • • 前沿推理、自主编码或高难数学:Gemini 2.5 Pro、Gemini 3 系列、Claude 或 GPT-5.5 级模型上限更高
  • • 极低成本路由、分类或抽取:更小的 Gemma、Llama 或 Qwen 模型可能以更低延迟达到质量目标
  • • 原生图像、音频或视频生成——Gemma 4 26B A4B IT 可理解图像但输出文本,应使用专用生成模型

供应商自营与 TheRouter 服务形态的差异

供应商自己运营时

Google 以开放权重形式发布 Gemma 4 26B A4B IT,可用于自托管、微调,并部署到本地硬件、Hugging Face、Kaggle、Google AI Studio、Vertex AI 等运行环境。

在 TheRouter 上

TheRouter 将其作为托管的 OpenAI 兼容 chat-completions 路由提供,支持文本/图像输入与文本输出;本页不声称 TheRouter 实时请求路径提供本地权重下载、微调或厂商原生运行时控制。

上下文长度
128K
最大输出
8K
输入价格每百万 tokens
$0.162每百万 Tokens
输出价格每百万 tokens
$0.648每百万 Tokens

模态能力

文本图像→文本

能力

视觉理解

价格明细

类型费率
输入$0.162 每百万 Tokens
输出$0.648 每百万 Tokens

支持参数

temperaturemax_tokenstop_pstop

模型规格

发布日期2026-07-08Google AI for Developers ↗已核实
架构 / 规模混合专家 Transformer,总参数 26B,每 token 4B 活跃参数Google AI for Developers ↗已核实
上下文窗口最高 256K tokenGoogle AI for Developers ↗已核实
训练 token26B A4B 模型训练 token 未公开披露Google AI for Developers ↗未知
输入 / 输出模态文本和图像输入;文本输出Google AI for Developers ↗已核实
许可Gemma 使用条款ai.google.dev ↗已核实

基准成绩

BenchmarkDistributionScoreSource
MMLU Pro
Gemma 4 26B A4B,0-shot,来自 Google Gemma 4 模型卡
82.6%ai.google.dev ↗
LiveCodeBench v6
Gemma 4 26B A4B,0-shot,官方模型卡中的代码生成基准
77.1%ai.google.dev ↗
AIME 2026 no tools
Gemma 4 26B A4B,0-shot,官方模型卡中的竞赛数学基准
88.3%ai.google.dev ↗

API 使用示例

所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "google/gemma-4-26b-a4b-it",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

API 使用指南

完整 API 参考 →

Chat 调用

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "google/gemma-4-26b-a4b-it",
    "messages": [{"role": "user", "content": "Explain adaptive image tiling in two paragraphs."}]
  }'

google 其他模型

同类模型

跨供应商的相似能力档位

动态与变更

2026-07-08

Google 文档化 Gemma 4,包含 MoE、thinking 与 256K 上下文

Google 发布文将 Gemma 4 描述为包含 E2B、E4B、12B、26B A4B、31B 五种规模的开放模型家族;其中 26B A4B 是混合专家模型,每 token 约 4B 活跃参数,支持图像和文本输入、文本输出、thinking、函数调用,以及最高 256K 上下文。

TheRouter 编辑重写Google AI for Developers ↗

常见问题

Gemma 4 26B A4B IT 适合作为生产聊天默认模型吗?

当开放权重、视觉输入和成本可预测性重要时适合使用。若需要最高推理质量、更长上下文或 Google 原生托管工具,应选择 Gemini 路由。

Gemma 4 26B A4B IT 能生成图像吗?

不能。Gemma 4 26B A4B IT 是视觉语言模型,可以读取图像输入并返回文本。图像生成应使用专用图像模型。

TheRouter 的服务方式与 Google 开放权重发布有什么不同?

Google 的发布允许团队下载权重并在多种环境运行。TheRouter 暴露的是托管 OpenAI 兼容 API 路由,集成更简单,但本地运行时和微调控制不属于该路由。

这些 API 代码片段已经验证了吗?

没有。本次 curator 运行没有付费 API 预算,因此在人工操作员批准并支付验证运行前,代码片段仍未被证明。

事实档案 — 本页每条断言可在此回溯来源
来源URL采集于
发布日期Google AI for Developers ↗2026-08-22已核实
架构 / 规模Google AI for Developers ↗2026-08-22已核实
上下文窗口Google AI for Developers ↗2026-08-22已核实
训练 tokenGoogle AI for Developers ↗2026-08-22未知
输入 / 输出模态Google AI for Developers ↗2026-08-22已核实
许可ai.google.dev ↗2026-08-22已核实
MMLU Proai.google.dev ↗2026-08-22已核实
LiveCodeBench v6ai.google.dev ↗2026-08-22已核实
AIME 2026 no toolsai.google.dev ↗2026-08-22已核实
Google 文档化 Gemma 4,包含 MoE、thinking 与 256K 上下文Google AI for Developers ↗2026-08-22已核实
帮助与联系