Назад к моделям

Gemma 4 26B A4B IT

googlegoogle/gemma-4-26b-a4b-it

Google's Gemma 4 26B Mixture-of-Experts instruction-tuned model with 4B active parameters per token — open weights under Apache 2.0. Ranks #6 on the open Arena leaderboard. Multimodal text + image input. (Renamed from gemma-4-26b-moe to match official upstream ID gemma-4-26b-a4b-it.)

Gemma 4 26B A4B IT — mixture-of-experts модель Google DeepMind в открытом семействе Gemma 4. Официальная карточка Gemma 4 описывает её как модель с 26B total parameters и примерно 4B active parameters на токен, вводом текста и изображений, текстовым выводом, thinking modes, native function calling, поддержкой system role и контекстом до 256K токенов. Google публикует Gemma 4 как open weights под Apache 2.0, с pre-trained и instruction-tuned вариантами размеров E2B, E4B, 12B, 26B A4B и 31B.

Для TheRouter Gemma 4 26B A4B IT — эффективный high-throughput маршрут Gemma 4, когда нужны multimodal understanding, agentic/function-calling покрытие и больший benchmark headroom, чем у малых E-series моделей, без перехода на proprietary frontier модель. Её не стоит считать заменой Gemini: лучший сценарий — production chat, image-grounded support, document/PDF parsing, coding и reasoning задачи, где open-weight portability и предсказуемая маршрутизация важнее абсолютного frontier ceiling.

Когда выбирать
  • • Vision-language извлечение, проверка и image-grounded поддержка, где нужна 26B MoE open-weight модель вместо proprietary frontier модели
  • • Многоязычные ассистенты и content workflows, где важна поддержка 140+ языков и переносимость модели
  • • Экономичные document QA и extraction с длинным, но ограниченным контекстом, особенно когда 256K токенов достаточно
  • • Команды, оценивающие open-weight deployment перед выбором self-hosting, fine-tuning или managed API route
Когда не выбирать
  • • Frontier reasoning, autonomous coding или сложная математика, где Gemini 2.5 Pro, модели класса Gemini 3, Claude или GPT-5.5 имеют намного более высокий потолок
  • • Сверхдешёвая маршрутизация, классификация или extraction, где меньшие Gemma, Llama или Qwen модели могут достичь качества с меньшей задержкой
  • • Нативная генерация изображений, аудио или видео — Gemma 4 26B A4B IT понимает изображения, но выводит текст; используйте специализированную generation модель

Чем обслуживание в TheRouter отличается от вендорского

Как её эксплуатирует вендор

Google публикует Gemma 4 26B A4B IT как open weights для self-hosting, fine-tuning и deployment на локальном железе, Hugging Face, Kaggle, Google AI Studio, Vertex AI и других runtimes.

На TheRouter

TheRouter обслуживает её как managed OpenAI-compatible chat-completions route с вводом текста/изображений и текстовым выводом; страница не заявляет local weight download, fine-tuning или vendor-native runtime controls на live request path TheRouter.

Размер контекста
128K
Максимальный вывод
8K
Цена Входза 1M токенов
$0.162за 1 млн токенов
Цена Выходза 1M токенов
$0.648за 1 млн токенов

Модальности

ТекстИзображение→Текст

Возможности

Зрение

Разбивка цен

ТипСтавка
Вход$0.162 за 1 млн токенов
Выход$0.648 за 1 млн токенов

Поддерживаемые параметры

temperaturemax_tokenstop_pstop

Характеристики

Дата релиза2026-07-08Google AI for Developers ↗проверено
Архитектура / размерMixture-of-Experts transformer, 26B total parameters, 4B active parameters на токенGoogle AI for Developers ↗проверено
Контекстное окноДо 256K токеновGoogle AI for Developers ↗проверено
Токены обученияНе раскрыто для модели 26B A4BGoogle AI for Developers ↗неизвестно
Модальности ввода / выводаТекст и изображения на входе; текст на выходеGoogle AI for Developers ↗проверено
ЛицензияУсловия использования Gemmaai.google.dev ↗проверено

Бенчмарки

BenchmarkDistributionScoreSource
MMLU Pro
Gemma 4 26B A4B, 0-shot, согласно карточке модели Google Gemma 4
82.6%ai.google.dev ↗
LiveCodeBench v6
Gemma 4 26B A4B, 0-shot, benchmark генерации кода из official model card
77.1%ai.google.dev ↗
AIME 2026 no tools
Gemma 4 26B A4B, 0-shot, benchmark олимпиадной математики из official model card
88.3%ai.google.dev ↗

Примеры API

Для новых интеграций используйте глобальный endpoint api.therouter.ai из примеров ниже; старый China accelerated endpoint выведен из эксплуатации.

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "google/gemma-4-26b-a4b-it",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

Chat completion

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "google/gemma-4-26b-a4b-it",
    "messages": [{"role": "user", "content": "Explain adaptive image tiling in two paragraphs."}]
  }'

Ещё от google

Похожие модели

Аналоги в других провайдерах

Новости и изменения

2026-07-08

Google описывает Gemma 4 с MoE, thinking и контекстом 256K

Launch post Google описывает Gemma 4 как open-model семейство из пяти размеров — E2B, E4B, 12B, 26B A4B и 31B; 26B A4B является mixture-of-experts вариантом с примерно 4B active parameters на токен, вводом изображений и текста, текстовым выводом, thinking, function calling и контекстом до 256K.

переработано TheRouterGoogle AI for Developers ↗

Частые вопросы

Подходит ли Gemma 4 26B A4B IT как default модель для production chat?

Используйте её, когда важны open weights, visual input и предсказуемая цена. Для максимального reasoning quality, более длинного контекста или managed Google-native tools выбирайте Gemini route.

Gemma 4 26B A4B IT генерирует изображения?

Нет. Gemma 4 26B A4B IT — vision-language модель: она читает изображения и возвращает текст. Для генерации используйте dedicated image model.

Чем обслуживание TheRouter отличается от open-weight релиза Google?

Релиз Google позволяет скачивать и запускать веса в разных средах. TheRouter предоставляет managed OpenAI-compatible API route, поэтому интеграция проще, но local runtime и fine-tuning controls находятся вне этого route.

Проверены ли API snippets?

Нет. У этого curator run нет бюджета на paid API, поэтому snippet verification остаётся неподтверждённой до human approval и оплаты verification run.

Реестр фактов — каждая утверждаемая величина имеет источник
источникURLполучено
Дата релизаGoogle AI for Developers ↗2026-08-22проверено
Архитектура / размерGoogle AI for Developers ↗2026-08-22проверено
Контекстное окноGoogle AI for Developers ↗2026-08-22проверено
Токены обученияGoogle AI for Developers ↗2026-08-22неизвестно
Модальности ввода / выводаGoogle AI for Developers ↗2026-08-22проверено
Лицензияai.google.dev ↗2026-08-22проверено
MMLU Proai.google.dev ↗2026-08-22проверено
LiveCodeBench v6ai.google.dev ↗2026-08-22проверено
AIME 2026 no toolsai.google.dev ↗2026-08-22проверено
Google описывает Gemma 4 с MoE, thinking и контекстом 256KGoogle AI for Developers ↗2026-08-22проверено
Помощь и контакты