Назад к моделям

Gemma 3 4B

googlegoogle/gemma-3-4b

Google's smallest Gemma 3 model at 4B parameters. Lightweight chat, copilots, coding and reasoning, cost-effective fine-tuned vertical assistants.

Gemma 3 4B — компактная модель в открытом семействе Google Gemma 3, анонсированная 12 марта 2025 года. Это 4-миллиардная vision-language модель с вводом изображений и текста, текстовым выводом, контекстом 128K токенов и instruction-tuned вариантом для диалогового использования. Google позиционировала Gemma 3 как своё самое мощное открытое семейство на момент запуска: длинный контекст, мультимодальность, function calling, structured outputs и поддержка более 140 языков.

Для TheRouter Gemma 3 4B — практичный open-weight выбор, когда команде нужны понимание изображений и многоязычный чат дешевле и быстрее, чем более крупные Gemma или frontier hosted модели. Она шире крошечных text-only моделей для document QA, визуальной проверки, извлечения данных и обычных ассистентских задач, и является практичным размером Gemma 3, когда важен deployment footprint. Её не стоит считать заменой Gemini: лучший сценарий — контролируемые задачи низкой и средней сложности, где важнее предсказуемая цена и переносимость открытых весов, чем максимум reasoning.

Когда выбирать
  • • Vision-language извлечение, проверка и image-grounded поддержка, где нужна 4B open-weight модель вместо proprietary frontier модели
  • • Многоязычные ассистенты и content workflows, где важна поддержка 140+ языков и переносимость модели
  • • Экономичные document QA и extraction с длинным, но ограниченным контекстом, особенно когда 128K токенов достаточно
  • • Команды, оценивающие open-weight deployment перед выбором self-hosting, fine-tuning или managed API route
Когда не выбирать
  • • Frontier reasoning, autonomous coding или сложная математика, где Gemini 2.5 Pro, модели класса Gemini 3, Claude или GPT-5.5 имеют намного более высокий потолок
  • • Сверхдешёвая маршрутизация, классификация или extraction, где меньшие Gemma, Llama или Qwen модели могут достичь качества с меньшей задержкой
  • • Нативная генерация изображений, аудио или видео — Gemma 3 4B понимает изображения, но выводит текст; используйте специализированную generation модель

Чем обслуживание в TheRouter отличается от вендорского

Как её эксплуатирует вендор

Google публикует Gemma 3 4B как open weights для self-hosting, fine-tuning и deployment на локальном железе, Hugging Face, Kaggle, Google AI Studio, Vertex AI и других runtimes.

На TheRouter

TheRouter обслуживает её как managed OpenAI-compatible chat-completions route с вводом текста/изображений и текстовым выводом; страница не заявляет local weight download, fine-tuning или vendor-native runtime controls на live request path TheRouter.

Размер контекста
128K
Максимальный вывод
8K
Цена Входза 1M токенов
$0.0432за 1 млн токенов
Цена Выходза 1M токенов
$0.0864за 1 млн токенов

Модальности

ТекстИзображение→Текст

Возможности

Зрение

Разбивка цен

ТипСтавка
Вход$0.0432 за 1 млн токенов
Выход$0.0864 за 1 млн токенов

Поддерживаемые параметры

temperaturemax_tokenstop_pstop

Характеристики

Дата релиза2025-03-12Google Developers Blog ↗проверено
Архитектура / размерПлотный transformer, 4 млрд параметровGoogle Developers Blog ↗проверено
Контекстное окноДо 128K токеновGoogle Developers Blog ↗проверено
Токены обучения4T токенов для модели 4BGoogle Developers Blog ↗проверено
Модальности ввода / выводаТекст и изображения на входе; текст на выходеGoogle Developers Blog ↗проверено
ЛицензияУсловия использования Gemmaai.google.dev ↗проверено

Бенчмарки

BenchmarkDistributionScoreSource
MMLU Pro
Gemma 3 IT 4B, 0-shot, согласно карточке модели Google Gemma 3
44.9%ai.google.dev ↗
HumanEval
Gemma 3 IT 4B, 0-shot, benchmark генерации кода из official model card
54.3%ai.google.dev ↗
GSM8K
Gemma 3 IT 4B, 0-shot, benchmark школьной математики из official model card
75.6%ai.google.dev ↗

Примеры API

Для новых интеграций используйте глобальный endpoint api.therouter.ai из примеров ниже; старый China accelerated endpoint выведен из эксплуатации.

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "google/gemma-3-4b",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

Chat completion

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "google/gemma-3-4b",
    "messages": [{"role": "user", "content": "Explain adaptive image tiling in two paragraphs."}]
  }'

Ещё от google

Похожие модели

Аналоги в других провайдерах

Новости и изменения

2025-03-12

Google представила Gemma 3 с мультимодальностью и контекстом 128K

Launch post Google описывает Gemma 3 как open-model семейство из четырёх размеров — 1B, 4B, 12B и 27B — с вводом изображений и текста, текстовым выводом, structured outputs, function calling и поддержкой более 140 языков.

переработано TheRouterGoogle Developers Blog ↗

Частые вопросы

Подходит ли Gemma 3 4B как default модель для production chat?

Используйте её, когда важны open weights, visual input и предсказуемая цена. Для максимального reasoning quality, более длинного контекста или managed Google-native tools выбирайте Gemini route.

Gemma 3 4B генерирует изображения?

Нет. Gemma 3 4B — vision-language модель: она читает изображения и возвращает текст. Для генерации используйте dedicated image model.

Чем обслуживание TheRouter отличается от open-weight релиза Google?

Релиз Google позволяет скачивать и запускать веса в разных средах. TheRouter предоставляет managed OpenAI-compatible API route, поэтому интеграция проще, но local runtime и fine-tuning controls находятся вне этого route.

Проверены ли API snippets?

Нет. У этого curator run нет бюджета на paid API, поэтому snippet verification остаётся неподтверждённой до human approval и оплаты verification run.

Реестр фактов — каждая утверждаемая величина имеет источник
источникURLполучено
Дата релизаGoogle Developers Blog ↗2026-08-21проверено
Архитектура / размерGoogle Developers Blog ↗2026-08-21проверено
Контекстное окноGoogle Developers Blog ↗2026-08-21проверено
Токены обученияGoogle Developers Blog ↗2026-08-21проверено
Модальности ввода / выводаGoogle Developers Blog ↗2026-08-21проверено
Лицензияai.google.dev ↗2026-08-21проверено
MMLU Proai.google.dev ↗2026-08-21проверено
HumanEvalai.google.dev ↗2026-08-21проверено
GSM8Kai.google.dev ↗2026-08-21проверено
Google представила Gemma 3 с мультимодальностью и контекстом 128KGoogle Developers Blog ↗2026-08-21проверено
Помощь и контакты