Назад к моделям

Qwen3 32B

qwenqwen/qwen3-32b

Гид по API

Chat completion

Стандартные OpenAI-совместимые chat completions. Опустите reasoning для non-thinking (быстрого) режима; установите reasoning: {} или бюджет для thinking mode.

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3-32b",
    "messages": [
      {"role": "user", "content": "Explain the tradeoffs between dense and MoE architectures for inference."}
    ],
    "temperature": 0.7,
    "max_tokens": 2048
  }'

Thinking mode

Включите deep chain-of-thought reasoning через параметр reasoning. Модель генерирует блок <think>…</think> перед финальным ответом — разберите или уберите его до показа пользователям.

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3-32b",
    "messages": [
      {"role": "user", "content": "Prove that the sum of two odd numbers is even."}
    ],
    "reasoning": {},
    "temperature": 0.6,
    "max_tokens": 8192
  }'

Стриминг

Стримьте ответы для интерактивных UI. Thinking mode сначала стримит блок <think>, затем ответ — обрабатывайте оба сегмента в цикле чтения.

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3-32b",
    "messages": [{"role": "user", "content": "Summarize the key points of the Qwen3 technical report."}],
    "stream": true
  }'

Tool calling

Qwen3-32B поддерживает tools в обоих режимах — thinking и non-thinking — полезно для agentic пайплайнов с reasoning traces рядом с выполнением инструментов.

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3-32b",
    "messages": [{"role": "user", "content": "What is the weather in Shanghai right now?"}],
    "tools": [{
      "type": "function",
      "function": {
        "name": "get_weather",
        "description": "Get current weather for a location",
        "parameters": {
          "type": "object",
          "properties": {
            "location": {"type": "string", "description": "City name"}
          },
          "required": ["location"]
        }
      }
    }],
    "tool_choice": "auto"
  }'

JSON-режим

JSON mode для структурированного извлечения, классификационных пайплайнов и RAG-ранжирования с machine-readable выводом.

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3-32b",
    "messages": [
      {"role": "system", "content": "Return only JSON with keys: summary, sentiment, keywords."},
      {"role": "user", "content": "Analyze this product review: The battery life is amazing but the screen is dim."}
    ],
    "response_format": {"type": "json_object"}
  }'
Реестр фактов — каждая утверждаемая величина имеет источник
источникURLполучено
Архитектураhuggingface.co ↗2026-06-08проверено
Параметрыhuggingface.co ↗2026-06-08проверено
Слоиhuggingface.co ↗2026-06-08проверено
Головы внимания (GQA)huggingface.co ↗2026-06-08проверено
Нативный контекстhuggingface.co ↗2026-06-08проверено
Режим мышленияhuggingface.co ↗2026-06-08проверено
Поддерживаемые языкиqwenlm.github.io ↗2026-06-08проверено
Лицензияhuggingface.co ↗2026-06-08проверено
Данные предобученияqwenlm.github.io ↗2026-06-08проверено
AIME 2024qwenlm.github.io ↗2026-06-08проверено
MATH-500qwenlm.github.io ↗2026-06-08проверено
LiveCodeBenchqwenlm.github.io ↗2026-06-08проверено
BFCL (Berkeley Function-Calling Leaderboard)qwenlm.github.io ↗2026-06-08проверено
MMLU-Proqwenlm.github.io ↗2026-06-08проверено
C-Evalqwenlm.github.io ↗2026-06-08проверено
Qwen3 выпускает dense 32B open-weight model с hybrid thinking modesQwen3 announcement ↗2026-06-08проверено
Помощь и контакты