Руководство по интеграции Step 5 Preview API: флагманская агентная модель StepFun на 600B через DashScope и TheRouter
Step 5 Preview объединяет 600B параметров MoE с активацией 27B на токен, контекстным окном в 1M токенов и поддержкой видео, а стоимость вывода составляет $2.70 за миллион токенов — включая рассуждения. В этом руководстве рассмотрены настройка API, доступ через DashScope, сравнение цен, позиционирование на бенчмарках и маршрутизация Step 5 Preview через TheRouter.
StepFun выпустила Step 5 Preview 20 сентября 2026 года, и одна только цена заслуживает внимания. При $2.70 за миллион выходных токенов — рассуждения включены — модель обходит всех конкурентов своего бенчмарк-класса с большим отрывом. Kimi K3 берёт $15.00 за ту же единицу вывода. GPT-6 Astra и Claude Opus 5 стоят ещё дороже. Step 5 Preview не догоняет эти frontier-модели по каждой строке бенчмарков, но разрыв достаточно мал, а разница в цене достаточно велика, чтобы присмотреться внимательнее.
Архитектура — sparse mixture of experts: 600B общих параметров, из которых на каждый токен активируются только 27B. Модель принимает текст, изображения и видео, предоставляет контекстное окно в 1M токенов с лимитом вывода до 64K токенов. В комплекте tool calling, JSON Schema output и три уровня reasoning effort. API совместим с форматом OpenAI, модель доступна на платформе StepFun и через DashScope.
Это первый материал о StepFun в блоге TheRouter. Ниже — полный путь интеграции.
OpenAI-совместимость означает, что провайдер предоставляет endpoint chat-completions, чей контракт запроса и ответа достаточно близок к API OpenAI, чтобы немодифицированный вызов OpenAI SDK работал после замены трёх значений: API key, base URL, название модели. Минимальная поверхность на практике —POST /v1/chat/completions с messages, model и потоковым ответом в форме OpenAI.
Быстрый старт: Step 5 Preview за 3 минуты
Шаг 1 — Получите API-ключ. Зарегистрируйтесь на platform.stepfun.com и сгенерируйте API-ключ в консоли разработчика.
Шаг 2 — Установите OpenAI SDK:
pip install --upgrade openai
Шаг 3 — Отправьте первый запрос к Step 5 Preview:
from openai import OpenAI
client = OpenAI(
api_key="your-stepfun-api-key",
base_url="https://api.stepfun.com/v1",
)
response = client.chat.completions.create(
model="step-5-preview",
messages=[
{"role": "user", "content": "Объясни архитектуру MoE в Step 5 Preview."}
],
)
print(response.choices[0].message.content)
Endpoint следует формату OpenAI Chat Completions. Если ваш код уже работает с OpenAI, изменения сводятся к base_url и api_key.
Что такое Step 5 Preview
Step 5 Preview — флагманская фундаментальная модель StepFun для агентной разработки ПО и профессиональной аналитики. Архитектура жертвует общим числом параметров ради эффективности инференса.
| Характеристика | Значение |
|---|---|
| Архитектура | Sparse MoE, 600B всего, 27B активных на токен |
| Контекстное окно | 1M токенов вход, 64K токенов максимум на выходе |
| Входные модальности | Текст, изображения (до 60 на запрос), видео (MP4, QuickTime, Matroska) |
| Reasoning effort | Три уровня (low, medium, high), задаётся для каждого запроса |
| Функции | Tool calling, streaming, JSON Mode, JSON Schema, prompt caching |
| Model ID | step-5-preview |
| Открытые веса | Запланированы на 15 октября 2026 года |
| Скорость вывода | 73.9 токенов/с (измерение Artificial Analysis, endpoint StepFun) |
27B активных параметров — минимальное значение среди всех моделей, с которыми StepFun сравнивает свою новинку. Для контекста: Kimi K3 активирует 104B из 2.8T, DeepSeek V4.1 Flash активирует 8B–16B из 552B. Step 5 Preview находится между ними по активному размеру, но значительно ниже K3 по стоимости вывода.
Цены
Выходные токены включают reasoning-токены, поэтому $2.70 покрывают полную цепочку рассуждений.
| Тип токенов | Цена за 1M токенов |
|---|---|
| Вход (cache miss) | $1.00 |
| Вход (cache hit) | $0.05 |
| Выход (вкл. reasoning) | $2.70 |
Для сравнения — стоимость вывода Step 5 Preview рядом с моделями, на которые StepFun ориентируется.
| Модель | Выход за 1M токенов |
|---|---|
| DeepSeek V4.1 Flash | $0.60 (off-peak) |
| Step 5 Preview | $2.70 |
| Kimi K3 | $15.00 |
| GPT-6 Astra | выше |
| Claude Opus 5 | выше |
Ценовой тезис прост: сопоставимый класс интеллекта за долю стоимости вывода. Насколько «сопоставимый» — зависит от задачи. Бенчмарки в следующем разделе — единственные данные, которые StepFun предоставляет.
Позиционирование на бенчмарках
Все цифры ниже взяты из собственной таблицы StepFun: Step 5 Preview на уровне High reasoning effort, конкуренты на максимальном. Данные бенчмарков — от производителей, если не указано иное.
| Бенчмарк | Step 5 Preview | GLM 5.3 | Kimi K3 | GPT-6 Astra | Claude Opus 5 |
|---|---|---|---|---|---|
| GPQA Diamond | 93.5% | 91.7% | 93.5% | 96.1% | 93.2% |
| DeepSWE v1.1 | 67.7% | 66.9% | 67.5% | 74.1% | 74.0% |
| Terminal-Bench v4 | 33.3% | 41.9% | 12.6% | 57.9% | 52.3% |
| FrontierFinance | 66.4% | 64.1% | 62.6% | 55.0% | 69.7% |
| SWE-Marathon v1.1 | 72.7% | 67.4% | 84.4% | 77.3% | 85.6% |
| BrowseComp | 88.7% | — | 91.2% | 91.5% | 90.2% |
| ALE-CLI | 29.5% | 28.6% | 27.6% | 33.3% | 28.6% |
Картина устойчивая: Step 5 Preview идёт вровень с китайскими open-weight флагманами (GLM 5.3, Kimi K3) на большинстве строк и отстаёт от GPT-6 Astra и Claude Opus 5 на 6–7 пунктов по самым сложным coding-бенчмаркам. FrontierFinance — единственная строка, где Step 5 Preview опережает большинство конкурентов; это согласуется с позиционированием StepFun в финансовой аналитике.
Три оговорки. Во-первых, StepFun использует High effort против Max у конкурентов. Во-вторых, шесть бенчмарков в полной таблице — собственные разработки StepFun (включая StepCodeBench). В-третьих, независимые оценки Artificial Analysis пока находятся в процессе.
Доступ к Step 5 Preview через DashScope
Step 5 Preview появилась на Alibaba Cloud Model Studio (DashScope) 21 сентября 2026 года. Endpoint DashScope совместим с OpenAI, поэтому SDK-интеграция выглядит практически идентично.
from openai import OpenAI
client = OpenAI(
api_key="your-dashscope-api-key",
base_url="https://dashscope.aliyuncs.com/compatible-mode/v1",
)
response = client.chat.completions.create(
model="STEPFUN/step-5-preview",
messages=[
{"role": "user", "content": "Суммируй тренды выручки за Q3."}
],
)
print(response.choices[0].message.content)
Тарифы DashScope для сторонних моделей могут отличаться от прямых цен StepFun. Актуальные ставки — на странице цен DashScope.
Через DashScope один API-ключ и один биллинг-аккаунт дают доступ к StepFun, Qwen, DeepSeek, GLM и другим моделям — это упрощает работу с несколькими провайдерами.
Мультимодальный ввод: изображения и видео
Step 5 Preview принимает до 60 изображений на запрос и поддерживает видео в форматах MP4, QuickTime и Matroska. Работа с изображениями использует стандартный формат OpenAI image_url.
response = client.chat.completions.create(
model="step-5-preview",
messages=[
{
"role": "user",
"content": [
{"type": "text", "text": "Опиши диаграмму архитектуры."},
{
"type": "image_url",
"image_url": {"url": "https://example.com/diagram.png"},
},
],
}
],
)
Видеовход работает аналогично: видеофайл передаётся как URL-ссылка в контенте сообщения.
Tool calling и агентные рабочие процессы
Step 5 Preview поддерживает function calling через стандартный интерфейс OpenAI tools. В сочетании с контекстным окном в 1M токенов и лимитом вывода 64K модель справляется с долгими агентными задачами, где нужно читать крупные кодовые базы, итеративно вызывать инструменты и генерировать объёмные результаты.
tools = [
{
"type": "function",
"function": {
"name": "search_codebase",
"description": "Поиск файлов в репозитории по заданному паттерну",
"parameters": {
"type": "object",
"properties": {
"query": {"type": "string", "description": "Поисковый запрос"},
"file_pattern": {"type": "string", "description": "Glob-паттерн"}
},
"required": ["query"]
}
}
}
]
response = client.chat.completions.create(
model="step-5-preview",
messages=[{"role": "user", "content": "Найди все обработчики API-маршрутов."}],
tools=tools,
)
StepFun демонстрирует три примера длительных задач: 24-часовая оптимизация MLA-ядра на H100 до 508 TFLOPS, 24 часа автоматизированного дообучения модели Qwen3-30B-A3B с приростом 6.7 пунктов на AIME24 и более 3000 ходов в Pokemon Red.
Reasoning effort
Step 5 Preview предлагает три уровня reasoning effort: low, medium, high. Низкий уровень жертвует точностью ради скорости и экономии, высокий включает глубокую цепочку рассуждений.
response = client.chat.completions.create(
model="step-5-preview",
messages=[{"role": "user", "content": "Докажи неравенство Коши-Шварца."}],
extra_body={"reasoning_effort": "high"},
)
Reasoning-токены входят в общий объём выходных токенов. При ставке $2.70 за миллион выходных токенов стоимость «размышлений» уже включена, дополнительных начислений нет.
Маршрутизация Step 5 Preview через TheRouter
TheRouter направляет OpenAI-совместимые запросы через настроенных провайдеров. Чтобы добавить Step 5 Preview в маршрутизацию, направьте SDK на TheRouter и настройте цепочку провайдеров.
from openai import OpenAI
client = OpenAI(
api_key="your-therouter-api-key",
base_url="https://api.therouter.ai/v1",
)
response = client.chat.completions.create(
model="step-5-preview",
messages=[{"role": "user", "content": "Оптимизируй этот SQL-запрос."}],
)
Практичная схема маршрутизации для агентных coding-задач: длинноконтекстные задачи отправлять на Step 5 Preview (при $2.70/M это намного дешевле frontier-моделей), а простые дополнения — на DeepSeek V4.1 Flash ($0.60/M), где flash-скорость важнее глубины рассуждений.
Для задач финансового анализа лидерство Step 5 Preview на FrontierFinance (66.4% против 55.0% у GPT-6 Astra) может оправдать отдельный маршрут для финансовых запросов.
Когда выбирать Step 5 Preview
Step 5 Preview подходит, когда:
- Нужна flagship-класс рассуждения при цене в разы ниже frontier-моделей
- Финансовая аналитика — ключевой use case (сильные результаты на FrontierFinance)
- Агентные задачи требуют контекстного окна в 1M токенов
- Рабочий процесс включает мультимодальный ввод (изображения, видео)
- Хочется, чтобы стоимость reasoning была включена в цену выходных токенов
Стоит рассмотреть альтернативы, когда:
- Нужны абсолютно лучшие результаты по coding-бенчмаркам (GPT-6 Astra и Claude Opus 5 впереди на 6–7 пунктов по DeepSWE)
- Flash-уровень латентности и цена вывода ниже $1 — главный приоритет (DeepSeek V4.1 Flash, Qwen3.8-Flash)
- Нужна зрелая экосистема с обширным набором сторонних инструментов
На что обратить внимание
Step 5 Preview не случайно помечена как preview. Открытые веса запланированы на 15 октября 2026 года, лицензия пока не объявлена. Технического отчёта нет, независимые оценки Artificial Analysis ещё в процессе.
Модель уже работает на API StepFun и DashScope. О доступности на OpenRouter не объявлено. После выхода весов экономика self-hosted-развёртывания сместит ценовое сравнение ещё больше в пользу Step 5 Preview.
FAQ
Какой model ID у Step 5 Preview?
На API StepFun — step-5-preview. На DashScope — STEPFUN/step-5-preview.
Step 5 Preview совместима с OpenAI?
Да. Поддерживается формат Chat Completions endpoint. Укажите base_url как https://api.stepfun.com/v1 и ваш API-ключ StepFun.
Как соотносятся цены Step 5 Preview и Kimi K3? Step 5 Preview — $2.70 за миллион выходных токенов (reasoning включён). Kimi K3 — $15.00 за миллион. Step 5 Preview стоит 18% от цены K3.
Поддерживает ли Step 5 Preview tool calling? Да. Function calling работает через формат OpenAI tools со стандартными опциями tool_choice.
Когда выйдут открытые веса Step 5 Preview? StepFun объявила дату — 15 октября 2026 года.
Можно ли получить доступ к Step 5 Preview через DashScope? Да. Step 5 Preview представлена на Alibaba Cloud Model Studio (DashScope) как сторонняя модель.
Источники: Анонс StepFun (получено 2026-10-04), Анализ CellCog (получено 2026-10-04), MarkTechPost (получено 2026-10-04), Artificial Analysis (получено 2026-10-04), Новые модели DashScope (получено 2026-10-04), Hugging Face (получено 2026-10-04).