Назад к моделям

TTS-1 HD — высококачественная модель синтеза речи OpenAI, представленная вместе с TTS-1 на OpenAI DevDay 6 ноября 2023 года. Преобразует текст в естественно звучащую речь, оптимизированную для качества аудио, а не задержки. По $30,00 за миллион символов — вдвое дороже TTS-1 ($15,00/млн симв.) — она является предпочтительным вариантом, когда качество звука имеет первостепенное значение: аудиокниги, подкасты, озвучка e-learning и вещательные медиа. Разделяет тот же набор голосов (alloy, ash, coral, echo, fable, onyx, nova, shimmer) и форматы вывода (MP3, Opus, AAC, FLAC, WAV, PCM), отличаясь от TTS-1 только компромиссом качество/задержка.

По состоянию на 2025–2026 годы OpenAI рекомендует gpt-4o-mini-tts для новых голосовых агентов, поскольку та добавляет поддержку инструкций (управление тоном, акцентом и стилем речи через параметр instructions). TTS-1 HD остаётся полностью поддерживаемой и является правильным выбором для производственных конвейеров, генерирующих предрендеренные аудиоресурсы — сценарии, где запрос не на интерактивном критическом пути, и несколько лишних сотен миллисекунд на синтез приемлемы в обмен на заметно более чёткий результат. Вызывается через совместимый с OpenAI эндпоинт TheRouter (/v1/audio/speech) без изменений.

Когда выбирать
  • • Аудиокниги и длинная озвучка, где слушатель оценивает каждое предложение — повышенная точность TTS-1 HD ощутима при длительном прослушивании
  • • Производство подкастов и маркетинговых видео для публикации — разница в качестве по сравнению с TTS-1 слышна нетехнической аудитории
  • • Озвучка e-learning и корпоративного обучения, которую будут воспроизводить многократно — меньше артефактов повышает воспринимаемый профессионализм
  • • Пакетный пре-рендеринг аудиоресурсов (демо продукта, объяснительные видео, записи IVR), где синтез происходит в офлайне и стоимость запроса предсказуема
Когда не выбирать
  • • Разговорные агенты в реальном времени, где критична задержка первого аудио — используйте TTS-1 для меньшей задержки или gpt-4o-realtime-preview для нативного потокового голоса
  • • Новые голосовые агенты с управлением стилем речи через промпты (тон, акцент, эмоции) — используйте gpt-4o-mini-tts с поддержкой параметра instructions
  • • Высокобъёмные конвейеры с жёстким бюджетом, где надбавка за качество не оправдана — TTS-1 за $15/млн симв. обеспечивает приемлемое качество за полцены
Размер контекста
--
Максимальный вывод
--
Цена Текстза 1 млн символов
$32.40за 1 млн символов

Модальности

Текст→Аудио

Возможности

Синтез речи

Возможности генерации медиа

tts
output_formats
  • mp3
  • opus
  • aac
  • flac
voices
  • alloy
  • echo
  • fable
  • onyx
  • nova
  • shimmer
defaults
voice
alloy

Разбивка цен

ТипСтавка
Текст$32.40 за 1 млн символов

request is price per 1M characters

Поддерживаемые параметры

inputvoiceresponse_formatspeed

Характеристики

Дата релиза2023-11-06 (OpenAI DevDay)openai.com ↗проверено
Цена$30,00 за 1 млн символовopenai.com/api/pricing ↗проверено
Максимальная длина ввода4 096 символов на запросplatform.openai.com ↗проверено
Доступные голосаalloy, ash, coral, echo, fable, onyx, nova, shimmer (9 голосов)platform.openai.com ↗проверено
Форматы выводаMP3 (по умолчанию), Opus, AAC, FLAC, WAV, PCMplatform.openai.com ↗проверено
Управление скоростью0,25–4,0× (по умолчанию 1,0×)platform.openai.com ↗проверено
Задержка по сравнению с TTS-1Задержка выше, чем у TTS-1 — оптимизирована под качество, а не скоростьplatform.openai.com ↗проверено
Следование инструкциям (стиль голоса)Не поддерживается — для управления стилем через промпты используйте gpt-4o-mini-ttsplatform.openai.com ↗проверено
Лимиты (Tier 1)500 RPMplatform.openai.com ↗проверено
Дата отсечения данныхНе раскрытонеизвестно
ЛицензияПроприетарная (условия использования OpenAI API)openai.com/policies ↗проверено

Бенчмарки

BenchmarkDistributionScoreSource
Relative audio quality vs TTS-1
OpenAI характеризует TTS-1 HD как обеспечивающую более высокое качество аудио, чем TTS-1, за счёт большей задержки. Числовые показатели MOS или CMOS не раскрыты.
Higher quality than TTS-1qualitativeplatform.openai.com ↗

Примеры API

Для новых интеграций используйте глобальный endpoint api.therouter.ai из примеров ниже; старый China accelerated endpoint выведен из эксплуатации.

cURL
curl https://api.therouter.ai/v1/audio/speech   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "openai/tts-1-hd",
    "input": "Welcome to TheRouter.",
    "voice": "alloy"
  }'

Генерация речи (v1/audio/speech)

cURL
curl https://api.therouter.ai/v1/audio/speech \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai/tts-1-hd",
    "input": "The quick brown fox jumped over the lazy dog.",
    "voice": "nova"
  }' \
  --output speech-hd.mp3

Ещё от openai

Похожие модели

Аналоги в других провайдерах

Новости и изменения

2025-03-20

OpenAI выпустила gpt-4o-mini-tts с поддержкой инструкций для голосовых агентов

OpenAI выпустила gpt-4o-mini-tts вместе с новыми моделями распознавания речи, позиционируя её как рекомендуемую для новых голосовых агентов. В отличие от TTS-1 HD, она принимает поле instructions для управления акцентом, тоном, эмоцией и стилем речи. TTS-1 HD по-прежнему поддерживается и остаётся предпочтительным выбором для предрендеренного аудио с приоритетом качества там, где следование инструкциям не нужно.

переработано TheRouteropenai.com ↗
2024-03-30

Голоса OpenAI TTS появились в Azure OpenAI Service

Microsoft объявила о поддержке TTS-1 и TTS-1 HD в Azure OpenAI Service и Azure AI Speech, расширив корпоративный доступ с соблюдением требований к хранению данных для самого высококачественного TTS от OpenAI. Это делает TTS-1 HD доступной для регулируемых отраслей — здравоохранения, финансов, государственного управления — где данные должны оставаться в географических границах Azure.

переработано TheRoutertechcommunity.microsoft.com ↗
2023-11-06

OpenAI DevDay: запуск TTS-1 и TTS-1 HD

OpenAI представила первые производственные модели синтеза речи на DevDay 2023: TTS-1 для потоковой передачи с низкой задержкой и TTS-1 HD для вывода высокой точности. Обе модели поддерживают 6 начальных голосов (alloy, echo, fable, onyx, nova, shimmer), несколько форматов вывода и OpenAI Audio API (/v1/audio/speech), позволяя любому приложению добавить естественно звучащую генерацию речи одним вызовом API.

переработано TheRouteropenai.com ↗

Частые вопросы

В чём разница между TTS-1 HD и TTS-1?

TTS-1 HD оптимизирована для качества аудио и лучше подходит для контента, который будут слушать внимательно — подкасты, аудиокниги, корпоративная озвучка. TTS-1 оптимизирована для низкой задержки и лучше для приложений реального времени или потоковых. TTS-1 HD стоит $30/млн симв.; TTS-1 — $15/млн симв. Обе поддерживают одинаковые голоса, форматы вывода и управление скоростью.

переработано TheRouterplatform.openai.com ↗
Что выбрать для новых проектов — TTS-1 HD или gpt-4o-mini-tts?

Используйте gpt-4o-mini-tts для любого нового голосового агента или разговорного приложения — она добавляет следование инструкциям (тон, акцент, личность через instructions) и является рекомендуемым путём OpenAI. Используйте TTS-1 HD, когда нужно наивысшее качество аудио для предрендеренного, неинтерактивного контента без управления стилем — аудиокниги, сегменты подкастов или корпоративный e-learning с офлайн-синтезом.

переработано TheRouterplatform.openai.com ↗
Как использовать TTS-1 HD через TheRouter?

Укажите baseURL вашего клиента как https://api.therouter.ai/v1, используйте API-ключ TheRouter и задайте model как openai/tts-1-hd. Все остальные параметры (voice, speed, response_format, input) остаются идентичными OpenAI SDK. TheRouter прозрачно обрабатывает маршрутизацию, выставление счетов и агрегацию лимитов.

переработано TheRouterplatform.openai.com ↗
Какой формат вывода выбрать для TTS-1 HD?

MP3 — формат по умолчанию, подходящий для большинства веб- и мобильных сценариев. Для контента, который будет пост-обрабатываться в DAW или редактироваться, используйте FLAC (без потерь) или WAV. Opus обеспечивает меньший размер файла по сравнению с MP3 при эквивалентном качестве — хорош для доставки при ограниченной пропускной способности. PCM оптимален для прямой интеграции в аудиоконвейер (телефония или микширование в реальном времени).

переработано TheRouterplatform.openai.com ↗
Реестр фактов — каждая утверждаемая величина имеет источник
источникURLполучено
Дата релизаopenai.com ↗2026-06-09проверено
Ценаopenai.com/api/pricing ↗2026-06-09проверено
Максимальная длина вводаplatform.openai.com ↗2026-06-09проверено
Доступные голосаplatform.openai.com ↗2026-06-09проверено
Форматы выводаplatform.openai.com ↗2026-06-09проверено
Управление скоростьюplatform.openai.com ↗2026-06-09проверено
Задержка по сравнению с TTS-1platform.openai.com ↗2026-06-09проверено
Следование инструкциям (стиль голоса)platform.openai.com ↗2026-06-09проверено
Лимиты (Tier 1)platform.openai.com ↗2026-06-09проверено
Дата отсечения данных——неизвестно
Лицензияopenai.com/policies ↗2026-06-09проверено
Relative audio quality vs TTS-1platform.openai.com ↗2026-06-09проверено
OpenAI выпустила gpt-4o-mini-tts с поддержкой инструкций для голосовых агентовopenai.com ↗2026-06-09проверено
Голоса OpenAI TTS появились в Azure OpenAI Servicetechcommunity.microsoft.com ↗2026-06-09проверено
OpenAI DevDay: запуск TTS-1 и TTS-1 HDopenai.com ↗2026-06-09проверено
В чём разница между TTS-1 HD и TTS-1?platform.openai.com ↗2026-06-09к проверке
Что выбрать для новых проектов — TTS-1 HD или gpt-4o-mini-tts?platform.openai.com ↗2026-06-09к проверке
Как использовать TTS-1 HD через TheRouter?platform.openai.com ↗2026-06-09к проверке
Какой формат вывода выбрать для TTS-1 HD?platform.openai.com ↗2026-06-09к проверке
Помощь и контакты