TTS-1 HD — высококачественная модель синтеза речи OpenAI, представленная вместе с TTS-1 на OpenAI DevDay 6 ноября 2023 года. Преобразует текст в естественно звучащую речь, оптимизированную для качества аудио, а не задержки. По $30,00 за миллион символов — вдвое дороже TTS-1 ($15,00/млн симв.) — она является предпочтительным вариантом, когда качество звука имеет первостепенное значение: аудиокниги, подкасты, озвучка e-learning и вещательные медиа. Разделяет тот же набор голосов (alloy, ash, coral, echo, fable, onyx, nova, shimmer) и форматы вывода (MP3, Opus, AAC, FLAC, WAV, PCM), отличаясь от TTS-1 только компромиссом качество/задержка.
По состоянию на 2025–2026 годы OpenAI рекомендует gpt-4o-mini-tts для новых голосовых агентов, поскольку та добавляет поддержку инструкций (управление тоном, акцентом и стилем речи через параметр instructions). TTS-1 HD остаётся полностью поддерживаемой и является правильным выбором для производственных конвейеров, генерирующих предрендеренные аудиоресурсы — сценарии, где запрос не на интерактивном критическом пути, и несколько лишних сотен миллисекунд на синтез приемлемы в обмен на заметно более чёткий результат. Вызывается через совместимый с OpenAI эндпоинт TheRouter (/v1/audio/speech) без изменений.