OpenAI запускает GPT-Realtime-Whisper одновременно с GPT-Realtime-2 и GPT-Realtime-Translate
7 мая 2026 года OpenAI выпустила три новые модели аудио в реальном времени: GPT-Realtime-2 (голосовой агент с контекстом 128K), GPT-Realtime-Translate (потоковый перевод за $0,034/мин) и GPT-Realtime-Whisper (потоковая речь-в-текст за $0,017/мин). GPT-Realtime-Whisper разработана для живой транскрипции с настраиваемой задержкой — режим 'minimal' даёт почти мгновенные дельты, а 'xhigh' предпочитает точность скорости. Модель подключается через выделенный эндпоинт транскрипционных сессий с WebRTC (браузеры) или WebSocket (серверные медиа-конвейеры). Также доступна через Azure Foundry с WER примерно на 50% ниже, чем у предыдущих моделей транскрипции в реальном времени.