OpenAIDevs — 08-05-2026
15 твитov за сутки. OpenAI представила флагманскую модель GPT-Realtime-2 с расширенным контекстным окном и новыми аудио-возможностями в API.
Релиз GPT-Realtime-2 — новая speech-to-speech модель получила контекстное окно 128K, уровни рассуждения от minimal до xHigh и достигла 96.6% в бенчкреке Big Bench Audio. Модель значительно улучшила удержание инструкций, подняв показатель с 36.7% до 70.8%. В API также доступны модели GPT-Realtime-Translate для перевода и GPT-Realtime-Whisper для стриминговой транскрипции.
Применение в продуктах — Genspark интегрировал модель в своего агента Call for Me, заметив рост эффективной частоты разговоров на 26%. Glean запустил голосовые возможности для корпоративного контекста, показав рост полезности на 42.9%. Vimeo демонстрирует использование GPT-Realtime-Translate для живого дубляжа мероприятий. Примеры использования включают создание живых переводчиков и голосовых агентов для сложных задач.
Инструментарий и разработка — Выпущен новый гайд по промптингу для настройки рассуждений и обработки аудио. Обновление Codex для Chrome позволяет работать с вкладками в фоне, собирать контекст через DevTools и тестировать мультиплеерные игры через subagents.
Источники
- GPT-Realtime-2: Building a Live Translator
- New Voice Model from OpenAI in the API gpt-realtime-2
- GPT-Realtime-2 speech-to-speech model demo
- GPT-Realtime-2 in Genspark
- Prompting guide for GPT-Realtime-2
- Technical details of GPT-Realtime-2 release
- Codex Chrome extension update
- Codex Chrome subagents feature
- Codex browser dev work capabilities
- Audio MultiChallenge S2S leaderboard results
- Live dubbing in Vimeo with GPT-Realtime-Translate
- Glean real-time voice capability
- New audio capabilities in API
- GPT-Realtime-Whisper streaming transcription
- Availability of Realtime API models