
VibeVoice-ASR
model: Открытая модель Microsoft для распознавания речи с поддержкой длинных аудиофайлов.
Поддерживает ввод до 60 минут аудио и обеспечивает структурированный вывод результатов. Инструмент подходит для задач автоматической транскрипции с акцентом на точность и удобство обработки больших объемов данных.
Источник: @dotey, 29-04-2026