Dia 1.6B
Тип: Модель синтеза речи (TTS) от Hugging Face с естественным человеческим звучанием.
Обеспечивает высокое качество генерации голоса, приближенное к реальным человеческим интонациям. Подходит для задач, где важна естественность и выразительность аудио-контента.
Источник: @HuggingModels, 31-05-2026