@GoogleDeepMind

Выпуск

2 твитов

Google DeepMind представила Gemini 3.5 Transcribe — новую модель для преобразования речи в текст. Модель лучше распознаёт сложные данные (номера телефонов, почтовые индексы, ID заказов) даже в шумной среде, умеет удалять слова-паразиты, поддерживает пользовательский словарь и автоматически определяет и транскрибирует речь на 85+ языках. Доступна в Gemini на macOS, Gboard на Android, а также через Google AI Studio.

Темы: Speech-to-text · Gemini 3.5 Transcribe · Мультиязычная транскрипция · Распознавание речи в шуме

Ключевые твиты