← назад

GoogleDeepMind — 16-04-2026

4 твитoв за сутки. GoogleDeepMind представила новую модель Gemini 3.1 Flash TTS и пространственный энкодер TIPSv2.

Gemini 3.1 Flash TTSновая модель text-to-speech с Audio Tags для управления стилем и темпом через текстовые команды.

Возможности и безопасностьболее естественная речь, поддержка 70+ языков (включая Hindi, Japanese, German) и наличие SynthID watermarking на всех выходах.

Доступностьпревью для разработчиков через Gemini API и Google AI Studio, превью для Enterprise на Vertex AI и выкатывание для всех в Google Vids (подробности здесь).

TIPSv2релиз foundational image-text encoder с пространственным пониманием (spatial awareness) и улучшенным patch-text alignment.

Источники