← назад

GoogleAI — 29-05-2026

3 твитов за сутки. Сообщество демонстрирует новые сценарии использования модели Gemini Omni, объединяя генерацию видео, аудио и текста в едином промпте.

Визуализация речи — пользователь @DotCSV показал, как модель позволяет аватару говорить на испанском, английском и японском языках, устраняя необходимость в цепочке отдельных моделей для перевода, клонирования голоса и синхронизации губ Watch your avatar speak Spanish, English and Japanese.

Генерация полета дрона — разработчик @bilawalsidhu нарисовал схематичный путь камеры, после чего Gemini Omni сгенерировал видеозапись от первого лица дрона, летящего по этой траектории Draw a path that a drone can follow.

Источники