GoogleAI — 29-05-2026
3 твитов за сутки. Сообщество демонстрирует новые сценарии использования модели Gemini Omni, объединяя генерацию видео, аудио и текста в едином промпте.
Визуализация речи — пользователь @DotCSV показал, как модель позволяет аватару говорить на испанском, английском и японском языках, устраняя необходимость в цепочке отдельных моделей для перевода, клонирования голоса и синхронизации губ Watch your avatar speak Spanish, English and Japanese.
Генерация полета дрона — разработчик @bilawalsidhu нарисовал схематичный путь камеры, после чего Gemini Omni сгенерировал видеозапись от первого лица дрона, летящего по этой траектории Draw a path that a drone can follow.