@GoogleDeepMind

Выпуск

2 твитов

Google DeepMind представила агентное понимание видео для моделей Gemini. Новый подход позволяет анализировать видео с большей точностью, используя до 88% меньше токенов — модель динамически подстраивает частоту кадров, рассуждая по транскрипту, аудио и кадрам, вместо сканирования всего файла целиком. Функция разворачивается для Gemini 3.7 Flash, 3.6 Flash и 3.5 Flash-Lite через API.

Темы: Агентное видеопонимание · Оптимизация токенов · Gemini Flash модели · Анализ длинных видео

Ключевые твиты