← назад

alliekmiller — 21-05-2026

Автор анализирует четыре ключевых направления Google I/O 2026, отмечая сдвиг в сторону голосовых интерфейсов, автономных агентов и мультимодальных моделей, но критикуя отсутствие инструментов для совместной работы.

Voice AI as an interface — Google и Samsung представили очки Gemini с поддержкой Gentle Monster и Warby Parker для перевода, навигации и поиска, а также推出了 Docs Live для голосового создания документов с редактированием Gemini-powered glasses.

Agent-first everything — Запущен Gemini Spark, агент-ассистент на выделенных VM в Google Cloud с собственным адресом Gmail, интегрирующийся с Uber, OpenTable и Zillow, который станет доступен подписчикам AI Ultra следующей неделе Gemini Spark.

Orchestration efficiency — Представлен Gemini 3.5 Flash, работающий примерно в 4 раза быстрее аналогов и дешевле половины их стоимости, что позволяет предприятиям оптимизировать расходы на токены Gemini 3.5 Flash.

World models — Demis Hassabis анонсировал Gemini Omni, позволяющую генерировать и редактировать видео через естественный язык, с заявлением о будущем универсальном вводе-выводе без указания сроков Gemini Omni.

Критика и наблюдения — Автор отмечает отсутствие на ивентах демо совместной работы людей в AI-воркфлоу и рекурсивного обучения, выражая опасение, что AI превращается в «одиночный режим» Google I/O 2026.

Источники