NVIDIAAI — 29-04-2026
17 твитов за сутки. NVIDIA представила новую мультимодальную модель Nemotron 3 Nano Omni и анонсировала её интеграцию в различные сервисы и инфраструктурные платформы.
Релиз Nemotron 3 Nano Omni — новая open multimodal модель на 30B параметров с контекстом 256K, которая объединяет аудио, видео, изображения и текст в единую архитектуру без использования разрозненных пайплайнов (вместо связки отдельных vision и language моделей). Модель представляет собой гибрид Transformer-Mamba MoE с 3B активными параметрами и поддерживает квантование FP8 / NVFP4. Для локального запуска требуется около 25GB RAM (доступны GGUF версии).
Интеграции и доступность — Модель уже доступна в LM Studio, на OpenRouter, в Fireworks и DeepInfra (с OpenAI-совместимым API). Также запущены сервисы на Nebius Token Factory, SGLang, Crusoe Managed Inference и Vultr.
Другие анонсы — Выход моделей Laguna XS.2 и Laguna M.1 от Poolside и запуск поисковой модели Waldo от Glean, построенной на базе Nemotron 3 Nano. Также анонсированы предстоящие стримы Nemotron Labs на 5 и 12 мая.
Источники
- Релиз Laguna XS.2 и Laguna M.1
- Nemotron 3 Nano Omni в LM Studio
- Анонс Nemotron 3 Nano Omni
- Репост анонса NVIDIA
- Расписание стримов Nemotron Labs
- Архитектура единого контекста
- Доступ на Nebius Token Factory
- Технические детали: Transformer-Mamba MoE
- Производительность в SGLang
- Релиз Nemotron-3-Nano-Omni (GGUF/Guide)
- Доступ на OpenRouter
- Деплой на Vultr
- Поддержка в GMI
- Описание архитектуры и кейсов
- Доступ на Fireworks
- Партнерство с DeepInfra
- Модель Waldo от Glean
