← назад

NVIDIAAI — 14-05-2026

6 твитов за сутки. NVIDIA объясняет архитектурные преимущества Blackwell для длинного контекста, анонсирует обновление OpenShell и делится кейсами локального AI.

DeepSeek-V4 на BlackwellNVIDIA Blackwell оптимизирован под узкие места long-context inference: давление KV-cache при декодировании и пропускная способность весов MoE при префилле. Система NVIDIA HGX B200 удерживает сжатые кэши CSA/HCA/SWA для множества запросов, а нативная поддержка MXFP4 обеспечивает эффективный квантованный инференс весов MoE, повышая пропускную способность и снижая накладные расходы.

Agentic inference at scale — для масштабируемого агентного инференса требуется баланс между моделями, софтом и вычислениями. Полностековая платформа NVIDIA использует экстремальный ко-дизайн (compute, networking, storage, memory) и широкую экосистему ПО для снижения стоимости токена и повышения масштабируемости.

OpenShell v0.0.40 — вышло обновление OpenShell с локальной маршрутизацией сервисов в шлюзе, планированием узлов k8s и толерантностями. Добавлена поддержка OS trust store для CLI TLS и исправлен баг с утечкой секретов в SecretResolver debug.

Video Analytics AI Agents — анонсирован вебинар о создании AI-агентов для видеоаналитики с использованием навыков (Skills).

Локальный AI на DGX Spark — пользователь sudoingX показал автономный запуск 121B модели на DGX Spark, где агент Hermes самостоятельно прошел 8 тестов в 3 наборах без написания кода пользователем.

Источники