← назад

huggingface — 19-05-2026

9 твитов за сутки. Huggingface анонсировал интеграцию с Dell для корпоративного сегмента, обновил инструменты оценки памяти и ускорения локального инференса, а также возродил PapersWithCode.

Enterprise-интеграция с Dell — модели Kimi K2.6, DeepSeek V4 Pro, GLM 5.1, MiniMax M2.7 и DeepSeek V4 Flash доступны в один клик через Dell Enterprise Hub, оптимизированы для серверов PowerEdge XE9780 с NVIDIA B300, что позиционируется как решение для борьбы с нехваткой GPU за счёт on-prem развёртывания 1, 6.

Улучшения локального инференсаllama.cpp добавил поддержку MTP для семейства Qwen3.6, что позволило увеличить скорость генерации Qwen3.6-27B на A10G с 25 до 45 токенов в секунду (+78%) с помощью флагов --spec-type draft-mtp и --spec-draft-n-max 2 4, 5.

Инструменты и инфраструктура — обновлённый hf-mem теперь детально разбивает оценку памяти MoE-моделей на базовые веса, маршрутизируемые эксперты и KV cache для точного планирования стратегии параллелизма 2. Возрождение PapersWithCode обещает масштабный парсинг SOTA-методов и лидербордов по всем доменам с помощью AI-агентов 3.

Экосистема и сообщество — Kernel MaxSim обеспечивает ускорение late-interaction retrieval (ColBERT/PyLate) в 3–5 раз за счёт tiled scoring на Metal и WMMA 9. Отмечается тренд на самостоятельное обучение моделей на open-source базе (на примере Cursor Composer 2.5) 7.

Источники

paperswithcode hf-mem maxsim dell-enterprise-hub