← назад

HuggingModels — 29-05-2026

50 твитов за сутки. Лента была почти полностью потоком Hugging Face чекпойнтов: GGUF/MLX локальные LLM, vision-language модели, ASR, privacy-memory и робототехнические модели.

Локальные LLM и reasoning-чекпойнтыMythoMax-L2-13b-heretic подан как uncensored GGUF для локальной генерации текста, MaxParadigm V1 — как GGUF-модель для локальных чат-ботов и US endpoints, а Granite 4.1 30B Claude-X2B Thinking — как MLX/safetensors fine-tune с дополнительным reasoning-слоем. Отдельно отмечен релиз Claude Opus 4.8 и интерес к Mercury как open-source персональному агенту с терминалом, Telegram, памятью SQLite и multi-provider поддержкой по цитируемому треду.

Vision-language и image tagging — серия STEP/Qwen чекпойнтов закрывает разные режимы визуального понимания: STEP rawimg v2 без mapping/CoT, STEP rawimg v1 с action CoT, Qwen3VL 8B SFT 2 epoch и Qwen3VL 8B SFT 1 epoch. Для niche tagging отдельно вынесен OppaiOracle, vision transformer для распознавания персонажей, сцен и объектов в anime art.

Компактные specialized-моделиTSD-KD Qwen2.5 1.5B описан как компактная distillation-модель для instruction following, ADRv2024 — как DeBERTa v2 classifier для текстовой классификации, HaloGuard1 4B — как Qwen3 4B LoRA для conversational generation, а Qwen3.5 fine-tune — как ранний текстовый SFT-чекпойнт.

Speech, privacy и roboticsKasuleTrevor's Whisper закрывает Luganda ASR, MemPrivacy-4B-RL нацелен на обнаружение и управление приватной информацией в personalized memory systems, so101-test показывает ACT-подход к роботическому pick-and-place, а emotion-aware chatbot model предлагает RoBERTa-классификацию эмоций для чатботов.

Источники

tsd-kd-qwen25-15b emotion-aware-chatbot-model step-sft-qwen25-vl-7b-instruct-rawimg-v2-nomap-action-nocot step-sft-qwen25-vl-7b-instruct-rawimg-v1-action-cot qwen35-fine-tuned adrv2024 mythomax-l2-13b-heretic memprivacy so101-test oppaioracle haloguard1-4b qwen3vl-8b-sft kasuletrevors-whisper maxparadigm-v1 granite-finetune claude-opus-48