← назад

HuggingModels — 12-05-2026

50 твитов за сутки. Лента принесла плотный поток новых Hugging Face моделей: от safety/NLP и gaze estimation до Qwen/Gemma-производных и компактных coding моделей.

Модерация и safetyPortuguese Hate Speech Model описан как RoBERTa-вариант для hate speech detection на бразильском португальском; ссылка на модель дана в отдельном твите.

Qwen/Gemma reasoning слойDFT-sigmoid сочетает Qwen2, discrete Fourier transforms и sigmoid activation; Shaybot-Gemma дообучен для более естественного диалога на базе Gemma; Qwen/Qwen3-4B-Thinking-2507 подается как reasoning/SFT модель для задач рассуждения.

Локальные и специализированные моделиprivi-gaze-distill делает gaze estimation локально на устройстве, LayerC-VLN-shard0 сфокусирован на региональном US-контексте, а llama-70b-partial-rknot обещает сжатие Llama 3 70B через resonance-knot.

Long-context и dev-моделиQwen3-32B-LongContext заявлен с 32B параметрами и контекстом 31.6K токенов, YOLO-Coder-8B позиционируется как Qwen2.5-Coder модель для CLI debugging и developer tooling, а yosa-gin002 добавляет еще один Qwen2 safetensors вариант.

Генеративные и нишевые релизыDreamZero G1 Sonic 0422 2 ориентирован на Sonic-style image generation, Smart Reminder подается как scheduling/productivity модель, а несколько свежих safetensors-релизов остаются в статусе ранних, почти без загрузок.

Источники

privi-gaze-distill shaybot-gemma qwen3-32b-longcontext yosa-gin002 layerc-vln-shard0 portuguese-hate-speech-model qwenqwen3-4b-thinking-2507 dft-sigmoid dreamzero-g1-sonic-0422-2 yolo-coder-8b llama-70b-partial-rknot