← назад

HuggingModels — 01-05-2026

50 твитoв за сутки. Обзор новых моделей для локализованных задач, математических вычислений и экспериментов с интерпретируемостью.

Локализованные модели (US English)представлена модель для понимания нюансов американского английского, готовая к использованию для задач sentiment analysis, а также специализированный пайплайн n173 и модель n169 для американского контекста.

Математические и логические инструментыQwen2.5 Math 7B выдает только финальный ответ без лишнего текста, Mistral 7B Lean Prover использует DPO для работы с теоремами, а квантованная версия Qwen3.6-27B обеспечивает высокую эффективность.

Интерпретируемость и архитектурыSparse Autoencoder (SAE) позволяет заглянуть внутрь Gemma 4 E2B, модель EchoSelf на базе GPT2 имитирует когнитивную архитектуру с памятью, а P2-ETF-LIQUID-NEURAL-ODE моделирует непрерывную динамику для временных рядов.

Специализированные задачиWhisper для Luganda обеспечивает транскрибацию африканского языка, IndoBERT-based модель оценивает релевантность вопросов в MCQ, pokerai обучается стратегии игры в покер, а модель для извлечения признаков превращает текст в векторы.

Экспериментальные и Uncensored моделиQwen3.6-27B-AEON работает с текстом и изображениями без цензуры, а transformer quadruple cube предназначен для обработки сложных структур данных.

Безопасность и финансыMercury Agent обнаружил и пропатчил старую уязвимость ядра Linux, а алгоритм CVaR-PPO оптимизирует финансовые портфели с учетом рисков.

Источники

gemma-4-sae qwen36-27b-omnimerge-v4-gguf gemma-4-e2b-sae unnamed-text-generation-model mistral-7b-lean-prover-dpo feature-extraction-model pokerai us-english-fine-tuned-model indobert-based-kisi-mcq-relevance qwen36-27b-aeon-ultimate-uncensored-bf16-mlx-2bit cvar-ppo luganda-whisper-model cvar-ppo-trading-model qwen25-math n169 p2-etf-liquid-neural-ode echoself luganda-whisper mannix-itaqwen36-27b-omnimerge-v4-gguf n173