@alibaba_qwen
Главное событие дня — выпуск Qwen3.8-Flash-Next, мультимодальной MoE-модели на 125B параметров (6B активных), являющейся ранним превью архитектуры Qwen4. Модель использует новые архитектурные решения (GDN, QSA hybrid attention, N-gram Embedding, Muon optimizer), обучена в 9 раз дешевле Qwen3.7-Plus и при этом превосходит её по бенчмаркам. Поддержка с первого дня от vLLM, SGLang и Unsloth — модель уже можно запускать локально на 75GB RAM. Также отмечено первое место среди открытых моделей в Image-to-WebDev Arena.