@alibaba_qwen

Выпуск

8 твитов

Главное событие дня — выпуск Qwen3.8-Flash-Next, мультимодальной MoE-модели на 125B параметров (6B активных), являющейся ранним превью архитектуры Qwen4. Модель использует новые архитектурные решения (GDN, QSA hybrid attention, N-gram Embedding, Muon optimizer), обучена в 9 раз дешевле Qwen3.7-Plus и при этом превосходит её по бенчмаркам. Поддержка с первого дня от vLLM, SGLang и Unsloth — модель уже можно запускать локально на 75GB RAM. Также отмечено первое место среди открытых моделей в Image-to-WebDev Arena.

Темы: Запуск Qwen3.8-Flash-Next · Архитектура Qwen4 · Экономия на инференсе · Поддержка экосистемы · Open-weight MoE

Ключевые твиты