qwen3.5-9b Q K M
model: Обновление модели Qwen3.5-9b от Qwen с применением квантования Q K M.
Обеспечивает производительность на уровне 25 токенов в секунду, оптимизируя скорость инференса. Решение подходит для задач, требующих быстрого отклика без потери качества генерации.
Источник: @tunguz, 28-05-2026