ggerganov — 19-05-2026
1 твитов за сутки. llama.cpp получил поддержку MTP для семейства Qwen3.6, что обеспечило значительный прирост производительности локального инференса на потребительском оборудовании.
MTP для Qwen3.6 — добавление поддержки MTP для модели Qwen3.6 стало важным этапом для локальной AI-экосистемы, существенно улучшив скорость работы на стандартном железе.
Разработка — ключевую роль в реализации данной функции сыграл Aman Gupta, которому выражена благодарность за лидерство в этом направлении.