← назад

ggerganov — 19-05-2026

1 твитов за сутки. llama.cpp получил поддержку MTP для семейства Qwen3.6, что обеспечило значительный прирост производительности локального инференса на потребительском оборудовании.

MTP для Qwen3.6 — добавление поддержки MTP для модели Qwen3.6 стало важным этапом для локальной AI-экосистемы, существенно улучшив скорость работы на стандартном железе.

Разработка — ключевую роль в реализации данной функции сыграл Aman Gupta, которому выражена благодарность за лидерство в этом направлении.

Источники