@ggerganov

Выпуск

2 твитов

День был посвящён обновлениям llama.cpp и поддержке новых моделей. Для Qwen3.8-27B с MTP рекомендован переход на DFlash ради дополнительного ускорения; для этого требуется llama.cpp v0.6.0. Также появилась поддержка EmbeddingGemma 2 с первого дня.

Темы: llama.cpp · DFlash · Qwen3.8-27B · EmbeddingGemma 2

Ключевые твиты