← назад

llama-gguf

Llama GGUF

Модель Llama в формате GGUF от Hugging Face для локального инференса через llama.cpp.

Оптимизирована для совместимости с endpoints и локального запуска. Позволяет эффективно использовать ресурсы без облачных затрат.

Источник: @HuggingModels, 26-05-2026