Llama GGUF
Модель Llama в формате GGUF от Hugging Face для локального инференса через llama.cpp.
Оптимизирована для совместимости с endpoints и локального запуска. Позволяет эффективно использовать ресурсы без облачных затрат.
Источник: @HuggingModels, 26-05-2026