← назад

ollama

Ollama

Запуск LLM локально — платформа для запуска языковых моделей на своём железе.

Версия 0.19 — релиз 01-04-2026: поддержка MLX как бэкенда на Apple Silicon. Ollama теперь задействует GPU Neural Accelerators на M5/M5 Pro/M5 Max, увеличивая скорость генерации в 2–3 раза по сравнению с предыдущей версией. Кроме того: NVFP4 для production-качества на NVIDIA GPU, умное кэширование промптов (меньше памяти, быстрее ветвление в агентах), поддержка Qwen3.5-35B-A3B-nvfp4.

Ссылки: - Сайт: https://ollama.com - GitHub: https://github.com/ollama/ollama - Блог (MLX): https://ollama.com/blog/mlx - Twitter: https://x.com/ollama

Источник: @ollama, 01-04-2026