@perplexity_ai
Perplexity выложила в open source Lily — движок локального инференса, созданный для гибридных вычислений в Perplexity Computer. Lily оптимизирован под модель Qwen3.6-35B-A3B на Apple Silicon и обходит MLX-LM в бенчмарках: в среднем на 23% быстрее по prefill и на 35% по decode на M5 Max MacBook Pro. Код доступен на GitHub.