Perplexity libera Lily: motor de inferencia en Rust que dobla rendimiento de MLX en Apple Silicon
La compañía abre su motor de inferencia optimizado para Qwen3.6-35B, logra 1.35x más velocidad de decodificación que MLX-LM en M5 Max.
5 min lectura1semIAOnda Redaccion