K-Search lleva la experiencia de CUDA a Apple Silicon: 20x más rápido en prefill
Investigadores de Berkeley automatizan la transferencia de décadas de optimizaciones de kernels CUDA al framework MLX de Apple, logrando rendimiento cercano al experto humano sin reescribir código desde cero.
6 min lectura6dIAOnda Redaccion