CARAT revela si los LLM de materiales razonan o simplemente recitan
El nuevo benchmark CARAT analiza si los modelos de lenguaje para materiales comprenden la estructura cristalina o solo reproducen datos presentes en su entrenamiento. Los resultados muestran brechas significativas entre razonamiento fundamentado y recitación superficial.
5 min lecturaayerIAOnda Redaccion