Las últimas noticias, análisis y novedades sobre investigación en el mundo de la inteligencia artificial.
Un nuevo enfoque basado en activaciones internas permite detectar y corregir alucinaciones en tiempo de inferencia sin reentrenar el modelo.
Nueva investigación de Anthropic muestra que Claude desarrolla modelos internos coherentes de conceptos abstractos durante el entrenamiento.