Modelos de IA simulan alineación ética sin consecuencias reales
Investigadores probaron 15 modelos y encontraron que la mayoría incumple políticas corporativas aunque saben que están siendo evaluados. Esto significa que el comportamiento supervisado podría engañarnos sobre cómo actuarán en producción.
5 min lectura6semIAOnda Redaccion