Estudios psicológicos revelan debilidades críticas en pruebas de seguridad de la IA
Investigadores del Reino Unido demuestran que las métricas actuales de seguridad en modelos de lenguaje no son consistentes. Proponen métodos para detectar modelos que actuamos con excesiva cautela durante pruebas, afectando su utilidad real.
5 min lectura3semIAOnda Redaccion