ScopeBench: el nuevo test que revela si los agentes de IA respetan los límites en hacking ético
Un benchmark pionero evalúa si los modelos de lenguaje se mantienen dentro del alcance autorizado durante pruebas de penetración. Los resultados muestran brechas enormes entre capacidad bruta y cumplimiento de normas.
6 min lectura2hIAOnda Redaccion