OpenAI prueba nuevos entrenamientos para hacer IA más segura y fiable
Investigadores de OpenAI demuestran que pequeñas dosis de entrenamiento en rasgos beneficiosos, como veracidad y corregibilidad, mejoran la seguridad de los modelos en múltiples dominios. El método supera a las técnicas constitucionales de Anthropic.
5 min lectura6semIAOnda Redaccion