Cómo detectar y frenar la adulación de IA con características lineales en cascada
Un nuevo método permite identificar y controlar la 'sycophancy' en modelos de lenguaje, usando muestras que escalan linealmente y reduciendo costos computacionales.
5 min lectura6semIAOnda Redaccion