¿Pueden los Agentes de IA Extraer Conclusiones Científicas Confiables?
Un nuevo benchmark revela que los modelos más avanzados apenas alcanzan un 34 % de precisión factual al sintetizar hallazgos científicos. La evaluación en ‘clean‑room’ muestra que las cifras habituales son engañosas.
5 min lectura13semIAOnda Redaccion