FinPerMA: el benchmark que expone las debilidades de la memoria personalizada en agentes LLM
Un nuevo benchmark revela que los agentes de IA con memoria personalizada fallan al adaptarse a eventos financieros clave. Ni siquiera el contexto completo supera el 47% de precisión general.
5 min lectura2hIAOnda Redaccion