El formato del prompt cambia los rankings: nuevo estudio revela fragilidad en benchmarks de LLM
Un estudio masivo en OpenRouter demuestra que simples cambios de formato en los prompts alteran la precisión hasta 30x entre modelos. La parseabilidad predice el rendimiento mejor que el tamaño.
6 min lectura8semIAOnda Redaccion