CSTutorBench: el nuevo estándar para evaluar SLMs como tutores de programación por bloques
Investigadores presentan CSTutorBench, un benchmark que revela cómo los modelos pequeños fallan en pedagogía profunda pese a dominar tono y vocabulario. La clave: familia del modelo y fine-tuning superan al conteo de parámetros.
6 min lectura9semIAOnda Redaccion