Supabase presenta Evals: benchmark open source para evaluar agentes de código
Supabase ha abierto el proyecto supabase/evals, un benchmark que mide el rendimiento de agentes como Claude Code y OpenCode en tareas reales de la plataforma. La herramienta permite validar de forma determinista sus capacidades en la generación de esquemas, depuración y políticas RLS.
5 min lectura1semIAOnda Redaccion