En proyectos de software, el mayor cuello de botella para los agentes de IA no siempre es el modelo, sino la información que recibe. Un repositorio de 1,8 millones de líneas de Apache Airflow puede contener patrones útiles, pero también ruido, dependencias indirectas y decisiones históricas difíciles de reconstruir. El experimento descrito por Towards AI plantea una idea sencilla: antes de pedirle a una IA que modifique código, conviene darle una representación compacta, verificable y orientada a tareas.

La clave está en un catálogo de aproximadamente 9.700 tokens. No pretende sustituir al código fuente ni convertir todo el proyecto en una memoria perfecta. Su valor está en ordenar lo esencial: componentes, responsabilidades, relaciones entre módulos, puntos de entrada, convenciones y señales de comportamiento. Para un ingeniero, esa síntesis es revisable; para un agente, reduce la búsqueda ciega que suele consumir tiempo, contexto y llamadas al modelo.

En un sistema como Airflow, una petición aparentemente pequeña puede implicar operadores, DAGs, schedulers, conectores y rutas de ejecución muy distintas. Sin contexto, un agente puede localizar una función parecida, copiar una solución incompleta o alterar una interacción crítica. Con un catálogo útil, puede empezar entendiendo qué hace cada parte del sistema y dónde conviene intervenir.

El enfoque se alinea con una tendencia importante en la ingeniería de agentes: mejorar el contexto antes de mejorar el códigobase. Las instrucciones generales ayudan, pero no sustituyen una descripción precisa del dominio. En proyectos grandes, la calidad de la respuesta depende tanto de lo que se le pide como de qué arquitectura, límites y convenciones se le explican.

Esto también cambia el papel del equipo humano. Un catálogo no debe ser un documento automático que nadie lee, sino una capa de conocimiento mantenida con criterios claros. Debe reflejar cambios reales, señalar zonas sensibles y permitir contrastar la síntesis con el código. Si se vuelve obsoleto, puede producir una confianza peligrosa: el agente parecerá más informado de lo que realmente es.

El experimento es relevante porque muestra una alternativa práctica a alimentar al modelo con todo el repositorio. Los límites de contexto, el coste de las consultas y la latencia hacen imposible tratar cada códigobase como una lista interminable de archivos. Una representación breve y controlada puede ofrecer buena parte de la utilidad sin trasladar todo el peso al modelo.

Tampoco elimina los retos de seguridad, evaluación y mantenimiento. Un catálogo puede ocultar detalles, simplificar demasiado una dependencia o dejar fuera comportamientos emergentes. Por eso, las respuestas de un agente deberían seguir acompañadas de pruebas, revisiones humanas y mecanismos para volver al código fuente cuando la síntesis no sea suficiente.

La lección va más allá de Apache Airflow. En cualquier organización que integre agentes en el desarrollo, el contexto es una infraestructura crítica. Quien lo diseña bien no solo mejora la productividad de la IA: también reduce errores, acelera la incorporación de nuevos desarrolladores y convierte el conocimiento del proyecto en algo explícito, accesible y reutilizable.