Reddit ha impuesto recientemente nuevas restricciones al acceso de Old Reddit, la interfaz clásica que muchos usuarios veteranos siguen prefiriendo por su simplicidad y rapidez. Según la publicación de Engadget, la medida busca frenar el uso no autorizado de la plataforma mediante técnicas de scraping, al mismo tiempo que la versión nueva de Reddit lucha por contener el mismo problema. Este anuncio no es un ajuste menor; forma parte de una estrategia más amplia de la compañía para controlar cómo se consumen y se reutilizan sus datos, especialmente en un contexto donde los modelos de inteligencia artificial dependen de grandes volúmenes de texto entrenado en fuentes públicas como Reddit.
Old Reddit, lanzada en los primeros años de la plataforma, ofrece una experiencia ligera basada en HTML puro, sin los elementos interactivos y los algoritmos de recomendación que caracterizan a la redesign de 2018. Durante años, comunidades de desarrolladores, investigadores y usuarios con conexiones lentas han dependido de esta versión para acceder a hilos de discusión sin la sobrecarga de JavaScript y los scripts de seguimiento. Sin embargo, esa misma apertura ha facilitado que bots y raspadores extraigan contenido a gran escala, alimentando conjuntos de datos utilizados para entrenar modelos de lenguaje grandes (LLMs) y otras aplicaciones de IA.
Las nuevas restricciones incluyen límites más estrictos a las peticiones API desde clientes no autenticados, el bloqueo de ciertos user‑agents asociados a herramientas de scraping y la implementación de desafíos CAPTCHA para accesos sospechosos desde la interfaz clásica. Reddit también ha señalado que está revisando los términos de servicio para prohibir explícitamente la extracción masiva de datos sin permiso, amenazando con acciones legales contra quienes violen esas normas.
Desde el punto de vista de la compañía, el movimiento responde a dos presiones principales. Por un lado, la creciente preocupación por la privacidad y el uso no consentido de la información de los usuarios en el entrenamiento de IA, un tema que ha generado debates regulatorios en la UE y EE.UU. Por otro lado, la necesidad de monetizar su infraestructura: Reddit ha explorado licencias de datos a empresas de IA y quiere asegurarse de que cualquier extracción se haga bajo acuerdos comerciales que le generen ingresos.
El impacto recae sobre varios grupos. Los usuarios de Old Reddit, muchos de los cuales valoran la velocidad y la ausencia de publicidad, ahora enfrentan tiempos de carga más largos o la necesidad de crear cuentas y aceptar términos más restrictivos. Los moderadores que dependen de herramientas externas para la gestión de comunidades (como bots de mantenimiento o análisis de tendencias) pueden ver limitada su funcionalidad si esas herramientas no logran adaptarse a los nuevos requisitos de autenticación. Asimismo, investigadores académicos que utilizan Reddit como corpus para estudios de lenguaje o sociología deberán solicitar acceso formal o recurrir a los dump de datos que Reddit publique oficialmente, lo que podría ralentizar ciertos proyectos.
Este escenario se inscribe en una tendencia más amplia: plataformas como Twitter, Stack Overflow y Wikipedia han revisado sus políticas de acceso ante el auge del scraping para entrenar IA. La diferencia radica en que Reddit posee una de las bases de datos de conversación más ricas y diversas de internet, lo que la convierte en un objetivo particularmente valioso. Mientras la compañía intenta equilibrar la apertura comunitaria con la protección de sus activos, el debate sobre quién tiene derecho a usar esos datos y bajo qué condiciones se intensifica.
En conclusión, las restricciones a Old Reddit no son solo un ajuste técnico; son un síntoma de la lucha por definir el futuro de los datos generados por usuarios en la era de la inteligencia artificial. Cómo Reddit navegue este equilibrio influirá no solo en su propia comunidad, sino también en el estándar que establezca para otras plataformas que enfrentan dilemas similares de acceso, privacidad y monetización.