Anthropic, la empresa fundada por ex‑OpenAI, ha anunciado hoy el lanzamiento de dos nuevas variantes de su modelo de lenguaje Claude: la versión pública Claude Fable 5 y la edición restringida Claude Mythos 5. Ambos comparten la misma base de arquitectura, pero difieren radicalmente en sus estrategias de mitigación de riesgos y en las políticas de acceso.

El anuncio llega en un momento en que el debate sobre la seguridad de los modelos de lenguaje genera cada vez más atención. Desde la fase inicial de GPT‑3, los proveedores han buscado equilibrar la potencia creativa de sus sistemas con la necesidad de evitar contenidos dañinos, manipulaciones y fraudes. Anthropic, que se ha posicionado como pionera en la “seguridad por diseño”, ha intentado una doble vía: ofrecer una solución más accesible para los usuarios generales y, al mismo tiempo, proporcionar una herramienta altamente robusta para clientes que requieren garantías adicionales.

¿Qué es Claude Fable 5?

Claude Fable 5 se presenta como la versión “generally available” (GA) del modelo. A diferencia de su predecesor, Fable 4, que ya incluía clasificadores de contenido, la nueva versión incorpora un conjunto más estricto de filtros y un mecanismo de “puntuación de riesgo” en tiempo real. Esto significa que, al generar respuestas, el modelo evalúa continuamente la probabilidad de que el contenido sea dañino y, si la puntuación supera un umbral preestablecido, el texto se bloquea o se modifica.

Para los desarrolladores, Fable 5 ofrece una API estándar con nuevas opciones de “modo seguro” y “modo creativo”. El primero prioriza la precisión y la neutralidad, mientras que el segundo permite un mayor grado de libertad en la generación de contenido, aunque con un riesgo proporcionalmente mayor. Esta flexibilidad permite a las empresas adaptar el modelo a sus necesidades específicas, sin comprometer la seguridad.

Claude Mythos 5: el nivel de mayor seguridad

Mientras que Fable 5 se dirige al mercado amplio, Mythos 5 se mantiene bajo un esquema de acceso limitado. Anthropic ha decidido elevar las barreras de entrada, permitiendo su uso únicamente a organizaciones que atraviesen un proceso de evaluación exhaustivo. Además, Mythos 5 incorpora la tecnología de “Project Glasswing”, una capa adicional de supervisión que utiliza tanto algoritmos internos como revisores humanos para garantizar que el contenido generado cumpla con normas éticas estrictas.

El nuevo nivel Mythos‑Class introduce un “modo de auditoría”, donde cada respuesta del modelo se registra y se puede revisar en detalle. Esta característica es particularmente relevante para sectores regulados, como la salud o la banca, donde la trazabilidad y la responsabilidad son obligatorias. Al mismo tiempo, las medidas de mitigación en Mythos 5 incluyen desactivación de ciertas capacidades de generación de lenguaje que podrían generar desinformación, como los “hallucinations” de hechos.

¿Por qué es importante esta estrategia?

Anthropic está tomando una postura diferenciada frente a competidores como OpenAI y Meta. Mientras que OpenAI ha optado por un modelo “más abierto” con controles de contenido en la nube, Anthropic apuesta por un enfoque modular: el mismo motor de IA se adapta a distintos contextos mediante capas de seguridad variables.

Esta estrategia responde a dos tendencias del mercado:

  1. Regulación creciente: La Unión Europea y otras jurisdicciones están implementando leyes que exigen a los proveedores de IA una mayor transparencia y trazabilidad. Al ofrecer Mythos 5 con auditoría y supervisión humana, Anthropic se posiciona como un aliado potencial de gobiernos y corporaciones que deben cumplir con la normativa.

  2. Demanda de personalización: Las empresas ya no buscan simplemente un modelo de lenguaje; quieren soluciones que se ajusten a sus políticas internas y a su perfil de riesgo. Con Fable 5 y Mythos 5, Anthropic permite a los clientes elegir el nivel de protección que mejor se adapta a su negocio.

Impacto en el ecosistema IA

El lanzamiento de Claude Fable 5 y Mythos 5 también envía un mensaje al ecosistema de IA. La dualidad entre versiones públicas y restringidas sugiere una madurez en la gestión de riesgos que podría convertirse en estándar de la industria. Si otras empresas adoptan modelos similares, podríamos ver una mayor claridad en la forma en que se negocian los compromisos entre innovación y seguridad.

En resumen, Anthropic ha marcado un hito con la publicación de dos versiones de Claude que comparten la misma arquitectura pero ofrecen diferentes niveles de protección. Esta doble vía no solo refuerza la reputación de la empresa como líder en IA segura, sino que también establece un marco de referencia para la regulación y la adopción corporativa.

Para los profesionales tech que trabajan con IA, la noticia significa que ahora disponen de herramientas con un nivel de personalización y control sin precedentes. El futuro de los modelos de lenguaje parece orientarse hacia soluciones modulables, donde la seguridad no sea un simple añadido, sino un pilar fundamental del diseño.