28 julio, 2026

El gobierno de EE.UU. fuerza a Anthropic a suspender Fable 5 y Mythos 5 en todo el mundo; la empresa acata pero rechaza la decisión

Claude Fable 5 and Claude Mythos 5

Tres días después de su lanzamiento más ambicioso, Anthropic tuvo que apagar sus dos modelos más poderosos para todos sus usuarios en el mundo. No fue una decisión técnica. Fue una orden del gobierno de Estados Unidos.

El 12 de junio, el Departamento de Comercio emitió una directiva de control de exportaciones que prohibió el acceso a Claude Fable 5 y Claude Mythos 5 a cualquier ciudadano extranjero, independientemente de si se encuentra dentro o fuera del territorio estadounidense — incluyendo a los propios empleados de Anthropic con esa condición migratoria. El efecto práctico fue inmediato: para garantizar el cumplimiento, la empresa tuvo que deshabilitar ambos modelos para la totalidad de su base de clientes.

La acusación: un jailbreak con alcance limitado

Según el comunicado público de Anthropic, el gobierno no proporcionó detalles específicos sobre su preocupación de seguridad nacional. La empresa reconstruyó la situación a partir de evidencia verbal: las autoridades habrían tenido conocimiento de una técnica para eludir los filtros de seguridad de Fable 5 — un “jailbreak” — que en la demostración revisada se utilizó para identificar un número reducido de vulnerabilidades de software ya conocidas y de baja criticidad.

La respuesta de Anthropic fue contundente en tres puntos. Primero, que las vulnerabilidades identificadas son simples y detectables por otros modelos públicos disponibles en el mercado, incluido GPT-5.5 de OpenAI. Segundo, que la técnica observada no constituye un jailbreak universal — es decir, no es capaz de desbloquear ampliamente las capacidades restringidas del modelo, sino que actúa en un contexto muy específico. Tercero, que en ningún momento el gobierno presentó un caso donde esta técnica haya derivado en un resultado dañino concreto.

La defensa técnica de Anthropic

La empresa recordó que, antes del lanzamiento de Fable 5, sus salvaguardas fueron sometidas a miles de horas de pruebas de ataque coordinadas con el propio gobierno estadounidense, el Instituto de Seguridad en IA del Reino Unido (UK AISI), organizaciones privadas de ciberseguridad y equipos internos. Ningún evaluador logró encontrar un jailbreak universal. Anthropic también destacó que la política de retención de datos por 30 días — que generó fricciones con clientes corporativos — fue diseñada precisamente para detectar y responder rápidamente a cualquier ataque exitoso contra los filtros.

La posición de la compañía es que la seguridad perfecta no existe para ningún proveedor de modelos de IA, y que su estrategia de defensa en profundidad reduce los riesgos de Fable 5 a niveles comparables con los de otros modelos ya desplegados masivamente en la industria.

El desacuerdo que queda en el registro

nthropic acató la directiva. Pero no guardó silencio.

En su declaración pública, la empresa afirmó que discrepa con la decisión y advirtió sobre el precedente que establece: si el hallazgo de un jailbreak no-universal y de alcance estrecho es suficiente para retirar del mercado un modelo comercial desplegado para cientos de millones de personas, ese estándar haría imposible el lanzamiento de cualquier nuevo modelo de frontera para cualquier empresa del sector.

La empresa también cuestionó el proceso: señaló que el gobierno debería contar con mecanismos legales para bloquear despliegues inseguros, pero que dicho proceso debe ser transparente, justo, claro y técnicamente fundamentado. La acción del 12 de junio, en su evaluación, no cumplió ninguno de esos criterios.

¿Por qué importa? Este episodio es más que un conflicto entre una empresa y un regulador. Es el primer caso documentado en que el gobierno de Estados Unidos invoca controles de exportación para suspender el acceso global a un modelo de IA comercial, sin proceso público ni evidencia técnica compartida. El resultado fue que usuarios en México, Europa, Asia y el resto del mundo perdieron acceso a una herramienta por una decisión tomada en Washington sobre la base de una demostración verbal. La pregunta que queda abierta es si esto es el comienzo de una nueva era de regulación unilateral de la IA — o un error de calibración que se resolverá en días.

 

 

📚 FUENTES CONSULTADAS

Antropic