Fable 5: el modelo que ni su propia creadora se atrevió a soltar sin permiso del gobierno

Anthropic lanzó el razonador más bestia que ha probado esta redacción. Tres días después, el gobierno de EEUU le puso un bozal y la propia empresa apagó el interruptor antes de que se lo pidieran dos veces.

10 min de lectura Actualizado el

En este artículo

El modelo que Anthropic tenía guardado en un cajón

Antes de hablar de bozales y decretos, hay que entender de dónde viene Fable 5. Y para eso hay que retroceder hasta abril de 2026, cuando Anthropic restringió Claude Mythos Preview (el hermano mayor de lo que hoy conocemos como Mythos 5) a un grupo selecto de empresas bajo el llamado Project Glasswing.

¿El motivo? Encontraba vulnerabilidades cibernéticas demasiado bien. Tan bien que la propia Anthropic decidió no soltarlo al público general.

Esto es importante porque no es un dato menor: es el precedente que explica todo lo que vino después. Cuando una empresa restringe su propio producto porque es "demasiado bueno" en ciberseguridad ofensiva, no está haciendo teatro regulatorio. Está reconociendo que tiene entre manos algo con capacidad de doble uso real: lo mismo que ayuda a un equipo de seguridad a tapar un agujero, ayuda a alguien con malas intenciones a abrirlo.

Con ese antecedente en la mochila, Anthropic lanzó Fable 5. Y aquí es donde entra mi experiencia personal con el modelo, porque lo he usado y el razonamiento está a otro nivel. Encadena problemas complejos de una forma que a otros modelos les cuesta desmontar, con una profundidad de análisis que se nota especialmente en tareas donde hay que sostener varios pasos lógicos sin perder el hilo.

Pero (y este pero es el que de verdad importa) el consumo de tokens es una barbaridad. No es un modelo para el día a día. Es como pagar un taxi que nunca para el contador: cada pensamiento extra que genera el modelo para razonar mejor tiene un coste, y ese coste se dispara rápido. Yo solo lo uso cuando tengo una tarea que ningún otro modelo resuelve bien. Para todo lo demás, es tirar dinero por el desagüe.

Guarda ese dato, porque va a volver a aparecer más adelante en la historia, cuando hablemos de la promoción de tokens con la que Anthropic intentó arreglar el estropicio.

12 de junio: el gobierno aprieta y Anthropic aprieta más

El 12 de junio de 2026, el Departamento de Comercio de Estados Unidos emitió controles de exportación que restringían el acceso de personas no estadounidenses tanto a Fable 5 como a Mythos 5. Hasta aquí, una directiva gubernamental más, de las que llegan y se aplican con matices.

Lo que hizo Anthropic no fue aplicar matices. Bloqueó el acceso a todo el mundo, incluidos sus propios empleados extranjeros. No solo clientes fuera de EEUU: su propia plantilla internacional se quedó sin acceso a los modelos que ellos mismos habían construido.

Esa reacción, más allá de lo que pedía la orden, es la pista más clara de que Anthropic no estaba del todo tranquila con lo que tenía entre manos. Si la orden pedía restringir el acceso extranjero y la empresa decidió apagar el interruptor entero, alguien dentro de Anthropic hizo un cálculo de riesgo que iba más allá de cumplir el papeleo.

Según un reportaje de Axios citado en la cobertura del caso, la administración señaló un jailbreak que saltaba las salvaguardas de Fable 5 en tareas de ciberseguridad, química y biología. Ese es el tipo de combinación que enciende alarmas en cualquier despacho de Washington: no es "el modelo dice groserías", es "el modelo puede ayudarte a construir algo peligroso si sabes cómo preguntarle".

Lo que se sabe ahora, con más detalle, es que fue el secretario de Comercio Howard Lutnick quien envió la carta que forzó a Anthropic a suspender el acceso a ambos modelos en menos de 90 minutos. Y que la propia Anthropic declaró que el gobierno "no proporcionó detalles específicos de su preocupación de seguridad nacional": cualquier evidencia del jailbreak llegó de forma verbal, sin informe técnico documentado.

Para el contexto regulatorio completo de cómo se construyó esa presión y qué ocurrió durante los 19 días que siguieron, lo tienes desarrollado en Anthropic y los controles de exportación: 19 días de restricciones sin explicación y el levantamiento que huele a rendición.

La versión de Anthropic: "minor" y "relatively simple"

Aquí es donde el relato se parte en dos, y conviene no quedarse con una sola mitad.

Anthropic reconoció el jailbreak, sí. Pero su versión es mucho más modesta que la del gobierno. La compañía aseguró que solo recibió "evidencia verbal" (ni un informe técnico detallado, ni una prueba de concepto documentada) de lo que describieron como un jailbreak "estrecho y no universal", que encontraba vulnerabilidades de software "menores" y "relativamente simples".

Además, Anthropic añadió un argumento incómodo para el propio gobierno: otros modelos, como GPT-5.5, tienen capacidades similares. Su razonamiento es simple y tiene lógica de negocio detrás: si retiras un modelo por un jailbreak de este calibre, tendrías que parar el despliegue de prácticamente todos los modelos de frontera del mercado, no solo el suyo.

Es un argumento válido en el sentido de que apunta a una inconsistencia regulatoria real. Pero también es exactamente lo que diría cualquier empresa que quiere recuperar el acceso a su producto estrella lo antes posible. Ninguna de las dos cosas es incompatible con la otra: puede ser cierto que la vulnerabilidad fuera menor Y que a Anthropic le convenga minimizarla en público.

Lo que no consta (y aquí hay que ser honestos con las lagunas) es el mecanismo exacto del jailbreak, ni si explotaba algo específico de la arquitectura de Fable 5 o era una técnica más genérica. Sin eso, juzgar quién tiene razón es, como mínimo, prematuro.

El contexto que nadie menciona: Trump ya había puesto el marco

Este episodio no salió de la nada. A principios de junio de 2026, antes incluso del bloqueo del día 12, el presidente Trump firmó una orden ejecutiva pidiendo a las empresas de IA que se sometieran voluntariamente a pruebas de seguridad gubernamentales. Esa orden marcó un giro claro: la Casa Blanca estaba subiendo el foco sobre la seguridad de los modelos de frontera antes de que estallara el caso Fable.

Así que cuando llegó el bloqueo del 12 de junio, no fue un rayo en cielo despejado. Fue la primera aplicación práctica de un marco que ya estaba en marcha.

26 de junio: un levantamiento a la carta, no una solución técnica

Catorce días después del bloqueo total, el 26 de junio, la administración Trump levantó parcialmente la prohibición. Pero no de cualquier manera: permitió que Mythos 5 fuera accesible para más de 100 agencias gubernamentales y empresas estadounidenses específicas, incluyendo a sus empleados no estadounidenses y a los propios empleados extranjeros de Anthropic.

Fíjate en el matiz, porque es la clave de todo el episodio: esto no fue un arreglo técnico del modelo. No hubo un parche que corrigiera la vulnerabilidad y permitiera reabrir el grifo para todo el mundo por igual. Fue una lista cerrada de organizaciones consideradas de confianza.

El secretario de Comercio, Howard Lutnick, justificó la decisión citando "salvaguardas apropiadas". Pero esas salvaguardas nunca se detallaron públicamente. No sabemos si son técnicas (limitaciones al modelo), contractuales (acuerdos de uso) o puramente administrativas (autorización caso por caso). Ese vacío de información importa, porque significa que el criterio para decidir quién puede usar un modelo de IA de frontera dejó de ser "supera estos controles de seguridad" y pasó a ser "estamos en la lista de confianza de alguien".

Anthropic, por su parte, celebró el movimiento en redes sociales, subrayando que Mythos 5 podía redesplegarse para entidades que "operan y defienden infraestructura crítica" (un mensaje que reposiciona el modelo como herramienta defensiva, no ofensiva, justo cuando más lo necesitaba de cara a la opinión pública).

Lo que la directiva del 26 de junio no resolvió fue el caso de Fable 5. Ese modelo se quedó fuera del acuerdo, sin fecha ni explicación, durante días más.

30 de junio y 1 de julio: la vuelta de Fable, con reloj de arena

El 30 de junio, Anthropic anunció que el Departamento de Comercio había levantado los controles de exportación sobre ambos modelos, Fable 5 y Mythos 5. Al día siguiente, 1 de julio, la compañía restauró el acceso a Fable 5.

Pero aquí viene la letra pequeña que separa un titular optimista de la realidad: la restauración vino acompañada de una promoción por tiempo limitado. Los suscriptores de pago recibieron hasta el 50% de sus límites semanales de tokens dedicados específicamente a Fable 5, válida solo hasta el 7 de julio de 2026 a las 23:59:59 hora del Pacífico.

No es un modelo "gratis" ni un regalo aparte: es un porcentaje de los tokens que esos suscriptores ya pagaban dentro de su plan, reasignado temporalmente a Fable 5. Y no es una vuelta permanente. Es una promo con fecha de caducidad, sin ninguna confirmación pública de qué pasa después del 7 de julio ni si el acceso se mantendrá, se recortará o volverá a las condiciones previas al bloqueo.

Aquí es donde vuelve a entrar mi experiencia con el modelo. Si Fable 5 ya consumía tokens como un poseso en condiciones normales, una ventana de acceso ampliado y con fecha de corte es la peor combinación posible para usarlo mal: la tentación de "aprovechar" el 50% extra en tareas rutinarias, cuando el modelo solo tiene sentido económico para lo que ningún otro puede resolver.

Todo este episodio no ocurre en el vacío corporativo. Anthropic presentó confidencialmente un borrador de S-1 el 1 de junio de 2026, es decir, está en plena preparación de una salida a bolsa. Y en marzo de 2026 ya arrastraba una batalla legal por haber sido etiquetada como "riesgo de cadena de suministro" por el Secretario de Defensa.

Esto cambia el cálculo de incentivos de la empresa. Una compañía que se prepara para salir a bolsa tiene motivos de sobra para minimizar públicamente cualquier hallazgo de seguridad que pueda espantar a inversores, y también para llegar a acuerdos rápidos con el gobierno en lugar de librar una batalla pública prolongada. No digo que esto invalide su versión de los hechos sobre el jailbreak "menor" y "relativamente simple". Digo que hay que leerla sabiendo qué hay en juego para quien la firma.

Y en paralelo, la propia dinámica del sector (modelos de razonamiento cada vez más capaces de encontrar vulnerabilidades) tiene comparación directa con lo que están haciendo otros competidores chinos en el mismo terreno. Si te interesa ver cómo se posiciona la competencia frente a Mythos en capacidades de ciberseguridad, lo analizamos en GLM-5.2 vs Mythos: ¿nuevo sheriff chino en ciberseguridad o humo con acento de Pekín?.

Qué te llevas de todo esto

Un modelo puede pasar de "el más capaz en razonamiento que hemos probado" a "inaccesible para todo el mundo, incluidos los empleados de quien lo creó" en apenas 72 horas, y la decisión no vino del mercado ni de un fallo técnico confirmado públicamente: vino de una directiva gubernamental sobre controles de exportación.

La propia empresa que construyó el modelo reaccionó con más dureza de la que exigía la orden original, bloqueando a todo el mundo quince días antes de que hubiera ni siquiera un levantamiento parcial. Eso dice más sobre su nivel real de confianza en las salvaguardas que cualquier comunicado optimista.

El levantamiento del 26 de junio no fue un arreglo técnico universal: fue una lista de confianza de más de 100 organizaciones seleccionadas, con criterios de "salvaguardas apropiadas" que nunca se detallaron. Y la vuelta de Fable 5 el 1 de julio llegó con reloj de arena: una promoción de tokens que caduca el 7 de julio, no una restauración permanente.

Sobre si todo esto es un avance real de seguridad o un parche temporal mientras se cierra un acuerdo más amplio entre la Casa Blanca y las grandes de la IA, no hay manera honesta de saberlo con lo que hay público hoy. Lo único verificable es la secuencia de fechas, y esa secuencia dice que la empresa que construyó el modelo fue la primera en cortarle el grifo, sin que nadie se lo tuviera que pedir dos veces.

Fuentes

  1. Anthropic shuts down Fable, Mythos models following Trump admin directivearstechnica.com · 2026-06-13
  2. The Moral Of Anthropic’s Fable: Model Access Is Powerforbes.com · 2026-06-13
  3. Anthropic restores access to Fable 5 after negotiations with White Housebusinessinsider.com · 2026-07-01
  4. Trump administration releases Anthropic Mythos to be used by more than 100 US companies, agencies | TechCrunchtechcrunch.com · 2026-06-27