El gobierno suspendió la IA que lideró los benchmarks en 72 horas: qué es Claude Fable 5 y cuánto cuesta

Featured Image
06.16.2026
 · 
17 min read

Claude Fable 5: qué es, cuánto cuesta y por qué el gobierno lo suspendió en 72 horas

Claude Fable 5 fue la IA mas potente del planeta. Duro 72 horas. Anthropic lo lanzo al publico el 9 de junio de 2026, debuto #1 en el Intelligence Index con 80.3% en SWE-Bench Pro, cuesta 10/50 dolares por millon de tokens (el doble que Opus 4.8), y el gobierno de EE.UU. lo forzo offline tres dias despues por una directiva de control de exportaciones.

Respuesta corta, si tienes treinta segundos: Claude Fable 5 es la version publica del modelo clase Mythos de Anthropic, el mas inteligente que existia en junio de 2026. Cuesta el doble que Opus 4.8 por token (10 dolares input, 50 output por millon), aunque en uso real medido sale alrededor de 40% mas caro porque gasta menos tokens. Vale la plata en trabajo agentico complejo y de alto riesgo, no la vale en copy, research o tareas de alto volumen bien definidas. El gobierno de EE.UU. lo suspendio el 12 de junio por una directiva de exportacion tras un reporte de jailbreak, asi que hoy no se accede por los canales generales. Mientras vuelve, Opus 4.8 mas un metodo por capas hace el trabajo. Eso es todo lo esencial, el resto del articulo es el detalle que te deja decidir con cabeza y no con FOMO.

Estas viendo todo el hype de Claude Fable 5, el modelo de codigo mas potente que existe, primero en todos los benchmarks, y tienes la billetera en la mano lista para subir a MAX.

Pero hay un nudo en el estomago. Tu no codeas agentes ocho horas al dia, tu vives de marketing, growth, research, copy. Y nadie te dijo si para eso vale quemar dos o tres veces lo que pagas por Opus. Para rematar, escuchaste que ya lo banearon.

Imagínate decidir esto en tres minutos, con un arbol claro que te diga cuando soltar plata en Fable y cuando volver a Opus, entendiendo el costo real en dolares y no en tokens abstractos que nadie te tradujo, y pudiendo contar el arco lanzamiento-suspension como el que de verdad entiende, no como el que cayo en el hype. Eso es lo que arma este articulo.

Todos cubrieron el lado dev y el de seguridad, las peleas de SWE-Bench, los jailbreaks. Aqui te lo traduzco a tu mundo: que es, cuanto cuesta de verdad, cuando si y cuando no, y que hacer ahora que esta suspendido. Si lo que quieres es montar un sistema donde tu equipo de marketing use estos modelos como una maquina y no como un juguete caro, eso es exactamente lo que enseno en la inmersion de IA para equipos de marketing y ventas. Pero primero, lo importante, entender que compraste.

Tabla de contenido

  1. Que es Claude Fable 5 (y por que no es lo mismo que Mythos 5)
  2. En desarrollo: la saga de Claude Fable 5
  3. Cuanto cuesta de verdad: el calculo en dolares
  4. Fable 5 para marketing y growth: cuando si quemar la plata, cuando volver a Opus
  5. El classifier que te degrada a Opus solo (y por que la gente esta furiosa)
  6. Fable vs Opus 4.8 vs GPT-5.5 vs Gemini 3.1: la tabla real de benchmarks
  7. Que hacer AHORA que esta suspendido
  8. Lo que casi todos preguntan en ventas

Que es Claude Fable 5 (y por que no es lo mismo que Mythos 5)

Claude Fable 5 es el primer modelo de la clase Mythos que Anthropic abrio al publico, lanzado el 9 de junio de 2026 via la Claude API, AWS, Microsoft Foundry y planes Enterprise por consumo.

tablas comparativas de benchmarks Fable 5 vs Mythos 5 vs modelos previos
tablas comparativas de benchmarks Fable 5 vs Mythos 5 vs modelos previos. Fuente: Vellum AI

Aqui es donde casi todos se enredan, asi que vamos despacio. Fable 5 y Mythos 5 comparten el mismo modelo base, la diferencia esta en los frenos. Fable es la version con salvaguardas mas estrictas, la que sacaron para el publico, y Mythos es la version sin tantos frenos, que todavia no es publica. O sea, cuando alguien te diga "es que probe Mythos", lo mas probable es que este confundido, porque lo que abrieron fue Fable. Misma cabeza, distinto bozal.

Los numeros duros que importan: un millon de tokens de contexto, hasta 128 mil tokens de output, y un 80.3% en SWE-Bench Pro contra 69.2% de Opus 4.8, un gap de mas de once puntos. Ese salto de once puntos no es maquillaje, en benchmarks de codigo eso es brutal.

El nombre tampoco es casualidad, y vale entenderlo porque despues se vuelve chiste cruel. "Fable" es fabula, el cuento con moraleja. Anthropic lo bautizo asi porque es la version domesticada, la que cuenta la historia segura. Lo que nadie previo es que la moraleja terminaria siendo otra: te lo mostraron, te emocionaste, y se apago antes de que pasaras la primera pagina. Pero a eso volvemos en el arco.

Y guarda esta idea, porque es la base de todo el calculo de plata: lo barato hace el 80%, lo caro solo remata. Construye lo que puedas en modelos gratis y reserva el tier top para el ultimo tramo donde la inteligencia extra de verdad cambia el resultado. A esa logica volvemos completa mas abajo, donde de verdad acciona. Si vienes siguiendo la evolucion de estos modelos desde el principio, el contexto historico esta en Claude, la IA que todo marketer necesita, que es la base de todo este cluster.

En desarrollo: la saga de Claude Fable 5

Lo que va pasando con Fable 5, lo mas reciente primero. Esta seccion se actualiza conforme avanza la historia.

16 de junio de 2026, sigue suspendido y sin fecha de regreso. Anthropic mantiene cerrado el acceso a Fable 5 y Mythos 5 mientras resuelve el tema de seguridad con el gobierno. La postura oficial es que vuelve cuando se parchee, pero no hay fecha. Quien pago MAX por Fable se quedo esperando.

12 de junio de 2026, el gobierno de EE. UU. lo fuerza offline. A unas 72 horas del lanzamiento, una directiva de control de exportaciones suspende el acceso. El detonante: Amazon, por boca de su CEO Andy Jassy, alerto a la Casa Blanca de un jailbreak. David Sacks dice que la restriccion se levanta cuando Anthropic parchee, y acusa a la empresa de haberse negado a arreglarlo antes. Anthropic da su propia version, asi que hay disputa publica. Fortune, Tom’s Hardware.

11 de junio de 2026, Microsoft lo saca de su Copilot interno. No por calidad, sino por la retencion obligatoria de datos de 30 dias, incompatible con su politica de Zero Data Retention. Microsoft sigue ofreciendolo a clientes externos via Foundry. mlq.ai.

9 de junio de 2026, lanzamiento: “una bestia” que quema tokens. Fable 5 debuta numero uno en el Artificial Analysis Intelligence Index con 64.9 puntos y 80.3% en SWE-Bench Pro. Simon Willison lo llama “something of a beast” y gasta 110.42 dolares en tokens en un solo dia. Nathan Lambert advierte sobre el classifier silencioso: un modelo que se vuelve menos inteligente sin avisar es, en sus palabras, IA desalineada. Simon Willison, Interconnects.

Cuanto cuesta de verdad: el calculo en dolares

Fable 5 cuesta 10 dolares por millon de tokens de input y 50 por millon de output, exactamente el doble que Opus 4.8. Pero el numero que de verdad asusta no es ese, es lo que se evapora en una sola sesion.

InputFable $10/MOpus $5/M
OutputFable $50/MOpus ~$25/M
Ejemplo real2.3M tokens = $115
Costo Fable 5 vs Opus 4.8

Un solo code review de 92 dolares que ni siquiera termino. Asi se siente el precio cuando lo dejas correr sin control.

La gente pregunta el costo en tokens y nadie lo traduce a dolares por tarea. Asi que vamos con casos reales, de los que ponen la piel de gallina.

Simon Willison gasto 110.42 dolares en tokens en 24 horas, consumiendo de un tiron buena parte de su plan mensual de 100 dolares. Otro dev quemo 92 dolares en un solo code review que ni siquiera termino. Una tarea de 2.3 millones de tokens, 115 dolares ahi mismo. La sensacion general en la comunidad fue la misma: Fable come tokens rapido y un presupuesto que te duraba semanas se evapora en un dia.

El famoso "consume el doble" es mentira a medias.

Andres OspinaGrowth Marketing

Todo lo que publico aquí es gratis. Implementarlo contigo tiene precio.

Si algo de lo que leíste te hizo pensar "esto me está pasando", hablemos. Te respondo el mismo día.

Agendar 30 min →

Ese titular sale del limite de 5 horas en Cowork, NO del limite semanal. Y cuando un dev se sento a medir el costo real en dolares, no en sensacion, descubrio que Fable salio solo alrededor de 40% mas caro que Opus, no el doble. ¿Por que? Porque Fable usaba menos tokens para llegar al mismo resultado. Mas caro por token, si, pero mas eficiente en cantidad. El precio es 10/50 por millon, el doble de Opus 4.8, y segun Anthropic mas del 95% de las sesiones corren sin fallback, o sea menos del 5% caen a Opus, un detalle que importa muchisimo y que desarrollo en la seccion del classifier.

Aterrizemoslo en plata de verdad, porque "10/50 por millon" no le dice nada a nadie que no sea ingeniero. Una sesion de coding agentico seria consume facil entre 1 y 3 millones de tokens entre input y output. En el rango bajo hablas de 20 a 40 dolares por sesion, en el alto te vas a 100 o mas. Si tu mes operativo de IA eran 100 dolares con Opus, un par de dias jugando con Fable en loop sin control te lo come entero, que es exactamente lo que le paso a Willison. La trampa no es el precio por token, es que el modelo es "relentlessly proactive", como lo describio el mismo Willison: arranca a desplegar herramientas, subagentes y verificaciones por su cuenta, y cada una de esas acciones es plata corriendo. Lo que te ahorra en tiempo te lo cobra en tokens.

Entonces, ¿es carisimo? Depende de como lo uses. Si lo dejas corriendo en loop agentico sin control, te vacia el bolsillo en una tarde. Si lo usas con cabeza, el premium real es mas cercano al 40% que al 100%. La cuenta que de verdad importa no es "cuanto cuesta el token", es "cuanto vale la hora que me ahorra". Si Fable resuelve en dos horas algo que te tomaba dos dias, 100 dolares de tokens contra dos dias de tu tiempo no es ni discusion. Si lo que le pides es reescribir un email que Opus hace igual, esos mismos 100 dolares son plata tirada. El precio nunca se evalua solo, se evalua contra lo que reemplaza. Para quien quiere la letra chica de como se factura todo esto, vale ver el desglose de precio de Claude Code.

Fable 5 para marketing y growth: cuando si quemar la plata, cuando volver a Opus

Para marketing y growth, la respuesta corta es esta: Fable 5 vale la plata en trabajo agentico complejo y de alto riesgo, y NO la vale en copy, research o tareas de alto volumen bien definidas, donde Opus o Sonnet hacen el mismo trabajo por una fraccion.

arbol de decision: tres rutas para elegir modelo segun la tarea

La regla no es "el mas potente". Es saber donde la inteligencia extra cambia el resultado y donde solo te cuesta plata.

Este es el angulo que nadie cubrio, y es el corazon del articulo. Toda la conversacion fue sobre SWE-Bench, sobre devs, sobre seguridad. Cero personas tradujeron que significa Fable 5 para alguien que vive de copy, de research de mercado, de automatizar pipelines de growth. Aqui va el arbol de decision en lenguaje de marketer:

  • SI Fable → automatizacion multi-paso de alto riesgo, un frontend dificil, un flujo donde un error te rompe el tracking o te manda mal los leads → ahi el premium se paga solo.
  • NO Fable, vuelve a Opus → copy, research de mercado, drafts, clasificacion de leads, cualquier tarea de alto volumen y bien definida → Opus hace lo mismo por la mitad, quemarias plata sin cambiar el resultado.

Para que no quede en abstracto, bajemoslo a tu semana real. ¿Cuando si soltar la plata? Cuando montas un flujo de attribution que cruza HubSpot con la pauta y un error te manda los leads a la campana equivocada, cuando construyes un dashboard interno que tu equipo va a usar todos los dias y tiene que estar bien la primera vez, cuando automatizas un pipeline de scoring que toca datos de clientes y una pifia te ensucia el CRM. Ahi el riesgo de error es caro y la inteligencia extra te lo evita, el premium se justifica solo. ¿Cuando volver a Opus o Sonnet? Cuando generas cincuenta variantes de copy para testear, cuando le pides research de mercado que vas a revisar igual con tus ojos, cuando clasificas leads contra reglas que ya escribiste tu, cuando produces borradores que de todos modos vas a editar. Volumen, rutina, tareas bien definidas: ahi el modelo caro no cambia el output, solo cambia tu factura.

Boris Cherny describio a Fable como el primer modelo que se sentia "tan metodico y preciso, tomando mediciones, agregando logs y verificando" su propio trabajo. Para un sistema de automatizacion de growth donde una pifia te rompe un flujo entero, eso vale oro.

Pero el consenso sobre el otro lado fue brutal y honesto. Un dev lo puso sin anestesia: "most people just don't need the very top frontier models, for most of my work it wasn't worth the cost". Y mi favorita, por lo grafica: "Fable se sentia como ir en limusina, y ahora volvemos a una bicicleta". La bicicleta te lleva igual al trabajo, la limusina cuesta cinco veces mas para llegar al mismo sitio.

La regla de oro no es "el mas potente para todo", es saber donde la inteligencia extra cambia el resultado de tu chamba de los martes y donde solo te cuesta plata. Si quieres ver el ROI cuando SI vale el costo alto, mira el caso de 8 horas a 11 segundos con Claude Code, que es exactamente el tipo de tarea donde el modelo caro se paga solo. Y si todo esto te suena util pero no sabes por donde empezar a meter estos modelos en tu operacion, el playbook de Claude para marketing es el mapa completo.

El classifier que te degrada a Opus solo (y por que la gente esta furiosa)

"¿Por que me baja a Opus sin avisarme?" Esa pregunta tiene a medio Twitter furioso, y con razon. Fable 5 te degrada en silencio: menos del 5% de las tareas caen a un fallback de Opus sin decirte nada (Anthropic dice que mas del 95% de las sesiones no tienen fallback), y en temas de ciber, bio o quimica directamente bloquea o degrada la respuesta.

Para alguien que solo juega, da igual. Para alguien que depende del modelo en produccion, esto es una pesadilla. Estas corriendo un flujo de automatizacion legitimo, pagando precio premium, y el modelo decide solo que esa peticion merece menos inteligencia. Trabajo que funcionaba ayer, hoy sale peor, y no sabes por que.

Nathan Lambert lo dijo sin filtro, y es el take mas afilado de toda la polemica: un modelo que se vuelve menos inteligente automaticamente, sin avisarte, es categoricamente IA desalineada. No "molesto", no "mejorable", desalineada por diseno. Y tiene razon en algo incomodo, la inconsistencia. El classifier es "jumpy", rechaza la misma peticion que acepto hace un rato, y en una sesion nueva la deja pasar. Gente trabajando con imagen medica, automatizacion de laboratorio o firmware se topo con bloqueos a trabajo perfectamente legitimo.

Y hay un dato contrarian que casi nadie cubrio, porque no encaja con el hype. Endor Labs destapo lo que llamaron "record cheating": 38 de 200 instancias de su benchmark con trampa confirmada, 33 de ellas por memorizacion de training data. Un parche de numpy salio 100% identico al golden patch, 34 lineas verbatim. O sea, en algunos casos el modelo no estaba resolviendo, estaba recordando la respuesta que ya habia visto. Eso no invalida los 80 puntos de SWE-Bench, pero el record mas llamativo no fue de inteligencia, fue de memoria con disfraz.

Una pregunta legitima que floto en Hacker News y que vale oro: si las salvaguardas de Fable prohiben tocar temas de seguridad, ¿como hicieron auditorias de seguridad con el? La respuesta corta es que el classifier es inconsistente, y esa inconsistencia es justo el problema.

Fable vs Opus 4.8 vs GPT-5.5 vs Gemini 3.1: la tabla real de benchmarks

¿Es Fable 5 mejor que GPT-5.5 y Gemini 3.1? Si, en inteligencia general lidera, pero no en todo, y ese matiz es el que separa la decision inteligente del que solo mira specs.

grafica del Intelligence Index con Fable 5 #1 (64.9) vs GPT-5.5, Gemini 3.1, Opus 4.8
grafica del Intelligence Index con Fable 5 #1 (64.9) vs GPT-5.5, Gemini 3.1, Opus 4.8. Fuente: Artificial Analysis
ModeloIntelligence IndexSWE-Bench ProPrecio output /M
Claude Fable 564.980.3%$50
Claude Opus 4.861.469.2%$25
GPT-5.56058.6%$30
Gemini 3.15754.2%$12
Fable 5 vs Opus 4.8 vs GPT-5.5 vs Gemini 3.1 (junio 2026)

Donde lidera, lidera claro. Primer lugar en el Intelligence Index, encabeza Humanity's Last Exam con 53% contra el 46% de Opus, gana AA-Omniscience con 40 contra 33. En SWE-Bench Pro les saca mas de veinte puntos a GPT-5.5 y a Gemini 3.1. Si tu vara es "el modelo mas inteligente del mundo en junio de 2026", Fable se la lleva sin discusion.

Pero la potencia no es uniforme, y aqui esta el detalle que mata el cuento del modelo perfecto. En el benchmark de codigo seguro de Endor Labs, Fable quedo a mitad de tabla: 59.8% de FuncPass y apenas 19.0% de SecPass. O sea, escribe codigo que funciona, pero no necesariamente codigo seguro. Para un marketer que automatiza flujos con datos de clientes, ese 19% deberia hacerte levantar la ceja.

Hay un matiz mas que casi nadie aterrizo bien, y es donde se siente la diferencia. Segun la gente que lo probo a fondo, "la conversacion ordinaria no se sintio dramaticamente distinta a Opus 4.8, pero el frontend duro y el coding agentico si". Traducido: si tu uso del modelo es escribir, conversar, resumir o sacar ideas, la mejora de Fable sobre Opus es marginal y no justifica el premium. La diferencia gorda aparece solo cuando lo pones a hacer trabajo agentico largo, con muchos pasos encadenados, donde un razonamiento ligeramente mejor en cada paso se acumula en un resultado muy superior al final. Por eso el numero de SWE-Bench impresiona y el de una charla normal no: el benchmark mide justo el escenario donde Fable brilla.

El numero uno en benchmarks no es lo mismo que el numero uno para lo que haces. Si tu trabajo vive en razonamiento duro, ahi brilla, y si vive en seguridad de codigo o en volumen, hay opciones que rinden igual por menos. Para el otro lado del tablero de herramientas, Claude Code vs Cursor te lo aterriza al stack diario.

Que hacer AHORA que esta suspendido

Lo primero: si pagaste MAX por Fable y te quedaste sin acceso, no estas solo, y no hay una respuesta limpia todavia. El ban es por directiva de exportacion del gobierno, no por decision de Anthropic, asi que el "que pasa con mi suscripcion" sigue en el aire.

ilustracion editorial plan B tres rutas de fallback

Todos contaron que lo apagaron, ninguno te dijo que usar mientras tanto. Aqui van las tres rutas.

Ruta 1, el metodo por capas. Esta es la mas inteligente, y la que prometi arriba. Construye en modelos baratos o gratis, haz el 80% del trabajo ahi, y reserva el tier top solo para rematar el output final, ese ultimo tramo donde la calidad de verdad cambia el resultado. Asi, cuando Fable vuelva, ni siquiera vas a quemar lo que quemaste antes, porque lo vas a usar donde duele menos y rinde mas. Esta logica funciona con o sin Fable, y es la que te blinda contra el proximo modelo carisimo que salga el mes que viene.

Ruta 2, Opus 4.8 como caballo de batalla. Para casi todo el trabajo de marketing y growth, Opus 4.8 hace el trabajo. El propio fallback de Fable era Opus, asi que ya lo estabas usando sin saberlo en esa fraccion de tareas que caian de vuelta. La bicicleta te lleva al trabajo igual.

Ruta 3, esperar el levantamiento del control. La postura oficial es que si Anthropic remedia el problema de seguridad, el control se levanta y Fable vuelve. No hay fecha. Y aqui hay una capa que importa para founders y empresas fuera de EE.UU. construyendo sobre infraestructura americana: cuando el acceso al mejor modelo depende de una directiva de exportacion de un gobierno, tu roadmap de producto tiene un punto de falla que no controlas. Eso es estrategia, no un detalle tecnico.

Lo resume bien quien pago: "subi a MAX para disfrutar los 12 dias de Fable, pero todo era una fabula despues de todo, dos dias y ya no estaba, ahora vuelvo a pro". Para entender las alternativas dentro del mismo ecosistema mientras esto se resuelve, vale ver que es Claude Cowork, porque ahi vive parte del lio del limite de las 5 horas. Y si nunca montaste el flujo de capas y no sabes por donde arrancar, el tutorial paso a paso de Claude Code te deja la base lista para cuando Fable regrese.

Lo que casi todos preguntan en ventas

Las preguntas reales que aparecen en YouTube, Hacker News y cada conversacion sobre implementar esto.

¿Que es Claude Fable 5 y en que se diferencia de Mythos 5? Mismo modelo base, distintos frenos. Fable tiene salvaguardas mas estrictas y es la version publica, Mythos no tiene tantos frenos y todavia no salio. Si alguien te dice que probo Mythos, casi seguro probo Fable.

¿Cuanto cuesta y vale la pena contra Opus 4.8? El doble por token (10/50 por millon), pero en uso real fue alrededor de 40% mas caro porque gasta menos tokens. Vale la pena solo en trabajo agentico complejo de alto riesgo. En copy y research, ni lo mires.

¿Por que lo sacaron de circulacion? Directiva de control de exportaciones de EE.UU., disparada por un jailbreak que Amazon, via su CEO Andy Jassy, escalo a la Casa Blanca. David Sacks dijo que volveria cuando Anthropic lo arregle, aunque acusa a Anthropic de haberse negado a parcharlo antes. O sea, ni Anthropic decide sola cuando regresa.

¿Es mejor que GPT-5.5 y Gemini 3.1? En inteligencia general si, lidera claro con 64.9 de Index. En codigo seguro queda a mitad de tabla con 19% de SecPass. Depende de la tarea.

¿Como lo accedo ahora que esta suspendido y que pasa con mi suscripcion? Por ahora no se accede por los canales generales, y la situacion de las suscripciones MAX sigue sin resolverse del lado de Anthropic. Mientras tanto, Opus 4.8 y el metodo por capas.

¿Por que me degrada a Opus sin avisar y como lo blindo en produccion? Por el classifier, que cae a fallback en menos del 5% de tareas y es "jumpy", acepta una peticion y rechaza la misma minutos despues. Para blindarte, no dependas de un solo modelo en flujos criticos y monitorea las salidas, porque la degradacion es silenciosa.

¿De verdad consume el doble de tokens? No. El "doble" es del limite de 5 horas en Cowork. En dolares medidos fue alrededor de 40% mas, porque usa menos tokens para el mismo resultado.

¿Sirve para mi equipo de marketing o es solo para devs? Sirve, pero no para lo que primero pensarias. No lo metas a escribir copy ni a sacar research, eso lo hace Opus por la mitad. Lo que si vale es ponerlo a construir la infraestructura de tu growth: los flujos de automatizacion, los dashboards internos, los pipelines de datos donde un error sale caro. El modelo no reemplaza a tu equipo, le construye las maquinas que tu equipo despues opera.

Andrés Ospina

Andrés Ospina

Growth Marketer & Estratega de IA

16 años construyendo sistemas de crecimiento para startups como Kayak, RD Station, Platzi y CodeGPT. Construyo lo que la mayoría terceriza.

El gobierno suspendió la IA que lideró los benchmarks en 72 horas: qué es Claude Fable 5 y cuánto cuesta