Opus 5 es un modelo frontera. El problema es que Fable 5 también lo es, y cuesta la mitad

Anthropic lanza Opus 5 al mismo precio que Opus 4.8 y casi a la par de Fable 5 en coding agéntico. No es un impostor con traje caro: es el diario driver que Anthropic quiere que uses todos los días. La pregunta útil no es si es frontera. Es si te sale a cuenta.

14 min de lectura

En este artículo

El Cuñado ya lo ha decidido

El Cuñado dice: "Bro, Anthropic acaba de soltar Opus 5 y es otro nivel. Se carga a Fable, se carga a GPT y va a dejar obsoleto todo lo que tenías montado. Si no migras ya, te comes el polvo."

La realidad es: Opus 5 salió el 24 de julio de 2026 al mismo precio que Opus 4.8 ($5 por millón de tokens de entrada y $25 por millón de salida). Es un modelo frontera, como lo fueron sus predecesores, pero no tumba a Fable 5: se acerca a él en codificación agéntica pagando aproximadamente la mitad. Las mejoras sobre Opus 4.8 son reales en los benchmarks de Anthropic, pero iterativas. El atractivo principal es token efficiency: más trabajo útil por el mismo billete.

Por qué importa saberlo: si montas tu stack creyendo que "el modelo nuevo lo cambia todo", vas a pagar de más, a acoplarte a un proveedor y a ignorar lo que de verdad está moviendo el mercado: routers de modelos, pesos abiertos y coste del trabajo terminado, no del token suelto.

Eso es el desmontaje. Ahora el cuerpo del delito.

Qué salió de verdad el 24 de julio

El mercado de apuestas y las filtraciones daban el 23 de julio. Anthropic ese día soltó modo de voz. El modelo llegó un día después. Pequeño detalle, pero dice mucho: hay más especulación alrededor de cada release de Anthropic que datos fríos el día del anuncio.

Opus 5 se posiciona como el daily driver recomendado para trabajo agéntico y empresarial. Opus 4.8 pasa a legacy. Fable 5 sigue siendo el techo de capacidad de la casa, pero la distancia con Opus 5 en el tramo que más importa (coding agéntico) se ha acortado de forma considerable.

Precios, sin maquillaje:

  • Opus 5: $5 / M tokens entrada, $25 / M salida (igual que Opus 4.8).
  • Fable 5: $10 / M entrada, $50 / M salida.
  • Kimi K3 (peso abierto): $15 / M tokens de salida, con rendimiento que el propio sector ya trata como amenaza directa a la franja cara.

Mismo precio que el predecesor + rendimiento que se acerca al buque insignia = la historia no es "somos más listos que nadie". Es "te damos casi frontera sin cobrarte frontera". En un mercado donde la competencia de precios es salvaje, eso no es detalle de marketing. Es la tesis del producto.

Fable 5: el techo real y lo que le pasó en junio

Para entender Opus 5 hay que mirar a Fable 5 sin romanticismo.

Fable 5 se lanzó el 9 de junio de 2026. Fue el primer modelo de clase Mythos disponible para el público general. Precio doble respecto a la línea Opus. En los benchmarks que publica Anthropic pega un salto serio en codificación agéntica:

  • SWE-Bench Pro: 80,3% frente al 69,2% de Opus 4.8 y al 58,6% de GPT-5.5.
  • FrontierCode (código de producción): 29,3% frente al 13,4% de Opus 4.8 (más del doble).

Eso sí es un salto de capacidad en tareas complejas. No lo vamos a negar para hacer de contrarians baratos.

Fable 5 lleva clasificadores de seguridad que vigilan ciberseguridad ofensiva, biología y extracción del pensamiento del modelo. Se activan en menos del 5% de las sesiones según el material de lanzamiento, y cuando saltan reenvían la petición a Opus 4.8. Falsos positivos incluidos. Traducción de bar: a veces crees que estás hablando con el Ferrari y te acaban poniendo el utilitario sin avisarte con un letrero de neón.

El 12 de junio, tres días después del lanzamiento, Fable 5 quedó suspendido por una directiva de control de exportaciones de EE.UU. El veto se levantó tiempo después y hoy la gente de todo el mundo lo usa con normalidad. Pero quien construyó producto crítico encima de "solo Fable" aprendió la lección del vendor lock-in a hostia limpia durante esas semanas. Si te suena el caso, lo desgranamos con más detalle en No dependas de un único proveedor de IA.

Opus 5 nace en ese clima. No como reemplazo místico de Fable. Como la opción que Anthropic quiere que uses todos los días sin que te tiemble el CFO ni te corte una directiva federal el grifo.

Los números de Opus 5 (y de dónde salen)

Aquí hay que ir con el cinturón puesto.

La línea oficial de Anthropic es que Opus 5 rinde similar o ligeramente por encima de Fable en tareas de codificación y supera a Opus 4.8 en casi todas las tareas de sus comparativas. El matiz importante (y no es letra pequeña) es que las mejoras son iterativas, no un salto radical. El gancho comercial es rendimiento cercano a Fable a mitad de coste.

Los números internos de Anthropic añaden otra capa: Opus 5 duplica el rendimiento de Opus 4.8 en Frontier-Bench y queda dentro del 0,5% del pico de Fable 5 en un benchmark de codificación agéntica, cobrando la mitad.

Donde coinciden las fuentes:

  • Opus 5 > Opus 4.8 de forma clara en las suites que enseña Anthropic.
  • La distancia con Fable se acorta mucho en coding agéntico.
  • El precio no sube respecto a Opus 4.8; Fable sigue en otra liga de tarifa.

Donde hay que poner el asterisco gordo:

  • Todos esos benchmarks salen de Anthropic. No hay auditorías independientes que los verifiquen.
  • No tenemos metodología pública detallada de Frontier-Bench comparable punto por punto con estándares de industria.
  • "Supera ostensiblemente a GPT" es lenguaje de cobertura periodística, no una final de la NBA pitada por árbitros neutrales.

Un benchmark propio sin contraparte externa es una demo con Excel. Sirve para orientarte. No para jurar en un comité de arquitectura.

Seamos justos: Anthropic no está mintiendo. Publicar benchmarks propios es práctica estándar en la industria (OpenAI, Google y Meta hacen exactamente lo mismo con cada lanzamiento), y las mejoras iterativas que muestran son consistentes con la curva de maduración esperable en modelos de esta generación. El problema no es que Anthropic haga trampas; es que el sector trata cualquier gráfica de barras como un parte de guerra definitivo sin esperar a que terceros repliquen los resultados con metodología abierta.

Eso no convierte a Opus 5 en humo. Convierte el discurso de "revolución" en lo que es: marketing apoyado en mejoras reales pero acotadas, medidas en casa.

Lo que Anthropic no metió a propósito

Anthropic evitó entrenar a Opus 5 en tareas de ciberseguridad de vanguardia. El modelo queda sustancialmente por detrás de los de clase Mythos en la explotación de vulnerabilidades.

Eso no es un bug. Es una decisión de producto y de riesgo. Los modelos de clase Mythos tienen más músculo ofensivo y más restricciones. Opus 5 se vende como caballo de empresa y coding agéntico cotidiano; no como navaja suiza para red teaming de frontera.

Si tu caso de uso es investigación ofensiva seria, Opus 5 no es el juguete que te han vendido en Twitter. Si tu caso de uso es agente de desarrollo, refactor, orquestación de tareas y trabajo de backoffice inteligente, el recorte tiene sentido: menos superficie de pánico regulatorio, más fácil de colocar en cuentas grandes.

El Cuñado no lee esta parte. Pasa directamente al hilo de "lo cambia todo".

Token efficiency: la palabra fea que manda de verdad

Token efficiency no es un eslogan bonito. Es la relación entre el rendimiento que sacas y los tokens (y por tanto el dinero y la latencia) que quemas para sacarlo. Maximizar salida útil por unidad de coste.

Durante dos años el juego del hype fue simple: modelo más grande, bench más alto, capturas más pornográficas en LinkedIn. En 2026 el discurso entre desarrolladores y managers de ingeniería se ha desplazado hacia gestión de costes, modelos de peso abierto, inferencia local y alternativas a los buques frontera para todo.

Opus 5 encaja ahí con precisión milimétrica:

  1. No te suben el precio respecto a Opus 4.8.
  2. Te acercan al techo Fable en lo que más duele (coding agéntico).
  3. Te empujan a usarlo como día a día, no como champán de domingo.

Pero hay una trampa de contabilidad que mucha empresa sigue sin pillar: el coste de un modelo es el del trabajo terminado, no el precio por token.

Un modelo "barato" que falla, alucina formatos, obliga a reintentos y necesita tres pasadas de reparación te sale más caro que un modelo "caro" que cierra el ticket a la primera. Al revés también: pagar tarifa Fable para extraer campos de un PDF es tirar dinero a una trituradora con logo.

Por eso el precio de catálogo de Opus 5 es condición necesaria y no suficiente. La pregunta útil no es "¿cuánto cuesta el millón de tokens?" Es "¿cuánto me cuesta un PR aceptado, un informe cerrado, un expediente clasificado sin intervención humana?"

Kimi K3 y la presión desde abajo

Opus 5 a $25 / M de salida tiene que justificar su valor frente a Kimi K3 a $15 / M de salida con rendimiento similar en el tramo que al mercado le importa. Y Kimi no viene solo: el entorno de pesos abiertos lleva meses comiendo cuota de adopción real, no de hype de keynote.

Si quieres el contraste de campo con el mismo tipo de encargo sobre la mesa, tenemos la prueba en Grok 4.5 y Kimi K3 contra el listón y el análisis de brecha en Kimi K3 y la carrera con Anthropic y OpenAI.

La presión es doble:

  • Por arriba, Fable marca el techo de capacidad y dobla el precio.
  • Por abajo, abiertos y mid-tier aplastan el margen con tarifas que hacen sudar a cualquiera que facture agentes 24/7.

Anthropic responde con Opus 5 al estilo clásico de quien siente el aliento en la nuca: más rendimiento sin tocar el precio. No es caridad. Es supervivencia de posicionamiento. Si no bajas el coste por unidad de inteligencia útil, el router del cliente te saca del camino feliz y te deja para los tres casos difíciles del mes.

El router se come al fanboy de marca

Cursor y Meta, entre otros, están montando model routers: sistemas que eligen automáticamente modelo según la naturaleza de la petición, con el objetivo de no mandar cada chorrada al modelo más caro.

Esto no es una moda de PowerPoint. Es la consecuencia mecánica de tres hechos:

  1. La diferencia de precio entre tiers es brutal (Fable al doble que Opus; abiertos aún más abajo).
  2. La diferencia de dificultad entre tareas también lo es: extraer un JSON no es lo mismo que razonar un diseño de arquitectura.
  3. El acoplamiento a una sola marca caduca en meses (a veces en días, si hay un parón por exportación).

La arquitectura que aguanta no dice "esto lo hace Claude" ni "esto lo hace GPT". Dice: clasifica el paso por dificultad (determinista → extracción simple → razonamiento con criterio) y asígnale el modelo más barato que pase tu gate de calidad. Cambiar de proveedor tiene que ser config, no un refactor de tres sprints.

Si te interesa el patrón con presupuesto duro y fallback, está desarrollado en Cómo montar un router de modelos por tier.

Opus 5, leído con esa lente, no es "el modelo al que migrar toda la empresa". Es un candidato muy fuerte para la franja alta-media del router: trabajo agéntico serio sin tarifa Mythos. El techo absoluto sigue siendo otra celda del sistema. Las tareas tontas bajan a modelos baratos o locales.

El Cuñado oye "router" y piensa que es cosa de frikis. El manager que paga la factura de julio entiende que es el único sanedrín que le queda.

Agentic coding: dónde sí se nota (y dónde te la cuelan)

Agentic coding es la capacidad del modelo para trabajar como un agente de programación: escribir, depurar, moverse por un repo, encadenar herramientas y no morirse en el primer error de compilación. No es autocomplete fancy. Es mando y control sobre una tarea con estado.

Ahí es donde los números de Fable pegaron el golpe (FrontierCode al doble que Opus 4.8) y donde Opus 5 se vende como "casi eso, mitad de precio". Si tu producto es un agente de desarrollo, un copilot profundo o un pipeline que toca código de verdad, esta franja te importa más que un bench de cultura general.

Trampas típicas al leer esos benches:

  • Tarea de lab vs. producción. Un SWE-Bench no incluye a tu compañero que mergea con el repo en llamas, ni tus linters sádicos, ni el contexto basura del ticket de Jira.
  • Reintentos invisibles. El bench cuenta éxito final; tu factura cuenta cada intento.
  • Clasificadores y degradaciones silenciosas. En Fable, un porcentaje de sesiones (bajo, pero real) baja a Opus. Si no lo mides, atribuyes al modelo "bueno" resultados del modelo "de respaldo".
  • Contaminación de medición. Si no lees transcripts en crudo en un canario barato antes de lanzar la matriz cara, te comes fallos de validez que el scorer en verde no ve. Coste del canario: céntimos. Coste de la matriz contaminada: la tirada entera a la basura.

Nada de eso sale en el hilo de lanzamiento con emojis de cohete.

Qué NO te están vendiendo (lista para clavar en la pared)

  • Que Opus 5 sea un salto que transforma por completo las capacidades. Las propias comparativas hablan de mejoras iterativas.
  • Que Opus 5 tumbe a Fable 5 en todas las tareas. Se acerca en tramos clave de coding; no lo borra del mapa.
  • Que los benches estén auditados por terceros. Son de Anthropic.
  • Que el precio sea una ley de la física. El mercado es dinámico; Kimi y compañía existen precisamente para que nadie se duerma.
  • Que Opus 5 traiga músculo de ciberseguridad ofensiva de frontera. Anthropic evitó ese entrenamiento a propósito.

Si alguien te vende lo contrario, no está leyendo el release. Está escribiendo fanfic con factura.

Cómo decidir sin beberte el Kool-Aid

Olvida la marca durante diez minutos. Haz el ejercicio sucio:

  1. Parte tu pipeline en niveles de dificultad. Determinista y reglas; extracción/clasificación; redacción con criterio; razonamiento de negocio o multi-step arriesgado.
  2. Pon un gate de calidad por nivel con casos tuyos, no con el leaderboard de la web del proveedor. Si no tienes pipeline de evaluación con datos propios, estás eligiendo con fe.
  3. Asigna el modelo más barato que pase el gate. Reevalúa cuando salga un Opus nuevo, un Kimi nuevo o un Flash de turno. El cambio ha de ser config.
  4. Mira el coste por trabajo cerrado (ticket, PR, informe), no solo el dashboard de tokens.
  5. Anota el riesgo de corte. Un solo proveedor frontera para todo el flujo crítico es una apuesta, no una arquitectura. Fable 5 lo demostró en junio.

Opus 5 encaja muy bien como caballo de nivel alto en ese esquema. Encaja mal como religión.

El remate

Anthropic no ha soltado un dios nuevo el 24 de julio. Ha soltado un argumento comercial impecable en la guerra que sí importa: rendimiento útil por dólar, con Opus 5 como daily driver y Fable como techo caro al que ahora la gente de todo el mundo puede acceder con normalidad.

El Cuñado seguirá gritando que "esto lo cambia todo". Tú mira el router, el gate de calidad y la factura del trabajo terminado. Ahí es donde se decide si Opus 5 te hace más rico o solo más ruidoso.

Preguntas frecuentes

¿Opus 5 es mejor que Fable 5?

No en bloque. Fable 5 sigue siendo el techo de capacidad de Anthropic en los benchmarks que la propia compañía publica, con saltos claros en SWE-Bench Pro (80,3%) y FrontierCode (29,3%). Opus 5 se acerca mucho en codificación agéntica (llega a quedar dentro del 0,5% del pico de Fable en un benchmark interno) a mitad de precio. La compra inteligente no es "quién gana el podio", es qué nivel de dificultad estás pagando.

¿Cuánto cuesta Claude Opus 5?

$5 por millón de tokens de entrada y $25 por millón de tokens de salida, el mismo precio que Opus 4.8. Fable 5 dobla esa tarifa ($10 / $50). Kimi K3, como referencia de presión competitiva, se mueve en torno a $15 por millón de tokens de salida. El precio de catálogo no garantiza menor factura: mandan los reintentos y el coste por trabajo terminado.

¿Sigue disponible Fable 5?

Sí. Fable 5 se lanzó el 9 de junio de 2026, fue suspendido el 12 de junio por una directiva de control de exportaciones de EE.UU. y el veto se levantó tiempo después. Hoy la gente de todo el mundo lo usa con normalidad. Sus clasificadores de seguridad pueden reenviar parte de las sesiones a Opus 4.8 (menos del 5% según Anthropic), pero el acceso al modelo está abierto.

¿Opus 5 sirve para ciberseguridad ofensiva avanzada?

No es su terreno. Anthropic evitó entrenarlo en tareas de ciberseguridad de vanguardia, y queda sustancialmente por detrás de los modelos de clase Mythos en explotación de vulnerabilidades. Para trabajo agéntico y empresarial cotidiano es la apuesta que la compañía empuja; para ofensiva de frontera, el propio diseño del producto te está diciendo que mires a otra parte.

Fuentes

  1. Anthropic's Opus 5 is about token efficiency, not a capability leaparstechnica.com · 2026-07-24
  2. Fable 5: el primer modelo Mythos más allá de Opuswebreactiva.com · 2026-06-09
  3. Claude Opus 5: el lanzamiento que no fueblog.donweb.com · 2026-07-22