Llega Claude Opus 5.5: Fable, a precio de Opus

Llega Claude Opus 5.5: Fable, a precio de Opus
ContenidoContents

Hace dos meses escribí que Claude Opus 5 se convertía en el por defecto razonable: cerca de Fable, al precio del Opus de entonces. Hoy, 22 de septiembre, Anthropic publica Claude Opus 5.5 y aprieta otra vez el mismo tornillo. Dicen que en la mayoría del trabajo rinde al nivel de Fable 5.1 y que ejecutarlo sale un 40 % más barato que Opus 5.

No es el veredicto de una semana dentro de Moodle. Es la ficha, leída despacio.

Los números, en claro

  • ID del modelo: claude-opus-5-5.
  • Precio: 4 $ por millón de tokens de entrada y 20 $ de salida. Un 20 % menos que Opus 5 (5 $/25 $) y menos de la mitad de Fable 5.1 (10 $/50 $).
  • Lecturas de caché: 0,20 $ por millón. En Opus 5 eran 0,50 $. En un agente, que relee el mismo contexto una y otra vez, eso pesa más que el descuento del token suelto.
  • Contexto: 1 millón de tokens. Salida: hasta 128.000.
  • Corte de conocimiento: junio de 2026.
  • Esfuerzo por defecto: medium. En Opus 5, si no decías nada, iba en high.

El modo rápido, en preview y solo en la API de Claude y en Claude Code, promete hasta 2,5 veces la velocidad. Cuesta el doble: 8 $ y 40 $. Sonnet 5.5 y Haiku 5.5 llegan en las próximas semanas. En los planes Pro, Max y Team suben el límite de cinco horas, y regalan un reinicio de cuota que puedes guardarte para cuando quieras.

El benchmark, con el asterisco delante

Anthropic publica la tabla en esfuerzo max, salvo donde lo dicen. En Terminal-Bench 4.0, Opus 5.5 va en xhigh y GPT-6 Astra en high, el máximo de cada uno según quien lo midió. Los salvaguardas de producción estaban puestos: si saltaban, la tarea de ciberseguridad la terminaba Opus 4.8, y la de biología, Opus 5. Eso baja la nota en esos bancos.

Prueba Opus 5.5 Fable 5.1 Opus 5 GPT-6 Astra GPT-5.6 Sol
Terminal-Bench 4.0 66,4 % 55,8 % 52,3 % 57,9 % 37,3 %
FrontierCode v1.1 54,4 % 50,3 % 48,0 % 53,3 % 47,5 %
CursorBench 4.0 57,8 % 51,8 % 46,6 % — 41,7 %
GDPval-AA v2.1 (Elo) 1846 1735 1708 1542 1588
Terminal-Bench Science 0.1 58,7 % 52,6 % 29,0 % 64,6 % 22,4 %
OSWorld 2.0 81,8 % 80,7 % 74,0 % — —

Lo que me importa no es el pico. Es el punto en el que yo lo dejaría puesto. En FrontierCode, con el esfuerzo por defecto (medium), Anthropic dice que saca un 54,6 % y supera el mejor resultado de Astra (53,3 %) por cerca de una quinta parte del coste por tarea. En CursorBench, también en medium, un 52,5 %: por encima del máximo de Fable 5.1 (51,8 %) y del máximo de Opus 5 (46,6 %). En Terminal-Bench 4.0, el medium ya gana al max de Opus 5 por una quinta parte del coste, y empata con Astra por un 40 % de lo que cuesta Astra.

En ciencia de terminal, Astra sigue delante: 64,6 % contra 58,7 %. Anthropic lo dice en la propia página: a esta altura el margen del benchmark ya no explica bien la diferencia real, y en su uso interno la distancia con Fable 5.1 es más estrecha de lo que sugiere la tabla.

Si programas con la API: cuatro cosas que rompen

Migrar el ID no basta. En la guía de novedades hay cuatro cambios que devuelven error, o que dejan la respuesta en silencio:

  • El pensamiento no se puede apagar. thinking: disabled y el presupuesto manual (type: enabled con budget_tokens) dan un 400. O lo omites, o mandas adaptive. El esfuerzo es el dial.
  • No hay tool use forzado. tool_choice en any o en una herramienta concreta también da 400. Quedan auto y none. Si necesitas JSON válido, auto con herramientas estrictas, o salidas estructuradas.
  • Los bloques de pensamiento van atados al modelo. Opus 5.5 lee los de Opus 5 y de Sonnet y Haiku anteriores. No lee los de Fable ni Mythos. Si cambias de modelo a mitad de conversación hacia cualquier otro que no sea Fable 5.1 o Mythos 5.1 en la API de Claude, el razonamiento anterior se cae. La petición no falla: simplemente sigue sin él.
  • La herramienta vieja de ordenador, computer_20251124, no vale en la API de Claude ni en Google Cloud. Hay que pasar al toolset computer_toolset_20260801. En Bedrock la antigua sigue funcionando.

Y uno que no da error y por eso es peor: el texto que el modelo escribe entre llamadas a herramientas vuelve dentro de bloques thinking. Con el display por defecto, una interfaz que enseñaba ese texto como progreso se queda muda entre herramienta y herramienta.

El esfuerzo por defecto baja de high a medium. Si copias la configuración de Opus 5 sin mirar, no estás comparando el mismo punto de la curva. A igual esfuerzo, además, piensa más por turno que Opus 5, sobre todo en xhigh y max. Hay que volver a medir, no heredar el número.

La correa, esta vez en el Opus

Hasta ahora la correa gorda era cosa de Fable y Mythos. Lo conté cuando apagaron Fable 5 y cuando volvió encendido. Opus 5.5 es el primer Opus que sale con salvaguardas de esa clase en ciberseguridad, biología y destilación.

En la práctica: identificar y arreglar bugs de tu propio código sigue en este modelo. La mayoría de las tareas de ciberseguridad se desvían a Opus 4.8. Para biología de verdad hay que pedir sitio en el programa de verificación de ciencias de la vida. Anthropic dice que intenta saltarse los límites un 85 % menos que Opus 5 o Mythos 5.1, y que cuando lo intenta es de baja gravedad y lo cuenta. También dice que a menudo sospecha que lo están evaluando. Eso, dicho por ellos, es un agujero en la propia evaluación.

La retención de datos sigue en cero, como en los Opus anteriores. No como en Fable.

Qué significa

Para mí la lectura es la de julio, un escalón más abajo en la factura. Opus 5 ya era el modelo que podías dejar puesto. Este es el mismo sitio, más barato por tarea, más rápido de generar, y con la prosa menos hinchada: lo que más se le afeaba al 5. Factory dice que en medium iguala al Opus 5 en high gastando un 20-25 % menos de salida. Box, un tercio de los tokens y respuestas un 40 % menos verbosas.

La cuenta pendiente es la correa. Si tu trabajo es código normal, no la vas a notar. Si tu trabajo roza la seguridad ofensiva o la biología, este Opus ya no es el Opus de julio: te mandan al modelo de abajo, o a una lista de acceso. Y si integras la API, el detalle que más duele no es el precio. Es que el esfuerzo por defecto ha bajado un punto, y que apagar el pensamiento ya no es una opción.


Fuentes: Anthropic — Introducing Claude Opus 5.5, What’s new in Claude Opus 5.5, Reuters.

CompartirShare