Llega Claude Opus 5: frontera a mitad de precio
ContenidoContents
Anthropic acaba de lanzar Claude Opus 5, y el titular no es tanto “es más listo” —que lo es— como cuánto cuesta esa inteligencia: Opus 5 se acerca a la capacidad de Fable 5, su modelo más top, pero a la mitad de precio, y cuesta lo mismo que el Opus 4.8 que reemplaza.
Los números, en claro
- ID del modelo:
claude-opus-5. - Precio: 5 $ por millón de tokens de entrada y 25 $ de salida. Idéntico a Opus 4.8, y la mitad de Fable 5 (10 $/50 $).
- Contexto: 1 millón de tokens (es a la vez el valor por defecto y el máximo).
- Salida: hasta 128k tokens.
- Corte de conocimiento: mayo de 2026.
Y pasa a ser el modelo por defecto: es el que Anthropic recomienda de entrada y el que manda en Claude Max y Pro. Según Anthropic, marca máximos en varios benchmarks —un llamativo 30,2 % en ARC-AGI-3, casi cuatro veces GPT-5.6 Sol— aunque reconoce que sigue por detrás de Mythos 5 en tareas de ciberseguridad.
Lo más práctico: un dial para tu factura
Lo que más me interesa no es el benchmark, es el control de esfuerzo. Opus 5 tiene cinco niveles —low, medium, high, xhigh, max— que deciden cuánto “piensa” el modelo antes de responder, y por tanto cuántos tokens gastas. En low y medium rinde muy bien por una fracción del coste y la latencia; reservas xhigh/max para lo difícil de verdad.
Es, literalmente, un dial: la misma inteligencia de frontera, y tú decides en cada tarea si pagas por profundidad o por rapidez. Para quien construye productos con IA, poder mover ese mando sin cambiar de modelo es tan importante como el propio salto de capacidad.
Si programas con IA: lo que cambia
Un par de cosas que conviene mirar si integras la API:
- El pensamiento viene activado por defecto. En Opus 4.8 no pensaba salvo que lo pidieras; en Opus 5 sí, y el nivel de esfuerzo es el que gradúa cuánto. Como
max_tokenslimita el total (pensamiento + respuesta), revisa ese valor en flujos que antes iban sin pensar. - Breaking change: desactivar el pensamiento (
thinking: disabled) solo se acepta con esfuerzohigho inferior; conxhighomaxdevuelve un error 400. - Detalles que ayudan: el mínimo para cachear un prompt baja a 512 tokens (antes 1024), y ya puedes añadir o quitar herramientas a mitad de conversación sin romper la caché (en beta).
- Migrar es casi gratis: cambiar el ID de
claude-opus-4-8aclaude-opus-5y revisar esos dos cambios de comportamiento.
Cambios de comportamiento (aunque no toques código)
Opus 5 se nota distinto: las respuestas por defecto son más largas, narra más su progreso en tareas agénticas, delega más en subagentes y —esto es importante— se autoverifica sin que se lo pidas. Si arrastras instrucciones del tipo “añade un paso final de verificación” de modelos anteriores, quítalas: en Opus 5 provocan que verifique de más.
Qué significa
Para mí, la lectura es sencilla: Opus 5 se convierte en el “por defecto” razonable. Antes tenías que elegir entre pagar el tope (Fable 5) o conformarte con un escalón por debajo; ahora tienes capacidad casi de frontera a precio de Opus, con un dial para ajustar coste según la tarea. Para los que montamos cosas con IA —desde un generador de preguntas para Moodle hasta agentes que dan vueltas solos— esto baja el listón de “cuándo me puedo permitir el buen modelo”.
No es una actualización incremental disfrazada: es Anthropic apretando justo donde aprietan también GPT-5.6 y los modelos chinos, el coste por token útil. Y eso, al final, es lo que decide qué se puede construir.
Fuentes: Anthropic — What’s new in Claude Opus 5, Models overview, Fortune, VentureBeat.