IA4 MIN

Claude Opus 5 ya está aquí: casi alcanza a Fable 5 y cuesta la mitad

El nuevo modelo será el predeterminado para los usuarios de Claude Max y el más potente de Pro. Mantiene el precio de Opus 4.8, pero pensar más también puede disparar la factura.

Ilustración oficial de Claude Opus 5 formada por huevos de distintos tamaños
Imagen: Anthropic
01

Esta mañana era un rumor. Anthropic ha tardado unas horas en confirmarlo

Esta mañana seguíamos una fecha, varios movimientos en la API y demasiada gente mirando el mismo calendario. No había una confirmación oficial, así que tocaba llamarlo rumor. Ya no. Anthropic ha lanzado Claude Opus 5 hoy, 24 de julio, con disponibilidad inmediata en Claude, Claude Code, su API y las principales plataformas en la nube.

La compañía lo coloca justo debajo de Fable 5, su modelo más capaz, pero la distancia se ha estrechado mucho. Según la tabla oficial de modelos y precios, Opus 5 cuesta 5 dólares por cada millón de tokens de entrada y 25 dólares por los de salida: el mismo precio que Opus 4.8 y exactamente la mitad que Fable 5.

Para los usuarios de pago hay un cambio fácil de entender. Opus 5 será el modelo predeterminado de Claude Max y la opción más potente incluida en Claude Pro. Fable 5 conserva el puesto para encargos autónomos especialmente largos y difíciles, aunque requiere créditos de uso fuera de sus periodos promocionales.

02

La diferencia con Fable 5 empieza a ser demasiado pequeña para ignorarla

Anthropic asegura que Opus 5 supera al resto en Frontier-Bench v0.1 y más que duplica el resultado de Opus 4.8 con un coste menor por tarea. En CursorBench 3.2 queda a un 0,5% del mejor resultado de Fable 5 utilizando el nivel máximo de esfuerzo, pero cuesta la mitad por encargo.

Hay cifras todavía más vistosas. En ARC-AGI 3 logra tres veces la puntuación del siguiente modelo y, en OSWorld 2.0 —una prueba donde la IA utiliza un ordenador—, supera el mejor resultado de Fable 5 gastando poco más de un tercio. Son mediciones publicadas por Anthropic y necesitan pruebas externas, pero el mensaje comercial no deja mucho espacio a la duda: Opus ya no es la alternativa claramente inferior.

Mi primera lectura es que Fable 5 acaba de perder su argumento más cómodo. Sigue siendo mejor cuando una tarea puede durar horas o días, pero ahora tendrá que demostrar que esa ventaja compensa pagar el doble.

Gráfica oficial de Anthropic que compara el rendimiento y el coste de Opus 5, Fable 5, Opus 4.8 y GPT-5.6 Sol en OSWorld 2.0
Imagen: Anthropic
03

El nuevo control de esfuerzo decide cuánto piensa Claude y cuánto te cobra

Opus 5 acepta un millón de tokens de contexto, puede generar hasta 128.000 tokens y trae el razonamiento adaptativo activado. La novedad práctica es una escala con cinco niveles: bajo, medio, alto, muy alto y máximo. Es como elegir cuánto tiempo puede dedicar un mecánico a revisar el coche antes de devolverte las llaves. Más atención suele ayudar; también aparecen más horas en la factura.

Anthropic dice que los niveles bajos conservan buena parte del rendimiento usando menos tokens y menos tiempo. En el extremo contrario, el modo máximo está pensado para programación compleja, investigación y agentes que deben coordinar herramientas durante muchos pasos. El precio por millón no cambia, pero una tarea que piensa y actúa más termina consumiendo más.

También hay un modo rápido que funciona unas 2,5 veces más deprisa y duplica el precio hasta 10 dólares por millón de tokens de entrada y 50 dólares por los de salida. Para responder un correo sería matar moscas a cañonazos. Para encontrar un fallo urgente en producción, quizá no.

04

Opus 5 comprueba su trabajo más veces, aunque Anthropic avisa de un efecto secundario

El modelo revisa sus resultados sin que se lo pidan, recurre más a subagentes y explica con mayor frecuencia lo que está haciendo durante una tarea larga. Anthropic recomienda incluso retirar de los prompts las órdenes antiguas que exigían una verificación final: con Opus 5 pueden provocar revisiones innecesarias y hacer que el trabajo se alargue.

En seguridad, la empresa lo presenta como su Opus mejor alineado hasta ahora. Su auditoría automática le asigna 2,3 puntos de comportamiento desalineado, la cifra más baja de sus modelos recientes. Aun así, Mythos 5 continúa por delante en ciberseguridad ofensiva y Fable 5 mantiene ventaja en los trabajos autónomos más exigentes.

La familia Claude 5 ya está completa y nuestra apuesta de esta mañana acertó el día. Lo interesante empieza ahora: comprobar si Opus 5 realmente necesita la mitad de dinero para hacer casi el mismo trabajo o si esa promesa se deshace cuando salga de los gráficos de Anthropic.

00

La conversación empieza aquí

Accede con una cuenta de apoyo para comentar. Entrar

Todavía no ha comentado nadie. ¿Estrenas tú?

SIGUE LEYENDO

También te puede interesar

PORTADA