IA5 MIN

Claude Fable 5.1 y Mythos 5.1 ya están aquí: Anthropic mejora sus agentes y marca todo lo que escriben

Fable 5.1 mejora el trabajo autónomo que dura horas y abarata mucho la memoria de sus agentes. Mythos 5.1 usa el mismo modelo, pero queda reservado a Project Glasswing. Ambos ponen una marca de agua estadística en cada texto.

Arte oficial de Claude Fable 5.1 y Claude Mythos 5.1 con un cielo azul y una luna
Imagen: Anthropic

Anthropic acaba de lanzar Claude Fable 5.1 y Claude Mythos 5.1, dos nombres que parecen anunciar modelos distintos, aunque la diferencia real está en quién puede utilizarlos. Fable 5.1 es el sucesor disponible para los clientes de la API y las plataformas asociadas. Mythos 5.1 comparte sus capacidades y su precio, pero solo llega por invitación a las organizaciones de Project Glasswing.

La novedad importante no es que Claude responda mejor una pregunta aislada, sino que pierda menos el hilo cuando un trabajo se alarga durante horas. Anthropic lo orienta a programar con agentes, investigar en varios pasos, manejar documentos y hojas de cálculo, leer gráficos densos y controlar un ordenador. Aun así, la propia compañía recomienda empezar con Opus 5 para la mayoría de tareas, que cuesta la mitad y responde más rápido. Fable 5.1 queda para los encargos en los que Opus 5 no llega ni elevando su esfuerzo.

01

Fable 5.1 busca el trabajo que no cabe en una respuesta

La ficha técnica conserva una ventana de contexto de un millón de tokens y permite generar hasta 128.000 tokens de salida. El razonamiento adaptativo está siempre activo, con esfuerzo alto por defecto, así que el modelo decide cuánto pensar antes de actuar y el desarrollador puede subir o bajar ese esfuerzo durante la conversación.

Los resultados publicados por Anthropic apuntan a un salto considerable en tareas largas. Fable 5.1 obtiene un 52,6% en Terminal-Bench-Science 0.1 frente al 24,7% de Fable 5, y pasa del 42% al 55,8% en Terminal-Bench 4.0. También mejora en trabajo de oficina y uso del ordenador, aunque estas son evaluaciones de la propia empresa y todavía falta comprobar cómo se traducen a productos reales. La ganancia, además, se concentra en los niveles de esfuerzo más altos, justo donde cada tarea tarda y cuesta más.

Hay cambios menos vistosos que pueden importar mucho en una aplicación. Fable 5.1 puede mostrar breves actualizaciones entre herramientas, acepta instrucciones de sistema que duran un solo turno y permite cambiar el nivel de esfuerzo sin romper la caché. En cambio, ya no admite obligar al modelo a llamar una herramienta concreta, y editar mensajes anteriores puede invalidar sus bloques de razonamiento. Quien sustituya Fable 5 sin revisar la integración puede encontrarse con errores que no existían ayer.

Tabla oficial que compara Claude Fable 5.1 con Fable 5, Opus 5 y GPT-5.6 Sol en varias pruebas
Imagen: Anthropic
02

El precio no baja, pero la memoria del agente cuesta cuatro veces menos

Fable 5.1 mantiene la tarifa de Fable 5: 10 dólares por cada millón de tokens de entrada y 50 dólares por cada millón de salida. Es el doble que Opus 5, de modo que no tiene sentido escogerlo solo porque es el modelo nuevo. El cambio está en las lecturas de caché, que bajan de un dólar a 0,25 dólares por millón de tokens. Esa caché permite reutilizar instrucciones, archivos e historial sin procesarlos desde cero en cada paso.

En un chat corto el ahorro apenas se notará. En un agente que vuelve cientos de veces sobre el mismo repositorio o una investigación enorme sí puede cambiar la factura. La tabla oficial de precios confirma que cada lectura cuesta ahora el 2,5% de la entrada normal. Anthropic calcula alrededor de un 25% menos para una carga típica y un 45% menos cuando hay un uso intensivo de agentes, pero son estimaciones de la compañía basadas en sus propias cargas y no una rebaja garantizada para todo el mundo.

Gráfico de Anthropic que estima un menor coste de uso para Fable 5.1 gracias a la caché más barata
Imagen: Anthropic
03

Mythos 5.1 no aparecerá en tu selector de modelos

Mythos 5.1 no es una versión prémium que cualquiera pueda activar. Anthropic dice que utiliza el mismo modelo subyacente que Fable 5.1, pero lo reserva a participantes aprobados de Project Glasswing, la alianza defensiva con empresas como Amazon, Apple, Google, Microsoft, NVIDIA y CrowdStrike. Su objetivo es encontrar y corregir vulnerabilidades críticas antes de que esas capacidades lleguen a atacantes.

La distancia que muestra Terminal-Bench 4.0 nace, según Anthropic, de las salvaguardas de ciberseguridad. Fable 5.1 obtiene un 55,8% y Mythos 5.1 alcanza el 60,9%. La empresa espera reducir esa diferencia al hacer sus filtros más precisos, por lo que no conviene leer el gráfico como una comparación entre dos cerebros separados. Es el mismo sistema trabajando bajo permisos distintos, una precaución relevante después de las pruebas en las que Claude acabó atacando organizaciones reales.

Gráfico de Anthropic con los resultados de Mythos 5.1, Fable 5.1 y Mythos 5 en Terminal-Bench 4.0
Imagen: Anthropic
04

Cada texto sale marcado, y eso sigue siendo un problema

Fable 5.1 y Mythos 5.1 estrenan también una función que no se puede desactivar: todo texto generado lleva la marca de agua estadística de Anthropic en cada plataforma donde estén disponibles. No añade caracteres ocultos ni datos sobre la cuenta, sino una pauta en la elección de palabras que la compañía podrá detectar. Los archivos de imagen y vídeo compatibles reciben credenciales C2PA al descargarlos mediante la API de archivos.

Anthropic sostiene que la marca no altera el significado, la calidad ni la legibilidad. El problema nunca fue ese. La señal solo demuestra que Claude intervino, pero un cliente, una universidad o una empresa puede acabar utilizándola como si probara quién escribió el texto. Por eso nuestra recomendación sigue siendo no usar Claude en la redacción final de un trabajo importante, aunque Fable 5.1 sea mejor modelo que ayer.

La actualización resuelve una parte difícil de los agentes, mantener capacidad durante mucho tiempo sin disparar tanto el coste de su memoria. No resuelve la decisión que Anthropic ha tomado alrededor del texto que producen. Fable 5.1 puede ser una herramienta extraordinaria para programar, investigar o analizar archivos, pero la marca de agua convierte la escritura final en un precio adicional que no aparece en la factura.

00

La conversación empieza aquí

Accede con una cuenta de apoyo para comentar. Entrar

Todavía no ha comentado nadie. ¿Estrenas tú?

TU SIGUIENTE RUTA

Sigue tirando del hilo de Modelos y agentes de IA

Si este tema te interesa, estas tres piezas son el mejor lugar por el que seguir.

ABRIR EL TEMA COMPLETO
  1. 01Google lanza Gemini Omni 1.1 Flash, el «Nano Banana» del vídeo que edita clips con una fraseIA · 4 MIN
  2. 02OpenAI cortará sus modelos de Cursor el 12 de noviembre tras la compra de SpaceXIA · 4 MIN
  3. 03Cómo programar una publicación con GitHub Actions sin perder el controlIA · 3 MIN

SIGUE LEYENDO

También te puede interesar

PORTADA