IA4 MIN

Sonnet 5.5 se acerca a Opus y acelera: la sorpresa está en cuánto cuesta usarlo de verdad

El nuevo Claude mejora mucho en programación sin subir el precio por token. Una medición independiente muestra el matiz: al pedirle su máximo rendimiento, puede gastar más por tarea que Sonnet 5.

Un programador trabaja ante una pantalla con código en un ordenador portátil
Imagen: Ibrahim Yusuf / Unsplash · fotografía ilustrativa

Anthropic ha lanzado Claude Sonnet 5.5 apenas una semana después de presentar Opus 5.5. Lo ofrece al mismo precio por token que Sonnet 5, pero afirma que genera las respuestas más de un 30 % más rápido y que necesita menos pasos para completar muchos trabajos. La mejora en programación es llamativa. En una prueba publicada por Anthropic, pasa del 10,3 % al 70,6 % de tareas resueltas.

Hay un matiz que importa más que la cifra de portada. Una evaluación independiente de Artificial Analysis sitúa a Sonnet 5.5 casi al nivel de Opus 5.5 cuando se le exige al máximo. También encuentra que, en ese ajuste, consume más tokens y cuesta más por tarea que su predecesor. Son dos formas distintas de usar el mismo modelo, no una contradicción que pueda resolverse mirando solo la tarifa.

01

Un salto fuerte en programación, con pruebas distintas

En Terminal-Bench 4.0, una prueba en la que un agente debe resolver tareas técnicas usando una terminal, Anthropic comunica un 70,6 % para Sonnet 5.5 frente al 10,3 % de Sonnet 5. Artificial Analysis también observa una mejora grande, aunque obtiene un 64 % con su propia configuración. Esos porcentajes no deben mezclarse como si hubieran salido de la misma ejecución. En ambos casos, el salto frente a la generación anterior es el dato significativo.

El avance no convierte a Sonnet en el sustituto automático de Opus. En el índice de Artificial Analysis, Sonnet 5.5 llega a 56 puntos en su configuración máxima, dos menos que Opus 5.5. Anthropic también reconoce que Opus conserva ventaja en trabajos abiertos que exigen mantener el criterio durante mucho tiempo. Para arreglar un fallo concreto o montar una primera versión, Sonnet puede ser una elección más ágil. Para una decisión compleja con muchos compromisos, sigue habiendo razones para usar Opus 5.5.

Dos monitores con código en una estación de trabajo iluminada
Imagen: Jakub Żerdzicki / Unsplash · fotografía ilustrativa
02

La tarifa no ha subido, pero el coste final depende del esfuerzo

La API de Sonnet 5.5 mantiene los 2 dólares por millón de tokens de entrada y 10 por millón de salida de Sonnet 5. Anthropic publica también 0,20 dólares por millón de tokens recuperados de caché. Son precios oficiales en dólares, no una tarifa en euros confirmada para España. Un token es un fragmento del contenido que el modelo lee o escribe, así que pagar el mismo precio por fragmento no garantiza pagar lo mismo por un encargo completo.

Anthropic calcula hasta un 30 % menos de coste por tarea para la mayoría de los trabajos que probó. Artificial Analysis midió otra situación: con el esfuerzo al máximo, Sonnet 5.5 generó unos 193.000 tokens de salida por tarea de su índice y costó 7,60 dólares de media, alrededor de un 50 % más que Sonnet 5 en esa comparación. El ajuste máximo compra más capacidad a cambio de más trabajo interno. Si se comparan modelos, hay que mirar la tarea terminada y el nivel de esfuerzo, no solo los precios por millón de tokens. Lo mismo vale para GPT-6 Sol, cuya tarifa publicada coincide en entrada y salida.

Una persona diseña una interfaz gráfica en un portátil
Imagen: Compagnons / Unsplash · fotografía ilustrativa
03

Dónde se puede usar y qué falta probar

Sonnet 5.5 ya está disponible en las plataformas de Claude y a través de AWS, Google Cloud y Microsoft Azure. En la API de Anthropic se llama `claude-sonnet-5-5`. La compañía lo orienta a programación cotidiana, documentos, presentaciones, hojas de cálculo y diseño. Esas posibilidades no equivalen a una prueba nuestra de cómo se comporta en cada aplicación.

Anthropic ha añadido protecciones para peticiones de ciberseguridad de alto riesgo. En algunos casos, la respuesta pasa a Sonnet 5, un detalle que puede afectar a quien compare resultados sin fijarse en qué modelo respondió. Sonnet 5.5 es una mejora notable y un candidato serio para el trabajo diario, pero la recomendación definitiva depende de la tarea real, del tiempo de respuesta y de lo que cueste terminarla, no de ganar una sola gráfica.

00

La conversación empieza aquí

Accede con una cuenta de apoyo para comentar. Entrar

Todavía no ha comentado nadie. ¿Estrenas tú?

TU SIGUIENTE RUTA

Sigue tirando del hilo de Modelos y agentes de IA

Si este tema te interesa, estas tres piezas son el mejor lugar por el que seguir.

ABRIR EL TEMA COMPLETO
  1. 01Claude Opus 5.5 baja de precio y recibe buenas primeras impresiones, con maticesIA · 2 MIN
  2. 02Google habla de más de 300 idiomas, pero traducir sin conexión es otra historiaIA · 2 MIN
  3. 03Qué es destilar una IA y por qué el modelo pequeño no sabe todo lo que sabe el grandeIA · 2 MIN

SIGUE LEYENDO

También te puede interesar

PORTADA