Anthropic ha lanzado Claude Sonnet 5.5 apenas una semana después de presentar Opus 5.5. Lo ofrece al mismo precio por token que Sonnet 5, pero afirma que genera las respuestas más de un 30 % más rápido y que necesita menos pasos para completar muchos trabajos. La mejora en programación es llamativa. En una prueba publicada por Anthropic, pasa del 10,3 % al 70,6 % de tareas resueltas.
Hay un matiz que importa más que la cifra de portada. Una evaluación independiente de Artificial Analysis sitúa a Sonnet 5.5 casi al nivel de Opus 5.5 cuando se le exige al máximo. También encuentra que, en ese ajuste, consume más tokens y cuesta más por tarea que su predecesor. Son dos formas distintas de usar el mismo modelo, no una contradicción que pueda resolverse mirando solo la tarifa.
Un salto fuerte en programación, con pruebas distintas
En Terminal-Bench 4.0, una prueba en la que un agente debe resolver tareas técnicas usando una terminal, Anthropic comunica un 70,6 % para Sonnet 5.5 frente al 10,3 % de Sonnet 5. Artificial Analysis también observa una mejora grande, aunque obtiene un 64 % con su propia configuración. Esos porcentajes no deben mezclarse como si hubieran salido de la misma ejecución. En ambos casos, el salto frente a la generación anterior es el dato significativo.
El avance no convierte a Sonnet en el sustituto automático de Opus. En el índice de Artificial Analysis, Sonnet 5.5 llega a 56 puntos en su configuración máxima, dos menos que Opus 5.5. Anthropic también reconoce que Opus conserva ventaja en trabajos abiertos que exigen mantener el criterio durante mucho tiempo. Para arreglar un fallo concreto o montar una primera versión, Sonnet puede ser una elección más ágil. Para una decisión compleja con muchos compromisos, sigue habiendo razones para usar Opus 5.5.

La tarifa no ha subido, pero el coste final depende del esfuerzo
La API de Sonnet 5.5 mantiene los 2 dólares por millón de tokens de entrada y 10 por millón de salida de Sonnet 5. Anthropic publica también 0,20 dólares por millón de tokens recuperados de caché. Son precios oficiales en dólares, no una tarifa en euros confirmada para España. Un token es un fragmento del contenido que el modelo lee o escribe, así que pagar el mismo precio por fragmento no garantiza pagar lo mismo por un encargo completo.
Anthropic calcula hasta un 30 % menos de coste por tarea para la mayoría de los trabajos que probó. Artificial Analysis midió otra situación: con el esfuerzo al máximo, Sonnet 5.5 generó unos 193.000 tokens de salida por tarea de su índice y costó 7,60 dólares de media, alrededor de un 50 % más que Sonnet 5 en esa comparación. El ajuste máximo compra más capacidad a cambio de más trabajo interno. Si se comparan modelos, hay que mirar la tarea terminada y el nivel de esfuerzo, no solo los precios por millón de tokens. Lo mismo vale para GPT-6 Sol, cuya tarifa publicada coincide en entrada y salida.

Dónde se puede usar y qué falta probar
Sonnet 5.5 ya está disponible en las plataformas de Claude y a través de AWS, Google Cloud y Microsoft Azure. En la API de Anthropic se llama `claude-sonnet-5-5`. La compañía lo orienta a programación cotidiana, documentos, presentaciones, hojas de cálculo y diseño. Esas posibilidades no equivalen a una prueba nuestra de cómo se comporta en cada aplicación.
Anthropic ha añadido protecciones para peticiones de ciberseguridad de alto riesgo. En algunos casos, la respuesta pasa a Sonnet 5, un detalle que puede afectar a quien compare resultados sin fijarse en qué modelo respondió. Sonnet 5.5 es una mejora notable y un candidato serio para el trabajo diario, pero la recomendación definitiva depende de la tarea real, del tiempo de respuesta y de lo que cueste terminarla, no de ganar una sola gráfica.
La conversación empieza aquí
Accede con una cuenta de apoyo para comentar. Entrar




Todavía no ha comentado nadie. ¿Estrenas tú?