Anthropic lanza Claude Sonnet 5.5: más rápido, con ciber y una factura en disputa
Sonnet 5.5 sale el 28 de septiembre al mismo precio que Sonnet 5, con un 30% más de velocidad según Anthropic y salvaguardas ciber. Artificial Analysis lo pone nº 2 de su índice y, a máximo esfuerzo, como el modelo que más tokens gasta.

Anthropic publicó el 28 de septiembre Claude Sonnet 5.5, el segundo modelo de la familia 5.5. El precio no se mueve: 2 dólares por millón de tokens de entrada y 10 por millón de salida, más 0,20 en lecturas de caché, igual que Sonnet 5. La promesa es otra: corre un 30% o más rápido y, según la empresa, sale hasta un 30% más barato por tarea porque gasta menos tokens.
El identificador de API es claude-sonnet-5-5. Está en Claude.ai, en la API, en Amazon Bedrock, en Google Cloud y en Microsoft Foundry. Haiku 5.5 llegará en las próximas semanas para volumen y coste.
-IA Crew dice: Suben el número de la ficha, dejan el precio quieto y te venden la factura más baja como si el modelo hubiera aprendido a hablar menos.-
Lo que Anthropic dice que hace mejor
En Terminal-Bench 4.0, Anthropic reporta un 70,6% frente al 10,3% de Sonnet 5. En FrontierCode 1.1 llega a 46,2% en Max y 52,1% en Xhigh, por encima del 42,4% de Sonnet 5. CursorBench 4.0 pasa de 34,1% a 55,5%. En Humanity’s Last Exam con herramientas, 64,5% frente a 54,9%.
La empresa lo presenta como el Sonnet más rápido hasta la fecha y como complemento más barato de Opus 5.5 para tareas cotidianas, bugs, documentos, diapositivas y hojas. En un ejemplo interno de finanzas usó unos 121.000 tokens por respuesta frente a 497.000 de Sonnet 5. En otro, 2,4 veces más rápido y un 12% menos de tokens totales.
Es el primer Sonnet que sale con salvaguardas ciber y con clasificadores contra la extracción del razonamiento. Las capacidades de ciberseguridad, dice Anthropic, son comparables a las de Opus 5; las tareas de más riesgo caen visiblemente a Sonnet 5 y los defensores podrán pedir acceso por un programa de verificación. También amplía el preserved thinking, de modo que el pensamiento no se desacople de la cuenta que lo creó.
La ventana de contexto es de 1 millón de tokens y la salida máxima, 128.000. El tokenizador es el de Sonnet 5, así que el mismo texto produce los mismos recuentos.
La letra pequeña de Artificial Analysis
Artificial Analysis midió Sonnet 5.5 el día del lanzamiento y lo colocó número 2 de su Intelligence Index, con 56, solo por detrás de Opus 5.5 en esfuerzo máximo. En su Terminal-Bench 4.0 da un 64%, no el 70,6% del post de Anthropic: son protocolos distintos y conviene no mezclarlos.
El pero está en el consumo. A esfuerzo máximo, AA estima unos 193.000 tokens de salida por tarea, el máximo que ha medido, y un coste por tarea de unos 7,60 dólares: un 50% más que Sonnet 5 pese al mismo precio nominal. La paradoja es clara: Anthropic habla de hasta un 30% menos por tarea; AA, en su batería a máximo esfuerzo, ve más tokens y más factura.
-IA Crew dice: El laboratorio te enseña la carrera de 100 metros; el banco de pruebas te enseña la maratón con el contador de tokens en la muñeca.-
Para quien factura por API, la decisión no es «¿es más listo?» sino «¿en qué modo lo corro?». A esfuerzo bajo o medio, Anthropic sostiene que Sonnet 5.5 supera la mejor nota de Sonnet 5 por una fracción del coste. A máximo esfuerzo, AA sugiere que el modelo se pone hablador. El truco práctico es fijar el nivel de esfuerzo y medir la factura real del propio workload, no el recorte de un comunicado.
Sonnet 5.5 no sustituye a Opus 5.5 ni cierra la familia: Haiku 5.5 sigue en camino. Lo que cambia hoy es el Sonnet de trabajo diario, con ciber más cerrado y un desacuerdo educado entre el fabricante y el medidor independiente sobre si «más rápido» también significa «más barato».
-IA Crew dice: Cuando el precio por millón no se mueve, la única pelea que queda es cuántos millones se come cada ticket.-
Diccionario de la Crew
Token — Unidad de texto que el modelo lee o escribe; el precio de la API se calcula por millón de tokens.
API — Interfaz con la que un programa llama al modelo sin pasar por el chat de consumidor.
Benchmark — Prueba estandarizada para comparar modelos; dos laboratorios pueden reportar el mismo nombre con protocolos distintos.


