Anthropic presentó Claude Sonnet 5.5. Es más eficiente, rápido y a menudo iguala a Opus 5.5.

  • Anthropic presentó Claude Sonnet 5.5, el segundo modelo de la serie 5.5
  • En una serie de pruebas, se acerca al Opus 5.5, que es el doble de caro
  • Debería realizar el mismo trabajo más rápido y hasta un 30 % más barato que Sonnet 5

Sdílejte:
Adam Kurfürst
Adam Kurfürst
28. 9. 2026 22:35

Menos de una semana después del lanzamiento de Opus 5.5, Anthropic complementa la nueva serie con su hermano más barato y rápido. Claude Sonnet 5.5 está dirigido a tareas diarias bien definidas, como la corrección de errores en el código o la creación de documentos, presentaciones y hojas de cálculo. Si utilizas Claude a través de la API, pagarás lo mismo por los tokens que con Sonnet 5, pero el nuevo modelo consumirá menos para la misma tarea.

A menudo iguala a Opus 5.5 en las pruebas

Anthropic, en su anuncio, escribe que el modelo ha mejorado en todas las áreas en comparación con su predecesor, en algunas de forma drástica. El salto más significativo se reporta en la prueba Terminal-Bench 4.0, que examina tareas complejas en la línea de comandos. Según la tabla de la empresa, Sonnet 5.5 alcanzó el 70,6 %, mientras que Sonnet 5 solo llegó al 10,3 %. Incluso supera ligeramente a Opus 5.5, que obtuvo un 66,4 %.

En la prueba GDPval-AA, donde los modelos realizan tareas laborales reales de 44 profesiones, se queda atrás de Opus 5.5 por solo dos puntos (1.844 frente a 1.846) y supera a Sonnet 5 en aproximadamente 400. El competitivo GPT-6 Sol de OpenAI tiene 1.487 puntos en la tabla. El nuevo modelo también se mantiene justo detrás de Opus 5.5 en el control de la computadora y la lectura de gráficos. Además, fue el primer Sonnet en terminar Pokémon Red basándose únicamente en capturas de pantalla. A pesar de todo esto, la empresa admite que para tareas complejas y abiertas que requieren un juicio a largo plazo, Opus 5.5 sigue siendo claramente más potente, lo cual es lógico dada la definición a largo plazo de las series de modelos Claude.

Según la empresa, la mejora es más notable en la programación. En la prueba FrontierCode, Sonnet 5.5, con la misma configuración, tiene una puntuación 10 puntos superior a Sonnet 5 por aproximadamente una quinceava parte del coste. A los evaluadores les gustó lo rápido que se orienta en código ajeno y que a menudo combina las llamadas a herramientas, lo que le permite completar la tarea en menos pasos. Daniel Vogel, director de operaciones de Epic Games, afirma que el modelo ha manejado decenas de miles de líneas de código de arquitectura de juegos y tareas de varias horas.

La empresa también destaca su sentido del diseño. El nuevo Sonnet debe proporcionar un mejor ajuste al aspecto de las aplicaciones y crear una presentación a partir de una plantilla que requiera pocas modificaciones. En una prueba interna, recibió los resultados trimestrales de una empresa que cotiza en bolsa junto con las transcripciones de las llamadas con inversores y se le pidió que preparara una presentación de diez diapositivas según una plantilla. Dos expertos calificaron su primera versión como lista para enviar.

Sonnet 5.5 es mucho más eficiente al mismo precio

Los desarrolladores pagarán aproximadamente 43 CZK (2 dólares) por millón de tokens de entrada y 214 CZK (10 dólares) por millón de tokens de salida, es decir, la mitad de lo que cuesta Opus 5.5. La lectura desde la caché costará aproximadamente 4 CZK por millón de tokens. Por lo tanto, el ahorro no proviene de una lista de precios más baja, sino de la eficiencia: según Anthropic, el modelo necesita menos tokens para el mismo trabajo, y la tarea resultará hasta un 30 % más barata que con Sonnet 5. Slack, por ejemplo, midió aproximadamente un 14 % menos de tokens de salida en su Slackbot.

Además, genera texto más de un 30 % más rápido, lo que lo convierte en el Sonnet más rápido de la historia. Puedes equilibrar la velocidad y el precio eligiendo el nivel de esfuerzo. En las aplicaciones Claude y Claude Code, el nivel predeterminado es medio, mientras que en la plataforma de desarrollo es alto. Con el nivel medio, Sonnet 5.5 superó significativamente el mejor resultado de Sonnet 5 en Terminal-Bench, según la empresa, y por menos de una décima parte del coste.

El modelo ya está disponible en todas las plataformas, incluyendo las nubes de Amazon Web Services, Google Cloud y Microsoft Azure, incluso en modo sin almacenamiento de datos. La serie 5.5 se cerrará en las próximas semanas con Haiku 5.5, diseñado para implementaciones de bajo coste y gran volumen.

El nuevo Sonnet recibe por primera vez salvaguardias de seguridad más robustas

Según Anthropic, las capacidades en ciberseguridad igualan a Opus 5, lo que lo convierte en el primer Sonnet en recibir salvaguardias similares a las de los modelos más potentes de la empresa. La búsqueda y corrección de errores en el propio código continuará, pero las tareas de seguridad más arriesgadas pasarán visiblemente al Sonnet 5 anterior. La protección en el campo de la biología sigue siendo la misma que la de su predecesor, pero la empresa advierte que podría interceptar accidentalmente algunas consultas de microbiología y virología.

Ahora, Sonnet también se defiende de la llamada destilación, en la que los atacantes, a través de miles de cuentas falsas, extraen las capacidades del modelo para su propia IA sin restricciones de seguridad. Por ello, fue el primer Sonnet en recibir clasificadores que impiden la explotación de su razonamiento. El pensamiento del modelo ahora está vinculado a la cuenta que lo creó, lo que notarás si transfieres conversaciones entre cuentas, por ejemplo, al cambiar de cuenta en medio del trabajo en Claude Code. En una auditoría automatizada de comportamiento con aproximadamente 1.850 escenarios, según la empresa, se desempeña igual o mejor que Sonnet 5 y, de todos sus modelos, es el que menos pone a prueba los límites del entorno en el que se ejecuta.

¿Es Sonnet 5.5 suficiente para tu trabajo diario, o prefieres pagar más por Opus?

Fuente: Anthropic

Sobre el autor

Adam Kurfürst

Adam studuje na gymnáziu a technologické žurnalistice se věnuje od svých 14 let. Pakliže pomineme jeho vášeň pro chytré telefony, tablety a příslušenství, rád se… Más sobre el autor

Adam Kurfürst
Sdílejte: