Imagen: Anthropic
Anthropic ha presentado Claude Sonnet 5.5, el segundo modelo de la familia Claude 5.5 y el relevo directo de Sonnet 5. Según el anuncio oficial, responde al menos un 30% más rápido, cuesta hasta un 30% menos por tarea en la mayoría del trabajo y se queda muy cerca de Opus 5.5 en varias pruebas. Para quien usa Claude a diario, es el modelo intermedio, que ahora corre más y gasta menos sin tocar el precio.
El modelo rápido y barato de la familia
Anthropic lo plantea como el complemento más rápido y barato de Claude Opus 5.5. El reparto de papeles es claro: Opus 5.5 está pensado para el trabajo complejo que exige un juicio cuidadoso, mientras que Sonnet 5.5 rinde mejor en tareas acotadas del día a día, en corregir errores y en crear documentos, presentaciones y hojas de cálculo bien acabados. La compañía añade que tiene «buen ojo para el diseño».
La propia Anthropic admite el límite: las puntuaciones de las pruebas solo reflejan una faceta del modelo y, tanto en sus ensayos como en los de probadores externos, Opus 5.5 sigue siendo claramente más fuerte en el trabajo complejo y abierto que requiere un juicio sostenido. El siguiente en llegar a la familia, Claude Haiku 5.5, pensado para aplicaciones de gran volumen y sensibles al coste, llegará «en las próximas semanas».
Las cifras: del 10,3% al 70,6%
El salto más llamativo está en la programación. En Terminal-Bench 4.0, una evaluación de programación con agentes, Sonnet 5.5 marca un 70,6%, frente al 10,3% de Sonnet 5. En FrontierCode con esfuerzo alto logra 10 puntos más que su predecesor con el mismo ajuste, y con cerca de una quinceava parte del coste por tarea. En CursorBench, que usa tareas de sesiones reales de programación en Cursor, su mejor puntuación se queda a unos dos puntos de Opus 5.5.
Fuera del código también mejora. En GDPval-AA, que mide tareas reales de 44 profesiones y nueve grandes industrias, queda dos puntos por debajo de Opus 5.5 y unos 400 puntos por encima de Sonnet 5. Anthropic afirma además que supera con claridad a Sonnet 5 y a GPT-6 Sol en el trabajo de conocimiento de largo recorrido. Es el primer Sonnet que se pasa Pokémon Red trabajando solo a partir de capturas de pantalla.
Qué dicen los primeros probadores
Epic cuenta que, en sus pruebas iniciales, el modelo alcanzó «el mismo listón de calidad que cabría esperar de un modelo de gama superior» y manejó «decenas de miles de líneas de código» para la arquitectura de sistemas de juego. En Unity, donde una tarea solo cuenta si el cambio funciona de verdad, la mayor parte del trabajo de Sonnet 5.5 superó esa comprobación, y el modelo completó «el 90% de las tareas» de su prueba de varios pasos con Unity Editor y programación.
En las evaluaciones de Slackbot, y sin cambiar ninguna instrucción, Sonnet 5.5 superó a Sonnet 5 en casi todas, en menos pasos y con alrededor de un 14% menos de tokens de salida. Uno de los primeros probadores lo resume así: «Rápido programando, y se le puede reconducir enseguida en flujos de trabajo iterativos». Otro, que lo probó con casos reales de soporte, asegura que «las incidencias se procesaron un 20% más rápido».
Qué cambia para quien usa Claude
El precio no se mueve respecto a Sonnet 5: Anthropic lo fija en 2 dólares por millón de tokens de entrada, 10 dólares por millón de tokens de salida y 0,20 dólares por millón en lecturas de caché. El ahorro llega por otro lado, porque suele necesitar muchos menos tokens para hacer el mismo trabajo. Y es, además, el Sonnet más rápido hasta la fecha.
El nivel de esfuerzo marca el equilibrio: en los ajustes bajos responde antes y gasta menos; en los altos, razona más y revisa mejor su trabajo. En Claude Code y en las aplicaciones de Anthropic viene en medio por defecto; en la Claude Platform, en alto. Ya está disponible en todas las plataformas, incluidas Amazon Web Services, Google Cloud y Microsoft Azure, y los desarrolladores pueden usarlo en la Claude Platform con el identificador claude-sonnet-5-5. Quien use Sonnet con el pensamiento apagado tendrá que pasar al nuevo ajuste between_tools antes de dar el salto.
Un Sonnet con frenos de ciberseguridad
Como su capacidad en ciberseguridad es comparable a la de Opus 5, es el primer Sonnet que se lanza con salvaguardas y mecanismos de respaldo como los de los modelos más capaces de la casa. Se pueden seguir buscando y corrigiendo errores en el código propio, pero las tareas de ciberseguridad de mayor riesgo pasarán de forma visible a Sonnet 5. El desarrollo rutinario no se ve afectado.
También es el primer Sonnet con clasificadores de seguridad que impiden extraer su razonamiento, una defensa contra la destilación: ataques en los que se usan miles de cuentas falsas para extraer las capacidades de un modelo a escala industrial.
Te puede interesar
Tech Planet participa en el programa de afiliados de Amazon. Si compras a través de estos enlaces, recibimos una pequeña comisión sin coste extra para ti, lo que nos ayuda a seguir creando contenido como este.
| Imagen | Producto | Características | Comprar |
|---|---|---|---|
![]() |
GL.iNet GL-MT3000 Beryl AX, router de viaje | Wi-Fi 6 de doble banda · WAN de 2,5 G · OpenVPN y WireGuard · OpenWrt · DNS sobre HTTPS y sobre TLS | Ver precio en Amazon |
![]() |
Beelink ME Mini, NAS de escritorio | Intel N95 (4 núcleos / 4 hilos) · 12 GB LPDDR5 · 6 ranuras M.2 NVMe de hasta 4 TB cada una · doble LAN de 2,5 Gbps | Ver precio en Amazon |
![]() |
Curso intensivo de Python, tercera edición | libro · tercera edición | Ver precio en Amazon |
![]() |
Raspberry Pi 5 | Broadcom BCM2712 · CPU Arm Cortex-A76 de 4 núcleos a 2,4 GHz · Wi-Fi de doble banda y Bluetooth 5.0 · Gigabit Ethernet con PoE+ (requiere HAT aparte) | Ver precio en Amazon |
Escrito por Eloy Andrade









