Claude Sonnet 5.5: La nueva referencia en velocidad, coste y desarrollo de código

Anthropic ha presentado Claude Sonnet 5.5, la segunda incorporación a la familia Claude 5.5. Este modelo llega como una opción más ágil y rentable que su hermano mayor, Opus 5.5, y promete ser un salto notable frente al anterior Sonnet 5. La compañía lo define como un complemento perfecto para tareas bien definidas del día a día, como corregir errores de código, redactar documentos o preparar presentaciones.

Qué ofrece Claude Sonnet 5.5

La principal novedad es su equilibrio entre rendimiento y coste. Según Anthropic, Sonnet 5.5 es más de un 30% más rápido que Sonnet 5 y puede costar hasta un 30% menos por tarea, gracias a que necesita menos tokens para completar el mismo trabajo. Esto lo convierte en una opción atractiva para desarrolladores y empresas que buscan eficiencia sin sacrificar calidad.

[Haz clic en la imagen para ampliar]

En las pruebas internas, el modelo ha mostrado mejoras espectaculares en programación. Por ejemplo, en la evaluación Terminal-Bench 4.0, que mide tareas complejas en línea de comandos, Sonnet 5.5 alcanzó un 70,6% frente al 10,3% de Sonnet 5. También destaca en tareas de larga duración y en comprensión de imágenes, siendo el primer modelo Sonnet capaz de completar el juego Pokémon Red solo con capturas de pantalla.

Puntos clave de Sonnet 5.5

  • Velocidad: genera respuestas más de un 30% más rápido que Sonnet 5.
  • Coste: hasta un 30% menos por tarea, aunque el precio por token se mantiene igual (2 dólares por millón de tokens de entrada y 10 por salida).
  • Rendimiento en código: supera ampliamente a Sonnet 5 en pruebas como Terminal-Bench y FrontierCode.
  • Colaboración: escribe de forma más clara y natural, lo que facilita el trabajo en equipo.
  • Seguridad: incluye salvaguardas específicas para ciberseguridad y biología, similares a las de los modelos más avanzados.

Comparativa con otros modelos

Sonnet 5.5 se sitúa entre Sonnet 5 y Opus 5.5. En varias evaluaciones, con el nivel de esfuerzo máximo, se acerca a Opus 5.5, pero Anthropic insiste en que Opus sigue siendo superior en tareas complejas y abiertas que requieren juicio sostenido. La siguiente tabla resume las diferencias principales:

[Haz clic en la imagen para ampliar]
ModeloVelocidadCoste por tareaRendimiento en código
Sonnet 5ReferenciaReferenciaBajo (10,3% en Terminal-Bench)
Sonnet 5.5+30% más rápidoHasta -30%Alto (70,6% en Terminal-Bench)
Opus 5.5Más lentoMás altoSuperior en tareas complejas

Disponibilidad y seguridad

Claude Sonnet 5.5 ya está disponible en todas las plataformas, incluyendo Amazon Web Services, Google Cloud y Microsoft Azure. Los desarrolladores pueden acceder a él a través de la API con el identificador claude-sonnet-5-5. Además, mantiene la política de cero retención de datos, lo que refuerza la privacidad.

En cuanto a seguridad, Anthropic ha implementado salvaguardas específicas para ciberseguridad y biología, similares a las de Opus 5.5. También ha añadido protecciones contra ataques de destilación, que buscan extraer las capacidades del modelo a gran escala. Estas medidas no afectan al uso habitual, pero sí limitan ciertas peticiones de alto riesgo.

Preguntas y respuestas

¿Cuánto cuesta Claude Sonnet 5.5?

El precio por token es el mismo que el de Sonnet 5: 2 dólares por millón de tokens de entrada, 10 por millón de salida y 0,20 por millón para lecturas de caché. Sin embargo, al necesitar menos tokens por tarea, el coste total por tarea puede ser hasta un 30% menor.

¿En qué se diferencia de Opus 5.5?

Sonnet 5.5 es más rápido y barato, ideal para tareas cotidianas y bien definidas. Opus 5.5 está diseñado para trabajos complejos que requieren un juicio cuidadoso y sostenido. En pruebas, Sonnet 5.5 se acerca a Opus en algunas áreas, pero Opus sigue siendo superior en tareas abiertas y complejas.

¿Qué mejoras trae en programación?

Sonnet 5.5 muestra avances notables: en Terminal-Bench 4.0 pasa de un 10,3% a un 70,6%, y en FrontierCode supera a Sonnet 5 por 10 puntos. Además, los desarrolladores destacan que entiende el código más rápido y necesita menos pasos para completar tareas.