Anthropic sigue a la vanguardia en el desarrollo de inteligencia artificial agéntica. Aunque sus modelos más potentes pertenecen a la renombrada familia Opus, la empresa también dirige sus esfuerzos hacia la serie Sonnet, diseñada para aplicaciones generales con un enfoque en rendimiento, velocidad y costo-efectividad. En este contexto, da la bienvenida a su más reciente incorporación: Claude Sonnet 5.

Este nuevo modelo ha sido presentado como “el Sonnet más agéntico hasta la fecha”, destacando que su rendimiento es comparable al de Opus 4.8, la versión más avanzada de la serie, pero a un costo más accesible.

Detalles y Lanzamiento de Claude Sonnet 5

Claude Sonnet 5 ya se encuentra disponible como modelo predeterminado en los planes Gratis y Pro, y ha sido implementado en todas las suscripciones. Además, cuenta con una oferta especial de lanzamiento: solo 2$ por millón de tokens de entrada y 10$ por millón de tokens de salida, válida hasta el 31 de agosto. Posteriormente, los precios se incrementarán a 3$ y 15$, respectivamente.

Capacidades Impresionantes de Claude Sonnet 5

Las habilidades agénticas de Claude Sonnet 5 le permiten planificar, utilizar herramientas como navegadores y terminales, y operar de manera autónoma, alcanzando niveles que hasta ahora eran dominio exclusivo de modelos más grandes y costosos. Anthropic ha publicado resultados comparativos de rendimiento entre Sonnet 5, Sonnet 4.6 y Opus 4.8. Como se puede observar en la tabla a continuación, Sonnet 5 representa una mejora significativa respecto a su predecesor Sonnet 4.6 en aspectos como razonamiento, uso de herramientas, programación y conocimientos generales, mientras que su rendimiento se aproxima al de Opus 4.8, pero a un costo mucho más bajo.

Tabla comparativa rendimiento entre Claude Sonnet 5 y otros modelos

Los usuarios que han tenido acceso anticipado afirman que esta IA ahora es capaz de identificar y corregir sus propios errores antes de completar una tarea, algo que mejora significativamente la experiencia en entornos de producción digital.

El cofundador de Lovable, Fabian Hedin, compartió su entusiasmo: “Claude Sonnet 5 logra más con menos. Ofrece la misma calidad de resultados, pero reduce el número de pasos necesarios. Además, rechaza solicitudes inseguras de manera clara y consistente. En Lovable, proporcionamos herramientas poderosas a millones de desarrolladores. Un modelo que sabe cuándo decir que no es tan crucial como uno que sabe cómo desarrollar.”

Siguiendo esta línea, Anthropic ha destacado que Claude Sonnet 5 “muestra una tasa general de comportamientos indeseables inferior a Sonnet 4.6 y, en términos generales, es más seguro para su uso en contextos con agentes”. Este modelo es más efectivo al rechazar solicitudes maliciosas y resistir ataques de inyección rápida.

Límites en Ciberseguridad

La empresa aclara que “las evaluaciones indican que tiene una capacidad significativamente inferior para llevar a cabo tareas de ciberseguridad en comparación con nuestros modelos Opus actuales”. Así, aunque Claude Sonnet 5 puede ayudar a entender conceptos básicos o realizar tareas cibernéticas sencillas, se queda atrás frente a los “pesos pesados” como Opus 4.8 o Mythos 5. En pruebas de campo, como intentos controlados de hackear el navegador Firefox, Sonnet 5 no logró generar un ataque funcional.

Aunque Anthropic menciona una leve mejora en Sonnet 5 con respecto a su versión anterior (Sonnet 4.6), los logros parciales no derivan de una capacitación específica en hacking, sino que reflejan un razonamiento lógico y una inteligencia general superiores.

Para minimizar complicaciones de seguridad, Anthropic ha implementado en Sonnet 5 las medidas de seguridad que ya estaban disponibles en Claude Opus 4.7 y 4.8, las cuales permiten detectar y bloquear el uso peligroso de la red en tiempo real.

Conclusiones sobre Claude Sonnet 5

En resumen, Anthropic posiciona a Claude Sonnet 5 como un modelo idóneo y seguro para el mercado de consumo masivo. Para ello, la compañía ha limitado deliberadamente sus capacidades en ciberseguridad ofensiva y lo ha dotado de protecciones en tiempo real, que son utilizadas en sus modelos de alta gama para empresas.

Foto: generada con ChatGPT Images 2.0