Anthropic presentó Sonnet 5, la nueva versión de su modelo de inteligencia artificial de gama media, diseñado para responder consultas cotidianas y gestionar agentes de IA con mayor autonomía, mejor rendimiento y un costo inferior al de modelos más avanzados.

La compañía aseguró que Sonnet 5 representa un importante salto respecto a la generación anterior y que, hace apenas unos meses, un rendimiento similar solo podía lograrse mediante modelos considerablemente más grandes y costosos.

El lanzamiento coincide con el regreso de Fable 5, el modelo de clase Mythos cuyo despliegue fue suspendido temporalmente hace dos semanas y que ahora vuelve a estar disponible a nivel global tras recibir la aprobación del gobierno de Estados Unidos.

Más autonomía para los agentes de IA

Según explicó Anthropic, Sonnet 5 está pensado tanto para responder preguntas de los usuarios como para ejecutar tareas complejas de forma autónoma.

El modelo puede interactuar con navegadores web, utilizar terminales y completar procesos de principio a fin con una intervención humana mínima, una capacidad que lo convierte en una herramienta especialmente orientada al desarrollo de agentes inteligentes.

En las pruebas internas realizadas por la empresa, Sonnet 5 mostró mejoras significativas en la finalización de tareas complejas y en distintos exámenes de rendimiento relacionados con conocimiento experto y uso de terminales.

Mejor rendimiento y mayor seguridad

Anthropic destacó que Sonnet 5 supera a Sonnet 4.6 en todas las pruebas comparativas publicadas.

Entre los avances más destacados figuran una reducción de los comportamientos indeseados y una mayor seguridad cuando opera como agente autónomo.

En evaluaciones como Humanity's Last Exam, orientada al conocimiento especializado, y Terminal-Bench v2.1, enfocada en tareas realizadas desde una terminal de comandos, el nuevo modelo mejoró en 10,6 y 13,4 puntos, respectivamente.

Se acerca a los modelos más potentes

La empresa también comparó Sonnet 5 con Opus 4.8, uno de sus modelos de mayor capacidad.

En pruebas relacionadas con trabajo de conocimiento realizado por agentes, Sonnet 5 logró igualar e incluso superar a Opus 4.8 en algunos casos.

Asimismo, al activar el nivel más alto de razonamiento, el nuevo modelo consigue aproximarse al rendimiento de Opus 4.8 en tareas especialmente exigentes.

No obstante, Anthropic reconoció que Opus continúa siendo superior en áreas como matemáticas avanzadas, razonamiento complejo y ciberseguridad ofensiva, un ámbito en el que Sonnet 5 incorpora limitaciones deliberadas por motivos de seguridad.

Disponible para todos los usuarios

Sonnet 5 ya está disponible como modelo predeterminado para los usuarios de Claude, tanto en la versión gratuita como en los planes Pro.

Para desarrolladores y empresas, Anthropic fijó un precio base de 3 dólares por millón de tokens de entrada y 15 dólares por millón de tokens de salida, manteniendo la estrategia de ofrecer un modelo con altas prestaciones a un costo inferior al de sus alternativas más avanzadas.

Un nuevo sistema de procesamiento

Otra de las novedades es la incorporación de un nuevo sistema de tokenización, encargado de procesar el texto antes de que sea interpretado por la inteligencia artificial.

Con información de Europa Press.