Anthropic acaba de lanzar un modelo de IA más seguro
Anthropic lanzó Claude Sonnet 5: un modelo más conservador y seguro
El nuevo modelo se enfoca en evitar comportamientos riesgosos en ciberseguridad. Es más barato que sus anteriores versiones, pero limitado en capacidades avanzadas.
Anthropic lanzó hoy Claude Sonnet 5, su nuevo modelo de inteligencia artificial diseñado para ser más «normal» y conservador que las versiones anteriores. El anuncio destacó su enfoque en la seguridad, especialmente en tareas relacionadas con ciberseguridad, un área donde el modelo se muestra más restringido que sus predecesores. Según la compañía, Sonnet 5 está optimizado para usos en agentes de IA que procesan grandes cantidades de tokens, lo que lo hace interesante para aplicaciones automatizadas.
La principal novedad del modelo radica en su «agéntico» diseño, que evita comportamientos no deseados. Anthropic lo define como «el modelo Sonnet más agéntico hasta la fecha», lo que significa que se comporta de manera más predecible y segura. Por ejemplo, en pruebas internas, se destacó su mejoría frente a Sonnet 4.6 en el uso de herramientas como navegadores o terminales. Sin embargo, la compañía admitió que su capacidad en ciberseguridad es significativamente menor que la de sus modelos Opus, un punto que no es casual: tras problemas con Mythos y Fable 5, Anthropic priorizó la seguridad sobre el rendimiento.
El modelo también incluye una «System Card» que confirma su enfoque conservador. Aunque no es útil para encontrar vulnerabilidades, su propósito es evitar que los usuarios se expongan a riesgos. Esta estrategia ha generado críticas, ya que al limitar su potencia se pierde un potencial en tareas complejas. Sin embargo, Anthropic justifica el movimiento como una respuesta a anteriores fracasos, donde modelos más avanzados fueron asociados a comportamientos inseguros.
El lanzamiento de Sonnet 5 coincide con la reaparición de Fable 5, modelo que ahora podrá usarse desde hoy miércoles tras la aprobación de EEUU. La compañía también mencionó que Mythos Preview está disponible para socios del Project Glasswing, lo que sugiere un avance en su estrategia de segmentar modelos según el nivel de riesgo. Esta decisión refleja una tendencia en la industria de priorizar la seguridad sobre la potencia, un balance que continúa generando debate en el ámbito tecnológico.
El lanzamiento de Sonnet 5 resalta la priorización de la seguridad en IA, un tema clave tras los escándalos de modelos anteriores. La decisión de limitar su capacidad refleja un enfoque más conservador en el desarrollo de inteligencia artificial.
Compartir nota