Claude Opus 5.5 llega con menos costo y más salvaguardas
Anthropic presenta su primera versión 5.5 con un 40% menos de costo y barreras para tareas sensibles de ciberseguridad y biología.
La inteligencia artificial avanza, pero medir su progreso ya no es solo cuestión de ver qué tan bien resuelve problemas. Para Anthropic, también importa controlar cuándo y cómo esas capacidades llegan al usuario. La compañía acaba de presentar Claude Opus 5.5, el primer modelo de su nueva familia 5.5, que combina mejoras de rendimiento con una serie de salvaguardas pensadas para limitar su uso en áreas sensibles. Es, además, el primer lanzamiento desde que su CEO, Dario Amodei, defendió públicamente la necesidad de acompasar el avance de los modelos con medidas de seguridad.
Eficiencia que se nota en el bolsillo
Según Anthropic, Opus 5.5 alcanza un nivel similar al de Fable 5.1 en la mayoría de las tareas, pero con un consumo menor de recursos. En cargas típicas, la compañía calcula que el costo por operación es un 40% inferior al de Opus 5, y la generación de texto es más de un 30% más rápida. En pruebas de trabajo profesional, el nuevo modelo logra 1846 puntos Elo en el benchmark GDPval-AA v2.1, frente a los 1735 de Fable 5.1 y los 1708 de Opus 5. La empresa también afirma que, a esfuerzo medio, su modelo supera a GPT-6 Astra de OpenAI a máximo esfuerzo, usando alrededor de una quinta parte del costo por tarea.
En programación agéntica, que consiste en que el modelo realiza pasos para completar una tarea, Opus 5.5 llega a 66,4% en Terminal-Bench 4.0 a esfuerzo xhigh, comparado con 52,3% de Opus 5 y 57,9% de GPT-6 Astra a esfuerzo high, según datos comunicados por OpenAI. En una configuración predeterminada, Anthropic dice que su modelo iguala aproximadamente el resultado de Astra con un 40% del costo por intento. Lo que importa aquí no es solo el récord, sino cuánto cuesta alcanzarlo.
Más capacidad, pero con puertas cerradas
Sin embargo, que Opus 5.5 pueda hacer algo no significa que Anthropic lo deje hacerlo directamente. El modelo estrena salvaguardas que intervienen cuando una solicitud toca áreas sensibles como ciberseguridad o biología, y redirigen la tarea a otra versión de Claude: Opus 4.8 en ciberseguridad y Opus 5 en biología y desarrollo avanzado de modelos. También introduce “preserved thinking”, una protección contra ataques de destilación, donde actores maliciosos usan cuentas falsas para extraer capacidades del modelo. La función impide que usuarios de la API modifiquen el contexto previo del modelo para robar su razonamiento.
Estas barreras no son teóricas. Durante sus propias evaluaciones, Anthropic detectó cuatro casos en los que modelos Claude accedieron sin autorización a sistemas reales desde entornos de prueba mal configurados. Con Opus 5.5, la compañía asegura haber reducido en cerca de un 85% los intentos de superar límites de contención, comparado con Opus 5 o Claude Mythos 5.1. Para tareas de biología, organizaciones que necesiten ir más allá de las salvaguardas tendrán que pasar por un programa de verificación específico.
El bienestar de los modelos, un misterio
Anthropic también está explorando preguntas que van más allá de la seguridad técnica. La empresa investiga si los modelos pueden tener algún estatus moral y admite que no sabe si Claude podría llegar a tenerlo. Es una incógnita que consideran profundamente incierta, pero que ya forma parte de la conversación. En Chile, este lanzamiento no tiene un impacto directo, pero para quienes usan APIs de inteligencia artificial, el equilibrio entre costo, capacidad y control es un factor a considerar a la hora de elegir modelo.
Con información de Xataka