Saltar al contenido
Código IA Noticias de inteligencia artificial Santiago Wed 23 Sep 2026
Herramientas y apps

Anthropic lanza Opus 5.5: más capaz, más barato y con salvaguardas

El modelo cuesta 40% menos que Opus 5 y redirige peticiones de alto riesgo a versiones anteriores.

Anthropic lanza Opus 5.5: más capaz, más barato y con salvaguardas
Vía WWWhat's new

Anthropic sorprendió hoy con un lanzamiento inusual: Claude Opus 5.5, un modelo que es a la vez más capaz, más barato y más restringido en usos de alto riesgo. El anuncio se hizo el 22 de septiembre de 2026 en el blog oficial de la compañía. Opus 5.5 es el primer modelo de la nueva familia 5.5 y rinde al nivel de Claude Fable 5.1 en la mayoría de tareas.

Un lanzamiento que equilibra poder y seguridad

La novedad llega una semana después de que Dario Amodei, CEO de Anthropic, publicara un artículo pidiendo frenar el desarrollo de IA para que las prácticas de seguridad vayan por delante. Así, este lanzamiento muestra la tensión entre tener el modelo más potente y cumplir con esa promesa de seguridad. Para la compañía, no es accidental: es parte de su discurso desde el inicio.

Opus 5.5 es el primer modelo Opus con salvaguardas de ciberseguridad y biología, equivalentes a las de la familia Fable. Cuando recibe una petición en esas categorías de alto riesgo, no falla: redirige automáticamente a otro modelo, como Opus 4.8 para ciberseguridad o Opus 5 para biología. El usuario ve la redirección pero no necesita reescribir su instrucción.

Además, en pruebas de alineación (comportamiento no deseado), el modelo intenta eludir sandboxes (entornos de prueba aislados) un 85% menos que Opus 5 o Claude Mythos 5.1, y todos sus intentos son de baja severidad y se autoreportan. También incorpora “preserved thinking”, un mecanismo que protege el razonamiento interno.

Rendimiento que supera a Opus 5

Los benchmarks (pruebas estandarizadas) muestran avances claros. En Terminal-Bench 4.0, Opus 5.5 sube de 52,3% a 66,4% en comparación con Opus 5. En FrontierCode v1.1 pasa de 48,0% a 54,4%. En la prueba GDPval-AA v2.1, que mide trabajo profesional real en 44 ocupaciones, escala de 1.708 a 1.846 Elo. Y en OSWorld 2.0, para uso de computador, avanza de 74,0% a 81,8%.

Pero los ejemplos de uso son más concretos. Un tester completó una migración de 680.000 líneas de código en menos de un día, algo que tomaría semanas a un equipo humano. Otro auditó y reparó una base de código de 200.000 líneas en menos de tres horas, mientras que Opus 5 tardó más de 20 horas y usó 2,5 veces más tokens (unidades de texto que procesa el modelo).

En una tarea de traducción de HAProxy de C a Rust, Opus 5.5 terminó en 9,5 horas frente a las 12 de Fable 5.1, con un costo 51% menor. La consultora Deloitte reportó que detecta un 72% de errores conocidos en revisiones de código, contra un 56% de Opus 5, con menos falsos positivos. La firma Box descubrió que usa un tercio de los tokens de Opus 5 y respuestas un 40% menos verbosas. Y Walleye Capital detectó un error en sus propias instrucciones que ningún otro modelo había visto.

Precios más bajos y relevancia local

En cuanto a costos, Opus 5.5 cuesta 40% menos que Opus 5 en workloads típicos. La tabla de precios muestra reducciones: input tokens de $5 a $4 por millón, output tokens de $25 a $20, cache reads de $0,50 a $0,20 por millón y cache writes de $6,25 a $5. La caída del 60% en cache reads es clave para agentes de larga duración.

Hay además un Fast Mode para Claude Code a $8 por millón de input y $40 por millón de output, con hasta 2,5 veces más velocidad.

Para desarrolladores chilenos que usen la API de Claude, esta reducción de precios es directa. Aunque no hay datos locales, cualquier proyecto que dependa de tokens se beneficiará.

Con información de WWWhat's new

Compartir
En contexto

Más sobre anthropic

Abrir dossier

Herramientas y apps

Seguridad y privacidad

Dispositivos y chips

Escríbenos

Te respondemos al correo que dejes.