Anthropic presentó Claude Opus 5.5 el 22 de septiembre de 2026, el primer modelo de su nueva familia 5.5. El dato central es simple: cuesta 40% menos operarlo que Opus 5 y rinde al nivel de Fable 5.1 en la mayoría de las tareas.
Es el primer lanzamiento de la compañía desde que pidió públicamente pausar el ritmo de la frontera de la IA, y llega evaluado antes de salir a producción por firmas externas como Frontier Design y METR.
TL;DR
- Anthropic lanzó Claude Opus 5.5 el 22 de septiembre de 2026, primer modelo de la familia 5.5.
- El nuevo modelo rinde al nivel de Fable 5.1 en la mayoría de las tareas, según Anthropic.
- Cuesta 40% menos que Opus 5 en cargas de trabajo típicas, con tokens de entrada a $4 y salida a $20 por millón.
- Las lecturas de caché bajan a $0,20 por millón de tokens, 60% menos que Opus 5.
- Genera texto más de 30% más rápido que Opus 5 y completó una migración de 680.000 líneas de código en menos de un día.
- Obtuvo el mejor puntaje hasta ahora en la auditoría de comportamiento automatizada de Anthropic.
- Es comparable a Claude Mythos 5.1 en biología y ciberseguridad, por lo que usa las salvaguardas de Fable 5.1.
- Sonnet 5.5 y Haiku 5.5 llegarán en las próximas semanas con mejoras similares.
Qué pasó
Claude Opus 5.5 llega como el modelo insignia de Anthropic y reemplaza a Opus 5 en el tope de su catálogo. La compañía lo describe como comparable en rendimiento a Claude Fable 5.1 en la mayoría de las tareas, pero con un costo de cómputo significativamente menor.
El anuncio llega después de que Anthropic pidiera frenar el ritmo de desarrollo en la frontera de la IA, una postura pública sobre la velocidad a la que se despliegan modelos cada vez más capaces. Opus 5.5 es la primera prueba de esa postura. Antes de salir, pasó por evaluadores externos como Frontier Design y METR, además de la auditoría de comportamiento automatizada interna de Anthropic, la más extensa que aplica la empresa.
Según Anthropic, Opus 5.5 obtuvo los mejores resultados de esa auditoría entre todos los modelos que probó hasta ahora. Es menos propenso a tomar acciones difíciles de revertir o a actuar fuera de los límites que se le fijan, y resiste mejor los intentos de inyección de prompt que Opus 5.
Contexto e historia
La familia Claude 5.5 sucede a la generación que integró a Opus 5, Fable 5.1 y Mythos 5.1 a lo largo de 2026. Cada lanzamiento de ese ciclo vino acompañado de programas de verificación para dominios sensibles, biología y ciberseguridad, donde un modelo más capaz también es un modelo con más potencial de uso indebido.
Opus 5.5 hereda ese esquema. Anthropic dice que su desempeño en biología y ciberseguridad es comparable al de Claude Mythos 5.1, así que lo despliega con las mismas salvaguardas que usa para Fable 5.1, con acceso abierto para uso general pero acceso verificado para investigación de alto riesgo. Las organizaciones ya pueden aplicar al Life Sciences Verification Program para usar Opus 5.5 en investigación biológica, y en las próximas semanas se ampliará el Cyber Verification Program para profesionales de ciberseguridad verificados.
sequenceDiagram
participant O as Organizacion
participant A as Anthropic
participant M as Claude Opus 5.5
O->>A: solicita acceso al programa de verificacion
A-->>O: valida credenciales y aprueba el acceso
O->>M: envia consultas de investigacion
M-->>O: responde con las salvaguardas de Fable 5.1 activas
Note over O,M: el mismo flujo aplica al Cyber Verification Program
Ese patrón, capacidad creciente acompañada de verificación creciente, es la forma en que Anthropic viene manejando la tensión entre publicar modelos más útiles y evitar que esos mismos modelos faciliten daños graves.
Detalles técnicos y rendimiento de Claude Opus 5.5
En pruebas internas, un evaluador completó una migración de código de 680.000 líneas en menos de un día, un trabajo que a un equipo de ingeniería le habría tomado semanas. Anthropic también probó a Opus 5.5 recortando tiempos de carga en cada página de una aplicación web, y tuvo éxito en 39 de 40 intentos, mientras que Opus 5 lograba mejoras más chicas y, en varios casos, alteraba el comportamiento de la aplicación al hacerlo.
En un tercer test, distintos modelos de Claude construyeron un videojuego a partir de un único prompt. Opus 5.5 obtuvo el puntaje más alto de todos por la calidad de sus gráficos y el pulido del resultado final.
La siguiente tabla resume los benchmarks que publicó Anthropic, comparando Opus 5.5 contra Fable 5.1, Opus 5 y los modelos de la competencia (GPT-6 Astra y GPT-5.6 Sol):
BenchmarkOpus 5.5Fable 5.1Opus 5GPT-6 AstraGPT-5.6 Sol
Terminal-Bench 4.0 (código agéntico)66,4%55,8%52,3%57,9%37,3%
FrontierCode v1.154,4%50,3%48,0%53,3%47,5%
CursorBench 4.057,8%51,8%46,6%N/D41,7%
GDPval-AA v2.1 (trabajo de conocimiento)18461735170815421588
AutomationBench40,0%31,4%26,9%41,4%28,8%
Humanity's Last Exam (con herramientas)67,7%65,6%63,6%57,2%N/D
Terminal-Bench-Science 0.158,7%52,6%29,0%64,6%22,4%
OSWorld 2.0 (uso de computadora)81,8%80,7%74,0%N/DN/D
Los resultados en razonamiento multidisciplinario también subieron: Opus 5.5 llegó a 67,7% en Humanity's Last Exam usando herramientas, frente a 63,6% de Opus 5. En reconocimiento de gráficos (Chartography), pasó de 83,4% a 89,0% con herramientas. Son mejoras de pocos puntos frente a Fable 5.1 en casi todos los benchmarks, lo que confirma lo que la propia Anthropic advierte en su comparativo. A este nivel de capacidad, dice la empresa, los márgenes de benchmark se volvieron una guía menos confiable de las diferencias reales de uso, y en su experiencia interna la distancia entre Opus 5.5 y Fable 5.1 es más chica de lo que sugieren estos números.
En seguridad, Anthropic amplió sus pruebas de alineación para cubrir tareas más largas, tareas imposibles de completar bien y escenarios calcados de incidentes reales. El detalle completo de esa evaluación está en el System Card de Opus 5.5, publicado junto con el modelo.
💭 Clave: Anthropic advierte que, a partir de cierto nivel de capacidad, la brecha entre modelos en los benchmarks deja de reflejar con precisión la brecha real de utilidad en el trabajo diario.
Opus 5.5 completó una migración de 680.000 líneas de código en menos de un día.
Cómo empezar
Opus 5.5 se usa a través de la API de Anthropic con el identificador de modelo claude-opus-5-5. El primer paso es guardar la clave de API como variable de entorno.
En Windows (PowerShell):
setx ANTHROPIC_API_KEY "tu-clave-de-api"
En macOS y Linux (bash o zsh):
export ANTHROPIC_API_KEY="tu-clave-de-api"
Con la clave configurada, una llamada mínima a la API se ve así:
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2026-01-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-opus-5-5",
"max_tokens": 1024,
"messages": [{"role": "user", "content": "Explica que hace este script de deploy"}]
}'
Esa llamada devuelve un objeto JSON con la respuesta del modelo. Para un uso más realista, agéntico, conviene manejarlo desde el SDK de Python y confirmar explícitamente qué modelo respondió antes de confiar en el resultado:
import anthropic
client = anthropic.Anthropic()
response = client.messages.create(
model="claude-opus-5-5",
max_tokens=4096,
messages=[
{"role": "user", "content": "Revisa este modulo y sugiere como reducir su tiempo de carga"}
],
)
assert response.model == "claude-opus-5-5"
print(response.content[0].text)
El assert sobre response.model es la forma más simple de confirmar, en cada llamada, que efectivamente se está usando Opus 5.5 y no un modelo distinto por un error de configuración o un fallback silencioso.
💡 Tip: si tu aplicación cachea prompts largos (system prompts, documentación, contexto de un repo), revisá el costo de cache reads en tu dashboard de uso. A $0,20 por millón de tokens es ahí donde más se nota la baja de precio.
Impacto y análisis
El recorte de precio no es parejo entre tipos de token. Los tokens de entrada y salida bajaron 20%, a $4 y $20 por millón respectivamente, pero las lecturas de caché cayeron 60%, a $0,20 por millón. Anthropic señala que esas lecturas de caché son la mayor parte del costo en trabajo agéntico y de programación, así que el ahorro real para un agente que corre horas sobre el mismo repositorio es mayor al 40% que anuncia el titular.
Esto no es solo una mejora incremental de modelo, sino una corrección de precio pensada para el cómputo agéntico de largo plazo, para agentes que leen el mismo contexto una y otra vez durante una sesión larga.
Para equipos de desarrollo en América Latina que ya pagan estos servicios en dólares, la baja de precio importa doblemente. Reduce el costo directo por token y, al ser Opus 5.5 más rápido, reduce también el tiempo de cómputo facturado por tarea. Un agente que antes tardaba minutos en iterar sobre un monorepo grande ahora termina más rápido y consume menos lecturas de caché por sesión.
Anthropic acompañó el lanzamiento con dos cambios de producto. Subió los límites de uso de cinco horas en los planes Pro, Max, Team y Enterprise por asiento, y sumó un reinicio de límite de tasa que los usuarios de planes pagos pueden guardar y usar cuando quieran, en vez de perderlo si no lo consumen.
La comunicación del modelo también cambió. Los primeros usuarios que lo probaron describieron su escritura como más clara y ordenada que la de Opus 5, con la información más importante puesta al principio. Un usuario citado por Anthropic lo resumió así: "escribe como yo escribo". Para Anthropic, eso no es solo un detalle de estilo, sino un beneficio de seguridad: un modelo cuyo trabajo se sigue y se revisa más fácil también es, en la práctica, un modelo más fácil de supervisar.
El límite más real de este lanzamiento es el acceso a las capacidades de mayor riesgo. Usar Opus 5.5 para investigación biológica de punta o para trabajo de ciberseguridad requiere pasar por los programas de verificación, algo que no se consigue simplemente creando una cuenta de API. Y aunque el modelo generó texto un 30% más rápido que Opus 5, sigue siendo el modelo más caro del catálogo de Anthropic. La baja de precio lo acerca a Fable 5.1, no lo convierte en la opción barata.
⚠️ Ojo: Sonnet 5.5 y Haiku 5.5 todavía no salieron. Si tu caso de uso no necesita el tope de capacidad, probablemente convenga esperar a esas versiones antes de migrar todo tu pipeline a Opus 5.5.
Las lecturas de caché bajaron 60%, el mayor recorte de precio de todo el lanzamiento.
Qué sigue
Anthropic confirmó que Claude Sonnet 5.5 y Claude Haiku 5.5 llegarán en las próximas semanas, con buena parte de las mismas mejoras de rendimiento, eficiencia y seguridad que trae Opus 5.5. Eso va a definir si el recorte de precio de Opus 5.5 se vuelve el piso de toda la familia o si queda como el caso particular del modelo más grande.
También queda pendiente la expansión del Cyber Verification Program, prometida para las próximas semanas, que va a ampliar quién puede usar Opus 5.5 sin restricciones en trabajo de ciberseguridad.
📖 Resumen en Telegram: Ver resumen
Probalo vos: corré el curl de arriba con tu propia API key y compará el campo response.model contra el que te devolvía Opus 5 la semana pasada.
Preguntas frecuentes
¿Qué es Claude Opus 5.5?
Es el primer modelo de la familia Claude 5.5 de Anthropic, presentado el 22 de septiembre de 2026. Rinde al nivel de Fable 5.1 en la mayoría de las tareas y cuesta 40% menos operarlo que Opus 5.
¿Cuánto cuesta usar Claude Opus 5.5 frente a Opus 5?
Los tokens de entrada cuestan $4 por millón y los de salida $20 por millón, 20% menos que Opus 5. Las lecturas de caché bajaron 60%, a $0,20 por millón de tokens.
¿Necesito verificación especial para usarlo en biología o ciberseguridad?
Sí, si el uso es de investigación de alto riesgo. Anthropic considera a Opus 5.5 comparable a Mythos 5.1 en esas áreas, así que aplica las mismas salvaguardas que a Fable 5.1, con acceso verificado vía el Life Sciences Verification Program y, próximamente, el Cyber Verification Program.
¿Cuándo llegan Claude Sonnet 5.5 y Claude Haiku 5.5?
Anthropic dijo que saldrán en las próximas semanas, con mejoras similares de rendimiento, eficiencia y seguridad.
¿Qué significa que Anthropic frene el ritmo de la frontera?
Es la postura pública de Anthropic sobre desacelerar la velocidad de despliegue de modelos cada vez más capaces. Opus 5.5 es el primer lanzamiento de la compañía después de adoptar esa postura, y pasó por evaluadores externos como METR antes de salir.
¿Cómo confirmo que una respuesta vino de Opus 5.5 y no de otro modelo?
Revisando el campo model del objeto de respuesta de la API, que debe ser exactamente claude-opus-5-5.
Referencias
- Anthropic: Introducing Claude Opus 5.5: anuncio oficial con benchmarks, precios y detalles del System Card.
- METR: una de las organizaciones externas que evaluó a Opus 5.5 antes de su lanzamiento.
- Documentación de la API de Anthropic: referencia de endpoints, modelos y parámetros para integrar Claude Opus 5.5.
- Wikipedia: Anthropic: contexto general sobre la compañía y su familia de modelos Claude.
📱 ¿Te gusta este contenido? Únete a nuestro canal de Telegram @programacion donde publicamos a diario lo más relevante de tecnología, IA y desarrollo. Resúmenes rápidos, contenido fresco todos los días.
Top comments (0)