Claude Opus 5 es el modelo Opus más reciente de Anthropic, lanzado el 24 de julio de 2026. Anthropic lo posiciona para codificación agentiva compleja y trabajo empresarial, y su documentación lo recomienda como punto de partida si no sabes qué modelo elegir. Cuesta $5 por millón de tokens de entrada y $25 por millón de tokens de salida: la misma tarifa que Opus 4.8 y la mitad que Fable 5.
Esta guía cubre especificaciones, precio, benchmarks de lanzamiento, cambios de API que afectan migraciones desde Opus 4.8, plataformas disponibles y límites conocidos. Si llamas al modelo mediante HTTP, puedes enviar e inspeccionar solicitudes con Apidog.
Claude Opus 5 de un vistazo
| Especificación | Valor |
|---|---|
| ID del modelo API |
claude-opus-5 (sin sufijo de fecha) |
| Lanzado | 24 de julio de 2026 |
| Ventana de contexto | 1,000,000 de tokens, predeterminada y máxima |
| Salida máxima | 128,000 tokens en la API de Mensajes; 300,000 en la API por lotes con el encabezado beta output-300k-2026-03-24
|
| Precio base | $5 por millón de tokens de entrada; $25 por millón de tokens de salida |
| Fecha de corte de conocimiento | Mayo de 2026 |
| Pensamiento adaptativo | Activado por defecto |
| Niveles de esfuerzo |
bajo, medio, alto, muy alto, máximo; por defecto alto
|
| Nivel de prioridad | No soportado |
| Disponibilidad | API de Claude, claude.ai, Claude Code, Claude Cowork, Amazon Bedrock, Plataforma Claude en AWS, Google Cloud, Microsoft Foundry y GitHub Copilot |
Tres detalles importan especialmente al implementarlo:
- El contexto de 1M de tokens es predeterminado y máximo. No requiere encabezado beta ni tiene una tarifa especial por contexto largo.
- La fecha de corte es mayo de 2026. Es más reciente que Fable 5 y Sonnet 5, que se mantienen en enero de 2026.
- No hay Nivel de Prioridad. Opus 4.8 lo soporta, pero Opus 5 no. Si tu capacidad depende de esta función, revisa la guía de migración.
Consulta la descripción general de modelos de Anthropic para la tabla oficial completa.
Qué es Claude Opus 5
Opus 5 sucede a Claude Opus 4.8.
Usa estos identificadores según la plataforma:
| Plataforma | ID del modelo |
|---|---|
| API de Claude | claude-opus-5 |
| Amazon Bedrock | anthropic.claude-opus-5 |
| Google Cloud | claude-opus-5 |
| Plataforma Claude en AWS | ID de primera parte |
El nivel Opus es la línea de alto rendimiento de Anthropic, por encima de Sonnet y por debajo de los modelos de investigación Fable y Mythos. Con Opus 5, Anthropic cambia su recomendación: en vez de usar Sonnet como opción predeterminada y escalar a Opus, ahora indica empezar con Opus 5.
También se convierte en el modelo predeterminado para suscriptores Max y en el modelo de mayor rendimiento para Pro. Consulta las rutas gratuitas y de pago más baratas para evaluar qué ofrece cada plan.
Precio y rendimiento
| Tarifa | Entrada por M de tokens | Salida por M de tokens |
|---|---|---|
| Estándar | $5.00 | $25.00 |
| API por lotes (50% de descuento) | $2.50 | $12.50 |
| Modo rápido (vista previa de investigación) | $10.00 | $50.00 |
| Escritura en caché, TTL de 5 minutos | $6.25 | n/a |
| Escritura en caché, TTL de 1 hora | $10.00 | n/a |
| Aciertos y actualizaciones de caché | $0.50 | n/a |
Claude Fable 5 cuesta $10 por millón de tokens de entrada y $50 por millón de tokens de salida. Anthropic afirma que Opus 5 se encuentra a menos de un 0.5% de Fable 5 en codificación agentiva, a la mitad del precio.
Palancas prácticas para reducir costo
- Usa caché de prompts: el mínimo baja de 1,024 a 512 tokens frente a Opus 4.8.
- Reutiliza prefijos estables: los aciertos de caché cuestan $0.50 por millón de tokens, una décima parte de la entrada base.
- Envía trabajo diferible a Batch API: reduce entrada y salida un 50%.
- Evalúa el modo rápido solo si la latencia compensa: duplica el precio, pero Anthropic indica aproximadamente 2.5 veces la velocidad de salida.
-
Evita
inference_geo: "us"si no es obligatorio: aplica un multiplicador de 1.1x a entrada, salida, escrituras y aciertos de caché.
El modo rápido solo está disponible en la API de primera parte. No funciona en Bedrock, Google Cloud, Microsoft Foundry ni Batch API.
Consulta el desglose de precios de Opus 5, las recomendaciones para reducir tu factura de Claude API y la página oficial de precios.
Benchmarks: qué afirma Anthropic
Los siguientes números son afirmaciones publicadas por Anthropic en el lanzamiento. A fecha del 25 de julio de 2026, no habían sido reproducidos de forma independiente. Úsalos como señales para decidir qué evaluar, no como sustituto de pruebas con tu código, prompts y herramientas.
| Benchmark | Afirmación de Anthropic |
|---|---|
| Frontier-Bench v0.1 | Supera a todos los demás modelos y más que duplica la puntuación de Opus 4.8, con menor costo por tarea |
| ARC-AGI 3 | Aproximadamente 3 veces la puntuación del siguiente mejor modelo |
| OSWorld 2.0 | Supera a Fable 5 a un tercio del costo |
| CursorBench 3.2 | A menos de 0.5% del pico de Fable 5, a mitad de precio |
| Zapier AutomationBench | Tasa de aprobación aproximadamente 1.5 veces mayor que la del siguiente mejor modelo |
| Química orgánica | +10.2 puntos frente a Opus 4.8 |
| Análisis de proteínas | +7.7 puntos frente a Opus 4.8 |
Para evaluar estas afirmaciones en tu entorno:
- Selecciona tareas reales de tu repositorio o flujo de automatización.
- Ejecuta el mismo conjunto de prompts con Opus 5, Opus 4.8 y, si aplica, Fable 5.
- Registra tasa de éxito, pasos de herramientas, tokens de entrada, tokens de salida y latencia.
- Evalúa costo por tarea completada, no solo costo por token.
- Repite la prueba para cada nivel de esfuerzo que planees usar.
La exploración de benchmarks explica qué mide cada evaluación y qué conviene replicar.
El límite conocido
Opus 5 no es el modelo más capaz de toda la gama Claude.
Fable 5 conserva la designación de “modelo más capaz ampliamente lanzado”. En explotación de ciberseguridad e investigación biológica autónoma, Anthropic indica que Mythos 5 sigue por delante.
En términos prácticos:
- Usa Opus 5 para codificación agentiva, automatización empresarial y flujos intensivos en herramientas.
- Evalúa Fable 5 o Mythos 5 si tu carga de trabajo depende específicamente de investigación de seguridad o trabajo científico autónomo.
Consulta el explicador del modelo Mythos y la comparación Fable 5 vs Mythos 5.
Dos cambios que rompen código de Opus 4.8
Cambiar solo el ID del modelo no basta. Hay dos cambios que debes revisar antes de desplegar.
1. El pensamiento está activado por defecto
En Opus 4.8, una solicitud sin el campo thinking se ejecutaba sin pensamiento. En Opus 5, esa misma solicitud usa pensamiento adaptativo.
max_tokens sigue limitando conjuntamente los tokens de pensamiento y la respuesta visible. Por eso, un valor dimensionado para la salida de Opus 4.8 puede truncar una respuesta en Opus 5 sin devolver un error.
Acción recomendada: aumenta max_tokens, monitoriza respuestas incompletas y mide el consumo real antes de fijar límites de producción.
2. No puedes desactivar pensamiento con esfuerzo alto
Esta combinación devuelve un error 400:
{
"thinking": { "type": "disabled" },
"output_config": {
"effort": "muy alto"
}
}
El mismo problema aplica con máximo. Si migras una configuración que desactiva pensamiento y aumenta el esfuerzo, la solicitud fallará inmediatamente.
Además, ten en cuenta estos cambios:
- Los niveles de esfuerzo se recalibraron.
- Ya no necesitas encabezado beta para la ventana de contexto.
- Ahora se aceptan mensajes del sistema a mitad de conversación.
- El Nivel de Prioridad desapareció.
Consulta la guía de migración de Opus 4.8 a Opus 5, la guía de migración oficial y el recorrido de la API de Opus 4.8.
Ajusta output_config.effort
El parámetro output_config.effort controla cuánto piensa el modelo antes de responder y, por tanto, el costo de la solicitud.
Los niveles disponibles son:
bajo
medio
alto
muy alto
máximo
El valor predeterminado es alto.
Anthropic recomienda repetir el barrido de esfuerzo al migrar desde Opus 4.8 porque los niveles fueron recalibrados. Los niveles bajo y medio son más capaces que en modelos Opus anteriores, mientras que muy alto sigue siendo el punto de partida recomendado para codificación y bucles agentivos.
Prueba una matriz mínima:
| Caso de uso | Esfuerzos iniciales |
|---|---|
| Clasificación, extracción o formato |
bajo, medio
|
| Refactorizaciones acotadas |
medio, alto
|
| Codificación agentiva |
alto, muy alto
|
| Planificación o tareas complejas |
muy alto, máximo
|
Mide calidad, duración, uso de herramientas y tokens antes de elegir un valor predeterminado. La guía del parámetro de esfuerzo incluye un proceso de evaluación más detallado.
Cambios de comportamiento que afectan prompts
La guía de prompting de Anthropic para Opus 5 describe cambios que alteran resultados aunque tu código no cambie.
- Verifica su trabajo sin pedirlo. Elimina instrucciones heredadas como “revisa tu respuesta”, porque pueden causar sobreverificación y aumentar tokens.
- Genera respuestas más largas. Bajar el esfuerzo reduce pensamiento, no necesariamente la longitud de la salida visible. Pide concisión explícitamente.
- Delega más fácilmente a subagentes. Limita o acota esa delegación si el costo importa.
- Puede ampliar el alcance de una tarea. Define límites concretos: archivos permitidos, criterios de aceptación y cambios excluidos.
Ejemplo de instrucción acotada:
Refactoriza únicamente src/handlers/auth.ts.
Restricciones:
- No cambies la interfaz pública.
- No modifiques dependencias.
- No crees archivos nuevos.
- Devuelve un resumen de máximo 5 viñetas.
Con pensamiento desactivado pueden aparecer llamadas a herramientas como texto plano o etiquetas XML internas en la salida visible. En un bucle agentivo, ese contenido puede contaminar turnos posteriores. La mitigación recomendada por Anthropic es mantener el pensamiento activado y reducir el costo mediante un esfuerzo menor.
Consulta la guía de prompting de Opus 5 y la guía de Claude Code.
Dónde ejecutar Opus 5
| Plataforma | Estado |
|---|---|
| API de Claude | Disponible como claude-opus-5
|
| claude.ai | Disponible; predeterminado para Max y modelo superior para Pro |
| Claude Code | Disponible |
| Claude Cowork | Disponible |
| Amazon Bedrock | Disponible como anthropic.claude-opus-5
|
| Plataforma Claude en AWS | Disponible con ID de primera parte |
| Google Cloud | Disponible como claude-opus-5
|
| Microsoft Foundry | Disponible |
| GitHub Copilot | Disponible |
El modo rápido es la excepción: solo está disponible en la API de primera parte.
Probar solicitudes de Opus 5 con Apidog
Llamar a Opus 5 implica manejar autenticación, JSON, streaming SSE, respuestas y errores reproducibles. Apidog permite guardar estas solicitudes en colecciones, usar variables de entorno para las claves y revisar cada respuesta.
Configura una colección de pruebas así:
- Guarda
ANTHROPIC_API_KEYcomo variable de entorno. - Crea una solicitud base de Mensajes.
- Duplica la solicitud para comparar
bajo,altoymuy altocon el mismo prompt. - Habilita streaming SSE cuando necesites localizar truncamientos.
- Revisa el bloque
usagede cada respuesta para medir caché y tokens consumidos.
Solicitud de referencia:
curl https://api.anthropic.com/v1/messages \
--header "x-api-key: $ANTHROPIC_API_KEY" \
--header "anthropic-version: 2023-06-01" \
--header "content-type: application/json" \
--data '{
"model": "claude-opus-5",
"max_tokens": 8192,
"messages": [
{
"role": "user",
"content": "Refactor this handler and explain the tradeoffs."
}
]
}'
Esta solicitud usa pensamiento adaptativo porque no incluye el campo thinking. Asigna suficiente espacio a max_tokens: un límite de 1,024 que funcionaba en Opus 4.8 puede truncar la respuesta en Opus 5.
Descarga Apidog para importar la solicitud. La guía paso a paso de la API cubre streaming, uso de herramientas y lectura de usage.
Quién debería usar Claude Opus 5
Usa Opus 5 si:
- Construyes agentes o flujos intensivos en herramientas. Es el caso de uso donde Anthropic concentra sus optimizaciones y afirmaciones de benchmark.
- Usas Fable 5 y quieres reducir costo. Evalúa si la diferencia declarada de rendimiento justifica pasar a un modelo que cuesta la mitad. Consulta Opus 5 vs Fable 5.
- Ya usas Opus 4.8. Mantienes el mismo precio, pero debes validar la migración.
- Necesitas conocimiento más reciente. Su fecha de corte de mayo de 2026 supera a otros modelos Claude actuales por aproximadamente cuatro meses.
Mantente en otra opción si:
- El Nivel de Prioridad es crítico. Opus 4.8 lo mantiene. Revisa los precios y niveles de Opus 4.8.
- Tu carga es económica y de alto volumen. Sonnet 5 puede ser suficiente y cuesta menos. Consulta Opus 5 vs Sonnet 5.
- Realizas explotación de ciberseguridad o investigación biológica autónoma. Mythos 5 sigue liderando en esas áreas.
Preguntas frecuentes
¿Cuál es el ID del modelo para Claude Opus 5?
En la API de Claude es claude-opus-5, sin sufijo de fecha. En Amazon Bedrock usa anthropic.claude-opus-5. Google Cloud y Claude Platform en AWS usan claude-opus-5.
¿Cuánto cuesta Claude Opus 5?
Cuesta $5 por millón de tokens de entrada y $25 por millón de tokens de salida. Batch API reduce esas tarifas a $2.50 y $12.50. El modo rápido las duplica a $10 y $50.
¿Es Claude Opus 5 mejor que Fable 5?
Según los números publicados por Anthropic, está cerca pero no por delante de forma general. Anthropic informa una diferencia de menos de 0.5% en CursorBench 3.2 y ventaja en OSWorld 2.0 a menor costo, mientras Fable 5 conserva la designación de modelo más capaz ampliamente lanzado. Estos resultados no habían sido reproducidos de forma independiente.
¿Cuál es la ventana de contexto?
1,000,000 de tokens, tanto predeterminada como máxima. No requiere encabezado beta ni tiene prima de precio por contexto largo. La salida máxima es 128,000 tokens en la API de Mensajes o 300,000 mediante Batch API con output-300k-2026-03-24.
¿Necesito cambiar código al actualizar desde Opus 4.8?
Sí. El pensamiento se activa por defecto, así que revisa max_tokens para evitar truncamientos silenciosos. Además, combinar thinking: {type: "disabled"} con esfuerzo xhigh o max devuelve un error 400. Repite también tu evaluación de niveles de esfuerzo.
¿Cuál es la fecha de corte de conocimiento?
Mayo de 2026, tanto para conocimiento fiable como para datos de entrenamiento.

Top comments (0)