Anthropic lanzó Claude Opus 5 el 24 de julio de 2026. La respuesta a «¿puedo usarlo gratis?» depende de cómo lo uses:
- En las aplicaciones de Claude: sí, si ya tienes una suscripción de pago. Opus 5 es el modelo predeterminado para Max y el modelo de mayor rendimiento disponible para Pro.
-
Mediante la API: no existe acceso gratuito ilimitado a
claude-opus-5. Puedes usar créditos de prueba o promocionales, pero se consumen.
Opus 5 cuesta $5 por millón de tokens de entrada y $25 por millón de tokens de salida: el mismo precio que Opus 4.8 y la mitad de los $10 / $50 de Fable 5. Sin embargo, puedes reducir una factura real en más de la mitad usando lotes, caché de prompts y niveles de esfuerzo adecuados.
Cuando empieces a probar la API, Apidog te permite enviar, guardar y comparar solicitudes HTTP.
Para consultar las especificaciones completas, revisa qué es Claude Opus 5. La publicación de lanzamiento de Opus 5 de Anthropic contiene el anuncio, y la descripción general de los modelos incluye los ID y la disponibilidad.
Ten presente esta diferencia:
- Gratis en las aplicaciones Claude: tu suscripción cubre el uso, sujeto a límites.
- Gratis mediante API: créditos promocionales o de prueba con saldo limitado.
Ruta gratuita 1: suscripciones de Claude
Los materiales de lanzamiento de Anthropic indican dos opciones para usar Opus 5 en productos de consumo:
- Max: Opus 5 es el modelo predeterminado.
- Pro: Opus 5 es el modelo de mayor rendimiento disponible.
Los materiales no indican que el plan gratuito de Claude incluya Opus 5. Antes de basar un flujo de trabajo en esta opción, abre el selector de modelos de tu cuenta y confirma si está disponible.
Opus 5 también está disponible en Claude Code, Claude Cowork y GitHub Copilot. Si ya pagas una suscripción compatible, es posible que puedas usarlo desde ahí.
Controla el consumo: Opus 5 puede agotar los límites antes que 4.8 porque el pensamiento está activado por defecto, las respuestas son más largas y el modelo delega tareas a subagentes con mayor facilidad.
Consulta cómo usar Claude Opus 5 en Claude Code para configurar ese uso, y cómo usar Claude Opus 4.8 gratis para las rutas equivalentes de la generación anterior.
Ruta gratuita 2: créditos de prueba y promociones en la nube
El ID del modelo en la API de Claude es:
claude-opus-5
La API es de pago por uso, pero puedes comenzar sin pagar por adelantado en estos casos:
- Créditos para cuentas nuevas de Anthropic: las cuentas nuevas suelen recibir un saldo pequeño para validar la integración y medir tokens antes de añadir una tarjeta.
-
Créditos promocionales de plataformas cloud: Opus 5 está disponible en Amazon Bedrock como
anthropic.claude-opus-5, Claude Platform en AWS, Google Cloud y Microsoft Foundry. Las cuentas nuevas pueden incluir créditos promocionales utilizables para Claude.
No asumas importes ni condiciones: revisa la oferta actual de cada plataforma, ya que cambian con frecuencia.
Usa esos créditos para medir, no para producción:
- Ejecuta prompts representativos de tu aplicación.
- Guarda el bloque
usagede cada respuesta. - Calcula el coste por tarea usando los tokens reales.
- Decide si el modelo es viable antes de escalar.
Consulta la documentación de precios de Anthropic para ver las tarifas actuales.
Atención: el pensamiento está activado por defecto
En Opus 4.8, una solicitud sin el campo thinking se ejecutaba sin pensamiento. En Opus 5, esa misma solicitud usa pensamiento adaptativo.
Los tokens de pensamiento se facturan como salida, a $25 por millón de tokens. Por tanto, migrar una batería de pruebas desde 4.8 sin cambios puede consumir créditos más rápido.
Consulta migrando de Opus 4.8 a Opus 5 para revisar las diferencias de migración.
No existe una API gratuita ilimitada
Ningún plan gratuito de la API de Claude ofrece llamadas ilimitadas a claude-opus-5.
Evita proxies, pools de claves y revendedores que prometen acceso ilimitado o gratuito a modelos de frontera. Estos esquemas pueden violar los términos de Anthropic, dejar de funcionar sin aviso y enviar tus solicitudes a infraestructura que no controlas.
Cuando se agoten los créditos de prueba o promoción, debes pagar por token o detener el uso.
La ruta de pago más económica
La tarifa estándar de Opus 5 es:
- Entrada: $5 por millón de tokens.
- Salida: $25 por millón de tokens.
Estas son las palancas que más afectan el coste.
Palanca 1: usa la API por lotes para trabajo asíncrono
Todo lo que no necesite respuesta en segundos debería evaluarse para la API por lotes.
La API por lotes se ejecuta de forma asíncrona y reduce el precio al 50%:
- Entrada: $2.50 por millón de tokens.
- Salida: $12.50 por millón de tokens.
El modelo y la calidad de respuesta son los mismos. La diferencia es la latencia.
Es una buena opción para:
- Evaluaciones nocturnas.
- Procesamiento masivo de documentos.
- Clasificación por lotes.
- Suites de regresión.
- Pipelines de generación de contenido.
También admite hasta 300.000 tokens de salida por solicitud usando el encabezado beta:
output-300k-2026-03-24
La API estándar de Mensajes admite 128.000 tokens de salida. Ten en cuenta que el modo rápido no funciona con la API por lotes.
Palanca 2: ajusta output_config.effort
Opus 5 expone output_config.effort, el selector entre coste y capacidad.
El valor predeterminado es high. Un esfuerzo menor reduce los tokens de pensamiento, y esos tokens se cobran a tarifa de salida.
Empieza comparando low, medium y high con tus propios casos de uso.
{
"output_config": {
"effort": "low"
}
}
Anthropic indica que low y medium son significativamente más capaces en Opus 5 que en modelos Opus anteriores. No reutilices automáticamente la configuración de esfuerzo de Opus 4.8: vuelve a ejecutar tus evaluaciones.
Dos reglas prácticas:
El esfuerzo controla el pensamiento, no la longitud visible de la respuesta.
Si quieres respuestas más cortas, indícalo explícitamente en el prompt.No desactives el pensamiento solo para ahorrar.
Combinarthinking: {"type": "disabled"}con esfuerzoxhighomaxdevuelve un error 400. Además, Anthropic recomienda mantener el pensamiento activado y reducir el esfuerzo cuando sea necesario.
Con el pensamiento desactivado, Opus 5 puede escribir llamadas a herramientas como texto plano o filtrar etiquetas XML internas en la salida.
Consulta el parámetro de esfuerzo de Claude Opus 5 para ver los cinco niveles.
Palanca 3: activa la caché de prompts
Los aciertos de caché cuestan $0.50 por millón de tokens de entrada, una décima parte de la tarifa estándar de entrada.
Las escrituras tienen estos costes:
- Caché de 5 minutos: $6.25 por millón de tokens.
- Caché de 1 hora: $10 por millón de tokens.
En Opus 5, el prefijo mínimo cacheable baja a 512 tokens, frente a los 1.024 de Opus 4.8.
Esto permite cachear prompts del sistema, documentación de referencia y contexto estable que antes era demasiado corto.
Ejemplo con un prefijo estable de 40.000 tokens y 10.000 tokens variables:
| Escenario | Coste de entrada |
|---|---|
| Sin caché: 50.000 tokens a $5/MTok | $0.25 |
| Escritura del prefijo cacheado: 40.000 tokens a $6.25/MTok | $0.25 |
| Acierto posterior: 40.000 tokens cacheados + 10.000 nuevos | $0.07 |
La escritura cuesta cinco centavos más que enviar ese prefijo sin caché, pero el primer acierto posterior ya compensa ese coste.
Verifica que funciona comprobando este campo en la respuesta:
{
"usage": {
"cache_read_input_tokens": 40000
}
}
Si cache_read_input_tokens es 0 en llamadas repetidas, revisa la posición del punto de interrupción de caché.
Palanca 4: evita el modo rápido si el coste importa
El modo rápido cuesta el doble de la tarifa estándar:
- Entrada: $10 por millón de tokens.
- Salida: $50 por millón de tokens.
A cambio, aumenta la velocidad de salida aproximadamente 2,5 veces.
Es una vista previa de investigación disponible solo mediante la API directa de Anthropic. No está disponible en Bedrock, Google Cloud, Microsoft Foundry ni en la API por lotes.
Úsalo únicamente cuando la latencia sea crítica y un usuario esté esperando la respuesta en tiempo real.
Palanca 5: no configures inference_geo sin necesidad
Esta configuración:
{
"inference_geo": "us"
}
aplica un multiplicador de 1,1x a todas las categorías de tokens, es decir, un recargo del 10%.
Solo debes activarlo si tienes requisitos de residencia de datos.
Una mejora menor al migrar: la sobrecarga del prompt del sistema para uso de herramientas en Opus 5 es de 286 tokens con tool_choice configurado como auto o none. Es inferior a los 290 de Opus 4.8 y a los 675 de Opus 4.7.
Para más optimizaciones generales, consulta reduce tu factura de la API de Claude.
Comparativa de costes
| Configuración | Entrada / MTok | Salida / MTok | Ideal para |
|---|---|---|---|
Estándar, esfuerzo high
|
$5.00 | $25.00 | Uso interactivo predeterminado |
| API por lotes | $2.50 | $12.50 | Cargas asíncronas |
| Aciertos de caché en un prefijo estable | $0.50 | n/a | Contexto largo reutilizado |
| Modo rápido | $10.00 | $50.00 | Casos críticos de latencia |
inference_geo: "us" |
1.1x todas las categorías | 1.1x todas las categorías | Residencia de datos |
El descuento por lotes se aplica a las tarifas estándar de tokens. Comprueba en tu factura cómo se combina con los precios de caché antes de estimar ahorros conjuntos.
Consulta precios de Claude Opus 5 para ver ejemplos completos.
Prueba las rutas baratas con Apidog
Cada ajuste anterior se puede validar inspeccionando una respuesta HTTP. Usa primero una llamada base:
curl https://api.anthropic.com/v1/messages \
--header "x-api-key: $ANTHROPIC_API_KEY" \
--header "anthropic-version: 2023-06-01" \
--header "content-type: application/json" \
--data '{
"model": "claude-opus-5",
"max_tokens": 4096,
"output_config": {"effort": "low"},
"messages": [
{"role": "user", "content": "Summarize this OpenAPI spec in three sentences."}
]
}'
En Apidog, guarda la solicitud como POST y almacena la clave como variable de entorno. No pegues secretos directamente en el cuerpo de la solicitud ni en archivos que puedas confirmar en Git.
Luego valida estos puntos:
-
Compara niveles de esfuerzo. Duplica la solicitud y prueba
low,mediumyhigh. Comparausage.output_tokens. -
Confirma la caché. Ejecuta dos veces una solicitud con el mismo prefijo largo y verifica que
cache_read_input_tokenssea mayor que cero en la segunda llamada. -
Detecta truncamientos. El pensamiento y la salida comparten
max_tokens. Si recibesstop_reason: "max_tokens", pagaste por una salida incompleta. Añade una aserción para detectar ese resultado. - Inspecciona streaming y herramientas. Revisa eventos SSE y cargas útiles de llamadas a herramientas cuando un flujo agéntico consuma más tokens de lo esperado.
Descarga Apidog para seguir el proceso y consulta cómo usar la API de Claude Opus 5 para un tutorial de integración completo.
¿Debes optimizar Opus 5 o usar otro modelo?
A veces, el ahorro más grande consiste en elegir otro modelo.
Sonnet 5 tiene tarifas introductorias de $2 / $10, que aumentan a $3 / $15 el 1 de septiembre de 2026, y comparte la ventana de contexto de 1 millón de tokens.
Si tu carga no requiere codificación agéntica ni razonamiento complejo de varios pasos, compara Sonnet 5 antes de optimizar la factura de Opus 5.
Consulta Claude Opus 5 vs Sonnet 5 para evaluar la prima de capacidad y cómo usar Claude Sonnet 5 gratis para las rutas gratuitas de Sonnet.
Anthropic afirma que Opus 5 obtiene más del doble de la puntuación de Frontier-Bench de Opus 4.8, se sitúa a menos del 0,5% de Fable 5 en CursorBench 3.2 a la mitad de precio y supera a Fable 5 en OSWorld 2.0 a un tercio del coste.
Estas son cifras publicadas por Anthropic, no reproducidas de forma independiente a 25 de julio de 2026. Trátalas como afirmaciones que debes validar con tus propias evaluaciones.
Opus 5 tampoco es el modelo más capaz de la pila de Claude: Fable 5 sigue siendo el modelo más capaz de Anthropic ampliamente lanzado, y Opus 5 queda por detrás de Mythos 5 en explotación de ciberseguridad e investigación autónoma en biología.
Consulta qué es Claude Fable 5 si tu caso de uso necesita ese nivel de capacidad.
Qué ruta te conviene
| Objetivo | Ruta | Inconveniente |
|---|---|---|
| Chat, escritura e investigación | Suscripción Claude Pro o Max | Límites medidos; Opus 5 los consume más rápido que 4.8 |
| Codificación agéntica | Claude Code con un plan de pago | Respuestas largas y subagentes consumen el saldo |
| Prototipar una integración | Créditos de prueba de API o promociones cloud | El saldo se agota y después pagas por token |
| API de producción más económica | Lotes + caché + esfuerzo low
|
Los lotes añaden latencia; la caché necesita un prefijo estable |
| API interactiva más económica | Tarifa estándar + caché + esfuerzo por tarea | No hay descuento por lotes |
Preguntas frecuentes
¿Claude Opus 5 es gratis?
No mediante la API. En las aplicaciones de Claude, viene incluido con suscripciones de pago: es el valor predeterminado en Max y el modelo de mayor rendimiento disponible en Pro. Los materiales de lanzamiento de Anthropic no indican que esté disponible en el plan gratuito.
¿Puedo obtener acceso gratuito a la API de Claude Opus 5?
Solo mediante créditos de prueba para cuentas nuevas o créditos promocionales de Amazon Bedrock, Google Cloud o Microsoft Foundry. Todos tienen un saldo limitado. No existe un nivel gratuito ilimitado para la API.
¿Cuál es la forma legítima más barata de ejecutar Opus 5 a escala?
Usa la API por lotes a $2.50 / $12.50, añade caché de prompts a prefijos estables de más de 512 tokens y prueba low o medium donde tus evaluaciones lo permitan. Mantén el modo rápido desactivado y no configures inference_geo si no tienes un requisito de residencia de datos.
¿Debo desactivar el pensamiento para ahorrar tokens?
No. Combinar pensamiento desactivado con esfuerzo xhigh o max genera un error 400. La recomendación de Anthropic es mantenerlo activado y reducir el esfuerzo.
Comprueba siempre el bloque usage en respuestas reales. Una solicitud guardada en Apidog con aserciones sobre estos campos ayuda a detectar regresiones de coste automáticamente.
Top comments (0)