<?xml version="1.0" encoding="UTF-8"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:dc="http://purl.org/dc/elements/1.1/">
  <channel>
    <title>DEV Community: Roobia</title>
    <description>The latest articles on DEV Community by Roobia (@roobia).</description>
    <link>https://dev.to/roobia</link>
    <image>
      <url>https://media2.dev.to/dynamic/image/width=90,height=90,fit=cover,gravity=auto,format=auto/https:%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Fuser%2Fprofile_image%2F2197084%2F1d72640c-64d4-4f30-a828-302a9e3360b0.jpg</url>
      <title>DEV Community: Roobia</title>
      <link>https://dev.to/roobia</link>
    </image>
    <atom:link rel="self" type="application/rss+xml" href="https://dev.to/feed/roobia"/>
    <language>en</language>
    <item>
      <title>Claude Opus 5 vs Sonnet 5: ¿Qué nivel necesitas realmente?</title>
      <dc:creator>Roobia</dc:creator>
      <pubDate>Sat, 25 Jul 2026 03:31:59 +0000</pubDate>
      <link>https://dev.to/roobia/claude-opus-5-vs-sonnet-5-que-nivel-necesitas-realmente-47h</link>
      <guid>https://dev.to/roobia/claude-opus-5-vs-sonnet-5-que-nivel-necesitas-realmente-47h</guid>
      <description>&lt;p&gt;Anthropic lanzó &lt;a href="https://apidog.com/es/blog/what-is-claude-opus-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Claude Opus 5&lt;/a&gt; el 24 de julio de 2026 y Claude Sonnet 5 el 30 de junio de 2026. Ambos son modelos de generación actual, con ventana de contexto de 1M, salida máxima de 128k, pensamiento adaptativo activado por defecto y un parámetro de esfuerzo. La diferencia práctica está en el coste, la fiabilidad por tarea y el rendimiento en flujos agénticos.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation" class="crayons-btn crayons-btn--primary"&gt;Prueba Apidog hoy&lt;/a&gt;
&lt;/p&gt;

&lt;p&gt;Sonnet 5 mantiene una tarifa introductoria de $2 por millón de tokens de entrada y $10 por millón de tokens de salida hasta el 31 de agosto de 2026. El 1 de septiembre de 2026 cambiará a $3 / $15. Opus 5 permanece en $5 / $25. Por tanto, Opus cuesta 2.5x más mientras se mantenga la tarifa introductoria de Sonnet, y aproximadamente 1.67x más después del cambio de septiembre.&lt;/p&gt;

&lt;p&gt;Si está presupuestando una carga de trabajo para el cuarto trimestre de 2026, use los precios estándar de Sonnet 5, no los promocionales.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fsdrhdwbe6bi67ix2a880.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fsdrhdwbe6bi67ix2a880.png" alt="Comparación de Claude Opus 5 y Claude Sonnet 5" width="800" height="533"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;Esta guía explica cómo comparar ambos modelos por coste real por tarea, no solo por precio por token. Puede ejecutar los mismos prompts en ambos modelos desde &lt;a href="https://apidog.com?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt; y usar los campos &lt;code&gt;usage&lt;/code&gt; de la respuesta para medir el coste real.&lt;/p&gt;

&lt;h2&gt;
  
  
  Precios y fechas relevantes
&lt;/h2&gt;

&lt;p&gt;Estas son las tarifas base publicadas en la &lt;a href="https://platform.claude.com/docs/en/about-claude/pricing" rel="noopener noreferrer"&gt;página de precios de Anthropic&lt;/a&gt;.&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Modelo&lt;/th&gt;
&lt;th&gt;Entrada / MTok&lt;/th&gt;
&lt;th&gt;Salida / MTok&lt;/th&gt;
&lt;th&gt;Estado&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Claude Opus 5&lt;/td&gt;
&lt;td&gt;$5.00&lt;/td&gt;
&lt;td&gt;$25.00&lt;/td&gt;
&lt;td&gt;Estándar&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Claude Sonnet 5, hasta el 31 de agosto de 2026&lt;/td&gt;
&lt;td&gt;$2.00&lt;/td&gt;
&lt;td&gt;$10.00&lt;/td&gt;
&lt;td&gt;Introductorio&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Claude Sonnet 5, desde el 1 de septiembre de 2026&lt;/td&gt;
&lt;td&gt;$3.00&lt;/td&gt;
&lt;td&gt;$15.00&lt;/td&gt;
&lt;td&gt;Estándar&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;Antes de modelar costes de Opus 5, considere también estas tarifas:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Caché de prompts: $6.25/MTok para escritura de 5 minutos, $10/MTok para escritura de 1 hora y $0.50/MTok para aciertos de caché.&lt;/li&gt;
&lt;li&gt;API de Batch: $2.50 / $12.50, un descuento fijo del 50%.&lt;/li&gt;
&lt;li&gt;Modo rápido: $10 / $50 para una velocidad de salida 2.5x mayor.&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;inference_geo: "us"&lt;/code&gt;: multiplicador de 1.1x en cada categoría de token.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;El modo rápido está en vista previa de investigación, solo está disponible en la API de primera parte y no se puede combinar con Batch. Consulte la &lt;a href="https://apidog.com/es/blog/claude-opus-5-pricing?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de precios de Opus 5&lt;/a&gt; y el &lt;a href="https://apidog.com/es/blog/claude-sonnet-5-pricing?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;desglose de precios de Sonnet 5&lt;/a&gt; para ver ejemplos completos.&lt;/p&gt;

&lt;p&gt;Un punto importante: Opus 5 cuesta exactamente lo mismo que Opus 4.8. Anthropic no subió el precio de Opus con este salto generacional.&lt;/p&gt;

&lt;h2&gt;
  
  
  Especificaciones: diferencias pequeñas en la API
&lt;/h2&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Especificación&lt;/th&gt;
&lt;th&gt;Claude Opus 5&lt;/th&gt;
&lt;th&gt;Claude Sonnet 5&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;ID del modelo&lt;/td&gt;
&lt;td&gt;&lt;code&gt;claude-opus-5&lt;/code&gt;&lt;/td&gt;
&lt;td&gt;&lt;code&gt;claude-sonnet-5&lt;/code&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Ventana de contexto&lt;/td&gt;
&lt;td&gt;1M tokens&lt;/td&gt;
&lt;td&gt;1M tokens&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Salida máxima&lt;/td&gt;
&lt;td&gt;128k; 300k en Batch con cabecera beta&lt;/td&gt;
&lt;td&gt;128k&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Pensamiento adaptativo&lt;/td&gt;
&lt;td&gt;Activado por defecto&lt;/td&gt;
&lt;td&gt;Activado por defecto&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Niveles de esfuerzo&lt;/td&gt;
&lt;td&gt;Cinco, hasta &lt;code&gt;max&lt;/code&gt;; predeterminado: &lt;code&gt;high&lt;/code&gt;
&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;low&lt;/code&gt;, &lt;code&gt;medium&lt;/code&gt;, &lt;code&gt;high&lt;/code&gt;, &lt;code&gt;xhigh&lt;/code&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Fecha de corte de conocimiento&lt;/td&gt;
&lt;td&gt;Mayo de 2026&lt;/td&gt;
&lt;td&gt;Enero de 2026&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Nivel de prioridad&lt;/td&gt;
&lt;td&gt;No compatible&lt;/td&gt;
&lt;td&gt;No disponible&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Caché, herramientas, Batch y visión&lt;/td&gt;
&lt;td&gt;Compatible&lt;/td&gt;
&lt;td&gt;Compatible&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Tokenizador&lt;/td&gt;
&lt;td&gt;Generación 4.7&lt;/td&gt;
&lt;td&gt;Generación 4.7&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;Tres diferencias influyen directamente en la implementación.&lt;/p&gt;

&lt;h3&gt;
  
  
  1. Opus 5 tiene cuatro meses más de conocimiento
&lt;/h3&gt;

&lt;p&gt;Opus 5 llega hasta mayo de 2026, mientras que Sonnet 5 se detiene en enero de 2026. Esto importa si trabaja con versiones de librerías, cambios de APIs o documentación publicada durante la primavera de 2026.&lt;/p&gt;

&lt;p&gt;Para la mayoría de aplicaciones, una capa de recuperación de información reduce esta diferencia. Si no puede proporcionar contexto externo, Opus 5 tiene ventaja de actualidad.&lt;/p&gt;

&lt;h3&gt;
  
  
  2. Ninguno incluye Nivel de Prioridad
&lt;/h3&gt;

&lt;p&gt;Los equipos que migran desde Opus 4.8 deben tenerlo en cuenta: los modelos actuales no ofrecen Nivel de Prioridad. Si depende de garantías de latencia, no existe un reemplazo directo entre Opus 5 y Sonnet 5.&lt;/p&gt;

&lt;p&gt;Consulte la &lt;a href="https://apidog.com/es/blog/claude-opus-5-migration-opus-4-8?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de migración de Opus 4.8 a Opus 5&lt;/a&gt; para revisar los cambios de compatibilidad.&lt;/p&gt;

&lt;h3&gt;
  
  
  3. El tokenizador no diferencia a los dos modelos
&lt;/h3&gt;

&lt;p&gt;Los modelos Claude 4.7 y posteriores usan un tokenizador que genera aproximadamente un 30% más de tokens para el mismo texto frente a Sonnet 4.6 y versiones anteriores.&lt;/p&gt;

&lt;p&gt;Ese aumento &lt;strong&gt;no&lt;/strong&gt; aplica al comparar Opus 5 contra Sonnet 5: ambos usan el tokenizador de generación 4.7. El mismo prompt genera el mismo recuento de tokens de entrada facturables en los dos modelos.&lt;/p&gt;

&lt;h2&gt;
  
  
  Calcule el coste por tarea, no solo el coste por token
&lt;/h2&gt;

&lt;p&gt;Los precios por token son comparables entre Opus 5 y Sonnet 5, pero no bastan para decidir.&lt;/p&gt;

&lt;p&gt;El principal factor variable es la salida. Anthropic indica que Opus 5 puede generar respuestas visibles y entregables más largos. Reducir el esfuerzo disminuye el pensamiento, pero no reduce necesariamente la longitud de la respuesta visible.&lt;/p&gt;

&lt;p&gt;Como la salida cuesta cinco veces más que la entrada en ambos modelos, controle explícitamente la extensión:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Responde en un máximo de 8 viñetas.
No incluyas introducción ni conclusión.
Devuelve únicamente el parche unificado.
No expliques decisiones salvo que exista un riesgo de seguridad.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;La &lt;a href="https://apidog.com/es/blog/prompting-claude-opus-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de prompting de Opus 5&lt;/a&gt; incluye más patrones para limitar la verbosidad.&lt;/p&gt;

&lt;p&gt;Use también el &lt;a href="https://platform.claude.com/docs/en/build-with-claude/token-counting" rel="noopener noreferrer"&gt;endpoint de conteo de tokens&lt;/a&gt; para medir sus prompts reales antes de estimar presupuestos.&lt;/p&gt;

&lt;h3&gt;
  
  
  Ejemplo de coste diario
&lt;/h3&gt;

&lt;p&gt;Suponga una carga diaria de:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;500k tokens de entrada&lt;/li&gt;
&lt;li&gt;40k tokens de salida&lt;/li&gt;
&lt;/ul&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Escenario&lt;/th&gt;
&lt;th&gt;Coste diario&lt;/th&gt;
&lt;th&gt;Ratio frente a Sonnet 5&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Opus 5&lt;/td&gt;
&lt;td&gt;$3.50&lt;/td&gt;
&lt;td&gt;Línea base&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Sonnet 5, tarifa introductoria&lt;/td&gt;
&lt;td&gt;$1.40&lt;/td&gt;
&lt;td&gt;Opus es 2.5x&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Sonnet 5, tarifa estándar desde septiembre&lt;/td&gt;
&lt;td&gt;$2.10&lt;/td&gt;
&lt;td&gt;Opus es 1.67x&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Opus 5 con 30% más de salida&lt;/td&gt;
&lt;td&gt;$3.80&lt;/td&gt;
&lt;td&gt;Opus es 1.81x frente a Sonnet estándar&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;La última fila muestra un problema frecuente: una salida más larga de lo necesario puede aumentar el coste más que el cambio de modelo. Corríjalo en el prompt antes de optimizar otras variables.&lt;/p&gt;

&lt;h3&gt;
  
  
  Incluya los reintentos en el cálculo
&lt;/h3&gt;

&lt;p&gt;Con precios estándar:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Una ejecución de Opus 5 cuesta $3.50.&lt;/li&gt;
&lt;li&gt;Una ejecución de Sonnet 5 cuesta $2.10.&lt;/li&gt;
&lt;li&gt;Dos ejecuciones de Sonnet 5 cuestan $4.20.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Si Sonnet necesita un segundo intento donde Opus resuelve la tarea en uno, Sonnet se vuelve más caro. Añada al modelo de costes:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Tokens de entrada y salida.&lt;/li&gt;
&lt;li&gt;Tasa de reintentos.&lt;/li&gt;
&lt;li&gt;Fallos de herramientas.&lt;/li&gt;
&lt;li&gt;Tiempo de revisión humana.&lt;/li&gt;
&lt;li&gt;Coste de errores en producción.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Para reducir el coste de cualquiera de los dos modelos, consulte la guía para &lt;a href="https://apidog.com/es/blog/cut-claude-api-bill?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;reducir su factura de la API de Claude&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Cuándo elegir Opus 5
&lt;/h2&gt;

&lt;p&gt;Los resultados de lanzamiento de Anthropic para Opus 5 son afirmaciones publicadas por el proveedor. A fecha del 25 de julio de 2026, no habían sido reproducidos de forma independiente. Úselos como señales para crear sus propias pruebas, no como sustitutos de ellas.&lt;/p&gt;

&lt;p&gt;Entre las afirmaciones publicadas están:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Frontier-Bench v0.1:&lt;/strong&gt; Opus 5 supera a otros modelos y más que duplica la puntuación de Opus 4.8, con menor coste por tarea.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;ARC-AGI 3:&lt;/strong&gt; aproximadamente tres veces la puntuación del siguiente mejor modelo.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;OSWorld 2.0:&lt;/strong&gt; supera a Fable 5 a aproximadamente un tercio del coste.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;CursorBench 3.2:&lt;/strong&gt; queda dentro del 0.5% del pico de Fable 5 a la mitad de precio.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Zapier AutomationBench:&lt;/strong&gt; tasa de aprobación cercana a 1.5x la del siguiente mejor modelo.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Ciencia:&lt;/strong&gt; mejoras de 10.2 puntos en química orgánica y 7.7 puntos en análisis de proteínas frente a Opus 4.8.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Los resultados de lanzamiento de Sonnet 5 quedaron por debajo de Opus 4.8 en varios benchmarks agénticos: SWE-bench Pro, Terminal-Bench 2.1 y OSWorld-Verified.&lt;/p&gt;

&lt;p&gt;Revise el &lt;a href="https://apidog.com/es/blog/claude-opus-5-benchmarks?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;desglose de benchmarks de Opus 5&lt;/a&gt; y la &lt;a href="https://apidog.com/es/blog/claude-sonnet-5-benchmarks?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;publicación de benchmarks de Sonnet 5&lt;/a&gt; para ver la atribución completa.&lt;/p&gt;

&lt;p&gt;Elija Opus 5 cuando se cumpla una o varias de estas condiciones:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Codificación agéntica de largo alcance:&lt;/strong&gt; refactorizaciones multifichero, migraciones y bucles con docenas de llamadas a herramientas.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Errores costosos:&lt;/strong&gt; cambios de producción, código de seguridad o tareas con revisión humana intensiva.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Uso de computadoras:&lt;/strong&gt; automatización de escritorio o flujos similares a OSWorld.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Análisis científico o razonamiento complejo:&lt;/strong&gt; especialmente si el coste de una conclusión incorrecta es alto.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Conocimiento de mayo de 2026:&lt;/strong&gt; cuando no puede resolver la falta de contexto con recuperación de información.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Cuándo Sonnet 5 es suficiente
&lt;/h2&gt;

&lt;p&gt;Para la mayor parte del tráfico de producción, Sonnet 5 es una opción adecuada. Pagar por una capacidad que no mejora de forma detectable la salida no es una optimización.&lt;/p&gt;

&lt;p&gt;Use Sonnet 5 cuando:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Tiene alto volumen y llamadas pequeñas:&lt;/strong&gt; clasificación, extracción, etiquetado, enrutamiento y resúmenes.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;La salida tiene validación automática:&lt;/strong&gt; validación de esquemas, pruebas unitarias o reglas de negocio detectan fallos de forma económica.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;La latencia importa más que la profundidad:&lt;/strong&gt; interfaces interactivas y herramientas internas.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Está prototipando:&lt;/strong&gt; implemente primero con Sonnet y mida antes de cambiar de nivel.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Sonnet 5 también es el modelo predeterminado del plan gratuito de Claude, lo que permite probar prompts reales antes de integrar la API. Opus 5 está disponible para suscriptores Pro y es el predeterminado para Max. La &lt;a href="https://apidog.com/es/blog/claude-opus-5-free?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de acceso gratuito a Opus 5&lt;/a&gt; resume las opciones disponibles.&lt;/p&gt;

&lt;h2&gt;
  
  
  Matriz de decisión por carga de trabajo
&lt;/h2&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Carga de trabajo&lt;/th&gt;
&lt;th&gt;Elegir&lt;/th&gt;
&lt;th&gt;Motivo&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Refactorización multifichero o migración en un agente&lt;/td&gt;
&lt;td&gt;Opus 5&lt;/td&gt;
&lt;td&gt;La fiabilidad por paso reduce errores acumulados&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Clasificación o extracción de alto volumen&lt;/td&gt;
&lt;td&gt;Sonnet 5&lt;/td&gt;
&lt;td&gt;Ambos suelen alcanzar el nivel de calidad necesario&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Chat de soporte con recuperación de información&lt;/td&gt;
&lt;td&gt;Sonnet 5&lt;/td&gt;
&lt;td&gt;La recuperación reduce la brecha de conocimiento y la latencia importa&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Uso de computadoras o automatización de escritorio&lt;/td&gt;
&lt;td&gt;Opus 5&lt;/td&gt;
&lt;td&gt;OSWorld 2.0 es la señal agéntica más fuerte publicada por Anthropic&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Procesamiento nocturno por lotes&lt;/td&gt;
&lt;td&gt;Sonnet 5 u Opus 5 con Batch&lt;/td&gt;
&lt;td&gt;Batch reduce el coste de Opus 5 un 50%&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Revisión de seguridad o código crítico&lt;/td&gt;
&lt;td&gt;Opus 5&lt;/td&gt;
&lt;td&gt;El coste de un error supera la diferencia de tokens&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Análisis científico o cuantitativo&lt;/td&gt;
&lt;td&gt;Opus 5&lt;/td&gt;
&lt;td&gt;Las mejoras publicadas son más marcadas en estas tareas&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Prototipos y herramientas internas&lt;/td&gt;
&lt;td&gt;Sonnet 5&lt;/td&gt;
&lt;td&gt;Mida antes de pagar por mayor capacidad&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Conocimiento de primavera de 2026 sin RAG&lt;/td&gt;
&lt;td&gt;Opus 5&lt;/td&gt;
&lt;td&gt;Fecha de corte de mayo frente a enero de 2026&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;UX interactiva sensible a latencia&lt;/td&gt;
&lt;td&gt;Sonnet 5&lt;/td&gt;
&lt;td&gt;Opus rápido solo si la profundidad es imprescindible&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;La fila de Batch merece atención. Opus 5 en Batch cuesta $2.50 / $12.50, por debajo de la tarifa estándar de Sonnet 5 en entrada y ligeramente por encima en salida. Si tolera procesamiento asíncrono, el coste puede dejar de ser el factor decisivo.&lt;/p&gt;

&lt;h2&gt;
  
  
  Lo que ninguno de los dos modelos es
&lt;/h2&gt;

&lt;p&gt;Opus 5 no es el modelo más capaz de toda la pila de Claude. &lt;a href="https://apidog.com/es/blog/what-is-claude-fable-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Fable 5&lt;/a&gt; sigue siendo el modelo más capaz y ampliamente lanzado de Anthropic, con un precio de $10 / $50.&lt;/p&gt;

&lt;p&gt;Además, Anthropic afirma que Opus 5 sigue por detrás de &lt;a href="https://apidog.com/es/blog/mythos-class-model-explained?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Mythos 5&lt;/a&gt; en explotación de ciberseguridad e investigación biológica autónoma.&lt;/p&gt;

&lt;p&gt;El encuadre útil es este: Opus 5 ofrece capacidad de clase fronteriza a aproximadamente la mitad del precio fronterizo, pero existe un nivel superior. Si su carga de trabajo necesita ese techo, compare &lt;a href="https://apidog.com/es/blog/claude-opus-5-vs-fable-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Opus 5 vs Fable 5&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Compare ambos modelos en Apidog
&lt;/h2&gt;

&lt;p&gt;Los benchmarks usan la carga de trabajo de otra persona. La comparación relevante usa sus prompts, herramientas, datos y criterios de aceptación.&lt;/p&gt;

&lt;p&gt;Opus 5 y Sonnet 5 usan el mismo endpoint de Mensajes. Para alternar entre ellos, cambie el valor de &lt;code&gt;model&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fsuamw1zw7bz6spz1shu2.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fsuamw1zw7bz6spz1shu2.png" alt="Prueba de Claude Opus 5 y Sonnet 5 en Apidog" width="799" height="530"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;Configure la prueba en &lt;a href="https://apidog.com?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt;:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Cree una solicitud para el endpoint de Mensajes de Anthropic.&lt;/li&gt;
&lt;li&gt;Guarde la clave API como variable de entorno; no la incluya en el cuerpo de la solicitud.&lt;/li&gt;
&lt;li&gt;Cree dos variantes con el mismo prompt:

&lt;ul&gt;
&lt;li&gt;&lt;code&gt;"model": "claude-opus-5"&lt;/code&gt;&lt;/li&gt;
&lt;li&gt;&lt;code&gt;"model": "claude-sonnet-5"&lt;/code&gt;&lt;/li&gt;
&lt;/ul&gt;
&lt;/li&gt;
&lt;li&gt;Ejecute ambas solicitudes sobre una muestra representativa de tareas.&lt;/li&gt;
&lt;li&gt;Registre el objeto &lt;code&gt;usage&lt;/code&gt; de cada respuesta.&lt;/li&gt;
&lt;li&gt;Añada aserciones para detectar respuestas truncadas, rechazos y errores de esquema.&lt;/li&gt;
&lt;li&gt;Pruebe Opus 5 con distintos valores de &lt;code&gt;output_config.effort&lt;/code&gt;.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Ejemplo de solicitud:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;curl https://api.anthropic.com/v1/messages &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--header&lt;/span&gt; &lt;span class="s2"&gt;"x-api-key: &lt;/span&gt;&lt;span class="nv"&gt;$ANTHROPIC_API_KEY&lt;/span&gt;&lt;span class="s2"&gt;"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--header&lt;/span&gt; &lt;span class="s2"&gt;"anthropic-version: 2023-06-01"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--header&lt;/span&gt; &lt;span class="s2"&gt;"content-type: application/json"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--data&lt;/span&gt; &lt;span class="s1"&gt;'{
    "model": "claude-opus-5",
    "max_tokens": 4096,
    "messages": [
      {
        "role": "user",
        "content": "Refactor this handler to use async I/O."
      }
    ]
  }'&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Durante las pruebas, tenga en cuenta dos detalles:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;El pensamiento adaptativo está activado por defecto en ambos modelos.&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;max_tokens&lt;/code&gt; limita conjuntamente el pensamiento y la respuesta visible, por lo que un límite que funcionaba con un modelo anterior puede truncar la salida.&lt;/li&gt;
&lt;li&gt;En Opus 5, combinar &lt;code&gt;thinking: {type: "disabled"}&lt;/code&gt; con esfuerzo &lt;code&gt;xhigh&lt;/code&gt; o &lt;code&gt;max&lt;/code&gt; devuelve un error &lt;code&gt;400&lt;/code&gt;.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Pruebe especialmente los niveles &lt;code&gt;low&lt;/code&gt;, &lt;code&gt;medium&lt;/code&gt;, &lt;code&gt;high&lt;/code&gt; y &lt;code&gt;max&lt;/code&gt; de Opus 5. El valor predeterminado es &lt;code&gt;high&lt;/code&gt;, pero una configuración menor puede ofrecer resultados suficientes a menor coste. Consulte la &lt;a href="https://apidog.com/es/blog/claude-opus-5-effort-parameter?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía del parámetro de esfuerzo&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;Puede &lt;a href="https://apidog.com/download?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;descargar Apidog&lt;/a&gt; para ejecutar ambas variantes en paralelo y seguir el &lt;a href="https://apidog.com/es/blog/claude-opus-5-api?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;tutorial de la API de Opus 5&lt;/a&gt; para el flujo completo.&lt;/p&gt;

&lt;h2&gt;
  
  
  Preguntas frecuentes
&lt;/h2&gt;

&lt;h3&gt;
  
  
  ¿Vale Claude Opus 5 2.5 veces el precio de Sonnet 5?
&lt;/h3&gt;

&lt;p&gt;Sí, para codificación agéntica de largo alcance, uso de computadoras y tareas donde equivocarse es caro. Para clasificación, extracción y chat de alto volumen, normalmente no.&lt;/p&gt;

&lt;p&gt;El múltiplo de 2.5x solo aplica hasta el 1 de septiembre de 2026. Después, con Sonnet 5 a $3 / $15, Opus 5 cuesta aproximadamente 1.67x más.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Cuándo cambia el precio de Claude Sonnet 5?
&lt;/h3&gt;

&lt;p&gt;La tarifa introductoria de $2 / $10 dura hasta el 31 de agosto de 2026. Desde el 1 de septiembre de 2026, será $3 / $15. Opus 5 mantiene $5 / $25.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Opus 5 y Sonnet 5 tokenizan el texto de forma diferente?
&lt;/h3&gt;

&lt;p&gt;No. Ambos usan el tokenizador de generación 4.7. Un texto idéntico produce los mismos recuentos de entrada en ambos modelos.&lt;/p&gt;

&lt;p&gt;El aumento aproximado del 30% documentado por Anthropic se refiere a la comparación con Sonnet 4.6 y modelos anteriores. Aun así, compare siempre el coste por tarea completada: la longitud de salida y los reintentos suelen impactar más que el precio base.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Puedo alternar entre Opus 5 y Sonnet 5 sin cambiar el código?
&lt;/h3&gt;

&lt;p&gt;En la mayoría de casos, sí. Ambos usan pensamiento adaptativo por defecto y rechazan parámetros de muestreo no predeterminados.&lt;/p&gt;

&lt;p&gt;Revise estas diferencias:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Opus 5 incluye el nivel de esfuerzo &lt;code&gt;max&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Opus 5 usa &lt;code&gt;high&lt;/code&gt; como esfuerzo predeterminado.&lt;/li&gt;
&lt;li&gt;Opus 5 devuelve error &lt;code&gt;400&lt;/code&gt; si desactiva el pensamiento y usa esfuerzo &lt;code&gt;xhigh&lt;/code&gt; o &lt;code&gt;max&lt;/code&gt;.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  ¿Qué modelo recomienda Anthropic por defecto?
&lt;/h3&gt;

&lt;p&gt;La documentación de Anthropic recomienda empezar con Claude Opus 5 si no está seguro. Eso es una recomendación de capacidad, no un análisis de costes.&lt;/p&gt;

&lt;p&gt;Empiece con Opus 5 para establecer una línea de calidad y después mida si &lt;a href="https://apidog.com/es/blog/claude-sonnet-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Sonnet 5&lt;/a&gt; entrega resultados equivalentes por menos coste. La comparación anterior de &lt;a href="https://apidog.com/es/blog/claude-sonnet-5-vs-opus-4-8?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Sonnet 5 vs Opus 4.8&lt;/a&gt; sigue siendo útil como contexto.&lt;/p&gt;

&lt;p&gt;Para especificaciones, atribuciones de benchmarks y disponibilidad, consulte &lt;a href="https://apidog.com/es/blog/what-is-claude-opus-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;qué es Claude Opus 5&lt;/a&gt;, la &lt;a href="https://www.anthropic.com/news/claude-opus-5" rel="noopener noreferrer"&gt;publicación de lanzamiento de Opus 5&lt;/a&gt; y la &lt;a href="https://platform.claude.com/docs/en/about-claude/models/overview" rel="noopener noreferrer"&gt;visión general de modelos de Anthropic&lt;/a&gt;.&lt;/p&gt;

</description>
    </item>
    <item>
      <title>Diseño de prompts para Claude Opus 5: Evita la doble verificación</title>
      <dc:creator>Roobia</dc:creator>
      <pubDate>Sat, 25 Jul 2026 03:29:32 +0000</pubDate>
      <link>https://dev.to/roobia/diseno-de-prompts-para-claude-opus-5-evita-la-doble-verificacion-4gdo</link>
      <guid>https://dev.to/roobia/diseno-de-prompts-para-claude-opus-5-evita-la-doble-verificacion-4gdo</guid>
      <description>&lt;p&gt;La mayoría de las guías de migración te dicen qué se rompe en tu código. Esta trata sobre lo que se rompe en tus prompts.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation" class="crayons-btn crayons-btn--primary"&gt;Prueba Apidog hoy&lt;/a&gt;
&lt;/p&gt;

&lt;p&gt;Claude Opus 5 se lanzó el 24 de julio de 2026, y Anthropic publicó una &lt;a href="https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5" rel="noopener noreferrer"&gt;guía de prompting dedicada&lt;/a&gt; junto a él. La guía documenta un cambio importante: varias instrucciones que mejoraban Opus 4.8 empeoran Opus 5. El resultado puede ser más costo, más verbosidad y, en un caso, una salida que rompe activamente un bucle de agente.&lt;/p&gt;

&lt;p&gt;La razón es simple: Opus 5 ya realiza por defecto varias tareas que antes debías solicitar explícitamente. Si tu prompt heredado vuelve a pedirlas, la instrucción se combina con el comportamiento nativo del modelo. No obtienes el doble de precisión; obtienes pases de verificación duplicados.&lt;/p&gt;

&lt;p&gt;Esta guía recorre cada cambio de comportamiento documentado e incluye fragmentos que puedes copiar a tu prompt del sistema. También cubre los dos modos de fallo que aparecen al deshabilitar el pensamiento, el único caso donde un prompt de Opus 5 puede devolver una salida aparentemente correcta y corromper silenciosamente un bucle de agente.&lt;/p&gt;

&lt;p&gt;Si todavía trabajas en cambios a nivel de código, la &lt;a href="https://apidog.com/es/blog/claude-opus-5-migration-opus-4-8?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de migración de Opus 4.8 a Opus 5&lt;/a&gt; los cubre por separado. Para comparar el mismo prompt con configuraciones diferentes mediante solicitudes reales, puedes usar &lt;a href="https://apidog.com?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  El resumen de una línea
&lt;/h2&gt;

&lt;p&gt;Opus 5 verifica más, escribe más, delega más y explica más que Opus 4.8. Tus prompts de Opus 4.8 estaban ajustados para empujar al modelo hacia esos comportamientos. Ahora puede excederlos.&lt;/p&gt;

&lt;p&gt;El trabajo de migración es principalmente sustractivo:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Elimina instrucciones de verificación global.&lt;/li&gt;
&lt;li&gt;Añade límites explícitos de longitud.&lt;/li&gt;
&lt;li&gt;Restringe el uso de subagentes.&lt;/li&gt;
&lt;li&gt;Define el alcance permitido.&lt;/li&gt;
&lt;li&gt;Desactiva la narración de correcciones cuando la salida vaya a un parser o pipeline.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  1. Elimina las instrucciones de verificación global
&lt;/h2&gt;

&lt;p&gt;Anthropic indica que Opus 5 verifica su propio trabajo sin necesidad de solicitarlo. Puede releer lo escrito, comprobar cálculos, volver a ejecutar pruebas o buscar casos límite.&lt;/p&gt;

&lt;p&gt;En Opus 4.8, era común forzar ese comportamiento con instrucciones como estas:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Double-check your work before responding.
Verify each step before moving to the next one.
Review your answer for errors, then revise it.
Check your reasoning carefully.
Make sure the output is correct before returning it.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;En Opus 5, mantener esas líneas puede provocar sobreverificación. El modelo ejecuta sus comprobaciones predeterminadas y, además, las que ordenaste explícitamente. En ejecuciones largas de agentes, esos tokens adicionales se convierten en costo real.&lt;/p&gt;

&lt;h3&gt;
  
  
  Qué hacer
&lt;/h3&gt;

&lt;p&gt;Busca esos patrones en tus prompts de sistema y elimínalos.&lt;/p&gt;

&lt;p&gt;Si existe una operación realmente crítica, limita la verificación a ese único paso:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Do not add general verification passes; you already verify by default.
The only exception: after writing the migration SQL, run it against the
schema dump once and report any mismatch. Do not re-verify anything else.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;La diferencia es importante:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;“Verifica todo”&lt;/strong&gt; es una regla global y un multiplicador de costo.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;“Verifica este paso una vez”&lt;/strong&gt; es un control acotado.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Si estás monitorizando el gasto de la API durante la migración, combina este ajuste con las palancas de caché y lote del &lt;a href="https://apidog.com/es/blog/claude-opus-5-pricing?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;desglose de precios de Opus 5&lt;/a&gt;. Para optimizaciones generales, consulta la &lt;a href="https://apidog.com/es/blog/cut-claude-api-bill?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía para reducir la factura de la API de Claude&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  2. Solicita concisión explícitamente
&lt;/h2&gt;

&lt;p&gt;Las respuestas predeterminadas de Opus 5 son más largas que las de Opus 4.8. Esto también afecta a artefactos generados, como informes, resúmenes, documentos de diseño y README.&lt;/p&gt;

&lt;p&gt;No intentes resolverlo únicamente bajando &lt;code&gt;effort&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;El parámetro &lt;code&gt;effort&lt;/code&gt; controla cuánto piensa el modelo, no cuánto texto visible genera. Cambiar de &lt;code&gt;xhigh&lt;/code&gt; a &lt;code&gt;medium&lt;/code&gt; puede reducir tokens de pensamiento, pero la longitud de la respuesta seguirá siendo similar.&lt;/p&gt;

&lt;p&gt;La longitud debe controlarse desde el prompt.&lt;/p&gt;

&lt;h3&gt;
  
  
  Limita la respuesta visible
&lt;/h3&gt;



&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Response format: at most 150 words unless I ask for more.
No preamble, no restatement of my question, no summary at the end.
Lead with the answer, then the reasoning if it is needed.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;h3&gt;
  
  
  Limita entregables escritos
&lt;/h3&gt;



&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Write the migration doc at 800 words maximum.
Include: the breaking changes, the fix for each, and a rollback step.
Exclude: background on the old system, a glossary, and a conclusion section.
If a section would exceed its share, cut examples before cutting steps.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;h3&gt;
  
  
  Limita la explicación en tareas de código
&lt;/h3&gt;



&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Return the diff and nothing else.
No explanation of what you changed unless the change is non-obvious,
in which case one sentence above the hunk.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Para entender qué cambia en cada nivel, consulta la &lt;a href="https://apidog.com/es/blog/claude-opus-5-effort-parameter?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía del parámetro de esfuerzo de Opus 5&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  3. Limita la delegación de subagentes
&lt;/h2&gt;

&lt;p&gt;Opus 5 delega en subagentes con más facilidad que Opus 4.8. Ante una tarea compuesta y un arnés compatible con generación de subagentes, puede expandir el trabajo.&lt;/p&gt;

&lt;p&gt;Esto puede ser útil, pero también es una decisión de costo y latencia: cada subagente tiene su propio contexto y consumo de tokens.&lt;/p&gt;

&lt;h3&gt;
  
  
  Prohíbe subagentes cuando no aporten valor
&lt;/h3&gt;



&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Do not spawn subagents for this task. Handle it in this conversation.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;h3&gt;
  
  
  Permite una cantidad limitada cuando el paralelismo sea útil
&lt;/h3&gt;



&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;You may delegate to at most 2 subagents, and only for independent
file-level work that can run in parallel.
Do research, planning, and final synthesis yourself in this thread.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Evita delegaciones innecesarias, por ejemplo:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Crear un subagente para leer un único archivo.&lt;/li&gt;
&lt;li&gt;Delegar una decisión para la que el hilo principal ya tiene contexto.&lt;/li&gt;
&lt;li&gt;Crear subagentes para planificación o síntesis cuando no hay trabajo paralelo independiente.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Si diseñas flujos con subagentes deliberadamente, la guía para &lt;a href="https://apidog.com/es/blog/create-claude-code-subagents?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;crear subagentes de código de Claude&lt;/a&gt; cubre cómo delimitarlos desde el arnés.&lt;/p&gt;

&lt;h2&gt;
  
  
  4. Restringe explícitamente el alcance
&lt;/h2&gt;

&lt;p&gt;Opus 5 puede expandir el alcance de una tarea. Si le pides arreglar una prueba fallida, podría también refactorizar una función auxiliar, actualizar tipos y añadir casos de prueba. Si le pides renombrar una variable, podría reorganizar el código circundante.&lt;/p&gt;

&lt;p&gt;En una tarea quirúrgica, esto produce diffs más grandes, revisiones más lentas y mayor radio de impacto.&lt;/p&gt;

&lt;h3&gt;
  
  
  Define qué puede cambiar y qué está prohibido
&lt;/h3&gt;



&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Scope: change only the retry-count constant in src/client/http.ts.
Do not refactor surrounding code, do not rename anything, do not add
tests, do not update docs. If you believe another change is required,
stop and tell me instead of making it.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;La última cláusula es especialmente útil. Da al modelo una salida válida cuando detecta un problema fuera del alcance:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Puede señalar la dependencia.&lt;/li&gt;
&lt;li&gt;No necesita modificar archivos no autorizados.&lt;/li&gt;
&lt;li&gt;Recibes un diff mínimo y una observación explícita.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  5. Desactiva la narración de correcciones cuando no la necesites
&lt;/h2&gt;

&lt;p&gt;Opus 5 narra sus correcciones más que Opus 4.8. Cuando cambia de enfoque, puede explicar qué intento anterior era incorrecto y por qué eligió otra alternativa.&lt;/p&gt;

&lt;p&gt;Esto es útil en trabajo interactivo. En un pipeline, una respuesta que alimenta un parser, una UI o otro modelo, esa narración puede contaminar un campo que debería contener solo el resultado final.&lt;/p&gt;

&lt;h3&gt;
  
  
  Devuelve únicamente la respuesta final
&lt;/h3&gt;



&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Do not narrate corrections or changes of approach.
Return only the final answer. If you revised your thinking, that
revision belongs in your reasoning, not in the response.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Si envías resultados a almacenamiento estructurado, combina esta instrucción con salidas estructuradas para imponer el formato en lugar de depender solo del prompt.&lt;/p&gt;

&lt;h2&gt;
  
  
  Modos de fallo con el pensamiento deshabilitado
&lt;/h2&gt;

&lt;p&gt;Todo lo anterior es ajuste de comportamiento. Esta sección trata de corrección.&lt;/p&gt;

&lt;p&gt;Anthropic documenta dos artefactos que pueden aparecer ocasionalmente en Opus 5 cuando deshabilitas el pensamiento mediante:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"thinking"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"type"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"disabled"&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Debes conocerlos antes de implementar un agente.&lt;/p&gt;

&lt;h3&gt;
  
  
  Llamadas a herramientas emitidas como texto plano
&lt;/h3&gt;

&lt;p&gt;El modelo puede producir algo que parece una llamada a herramienta, pero incluirlo como texto dentro de la respuesta en lugar de como un bloque estructurado &lt;code&gt;tool_use&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;En ese caso:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;No se ejecuta ninguna herramienta.&lt;/li&gt;
&lt;li&gt;El bucle del agente no detecta una llamada válida.&lt;/li&gt;
&lt;li&gt;El texto filtrado queda en el historial.&lt;/li&gt;
&lt;li&gt;Los siguientes turnos pueden interpretar ese texto como una acción ya realizada.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;En un chat de una sola interacción, probablemente lo detectarías. En un bucle de agente, puede acumularse durante varios turnos antes de ser visible.&lt;/p&gt;

&lt;h3&gt;
  
  
  Etiquetas XML internas en la salida visible
&lt;/h3&gt;

&lt;p&gt;También pueden aparecer etiquetas como &lt;code&gt;&amp;lt;thinking&amp;gt;&lt;/code&gt; en la respuesta visible.&lt;/p&gt;

&lt;p&gt;Esto es problemático si:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Renderizas respuestas como HTML.&lt;/li&gt;
&lt;li&gt;Analizas la salida para extraer estructura.&lt;/li&gt;
&lt;li&gt;Tienes una interfaz que espera texto limpio.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;No intentes solucionar este problema escribiendo una regla que mencione literalmente esas etiquetas. Incluir la secuencia de tokens en el contexto puede aumentar la probabilidad de que aparezca.&lt;/p&gt;

&lt;h3&gt;
  
  
  Mitigación recomendada
&lt;/h3&gt;

&lt;p&gt;La recomendación de Anthropic no es un cambio de prompt: mantén el pensamiento habilitado y controla el costo mediante un nivel de esfuerzo más bajo.&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"model"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"claude-opus-5"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"max_tokens"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="mi"&gt;4096&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"output_config"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="nl"&gt;"effort"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"low"&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;},&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"messages"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;[&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="nl"&gt;"role"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"user"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="nl"&gt;"content"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"..."&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;]&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Esto permite usar el extremo económico del rango sin introducir los artefactos asociados al pensamiento deshabilitado.&lt;/p&gt;

&lt;p&gt;También evita una incompatibilidad: en Opus 5, combinar &lt;code&gt;thinking: {type: "disabled"}&lt;/code&gt; con esfuerzo &lt;code&gt;xhigh&lt;/code&gt; o &lt;code&gt;max&lt;/code&gt; devuelve un error 400. Deshabilitar el pensamiento está limitado a un esfuerzo &lt;code&gt;high&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;Además, el pensamiento está activado por defecto. Una solicitud que omite el campo &lt;code&gt;thinking&lt;/code&gt; usa pensamiento adaptativo, en lugar de ejecutarse sin pensamiento como podía ocurrir en Opus 4.8.&lt;/p&gt;

&lt;p&gt;Si debes deshabilitar el pensamiento por un requisito estricto, añade una comprobación defensiva en tu bucle de agente:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Inspecciona el texto del turno del asistente antes de añadirlo al historial.&lt;/li&gt;
&lt;li&gt;Rechaza respuestas que contengan una cadena con forma de llamada a herramienta no ejecutada.&lt;/li&gt;
&lt;li&gt;Haz que el flujo falle de forma visible en lugar de permitir que una llamada fantasma entre en la transcripción.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Prueba los cambios en lugar de adivinar
&lt;/h2&gt;

&lt;p&gt;No puedes evaluar estos cambios leyendo el prompt. La longitud de respuesta, los pases de verificación y el número de subagentes se reflejan en recuentos de tokens y en la estructura de la carga útil.&lt;/p&gt;

&lt;p&gt;La forma correcta de validar la migración es enviar solicitudes equivalentes y comparar resultados.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fpajvu20pmb0qvn1l5hvk.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fpajvu20pmb0qvn1l5hvk.png" alt="Comparación de solicitudes y respuestas de API" width="799" height="530"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;Puedes configurarlo en &lt;a href="https://apidog.com?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt;, una plataforma todo en uno para desarrollo y pruebas de API:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Crea una solicitud al endpoint de mensajes de Anthropic con &lt;code&gt;"model": "claude-opus-5"&lt;/code&gt;. Guarda la clave API como variable de entorno, no en el cuerpo de la solicitud.&lt;/li&gt;
&lt;li&gt;Guarda tu prompt de sistema antiguo de Opus 4.8 y la versión recortada para Opus 5 como dos solicitudes separadas con la misma entrada.&lt;/li&gt;
&lt;li&gt;Compara el bloque &lt;code&gt;usage&lt;/code&gt; de cada respuesta. Los tokens de salida muestran si se aplicó el límite de concisión; los tokens de entrada y los campos de caché muestran si editaste un prefijo cacheable.&lt;/li&gt;
&lt;li&gt;Duplica la solicitud con distintos niveles de esfuerzo para comprobar cómo disminuyen los tokens de pensamiento mientras la longitud visible se mantiene.&lt;/li&gt;
&lt;li&gt;Inspecciona la respuesta de streaming y confirma que las llamadas a herramientas llegan como bloques &lt;code&gt;tool_use&lt;/code&gt;, no como texto plano.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;El paso 5 detecta el fallo de llamadas a herramientas en texto antes de que llegue a producción. Puedes &lt;a href="https://apidog.com/download?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;descargar Apidog&lt;/a&gt; para ejecutar estas comparaciones lado a lado, y consultar el &lt;a href="https://apidog.com/es/blog/claude-opus-5-api?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;tutorial de la API de Opus 5&lt;/a&gt; para revisar la forma completa de la solicitud.&lt;/p&gt;

&lt;h2&gt;
  
  
  El techo honesto
&lt;/h2&gt;

&lt;p&gt;Conviene decirlo claramente: Opus 5 no es la cima de la pila de Claude.&lt;/p&gt;

&lt;p&gt;Fable 5 conserva la designación de “el más capaz ampliamente lanzado”, y Opus 5 sigue por detrás de Mythos 5 en explotación de ciberseguridad e investigación de biología autónoma. Anthropic indica ambas cosas en su propia &lt;a href="https://www.anthropic.com/news/claude-opus-5" rel="noopener noreferrer"&gt;publicación de lanzamiento&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;El encuadre preciso es una capacidad de clase frontera a la mitad del precio de frontera, con un techo explícitamente definido por encima.&lt;/p&gt;

&lt;p&gt;Las afirmaciones de los benchmarks de lanzamiento —Frontier-Bench, ARC-AGI 3, OSWorld 2.0 y CursorBench— son cifras proporcionadas por Anthropic y no habían sido reproducidas de forma independiente hasta el 25 de julio de 2026. Trátalas como datos del proveedor y ejecuta tus propias evaluaciones sobre los prompts que realmente vayas a desplegar.&lt;/p&gt;

&lt;h2&gt;
  
  
  Armándolo todo
&lt;/h2&gt;

&lt;p&gt;Un prompt de sistema de Opus 5 para una tarea de agente sensible al costo puede quedar así:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Do not add verification passes; you verify by default.
Responses: 150 words maximum, no preamble, no closing summary.
Do not spawn subagents. Handle this in one thread.
Stay strictly within the task I state. If another change seems
required, stop and tell me rather than making it.
Do not narrate corrections or changes of approach.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Son seis líneas. Cinco son restricciones. Ninguna pide al modelo que se esfuerce más.&lt;/p&gt;

&lt;p&gt;Ese es el cambio de mentalidad:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;En Opus 4.8, el prompt buscaba elevar un piso.&lt;/li&gt;
&lt;li&gt;En Opus 5, el prompt debe establecer un techo.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Empieza con esta base y ejecuta un barrido de esfuerzo en tus propias evaluaciones. No migres directamente las configuraciones de 4.8: los niveles fueron recalibrados.&lt;/p&gt;

&lt;p&gt;Para la mecánica de los parámetros, consulta la &lt;a href="https://apidog.com/es/blog/claude-opus-5-effort-parameter?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía del parámetro de esfuerzo&lt;/a&gt;. Para el flujo de trabajo en el editor, consulta &lt;a href="https://apidog.com/es/blog/claude-opus-5-claude-code?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;usando Opus 5 en Claude Code&lt;/a&gt;. Para una visión general del modelo, empieza por &lt;a href="https://apidog.com/es/blog/what-is-claude-opus-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;qué es Claude Opus 5&lt;/a&gt;. La &lt;a href="https://platform.claude.com/docs/en/about-claude/models/overview" rel="noopener noreferrer"&gt;visión general de modelos&lt;/a&gt; de Anthropic contiene la tabla de especificaciones actual.&lt;/p&gt;

&lt;h2&gt;
  
  
  Preguntas frecuentes
&lt;/h2&gt;

&lt;h3&gt;
  
  
  ¿Debería eliminar “revisa tu trabajo” de mis prompts?
&lt;/h3&gt;

&lt;p&gt;Sí. La guía de prompting de Anthropic indica que Opus 5 ya verifica sin que se lo solicites. Las instrucciones heredadas pueden causar sobreverificación. Elimina la regla global y limita cualquier comprobación explícita a un paso crítico concreto.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Por qué Opus 5 es tan verboso incluso con poco esfuerzo?
&lt;/h3&gt;

&lt;p&gt;Porque &lt;code&gt;effort&lt;/code&gt; controla el pensamiento, no la longitud visible de la salida. Reducir el esfuerzo recorta tokens de razonamiento, pero las respuestas pueden seguir teniendo una longitud similar. Define un límite de palabras o un formato en el prompt.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Cómo evito que Opus 5 genere subagentes?
&lt;/h3&gt;

&lt;p&gt;Indícalo directamente:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Do not spawn subagents. Handle this in this conversation.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Si una parte del trabajo se beneficia del paralelismo, establece un máximo numérico y restringe la delegación a tareas independientes.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Por qué veo etiquetas &lt;code&gt;&amp;lt;thinking&amp;gt;&lt;/code&gt; en mi salida?
&lt;/h3&gt;

&lt;p&gt;Ese artefacto puede aparecer cuando el pensamiento está deshabilitado. No añadas una instrucción que mencione esas etiquetas, porque puede aumentar la probabilidad de fuga. La solución recomendada es mantener el pensamiento habilitado y usar un nivel de esfuerzo más bajo para controlar el costo.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Qué ocurre si una llamada a herramienta vuelve como texto plano?
&lt;/h3&gt;

&lt;p&gt;No se ejecuta ninguna acción. El texto queda en el historial de conversación y los turnos posteriores pueden interpretarlo como una operación completada. Valida los turnos del asistente antes de añadirlos al historial y, cuando sea posible, mantén el pensamiento habilitado.&lt;/p&gt;

</description>
    </item>
    <item>
      <title>Cómo usar Claude Opus 5 gratis</title>
      <dc:creator>Roobia</dc:creator>
      <pubDate>Sat, 25 Jul 2026 03:26:46 +0000</pubDate>
      <link>https://dev.to/roobia/como-usar-claude-opus-5-gratis-4n06</link>
      <guid>https://dev.to/roobia/como-usar-claude-opus-5-gratis-4n06</guid>
      <description>&lt;p&gt;Anthropic lanzó Claude Opus 5 el 24 de julio de 2026. La respuesta a «¿puedo usarlo gratis?» depende de cómo lo uses:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;En las aplicaciones de Claude:&lt;/strong&gt; sí, si ya tienes una suscripción de pago. Opus 5 es el modelo predeterminado para Max y el modelo de mayor rendimiento disponible para Pro.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Mediante la API:&lt;/strong&gt; no existe acceso gratuito ilimitado a &lt;code&gt;claude-opus-5&lt;/code&gt;. Puedes usar créditos de prueba o promocionales, pero se consumen.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation" class="crayons-btn crayons-btn--primary"&gt;Prueba Apidog hoy&lt;/a&gt;
&lt;/p&gt;

&lt;p&gt;Opus 5 cuesta &lt;strong&gt;$5 por millón de tokens de entrada&lt;/strong&gt; y &lt;strong&gt;$25 por millón de tokens de salida&lt;/strong&gt;: el mismo precio que Opus 4.8 y la mitad de los $10 / $50 de Fable 5. Sin embargo, puedes reducir una factura real en más de la mitad usando lotes, caché de prompts y niveles de esfuerzo adecuados.&lt;/p&gt;

&lt;p&gt;Cuando empieces a probar la API, &lt;a href="https://apidog.com?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt; te permite enviar, guardar y comparar solicitudes HTTP.&lt;/p&gt;

&lt;p&gt;Para consultar las especificaciones completas, revisa &lt;a href="https://apidog.com/es/blog/what-is-claude-opus-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;qué es Claude Opus 5&lt;/a&gt;. La &lt;a href="https://www.anthropic.com/news/claude-opus-5" rel="noopener noreferrer"&gt;publicación de lanzamiento de Opus 5 de Anthropic&lt;/a&gt; contiene el anuncio, y la &lt;a href="https://platform.claude.com/docs/en/about-claude/models/overview" rel="noopener noreferrer"&gt;descripción general de los modelos&lt;/a&gt; incluye los ID y la disponibilidad.&lt;/p&gt;

&lt;p&gt;Ten presente esta diferencia:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Gratis en las aplicaciones Claude:&lt;/strong&gt; tu suscripción cubre el uso, sujeto a límites.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Gratis mediante API:&lt;/strong&gt; créditos promocionales o de prueba con saldo limitado.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Ruta gratuita 1: suscripciones de Claude
&lt;/h2&gt;

&lt;p&gt;Los materiales de lanzamiento de Anthropic indican dos opciones para usar Opus 5 en productos de consumo:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Max:&lt;/strong&gt; Opus 5 es el modelo predeterminado.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Pro:&lt;/strong&gt; Opus 5 es el modelo de mayor rendimiento disponible.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Los materiales no indican que el plan gratuito de Claude incluya Opus 5. Antes de basar un flujo de trabajo en esta opción, abre el selector de modelos de tu cuenta y confirma si está disponible.&lt;/p&gt;

&lt;p&gt;Opus 5 también está disponible en Claude Code, Claude Cowork y GitHub Copilot. Si ya pagas una suscripción compatible, es posible que puedas usarlo desde ahí.&lt;/p&gt;

&lt;p&gt;Controla el consumo: Opus 5 puede agotar los límites antes que 4.8 porque el pensamiento está activado por defecto, las respuestas son más largas y el modelo delega tareas a subagentes con mayor facilidad.&lt;/p&gt;

&lt;p&gt;Consulta &lt;a href="https://apidog.com/es/blog/claude-opus-5-claude-code?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;cómo usar Claude Opus 5 en Claude Code&lt;/a&gt; para configurar ese uso, y &lt;a href="https://apidog.com/es/blog/how-to-use-claude-opus-4-8-for-free?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;cómo usar Claude Opus 4.8 gratis&lt;/a&gt; para las rutas equivalentes de la generación anterior.&lt;/p&gt;

&lt;h2&gt;
  
  
  Ruta gratuita 2: créditos de prueba y promociones en la nube
&lt;/h2&gt;

&lt;p&gt;El ID del modelo en la API de Claude es:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;claude-opus-5
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;La API es de pago por uso, pero puedes comenzar sin pagar por adelantado en estos casos:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Créditos para cuentas nuevas de Anthropic:&lt;/strong&gt; las cuentas nuevas suelen recibir un saldo pequeño para validar la integración y medir tokens antes de añadir una tarjeta.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Créditos promocionales de plataformas cloud:&lt;/strong&gt; Opus 5 está disponible en Amazon Bedrock como &lt;code&gt;anthropic.claude-opus-5&lt;/code&gt;, Claude Platform en AWS, Google Cloud y Microsoft Foundry. Las cuentas nuevas pueden incluir créditos promocionales utilizables para Claude.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;No asumas importes ni condiciones: revisa la oferta actual de cada plataforma, ya que cambian con frecuencia.&lt;/p&gt;

&lt;p&gt;Usa esos créditos para medir, no para producción:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Ejecuta prompts representativos de tu aplicación.&lt;/li&gt;
&lt;li&gt;Guarda el bloque &lt;code&gt;usage&lt;/code&gt; de cada respuesta.&lt;/li&gt;
&lt;li&gt;Calcula el coste por tarea usando los tokens reales.&lt;/li&gt;
&lt;li&gt;Decide si el modelo es viable antes de escalar.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Consulta la &lt;a href="https://platform.claude.com/docs/en/about-claude/pricing" rel="noopener noreferrer"&gt;documentación de precios de Anthropic&lt;/a&gt; para ver las tarifas actuales.&lt;/p&gt;

&lt;h3&gt;
  
  
  Atención: el pensamiento está activado por defecto
&lt;/h3&gt;

&lt;p&gt;En Opus 4.8, una solicitud sin el campo &lt;code&gt;thinking&lt;/code&gt; se ejecutaba sin pensamiento. En Opus 5, esa misma solicitud usa pensamiento adaptativo.&lt;/p&gt;

&lt;p&gt;Los tokens de pensamiento se facturan como salida, a &lt;strong&gt;$25 por millón de tokens&lt;/strong&gt;. Por tanto, migrar una batería de pruebas desde 4.8 sin cambios puede consumir créditos más rápido.&lt;/p&gt;

&lt;p&gt;Consulta &lt;a href="https://apidog.com/es/blog/claude-opus-5-migration-opus-4-8?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;migrando de Opus 4.8 a Opus 5&lt;/a&gt; para revisar las diferencias de migración.&lt;/p&gt;

&lt;h2&gt;
  
  
  No existe una API gratuita ilimitada
&lt;/h2&gt;

&lt;p&gt;Ningún plan gratuito de la API de Claude ofrece llamadas ilimitadas a &lt;code&gt;claude-opus-5&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;Evita proxies, pools de claves y revendedores que prometen acceso ilimitado o gratuito a modelos de frontera. Estos esquemas pueden violar los términos de Anthropic, dejar de funcionar sin aviso y enviar tus solicitudes a infraestructura que no controlas.&lt;/p&gt;

&lt;p&gt;Cuando se agoten los créditos de prueba o promoción, debes pagar por token o detener el uso.&lt;/p&gt;

&lt;h2&gt;
  
  
  La ruta de pago más económica
&lt;/h2&gt;

&lt;p&gt;La tarifa estándar de Opus 5 es:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Entrada:&lt;/strong&gt; $5 por millón de tokens.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Salida:&lt;/strong&gt; $25 por millón de tokens.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Estas son las palancas que más afectan el coste.&lt;/p&gt;

&lt;h3&gt;
  
  
  Palanca 1: usa la API por lotes para trabajo asíncrono
&lt;/h3&gt;

&lt;p&gt;Todo lo que no necesite respuesta en segundos debería evaluarse para la API por lotes.&lt;/p&gt;

&lt;p&gt;La API por lotes se ejecuta de forma asíncrona y reduce el precio al 50%:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Entrada:&lt;/strong&gt; $2.50 por millón de tokens.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Salida:&lt;/strong&gt; $12.50 por millón de tokens.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;El modelo y la calidad de respuesta son los mismos. La diferencia es la latencia.&lt;/p&gt;

&lt;p&gt;Es una buena opción para:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Evaluaciones nocturnas.&lt;/li&gt;
&lt;li&gt;Procesamiento masivo de documentos.&lt;/li&gt;
&lt;li&gt;Clasificación por lotes.&lt;/li&gt;
&lt;li&gt;Suites de regresión.&lt;/li&gt;
&lt;li&gt;Pipelines de generación de contenido.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;También admite hasta &lt;strong&gt;300.000 tokens de salida&lt;/strong&gt; por solicitud usando el encabezado beta:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;output-300k-2026-03-24
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;La API estándar de Mensajes admite 128.000 tokens de salida. Ten en cuenta que el modo rápido no funciona con la API por lotes.&lt;/p&gt;

&lt;h3&gt;
  
  
  Palanca 2: ajusta &lt;code&gt;output_config.effort&lt;/code&gt;
&lt;/h3&gt;

&lt;p&gt;Opus 5 expone &lt;code&gt;output_config.effort&lt;/code&gt;, el selector entre coste y capacidad.&lt;/p&gt;

&lt;p&gt;El valor predeterminado es &lt;code&gt;high&lt;/code&gt;. Un esfuerzo menor reduce los tokens de pensamiento, y esos tokens se cobran a tarifa de salida.&lt;/p&gt;

&lt;p&gt;Empieza comparando &lt;code&gt;low&lt;/code&gt;, &lt;code&gt;medium&lt;/code&gt; y &lt;code&gt;high&lt;/code&gt; con tus propios casos de uso.&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"output_config"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"effort"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"low"&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Anthropic indica que &lt;code&gt;low&lt;/code&gt; y &lt;code&gt;medium&lt;/code&gt; son significativamente más capaces en Opus 5 que en modelos Opus anteriores. No reutilices automáticamente la configuración de esfuerzo de Opus 4.8: vuelve a ejecutar tus evaluaciones.&lt;/p&gt;

&lt;p&gt;Dos reglas prácticas:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;&lt;p&gt;&lt;strong&gt;El esfuerzo controla el pensamiento, no la longitud visible de la respuesta.&lt;/strong&gt;&lt;br&gt;&lt;br&gt;
Si quieres respuestas más cortas, indícalo explícitamente en el prompt.&lt;/p&gt;&lt;/li&gt;
&lt;li&gt;&lt;p&gt;&lt;strong&gt;No desactives el pensamiento solo para ahorrar.&lt;/strong&gt;&lt;br&gt;&lt;br&gt;
Combinar &lt;code&gt;thinking: {"type": "disabled"}&lt;/code&gt; con esfuerzo &lt;code&gt;xhigh&lt;/code&gt; o &lt;code&gt;max&lt;/code&gt; devuelve un error 400. Además, Anthropic recomienda mantener el pensamiento activado y reducir el esfuerzo cuando sea necesario.&lt;/p&gt;&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Con el pensamiento desactivado, Opus 5 puede escribir llamadas a herramientas como texto plano o filtrar etiquetas XML internas en la salida.&lt;/p&gt;

&lt;p&gt;Consulta &lt;a href="https://apidog.com/es/blog/claude-opus-5-effort-parameter?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;el parámetro de esfuerzo de Claude Opus 5&lt;/a&gt; para ver los cinco niveles.&lt;/p&gt;

&lt;h3&gt;
  
  
  Palanca 3: activa la caché de prompts
&lt;/h3&gt;

&lt;p&gt;Los aciertos de caché cuestan &lt;strong&gt;$0.50 por millón de tokens de entrada&lt;/strong&gt;, una décima parte de la tarifa estándar de entrada.&lt;/p&gt;

&lt;p&gt;Las escrituras tienen estos costes:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Caché de 5 minutos: &lt;strong&gt;$6.25 por millón de tokens&lt;/strong&gt;.&lt;/li&gt;
&lt;li&gt;Caché de 1 hora: &lt;strong&gt;$10 por millón de tokens&lt;/strong&gt;.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;En Opus 5, el prefijo mínimo cacheable baja a &lt;strong&gt;512 tokens&lt;/strong&gt;, frente a los 1.024 de Opus 4.8.&lt;/p&gt;

&lt;p&gt;Esto permite cachear prompts del sistema, documentación de referencia y contexto estable que antes era demasiado corto.&lt;/p&gt;

&lt;p&gt;Ejemplo con un prefijo estable de 40.000 tokens y 10.000 tokens variables:&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Escenario&lt;/th&gt;
&lt;th&gt;Coste de entrada&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Sin caché: 50.000 tokens a $5/MTok&lt;/td&gt;
&lt;td&gt;$0.25&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Escritura del prefijo cacheado: 40.000 tokens a $6.25/MTok&lt;/td&gt;
&lt;td&gt;$0.25&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Acierto posterior: 40.000 tokens cacheados + 10.000 nuevos&lt;/td&gt;
&lt;td&gt;$0.07&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;La escritura cuesta cinco centavos más que enviar ese prefijo sin caché, pero el primer acierto posterior ya compensa ese coste.&lt;/p&gt;

&lt;p&gt;Verifica que funciona comprobando este campo en la respuesta:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"usage"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"cache_read_input_tokens"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="mi"&gt;40000&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Si &lt;code&gt;cache_read_input_tokens&lt;/code&gt; es &lt;code&gt;0&lt;/code&gt; en llamadas repetidas, revisa la posición del punto de interrupción de caché.&lt;/p&gt;

&lt;h3&gt;
  
  
  Palanca 4: evita el modo rápido si el coste importa
&lt;/h3&gt;

&lt;p&gt;El modo rápido cuesta el doble de la tarifa estándar:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Entrada:&lt;/strong&gt; $10 por millón de tokens.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Salida:&lt;/strong&gt; $50 por millón de tokens.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;A cambio, aumenta la velocidad de salida aproximadamente 2,5 veces.&lt;/p&gt;

&lt;p&gt;Es una vista previa de investigación disponible solo mediante la API directa de Anthropic. No está disponible en Bedrock, Google Cloud, Microsoft Foundry ni en la API por lotes.&lt;/p&gt;

&lt;p&gt;Úsalo únicamente cuando la latencia sea crítica y un usuario esté esperando la respuesta en tiempo real.&lt;/p&gt;

&lt;h3&gt;
  
  
  Palanca 5: no configures &lt;code&gt;inference_geo&lt;/code&gt; sin necesidad
&lt;/h3&gt;

&lt;p&gt;Esta configuración:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"inference_geo"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"us"&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;aplica un multiplicador de &lt;strong&gt;1,1x&lt;/strong&gt; a todas las categorías de tokens, es decir, un recargo del 10%.&lt;/p&gt;

&lt;p&gt;Solo debes activarlo si tienes requisitos de residencia de datos.&lt;/p&gt;

&lt;p&gt;Una mejora menor al migrar: la sobrecarga del prompt del sistema para uso de herramientas en Opus 5 es de 286 tokens con &lt;code&gt;tool_choice&lt;/code&gt; configurado como &lt;code&gt;auto&lt;/code&gt; o &lt;code&gt;none&lt;/code&gt;. Es inferior a los 290 de Opus 4.8 y a los 675 de Opus 4.7.&lt;/p&gt;

&lt;p&gt;Para más optimizaciones generales, consulta &lt;a href="https://apidog.com/es/blog/cut-claude-api-bill?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;reduce tu factura de la API de Claude&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Comparativa de costes
&lt;/h2&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Configuración&lt;/th&gt;
&lt;th&gt;Entrada / MTok&lt;/th&gt;
&lt;th&gt;Salida / MTok&lt;/th&gt;
&lt;th&gt;Ideal para&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Estándar, esfuerzo &lt;code&gt;high&lt;/code&gt;
&lt;/td&gt;
&lt;td&gt;$5.00&lt;/td&gt;
&lt;td&gt;$25.00&lt;/td&gt;
&lt;td&gt;Uso interactivo predeterminado&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;API por lotes&lt;/td&gt;
&lt;td&gt;$2.50&lt;/td&gt;
&lt;td&gt;$12.50&lt;/td&gt;
&lt;td&gt;Cargas asíncronas&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Aciertos de caché en un prefijo estable&lt;/td&gt;
&lt;td&gt;$0.50&lt;/td&gt;
&lt;td&gt;n/a&lt;/td&gt;
&lt;td&gt;Contexto largo reutilizado&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Modo rápido&lt;/td&gt;
&lt;td&gt;$10.00&lt;/td&gt;
&lt;td&gt;$50.00&lt;/td&gt;
&lt;td&gt;Casos críticos de latencia&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;&lt;code&gt;inference_geo: "us"&lt;/code&gt;&lt;/td&gt;
&lt;td&gt;1.1x todas las categorías&lt;/td&gt;
&lt;td&gt;1.1x todas las categorías&lt;/td&gt;
&lt;td&gt;Residencia de datos&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;El descuento por lotes se aplica a las tarifas estándar de tokens. Comprueba en tu factura cómo se combina con los precios de caché antes de estimar ahorros conjuntos.&lt;/p&gt;

&lt;p&gt;Consulta &lt;a href="https://apidog.com/es/blog/claude-opus-5-pricing?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;precios de Claude Opus 5&lt;/a&gt; para ver ejemplos completos.&lt;/p&gt;

&lt;h2&gt;
  
  
  Prueba las rutas baratas con Apidog
&lt;/h2&gt;

&lt;p&gt;Cada ajuste anterior se puede validar inspeccionando una respuesta HTTP. Usa primero una llamada base:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;curl https://api.anthropic.com/v1/messages &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--header&lt;/span&gt; &lt;span class="s2"&gt;"x-api-key: &lt;/span&gt;&lt;span class="nv"&gt;$ANTHROPIC_API_KEY&lt;/span&gt;&lt;span class="s2"&gt;"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--header&lt;/span&gt; &lt;span class="s2"&gt;"anthropic-version: 2023-06-01"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--header&lt;/span&gt; &lt;span class="s2"&gt;"content-type: application/json"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--data&lt;/span&gt; &lt;span class="s1"&gt;'{
    "model": "claude-opus-5",
    "max_tokens": 4096,
    "output_config": {"effort": "low"},
    "messages": [
      {"role": "user", "content": "Summarize this OpenAPI spec in three sentences."}
    ]
  }'&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;En &lt;a href="https://apidog.com?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt;, guarda la solicitud como &lt;code&gt;POST&lt;/code&gt; y almacena la clave como variable de entorno. No pegues secretos directamente en el cuerpo de la solicitud ni en archivos que puedas confirmar en Git.&lt;/p&gt;

&lt;p&gt;Luego valida estos puntos:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Compara niveles de esfuerzo.&lt;/strong&gt; Duplica la solicitud y prueba &lt;code&gt;low&lt;/code&gt;, &lt;code&gt;medium&lt;/code&gt; y &lt;code&gt;high&lt;/code&gt;. Compara &lt;code&gt;usage.output_tokens&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Confirma la caché.&lt;/strong&gt; Ejecuta dos veces una solicitud con el mismo prefijo largo y verifica que &lt;code&gt;cache_read_input_tokens&lt;/code&gt; sea mayor que cero en la segunda llamada.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Detecta truncamientos.&lt;/strong&gt; El pensamiento y la salida comparten &lt;code&gt;max_tokens&lt;/code&gt;. Si recibes &lt;code&gt;stop_reason: "max_tokens"&lt;/code&gt;, pagaste por una salida incompleta. Añade una aserción para detectar ese resultado.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Inspecciona streaming y herramientas.&lt;/strong&gt; Revisa eventos SSE y cargas útiles de llamadas a herramientas cuando un flujo agéntico consuma más tokens de lo esperado.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;a href="https://apidog.com/download?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Descarga Apidog&lt;/a&gt; para seguir el proceso y consulta &lt;a href="https://apidog.com/es/blog/claude-opus-5-api?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;cómo usar la API de Claude Opus 5&lt;/a&gt; para un tutorial de integración completo.&lt;/p&gt;

&lt;h2&gt;
  
  
  ¿Debes optimizar Opus 5 o usar otro modelo?
&lt;/h2&gt;

&lt;p&gt;A veces, el ahorro más grande consiste en elegir otro modelo.&lt;/p&gt;

&lt;p&gt;Sonnet 5 tiene tarifas introductorias de $2 / $10, que aumentan a $3 / $15 el 1 de septiembre de 2026, y comparte la ventana de contexto de 1 millón de tokens.&lt;/p&gt;

&lt;p&gt;Si tu carga no requiere codificación agéntica ni razonamiento complejo de varios pasos, compara Sonnet 5 antes de optimizar la factura de Opus 5.&lt;/p&gt;

&lt;p&gt;Consulta &lt;a href="https://apidog.com/es/blog/claude-opus-5-vs-sonnet-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Claude Opus 5 vs Sonnet 5&lt;/a&gt; para evaluar la prima de capacidad y &lt;a href="https://apidog.com/es/blog/claude-sonnet-5-free?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;cómo usar Claude Sonnet 5 gratis&lt;/a&gt; para las rutas gratuitas de Sonnet.&lt;/p&gt;

&lt;p&gt;Anthropic afirma que Opus 5 obtiene más del doble de la puntuación de Frontier-Bench de Opus 4.8, se sitúa a menos del 0,5% de Fable 5 en CursorBench 3.2 a la mitad de precio y supera a Fable 5 en OSWorld 2.0 a un tercio del coste.&lt;/p&gt;

&lt;p&gt;Estas son cifras publicadas por Anthropic, no reproducidas de forma independiente a 25 de julio de 2026. Trátalas como afirmaciones que debes validar con tus propias evaluaciones.&lt;/p&gt;

&lt;p&gt;Opus 5 tampoco es el modelo más capaz de la pila de Claude: Fable 5 sigue siendo el modelo más capaz de Anthropic ampliamente lanzado, y Opus 5 queda por detrás de Mythos 5 en explotación de ciberseguridad e investigación autónoma en biología.&lt;/p&gt;

&lt;p&gt;Consulta &lt;a href="https://apidog.com/es/blog/what-is-claude-fable-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;qué es Claude Fable 5&lt;/a&gt; si tu caso de uso necesita ese nivel de capacidad.&lt;/p&gt;

&lt;h2&gt;
  
  
  Qué ruta te conviene
&lt;/h2&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Objetivo&lt;/th&gt;
&lt;th&gt;Ruta&lt;/th&gt;
&lt;th&gt;Inconveniente&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Chat, escritura e investigación&lt;/td&gt;
&lt;td&gt;Suscripción Claude Pro o Max&lt;/td&gt;
&lt;td&gt;Límites medidos; Opus 5 los consume más rápido que 4.8&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Codificación agéntica&lt;/td&gt;
&lt;td&gt;Claude Code con un plan de pago&lt;/td&gt;
&lt;td&gt;Respuestas largas y subagentes consumen el saldo&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Prototipar una integración&lt;/td&gt;
&lt;td&gt;Créditos de prueba de API o promociones cloud&lt;/td&gt;
&lt;td&gt;El saldo se agota y después pagas por token&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;API de producción más económica&lt;/td&gt;
&lt;td&gt;Lotes + caché + esfuerzo &lt;code&gt;low&lt;/code&gt;
&lt;/td&gt;
&lt;td&gt;Los lotes añaden latencia; la caché necesita un prefijo estable&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;API interactiva más económica&lt;/td&gt;
&lt;td&gt;Tarifa estándar + caché + esfuerzo por tarea&lt;/td&gt;
&lt;td&gt;No hay descuento por lotes&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;h2&gt;
  
  
  Preguntas frecuentes
&lt;/h2&gt;

&lt;p&gt;&lt;strong&gt;¿Claude Opus 5 es gratis?&lt;/strong&gt;&lt;/p&gt;

&lt;p&gt;No mediante la API. En las aplicaciones de Claude, viene incluido con suscripciones de pago: es el valor predeterminado en Max y el modelo de mayor rendimiento disponible en Pro. Los materiales de lanzamiento de Anthropic no indican que esté disponible en el plan gratuito.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;¿Puedo obtener acceso gratuito a la API de Claude Opus 5?&lt;/strong&gt;&lt;/p&gt;

&lt;p&gt;Solo mediante créditos de prueba para cuentas nuevas o créditos promocionales de Amazon Bedrock, Google Cloud o Microsoft Foundry. Todos tienen un saldo limitado. No existe un nivel gratuito ilimitado para la API.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;¿Cuál es la forma legítima más barata de ejecutar Opus 5 a escala?&lt;/strong&gt;&lt;/p&gt;

&lt;p&gt;Usa la API por lotes a $2.50 / $12.50, añade caché de prompts a prefijos estables de más de 512 tokens y prueba &lt;code&gt;low&lt;/code&gt; o &lt;code&gt;medium&lt;/code&gt; donde tus evaluaciones lo permitan. Mantén el modo rápido desactivado y no configures &lt;code&gt;inference_geo&lt;/code&gt; si no tienes un requisito de residencia de datos.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;¿Debo desactivar el pensamiento para ahorrar tokens?&lt;/strong&gt;&lt;/p&gt;

&lt;p&gt;No. Combinar pensamiento desactivado con esfuerzo &lt;code&gt;xhigh&lt;/code&gt; o &lt;code&gt;max&lt;/code&gt; genera un error 400. La recomendación de Anthropic es mantenerlo activado y reducir el esfuerzo.&lt;/p&gt;

&lt;p&gt;Comprueba siempre el bloque &lt;code&gt;usage&lt;/code&gt; en respuestas reales. Una solicitud guardada en &lt;a href="https://apidog.com?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt; con aserciones sobre estos campos ayuda a detectar regresiones de coste automáticamente.&lt;/p&gt;

</description>
    </item>
    <item>
      <title>Cómo usar Claude Opus 5 en Claude Code</title>
      <dc:creator>Roobia</dc:creator>
      <pubDate>Sat, 25 Jul 2026 03:25:20 +0000</pubDate>
      <link>https://dev.to/roobia/como-usar-claude-opus-5-en-claude-code-39ab</link>
      <guid>https://dev.to/roobia/como-usar-claude-opus-5-en-claude-code-39ab</guid>
      <description>&lt;p&gt;Claude Opus 5 llegó el 24 de julio de 2026 y estuvo disponible en Claude Code desde el primer día. Para suscriptores Max, es el modelo predeterminado; para usuarios Pro, es el modelo más potente disponible. Con una clave API, cuesta $5 por millón de tokens de entrada y $25 por millón de tokens de salida, igual que Opus 4.8.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation" class="crayons-btn crayons-btn--primary"&gt;Prueba Apidog hoy&lt;/a&gt;
&lt;/p&gt;

&lt;p&gt;La configuración que funcionaba bien con modelos anteriores puede aumentar innecesariamente el costo con Opus 5. Este modelo verifica su trabajo por iniciativa propia, genera respuestas más extensas y recurre a subagentes con más frecuencia que Opus 4.8. Si tu &lt;code&gt;CLAUDE.md&lt;/code&gt; también le pide verificar, explicar y delegar constantemente, esos comportamientos se amplifican.&lt;/p&gt;

&lt;p&gt;Esta guía explica cómo seleccionar el modelo, ajustar el esfuerzo y actualizar tus prompts el primer día. También muestra cómo usar &lt;a href="https://apidog.com?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt; para validar la API que Claude Code acaba de implementar. Para más contexto, consulta el &lt;a href="https://apidog.com/es/blog/what-is-claude-opus-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;resumen de Claude Opus 5&lt;/a&gt; y el &lt;a href="https://www.anthropic.com/news/claude-opus-5" rel="noopener noreferrer"&gt;anuncio de Claude Opus 5&lt;/a&gt; de Anthropic.&lt;/p&gt;

&lt;h2&gt;
  
  
  ¿Qué cambia según el nivel de suscripción?
&lt;/h2&gt;

&lt;p&gt;El acceso a Opus 5 depende de tu plan y del entorno donde lo uses.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;Suscriptores Max:&lt;/strong&gt; Opus 5 se convierte en el modelo predeterminado. No necesitas cambiar nada, pero sí conviene revisar las reglas heredadas de tu proyecto: tus expectativas sobre costo, verbosidad y delegación probablemente estaban calibradas para otro modelo.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fe4fagt60inr18epprsrx.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fe4fagt60inr18epprsrx.png" alt="Selector de modelo de Claude Opus 5" width="800" height="533"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;Suscriptores Pro:&lt;/strong&gt; Opus 5 es el modelo de mayor rendimiento disponible en este nivel. Esto cambia el techo de capacidad disponible para tareas complejas de codificación, refactorización y trabajo agéntico.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;Usuarios de clave API:&lt;/strong&gt; Opus 5 está disponible en la API de Claude, Amazon Bedrock (&lt;code&gt;anthropic.claude-opus-5&lt;/code&gt;), Google Cloud, Microsoft Foundry y GitHub Copilot. El precio es de $5 por millón de tokens de entrada y $25 por millón de salida, sin cambios frente a Opus 4.8 y la mitad de los $10/$50 de Fable 5. Consulta el &lt;a href="https://apidog.com/es/blog/claude-opus-5-pricing?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;desglose de precios de Opus 5&lt;/a&gt; para ver tarifas de caché y procesamiento por lotes.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Flvkzn3m20mynmdxrz5n2.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Flvkzn3m20mynmdxrz5n2.png" alt="Precios de Claude Opus 5" width="800" height="435"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;Opus 5 tiene una fecha de corte de conocimiento de mayo de 2026. Fable 5 y Sonnet 5 se detienen en enero de 2026. Para flujos de trabajo que dependen de SDKs, APIs y librerías recientes, esos meses adicionales pueden ser relevantes.&lt;/p&gt;

&lt;h2&gt;
  
  
  Seleccionar Opus 5 en Claude Code
&lt;/h2&gt;

&lt;p&gt;Dentro de una sesión de Claude Code, abre el selector de modelos:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;/model
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Elige &lt;strong&gt;Claude Opus 5&lt;/strong&gt; en la lista.&lt;/p&gt;

&lt;p&gt;También puedes configurarlo directamente con el ID del modelo:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;/model claude-opus-5
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Usa exactamente &lt;code&gt;claude-opus-5&lt;/code&gt; para configuraciones, automatizaciones y reglas de proyecto. No requiere sufijo de fecha ni versión.&lt;/p&gt;

&lt;p&gt;La &lt;a href="https://platform.claude.com/docs/en/about-claude/models/overview" rel="noopener noreferrer"&gt;documentación de modelos de Anthropic&lt;/a&gt; enumera los IDs específicos para plataformas como Bedrock y Google Cloud.&lt;/p&gt;

&lt;p&gt;Opus 5 ofrece hasta 1M de tokens de contexto por defecto y como máximo, sin encabezado beta ni recargo de contexto largo. La salida máxima en la API de Mensajes es de 128k tokens. Aun así, evita enviar el repositorio completo en cada turno: tener capacidad no elimina el costo ni mejora automáticamente la precisión.&lt;/p&gt;

&lt;p&gt;Para otros comandos útiles, consulta la &lt;a href="https://apidog.com/es/blog/claude-code-cheatsheet?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;hoja de trucos de Claude Code&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Cómo se comporta el esfuerzo
&lt;/h2&gt;

&lt;p&gt;El esfuerzo se configura mediante &lt;code&gt;output_config.effort&lt;/code&gt; en la API. Los niveles disponibles son:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;low
medium
high
xhigh
max
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Las interfaces visuales suelen exponer estos valores como un selector de esfuerzo.&lt;/p&gt;

&lt;h3&gt;
  
  
  1. El valor predeterminado es &lt;code&gt;high&lt;/code&gt;
&lt;/h3&gt;

&lt;p&gt;Si no indicas ningún nivel, Opus 5 usa:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"output_config"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"effort"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"high"&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;No asumas que el comportamiento predeterminado es &lt;code&gt;medium&lt;/code&gt; o adaptativo.&lt;/p&gt;

&lt;h3&gt;
  
  
  2. No reutilices tus valores de Opus 4.8
&lt;/h3&gt;

&lt;p&gt;Anthropic recomienda reevaluar los niveles de esfuerzo para Opus 5. En particular, &lt;code&gt;low&lt;/code&gt; y &lt;code&gt;medium&lt;/code&gt; son más capaces que en modelos Opus anteriores.&lt;/p&gt;

&lt;p&gt;Una forma práctica de migrar es ejecutar el mismo conjunto de tareas con varios niveles:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;low     → tareas simples, cambios localizados, clasificación
medium  → edición estándar, bugs conocidos, tareas repetibles
high    → valor predeterminado para trabajo complejo
xhigh   → codificación y flujos agénticos exigentes
max     → evaluación específica cuando el costo no sea la prioridad
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Para trabajo de codificación y tareas agénticas, Anthropic sigue recomendando comenzar con &lt;code&gt;xhigh&lt;/code&gt;.&lt;/p&gt;

&lt;h3&gt;
  
  
  3. Evita combinar pensamiento desactivado con &lt;code&gt;xhigh&lt;/code&gt; o &lt;code&gt;max&lt;/code&gt;
&lt;/h3&gt;

&lt;p&gt;Esta combinación devuelve un error 400:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"thinking"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"type"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"disabled"&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;},&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"output_config"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"effort"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"xhigh"&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;El error también ocurre con &lt;code&gt;max&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;La solución es una de estas dos:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Mantener el pensamiento activado.&lt;/li&gt;
&lt;li&gt;Limitar el esfuerzo a &lt;code&gt;high&lt;/code&gt; o menos.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;En Claude Code interactivo normalmente no verás este error porque la herramienta prepara la solicitud. Es más probable encontrarlo al usar el SDK o automatizar llamadas a la API.&lt;/p&gt;

&lt;p&gt;Además, Anthropic recomienda mantener el pensamiento activado. Con el pensamiento desactivado pueden aparecer llamadas a herramientas escritas como texto plano que no llegan a ejecutarse, así como etiquetas XML internas visibles en la salida. Controla el costo bajando el esfuerzo, no desactivando el pensamiento.&lt;/p&gt;

&lt;p&gt;La &lt;a href="https://apidog.com/es/blog/claude-opus-5-effort-parameter?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de parámetros de esfuerzo&lt;/a&gt; explica cómo evaluar los niveles, y la &lt;a href="https://apidog.com/es/blog/claude-opus-5-migration-opus-4-8?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de migración desde Opus 4.8&lt;/a&gt; cubre otros cambios relevantes.&lt;/p&gt;

&lt;h2&gt;
  
  
  Cuatro ediciones de prompts para hacer el primer día
&lt;/h2&gt;

&lt;p&gt;Estas actualizaciones reducen sobreverificación, delegación innecesaria y respuestas demasiado largas. Hazlas en el &lt;code&gt;CLAUDE.md&lt;/code&gt; global y en los archivos de proyecto.&lt;/p&gt;

&lt;p&gt;La referencia principal es la &lt;a href="https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5" rel="noopener noreferrer"&gt;guía de prompts de Opus 5&lt;/a&gt; de Anthropic.&lt;/p&gt;

&lt;h3&gt;
  
  
  1. Elimina instrucciones de verificación redundantes
&lt;/h3&gt;

&lt;p&gt;Busca reglas como estas:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;“Siempre verifica tu trabajo dos veces”.&lt;/li&gt;
&lt;li&gt;“Verifica el cambio antes de reportar”.&lt;/li&gt;
&lt;li&gt;“Confirma que las pruebas pasen y luego confirma de nuevo”.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Elimínalas si no añaden una comprobación externa concreta.&lt;/p&gt;

&lt;p&gt;Opus 5 ya verifica su trabajo sin necesitar esa instrucción. Si también le pides repetir verificaciones, puede releer archivos, volver a ejecutar comprobaciones y gastar tokens confirmando resultados ya validados.&lt;/p&gt;

&lt;p&gt;En tu &lt;code&gt;CLAUDE.md&lt;/code&gt;, busca términos como:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;verificar
doble verificación
confirmar
revisar dos veces
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Conserva únicamente las reglas que indiquen una acción verificable y externa, por ejemplo: “Ejecuta &lt;code&gt;pnpm test&lt;/code&gt; antes de finalizar”.&lt;/p&gt;

&lt;h3&gt;
  
  
  2. Limita la creación de subagentes
&lt;/h3&gt;

&lt;p&gt;Opus 5 delega con más facilidad que Opus 4.8. Esto puede acelerar investigaciones paralelas, pero también aumentar el consumo de tokens.&lt;/p&gt;

&lt;p&gt;Añade límites explícitos a las instrucciones del proyecto:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight markdown"&gt;&lt;code&gt;&lt;span class="gu"&gt;## Delegación&lt;/span&gt;

No generes subagentes para tareas que se puedan terminar en una sola pasada.
Usa como máximo dos subagentes en paralelo. Si una tarea parece necesitar
más, describe la división y pregunta antes de generar más.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;El objetivo no es bloquear la delegación, sino exigir que sea proporcional al problema. Si necesitas configurar subagentes de forma intencional, consulta la guía para &lt;a href="https://apidog.com/es/blog/create-claude-code-subagents?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;crear subagentes de Claude Code&lt;/a&gt;.&lt;/p&gt;

&lt;h3&gt;
  
  
  3. Pide concisión de forma explícita
&lt;/h3&gt;

&lt;p&gt;Opus 5 suele producir respuestas, resúmenes y documentos más largos que Opus 4.8.&lt;/p&gt;

&lt;p&gt;Bajar el esfuerzo no reduce necesariamente la longitud de la salida visible. El esfuerzo controla la profundidad del razonamiento, no el número de palabras de la respuesta final.&lt;/p&gt;

&lt;p&gt;Define el formato de salida en tus instrucciones:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight markdown"&gt;&lt;code&gt;&lt;span class="gu"&gt;## Estilo de respuesta&lt;/span&gt;

Reporta los resultados en menos de 150 palabras a menos que pida detalles.
No resumas lo que acabas de hacer si puedo ver el diff.
Omite el preámbulo. Ve directo a la respuesta.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Puedes adaptar el límite según tu flujo:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight markdown"&gt;&lt;code&gt;Para cambios de código:
&lt;span class="p"&gt;-&lt;/span&gt; Indica archivos modificados.
&lt;span class="p"&gt;-&lt;/span&gt; Explica riesgos o decisiones en un máximo de 5 viñetas.
&lt;span class="p"&gt;-&lt;/span&gt; No incluyas un resumen narrativo del diff.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;h3&gt;
  
  
  4. Restringe el alcance de tareas específicas
&lt;/h3&gt;

&lt;p&gt;Opus 5 puede ampliar el alcance de una tarea si detecta problemas relacionados. Esto es útil en refactorizaciones, pero no en correcciones pequeñas o cambios sensibles.&lt;/p&gt;

&lt;p&gt;Usa límites explícitos:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Arregla la verificación de nulos en parseConfig y no cambies nada más.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;En lugar de:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Arregla la verificación de nulos en parseConfig.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;El primer prompt define tanto el cambio esperado como el límite de intervención. Para más ejemplos reutilizables, consulta la guía de &lt;a href="https://apidog.com/es/blog/prompting-claude-opus-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;prompts para Opus 5&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Crea una API y deja que Opus 5 la pruebe
&lt;/h2&gt;

&lt;p&gt;Claude Code puede generar rutas, controladores y validaciones, pero no puede asumir que un endpoint en ejecución cumple el contrato. La validación externa sigue siendo necesaria.&lt;/p&gt;

&lt;p&gt;Un flujo práctico es:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Diseña endpoints y esquemas de solicitud y respuesta en &lt;a href="https://apidog.com?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt;.&lt;/li&gt;
&lt;li&gt;Configura un servidor mock con respuestas realistas.&lt;/li&gt;
&lt;li&gt;Conecta el servidor Apidog MCP para que Opus 5 consulte la especificación real.&lt;/li&gt;
&lt;li&gt;Pide a Claude Code que implemente la ruta según ese contrato.&lt;/li&gt;
&lt;li&gt;Ejecuta el escenario de prueba cuando termine.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Por ejemplo:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;apidog run &lt;span class="nt"&gt;--access-token&lt;/span&gt; &lt;span class="nv"&gt;$APIDOG_TOKEN&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--project-id&lt;/span&gt; &lt;span class="nv"&gt;$PROJECT_ID&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--test-scenario&lt;/span&gt; &lt;span class="s2"&gt;"user-signup-flow"&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Las aserciones fallidas vuelven como salida que el modelo puede leer y corregir. Esto crea un bucle de validación basado en el comportamiento real de la API, no solo en el razonamiento interno del modelo.&lt;/p&gt;

&lt;p&gt;También puedes usar Apidog al integrar la API de Claude directamente en tu aplicación:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Enviar solicitudes a &lt;code&gt;claude-opus-5&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Inspeccionar eventos de streaming SSE.&lt;/li&gt;
&lt;li&gt;Revisar cargas útiles de llamadas a herramientas.&lt;/li&gt;
&lt;li&gt;Guardar la clave API como variable de entorno.&lt;/li&gt;
&lt;li&gt;Comparar el mismo prompt con distintos niveles de esfuerzo.&lt;/li&gt;
&lt;li&gt;Inspeccionar el bloque &lt;code&gt;usage&lt;/code&gt; para confirmar aciertos de caché.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;a href="https://apidog.com/download?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Descarga Apidog&lt;/a&gt; para configurar el proyecto localmente.&lt;/p&gt;

&lt;h2&gt;
  
  
  El límite honesto
&lt;/h2&gt;

&lt;p&gt;Opus 5 no es el modelo más alto de toda la pila de Claude.&lt;/p&gt;

&lt;p&gt;Fable 5 mantiene la designación de Anthropic como “el más capaz ampliamente lanzado”. Opus 5 también queda por detrás de Mythos 5 en explotación de ciberseguridad e investigación de biología autónoma, según las afirmaciones de Anthropic.&lt;/p&gt;

&lt;p&gt;Si tu carga de trabajo está en esas áreas, Opus 5 no es necesariamente el modelo adecuado. Consulta el &lt;a href="https://apidog.com/es/blog/mythos-class-model-explained?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;explicador de modelos de clase Mythos&lt;/a&gt; para entender ese nivel de capacidad.&lt;/p&gt;

&lt;p&gt;Sobre benchmarks, Anthropic informa que Opus 5:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Más que duplica la puntuación de Frontier-Bench v0.1 de Opus 4.8.&lt;/li&gt;
&lt;li&gt;Obtiene aproximadamente tres veces la puntuación del siguiente mejor modelo en ARC-AGI 3.&lt;/li&gt;
&lt;li&gt;Se acerca a 0.5% del pico de CursorBench 3.2 de Fable 5 a la mitad del precio.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Son métricas proporcionadas por el proveedor. Al 25 de julio de 2026, no habían sido reproducidas de forma independiente. Úsalas como motivo para ejecutar tu propia evaluación, no como resultado definitivo.&lt;/p&gt;

&lt;h2&gt;
  
  
  Cuándo usar otra cosa
&lt;/h2&gt;

&lt;p&gt;Usa Opus 5 para la mayoría del trabajo en Claude Code:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Codificación agéntica.&lt;/li&gt;
&lt;li&gt;Refactorizaciones de varios archivos.&lt;/li&gt;
&lt;li&gt;Tareas largas con lectura de comandos y salida de herramientas.&lt;/li&gt;
&lt;li&gt;Problemas que requieren varios ciclos de implementación y prueba.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Considera otro modelo cuando:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;El volumen sea alto y el costo sea el factor principal.&lt;/li&gt;
&lt;li&gt;Sonnet 5 pueda resolver edición estándar a menor precio.&lt;/li&gt;
&lt;li&gt;El problema pertenezca al territorio de Fable 5 o Mythos 5.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;El cambio de modelo es un solo comando:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;/model claude-sonnet-5
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Para tareas económicas.&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;/model claude-opus-5
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Para tareas complejas.&lt;/p&gt;

&lt;p&gt;Si ya usaste &lt;a href="https://apidog.com/es/blog/claude-sonnet-5-claude-code?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Sonnet 5 en Claude Code&lt;/a&gt; o &lt;a href="https://apidog.com/es/blog/claude-fable-5-claude-code?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Fable 5 en Claude Code&lt;/a&gt;, el flujo de trabajo será familiar.&lt;/p&gt;

&lt;h2&gt;
  
  
  Consejos prácticos
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Audita primero &lt;code&gt;CLAUDE.md&lt;/code&gt;.&lt;/strong&gt; Elimina instrucciones de verificación redundantes, añade límites de longitud y restringe la delegación.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Reevalúa el esfuerzo.&lt;/strong&gt; Los valores que usabas en Opus 4.8 no son una referencia fiable para Opus 5.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Mantén el pensamiento activado.&lt;/strong&gt; Ajusta el costo mediante &lt;code&gt;effort&lt;/code&gt;, no mediante &lt;code&gt;thinking: disabled&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Delimita el contexto.&lt;/strong&gt; Un millón de tokens es capacidad disponible, no una razón para enviar todo el repositorio en cada turno.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Verifica externamente.&lt;/strong&gt; Una prueba fallida contra un contrato real aporta más señal que una autoevaluación del modelo.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Preguntas frecuentes
&lt;/h2&gt;

&lt;p&gt;&lt;strong&gt;¿Está Claude Opus 5 disponible en Claude Code?&lt;/strong&gt;&lt;/p&gt;

&lt;p&gt;Sí, desde su lanzamiento el 24 de julio de 2026. Selecciónalo con &lt;code&gt;/model&lt;/code&gt; o usa directamente:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;/model claude-opus-5
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Es el modelo predeterminado para suscriptores Max y el modelo de mayor rendimiento para suscriptores Pro.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;¿Necesito cambiar mi &lt;a href="http://CLAUDE.md" rel="noopener noreferrer"&gt;&lt;code&gt;CLAUDE.md&lt;/code&gt;&lt;/a&gt;?&lt;/strong&gt;&lt;/p&gt;

&lt;p&gt;Probablemente. Anthropic indica que las instrucciones heredadas de verificación pueden causar sobreverificación en Opus 5. Elimina las reglas redundantes, añade límites de concisión y define cuántos subagentes puede crear.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;¿Por qué reducir el esfuerzo no hizo las respuestas más cortas?&lt;/strong&gt;&lt;/p&gt;

&lt;p&gt;Porque el esfuerzo controla la profundidad del pensamiento, no la longitud de la respuesta visible. Si quieres una salida corta, indícalo explícitamente en el prompt o en &lt;code&gt;CLAUDE.md&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;¿Qué causa un error 400 al configurar el esfuerzo en &lt;code&gt;xhigh&lt;/code&gt;?&lt;/strong&gt;&lt;/p&gt;

&lt;p&gt;Combinar:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"thinking"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"type"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"disabled"&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;},&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"output_config"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"effort"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"xhigh"&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;devuelve un error 400 en Opus 5. Activa el pensamiento o limita el esfuerzo a &lt;code&gt;high&lt;/code&gt;. Consulta la &lt;a href="https://apidog.com/es/blog/claude-opus-5-migration-opus-4-8?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de migración&lt;/a&gt; para más cambios desde Opus 4.8.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;¿Puedo usar Opus 5 en Claude Code con un plan gratuito?&lt;/strong&gt;&lt;/p&gt;

&lt;p&gt;Opus 5 está disponible mediante suscripciones Pro y Max, además de la API. Pro ofrece acceso al modelo como opción superior de ese nivel, mientras que Max lo usa como predeterminado. Consulta la &lt;a href="https://apidog.com/es/blog/claude-opus-5-free?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de acceso gratuito a Opus 5&lt;/a&gt; para conocer las rutas disponibles y las opciones de pago más económicas.&lt;/p&gt;

</description>
    </item>
    <item>
      <title>Claude Opus 5 Benchmarks: Qué revelan los números</title>
      <dc:creator>Roobia</dc:creator>
      <pubDate>Sat, 25 Jul 2026 03:23:31 +0000</pubDate>
      <link>https://dev.to/roobia/claude-opus-5-benchmarks-que-revelan-los-numeros-4f7</link>
      <guid>https://dev.to/roobia/claude-opus-5-benchmarks-que-revelan-los-numeros-4f7</guid>
      <description>&lt;p&gt;Anthropic lanzó Claude Opus 5 el 24 de julio de 2026 con afirmaciones de rendimiento llamativas: más del doble de Opus 4.8 en una evaluación, aproximadamente tres veces la puntuación del siguiente mejor modelo en otra y una victoria sobre Fable 5 a un tercio del coste en una tercera.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation" class="crayons-btn crayons-btn--primary"&gt;Prueba Apidog hoy&lt;/a&gt;
&lt;/p&gt;

&lt;p&gt;Eso no implica que las afirmaciones sean incorrectas. Significa que debe interpretarlas como cualquier gráfico de lanzamiento de un proveedor: revise qué se midió, contra qué modelo, con qué configuración y qué datos faltan. Esta guía reúne las afirmaciones publicadas de Opus 5, explica qué puede respaldar cada cifra y termina con un plan de evaluación que puede ejecutar en &lt;a href="https://apidog.com?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;Para conocer el modelo (&lt;code&gt;claude-opus-5&lt;/code&gt;, contexto de 1M, salida máxima de 128k y corte de conocimiento de mayo de 2026), consulte &lt;a href="https://apidog.com/es/blog/what-is-claude-opus-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;qué es Claude Opus 5&lt;/a&gt;. La fuente principal de las cifras es la &lt;a href="https://www.anthropic.com/news/claude-opus-5" rel="noopener noreferrer"&gt;publicación de lanzamiento de Claude Opus 5&lt;/a&gt; de Anthropic.&lt;/p&gt;

&lt;h2&gt;
  
  
  Todas las afirmaciones publicadas, en una tabla
&lt;/h2&gt;

&lt;p&gt;La columna de comparación es tan importante como el resultado. Varias afirmaciones se presentan como una relación frente a otro modelo, no como una puntuación absoluta.&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Benchmark&lt;/th&gt;
&lt;th&gt;Afirmación de Anthropic&lt;/th&gt;
&lt;th&gt;Expresado como&lt;/th&gt;
&lt;th&gt;Comparado con&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Frontier-Bench v0.1&lt;/td&gt;
&lt;td&gt;Supera a todos los demás modelos; más del doble de la puntuación de Opus 4.8, con un coste por tarea menor&lt;/td&gt;
&lt;td&gt;Proporción y afirmación de coste&lt;/td&gt;
&lt;td&gt;Opus 4.8 y el campo&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;ARC-AGI 3&lt;/td&gt;
&lt;td&gt;Aproximadamente 3 veces la puntuación del siguiente mejor modelo&lt;/td&gt;
&lt;td&gt;Proporción&lt;/td&gt;
&lt;td&gt;Siguiente mejor modelo sin nombre&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;OSWorld 2.0&lt;/td&gt;
&lt;td&gt;Supera a Fable 5 a un tercio del coste&lt;/td&gt;
&lt;td&gt;Posición y afirmación de coste&lt;/td&gt;
&lt;td&gt;Fable 5&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;CursorBench 3.2&lt;/td&gt;
&lt;td&gt;Dentro del 0.5% del pico de Fable 5, a mitad de precio&lt;/td&gt;
&lt;td&gt;Brecha y afirmación de coste&lt;/td&gt;
&lt;td&gt;Fable 5&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Zapier AutomationBench&lt;/td&gt;
&lt;td&gt;Tasa de aprobación aproximadamente 1.5 veces la del siguiente mejor modelo&lt;/td&gt;
&lt;td&gt;Proporción&lt;/td&gt;
&lt;td&gt;Siguiente mejor modelo sin nombre&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Química orgánica&lt;/td&gt;
&lt;td&gt;+10.2 puntos sobre Opus 4.8&lt;/td&gt;
&lt;td&gt;Diferencia absoluta&lt;/td&gt;
&lt;td&gt;Opus 4.8&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Análisis de proteínas&lt;/td&gt;
&lt;td&gt;+7.7 puntos sobre Opus 4.8&lt;/td&gt;
&lt;td&gt;Diferencia absoluta&lt;/td&gt;
&lt;td&gt;Opus 4.8&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Explotación de ciberseguridad&lt;/td&gt;
&lt;td&gt;Por detrás de Mythos 5&lt;/td&gt;
&lt;td&gt;Posición&lt;/td&gt;
&lt;td&gt;Mythos 5&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Investigación biológica autónoma&lt;/td&gt;
&lt;td&gt;Por detrás de Mythos 5&lt;/td&gt;
&lt;td&gt;Posición&lt;/td&gt;
&lt;td&gt;Mythos 5&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;Fuente: publicación de lanzamiento y documentación del modelo de Anthropic. Al momento de escribir este artículo, ningún tercero había publicado una reproducción de estos resultados.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fassets.apidog.com%2Fblog-next%2F2026%2F07%2Fimage-249.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fassets.apidog.com%2Fblog-next%2F2026%2F07%2Fimage-249.png" alt="" width="800" height="793"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;Antes de interpretar cada fila, tenga en cuenta dos puntos:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Solo dos de las nueve afirmaciones muestran una mejora absoluta en puntos.&lt;/li&gt;
&lt;li&gt;Anthropic incluye dos casos en los que su nuevo modelo insignia pierde.&lt;/li&gt;
&lt;/ol&gt;

&lt;h2&gt;
  
  
  El problema de las proporciones
&lt;/h2&gt;

&lt;p&gt;Cuatro afirmaciones —Frontier-Bench, ARC-AGI 3, AutomationBench y, en parte, CursorBench— se expresan como proporciones o brechas. Eso limita lo que puede concluir.&lt;/p&gt;

&lt;h3&gt;
  
  
  Una proporción oculta el denominador
&lt;/h3&gt;

&lt;p&gt;Decir que Opus 5 logra “aproximadamente 3 veces” la puntuación del siguiente mejor modelo en ARC-AGI 3 no indica la puntuación real.&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Si el siguiente modelo obtiene un 8%, tres veces equivale a un 24%.&lt;/li&gt;
&lt;li&gt;Si obtiene un 25%, tres veces equivale a un 75%.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Ambos casos pueden describirse como “3 veces”, pero representan avances muy distintos. Anthropic no publicó el valor de referencia.&lt;/p&gt;

&lt;h3&gt;
  
  
  Duplicar puede implicar un salto absoluto pequeño
&lt;/h3&gt;

&lt;p&gt;“Más del doble de la puntuación de Opus 4.8” en Frontier-Bench v0.1 plantea el mismo problema.&lt;/p&gt;

&lt;p&gt;En un benchmark difícil y nuevo donde Opus 4.8 parte de una puntuación de un solo dígito, duplicar puede ser una mejora absoluta relativamente limitada. Si Opus 4.8 ya obtuviera un 40%, duplicar sería extraordinario.&lt;/p&gt;

&lt;p&gt;La versión &lt;code&gt;v0.1&lt;/code&gt; también importa: es un benchmark nuevo, sin historial publicado, sin reproducciones comunitarias y sin un punto de saturación conocido.&lt;/p&gt;

&lt;h3&gt;
  
  
  “El siguiente mejor modelo” no está identificado
&lt;/h3&gt;

&lt;p&gt;Dos afirmaciones comparan Opus 5 con un modelo no especificado. Podría ser Fable 5, Mythos 5 u otro modelo. Sin conocer el competidor, no puede evaluar correctamente el significado de la proporción.&lt;/p&gt;

&lt;h3&gt;
  
  
  Las brechas necesitan unidades claras
&lt;/h3&gt;

&lt;p&gt;“Dentro del 0.5% del pico de Fable 5” en CursorBench 3.2 deja preguntas abiertas:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;¿Es una diferencia de 0.5 puntos porcentuales?&lt;/li&gt;
&lt;li&gt;¿Es una diferencia relativa del 0.5%?&lt;/li&gt;
&lt;li&gt;¿“Pico” significa una ejecución con la configuración más agresiva?&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;En benchmarks de programación, el nivel de &lt;code&gt;effort&lt;/code&gt; puede cambiar de forma importante el resultado. Consulte el &lt;a href="https://apidog.com/es/blog/claude-fable-5-benchmarks?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;desglose de los benchmarks de Fable 5&lt;/a&gt; para ver cómo se presentaron las cifras de ese modelo.&lt;/p&gt;

&lt;p&gt;Las dos afirmaciones científicas son más interpretables porque usan diferencias absolutas:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;code&gt;+10.2&lt;/code&gt; puntos en química orgánica.&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;+7.7&lt;/code&gt; puntos en análisis de proteínas.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Aun así, las puntuaciones base no se publicaron.&lt;/p&gt;

&lt;h2&gt;
  
  
  Las afirmaciones de coste por tarea dependen de la configuración
&lt;/h2&gt;

&lt;p&gt;Anthropic combina capacidad y coste en tres afirmaciones:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Menor coste por tarea en Frontier-Bench.&lt;/li&gt;
&lt;li&gt;Un tercio del coste en OSWorld 2.0.&lt;/li&gt;
&lt;li&gt;Mitad de precio en CursorBench 3.2.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;La comparación de precio de lista sí es verificable:&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Modelo&lt;/th&gt;
&lt;th&gt;Entrada por millón de tokens&lt;/th&gt;
&lt;th&gt;Salida por millón de tokens&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Opus 5&lt;/td&gt;
&lt;td&gt;$5&lt;/td&gt;
&lt;td&gt;$25&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Opus 4.8&lt;/td&gt;
&lt;td&gt;$5&lt;/td&gt;
&lt;td&gt;$25&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Fable 5&lt;/td&gt;
&lt;td&gt;$10&lt;/td&gt;
&lt;td&gt;$50&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;Opus 5 cuesta la mitad que Fable 5 en precio de lista. Anthropic publica estas tarifas en su &lt;a href="https://platform.claude.com/docs/en/about-claude/pricing" rel="noopener noreferrer"&gt;página de precios&lt;/a&gt;. Para caché, lotes y modo rápido, consulte el &lt;a href="https://apidog.com/es/blog/claude-opus-5-pricing?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;desglose de precios de Opus 5&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;Sin embargo, el coste por &lt;em&gt;tarea&lt;/em&gt; depende de la ejecución concreta:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Nivel de esfuerzo configurado.&lt;/li&gt;
&lt;li&gt;Uso de pensamiento.&lt;/li&gt;
&lt;li&gt;Número de turnos del flujo agéntico.&lt;/li&gt;
&lt;li&gt;Cantidad de subagentes generados.&lt;/li&gt;
&lt;li&gt;Lecturas y escrituras de caché.&lt;/li&gt;
&lt;li&gt;Longitud de la salida.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;La guía de prompts de Anthropic indica que Opus 5 genera respuestas predeterminadas más largas que Opus 4.8, delega con más facilidad a subagentes y puede ampliar el alcance de una tarea. Cada factor puede aumentar el consumo real de tokens.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fassets.apidog.com%2Fblog-next%2F2026%2F07%2Fimage-250.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fassets.apidog.com%2Fblog-next%2F2026%2F07%2Fimage-250.png" alt="" width="800" height="450"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;La conclusión práctica es simple: el precio de lista es estable, pero el coste por tarea es específico de su configuración. La &lt;a href="https://apidog.com/es/blog/claude-opus-5-vs-fable-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;comparación de Opus 5 vs Fable 5&lt;/a&gt; detalla dónde se paga esa diferencia. Para su caso, debe medirlo.&lt;/p&gt;

&lt;h2&gt;
  
  
  El techo que Anthropic se impone a sí mismo
&lt;/h2&gt;

&lt;p&gt;La afirmación más útil del lanzamiento no es una victoria: Anthropic indica que Opus 5 sigue por detrás de &lt;strong&gt;Mythos 5&lt;/strong&gt; en explotación de ciberseguridad e investigación biológica autónoma.&lt;/p&gt;

&lt;p&gt;Fable 5 también conserva la designación de “modelo más capaz ampliamente lanzado”.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fassets.apidog.com%2Fblog-next%2F2026%2F07%2Fimage-251.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fassets.apidog.com%2Fblog-next%2F2026%2F07%2Fimage-251.png" alt="" width="800" height="450"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;El resumen técnico es:&lt;/p&gt;

&lt;blockquote&gt;
&lt;p&gt;Capacidad de clase fronteriza a la mitad del precio fronterizo, con un modelo superior identificado para algunas tareas.&lt;/p&gt;
&lt;/blockquote&gt;

&lt;p&gt;Para investigación de seguridad fronteriza o trabajo científico autónomo, la referencia sigue siendo la clase Mythos. Consulte la &lt;a href="https://apidog.com/es/blog/mythos-class-model-explained?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;explicación del modelo de clase Mythos&lt;/a&gt; y &lt;a href="https://apidog.com/es/blog/fable-5-vs-mythos-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Fable 5 vs Mythos 5&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;También hay una implicación operativa. Anthropic incorporó &lt;code&gt;fallbacks: "default"&lt;/code&gt; detrás del encabezado beta &lt;code&gt;server-side-fallback-2026-07-01&lt;/code&gt;. Esta opción recurre automáticamente a Opus 4.8 cuando Opus 5 rechaza una solicitud de categoría cibernética.&lt;/p&gt;

&lt;p&gt;La existencia de ese mecanismo indica que debe medir los rechazos por separado, no solo la calidad de las respuestas aceptadas.&lt;/p&gt;

&lt;h2&gt;
  
  
  Lo que los benchmarks no cubren
&lt;/h2&gt;

&lt;p&gt;Los benchmarks miden finalización de tareas. No miden varios comportamientos que pueden determinar si el modelo funciona en producción.&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Desviación de comportamiento durante la migración.&lt;/strong&gt; Opus 5 verifica su propio trabajo sin que se lo pida. Si sus prompts heredados incluyen instrucciones como “revisa tu respuesta”, puede provocar sobreverificación y gasto adicional. La &lt;a href="https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5" rel="noopener noreferrer"&gt;guía de prompts de Anthropic para Opus 5&lt;/a&gt; recomienda eliminar estas instrucciones.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Longitud de salida.&lt;/strong&gt; Las respuestas y entregables predeterminados son más largos que en Opus 4.8. Reducir &lt;code&gt;effort&lt;/code&gt; reduce los tokens de pensamiento, no necesariamente la longitud visible. Solicite concisión de forma explícita.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Fallos con pensamiento deshabilitado.&lt;/strong&gt; Con &lt;code&gt;thinking: {type: "disabled"}&lt;/code&gt;, las llamadas a herramientas pueden aparecer ocasionalmente como texto sin formato en lugar de ejecutarse. En flujos agénticos, ese texto puede contaminar turnos posteriores. También pueden filtrarse etiquetas XML internas.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Recalibración de esfuerzo.&lt;/strong&gt; Anthropic recalibró los niveles de esfuerzo en Opus 5. No copie directamente la configuración de Opus 4.8: vuelva a evaluar &lt;code&gt;low&lt;/code&gt;, &lt;code&gt;medium&lt;/code&gt;, &lt;code&gt;high&lt;/code&gt; y &lt;code&gt;xhigh&lt;/code&gt;. Consulte la &lt;a href="https://apidog.com/es/blog/claude-opus-5-effort-parameter?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía del parámetro de esfuerzo&lt;/a&gt;.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Errores 400 de migración.&lt;/strong&gt; Combinar &lt;code&gt;thinking: {type: "disabled"}&lt;/code&gt; con &lt;code&gt;xhigh&lt;/code&gt; o &lt;code&gt;max&lt;/code&gt; devuelve un error HTTP 400 por solicitud. Es un detalle de integración, no de capacidad. Está cubierto en la &lt;a href="https://apidog.com/es/blog/claude-opus-5-migration-opus-4-8?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de migración de Opus 4.8 a Opus 5&lt;/a&gt;.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Qué probar usted mismo
&lt;/h2&gt;

&lt;p&gt;Los benchmarks del proveedor son una hipótesis inicial. Para validar Opus 5 en su carga de trabajo, ejecute esta evaluación compacta.&lt;/p&gt;

&lt;h3&gt;
  
  
  1. Cree un conjunto de tareas reales
&lt;/h3&gt;

&lt;p&gt;Seleccione entre 20 y 50 tareas de su propio historial:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Tickets cerrados.&lt;/li&gt;
&lt;li&gt;Pull requests fusionadas.&lt;/li&gt;
&lt;li&gt;Incidencias de soporte.&lt;/li&gt;
&lt;li&gt;Consultas internas.&lt;/li&gt;
&lt;li&gt;Flujos que hoy resuelve otro modelo.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Use entradas reales. Conservan su formato, ambigüedad y casos extremos.&lt;/p&gt;

&lt;h3&gt;
  
  
  2. Fije la configuración
&lt;/h3&gt;

&lt;p&gt;Registre la configuración exacta de cada ejecución:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"model"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"claude-opus-5"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"max_tokens"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="mi"&gt;8192&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"output_config"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"effort"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"medium"&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;},&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"thinking"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"type"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"enabled"&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Anote si el pensamiento está activado, el valor de &lt;code&gt;max_tokens&lt;/code&gt;, el nivel de &lt;code&gt;output_config.effort&lt;/code&gt;, el conjunto de herramientas y la versión del prompt. Sin una configuración fija, no habrá comparación válida.&lt;/p&gt;

&lt;h3&gt;
  
  
  3. Calcule el coste por tarea resuelta
&lt;/h3&gt;

&lt;p&gt;No compare solo coste por token. Calcule:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;coste por tarea resuelta =
  gasto total de las ejecuciones /
  número de tareas que pasan la verificación de aceptación
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Para cada respuesta, registre el bloque &lt;code&gt;usage&lt;/code&gt;:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Tokens de entrada.&lt;/li&gt;
&lt;li&gt;Tokens de salida.&lt;/li&gt;
&lt;li&gt;Lecturas de caché.&lt;/li&gt;
&lt;li&gt;Escrituras de caché.&lt;/li&gt;
&lt;li&gt;Coste total.&lt;/li&gt;
&lt;li&gt;Estado de aceptación de la tarea.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Ese es el indicador que intenta resumir el gráfico de coste por tarea de Anthropic.&lt;/p&gt;

&lt;h3&gt;
  
  
  4. Ejecute un barrido de esfuerzo
&lt;/h3&gt;

&lt;p&gt;Mantenga el mismo conjunto de tareas y pruebe:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;low → medium → high → xhigh
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;No transfiera directamente la configuración de Opus 4.8. Anthropic indica que &lt;code&gt;low&lt;/code&gt; y &lt;code&gt;medium&lt;/code&gt; son significativamente más fuertes en Opus 5 que en modelos Opus anteriores.&lt;/p&gt;

&lt;p&gt;Para cada nivel, compare:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Tasa de tareas resueltas.&lt;/li&gt;
&lt;li&gt;Coste por tarea resuelta.&lt;/li&gt;
&lt;li&gt;Latencia.&lt;/li&gt;
&lt;li&gt;Número de turnos.&lt;/li&gt;
&lt;li&gt;Tokens de entrada y salida.&lt;/li&gt;
&lt;li&gt;Errores y rechazos.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Controle especialmente &lt;code&gt;max_tokens&lt;/code&gt; en los niveles superiores.&lt;/p&gt;

&lt;h3&gt;
  
  
  5. Evalúe el bucle agéntico completo
&lt;/h3&gt;

&lt;p&gt;Gran parte de los benchmarks de lanzamiento son agénticos: OSWorld, CursorBench y AutomationBench. Un prompt de turno único no reproduce ese escenario.&lt;/p&gt;

&lt;p&gt;Conecte sus herramientas reales y mida:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Número de turnos.&lt;/li&gt;
&lt;li&gt;Llamadas a herramientas emitidas.&lt;/li&gt;
&lt;li&gt;Llamadas ejecutadas correctamente.&lt;/li&gt;
&lt;li&gt;Reintentos.&lt;/li&gt;
&lt;li&gt;Resultado final.&lt;/li&gt;
&lt;li&gt;Coste acumulado.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  6. Compare con su modelo actual
&lt;/h3&gt;

&lt;p&gt;Ejecute el mismo arnés contra el modelo que usa hoy: Opus 4.8, Sonnet 5 u otro. Mantenga iguales los prompts, las herramientas, las condiciones de aceptación y el conjunto de tareas.&lt;/p&gt;

&lt;p&gt;Un resultado relativo en sus propios datos es más útil que una puntuación absoluta en datos ajenos.&lt;/p&gt;

&lt;h3&gt;
  
  
  7. Registre los rechazos por separado
&lt;/h3&gt;

&lt;p&gt;En cargas relacionadas con ciberseguridad, Opus 5 puede rechazar más solicitudes que 4.8. No mezcle estos casos con fallos de calidad o errores de herramientas.&lt;/p&gt;

&lt;p&gt;Registre al menos:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;tarea_id
modelo
effort
resultado
rechazada
motivo_del_rechazo
fallback_activado
coste_total
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Para una metodología similar, consulte el &lt;a href="https://apidog.com/es/blog/claude-sonnet-5-benchmarks?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;artículo sobre los benchmarks de Sonnet 5&lt;/a&gt; y la &lt;a href="https://apidog.com/es/blog/claude-opus-5-api?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de la API de Opus 5&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Ejecutando la evaluación en Apidog
&lt;/h2&gt;

&lt;p&gt;La evaluación consiste en solicitudes HTTP autenticadas, cuerpos JSON, respuestas de transmisión y bloques &lt;code&gt;usage&lt;/code&gt; que debe inspeccionar en cada ejecución. &lt;a href="https://apidog.com?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt; puede centralizar ese flujo de trabajo.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fassets.apidog.com%2Fblog-next%2F2026%2F07%2Fimage-252.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fassets.apidog.com%2Fblog-next%2F2026%2F07%2Fimage-252.png" alt="" width="799" height="530"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;Configure la evaluación de esta forma:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Cree una solicitud al endpoint de mensajes de Anthropic.&lt;/li&gt;
&lt;li&gt;Guarde la clave de API como variable de entorno; no la pegue en el cuerpo de la solicitud.&lt;/li&gt;
&lt;li&gt;Duplique la solicitud para cada nivel de esfuerzo: &lt;code&gt;low&lt;/code&gt;, &lt;code&gt;medium&lt;/code&gt;, &lt;code&gt;high&lt;/code&gt; y &lt;code&gt;xhigh&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Mantenga fijo el prompt, las herramientas y &lt;code&gt;max_tokens&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Active streaming cuando necesite inspeccionar los eventos SSE.&lt;/li&gt;
&lt;li&gt;Verifique que las llamadas a herramientas sean estructuradas y no texto descriptivo.&lt;/li&gt;
&lt;li&gt;Añada aserciones sobre los campos &lt;code&gt;usage&lt;/code&gt; para capturar tokens y caché en cada ejecución.&lt;/li&gt;
&lt;li&gt;Guarde las solicitudes en una colección para reutilizarlas en futuras migraciones.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Solicitud base:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;curl https://api.anthropic.com/v1/messages &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--header&lt;/span&gt; &lt;span class="s2"&gt;"x-api-key: &lt;/span&gt;&lt;span class="nv"&gt;$ANTHROPIC_API_KEY&lt;/span&gt;&lt;span class="s2"&gt;"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--header&lt;/span&gt; &lt;span class="s2"&gt;"anthropic-version: 2023-06-01"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--header&lt;/span&gt; &lt;span class="s2"&gt;"content-type: application/json"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--data&lt;/span&gt; &lt;span class="s1"&gt;'{
    "model": "claude-opus-5",
    "max_tokens": 8192,
    "output_config": {"effort": "medium"},
    "messages": [
      {"role": "user", "content": "Fix the failing test in this diff."}
    ]
  }'&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Cambie un solo campo por ejecución, mantenga el resto fijo y registre &lt;code&gt;usage&lt;/code&gt; cada vez. &lt;a href="https://apidog.com/download?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Descargue Apidog&lt;/a&gt; si quiere seguir este patrón con entornos y aserciones.&lt;/p&gt;

&lt;h2&gt;
  
  
  El resumen honesto
&lt;/h2&gt;

&lt;p&gt;La historia de benchmarks de Opus 5 es sólida según las cifras de Anthropic: el mayor salto sobre su predecesor que la empresa afirma para un lanzamiento de Opus, sin cambio de precio de lista.&lt;/p&gt;

&lt;p&gt;Al mismo tiempo:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Los resultados los reporta el proveedor.&lt;/li&gt;
&lt;li&gt;No estaban reproducidos de forma independiente al 25 de julio de 2026.&lt;/li&gt;
&lt;li&gt;Muchas afirmaciones usan proporciones que no muestran el denominador.&lt;/li&gt;
&lt;li&gt;El coste por tarea depende de una configuración específica.&lt;/li&gt;
&lt;li&gt;Anthropic identifica límites frente a Mythos 5 en seguridad y ciencia autónoma.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Use la tabla de este artículo como la hipótesis de Anthropic sobre su modelo. Después, ejecute la evaluación sobre sus tareas, su configuración y sus criterios de aceptación. La diferencia entre un gráfico de lanzamiento y una carga de trabajo de producción es donde realmente se decide una migración de modelo.&lt;/p&gt;

&lt;p&gt;La &lt;a href="https://apidog.com/es/blog/what-is-claude-opus-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía fundamental de Opus 5&lt;/a&gt; cubre el resto de los cambios.&lt;/p&gt;

&lt;h2&gt;
  
  
  Preguntas frecuentes
&lt;/h2&gt;

&lt;h3&gt;
  
  
  ¿Los benchmarks de Claude Opus 5 están verificados de forma independiente?
&lt;/h3&gt;

&lt;p&gt;No. A partir del 25 de julio de 2026, todos los resultados de benchmark publicados de Opus 5 provienen de Anthropic. Ningún laboratorio de terceros o evaluador independiente había publicado una reproducción. Interprételos como cifras reportadas por el proveedor.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Cuál es la afirmación de benchmark más grande de Opus 5?
&lt;/h3&gt;

&lt;p&gt;Frontier-Bench v0.1. Anthropic afirma que Opus 5 supera en más del doble la puntuación de Opus 4.8 con un coste por tarea menor. No publicó las puntuaciones subyacentes, solo la proporción, y Frontier-Bench v0.1 es un benchmark nuevo sin historial establecido.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Es Claude Opus 5 el modelo Claude más capaz?
&lt;/h3&gt;

&lt;p&gt;No. Fable 5 conserva la designación de “el modelo más capaz ampliamente lanzado”, y Anthropic afirma que Opus 5 sigue por detrás de Mythos 5 en explotación de ciberseguridad e investigación biológica autónoma. La propuesta de Opus 5 es capacidad de clase fronteriza a la mitad del precio de Fable 5, no la cima de la pila.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Cuánto mejor es Opus 5 que Opus 4.8 en tareas científicas?
&lt;/h3&gt;

&lt;p&gt;Anthropic informa &lt;code&gt;+10.2&lt;/code&gt; puntos en química orgánica y &lt;code&gt;+7.7&lt;/code&gt; puntos en análisis de proteínas sobre Opus 4.8. Son las dos afirmaciones expresadas como diferencias absolutas, no como proporciones, aunque las puntuaciones base no se publicaron.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Opus 5 supera a Fable 5?
&lt;/h3&gt;

&lt;p&gt;Según los números de Anthropic, supera a Fable 5 en OSWorld 2.0 a un tercio del coste y se sitúa dentro del 0.5% del pico de Fable 5 en CursorBench 3.2 a mitad de precio. Fable 5 conserva la designación de capacidad general. Consulte la &lt;a href="https://apidog.com/es/blog/claude-opus-5-vs-fable-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;comparación completa&lt;/a&gt;.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Qué debería comparar yo mismo?
&lt;/h3&gt;

&lt;p&gt;El coste por tarea resuelta sobre 20 a 50 tareas reales de su propio historial. Ejecute cada tarea en varios niveles de esfuerzo, con sus herramientas reales conectadas y flujos multiturno habilitados. Compare el resultado con el modelo que usa hoy mediante el mismo arnés.&lt;/p&gt;

</description>
    </item>
    <item>
      <title>Parámetro de Esfuerzo de Claude Opus 5: Compensación entre Costo y Capacidad</title>
      <dc:creator>Roobia</dc:creator>
      <pubDate>Sat, 25 Jul 2026 03:19:34 +0000</pubDate>
      <link>https://dev.to/roobia/parametro-de-esfuerzo-de-claude-opus-5-compensacion-entre-costo-y-capacidad-1le4</link>
      <guid>https://dev.to/roobia/parametro-de-esfuerzo-de-claude-opus-5-compensacion-entre-costo-y-capacidad-1le4</guid>
      <description>&lt;p&gt;Cada artículo principal sobre el &lt;a href="https://www.anthropic.com/news/claude-opus-5" rel="noopener noreferrer"&gt;lanzamiento de Claude Opus 5&lt;/a&gt; el 24 de julio de 2026 mencionó la posibilidad de alternar entre costo y capacidad. Lo importante para quienes integran la API es el parámetro de solicitud &lt;code&gt;effort&lt;/code&gt;: tiene cinco niveles en Opus 5, su valor predeterminado es &lt;code&gt;high&lt;/code&gt; y afecta directamente el razonamiento interno, la latencia y el costo de salida.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation" class="crayons-btn crayons-btn--primary"&gt;Prueba Apidog hoy&lt;/a&gt;
&lt;/p&gt;

&lt;p&gt;Anthropic recalibró estos niveles para Opus 5. Por eso, no conviene copiar una configuración de Opus 4.8 sin evaluarla de nuevo. Además, una combinación concreta de opciones devuelve un error &lt;code&gt;400&lt;/code&gt;: desactivar el pensamiento y usar &lt;code&gt;effort: "xhigh"&lt;/code&gt; o &lt;code&gt;effort: "max"&lt;/code&gt;.&lt;/p&gt;

&lt;blockquote&gt;
&lt;p&gt;💡 Si quieres comparar los cinco niveles contra un endpoint real, envía la misma solicitud con cada configuración y registra calidad, tokens de salida y latencia.&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  Qué es realmente el parámetro &lt;code&gt;effort&lt;/code&gt;
&lt;/h2&gt;

&lt;p&gt;&lt;code&gt;effort&lt;/code&gt; se configura dentro de &lt;code&gt;output_config&lt;/code&gt; en una solicitud a la API de Mensajes:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"model"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"claude-opus-5"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"max_tokens"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="mi"&gt;8192&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"output_config"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"effort"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"high"&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;},&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"messages"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;[&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
      &lt;/span&gt;&lt;span class="nl"&gt;"role"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"user"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
      &lt;/span&gt;&lt;span class="nl"&gt;"content"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"Refactorizar este módulo y explicar las ventajas y desventajas."&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;]&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Controla cuánto razonamiento interno realiza el modelo antes de responder:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Un &lt;code&gt;effort&lt;/code&gt; más alto usa más tokens de razonamiento.&lt;/li&gt;
&lt;li&gt;Más razonamiento implica mayor latencia y mayor costo de salida.&lt;/li&gt;
&lt;li&gt;Un &lt;code&gt;effort&lt;/code&gt; más bajo reduce esos tres factores.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Opus 5 activa el pensamiento adaptativo de forma predeterminada. Si no incluyes &lt;code&gt;output_config&lt;/code&gt;, la solicitud se ejecuta con &lt;code&gt;effort: "high"&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;Las interfaces visuales pueden presentar esto como un selector de costo-capacidad, pero en la API el control real es este campo. Consulta la &lt;a href="https://apidog.com/es/blog/claude-opus-5-api?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía detallada de la API de Opus 5&lt;/a&gt; y la &lt;a href="https://platform.claude.com/docs/en/about-claude/models/overview" rel="noopener noreferrer"&gt;descripción general de modelos de Anthropic&lt;/a&gt; para la estructura completa de la solicitud.&lt;/p&gt;

&lt;h3&gt;
  
  
  &lt;code&gt;effort&lt;/code&gt; no controla la longitud visible
&lt;/h3&gt;

&lt;p&gt;No uses &lt;code&gt;effort&lt;/code&gt; para pedir respuestas más cortas. Según la &lt;a href="https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5" rel="noopener noreferrer"&gt;guía de prompting de Anthropic para Opus 5&lt;/a&gt;, bajar el esfuerzo reduce el razonamiento, no necesariamente la longitud del texto generado.&lt;/p&gt;

&lt;p&gt;Si necesitas concisión, indícalo en el prompt:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Responde en un máximo de 5 viñetas. No incluyas razonamiento paso a paso.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;h2&gt;
  
  
  Los cinco niveles
&lt;/h2&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Nivel&lt;/th&gt;
&lt;th&gt;Qué hace&lt;/th&gt;
&lt;th&gt;Uso típico&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;&lt;code&gt;low&lt;/code&gt;&lt;/td&gt;
&lt;td&gt;Razonamiento mínimo antes de responder&lt;/td&gt;
&lt;td&gt;Clasificación de alto volumen, extracción, enrutamiento y resúmenes cortos&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;&lt;code&gt;medium&lt;/code&gt;&lt;/td&gt;
&lt;td&gt;Razonamiento moderado&lt;/td&gt;
&lt;td&gt;Preguntas sobre contexto recuperado, ediciones de un solo archivo y transformaciones estructuradas&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;&lt;code&gt;high&lt;/code&gt;&lt;/td&gt;
&lt;td&gt;
&lt;strong&gt;Valor predeterminado.&lt;/strong&gt; Razonamiento sustancial&lt;/td&gt;
&lt;td&gt;Trabajo general cuando todavía no tienes mediciones&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;&lt;code&gt;xhigh&lt;/code&gt;&lt;/td&gt;
&lt;td&gt;Razonamiento extendido&lt;/td&gt;
&lt;td&gt;Codificación y bucles agénticos; es el punto de partida recomendado por Anthropic&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;&lt;code&gt;max&lt;/code&gt;&lt;/td&gt;
&lt;td&gt;Presupuesto máximo de razonamiento&lt;/td&gt;
&lt;td&gt;Problemas difíciles de un solo intento, donde un error cuesta más que los tokens&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;Dos detalles son especialmente importantes:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;
&lt;strong&gt;El valor predeterminado es &lt;code&gt;high&lt;/code&gt;.&lt;/strong&gt; Una solicitud sin &lt;code&gt;output_config&lt;/code&gt; ya consume razonamiento adaptativo. Esto afecta la previsión de costos si migras desde Opus 4.8.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Para código y agentes, empieza con &lt;code&gt;xhigh&lt;/code&gt;, no con &lt;code&gt;max&lt;/code&gt;.&lt;/strong&gt; Anthropic recomienda &lt;code&gt;xhigh&lt;/code&gt; como punto de partida. Usa &lt;code&gt;max&lt;/code&gt; solo si tus evaluaciones demuestran una mejora que justifique el costo adicional.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;El cambio de comportamiento predeterminado es uno de los puntos clave de la &lt;a href="https://apidog.com/es/blog/claude-opus-5-migration-opus-4-8?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;migración de Opus 4.8 a Opus 5&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Qué cambió con la recalibración
&lt;/h2&gt;

&lt;p&gt;Anthropic recalibró el significado de cada nivel en Opus 5. Por ejemplo, &lt;code&gt;medium&lt;/code&gt; en Opus 5 no representa la misma cantidad de razonamiento que &lt;code&gt;medium&lt;/code&gt; en Opus 4.8.&lt;/p&gt;

&lt;p&gt;La consecuencia práctica: vuelve a medir tus cargas de trabajo. No portes configuraciones por nombre.&lt;/p&gt;

&lt;p&gt;En modelos Opus anteriores, &lt;code&gt;low&lt;/code&gt; y &lt;code&gt;medium&lt;/code&gt; podían ser demasiado débiles para muchas tareas serias. En Opus 5, los niveles bajos son más utilizables para producción, especialmente en tareas donde el razonamiento profundo no mejora la precisión:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;clasificación;&lt;/li&gt;
&lt;li&gt;extracción de campos;&lt;/li&gt;
&lt;li&gt;enrutamiento;&lt;/li&gt;
&lt;li&gt;transformaciones con salida estructurada;&lt;/li&gt;
&lt;li&gt;resúmenes breves.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Opus 5 cuesta $5 por millón de tokens de entrada y $25 por millón de tokens de salida, igual que Opus 4.8. Los tokens de razonamiento se cobran en la parte de salida. Por tanto, bajar de &lt;code&gt;high&lt;/code&gt; a &lt;code&gt;low&lt;/code&gt; en un pipeline de clasificación puede reducir una parte relevante del gasto sin degradar una tarea que no necesita razonamiento adicional.&lt;/p&gt;

&lt;p&gt;Consulta el &lt;a href="https://apidog.com/es/blog/claude-opus-5-pricing?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;desglose de precios de Opus 5&lt;/a&gt; para ver la tarifa completa, el descuento por lote del 50% y el mínimo de caché de 512 tokens.&lt;/p&gt;

&lt;p&gt;Si buscas optimizar varios servicios de Claude, estas prácticas también se combinan con las recomendaciones para &lt;a href="https://apidog.com/es/blog/cut-claude-api-bill?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;reducir tu factura de la API de Claude&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Cómo interactúan &lt;code&gt;xhigh&lt;/code&gt; y &lt;code&gt;max&lt;/code&gt; con &lt;code&gt;max_tokens&lt;/code&gt;
&lt;/h2&gt;

&lt;p&gt;&lt;code&gt;max_tokens&lt;/code&gt; limita la suma de:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;tokens de razonamiento;&lt;/li&gt;
&lt;li&gt;tokens de respuesta visible.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;No es un límite exclusivo para el texto final.&lt;/p&gt;

&lt;p&gt;Al aumentar &lt;code&gt;effort&lt;/code&gt;, el modelo puede dedicar más parte del presupuesto a razonar antes de escribir. Si usas &lt;code&gt;xhigh&lt;/code&gt; o &lt;code&gt;max&lt;/code&gt; con un valor de &lt;code&gt;max_tokens&lt;/code&gt; pensado para un modelo sin razonamiento adaptativo, la respuesta puede truncarse antes de completarse.&lt;/p&gt;

&lt;p&gt;Para &lt;code&gt;xhigh&lt;/code&gt; o &lt;code&gt;max&lt;/code&gt;, Anthropic recomienda comenzar con &lt;code&gt;max_tokens: 64000&lt;/code&gt;:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"model"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"claude-opus-5"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"max_tokens"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="mi"&gt;64000&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"output_config"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"effort"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"xhigh"&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;},&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"messages"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;[&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
      &lt;/span&gt;&lt;span class="nl"&gt;"role"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"user"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
      &lt;/span&gt;&lt;span class="nl"&gt;"content"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"Corregir la prueba de integración fallida y explicar la causa raíz."&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;]&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Un límite alto no es una compra anticipada. Solo se facturan los tokens producidos. Establecer &lt;code&gt;64000&lt;/code&gt; simplemente evita que el modelo se quede sin espacio durante el razonamiento o la respuesta.&lt;/p&gt;

&lt;p&gt;Como comprobación operativa, revisa el motivo de parada en cada respuesta. Si obtienes &lt;code&gt;stop_reason: "max_tokens"&lt;/code&gt;, aumenta el límite antes de concluir que la respuesta era correcta pero breve.&lt;/p&gt;

&lt;h2&gt;
  
  
  El error &lt;code&gt;400&lt;/code&gt;: pensamiento desactivado con &lt;code&gt;xhigh&lt;/code&gt; o &lt;code&gt;max&lt;/code&gt;
&lt;/h2&gt;

&lt;p&gt;La siguiente combinación falla:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"model"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"claude-opus-5"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"max_tokens"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="mi"&gt;8192&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"thinking"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"type"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"disabled"&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;},&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"output_config"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"effort"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"xhigh"&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Opus 5 rechaza por solicitud la combinación de:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;&lt;code&gt;thinking: { "type": "disabled" }&lt;/code&gt;&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;effort: "xhigh"&lt;/code&gt; o &lt;code&gt;effort: "max"&lt;/code&gt;
&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Desactivar el pensamiento limita el esfuerzo a &lt;code&gt;high&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;Estas son las combinaciones válidas:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Pensamiento activado —el valor predeterminado— con cualquiera de los cinco niveles.&lt;/li&gt;
&lt;li&gt;Pensamiento desactivado solo con &lt;code&gt;low&lt;/code&gt;, &lt;code&gt;medium&lt;/code&gt; o &lt;code&gt;high&lt;/code&gt;.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;La ruta de migración que suele provocar este &lt;code&gt;400&lt;/code&gt; es clara:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Mantienes &lt;code&gt;thinking: { "type": "disabled" }&lt;/code&gt; desde una configuración de Opus 4.8.&lt;/li&gt;
&lt;li&gt;Cambias &lt;code&gt;effort&lt;/code&gt; a &lt;code&gt;xhigh&lt;/code&gt; porque es la recomendación para código o agentes.&lt;/li&gt;
&lt;li&gt;La API rechaza la solicitud.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;La recomendación de Anthropic es no desactivar el pensamiento en Opus 5. Con el pensamiento desactivado, pueden aparecer llamadas a herramientas como texto plano o filtraciones de etiquetas XML internas en la salida. En flujos agénticos, ese texto puede contaminar los siguientes turnos.&lt;/p&gt;

&lt;p&gt;Para reducir costos, baja &lt;code&gt;effort&lt;/code&gt; en lugar de desactivar el pensamiento. Consulta la &lt;a href="https://apidog.com/es/blog/prompting-claude-opus-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de prompting de Opus 5&lt;/a&gt; para más contexto sobre estos artefactos.&lt;/p&gt;

&lt;h2&gt;
  
  
  Cómo evaluar &lt;code&gt;effort&lt;/code&gt; en tus propias pruebas
&lt;/h2&gt;

&lt;p&gt;No elijas un nivel por intuición. Ejecuta una evaluación corta y conserva el resultado junto a la configuración del servicio.&lt;/p&gt;

&lt;h3&gt;
  
  
  1. Congela un conjunto de tareas reales
&lt;/h3&gt;

&lt;p&gt;Extrae entre 30 y 50 prompts de registros de producción. Incluye los casos difíciles, no solo ejemplos sintéticos o prompts que ya sabes que funcionan.&lt;/p&gt;

&lt;p&gt;Las diferencias entre niveles suelen desaparecer en tareas fáciles.&lt;/p&gt;

&lt;h3&gt;
  
  
  2. Define el criterio de aprobación antes de ejecutar
&lt;/h3&gt;

&lt;p&gt;Usa criterios verificables, por ejemplo:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;la suite de pruebas pasa;&lt;/li&gt;
&lt;li&gt;el JSON valida contra un esquema;&lt;/li&gt;
&lt;li&gt;el campo extraído coincide con la fuente de verdad;&lt;/li&gt;
&lt;li&gt;un revisor humano marca aprobado o fallido.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Evita criterios subjetivos como “la salida parece mejor”.&lt;/p&gt;

&lt;h3&gt;
  
  
  3. Ejecuta cada prompt con los cinco niveles
&lt;/h3&gt;

&lt;p&gt;Con 40 prompts tendrás 200 ejecuciones:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;40 prompts × 5 niveles = 200 solicitudes
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Para tareas sin sensibilidad a la latencia, puedes usar la API por lotes y aprovechar el descuento correspondiente.&lt;/p&gt;

&lt;h3&gt;
  
  
  4. Registra calidad, costo y latencia
&lt;/h3&gt;

&lt;p&gt;Guarda al menos estos tres valores por ejecución:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"passed"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="kc"&gt;true&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"output_tokens"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="mi"&gt;0&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"latency_ms"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="mi"&gt;0&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Obtén el costo real desde el bloque &lt;code&gt;usage&lt;/code&gt; de la respuesta. &lt;code&gt;usage.output_tokens&lt;/code&gt; incluye la señal relevante para comparar el gasto de salida, incluidos los tokens de razonamiento que no puedes inferir solo a partir del texto visible.&lt;/p&gt;

&lt;p&gt;También registra:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;code&gt;stop_reason&lt;/code&gt;;&lt;/li&gt;
&lt;li&gt;errores HTTP;&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;cache_read_input_tokens&lt;/code&gt;, si usas caché;&lt;/li&gt;
&lt;li&gt;versión del prompt y versión del modelo.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  5. Selecciona el nivel más barato que cumpla el criterio
&lt;/h3&gt;

&lt;p&gt;No selecciones el nivel con la puntuación máxima si un nivel inferior cumple el objetivo de calidad.&lt;/p&gt;

&lt;p&gt;Después, confirma el resultado con un conjunto de validación que no hayas usado para ajustar. De lo contrario, puedes terminar optimizando para los 40 prompts iniciales.&lt;/p&gt;

&lt;h3&gt;
  
  
  6. Repite la evaluación al cambiar de modelo
&lt;/h3&gt;

&lt;p&gt;La recalibración entre Opus 4.8 y Opus 5 demuestra que una misma etiqueta no garantiza un comportamiento equivalente entre versiones.&lt;/p&gt;

&lt;p&gt;Trata la evaluación de &lt;code&gt;effort&lt;/code&gt; como parte de tu checklist de migración.&lt;/p&gt;

&lt;h2&gt;
  
  
  Comparar niveles lado a lado en Apidog
&lt;/h2&gt;

&lt;p&gt;La mecánica consiste en enviar el mismo cuerpo cinco veces y cambiar solo &lt;code&gt;output_config.effort&lt;/code&gt;. Puedes hacerlo con scripts, pero una colección de solicitudes facilita revisar respuestas y mantener las comparaciones compartidas con el equipo.&lt;/p&gt;

&lt;p&gt;Una configuración práctica en &lt;a href="https://apidog.com?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt;:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Crea una solicitud para el endpoint de Mensajes de Anthropic.&lt;/li&gt;
&lt;li&gt;Guarda la clave API en una variable de entorno; no la pegues en el cuerpo ni en una colección compartida.&lt;/li&gt;
&lt;li&gt;Guarda la solicitud base en una colección.&lt;/li&gt;
&lt;li&gt;Duplica la solicitud cinco veces.&lt;/li&gt;
&lt;li&gt;Cambia únicamente &lt;code&gt;output_config.effort&lt;/code&gt; en cada copia.&lt;/li&gt;
&lt;li&gt;Inspecciona &lt;code&gt;usage&lt;/code&gt; en cada respuesta.&lt;/li&gt;
&lt;li&gt;Revisa &lt;code&gt;cache_read_input_tokens&lt;/code&gt; si también verificas el comportamiento de caché.&lt;/li&gt;
&lt;li&gt;Activa streaming y observa los eventos SSE si necesitas comparar la latencia percibida entre &lt;code&gt;low&lt;/code&gt; y &lt;code&gt;xhigh&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Añade una aserción para detectar truncamientos.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Una aserción útil es verificar que &lt;code&gt;stop_reason&lt;/code&gt; exista y no sea &lt;code&gt;max_tokens&lt;/code&gt;:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight javascript"&gt;&lt;code&gt;&lt;span class="nx"&gt;pm&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;test&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="s2"&gt;La respuesta no fue truncada por max_tokens&lt;/span&gt;&lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="p"&gt;()&lt;/span&gt; &lt;span class="o"&gt;=&amp;gt;&lt;/span&gt; &lt;span class="p"&gt;{&lt;/span&gt;
  &lt;span class="kd"&gt;const&lt;/span&gt; &lt;span class="nx"&gt;body&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="nx"&gt;pm&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;response&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;json&lt;/span&gt;&lt;span class="p"&gt;();&lt;/span&gt;

  &lt;span class="nx"&gt;pm&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;expect&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="nx"&gt;body&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;stop_reason&lt;/span&gt;&lt;span class="p"&gt;).&lt;/span&gt;&lt;span class="nx"&gt;to&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;exist&lt;/span&gt;&lt;span class="p"&gt;;&lt;/span&gt;
  &lt;span class="nx"&gt;pm&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;expect&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="nx"&gt;body&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;stop_reason&lt;/span&gt;&lt;span class="p"&gt;).&lt;/span&gt;&lt;span class="nx"&gt;not&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;to&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;eql&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="s2"&gt;max_tokens&lt;/span&gt;&lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="p"&gt;);&lt;/span&gt;
&lt;span class="p"&gt;});&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Esta comprobación es especialmente importante con &lt;code&gt;xhigh&lt;/code&gt; y &lt;code&gt;max&lt;/code&gt;: una respuesta truncada puede parecer simplemente corta si no inspeccionas el motivo de parada.&lt;/p&gt;

&lt;p&gt;Puedes &lt;a href="https://apidog.com/download?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;descargar Apidog&lt;/a&gt; para construir esta colección, aunque el procedimiento no depende de una herramienta concreta.&lt;/p&gt;

&lt;h2&gt;
  
  
  El límite de &lt;code&gt;effort&lt;/code&gt;
&lt;/h2&gt;

&lt;p&gt;&lt;code&gt;effort&lt;/code&gt; permite ejecutar Opus 5 de forma más eficiente, pero no convierte al modelo en el más capaz de toda la oferta de Claude.&lt;/p&gt;

&lt;p&gt;Los números de lanzamiento de Anthropic para Opus 5 indican más del doble de la puntuación de Frontier-Bench v0.1 de Opus 4.8, aproximadamente 3 veces el siguiente mejor modelo en ARC-AGI 3 y una diferencia de menos del 0.5% frente a Fable 5 en CursorBench 3.2 a la mitad del precio. Son cifras publicadas por el proveedor y no habían sido reproducidas independientemente hasta el 25 de julio de 2026.&lt;/p&gt;

&lt;p&gt;Trátalas como afirmaciones con fuente, no como mediciones neutrales. Consulta el &lt;a href="https://apidog.com/es/blog/claude-opus-5-benchmarks?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;desglose de benchmarks de Opus 5&lt;/a&gt; para conocer las advertencias de cada resultado.&lt;/p&gt;

&lt;p&gt;Por encima de Opus 5, &lt;a href="https://apidog.com/es/blog/what-is-claude-fable-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Fable 5&lt;/a&gt; sigue siendo el modelo más capaz de Anthropic ampliamente lanzado, a $10 por millón de tokens de entrada y $50 por millón de tokens de salida.&lt;/p&gt;

&lt;p&gt;Opus 5 también sigue por detrás de &lt;a href="https://apidog.com/es/blog/mythos-class-model-explained?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Mythos 5&lt;/a&gt; en explotación de ciberseguridad e investigación de biología autónoma, según declara Anthropic. Ejecutar Opus 5 con &lt;code&gt;effort: "max"&lt;/code&gt; no elimina esas diferencias.&lt;/p&gt;

&lt;p&gt;La decisión práctica es evaluar si la combinación de capacidad, latencia y precio cubre tu carga de trabajo. Para esa comparación, consulta &lt;a href="https://apidog.com/es/blog/claude-opus-5-vs-fable-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Opus 5 vs Fable 5&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Preguntas frecuentes
&lt;/h2&gt;

&lt;p&gt;&lt;strong&gt;¿Cuál es el nivel de &lt;code&gt;effort&lt;/code&gt; predeterminado en Claude Opus 5?&lt;/strong&gt;&lt;/p&gt;

&lt;p&gt;&lt;code&gt;high&lt;/code&gt;. Una solicitud sin &lt;code&gt;output_config&lt;/code&gt; usa &lt;code&gt;effort: "high"&lt;/code&gt; y pensamiento adaptativo activado.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;¿Cuáles son los cinco niveles de &lt;code&gt;effort&lt;/code&gt;?&lt;/strong&gt;&lt;/p&gt;

&lt;p&gt;&lt;code&gt;low&lt;/code&gt;, &lt;code&gt;medium&lt;/code&gt;, &lt;code&gt;high&lt;/code&gt;, &lt;code&gt;xhigh&lt;/code&gt; y &lt;code&gt;max&lt;/code&gt;. Para código y tareas agénticas, Anthropic recomienda empezar con &lt;code&gt;xhigh&lt;/code&gt; y ajustar según tus evaluaciones.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;¿Por qué mi solicitud devuelve un &lt;code&gt;400&lt;/code&gt; con &lt;code&gt;effort: "xhigh"&lt;/code&gt;?&lt;/strong&gt;&lt;/p&gt;

&lt;p&gt;Probablemente también estás enviando:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"thinking"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"type"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"disabled"&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Con el pensamiento desactivado, &lt;code&gt;effort&lt;/code&gt; queda limitado a &lt;code&gt;high&lt;/code&gt;. Elimina el bloque &lt;code&gt;thinking&lt;/code&gt; o baja el esfuerzo a &lt;code&gt;high&lt;/code&gt;, &lt;code&gt;medium&lt;/code&gt; o &lt;code&gt;low&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;¿Puedo reutilizar mi configuración de &lt;code&gt;effort&lt;/code&gt; de Opus 4.8 en Opus 5?&lt;/strong&gt;&lt;/p&gt;

&lt;p&gt;No deberías hacerlo sin evaluar. Los niveles fueron recalibrados y la misma etiqueta representa una cantidad diferente de razonamiento. Revisa la &lt;a href="https://apidog.com/es/blog/claude-opus-5-migration-opus-4-8?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de migración&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;¿Disminuir &lt;code&gt;effort&lt;/code&gt; hace que las respuestas sean más cortas?&lt;/strong&gt;&lt;/p&gt;

&lt;p&gt;No necesariamente. &lt;code&gt;effort&lt;/code&gt; controla el razonamiento interno, no la longitud visible. Pide explícitamente una respuesta concisa si eso es lo que necesitas.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;¿Qué valor de &lt;code&gt;max_tokens&lt;/code&gt; debo usar con &lt;code&gt;xhigh&lt;/code&gt; o &lt;code&gt;max&lt;/code&gt;?&lt;/strong&gt;&lt;/p&gt;

&lt;p&gt;Empieza con &lt;code&gt;64000&lt;/code&gt;. &lt;code&gt;max_tokens&lt;/code&gt; limita conjuntamente el razonamiento y la respuesta, así que un límite pensado para modelos sin razonamiento puede truncar la salida. Solo se facturan los tokens generados.&lt;/p&gt;

&lt;p&gt;Para consultar la hoja de especificaciones, la matriz de disponibilidad y el contexto de precios, empieza por &lt;a href="https://apidog.com/es/blog/what-is-claude-opus-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;qué es Claude Opus 5&lt;/a&gt;.&lt;/p&gt;

</description>
    </item>
    <item>
      <title>Claude Opus 5 vs Fable 5: ¿Vale la pena la mitad del precio?</title>
      <dc:creator>Roobia</dc:creator>
      <pubDate>Sat, 25 Jul 2026 03:18:15 +0000</pubDate>
      <link>https://dev.to/roobia/claude-opus-5-vs-fable-5-vale-la-pena-la-mitad-del-precio-41m</link>
      <guid>https://dev.to/roobia/claude-opus-5-vs-fable-5-vale-la-pena-la-mitad-del-precio-41m</guid>
      <description>&lt;p&gt;Anthropic lanzó &lt;a href="https://www.anthropic.com/news/claude-opus-5" rel="noopener noreferrer"&gt;Claude Opus 5&lt;/a&gt; el 24 de julio de 2026. La pregunta práctica para los equipos es directa: si Opus 5 se acerca a Fable 5 por la mitad del precio, ¿cuándo conviene seguir pagando por Fable 5?&lt;/p&gt;

&lt;p&gt;&lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation" class="crayons-btn crayons-btn--primary"&gt;Prueba Apidog hoy&lt;/a&gt;
&lt;/p&gt;

&lt;p&gt;Los precios son claros:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Opus 5:&lt;/strong&gt; $5 por millón de tokens de entrada y $25 por millón de tokens de salida.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Fable 5:&lt;/strong&gt; $10 por millón de tokens de entrada y $50 por millón de tokens de salida.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Anthropic afirma que Opus 5 queda a menos del 0.5% del pico de Fable 5 en CursorBench 3.2 y supera a Fable 5 en OSWorld 2.0 a un tercio del coste.&lt;/p&gt;

&lt;p&gt;Para validarlo con tus propios prompts, envía la misma solicitud a ambos IDs de modelo desde &lt;a href="https://apidog.com?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt; y compara respuesta, latencia y consumo de tokens.&lt;/p&gt;

&lt;h2&gt;
  
  
  Los dos modelos de un vistazo
&lt;/h2&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;&lt;/th&gt;
&lt;th&gt;Claude Opus 5&lt;/th&gt;
&lt;th&gt;Claude Fable 5&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;ID de modelo de API&lt;/td&gt;
&lt;td&gt;&lt;code&gt;claude-opus-5&lt;/code&gt;&lt;/td&gt;
&lt;td&gt;&lt;code&gt;claude-fable-5&lt;/code&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Precio de entrada&lt;/td&gt;
&lt;td&gt;$5 / MTok&lt;/td&gt;
&lt;td&gt;$10 / MTok&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Precio de salida&lt;/td&gt;
&lt;td&gt;$25 / MTok&lt;/td&gt;
&lt;td&gt;$50 / MTok&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Ventana de contexto&lt;/td&gt;
&lt;td&gt;1M tokens (predeterminado y máximo)&lt;/td&gt;
&lt;td&gt;1M tokens&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Salida máxima&lt;/td&gt;
&lt;td&gt;128k (300k en Batch con un encabezado beta)&lt;/td&gt;
&lt;td&gt;128k&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Fecha de corte de conocimiento&lt;/td&gt;
&lt;td&gt;Mayo de 2026&lt;/td&gt;
&lt;td&gt;Enero de 2026&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Posicionamiento&lt;/td&gt;
&lt;td&gt;Recomendación predeterminada de Anthropic&lt;/td&gt;
&lt;td&gt;Modelo ampliamente lanzado más capaz&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Pensamiento&lt;/td&gt;
&lt;td&gt;Adaptativo, activado por defecto, controlable mediante esfuerzo&lt;/td&gt;
&lt;td&gt;Siempre activado&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Lanzado&lt;/td&gt;
&lt;td&gt;24 de julio de 2026&lt;/td&gt;
&lt;td&gt;Principios de junio de 2026&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;Dos diferencias requieren atención inmediata.&lt;/p&gt;

&lt;p&gt;La primera es la fecha de corte. Opus 5 conoce información hasta &lt;strong&gt;mayo de 2026&lt;/strong&gt;, mientras que Fable 5 se detiene en &lt;strong&gt;enero de 2026&lt;/strong&gt;. Para proyectos que dependen de librerías, SDKs, frameworks o APIs que cambian rápido, el modelo más barato también puede ser el más actualizado.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fxwwhimm7auto0yp6uulk.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fxwwhimm7auto0yp6uulk.png" alt="Comparación de Claude Opus 5 y Claude Fable 5" width="800" height="793"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;La segunda es el posicionamiento. Anthropic sigue describiendo Fable 5 como su modelo más capaz lanzado ampliamente. Opus 5 es el modelo recomendado por defecto: úsalo cuando no tengas evidencia de que una tarea necesita el máximo techo de capacidad.&lt;/p&gt;

&lt;p&gt;Consulta la especificación completa en &lt;a href="https://apidog.com/es/blog/what-is-claude-opus-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;qué es Claude Opus 5&lt;/a&gt; y los detalles de Fable en &lt;a href="https://apidog.com/es/blog/what-is-claude-fable-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;qué es Claude Fable 5&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Lo que Anthropic realmente afirma
&lt;/h2&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Benchmark&lt;/th&gt;
&lt;th&gt;Afirmación de Anthropic para Opus 5&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;CursorBench 3.2&lt;/td&gt;
&lt;td&gt;Dentro del 0.5% del pico de Fable 5, a mitad de precio&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;OSWorld 2.0 (uso de ordenador)&lt;/td&gt;
&lt;td&gt;Supera a Fable 5 a un tercio del coste&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Frontier-Bench v0.1&lt;/td&gt;
&lt;td&gt;Supera a todos los demás modelos; más del doble de la puntuación de Opus 4.8&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;ARC-AGI 3&lt;/td&gt;
&lt;td&gt;Aproximadamente 3 veces el siguiente mejor modelo&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Zapier AutomationBench&lt;/td&gt;
&lt;td&gt;Tasa de aprobación aproximadamente 1.5 veces el siguiente mejor modelo&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Química orgánica&lt;/td&gt;
&lt;td&gt;+10.2 puntos sobre Opus 4.8&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Análisis de proteínas&lt;/td&gt;
&lt;td&gt;+7.7 puntos sobre Opus 4.8&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;La advertencia importante es que &lt;strong&gt;todas estas cifras proceden del proveedor&lt;/strong&gt;. Anthropic definió la configuración de evaluación, eligió los niveles de esfuerzo y publicó los resultados. Hasta el 25 de julio de 2026, no se habían reproducido de forma independiente.&lt;/p&gt;

&lt;p&gt;Esto no implica mala fe; es el estado habitual de un lanzamiento reciente. Pero una diferencia de 0.5% en un benchmark concreto no garantiza la misma diferencia en tu repositorio, tus herramientas ni tus prompts.&lt;/p&gt;

&lt;p&gt;La afirmación de OSWorld es especialmente relevante para automatización agencial: Anthropic indica que Opus 5 supera directamente a Fable 5 en tareas de uso de ordenador. En CursorBench, en cambio, Fable 5 conserva el pico de capacidad.&lt;/p&gt;

&lt;p&gt;Para revisar qué mide cada prueba, consulta la &lt;a href="https://apidog.com/es/blog/claude-opus-5-benchmarks?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de benchmarks de Opus 5&lt;/a&gt; y los &lt;a href="https://apidog.com/es/blog/claude-fable-5-benchmarks?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;benchmarks de Fable 5&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Cuándo elegir Opus 5
&lt;/h2&gt;

&lt;h3&gt;
  
  
  1. Quieres reducir el coste por token
&lt;/h3&gt;

&lt;p&gt;La diferencia es exactamente de 2x:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Opus 5:  $5 entrada / $25 salida por MTok
Fable 5: $10 entrada / $50 salida por MTok
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Si una carga de trabajo cuesta $3,000 al mes con Fable 5 para el mismo volumen de tokens, costaría aproximadamente $1,500 con Opus 5.&lt;/p&gt;

&lt;h3&gt;
  
  
  2. Puedes aprovechar Batch y caché
&lt;/h3&gt;

&lt;p&gt;Opus 5 incluye varias palancas de coste:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;API Batch: $2.50 / $12.50.&lt;/li&gt;
&lt;li&gt;Lecturas y actualizaciones de caché: $0.50 por millón.&lt;/li&gt;
&lt;li&gt;Mínimo de caché de prompts reducido a 512 tokens.&lt;/li&gt;
&lt;li&gt;Menor sobrecarga de prompt del sistema en uso de herramientas:

&lt;ul&gt;
&lt;li&gt;286 tokens con &lt;code&gt;tool_choice&lt;/code&gt; en &lt;code&gt;auto&lt;/code&gt; o &lt;code&gt;none&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;290 tokens en Opus 4.8.&lt;/li&gt;
&lt;li&gt;675 tokens en Opus 4.7.&lt;/li&gt;
&lt;/ul&gt;
&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Estas optimizaciones importan especialmente en flujos agenciales con prompts de sistema repetidos y muchas llamadas a herramientas.&lt;/p&gt;

&lt;p&gt;Consulta el &lt;a href="https://apidog.com/es/blog/claude-opus-5-pricing?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;desglose de precios de Opus 5&lt;/a&gt; y esta guía para &lt;a href="https://apidog.com/es/blog/cut-claude-api-bill?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;reducir tu factura de la API de Claude&lt;/a&gt;.&lt;/p&gt;

&lt;h3&gt;
  
  
  3. Necesitas ajustar calidad frente a coste
&lt;/h3&gt;

&lt;p&gt;Opus 5 incorpora &lt;code&gt;output_config.effort&lt;/code&gt;, con &lt;code&gt;high&lt;/code&gt; como valor predeterminado. Puedes elegir niveles como:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"output_config"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"effort"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"low"&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Una estrategia práctica:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;code&gt;low&lt;/code&gt;: clasificación, extracción o transformaciones simples.&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;medium&lt;/code&gt;: tareas de código rutinarias y análisis estructurado.&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;high&lt;/code&gt;: valor predeterminado para solicitudes complejas.&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;xhigh&lt;/code&gt;: tareas agenciales difíciles o razonamiento de alto impacto.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;No asumas que debes usar siempre &lt;code&gt;high&lt;/code&gt; o &lt;code&gt;xhigh&lt;/code&gt;. Prueba qué nivel de esfuerzo alcanza la calidad que necesitas en tu conjunto de evaluación. Consulta la &lt;a href="https://apidog.com/es/blog/claude-opus-5-effort-parameter?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía del parámetro de esfuerzo&lt;/a&gt;.&lt;/p&gt;

&lt;h3&gt;
  
  
  4. Necesitas conocimiento más reciente
&lt;/h3&gt;

&lt;p&gt;Opus 5 tiene una fecha de corte de mayo de 2026, cuatro meses posterior a Fable 5. Si trabajas con dependencias publicadas o actualizadas después de enero de 2026, esta diferencia puede ser más importante que el benchmark general.&lt;/p&gt;

&lt;h3&gt;
  
  
  5. Quieres seguir el valor predeterminado del ecosistema
&lt;/h3&gt;

&lt;p&gt;Opus 5 es el nuevo valor predeterminado para suscriptores Max y el modelo de mayor rendimiento disponible para usuarios Pro. Está disponible en API de Claude, &lt;a href="http://claude.ai" rel="noopener noreferrer"&gt;claude.ai&lt;/a&gt;, Claude Code, Claude Cowork, Amazon Bedrock, Claude Platform en AWS, Google Cloud, Microsoft Foundry y GitHub Copilot.&lt;/p&gt;

&lt;p&gt;La &lt;a href="https://platform.claude.com/docs/en/about-claude/models/overview" rel="noopener noreferrer"&gt;visión general de modelos&lt;/a&gt; de Anthropic recomienda comenzar con Opus 5 si no tienes una razón específica para elegir otro modelo.&lt;/p&gt;

&lt;h2&gt;
  
  
  Cuándo mantener Fable 5
&lt;/h2&gt;

&lt;h3&gt;
  
  
  1. Tu tarea está en el límite de capacidad
&lt;/h3&gt;

&lt;p&gt;Anthropic no trasladó la etiqueta de “modelo más capaz lanzado ampliamente” de Fable 5 a Opus 5. Para ejecuciones donde un fallo cuesta más que varios meses de API, Fable 5 sigue siendo la opción conservadora.&lt;/p&gt;

&lt;p&gt;El &lt;a href="https://www.anthropic.com/news/claude-fable-5-mythos-5" rel="noopener noreferrer"&gt;anuncio de Claude Fable 5&lt;/a&gt; es la referencia para ese posicionamiento.&lt;/p&gt;

&lt;h3&gt;
  
  
  2. Quieres pensamiento siempre activo
&lt;/h3&gt;

&lt;p&gt;Fable 5 piensa en cada solicitud. En Opus 5, puedes desactivar el pensamiento, pero Anthropic documenta efectos secundarios potenciales:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Llamadas a herramientas escritas como texto en vez de ejecutadas.&lt;/li&gt;
&lt;li&gt;Texto filtrado que contamina turnos posteriores en bucles agenciales.&lt;/li&gt;
&lt;li&gt;Etiquetas XML internas visibles en la salida.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;La mitigación recomendada es mantener el pensamiento activado y bajar el nivel de esfuerzo para controlar el coste. Fable 5 elimina esa superficie de configuración.&lt;/p&gt;

&lt;h3&gt;
  
  
  3. No quieres asumir riesgos de migración
&lt;/h3&gt;

&lt;p&gt;Opus 5 añade configuraciones que debes validar:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Combinar &lt;code&gt;thinking: { "type": "disabled" }&lt;/code&gt; con &lt;code&gt;xhigh&lt;/code&gt; o &lt;code&gt;max&lt;/code&gt; devuelve un error &lt;code&gt;400&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Si omites &lt;code&gt;thinking&lt;/code&gt;, el pensamiento se ejecuta por defecto.&lt;/li&gt;
&lt;li&gt;Un presupuesto &lt;code&gt;max_tokens&lt;/code&gt; diseñado para cargas sin pensamiento puede truncarse.&lt;/li&gt;
&lt;li&gt;Opus 5 puede delegar más fácilmente en subagentes y generar respuestas predeterminadas más largas.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Si migras, revisa la &lt;a href="https://apidog.com/es/blog/claude-opus-5-migration-opus-4-8?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de migración de Opus 4.8 a Opus 5&lt;/a&gt;.&lt;/p&gt;

&lt;h3&gt;
  
  
  4. Tu volumen no justifica el cambio
&lt;/h3&gt;

&lt;p&gt;“La mitad de precio” describe el coste por token, no el coste total de un proyecto.&lt;/p&gt;

&lt;p&gt;Incluye en el cálculo:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Horas de ingeniería para migrar prompts y evaluaciones.&lt;/li&gt;
&lt;li&gt;Ajustes de &lt;code&gt;effort&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Cambios en límites de tokens y comportamiento de herramientas.&lt;/li&gt;
&lt;li&gt;Coste de regresiones o resultados inesperados.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Si dos ingenieros necesitan una semana para migrar y el volumen mensual es bajo, mantener Fable 5 puede ser más barato.&lt;/p&gt;

&lt;p&gt;Consulta la &lt;a href="https://apidog.com/es/blog/claude-fable-5-vs-opus-4-8?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;comparación entre Fable 5 y Opus 4.8&lt;/a&gt; y la estructura de &lt;a href="https://apidog.com/es/blog/claude-fable-5-pricing?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;precios de Fable 5&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Cómo se ve la diferencia de precio en solicitudes reales
&lt;/h2&gt;

&lt;p&gt;Supongamos una tarea de codificación agencial con:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;200,000 tokens de entrada.&lt;/li&gt;
&lt;li&gt;20,000 tokens de salida.&lt;/li&gt;
&lt;/ul&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;&lt;/th&gt;
&lt;th&gt;Opus 5&lt;/th&gt;
&lt;th&gt;Fable 5&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Entrada (200k)&lt;/td&gt;
&lt;td&gt;$1.00&lt;/td&gt;
&lt;td&gt;$2.00&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Salida (20k)&lt;/td&gt;
&lt;td&gt;$0.50&lt;/td&gt;
&lt;td&gt;$1.00&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;&lt;strong&gt;Por tarea&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;$1.50&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;$3.00&lt;/strong&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;500 tareas/mes&lt;/td&gt;
&lt;td&gt;$750&lt;/td&gt;
&lt;td&gt;$1,500&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;5,000 tareas/mes&lt;/td&gt;
&lt;td&gt;$7,500&lt;/td&gt;
&lt;td&gt;$15,000&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;A 500 tareas al mes, la diferencia es $750. Si Fable 5 evita una ejecución fallida importante al mes, puede justificar ese coste.&lt;/p&gt;

&lt;p&gt;A 5,000 tareas al mes, la diferencia anual asciende a $90,000. En ese volumen, necesitas evidencia de que Fable 5 es mejor en &lt;strong&gt;tu&lt;/strong&gt; carga de trabajo, no solo en la evaluación de Anthropic.&lt;/p&gt;

&lt;p&gt;También existe el modo rápido de Opus 5, con 2.5x de velocidad de salida, disponible como vista previa de investigación en la API de terceros. Su precio es $10/$50, igual que la tarifa base de Fable 5. Si la restricción es latencia y no capacidad, puede ser preferible pagar por un Opus 5 más rápido.&lt;/p&gt;

&lt;p&gt;Ten en cuenta que &lt;code&gt;inference_geo: "us"&lt;/code&gt; añade un multiplicador de 1.1x a cada categoría de tokens en Opus 5.&lt;/p&gt;

&lt;h2&gt;
  
  
  Marco de decisión por carga de trabajo
&lt;/h2&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Tu carga de trabajo&lt;/th&gt;
&lt;th&gt;Elegir&lt;/th&gt;
&lt;th&gt;Por qué&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Codificación agencial de alto volumen&lt;/td&gt;
&lt;td&gt;Opus 5&lt;/td&gt;
&lt;td&gt;Anthropic informa una diferencia de hasta 0.5% en CursorBench a mitad de coste&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Uso de ordenador y automatización de navegador&lt;/td&gt;
&lt;td&gt;Opus 5&lt;/td&gt;
&lt;td&gt;Anthropic afirma que supera directamente a Fable 5 en OSWorld 2.0&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Trabajo con librerías posteriores a enero de 2026&lt;/td&gt;
&lt;td&gt;Opus 5&lt;/td&gt;
&lt;td&gt;Fecha de corte de mayo de 2026 frente a enero de 2026&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Tráfico de producción sensible al coste&lt;/td&gt;
&lt;td&gt;Opus 5&lt;/td&gt;
&lt;td&gt;Mitad de precio, Batch, caché de 512 tokens y niveles &lt;code&gt;low&lt;/code&gt;/&lt;code&gt;medium&lt;/code&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Ejecuciones únicas de razonamiento de alto riesgo&lt;/td&gt;
&lt;td&gt;Fable 5&lt;/td&gt;
&lt;td&gt;Sigue siendo el modelo más capaz lanzado ampliamente&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Sesiones autónomas largas donde un fallo es caro&lt;/td&gt;
&lt;td&gt;Fable 5&lt;/td&gt;
&lt;td&gt;Pensamiento siempre activo y menos superficie de migración&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Ya usas Fable 5 y tienes bajo volumen&lt;/td&gt;
&lt;td&gt;Fable 5&lt;/td&gt;
&lt;td&gt;El coste de migración puede superar los ahorros&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Explotación de ciberseguridad o investigación biológica autónoma&lt;/td&gt;
&lt;td&gt;Ninguno de los dos&lt;/td&gt;
&lt;td&gt;Ambos quedan por detrás de Mythos 5 en estos ejes&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;El patrón es simple:&lt;/p&gt;

&lt;blockquote&gt;
&lt;p&gt;&lt;strong&gt;Opus 5 gana en economía de rendimiento; Fable 5 gana en riesgo de cola.&lt;/strong&gt;&lt;/p&gt;
&lt;/blockquote&gt;

&lt;p&gt;Usa Opus 5 cuando ejecutas muchas tareas y puedes tolerar una respuesta ocasionalmente más débil. Mantén Fable 5 cuando procesas pocas tareas, pero un único resultado incorrecto es costoso.&lt;/p&gt;

&lt;h2&gt;
  
  
  Cómo comparar ambos modelos en tu propia carga de trabajo
&lt;/h2&gt;

&lt;p&gt;Los benchmarks del proveedor no sustituyen un conjunto de evaluación propio. Ambos modelos usan el endpoint de Messages, por lo que la comparación empieza cambiando una sola cadena.&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;curl https://api.anthropic.com/v1/messages &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--header&lt;/span&gt; &lt;span class="s2"&gt;"x-api-key: &lt;/span&gt;&lt;span class="nv"&gt;$ANTHROPIC_API_KEY&lt;/span&gt;&lt;span class="s2"&gt;"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--header&lt;/span&gt; &lt;span class="s2"&gt;"anthropic-version: 2023-06-01"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--header&lt;/span&gt; &lt;span class="s2"&gt;"content-type: application/json"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--data&lt;/span&gt; &lt;span class="s1"&gt;'{
    "model": "claude-opus-5",
    "max_tokens": 8192,
    "output_config": {"effort": "high"},
    "messages": [
      {
        "role": "user",
        "content": "Refactoriza este handler y explica las decisiones técnicas."
      }
    ]
  }'&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Para probar Fable 5, cambia:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="nl"&gt;"model"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"claude-opus-5"&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;por:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="nl"&gt;"model"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"claude-fable-5"&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;h3&gt;
  
  
  Proceso de evaluación recomendado
&lt;/h3&gt;

&lt;ol&gt;
&lt;li&gt;&lt;p&gt;&lt;strong&gt;Crea un entorno por modelo.&lt;/strong&gt;&lt;br&gt;&lt;br&gt;
Guarda la clave API como variable de entorno. Define el ID de modelo como otra variable para evitar modificar manualmente cada request.&lt;/p&gt;&lt;/li&gt;
&lt;li&gt;&lt;p&gt;&lt;strong&gt;Guarda una única solicitud en una colección.&lt;/strong&gt;&lt;br&gt;&lt;br&gt;
Ejecuta exactamente el mismo escenario contra ambos entornos. La única diferencia debe ser el modelo.&lt;/p&gt;&lt;/li&gt;
&lt;li&gt;&lt;p&gt;&lt;strong&gt;Compara los campos &lt;code&gt;usage&lt;/code&gt;.&lt;/strong&gt;&lt;br&gt;&lt;br&gt;
Revisa tokens de entrada, salida y lectura de caché. Opus 5 puede producir respuestas predeterminadas más largas, por lo que debes medir el coste real y no solo la tarifa por token.&lt;/p&gt;&lt;/li&gt;
&lt;li&gt;&lt;p&gt;&lt;strong&gt;Inspecciona el flujo SSE y las llamadas a herramientas.&lt;/strong&gt;&lt;br&gt;&lt;br&gt;
En flujos agenciales, comprueba si el modelo ejecuta una herramienta correctamente o si escribe una llamada como texto. El flujo de eventos en bruto permite detectar esa diferencia.&lt;/p&gt;&lt;/li&gt;
&lt;li&gt;&lt;p&gt;&lt;strong&gt;Prueba varios niveles de esfuerzo en Opus 5.&lt;/strong&gt;&lt;br&gt;&lt;br&gt;
Ejecuta &lt;code&gt;low&lt;/code&gt;, &lt;code&gt;medium&lt;/code&gt;, &lt;code&gt;high&lt;/code&gt; y &lt;code&gt;xhigh&lt;/code&gt;. La pregunta útil suele ser esta:&lt;/p&gt;&lt;/li&gt;
&lt;/ol&gt;

&lt;blockquote&gt;
&lt;p&gt;¿Qué nivel de esfuerzo de Opus 5 alcanza la calidad de Fable 5 con menor coste?&lt;/p&gt;
&lt;/blockquote&gt;

&lt;p&gt;Puedes configurar estos entornos en &lt;a href="https://apidog.com/download?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt; y seguir el flujo completo en la &lt;a href="https://apidog.com/es/blog/claude-opus-5-api?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de la API de Opus 5&lt;/a&gt;. Consulta también la &lt;a href="https://platform.claude.com/docs/en/about-claude/pricing" rel="noopener noreferrer"&gt;página de precios de Anthropic&lt;/a&gt; para las tarifas autorizadas.&lt;/p&gt;

&lt;h2&gt;
  
  
  El techo honesto
&lt;/h2&gt;

&lt;p&gt;Ninguno de estos dos modelos es la cima absoluta de la pila de Anthropic.&lt;/p&gt;

&lt;p&gt;Fable 5 sigue siendo el modelo más capaz lanzado ampliamente según la designación de Anthropic. Opus 5 no ha recibido esa etiqueta.&lt;/p&gt;

&lt;p&gt;Además, Anthropic afirma que Mythos 5 sigue por encima de Opus 5 en dos ejes concretos:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;&lt;strong&gt;Explotación de ciberseguridad&lt;/strong&gt;&lt;/li&gt;
&lt;li&gt;&lt;strong&gt;Investigación autónoma de biología&lt;/strong&gt;&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Mythos 5 fue lanzado junto a Fable 5 en un programa limitado, no para disponibilidad general. Por eso no es una opción para la mayoría de los equipos. Consulta la &lt;a href="https://apidog.com/es/blog/fable-5-vs-mythos-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;comparación Fable 5 vs Mythos 5&lt;/a&gt; para conocer la elegibilidad.&lt;/p&gt;

&lt;p&gt;La formulación precisa es esta:&lt;/p&gt;

&lt;blockquote&gt;
&lt;p&gt;&lt;strong&gt;Opus 5 ofrece capacidad de clase frontera a mitad de precio de frontera, con un techo de capacidad identificado por encima.&lt;/strong&gt;&lt;/p&gt;
&lt;/blockquote&gt;

&lt;p&gt;No significa que “el mejor modelo ahora cuesta la mitad”. Anthropic mantuvo la corona de capacidad en el modelo más caro.&lt;/p&gt;

&lt;h2&gt;
  
  
  Preguntas frecuentes
&lt;/h2&gt;

&lt;h3&gt;
  
  
  ¿Es Claude Opus 5 mejor que Fable 5?
&lt;/h3&gt;

&lt;p&gt;Según los benchmarks de Anthropic, Opus 5 supera a Fable 5 en OSWorld 2.0 y queda dentro del 0.5% del pico de Fable 5 en CursorBench 3.2. Estas cifras proceden del proveedor y no se habían reproducido de forma independiente hasta el 25 de julio de 2026.&lt;/p&gt;

&lt;p&gt;Anthropic sigue designando a Fable 5 como su modelo más capaz lanzado ampliamente, por lo que Fable 5 conserva la ventaja en tareas de máxima dificultad.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Cuánto más barato es Opus 5 que Fable 5?
&lt;/h3&gt;

&lt;p&gt;Exactamente la mitad en entrada y salida:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Opus 5:  $5 / $25 por MTok
Fable 5: $10 / $50 por MTok
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;La API Batch de Opus 5 reduce las tarifas a $2.50/$12.50 para trabajos no urgentes.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Qué modelo tiene la fecha de corte más reciente?
&lt;/h3&gt;

&lt;p&gt;Opus 5. Su fecha de corte es mayo de 2026, cuatro meses posterior a enero de 2026, la fecha de corte de Fable 5.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Debería migrar de Fable 5 a Opus 5?
&lt;/h3&gt;

&lt;p&gt;Primero mide tu volumen y ejecuta evaluaciones propias.&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Por debajo de unas pocas cientos de tareas difíciles al mes, los ahorros pueden no justificar la migración.&lt;/li&gt;
&lt;li&gt;Por encima de unas pocas miles de tareas al mes, el ahorro puede ser significativo, siempre que Opus 5 mantenga la calidad requerida en tu conjunto de evaluación.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  ¿Cuál es el ID de cada modelo?
&lt;/h3&gt;



&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Claude Opus 5:  claude-opus-5
Claude Fable 5: claude-fable-5
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;En Amazon Bedrock, Opus 5 es:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;anthropic.claude-opus-5
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;h3&gt;
  
  
  ¿Qué admite Opus 5 que Fable 5 no?
&lt;/h3&gt;

&lt;p&gt;Opus 5 expone &lt;code&gt;output_config.effort&lt;/code&gt; con niveles recalibrados, acepta mensajes de sistema a mitad de conversación, admite modo rápido a $10/$50 y permite cachear prompts de 512 tokens.&lt;/p&gt;

&lt;p&gt;Una diferencia en la otra dirección: Priority Tier no es compatible con Opus 5, aunque Opus 4.8 lo mantiene.&lt;/p&gt;

&lt;h2&gt;
  
  
  La respuesta corta
&lt;/h2&gt;

&lt;p&gt;Para la mayoría de los equipos, Opus 5 es la opción predeterminada. El factor decisivo es el volumen: a miles de tareas mensuales, el ahorro de 2x se convierte en presupuesto real.&lt;/p&gt;

&lt;p&gt;Elige Opus 5 si necesitas:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Menor coste por token.&lt;/li&gt;
&lt;li&gt;Mayor actualidad de conocimiento.&lt;/li&gt;
&lt;li&gt;Automatización de navegador o uso de ordenador.&lt;/li&gt;
&lt;li&gt;Ajustar calidad y coste con &lt;code&gt;output_config.effort&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Procesar muchas tareas de producción.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Mantén Fable 5 si:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;La tarea está en el límite de lo que un modelo puede resolver.&lt;/li&gt;
&lt;li&gt;Una única ejecución fallida tiene un coste alto.&lt;/li&gt;
&lt;li&gt;Tu volumen es bajo.&lt;/li&gt;
&lt;li&gt;La migración y recalibración superan los ahorros.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Finalmente, trata cada benchmark como lo que es: una medición del proveedor en su propio sistema de evaluación. Tu conjunto de pruebas es el desempate.&lt;/p&gt;

</description>
    </item>
    <item>
      <title>Claude Opus 5 Precios: Desglose Completo de Costos (2026)</title>
      <dc:creator>Roobia</dc:creator>
      <pubDate>Sat, 25 Jul 2026 03:16:14 +0000</pubDate>
      <link>https://dev.to/roobia/claude-opus-5-precios-desglose-completo-de-costos-2026-1m1o</link>
      <guid>https://dev.to/roobia/claude-opus-5-precios-desglose-completo-de-costos-2026-1m1o</guid>
      <description>&lt;p&gt;Claude Opus 5 se lanzó el 24 de julio de 2026 a $5 por millón de tokens de entrada y $25 por millón de tokens de salida. Esa es la misma tarifa que Anthropic cobraba por Opus 4.8 y exactamente la mitad de lo que cuesta Fable 5. El titular es correcto, pero no basta para estimar una factura.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation" class="crayons-btn crayons-btn--primary"&gt;Prueba Apidog hoy&lt;/a&gt;
&lt;/p&gt;

&lt;p&gt;Lo que suele faltar en los resúmenes de precios es lo que realmente determina el gasto: escrituras y lecturas de caché, descuentos por lotes, modo rápido, multiplicador regional y cambios de comportamiento que modifican el volumen de tokens. Esta guía reúne las tarifas y las aplica a solicitudes reales. Para verificar los cálculos con su tráfico, envíe solicitudes desde &lt;a href="https://apidog.com?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt; y revise el bloque &lt;code&gt;usage&lt;/code&gt; de cada respuesta.&lt;/p&gt;

&lt;h2&gt;
  
  
  La tabla de precios completa de Claude Opus 5
&lt;/h2&gt;

&lt;p&gt;Cada tarifa procede de la &lt;a href="https://platform.claude.com/docs/en/about-claude/pricing" rel="noopener noreferrer"&gt;documentación de precios&lt;/a&gt; de Anthropic y se aplica al ID de modelo &lt;code&gt;claude-opus-5&lt;/code&gt;.&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Categoría de token&lt;/th&gt;
&lt;th&gt;Precio por millón de tokens&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Entrada estándar&lt;/td&gt;
&lt;td&gt;$5.00&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Salida estándar&lt;/td&gt;
&lt;td&gt;$25.00&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Escritura en caché de prompt, TTL de 5 minutos&lt;/td&gt;
&lt;td&gt;$6.25&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Escritura en caché de prompt, TTL de 1 hora&lt;/td&gt;
&lt;td&gt;$10.00&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Aciertos y actualizaciones de caché&lt;/td&gt;
&lt;td&gt;$0.50&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Entrada de API por lotes&lt;/td&gt;
&lt;td&gt;$2.50&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Salida de API por lotes&lt;/td&gt;
&lt;td&gt;$12.50&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Entrada en modo rápido&lt;/td&gt;
&lt;td&gt;$10.00&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Salida en modo rápido&lt;/td&gt;
&lt;td&gt;$50.00&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;Puntos clave para implementar:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Los aciertos de caché cuestan una décima parte de la entrada estándar.&lt;/strong&gt; Es la palanca de ahorro más importante.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;La escritura de caché con TTL de 5 minutos cuesta 1.25x&lt;/strong&gt; la entrada estándar; el TTL de 1 hora cuesta 2x.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;La API por lotes tiene un descuento fijo del 50%&lt;/strong&gt; en entrada y salida.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;El modo rápido cuesta exactamente 2x&lt;/strong&gt; la tarifa estándar para una velocidad de salida de 2.5x. Es una vista previa de investigación, solo para API de terceros —no Bedrock, Google Cloud ni Microsoft Foundry— y no se combina con la API por lotes.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;No hay recargo por contexto largo.&lt;/strong&gt; La ventana de 1M de tokens es predeterminada y máxima; los tokens se facturan a la misma tarifa de $5 por millón.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fljm4q9ohbfq7xytayf4v.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fljm4q9ohbfq7xytayf4v.png" alt="Tabla visual de precios de Claude Opus 5" width="800" height="256"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;Esto también define el coste máximo de una llamada individual en la API de Mensajes: 1M de tokens de entrada más una salida máxima de 128k.&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Entrada: 1,000,000 / 1,000,000 × $5.00  = $5.00
Salida:    128,000 / 1,000,000 × $25.00 = $3.20
Total máximo: $8.20
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;En la API por lotes, la salida máxima puede subir a 300k con el encabezado beta &lt;code&gt;output-300k-2026-03-24&lt;/code&gt;. En ese caso, el lado de salida tiene un límite de $3.75.&lt;/p&gt;

&lt;h2&gt;
  
  
  El ancla: igual que 4.8, la mitad de Fable 5
&lt;/h2&gt;

&lt;p&gt;Así se posiciona Opus 5 frente a los modelos con los que probablemente lo comparará.&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Modelo&lt;/th&gt;
&lt;th&gt;Entrada / MTok&lt;/th&gt;
&lt;th&gt;Salida / MTok&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Claude Opus 5&lt;/td&gt;
&lt;td&gt;$5.00&lt;/td&gt;
&lt;td&gt;$25.00&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Claude Opus 4.8&lt;/td&gt;
&lt;td&gt;$5.00&lt;/td&gt;
&lt;td&gt;$25.00&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Claude Fable 5&lt;/td&gt;
&lt;td&gt;$10.00&lt;/td&gt;
&lt;td&gt;$50.00&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Claude Sonnet 5, introductorio hasta el 31 de agosto de 2026&lt;/td&gt;
&lt;td&gt;$2.00&lt;/td&gt;
&lt;td&gt;$10.00&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Claude Sonnet 5, desde el 1 de septiembre de 2026&lt;/td&gt;
&lt;td&gt;$3.00&lt;/td&gt;
&lt;td&gt;$15.00&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;Hay dos conclusiones prácticas:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;&lt;p&gt;&lt;strong&gt;Migrar desde Opus 4.8 no cambia el precio por token.&lt;/strong&gt; La tarifa es la misma que en 4.5, 4.6, 4.7 y 4.8. Sin embargo, sí puede cambiar el volumen total de tokens, especialmente por el pensamiento adaptativo y respuestas predeterminadas más largas. El &lt;a href="https://apidog.com/es/blog/claude-opus-4-8-pricing?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;desglose de precios de Opus 4.8&lt;/a&gt; sigue siendo válido para el ID anterior.&lt;/p&gt;&lt;/li&gt;
&lt;li&gt;&lt;p&gt;&lt;strong&gt;Opus 5 cuesta la mitad que Fable 5.&lt;/strong&gt; Anthropic afirma en el &lt;a href="https://www.anthropic.com/news/claude-opus-5" rel="noopener noreferrer"&gt;post de lanzamiento de Opus 5&lt;/a&gt; que está dentro del 0.5% del pico de Fable 5 en CursorBench 3.2 y que lo supera en OSWorld 2.0 a aproximadamente un tercio del coste por tarea. Son cifras del proveedor y nadie las había reproducido de forma independiente hasta el 25 de julio de 2026. Trátelas como afirmaciones, no como resultados comprobados.&lt;/p&gt;&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Para evaluar si la diferencia de precio compensa en su caso, consulte la &lt;a href="https://apidog.com/es/blog/claude-opus-5-vs-fable-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;comparación de Opus 5 vs Fable 5&lt;/a&gt; y el detalle de &lt;a href="https://apidog.com/es/blog/claude-fable-5-pricing?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;precios de Fable 5&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Ejemplo práctico 1: una única solicitud
&lt;/h2&gt;

&lt;p&gt;Suponga una llamada de resumen con:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;8,000 tokens de entrada&lt;/li&gt;
&lt;li&gt;1,200 tokens de salida&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;El cálculo es directo:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Entrada: 8,000 / 1,000,000 × $5.00   = $0.040
Salida:  1,200 / 1,000,000 × $25.00  = $0.030
Total por llamada                     = $0.070
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Con 10,000 llamadas mensuales:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;10,000 × $0.070 = $700/mes
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;La misma carga de trabajo costaría:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Fable 5:&lt;/strong&gt; $0.140 por llamada, o $1,400/mes.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Sonnet 5 con tarifa introductoria:&lt;/strong&gt; $0.028 por llamada, o $280/mes.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Aunque hay casi siete veces más tokens de entrada que de salida, la salida representa el 43% de la factura. La razón es simple: la salida cuesta cinco veces más que la entrada.&lt;/p&gt;

&lt;p&gt;Esto importa especialmente en Opus 5 porque los tokens de pensamiento se cobran como salida y el pensamiento adaptativo está activado de forma predeterminada.&lt;/p&gt;

&lt;h2&gt;
  
  
  Ejemplo práctico 2: una sesión de agente larga con caché
&lt;/h2&gt;

&lt;p&gt;Considere un agente de programación con:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Un prompt de sistema y contexto de repositorio de 120,000 tokens.&lt;/li&gt;
&lt;li&gt;Una sesión de 40 turnos.&lt;/li&gt;
&lt;li&gt;1,500 tokens nuevos de conversación por turno.&lt;/li&gt;
&lt;li&gt;2,500 tokens de salida por turno.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  Sin caché de prompt
&lt;/h3&gt;

&lt;p&gt;Sin caché, el contexto completo se reenvía en cada turno.&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Partida&lt;/th&gt;
&lt;th&gt;Tokens&lt;/th&gt;
&lt;th&gt;Tarifa&lt;/th&gt;
&lt;th&gt;Coste&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Entrada: 120,000 × 40, más 60,000 nuevos&lt;/td&gt;
&lt;td&gt;4,860,000&lt;/td&gt;
&lt;td&gt;$5.00&lt;/td&gt;
&lt;td&gt;$24.30&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Salida: 2,500 × 40&lt;/td&gt;
&lt;td&gt;100,000&lt;/td&gt;
&lt;td&gt;$25.00&lt;/td&gt;
&lt;td&gt;$2.50&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;&lt;strong&gt;Total&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;&lt;/td&gt;
&lt;td&gt;&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;$26.80&lt;/strong&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;h3&gt;
  
  
  Con caché de prompt de 5 minutos
&lt;/h3&gt;

&lt;p&gt;Si el prefijo de 120,000 tokens se almacena en caché:&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Partida&lt;/th&gt;
&lt;th&gt;Tokens&lt;/th&gt;
&lt;th&gt;Tarifa&lt;/th&gt;
&lt;th&gt;Coste&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Escritura en caché, una vez&lt;/td&gt;
&lt;td&gt;120,000&lt;/td&gt;
&lt;td&gt;$6.25&lt;/td&gt;
&lt;td&gt;$0.75&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Lecturas de caché: 39 turnos&lt;/td&gt;
&lt;td&gt;4,680,000&lt;/td&gt;
&lt;td&gt;$0.50&lt;/td&gt;
&lt;td&gt;$2.34&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Nueva entrada: 1,500 × 40&lt;/td&gt;
&lt;td&gt;60,000&lt;/td&gt;
&lt;td&gt;$5.00&lt;/td&gt;
&lt;td&gt;$0.30&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Salida: 2,500 × 40&lt;/td&gt;
&lt;td&gt;100,000&lt;/td&gt;
&lt;td&gt;$25.00&lt;/td&gt;
&lt;td&gt;$2.50&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;&lt;strong&gt;Total&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;&lt;/td&gt;
&lt;td&gt;&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;$5.89&lt;/strong&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;El ahorro es una &lt;strong&gt;reducción del 78%&lt;/strong&gt;:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Sin caché: $26.80
Con caché:  $5.89
Ahorro:    $20.91
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Después de cachear correctamente, la salida pasa a ser el siguiente objetivo de optimización: representa el 42% de la factura, frente al 9% sin caché.&lt;/p&gt;

&lt;h3&gt;
  
  
  Elegir el TTL correcto
&lt;/h3&gt;

&lt;p&gt;Las lecturas de caché actualizan el TTL de 5 minutos. Si los turnos del agente están separados por menos de cinco minutos, una sola escritura mantiene activa la caché.&lt;/p&gt;

&lt;p&gt;Si el agente permanece inactivo durante más tiempo, use el TTL de una hora:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Escritura de 5 minutos: 120,000 / 1,000,000 × $6.25 = $0.75
Escritura de 1 hora:    120,000 / 1,000,000 × $10.00 = $1.20
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;El total subiría a $6.34, que sigue siendo un 76% menor que ejecutar la sesión sin caché.&lt;/p&gt;

&lt;h2&gt;
  
  
  Ejemplo práctico 3: procesamiento por lotes
&lt;/h2&gt;

&lt;p&gt;La API por lotes reduce a la mitad el coste de entrada y salida para trabajos que no necesitan respuesta síncrona.&lt;/p&gt;

&lt;p&gt;Suponga 50,000 documentos, cada uno con:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;1,200 tokens de entrada&lt;/li&gt;
&lt;li&gt;150 tokens de salida&lt;/li&gt;
&lt;/ul&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Ruta&lt;/th&gt;
&lt;th&gt;Coste de entrada&lt;/th&gt;
&lt;th&gt;Coste de salida&lt;/th&gt;
&lt;th&gt;Total&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Estándar&lt;/td&gt;
&lt;td&gt;60 MTok × $5.00 = $300.00&lt;/td&gt;
&lt;td&gt;7.5 MTok × $25.00 = $187.50&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;$487.50&lt;/strong&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Por lotes&lt;/td&gt;
&lt;td&gt;60 MTok × $2.50 = $150.00&lt;/td&gt;
&lt;td&gt;7.5 MTok × $12.50 = $93.75&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;$243.75&lt;/strong&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;Los tokens y el modelo son los mismos. El ahorro es de &lt;strong&gt;$243.75&lt;/strong&gt;.&lt;/p&gt;

&lt;p&gt;Use lotes para cargas como:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Clasificación de contenido.&lt;/li&gt;
&lt;li&gt;Enriquecimiento de documentos.&lt;/li&gt;
&lt;li&gt;Evaluaciones offline.&lt;/li&gt;
&lt;li&gt;Resúmenes nocturnos.&lt;/li&gt;
&lt;li&gt;Retroalimentación no urgente.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;La compensación es latencia, no calidad. Si una tarea tolera entrega asíncrona, usar el endpoint estándar deja el 50% del presupuesto sin aprovechar.&lt;/p&gt;

&lt;h2&gt;
  
  
  Ejemplo práctico 4: lo que realmente cuesta el modo rápido
&lt;/h2&gt;

&lt;p&gt;El modo rápido duplica las tarifas:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Entrada: $10 por MTok
Salida:  $50 por MTok
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Al ejecutar la solicitud del primer ejemplo:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Entrada: 8,000 / 1,000,000 × $10.00  = $0.080
Salida:  1,200 / 1,000,000 × $50.00  = $0.060
Total por llamada                     = $0.140
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Es exactamente el doble del coste estándar.&lt;/p&gt;

&lt;p&gt;El modo rápido tiene sentido para interfaces interactivas donde el usuario percibe la velocidad de generación. Es difícil justificarlo para procesamiento en segundo plano.&lt;/p&gt;

&lt;p&gt;Además, no se combina con la API por lotes: las dos palancas de coste son mutuamente excluyentes.&lt;/p&gt;

&lt;h2&gt;
  
  
  Las cuatro palancas que realmente mueven su factura
&lt;/h2&gt;

&lt;h3&gt;
  
  
  1. El mínimo de caché de prompts se redujo a 512 tokens
&lt;/h3&gt;

&lt;p&gt;En Opus 4.8, el mínimo almacenable en caché era de 1,024 tokens. En Opus 5 es de &lt;strong&gt;512 tokens&lt;/strong&gt;.&lt;/p&gt;

&lt;p&gt;Esto permite cachear prompts de sistema y prefijos reutilizados que antes eran demasiado pequeños. El cambio de implementación consiste en añadir el bloque de control de caché al prefijo reutilizable.&lt;/p&gt;

&lt;p&gt;El punto de equilibrio llega rápido:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;TTL de 5 minutos:&lt;/strong&gt; rentable a partir de 1.3 solicitudes; gana desde la segunda llamada.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;TTL de 1 hora:&lt;/strong&gt; rentable a partir de 2.1 solicitudes; gana desde la tercera llamada.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Ejemplo: un prompt de sistema de 700 tokens reutilizado en 1,000 llamadas.&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Sin caché:
700,000 / 1,000,000 × $5.00 = $3.50

Con caché de 5 minutos:
Escritura: 700 / 1,000,000 × $6.25 = $0.0044
Lecturas:  999 × (700 / 1,000,000 × $0.50) = $0.3497
Total: $0.354
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Ese prompt no podía cachearse en Opus 4.8.&lt;/p&gt;

&lt;h3&gt;
  
  
  2. Procesamiento por lotes al 50%
&lt;/h3&gt;

&lt;p&gt;Audite qué cargas de trabajo necesitan realmente una respuesta síncrona.&lt;/p&gt;

&lt;p&gt;Una forma práctica de clasificar tareas:&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Tipo de carga&lt;/th&gt;
&lt;th&gt;Ruta recomendada&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Chat de usuario o autocompletado&lt;/td&gt;
&lt;td&gt;Estándar o modo rápido&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Clasificación masiva&lt;/td&gt;
&lt;td&gt;Por lotes&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Evaluaciones de prompts&lt;/td&gt;
&lt;td&gt;Por lotes&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Resúmenes programados&lt;/td&gt;
&lt;td&gt;Por lotes&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Procesamiento de cola de trabajos&lt;/td&gt;
&lt;td&gt;Por lotes&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;Mover una carga apta para lotes al endpoint por lotes reduce automáticamente el gasto de tokens a la mitad.&lt;/p&gt;

&lt;h3&gt;
  
  
  3. Los niveles de esfuerzo &lt;code&gt;low&lt;/code&gt; y &lt;code&gt;medium&lt;/code&gt; son utilizables
&lt;/h3&gt;

&lt;p&gt;&lt;code&gt;output_config.effort&lt;/code&gt; controla cuánto “piensa” el modelo. Los tokens de pensamiento se cobran como salida, a $25 por millón.&lt;/p&gt;

&lt;p&gt;Opus 5 recalibró estos niveles. Anthropic afirma que &lt;code&gt;low&lt;/code&gt; y &lt;code&gt;medium&lt;/code&gt; son significativamente más fuertes que en modelos Opus anteriores. El valor predeterminado es &lt;code&gt;high&lt;/code&gt;; &lt;code&gt;xhigh&lt;/code&gt; sigue siendo el ajuste recomendado para programación y trabajo de agentes.&lt;/p&gt;

&lt;p&gt;No migre la configuración de esfuerzo de Opus 4.8 sin medir. Ejecute el mismo conjunto de evaluaciones con cada nivel y compare:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Calidad o tasa de aprobación.&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;output_tokens&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Coste por tarea.&lt;/li&gt;
&lt;li&gt;Latencia.&lt;/li&gt;
&lt;li&gt;Tasa de truncamiento.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Si una tarea usa en promedio 8,000 tokens de pensamiento en &lt;code&gt;xhigh&lt;/code&gt; y 1,500 en &lt;code&gt;low&lt;/code&gt;, el ahorro teórico es:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;8,000 - 1,500 = 6,500 tokens de salida ahorrados

6,500 / 1,000,000 × $25.00 = $0.1625 por tarea
100,000 tareas × $0.1625 = $16,250
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Estas cifras son ilustrativas. La diferencia real depende de sus prompts y evaluaciones. La &lt;a href="https://apidog.com/es/blog/claude-opus-5-effort-parameter?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía del parámetro de esfuerzo&lt;/a&gt; explica cómo ejecutar ese barrido.&lt;/p&gt;

&lt;p&gt;Una trampa importante: bajar el esfuerzo reduce tokens de pensamiento, pero no garantiza respuestas visibles más cortas. Si necesita entregables más breves, indíquelo explícitamente en el prompt.&lt;/p&gt;

&lt;h3&gt;
  
  
  4. Menor sobrecarga del prompt del sistema para uso de herramientas
&lt;/h3&gt;

&lt;p&gt;Cuando envía definiciones de herramientas, la API inyecta un prompt del sistema que también se factura.&lt;/p&gt;

&lt;p&gt;En Opus 5, esa sobrecarga es de &lt;strong&gt;286 tokens&lt;/strong&gt; para elección de herramientas &lt;code&gt;auto&lt;/code&gt; o &lt;code&gt;none&lt;/code&gt;:&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Modelo&lt;/th&gt;
&lt;th&gt;Sobrecarga de herramientas&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Opus 5&lt;/td&gt;
&lt;td&gt;286 tokens&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Opus 4.8&lt;/td&gt;
&lt;td&gt;290 tokens&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Opus 4.7&lt;/td&gt;
&lt;td&gt;675 tokens&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;La diferencia frente a Opus 4.8 es de solo cuatro tokens: aproximadamente $20 por millón de solicitudes, por lo que es ruido.&lt;/p&gt;

&lt;p&gt;Frente a Opus 4.7, el ahorro es de 389 tokens por solicitud:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;389 / 1,000,000 × $5.00 = $0.001945 por solicitud
1,000,000 solicitudes × $0.001945 = $1,945
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Para optimizaciones aplicables a toda la línea Claude, consulte esta guía sobre &lt;a href="https://apidog.com/es/blog/cut-claude-api-bill?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;cómo reducir su factura de la API de Claude&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Dos partidas que la gente pasa por alto
&lt;/h2&gt;

&lt;h3&gt;
  
  
  El multiplicador &lt;code&gt;inference_geo: "us"&lt;/code&gt; es de 1.1x
&lt;/h3&gt;

&lt;p&gt;Fijar la inferencia a infraestructura solo de EE. UU. por cumplimiento o residencia de datos aplica un multiplicador de 1.1x a todas las categorías de tokens.&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Categoría&lt;/th&gt;
&lt;th&gt;Tarifa estándar&lt;/th&gt;
&lt;th&gt;Con &lt;code&gt;inference_geo: "us"&lt;/code&gt;
&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Entrada&lt;/td&gt;
&lt;td&gt;$5.00&lt;/td&gt;
&lt;td&gt;$5.50&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Salida&lt;/td&gt;
&lt;td&gt;$25.00&lt;/td&gt;
&lt;td&gt;$27.50&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Acierto de caché&lt;/td&gt;
&lt;td&gt;$0.50&lt;/td&gt;
&lt;td&gt;$0.55&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Entrada por lotes&lt;/td&gt;
&lt;td&gt;$2.50&lt;/td&gt;
&lt;td&gt;$2.75&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Salida por lotes&lt;/td&gt;
&lt;td&gt;$12.50&lt;/td&gt;
&lt;td&gt;$13.75&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;En el ejemplo de 10,000 llamadas mensuales:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Sin multiplicador: $700/mes
Con multiplicador 1.1x: $770/mes
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;En una factura de $50,000, representa $5,000 adicionales. Confirme que necesita esta fijación antes de activarla.&lt;/p&gt;

&lt;h3&gt;
  
  
  Priority Tier no es compatible con Opus 5
&lt;/h3&gt;

&lt;p&gt;Opus 4.8 mantiene compatibilidad con Priority Tier, pero Opus 5 no. Si su planificación de capacidad depende de esos compromisos, es una restricción real de migración.&lt;/p&gt;

&lt;p&gt;La &lt;a href="https://apidog.com/es/blog/claude-opus-5-migration-opus-4-8?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de migración de Opus 4.8 a Opus 5&lt;/a&gt; cubre este punto y otros cambios de API disruptivos.&lt;/p&gt;

&lt;h2&gt;
  
  
  Cambios de comportamiento que aparecen en su factura
&lt;/h2&gt;

&lt;p&gt;El precio por token es solo la mitad de la ecuación. El volumen de tokens es la otra mitad.&lt;/p&gt;

&lt;h3&gt;
  
  
  1. El pensamiento está activado por defecto
&lt;/h3&gt;

&lt;p&gt;En Opus 4.8, una solicitud sin el campo &lt;code&gt;thinking&lt;/code&gt; se ejecutaba sin pensamiento. En Opus 5, una solicitud equivalente usa pensamiento adaptativo y esos tokens se facturan como salida.&lt;/p&gt;

&lt;p&gt;Además, &lt;code&gt;max_tokens&lt;/code&gt; limita conjuntamente el pensamiento y la respuesta. Algunas cargas de trabajo pueden empezar a truncarse si mantienen el mismo límite.&lt;/p&gt;

&lt;h3&gt;
  
  
  2. Opus 5 delega a subagentes con más facilidad
&lt;/h3&gt;

&lt;p&gt;Cada subagente genera su propio conjunto de tokens facturados. Para cargas sensibles al coste:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Limite la delegación cuando no aporte valor.&lt;/li&gt;
&lt;li&gt;Restrinja el número de subagentes.&lt;/li&gt;
&lt;li&gt;Mida el gasto por flujo completo, no solo por respuesta final.&lt;/li&gt;
&lt;li&gt;Compare calidad y coste antes de habilitar delegación en producción.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  3. Opus 5 verifica su propio trabajo sin instrucciones explícitas
&lt;/h3&gt;

&lt;p&gt;Si conserva instrucciones como “doble verificación de su trabajo”, elimínelas y vuelva a medir. La &lt;a href="https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5" rel="noopener noreferrer"&gt;guía de prompts&lt;/a&gt; de Anthropic recomienda hacerlo porque Opus 5 ya realiza esa verificación.&lt;/p&gt;

&lt;p&gt;La sobreverificación consume tokens. Ninguno de estos cambios modifica el precio por token, pero todos pueden aumentar la factura.&lt;/p&gt;

&lt;h2&gt;
  
  
  Confirmando su gasto real con Apidog
&lt;/h2&gt;

&lt;p&gt;La forma más rápida de dejar de estimar es revisar el objeto &lt;code&gt;usage&lt;/code&gt; de cada respuesta. Incluye:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"usage"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"input_tokens"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="mi"&gt;0&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"output_tokens"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="mi"&gt;0&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"cache_creation_input_tokens"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="mi"&gt;0&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"cache_read_input_tokens"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="mi"&gt;0&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Este desglose permite verificar por separado entrada normal, salida, creación de caché y lecturas de caché.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Ff3pulre107yh0tkpx0ud.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Ff3pulre107yh0tkpx0ud.png" alt="Ejemplo de análisis de solicitudes en Apidog" width="799" height="530"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;&lt;a href="https://apidog.com?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt; es una plataforma de desarrollo y pruebas de API. Para validar el coste de Opus 5:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Cree una solicitud al endpoint de Mensajes con &lt;code&gt;"model": "claude-opus-5"&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Duplique la solicitud guardada para cada nivel de esfuerzo y compare el volumen de tokens de pensamiento con prompts idénticos.&lt;/li&gt;
&lt;li&gt;Compruebe que &lt;code&gt;usage.cache_read_input_tokens&lt;/code&gt; sea mayor que cero cuando espere un acierto de caché. Si es cero, trate el resultado como una prueba fallida antes de que se convierta en una factura sorpresa.&lt;/li&gt;
&lt;li&gt;Guarde las claves como variables de entorno en lugar de incluirlas en el cuerpo de la solicitud.&lt;/li&gt;
&lt;li&gt;Revise el flujo SSE para identificar dónde se consumen tokens de salida en generaciones largas.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;&lt;a href="https://apidog.com/download?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Descargue Apidog&lt;/a&gt; para ejecutar estas comprobaciones junto con el tutorial de la &lt;a href="https://apidog.com/es/blog/claude-opus-5-api?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de la API de Opus 5&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Lo que realmente está comprando por $5 / $25
&lt;/h2&gt;

&lt;p&gt;Opus 5 ofrece una posición fuerte en relación precio-capacidad, pero no es la cima de la pila de Claude.&lt;/p&gt;

&lt;p&gt;Fable 5 sigue siendo el modelo más capaz de Anthropic ampliamente lanzado. Opus 5 también sigue por detrás de Mythos 5 en explotación de ciberseguridad e investigación autónoma de biología, según Anthropic.&lt;/p&gt;

&lt;p&gt;La forma honesta de plantearlo es: capacidad de clase frontera a la mitad del precio de frontera, con un techo explícitamente nombrado por encima. El &lt;a href="https://apidog.com/es/blog/mythos-class-model-explained?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;explicador de clase Mythos&lt;/a&gt; cubre qué se sitúa por encima de esa línea.&lt;/p&gt;

&lt;p&gt;Para la mayoría de equipos, la pregunta no es Opus 5 frente al modelo superior. La pregunta es si la carga de trabajo necesita Opus o si &lt;a href="https://apidog.com/es/blog/claude-sonnet-5-pricing?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Sonnet 5&lt;/a&gt;, a $2 / $10 —y $3 / $15 desde el 1 de septiembre de 2026— puede hacer el trabajo por el 40% del precio.&lt;/p&gt;

&lt;p&gt;Ejecute ambos modelos contra sus propias evaluaciones antes de comprometer presupuesto. Consulte la &lt;a href="https://apidog.com/es/blog/what-is-claude-opus-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;visión general de Claude Opus 5&lt;/a&gt; para especificaciones y disponibilidad, y la &lt;a href="https://platform.claude.com/docs/en/about-claude/models/overview" rel="noopener noreferrer"&gt;visión general de modelos&lt;/a&gt; de Anthropic para la tabla canónica.&lt;/p&gt;

&lt;h2&gt;
  
  
  Preguntas frecuentes
&lt;/h2&gt;

&lt;h3&gt;
  
  
  ¿Cuánto cuesta Claude Opus 5?
&lt;/h3&gt;

&lt;p&gt;Cuesta $5 por millón de tokens de entrada y $25 por millón de tokens de salida en la API estándar. Los aciertos de caché cuestan $0.50 por millón, las ejecuciones por lotes cuestan $2.50 / $12.50 y el modo rápido $10 / $50.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Es Claude Opus 5 más caro que Opus 4.8?
&lt;/h3&gt;

&lt;p&gt;Por token, no: las tarifas son idénticas. Sin embargo, la factura puede aumentar porque el pensamiento está activado por defecto y las respuestas predeterminadas son más largas. Mida el volumen de tokens en su tráfico real antes de asumir paridad de coste.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Hay un recargo por contexto largo en la ventana de 1M?
&lt;/h3&gt;

&lt;p&gt;No. La ventana de contexto de 1M de tokens es predeterminada y máxima, sin un nivel premium para entradas largas.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Cuál es la forma más económica de ejecutar Claude Opus 5?
&lt;/h3&gt;

&lt;p&gt;Aplique estas tres medidas:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Almacene en caché prefijos reutilizados de al menos 512 tokens.&lt;/li&gt;
&lt;li&gt;Ejecute trabajos no urgentes mediante la API por lotes para obtener el descuento fijo del 50%.&lt;/li&gt;
&lt;li&gt;Pruebe niveles de esfuerzo hasta encontrar el más bajo que siga aprobando sus evaluaciones.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;La guía de &lt;a href="https://apidog.com/es/blog/claude-opus-5-free?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;ruta gratuita y más económica&lt;/a&gt; incluye más opciones.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿El anclaje regional tiene un coste adicional?
&lt;/h3&gt;

&lt;p&gt;Sí. Configurar &lt;code&gt;inference_geo: "us"&lt;/code&gt; aplica un multiplicador de 1.1x a todas las categorías de tokens, incluidos aciertos de caché y lotes.&lt;/p&gt;

</description>
    </item>
    <item>
      <title>¿Cómo usar la API de Claude Opus 5?</title>
      <dc:creator>Roobia</dc:creator>
      <pubDate>Sat, 25 Jul 2026 03:14:57 +0000</pubDate>
      <link>https://dev.to/roobia/como-usar-la-api-de-claude-opus-5-2pbl</link>
      <guid>https://dev.to/roobia/como-usar-la-api-de-claude-opus-5-2pbl</guid>
      <description>&lt;p&gt;Claude Opus 5 se lanzó el 24 de julio de 2026 y Anthropic lo recomienda como primera opción si no está seguro de qué modelo usar. El ID exacto del modelo para la API es &lt;code&gt;claude-opus-5&lt;/code&gt;, sin sufijo de fecha.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation" class="crayons-btn crayons-btn--primary"&gt;Prueba Apidog hoy&lt;/a&gt;
&lt;/p&gt;

&lt;p&gt;Esta guía cubre el flujo completo: crear una clave API, enviar su primera solicitud, usar streaming, implementar herramientas, controlar el pensamiento adaptativo con &lt;code&gt;effort&lt;/code&gt; y revisar &lt;code&gt;usage&lt;/code&gt; para validar la caché de prompts. Todas las solicitudes usan HTTP y JSON, por lo que puede construirlas y depurarlas en &lt;a href="https://apidog.com?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt; antes de integrarlas en su aplicación.&lt;/p&gt;

&lt;p&gt;Si migra desde Opus 4.8, revise también la &lt;a href="https://apidog.com/es/blog/claude-opus-5-migration-opus-4-8?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía completa de migración de Opus 4.8 a Opus 5&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Antes de su primera llamada: dos cambios disruptivos
&lt;/h2&gt;

&lt;h3&gt;
  
  
  1. El pensamiento está activado por defecto
&lt;/h3&gt;

&lt;p&gt;En Opus 4.8, una solicitud sin el campo &lt;code&gt;thinking&lt;/code&gt; se ejecutaba sin razonamiento. En Opus 5, la misma solicitud usa pensamiento adaptativo.&lt;/p&gt;

&lt;p&gt;&lt;code&gt;max_tokens&lt;/code&gt; sigue siendo un límite estricto para los tokens de pensamiento &lt;strong&gt;más&lt;/strong&gt; los tokens de salida. Si su integración de Opus 4.8 tenía un límite ajustado a la longitud esperada de la respuesta, Opus 5 puede truncarla.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;Acción recomendada:&lt;/strong&gt; aumente &lt;code&gt;max_tokens&lt;/code&gt; y compruebe &lt;code&gt;stop_reason&lt;/code&gt; en sus pruebas.&lt;/p&gt;

&lt;h3&gt;
  
  
  2. Desactivar el pensamiento limita el esfuerzo
&lt;/h3&gt;

&lt;p&gt;Esta combinación devuelve &lt;code&gt;400&lt;/code&gt;:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"thinking"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="nl"&gt;"type"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"disabled"&lt;/span&gt;&lt;span class="p"&gt;},&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"output_config"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="nl"&gt;"effort"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"xhigh"&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Cuando desactiva el pensamiento, el esfuerzo máximo permitido es &lt;code&gt;high&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;Elija una de estas opciones:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Mantenga el pensamiento activado y reduzca &lt;code&gt;effort&lt;/code&gt; para controlar costes.&lt;/li&gt;
&lt;li&gt;Desactive el pensamiento y limite &lt;code&gt;effort&lt;/code&gt; a &lt;code&gt;high&lt;/code&gt;.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Anthropic recomienda la primera opción. Con el pensamiento desactivado, Opus 5 puede escribir llamadas a herramientas como texto plano en lugar de ejecutarlas, y ocasionalmente puede filtrar etiquetas &lt;code&gt;&amp;lt;thinking&amp;gt;&lt;/code&gt; en la salida visible.&lt;/p&gt;

&lt;p&gt;Ambos cambios están documentados en la &lt;a href="https://platform.claude.com/docs/en/about-claude/models/migration-guide" rel="noopener noreferrer"&gt;guía de migración de modelos&lt;/a&gt; de Anthropic.&lt;/p&gt;

&lt;h2&gt;
  
  
  Paso 1: Obtener una clave API
&lt;/h2&gt;

&lt;p&gt;Inicie sesión en la Plataforma de Desarrolladores de Claude, abra las claves API de su organización y cree una clave nueva. Cópiela al crearla: no podrá verla otra vez.&lt;/p&gt;

&lt;p&gt;Guárdela como variable de entorno:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;&lt;span class="nb"&gt;export &lt;/span&gt;&lt;span class="nv"&gt;ANTHROPIC_API_KEY&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="s2"&gt;"sk-ant-..."&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;No incruste la clave directamente en el código ni en colecciones compartidas.&lt;/p&gt;

&lt;p&gt;Si prueba en una interfaz gráfica, cree un entorno con una variable llamada &lt;code&gt;ANTHROPIC_API_KEY&lt;/code&gt;. En Apidog puede usarla en los encabezados como:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;{{ANTHROPIC_API_KEY}}
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Así puede compartir solicitudes con el equipo sin exportar secretos.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fy5xdyqne3y7k364i7cwb.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fy5xdyqne3y7k364i7cwb.png" alt="Configuración de variable de entorno en Apidog" width="800" height="435"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;También necesita añadir créditos de facturación antes de enviar solicitudes. Opus 5 cuesta $5 por millón de tokens de entrada y $25 por millón de tokens de salida, igual que Opus 4.8. Consulte el &lt;a href="https://apidog.com/es/blog/claude-opus-5-pricing?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;desglose completo de precios&lt;/a&gt; para tarifas de caché, lotes y modo rápido.&lt;/p&gt;

&lt;h2&gt;
  
  
  Paso 2: Enviar su primera solicitud
&lt;/h2&gt;

&lt;p&gt;Use el endpoint:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;POST https://api.anthropic.com/v1/messages
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Incluya estos encabezados:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;&lt;code&gt;x-api-key&lt;/code&gt;&lt;/li&gt;
&lt;li&gt;&lt;code&gt;anthropic-version&lt;/code&gt;&lt;/li&gt;
&lt;li&gt;&lt;code&gt;content-type&lt;/code&gt;&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Ejemplo con &lt;code&gt;curl&lt;/code&gt;:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;curl https://api.anthropic.com/v1/messages &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--header&lt;/span&gt; &lt;span class="s2"&gt;"x-api-key: &lt;/span&gt;&lt;span class="nv"&gt;$ANTHROPIC_API_KEY&lt;/span&gt;&lt;span class="s2"&gt;"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--header&lt;/span&gt; &lt;span class="s2"&gt;"anthropic-version: 2023-06-01"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--header&lt;/span&gt; &lt;span class="s2"&gt;"content-type: application/json"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--data&lt;/span&gt; &lt;span class="s1"&gt;'{
    "model": "claude-opus-5",
    "max_tokens": 4096,
    "messages": [
      {
        "role": "user",
        "content": "Explain the difference between a 429 and a 529 from an API perspective."
      }
    ]
  }'&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Use &lt;code&gt;4096&lt;/code&gt; como punto de partida, no &lt;code&gt;1024&lt;/code&gt;. El pensamiento y la salida visible comparten el mismo presupuesto de &lt;code&gt;max_tokens&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;Ejemplo equivalente con el SDK oficial de Python:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight python"&gt;&lt;code&gt;&lt;span class="kn"&gt;import&lt;/span&gt; &lt;span class="n"&gt;os&lt;/span&gt;
&lt;span class="kn"&gt;from&lt;/span&gt; &lt;span class="n"&gt;anthropic&lt;/span&gt; &lt;span class="kn"&gt;import&lt;/span&gt; &lt;span class="n"&gt;Anthropic&lt;/span&gt;

&lt;span class="n"&gt;client&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="nc"&gt;Anthropic&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="n"&gt;api_key&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="n"&gt;os&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;environ&lt;/span&gt;&lt;span class="p"&gt;[&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;ANTHROPIC_API_KEY&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;])&lt;/span&gt;

&lt;span class="n"&gt;message&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;messages&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;create&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
    &lt;span class="n"&gt;model&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;claude-opus-5&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="n"&gt;max_tokens&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="mi"&gt;4096&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="n"&gt;messages&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="p"&gt;[&lt;/span&gt;
        &lt;span class="p"&gt;{&lt;/span&gt;
            &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;role&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;user&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
            &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;content&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;Explain the difference between a 429 and a 529 from an API perspective.&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
        &lt;span class="p"&gt;}&lt;/span&gt;
    &lt;span class="p"&gt;],&lt;/span&gt;
&lt;span class="p"&gt;)&lt;/span&gt;

&lt;span class="k"&gt;for&lt;/span&gt; &lt;span class="n"&gt;block&lt;/span&gt; &lt;span class="ow"&gt;in&lt;/span&gt; &lt;span class="n"&gt;message&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;content&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;
    &lt;span class="k"&gt;if&lt;/span&gt; &lt;span class="n"&gt;block&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nb"&gt;type&lt;/span&gt; &lt;span class="o"&gt;==&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;text&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;
        &lt;span class="nf"&gt;print&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="n"&gt;block&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;text&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;No asuma que &lt;code&gt;content[0].text&lt;/code&gt; contiene la respuesta. Con el pensamiento activado, &lt;code&gt;message.content&lt;/code&gt; puede contener primero un bloque &lt;code&gt;thinking&lt;/code&gt; y después un bloque &lt;code&gt;text&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;Opus 5 ofrece:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Ventana de contexto predeterminada y máxima de 1M de tokens.&lt;/li&gt;
&lt;li&gt;Máximo de 128k tokens de salida en la API de Mensajes.&lt;/li&gt;
&lt;li&gt;Fecha de corte de conocimiento de mayo de 2026.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Revise la &lt;a href="https://platform.claude.com/docs/en/about-claude/models/overview" rel="noopener noreferrer"&gt;descripción general de modelos&lt;/a&gt; y el &lt;a href="https://apidog.com/es/blog/what-is-claude-opus-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;explicador de Opus 5&lt;/a&gt; para más detalles.&lt;/p&gt;

&lt;h2&gt;
  
  
  Paso 3: Trabajar con pensamiento adaptativo
&lt;/h2&gt;

&lt;p&gt;El pensamiento adaptativo permite que el modelo decida cuánto razonamiento interno necesita una solicitud. No configure un presupuesto de pensamiento manualmente; controle el comportamiento mediante &lt;code&gt;output_config.effort&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;Implemente estas reglas:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Procese bloques por tipo.&lt;/strong&gt; Use &lt;code&gt;block.type == "text"&lt;/code&gt; para la salida visible y &lt;code&gt;block.type == "thinking"&lt;/code&gt; si necesita registrar razonamiento.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Conserve el contenido completo del asistente.&lt;/strong&gt; En conversaciones de múltiples turnos o flujos con herramientas, reenvíe &lt;code&gt;message.content&lt;/code&gt; completo.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Presupueste ambos tipos de tokens.&lt;/strong&gt; Pensamiento y respuesta comparten &lt;code&gt;max_tokens&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Compruebe truncamientos.&lt;/strong&gt; Si recibe &lt;code&gt;stop_reason: "max_tokens"&lt;/code&gt;, incremente el límite.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Para desactivar el pensamiento:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"model"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"claude-opus-5"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"max_tokens"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="mi"&gt;4096&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"thinking"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="nl"&gt;"type"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"disabled"&lt;/span&gt;&lt;span class="p"&gt;},&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"output_config"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="nl"&gt;"effort"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"high"&lt;/span&gt;&lt;span class="p"&gt;},&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"messages"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;[&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
      &lt;/span&gt;&lt;span class="nl"&gt;"role"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"user"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
      &lt;/span&gt;&lt;span class="nl"&gt;"content"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"Return only the HTTP status code."&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;]&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;No cambie &lt;code&gt;high&lt;/code&gt; por &lt;code&gt;xhigh&lt;/code&gt; o &lt;code&gt;max&lt;/code&gt;: la API devolverá &lt;code&gt;400&lt;/code&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Paso 4: Controlar el coste con &lt;code&gt;output_config.effort&lt;/code&gt;
&lt;/h2&gt;

&lt;p&gt;El parámetro &lt;code&gt;effort&lt;/code&gt; se configura dentro de &lt;code&gt;output_config&lt;/code&gt;:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"output_config"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"effort"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"high"&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Valores permitidos:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;&lt;code&gt;low&lt;/code&gt;&lt;/li&gt;
&lt;li&gt;&lt;code&gt;medium&lt;/code&gt;&lt;/li&gt;
&lt;li&gt;&lt;code&gt;high&lt;/code&gt;&lt;/li&gt;
&lt;li&gt;&lt;code&gt;xhigh&lt;/code&gt;&lt;/li&gt;
&lt;li&gt;&lt;code&gt;max&lt;/code&gt;&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;El valor predeterminado es &lt;code&gt;high&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;Ejemplo para una tarea de código con mayor esfuerzo:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;curl https://api.anthropic.com/v1/messages &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--header&lt;/span&gt; &lt;span class="s2"&gt;"x-api-key: &lt;/span&gt;&lt;span class="nv"&gt;$ANTHROPIC_API_KEY&lt;/span&gt;&lt;span class="s2"&gt;"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--header&lt;/span&gt; &lt;span class="s2"&gt;"anthropic-version: 2023-06-01"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--header&lt;/span&gt; &lt;span class="s2"&gt;"content-type: application/json"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--data&lt;/span&gt; &lt;span class="s1"&gt;'{
    "model": "claude-opus-5",
    "max_tokens": 65536,
    "output_config": {"effort": "xhigh"},
    "messages": [
      {
        "role": "user",
        "content": "Refactor this handler to stream responses and keep backpressure."
      }
    ]
  }'&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Tenga en cuenta estas reglas:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;
&lt;strong&gt;No reutilice directamente la configuración de Opus 4.8.&lt;/strong&gt; Los niveles fueron recalibrados. &lt;code&gt;low&lt;/code&gt; y &lt;code&gt;medium&lt;/code&gt; son más potentes en Opus 5 que en modelos Opus anteriores.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Evalúe con sus propios casos.&lt;/strong&gt; Envíe el mismo conjunto de prompts usando varios niveles de esfuerzo y compare calidad, latencia y consumo.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Use &lt;code&gt;xhigh&lt;/code&gt; como punto de partida para código y agentes.&lt;/strong&gt; Para turnos largos de agente, &lt;code&gt;65536&lt;/code&gt; es un límite inicial razonable.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Menor esfuerzo no significa respuestas más cortas.&lt;/strong&gt; Reduce el razonamiento interno, no necesariamente la longitud visible. Pida una respuesta breve explícitamente en el prompt.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Consulte la &lt;a href="https://apidog.com/es/blog/claude-opus-5-effort-parameter?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía detallada del parámetro de esfuerzo&lt;/a&gt; para una metodología de evaluación completa.&lt;/p&gt;

&lt;h2&gt;
  
  
  Paso 5: Transmitir la respuesta con streaming
&lt;/h2&gt;

&lt;p&gt;Añada &lt;code&gt;"stream": true&lt;/code&gt; para recibir eventos enviados por el servidor (SSE) en lugar de una única respuesta JSON.&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight python"&gt;&lt;code&gt;&lt;span class="k"&gt;with&lt;/span&gt; &lt;span class="n"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;messages&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;stream&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
    &lt;span class="n"&gt;model&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;claude-opus-5&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="n"&gt;max_tokens&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="mi"&gt;4096&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="n"&gt;messages&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="p"&gt;[&lt;/span&gt;
        &lt;span class="p"&gt;{&lt;/span&gt;
            &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;role&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;user&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
            &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;content&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;Draft a retry policy for a flaky upstream.&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
        &lt;span class="p"&gt;}&lt;/span&gt;
    &lt;span class="p"&gt;],&lt;/span&gt;
&lt;span class="p"&gt;)&lt;/span&gt; &lt;span class="k"&gt;as&lt;/span&gt; &lt;span class="n"&gt;stream&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;
    &lt;span class="k"&gt;for&lt;/span&gt; &lt;span class="n"&gt;text&lt;/span&gt; &lt;span class="ow"&gt;in&lt;/span&gt; &lt;span class="n"&gt;stream&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;text_stream&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;
        &lt;span class="nf"&gt;print&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="n"&gt;text&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="n"&gt;end&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;""&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="n"&gt;flush&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="bp"&gt;True&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt;

    &lt;span class="n"&gt;final&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;stream&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;get_final_message&lt;/span&gt;&lt;span class="p"&gt;()&lt;/span&gt;
    &lt;span class="nf"&gt;print&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="se"&gt;\n\n&lt;/span&gt;&lt;span class="s"&gt;usage:&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="n"&gt;final&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;usage&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;La secuencia SSE sigue este orden:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;message_start
content_block_start
content_block_delta
content_block_stop
message_delta
message_stop
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Con pensamiento activado, normalmente recibirá:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Un bloque de pensamiento con deltas &lt;code&gt;thinking_delta&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Un bloque de texto con deltas &lt;code&gt;text_delta&lt;/code&gt;.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;No renderice todos los deltas en el mismo búfer de interfaz. Si lo hace, mostrará el razonamiento del modelo a sus usuarios. Enrute los bloques &lt;code&gt;thinking&lt;/code&gt; y &lt;code&gt;text&lt;/code&gt; por separado desde el principio.&lt;/p&gt;

&lt;p&gt;Un cliente como &lt;a href="https://apidog.com?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt; permite inspeccionar los eventos SSE mientras llegan, verificar límites de bloques y validar el parser antes de implementar el controlador en producción.&lt;/p&gt;

&lt;h2&gt;
  
  
  Paso 6: Añadir uso de herramientas
&lt;/h2&gt;

&lt;p&gt;Defina las herramientas en el arreglo &lt;code&gt;tools&lt;/code&gt;. Cuando el modelo necesite una herramienta, devolverá:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"stop_reason"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"tool_use"&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Además, &lt;code&gt;message.content&lt;/code&gt; incluirá un bloque &lt;code&gt;tool_use&lt;/code&gt;. Ejecute la herramienta y reenvíe el resultado como un bloque &lt;code&gt;tool_result&lt;/code&gt;.&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight python"&gt;&lt;code&gt;&lt;span class="n"&gt;tools&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="p"&gt;[&lt;/span&gt;
    &lt;span class="p"&gt;{&lt;/span&gt;
        &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;name&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;get_order_status&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
        &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;description&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;Look up the current status of a customer order by ID.&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
        &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;input_schema&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="p"&gt;{&lt;/span&gt;
            &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;type&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;object&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
            &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;properties&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="p"&gt;{&lt;/span&gt;
                &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;order_id&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="p"&gt;{&lt;/span&gt;
                    &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;type&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;string&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
                    &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;description&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;The order ID, e.g. A-10293&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
                &lt;span class="p"&gt;}&lt;/span&gt;
            &lt;span class="p"&gt;},&lt;/span&gt;
            &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;required&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="p"&gt;[&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;order_id&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;],&lt;/span&gt;
        &lt;span class="p"&gt;},&lt;/span&gt;
    &lt;span class="p"&gt;}&lt;/span&gt;
&lt;span class="p"&gt;]&lt;/span&gt;

&lt;span class="n"&gt;message&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;messages&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;create&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
    &lt;span class="n"&gt;model&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;claude-opus-5&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="n"&gt;max_tokens&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="mi"&gt;4096&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="n"&gt;tools&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="n"&gt;tools&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="n"&gt;messages&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="p"&gt;[&lt;/span&gt;
        &lt;span class="p"&gt;{&lt;/span&gt;
            &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;role&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;user&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
            &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;content&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;What&lt;/span&gt;&lt;span class="sh"&gt;'&lt;/span&gt;&lt;span class="s"&gt;s the status of order A-10293?&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
        &lt;span class="p"&gt;}&lt;/span&gt;
    &lt;span class="p"&gt;],&lt;/span&gt;
&lt;span class="p"&gt;)&lt;/span&gt;

&lt;span class="k"&gt;if&lt;/span&gt; &lt;span class="n"&gt;message&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;stop_reason&lt;/span&gt; &lt;span class="o"&gt;==&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;tool_use&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;
    &lt;span class="n"&gt;call&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="nf"&gt;next&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="n"&gt;block&lt;/span&gt; &lt;span class="k"&gt;for&lt;/span&gt; &lt;span class="n"&gt;block&lt;/span&gt; &lt;span class="ow"&gt;in&lt;/span&gt; &lt;span class="n"&gt;message&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;content&lt;/span&gt; &lt;span class="k"&gt;if&lt;/span&gt; &lt;span class="n"&gt;block&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nb"&gt;type&lt;/span&gt; &lt;span class="o"&gt;==&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;tool_use&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt;
    &lt;span class="n"&gt;result&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="nf"&gt;get_order_status&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="o"&gt;**&lt;/span&gt;&lt;span class="n"&gt;call&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nb"&gt;input&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt;

    &lt;span class="n"&gt;follow_up&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;messages&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;create&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
        &lt;span class="n"&gt;model&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;claude-opus-5&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
        &lt;span class="n"&gt;max_tokens&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="mi"&gt;4096&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
        &lt;span class="n"&gt;tools&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="n"&gt;tools&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
        &lt;span class="n"&gt;messages&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="p"&gt;[&lt;/span&gt;
            &lt;span class="p"&gt;{&lt;/span&gt;
                &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;role&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;user&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
                &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;content&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;What&lt;/span&gt;&lt;span class="sh"&gt;'&lt;/span&gt;&lt;span class="s"&gt;s the status of order A-10293?&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
            &lt;span class="p"&gt;},&lt;/span&gt;
            &lt;span class="p"&gt;{&lt;/span&gt;
                &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;role&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;assistant&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
                &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;content&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="n"&gt;message&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;content&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
            &lt;span class="p"&gt;},&lt;/span&gt;
            &lt;span class="p"&gt;{&lt;/span&gt;
                &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;role&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;user&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
                &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;content&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="p"&gt;[&lt;/span&gt;
                    &lt;span class="p"&gt;{&lt;/span&gt;
                        &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;type&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;tool_result&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
                        &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;tool_use_id&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="n"&gt;call&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nb"&gt;id&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
                        &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;content&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="n"&gt;result&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
                    &lt;span class="p"&gt;}&lt;/span&gt;
                &lt;span class="p"&gt;],&lt;/span&gt;
            &lt;span class="p"&gt;},&lt;/span&gt;
        &lt;span class="p"&gt;],&lt;/span&gt;
    &lt;span class="p"&gt;)&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;La línea importante es esta:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight python"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;role&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;assistant&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;content&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="n"&gt;message&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;content&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;No reconstruya manualmente el turno del asistente. Reenviar &lt;code&gt;message.content&lt;/code&gt; conserva los bloques de pensamiento y evita degradar el bucle del agente.&lt;/p&gt;

&lt;p&gt;Detalles relevantes para agentes:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;El overhead del prompt del sistema para herramientas es de 286 tokens con &lt;code&gt;tool_choice&lt;/code&gt; configurado en &lt;code&gt;auto&lt;/code&gt; o &lt;code&gt;none&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Puede usar el encabezado beta &lt;code&gt;mid-conversation-tool-changes-2026-07-01&lt;/code&gt; para añadir o eliminar herramientas entre turnos sin invalidar la caché del prompt.&lt;/li&gt;
&lt;li&gt;Opus 5 delega a subagentes con más facilidad que Opus 4.8. Si necesita controlar costes, limite esa conducta explícitamente en el prompt de sistema.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Paso 7: Validar aciertos de caché con &lt;code&gt;usage&lt;/code&gt;
&lt;/h2&gt;

&lt;p&gt;Cada respuesta incluye un objeto &lt;code&gt;usage&lt;/code&gt;:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"usage"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"input_tokens"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="mi"&gt;84&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"cache_creation_input_tokens"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="mi"&gt;6421&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"cache_read_input_tokens"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="mi"&gt;0&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"output_tokens"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="mi"&gt;913&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Marque contenido estable con &lt;code&gt;cache_control&lt;/code&gt; para almacenarlo en caché:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"model"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"claude-opus-5"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"max_tokens"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="mi"&gt;4096&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"system"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;[&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
      &lt;/span&gt;&lt;span class="nl"&gt;"type"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"text"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
      &lt;/span&gt;&lt;span class="nl"&gt;"text"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"&amp;lt;your long, stable instructions and reference material&amp;gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
      &lt;/span&gt;&lt;span class="nl"&gt;"cache_control"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="nl"&gt;"type"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"ephemeral"&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;],&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"messages"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;[&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
      &lt;/span&gt;&lt;span class="nl"&gt;"role"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"user"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
      &lt;/span&gt;&lt;span class="nl"&gt;"content"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"Question one."&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;]&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Compruebe el comportamiento en dos llamadas consecutivas con el mismo prefijo:&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Llamada&lt;/th&gt;
&lt;th&gt;&lt;code&gt;cache_creation_input_tokens&lt;/code&gt;&lt;/th&gt;
&lt;th&gt;&lt;code&gt;cache_read_input_tokens&lt;/code&gt;&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Primera&lt;/td&gt;
&lt;td&gt;Mayor que 0&lt;/td&gt;
&lt;td&gt;&lt;code&gt;0&lt;/code&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Segunda&lt;/td&gt;
&lt;td&gt;Normalmente &lt;code&gt;0&lt;/code&gt;
&lt;/td&gt;
&lt;td&gt;Mayor que 0&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;Si los valores no cambian como espera, revise lo siguiente:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;El prefijo debe ser idéntico byte a byte.&lt;/li&gt;
&lt;li&gt;El contenido debe superar el mínimo de caché.&lt;/li&gt;
&lt;li&gt;No debe modificar instrucciones, herramientas o contenido estable entre llamadas.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;En Opus 5, el mínimo para caché de prompts es de &lt;strong&gt;512 tokens&lt;/strong&gt;, frente a 1.024 en Opus 4.8. Las lecturas de caché cuestan $0.50 por millón de tokens, frente a $5 por millón para la entrada base.&lt;/p&gt;

&lt;p&gt;Añada una aserción sobre &lt;code&gt;cache_read_input_tokens&lt;/code&gt; en su suite de pruebas. Así, una edición que invalide la caché se detectará antes de convertirse en un aumento de factura. Consulte también esta guía para &lt;a href="https://apidog.com/es/blog/cut-claude-api-bill?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;reducir su factura de la API de Claude&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Pruebe y depure el flujo completo en Apidog
&lt;/h2&gt;

&lt;p&gt;Todo el flujo es HTTP: encabezados de autenticación, cuerpo JSON, streaming SSE y respuestas que puede validar con aserciones. &lt;a href="https://apidog.com?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt; permite enviar, inspeccionar y probar estas solicitudes sin cambiar cómo Anthropic ejecuta la inferencia.&lt;/p&gt;

&lt;p&gt;Apidog no ejecuta el modelo ni enruta modelos: la inferencia sigue ocurriendo en Anthropic.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2F915to3otjt1lvds1uedx.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2F915to3otjt1lvds1uedx.png" alt="Prueba de solicitudes de Claude en Apidog" width="799" height="530"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;Configure una colección reutilizable:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;
&lt;strong&gt;Cree la solicitud.&lt;/strong&gt; Use &lt;code&gt;POST https://api.anthropic.com/v1/messages&lt;/code&gt;, los tres encabezados requeridos y una variable de entorno para la clave.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Guárdela en una colección.&lt;/strong&gt; El equipo reutiliza una solicitud validada en lugar de reconstruirla desde cero.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Duplique la solicitud por nivel de esfuerzo.&lt;/strong&gt; Cree variantes con &lt;code&gt;low&lt;/code&gt;, &lt;code&gt;medium&lt;/code&gt;, &lt;code&gt;high&lt;/code&gt; y &lt;code&gt;xhigh&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Ejecute el mismo prompt en cada variante.&lt;/strong&gt; Compare salida, latencia y uso de tokens.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Active streaming.&lt;/strong&gt; Añada &lt;code&gt;"stream": true&lt;/code&gt; e inspeccione eventos SSE para confirmar que los bloques &lt;code&gt;thinking&lt;/code&gt; y &lt;code&gt;text&lt;/code&gt; se manejan por separado.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Revise las llamadas a herramientas.&lt;/strong&gt; Si recibe &lt;code&gt;stop_reason: "tool_use"&lt;/code&gt;, inspeccione el objeto &lt;code&gt;input&lt;/code&gt; generado por el modelo y ajuste su &lt;code&gt;input_schema&lt;/code&gt; si es demasiado permisivo.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Añada aserciones.&lt;/strong&gt; Compruebe que &lt;code&gt;stop_reason&lt;/code&gt; no sea &lt;code&gt;max_tokens&lt;/code&gt; y que &lt;code&gt;cache_read_input_tokens&lt;/code&gt; sea mayor que cero en solicitudes repetidas.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;&lt;a href="https://apidog.com/download?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Descargue Apidog&lt;/a&gt; para seguir este flujo. La misma colección puede reutilizarse con &lt;a href="https://apidog.com/es/blog/claude-sonnet-5-api?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Sonnet 5&lt;/a&gt; o con sus &lt;a href="https://apidog.com/es/blog/how-to-use-claude-opus-4-8-api?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;solicitudes existentes de Opus 4.8&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Errores y trampas que encontrará
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;&lt;code&gt;400&lt;/code&gt; al combinar &lt;code&gt;thinking: disabled&lt;/code&gt; con &lt;code&gt;xhigh&lt;/code&gt; o &lt;code&gt;max&lt;/code&gt;.&lt;/strong&gt; Reduzca el esfuerzo a &lt;code&gt;high&lt;/code&gt; o reactive el pensamiento.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;&lt;code&gt;400&lt;/code&gt; con parámetros de muestreo.&lt;/strong&gt; &lt;code&gt;temperature&lt;/code&gt;, &lt;code&gt;top_p&lt;/code&gt; y &lt;code&gt;top_k&lt;/code&gt; con valores no predeterminados devuelven &lt;code&gt;400&lt;/code&gt;, igual que en Opus 4.8. Controle el formato mediante el prompt de sistema.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Respuestas truncadas.&lt;/strong&gt; Si recibe &lt;code&gt;stop_reason: "max_tokens"&lt;/code&gt;, el presupuesto fue consumido por pensamiento y salida. Aumente &lt;code&gt;max_tokens&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;El nivel de prioridad no es compatible con Opus 5.&lt;/strong&gt; Opus 4.8 sí lo mantiene. Evalúe este impacto antes de migrar tráfico empresarial.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Los mensajes de sistema a mitad de conversación funcionan.&lt;/strong&gt; Opus 5 acepta entradas &lt;code&gt;role: "system"&lt;/code&gt; dentro de &lt;code&gt;messages&lt;/code&gt;, donde Opus 4.8 devolvía &lt;code&gt;400&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Sobre-verificación.&lt;/strong&gt; Opus 5 ya verifica su trabajo sin que se lo pida. Elimine instrucciones heredadas como “verifique su respuesta antes de responder” si no aportan valor, porque consumen tokens de pensamiento.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  El límite honesto
&lt;/h2&gt;

&lt;p&gt;Opus 5 no es el modelo más capaz de la pila de Claude. Anthropic mantiene a Fable 5 como el modelo “más capaz lanzado ampliamente”, con un precio de $10 por millón de tokens de entrada y $50 por millón de tokens de salida.&lt;/p&gt;

&lt;p&gt;Opus 5 también está por detrás de Mythos 5 en explotación de ciberseguridad e investigación de biología autónoma, según Anthropic.&lt;/p&gt;

&lt;p&gt;Las cifras de lanzamiento —aproximadamente el doble de Opus 4.8 en Frontier-Bench v0.1, aproximadamente tres veces el siguiente mejor modelo en ARC-AGI 3 y dentro del 0,5 % de Fable 5 en CursorBench 3.2— son resultados proporcionados por Anthropic y no habían sido reproducidos de forma independiente al 25 de julio de 2026.&lt;/p&gt;

&lt;p&gt;Úselos como punto de partida, pero ejecute sus propias evaluaciones. Consulte la &lt;a href="https://apidog.com/es/blog/claude-opus-5-vs-fable-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;comparación de Opus 5 frente a Fable 5&lt;/a&gt; y la &lt;a href="https://www.anthropic.com/news/claude-opus-5" rel="noopener noreferrer"&gt;publicación de lanzamiento de Anthropic&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Preguntas frecuentes
&lt;/h2&gt;

&lt;h3&gt;
  
  
  ¿Cuál es el ID de modelo para Claude Opus 5?
&lt;/h3&gt;

&lt;p&gt;&lt;code&gt;claude-opus-5&lt;/code&gt;, exactamente y sin sufijo de fecha.&lt;/p&gt;

&lt;p&gt;En Amazon Bedrock es &lt;code&gt;anthropic.claude-opus-5&lt;/code&gt;. Google Cloud y la Plataforma Claude en AWS usan el ID de primera parte.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Por qué una solicitud de Opus 4.8 ahora se trunca en Opus 5?
&lt;/h3&gt;

&lt;p&gt;Porque el pensamiento está activado por defecto. &lt;code&gt;max_tokens&lt;/code&gt; limita pensamiento y respuesta juntos. Aumente el valor y compruebe si recibe:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"stop_reason"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"max_tokens"&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;h3&gt;
  
  
  ¿Por qué recibo un &lt;code&gt;400&lt;/code&gt; al desactivar pensamiento?
&lt;/h3&gt;

&lt;p&gt;Probablemente combinó:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"thinking"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="nl"&gt;"type"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"disabled"&lt;/span&gt;&lt;span class="p"&gt;},&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"output_config"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="nl"&gt;"effort"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"xhigh"&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Con pensamiento desactivado, limite &lt;code&gt;effort&lt;/code&gt; a &lt;code&gt;high&lt;/code&gt;. Alternativamente, active el pensamiento y reduzca el esfuerzo.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Necesito un encabezado beta para usar 1M de contexto?
&lt;/h3&gt;

&lt;p&gt;No. Opus 5 ofrece 1M de tokens como contexto predeterminado y máximo, sin encabezado beta ni prima de contexto largo.&lt;/p&gt;

&lt;p&gt;Para llegar a 300k de salida en la API por lotes, necesita el encabezado beta &lt;code&gt;output-300k-2026-03-24&lt;/code&gt;. La API de Mensajes limita la salida a 128k.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Puedo reutilizar la configuración de esfuerzo de Opus 4.8?
&lt;/h3&gt;

&lt;p&gt;No directamente. Anthropic recalibró los niveles y &lt;code&gt;low&lt;/code&gt; y &lt;code&gt;medium&lt;/code&gt; son más capaces en Opus 5. Ejecute un nuevo barrido de evaluación con sus propios prompts y métricas.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Apidog ejecuta el modelo?
&lt;/h3&gt;

&lt;p&gt;No. &lt;a href="https://apidog.com?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt; envía, inspecciona y prueba solicitudes HTTP. Anthropic ejecuta la inferencia. Apidog ayuda a manejar claves, streaming, llamadas a herramientas y aserciones sobre las respuestas.&lt;/p&gt;

</description>
    </item>
    <item>
      <title>¿Qué es Claude Opus 5? Especificaciones, Rendimiento y Precios</title>
      <dc:creator>Roobia</dc:creator>
      <pubDate>Sat, 25 Jul 2026 03:12:13 +0000</pubDate>
      <link>https://dev.to/roobia/que-es-claude-opus-5-especificaciones-rendimiento-y-precios-3bad</link>
      <guid>https://dev.to/roobia/que-es-claude-opus-5-especificaciones-rendimiento-y-precios-3bad</guid>
      <description>&lt;p&gt;Claude Opus 5 es el modelo Opus más reciente de Anthropic, lanzado el 24 de julio de 2026. Anthropic lo posiciona para codificación agentiva compleja y trabajo empresarial, y su documentación lo recomienda como punto de partida si no sabes qué modelo elegir. Cuesta $5 por millón de tokens de entrada y $25 por millón de tokens de salida: la misma tarifa que Opus 4.8 y la mitad que Fable 5.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation" class="crayons-btn crayons-btn--primary"&gt;Prueba Apidog hoy&lt;/a&gt;
&lt;/p&gt;

&lt;p&gt;Esta guía cubre especificaciones, precio, benchmarks de lanzamiento, cambios de API que afectan migraciones desde Opus 4.8, plataformas disponibles y límites conocidos. Si llamas al modelo mediante HTTP, puedes enviar e inspeccionar solicitudes con &lt;a href="https://apidog.com?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Claude Opus 5 de un vistazo
&lt;/h2&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Especificación&lt;/th&gt;
&lt;th&gt;Valor&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;ID del modelo API&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;claude-opus-5&lt;/code&gt; (sin sufijo de fecha)&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Lanzado&lt;/td&gt;
&lt;td&gt;24 de julio de 2026&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Ventana de contexto&lt;/td&gt;
&lt;td&gt;1,000,000 de tokens, predeterminada y máxima&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Salida máxima&lt;/td&gt;
&lt;td&gt;128,000 tokens en la API de Mensajes; 300,000 en la API por lotes con el encabezado beta &lt;code&gt;output-300k-2026-03-24&lt;/code&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Precio base&lt;/td&gt;
&lt;td&gt;$5 por millón de tokens de entrada; $25 por millón de tokens de salida&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Fecha de corte de conocimiento&lt;/td&gt;
&lt;td&gt;Mayo de 2026&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Pensamiento adaptativo&lt;/td&gt;
&lt;td&gt;Activado por defecto&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Niveles de esfuerzo&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;bajo&lt;/code&gt;, &lt;code&gt;medio&lt;/code&gt;, &lt;code&gt;alto&lt;/code&gt;, &lt;code&gt;muy alto&lt;/code&gt;, &lt;code&gt;máximo&lt;/code&gt;; por defecto &lt;code&gt;alto&lt;/code&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Nivel de prioridad&lt;/td&gt;
&lt;td&gt;No soportado&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Disponibilidad&lt;/td&gt;
&lt;td&gt;API de Claude, &lt;a href="http://claude.ai" rel="noopener noreferrer"&gt;claude.ai&lt;/a&gt;, Claude Code, Claude Cowork, Amazon Bedrock, Plataforma Claude en AWS, Google Cloud, Microsoft Foundry y GitHub Copilot&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;Tres detalles importan especialmente al implementarlo:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;
&lt;strong&gt;El contexto de 1M de tokens es predeterminado y máximo.&lt;/strong&gt; No requiere encabezado beta ni tiene una tarifa especial por contexto largo.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;La fecha de corte es mayo de 2026.&lt;/strong&gt; Es más reciente que Fable 5 y &lt;a href="https://apidog.com/es/blog/claude-sonnet-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Sonnet 5&lt;/a&gt;, que se mantienen en enero de 2026.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;No hay Nivel de Prioridad.&lt;/strong&gt; Opus 4.8 lo soporta, pero Opus 5 no. Si tu capacidad depende de esta función, revisa la &lt;a href="https://apidog.com/es/blog/claude-opus-5-migration-opus-4-8?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de migración&lt;/a&gt;.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Consulta la &lt;a href="https://platform.claude.com/docs/en/about-claude/models/overview" rel="noopener noreferrer"&gt;descripción general de modelos&lt;/a&gt; de Anthropic para la tabla oficial completa.&lt;/p&gt;

&lt;h2&gt;
  
  
  Qué es Claude Opus 5
&lt;/h2&gt;

&lt;p&gt;Opus 5 sucede a &lt;a href="https://apidog.com/es/blog/what-is-claude-opus-4-8?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Claude Opus 4.8&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;Usa estos identificadores según la plataforma:&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Plataforma&lt;/th&gt;
&lt;th&gt;ID del modelo&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;API de Claude&lt;/td&gt;
&lt;td&gt;&lt;code&gt;claude-opus-5&lt;/code&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Amazon Bedrock&lt;/td&gt;
&lt;td&gt;&lt;code&gt;anthropic.claude-opus-5&lt;/code&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Google Cloud&lt;/td&gt;
&lt;td&gt;&lt;code&gt;claude-opus-5&lt;/code&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Plataforma Claude en AWS&lt;/td&gt;
&lt;td&gt;ID de primera parte&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fassets.apidog.com%2Fblog-next%2F2026%2F07%2Fimage-239.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fassets.apidog.com%2Fblog-next%2F2026%2F07%2Fimage-239.png" alt="" width="800" height="793"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;El nivel Opus es la línea de alto rendimiento de Anthropic, por encima de Sonnet y por debajo de los modelos de investigación Fable y Mythos. Con Opus 5, Anthropic cambia su recomendación: en vez de usar Sonnet como opción predeterminada y escalar a Opus, ahora indica empezar con Opus 5.&lt;/p&gt;

&lt;p&gt;También se convierte en el modelo predeterminado para suscriptores Max y en el modelo de mayor rendimiento para Pro. Consulta las &lt;a href="https://apidog.com/es/blog/claude-opus-5-free?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;rutas gratuitas y de pago más baratas&lt;/a&gt; para evaluar qué ofrece cada plan.&lt;/p&gt;

&lt;h2&gt;
  
  
  Precio y rendimiento
&lt;/h2&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Tarifa&lt;/th&gt;
&lt;th&gt;Entrada por M de tokens&lt;/th&gt;
&lt;th&gt;Salida por M de tokens&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Estándar&lt;/td&gt;
&lt;td&gt;$5.00&lt;/td&gt;
&lt;td&gt;$25.00&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;API por lotes (50% de descuento)&lt;/td&gt;
&lt;td&gt;$2.50&lt;/td&gt;
&lt;td&gt;$12.50&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Modo rápido (vista previa de investigación)&lt;/td&gt;
&lt;td&gt;$10.00&lt;/td&gt;
&lt;td&gt;$50.00&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Escritura en caché, TTL de 5 minutos&lt;/td&gt;
&lt;td&gt;$6.25&lt;/td&gt;
&lt;td&gt;n/a&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Escritura en caché, TTL de 1 hora&lt;/td&gt;
&lt;td&gt;$10.00&lt;/td&gt;
&lt;td&gt;n/a&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Aciertos y actualizaciones de caché&lt;/td&gt;
&lt;td&gt;$0.50&lt;/td&gt;
&lt;td&gt;n/a&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;&lt;a href="https://apidog.com/es/blog/what-is-claude-fable-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Claude Fable 5&lt;/a&gt; cuesta $10 por millón de tokens de entrada y $50 por millón de tokens de salida. Anthropic afirma que Opus 5 se encuentra a menos de un 0.5% de Fable 5 en codificación agentiva, a la mitad del precio.&lt;/p&gt;

&lt;h3&gt;
  
  
  Palancas prácticas para reducir costo
&lt;/h3&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Usa caché de prompts:&lt;/strong&gt; el mínimo baja de 1,024 a 512 tokens frente a Opus 4.8.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Reutiliza prefijos estables:&lt;/strong&gt; los aciertos de caché cuestan $0.50 por millón de tokens, una décima parte de la entrada base.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Envía trabajo diferible a Batch API:&lt;/strong&gt; reduce entrada y salida un 50%.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Evalúa el modo rápido solo si la latencia compensa:&lt;/strong&gt; duplica el precio, pero Anthropic indica aproximadamente 2.5 veces la velocidad de salida.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Evita &lt;code&gt;inference_geo: "us"&lt;/code&gt; si no es obligatorio:&lt;/strong&gt; aplica un multiplicador de 1.1x a entrada, salida, escrituras y aciertos de caché.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;El modo rápido solo está disponible en la API de primera parte. No funciona en Bedrock, Google Cloud, Microsoft Foundry ni Batch API.&lt;/p&gt;

&lt;p&gt;Consulta el &lt;a href="https://apidog.com/es/blog/claude-opus-5-pricing?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;desglose de precios de Opus 5&lt;/a&gt;, las recomendaciones para &lt;a href="https://apidog.com/es/blog/cut-claude-api-bill?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;reducir tu factura de Claude API&lt;/a&gt; y la &lt;a href="https://platform.claude.com/docs/en/about-claude/pricing" rel="noopener noreferrer"&gt;página oficial de precios&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Benchmarks: qué afirma Anthropic
&lt;/h2&gt;

&lt;p&gt;Los siguientes números son afirmaciones publicadas por Anthropic en el lanzamiento. A fecha del 25 de julio de 2026, no habían sido reproducidos de forma independiente. Úsalos como señales para decidir qué evaluar, no como sustituto de pruebas con tu código, prompts y herramientas.&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Benchmark&lt;/th&gt;
&lt;th&gt;Afirmación de Anthropic&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Frontier-Bench v0.1&lt;/td&gt;
&lt;td&gt;Supera a todos los demás modelos y más que duplica la puntuación de Opus 4.8, con menor costo por tarea&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;ARC-AGI 3&lt;/td&gt;
&lt;td&gt;Aproximadamente 3 veces la puntuación del siguiente mejor modelo&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;OSWorld 2.0&lt;/td&gt;
&lt;td&gt;Supera a Fable 5 a un tercio del costo&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;CursorBench 3.2&lt;/td&gt;
&lt;td&gt;A menos de 0.5% del pico de Fable 5, a mitad de precio&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Zapier AutomationBench&lt;/td&gt;
&lt;td&gt;Tasa de aprobación aproximadamente 1.5 veces mayor que la del siguiente mejor modelo&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Química orgánica&lt;/td&gt;
&lt;td&gt;+10.2 puntos frente a Opus 4.8&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Análisis de proteínas&lt;/td&gt;
&lt;td&gt;+7.7 puntos frente a Opus 4.8&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;Para evaluar estas afirmaciones en tu entorno:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Selecciona tareas reales de tu repositorio o flujo de automatización.&lt;/li&gt;
&lt;li&gt;Ejecuta el mismo conjunto de prompts con Opus 5, Opus 4.8 y, si aplica, Fable 5.&lt;/li&gt;
&lt;li&gt;Registra tasa de éxito, pasos de herramientas, tokens de entrada, tokens de salida y latencia.&lt;/li&gt;
&lt;li&gt;Evalúa costo por tarea completada, no solo costo por token.&lt;/li&gt;
&lt;li&gt;Repite la prueba para cada nivel de esfuerzo que planees usar.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;La &lt;a href="https://apidog.com/es/blog/claude-opus-5-benchmarks?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;exploración de benchmarks&lt;/a&gt; explica qué mide cada evaluación y qué conviene replicar.&lt;/p&gt;

&lt;h2&gt;
  
  
  El límite conocido
&lt;/h2&gt;

&lt;p&gt;Opus 5 no es el modelo más capaz de toda la gama Claude.&lt;/p&gt;

&lt;p&gt;Fable 5 conserva la designación de “modelo más capaz ampliamente lanzado”. En explotación de ciberseguridad e investigación biológica autónoma, Anthropic indica que Mythos 5 sigue por delante.&lt;/p&gt;

&lt;p&gt;En términos prácticos:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Usa Opus 5 para codificación agentiva, automatización empresarial y flujos intensivos en herramientas.&lt;/li&gt;
&lt;li&gt;Evalúa Fable 5 o Mythos 5 si tu carga de trabajo depende específicamente de investigación de seguridad o trabajo científico autónomo.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Consulta el &lt;a href="https://apidog.com/es/blog/mythos-class-model-explained?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;explicador del modelo Mythos&lt;/a&gt; y la comparación &lt;a href="https://apidog.com/es/blog/fable-5-vs-mythos-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Fable 5 vs Mythos 5&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Dos cambios que rompen código de Opus 4.8
&lt;/h2&gt;

&lt;p&gt;Cambiar solo el ID del modelo no basta. Hay dos cambios que debes revisar antes de desplegar.&lt;/p&gt;

&lt;h3&gt;
  
  
  1. El pensamiento está activado por defecto
&lt;/h3&gt;

&lt;p&gt;En Opus 4.8, una solicitud sin el campo &lt;code&gt;thinking&lt;/code&gt; se ejecutaba sin pensamiento. En Opus 5, esa misma solicitud usa pensamiento adaptativo.&lt;/p&gt;

&lt;p&gt;&lt;code&gt;max_tokens&lt;/code&gt; sigue limitando conjuntamente los tokens de pensamiento y la respuesta visible. Por eso, un valor dimensionado para la salida de Opus 4.8 puede truncar una respuesta en Opus 5 sin devolver un error.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;Acción recomendada:&lt;/strong&gt; aumenta &lt;code&gt;max_tokens&lt;/code&gt;, monitoriza respuestas incompletas y mide el consumo real antes de fijar límites de producción.&lt;/p&gt;

&lt;h3&gt;
  
  
  2. No puedes desactivar pensamiento con esfuerzo alto
&lt;/h3&gt;

&lt;p&gt;Esta combinación devuelve un error 400:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"thinking"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="nl"&gt;"type"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"disabled"&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;},&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"output_config"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"effort"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"muy alto"&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;El mismo problema aplica con &lt;code&gt;máximo&lt;/code&gt;. Si migras una configuración que desactiva pensamiento y aumenta el esfuerzo, la solicitud fallará inmediatamente.&lt;/p&gt;

&lt;p&gt;Además, ten en cuenta estos cambios:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Los niveles de esfuerzo se recalibraron.&lt;/li&gt;
&lt;li&gt;Ya no necesitas encabezado beta para la ventana de contexto.&lt;/li&gt;
&lt;li&gt;Ahora se aceptan mensajes del sistema a mitad de conversación.&lt;/li&gt;
&lt;li&gt;El Nivel de Prioridad desapareció.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Consulta la &lt;a href="https://apidog.com/es/blog/claude-opus-5-migration-opus-4-8?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de migración de Opus 4.8 a Opus 5&lt;/a&gt;, la &lt;a href="https://platform.claude.com/docs/en/about-claude/models/migration-guide" rel="noopener noreferrer"&gt;guía de migración oficial&lt;/a&gt; y el &lt;a href="https://apidog.com/es/blog/how-to-use-claude-opus-4-8-api?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;recorrido de la API de Opus 4.8&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Ajusta &lt;code&gt;output_config.effort&lt;/code&gt;
&lt;/h2&gt;

&lt;p&gt;El parámetro &lt;code&gt;output_config.effort&lt;/code&gt; controla cuánto piensa el modelo antes de responder y, por tanto, el costo de la solicitud.&lt;/p&gt;

&lt;p&gt;Los niveles disponibles son:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;bajo
medio
alto
muy alto
máximo
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;El valor predeterminado es &lt;code&gt;alto&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;Anthropic recomienda repetir el barrido de esfuerzo al migrar desde Opus 4.8 porque los niveles fueron recalibrados. Los niveles &lt;code&gt;bajo&lt;/code&gt; y &lt;code&gt;medio&lt;/code&gt; son más capaces que en modelos Opus anteriores, mientras que &lt;code&gt;muy alto&lt;/code&gt; sigue siendo el punto de partida recomendado para codificación y bucles agentivos.&lt;/p&gt;

&lt;p&gt;Prueba una matriz mínima:&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Caso de uso&lt;/th&gt;
&lt;th&gt;Esfuerzos iniciales&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Clasificación, extracción o formato&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;bajo&lt;/code&gt;, &lt;code&gt;medio&lt;/code&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Refactorizaciones acotadas&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;medio&lt;/code&gt;, &lt;code&gt;alto&lt;/code&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Codificación agentiva&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;alto&lt;/code&gt;, &lt;code&gt;muy alto&lt;/code&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Planificación o tareas complejas&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;muy alto&lt;/code&gt;, &lt;code&gt;máximo&lt;/code&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;Mide calidad, duración, uso de herramientas y tokens antes de elegir un valor predeterminado. La &lt;a href="https://apidog.com/es/blog/claude-opus-5-effort-parameter?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía del parámetro de esfuerzo&lt;/a&gt; incluye un proceso de evaluación más detallado.&lt;/p&gt;

&lt;h2&gt;
  
  
  Cambios de comportamiento que afectan prompts
&lt;/h2&gt;

&lt;p&gt;La &lt;a href="https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5" rel="noopener noreferrer"&gt;guía de prompting de Anthropic&lt;/a&gt; para Opus 5 describe cambios que alteran resultados aunque tu código no cambie.&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Verifica su trabajo sin pedirlo.&lt;/strong&gt; Elimina instrucciones heredadas como “revisa tu respuesta”, porque pueden causar sobreverificación y aumentar tokens.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Genera respuestas más largas.&lt;/strong&gt; Bajar el esfuerzo reduce pensamiento, no necesariamente la longitud de la salida visible. Pide concisión explícitamente.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Delega más fácilmente a subagentes.&lt;/strong&gt; Limita o acota esa delegación si el costo importa.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Puede ampliar el alcance de una tarea.&lt;/strong&gt; Define límites concretos: archivos permitidos, criterios de aceptación y cambios excluidos.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Ejemplo de instrucción acotada:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Refactoriza únicamente src/handlers/auth.ts.

Restricciones:
- No cambies la interfaz pública.
- No modifiques dependencias.
- No crees archivos nuevos.
- Devuelve un resumen de máximo 5 viñetas.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Con pensamiento desactivado pueden aparecer llamadas a herramientas como texto plano o etiquetas XML internas en la salida visible. En un bucle agentivo, ese contenido puede contaminar turnos posteriores. La mitigación recomendada por Anthropic es mantener el pensamiento activado y reducir el costo mediante un esfuerzo menor.&lt;/p&gt;

&lt;p&gt;Consulta la &lt;a href="https://apidog.com/es/blog/prompting-claude-opus-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de prompting de Opus 5&lt;/a&gt; y la &lt;a href="https://apidog.com/es/blog/claude-opus-5-claude-code?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de Claude Code&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Dónde ejecutar Opus 5
&lt;/h2&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Plataforma&lt;/th&gt;
&lt;th&gt;Estado&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;API de Claude&lt;/td&gt;
&lt;td&gt;Disponible como &lt;code&gt;claude-opus-5&lt;/code&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;&lt;a href="http://claude.ai" rel="noopener noreferrer"&gt;claude.ai&lt;/a&gt;&lt;/td&gt;
&lt;td&gt;Disponible; predeterminado para Max y modelo superior para Pro&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Claude Code&lt;/td&gt;
&lt;td&gt;Disponible&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Claude Cowork&lt;/td&gt;
&lt;td&gt;Disponible&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Amazon Bedrock&lt;/td&gt;
&lt;td&gt;Disponible como &lt;code&gt;anthropic.claude-opus-5&lt;/code&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Plataforma Claude en AWS&lt;/td&gt;
&lt;td&gt;Disponible con ID de primera parte&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Google Cloud&lt;/td&gt;
&lt;td&gt;Disponible como &lt;code&gt;claude-opus-5&lt;/code&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Microsoft Foundry&lt;/td&gt;
&lt;td&gt;Disponible&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;GitHub Copilot&lt;/td&gt;
&lt;td&gt;Disponible&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;El modo rápido es la excepción: solo está disponible en la API de primera parte.&lt;/p&gt;

&lt;h2&gt;
  
  
  Probar solicitudes de Opus 5 con Apidog
&lt;/h2&gt;

&lt;p&gt;Llamar a Opus 5 implica manejar autenticación, JSON, streaming SSE, respuestas y errores reproducibles. &lt;a href="https://apidog.com?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt; permite guardar estas solicitudes en colecciones, usar variables de entorno para las claves y revisar cada respuesta.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fassets.apidog.com%2Fblog-next%2F2026%2F07%2Fimage-239.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fassets.apidog.com%2Fblog-next%2F2026%2F07%2Fimage-239.png" alt="" width="800" height="793"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;Configura una colección de pruebas así:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Guarda &lt;code&gt;ANTHROPIC_API_KEY&lt;/code&gt; como variable de entorno.&lt;/li&gt;
&lt;li&gt;Crea una solicitud base de Mensajes.&lt;/li&gt;
&lt;li&gt;Duplica la solicitud para comparar &lt;code&gt;bajo&lt;/code&gt;, &lt;code&gt;alto&lt;/code&gt; y &lt;code&gt;muy alto&lt;/code&gt; con el mismo prompt.&lt;/li&gt;
&lt;li&gt;Habilita streaming SSE cuando necesites localizar truncamientos.&lt;/li&gt;
&lt;li&gt;Revisa el bloque &lt;code&gt;usage&lt;/code&gt; de cada respuesta para medir caché y tokens consumidos.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Solicitud de referencia:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;curl https://api.anthropic.com/v1/messages &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--header&lt;/span&gt; &lt;span class="s2"&gt;"x-api-key: &lt;/span&gt;&lt;span class="nv"&gt;$ANTHROPIC_API_KEY&lt;/span&gt;&lt;span class="s2"&gt;"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--header&lt;/span&gt; &lt;span class="s2"&gt;"anthropic-version: 2023-06-01"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--header&lt;/span&gt; &lt;span class="s2"&gt;"content-type: application/json"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--data&lt;/span&gt; &lt;span class="s1"&gt;'{
    "model": "claude-opus-5",
    "max_tokens": 8192,
    "messages": [
      {
        "role": "user",
        "content": "Refactor this handler and explain the tradeoffs."
      }
    ]
  }'&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Esta solicitud usa pensamiento adaptativo porque no incluye el campo &lt;code&gt;thinking&lt;/code&gt;. Asigna suficiente espacio a &lt;code&gt;max_tokens&lt;/code&gt;: un límite de 1,024 que funcionaba en Opus 4.8 puede truncar la respuesta en Opus 5.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://apidog.com/download?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Descarga Apidog&lt;/a&gt; para importar la solicitud. La &lt;a href="https://apidog.com/es/blog/claude-opus-5-api?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía paso a paso de la API&lt;/a&gt; cubre streaming, uso de herramientas y lectura de &lt;code&gt;usage&lt;/code&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Quién debería usar Claude Opus 5
&lt;/h2&gt;

&lt;p&gt;Usa Opus 5 si:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Construyes agentes o flujos intensivos en herramientas.&lt;/strong&gt; Es el caso de uso donde Anthropic concentra sus optimizaciones y afirmaciones de benchmark.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Usas Fable 5 y quieres reducir costo.&lt;/strong&gt; Evalúa si la diferencia declarada de rendimiento justifica pasar a un modelo que cuesta la mitad. Consulta &lt;a href="https://apidog.com/es/blog/claude-opus-5-vs-fable-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Opus 5 vs Fable 5&lt;/a&gt;.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Ya usas Opus 4.8.&lt;/strong&gt; Mantienes el mismo precio, pero debes validar la migración.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Necesitas conocimiento más reciente.&lt;/strong&gt; Su fecha de corte de mayo de 2026 supera a otros modelos Claude actuales por aproximadamente cuatro meses.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Mantente en otra opción si:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;El Nivel de Prioridad es crítico.&lt;/strong&gt; Opus 4.8 lo mantiene. Revisa los &lt;a href="https://apidog.com/es/blog/claude-opus-4-8-pricing?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;precios y niveles de Opus 4.8&lt;/a&gt;.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Tu carga es económica y de alto volumen.&lt;/strong&gt; Sonnet 5 puede ser suficiente y cuesta menos. Consulta &lt;a href="https://apidog.com/es/blog/claude-opus-5-vs-sonnet-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Opus 5 vs Sonnet 5&lt;/a&gt;.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Realizas explotación de ciberseguridad o investigación biológica autónoma.&lt;/strong&gt; Mythos 5 sigue liderando en esas áreas.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Preguntas frecuentes
&lt;/h2&gt;

&lt;h3&gt;
  
  
  ¿Cuál es el ID del modelo para Claude Opus 5?
&lt;/h3&gt;

&lt;p&gt;En la API de Claude es &lt;code&gt;claude-opus-5&lt;/code&gt;, sin sufijo de fecha. En Amazon Bedrock usa &lt;code&gt;anthropic.claude-opus-5&lt;/code&gt;. Google Cloud y Claude Platform en AWS usan &lt;code&gt;claude-opus-5&lt;/code&gt;.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Cuánto cuesta Claude Opus 5?
&lt;/h3&gt;

&lt;p&gt;Cuesta $5 por millón de tokens de entrada y $25 por millón de tokens de salida. Batch API reduce esas tarifas a $2.50 y $12.50. El modo rápido las duplica a $10 y $50.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Es Claude Opus 5 mejor que Fable 5?
&lt;/h3&gt;

&lt;p&gt;Según los números publicados por Anthropic, está cerca pero no por delante de forma general. Anthropic informa una diferencia de menos de 0.5% en CursorBench 3.2 y ventaja en OSWorld 2.0 a menor costo, mientras Fable 5 conserva la designación de modelo más capaz ampliamente lanzado. Estos resultados no habían sido reproducidos de forma independiente.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Cuál es la ventana de contexto?
&lt;/h3&gt;

&lt;p&gt;1,000,000 de tokens, tanto predeterminada como máxima. No requiere encabezado beta ni tiene prima de precio por contexto largo. La salida máxima es 128,000 tokens en la API de Mensajes o 300,000 mediante Batch API con &lt;code&gt;output-300k-2026-03-24&lt;/code&gt;.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Necesito cambiar código al actualizar desde Opus 4.8?
&lt;/h3&gt;

&lt;p&gt;Sí. El pensamiento se activa por defecto, así que revisa &lt;code&gt;max_tokens&lt;/code&gt; para evitar truncamientos silenciosos. Además, combinar &lt;code&gt;thinking: {type: "disabled"}&lt;/code&gt; con esfuerzo &lt;code&gt;xhigh&lt;/code&gt; o &lt;code&gt;max&lt;/code&gt; devuelve un error 400. Repite también tu evaluación de niveles de esfuerzo.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Cuál es la fecha de corte de conocimiento?
&lt;/h3&gt;

&lt;p&gt;Mayo de 2026, tanto para conocimiento fiable como para datos de entrenamiento.&lt;/p&gt;

</description>
    </item>
    <item>
      <title>¿Todavía necesitas un cliente API si usas Cursor o Copilot?</title>
      <dc:creator>Roobia</dc:creator>
      <pubDate>Thu, 23 Jul 2026 07:04:52 +0000</pubDate>
      <link>https://dev.to/roobia/todavia-necesitas-un-cliente-api-si-usas-cursor-o-copilot-1g5j</link>
      <guid>https://dev.to/roobia/todavia-necesitas-un-cliente-api-si-usas-cursor-o-copilot-1g5j</guid>
      <description>&lt;p&gt;Describe el endpoint en lenguaje sencillo. Cursor escribe la llamada &lt;code&gt;fetch&lt;/code&gt;. Copilot autocompleta los encabezados. El código compila, así que surge la pregunta: si el agente del editor escribe la llamada a la API, ¿por qué mantener abierto un cliente API separado?&lt;/p&gt;

&lt;p&gt;&lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation" class="crayons-btn crayons-btn--primary"&gt;Prueba Apidog hoy&lt;/a&gt;
&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;Por lo general, sí.&lt;/strong&gt; Cursor y Copilot pueden escribir una buena primera versión de una llamada a la API, pero hay dos tareas que siguen fuera del IDE:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Darle al agente la especificación real de tu API para que no adivine endpoints.&lt;/li&gt;
&lt;li&gt;Ejecutar la llamada generada contra el servicio en vivo para comprobar que funciona.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Un cliente API con un servidor MCP y una CLI cubre ambas. Esta es la versión específica para IDE de una pregunta más amplia: &lt;a href="https://apidog.com/es/blog/still-need-api-tool-ai-agents?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;¿todavía necesitas una herramienta API en la era de los agentes de IA?&lt;/a&gt;&lt;/p&gt;

&lt;h2&gt;
  
  
  Lo que Cursor y Copilot ya hacen bien
&lt;/h2&gt;

&lt;p&gt;Los agentes de IDE son útiles para eliminar trabajo repetitivo.&lt;/p&gt;

&lt;p&gt;Pide a Cursor un &lt;code&gt;GET&lt;/code&gt; paginado con reintentos y normalmente generará:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Configuración del cliente.&lt;/li&gt;
&lt;li&gt;Manejo de errores.&lt;/li&gt;
&lt;li&gt;Tipos.&lt;/li&gt;
&lt;li&gt;Bucle de paginación.&lt;/li&gt;
&lt;li&gt;Estructura coherente con tu proyecto.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Copilot también acelera el trabajo de continuación: después de escribir una llamada, puede completar el resto del CRUD siguiendo el estilo existente. Claude Code y Cline pueden conectar módulos de cliente completos a partir de una descripción breve.&lt;/p&gt;

&lt;p&gt;Por ejemplo, un agente puede producir rápidamente un borrador como este:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight typescript"&gt;&lt;code&gt;&lt;span class="k"&gt;async&lt;/span&gt; &lt;span class="kd"&gt;function&lt;/span&gt; &lt;span class="nf"&gt;listUsers&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="nx"&gt;page&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="mi"&gt;1&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt; &lt;span class="p"&gt;{&lt;/span&gt;
  &lt;span class="kd"&gt;const&lt;/span&gt; &lt;span class="nx"&gt;response&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="k"&gt;await&lt;/span&gt; &lt;span class="nf"&gt;fetch&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
    &lt;span class="s2"&gt;`https://api.example.com/v1/users?page=&lt;/span&gt;&lt;span class="p"&gt;${&lt;/span&gt;&lt;span class="nx"&gt;page&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="s2"&gt;`&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="p"&gt;{&lt;/span&gt;
      &lt;span class="na"&gt;headers&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="p"&gt;{&lt;/span&gt;
        &lt;span class="na"&gt;Authorization&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="s2"&gt;`Bearer &lt;/span&gt;&lt;span class="p"&gt;${&lt;/span&gt;&lt;span class="nx"&gt;process&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;env&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;API_TOKEN&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="s2"&gt;`&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
      &lt;span class="p"&gt;},&lt;/span&gt;
    &lt;span class="p"&gt;}&lt;/span&gt;
  &lt;span class="p"&gt;);&lt;/span&gt;

  &lt;span class="k"&gt;if &lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="o"&gt;!&lt;/span&gt;&lt;span class="nx"&gt;response&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;ok&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt; &lt;span class="p"&gt;{&lt;/span&gt;
    &lt;span class="k"&gt;throw&lt;/span&gt; &lt;span class="k"&gt;new&lt;/span&gt; &lt;span class="nc"&gt;Error&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="s2"&gt;`Request failed: &lt;/span&gt;&lt;span class="p"&gt;${&lt;/span&gt;&lt;span class="nx"&gt;response&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;status&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="s2"&gt;`&lt;/span&gt;&lt;span class="p"&gt;);&lt;/span&gt;
  &lt;span class="p"&gt;}&lt;/span&gt;

  &lt;span class="k"&gt;return&lt;/span&gt; &lt;span class="nx"&gt;response&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;json&lt;/span&gt;&lt;span class="p"&gt;();&lt;/span&gt;
&lt;span class="p"&gt;}&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Eso elimina trabajo real. El problema no es que el agente escriba mal código; el problema es que puede estar escribiendo código correcto para una API que no es la tuya.&lt;/p&gt;

&lt;h2&gt;
  
  
  Las dos tareas que tu agente IDE deja abiertas
&lt;/h2&gt;

&lt;p&gt;A partir de 2026, la división es simple: el agente cubre la escritura, pero no cubre por sí solo la fundamentación ni la ejecución.&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Tarea&lt;/th&gt;
&lt;th&gt;¿La cubre el agente del IDE?&lt;/th&gt;
&lt;th&gt;Qué cubre la brecha&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Escribir un borrador inicial de llamada a la API&lt;/td&gt;
&lt;td&gt;Sí, bien&lt;/td&gt;
&lt;td&gt;Sigue usando Cursor o Copilot&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Autocompletar el resto del cliente&lt;/td&gt;
&lt;td&gt;Sí&lt;/td&gt;
&lt;td&gt;Sigue usando el agente&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Conocer tus endpoints, campos y autenticación reales&lt;/td&gt;
&lt;td&gt;No, adivina a partir de patrones&lt;/td&gt;
&lt;td&gt;Tu especificación, alimentada al agente a través de MCP&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Confirmar que la llamada devuelve lo que esperas&lt;/td&gt;
&lt;td&gt;No&lt;/td&gt;
&lt;td&gt;Un cliente o CLI que la ejecuta&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Volver a ejecutar la comprobación en cada commit en CI&lt;/td&gt;
&lt;td&gt;No&lt;/td&gt;
&lt;td&gt;Un ejecutor de pruebas determinista&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Mostrar la solicitud exacta que envió el agente&lt;/td&gt;
&lt;td&gt;No&lt;/td&gt;
&lt;td&gt;Un historial de solicitudes inspeccionable&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;Las dos filas más importantes son conocer tu API real y ejecutar llamadas contra ella.&lt;/p&gt;

&lt;h2&gt;
  
  
  Brecha 1: el agente necesita tu especificación real, no una suposición
&lt;/h2&gt;

&lt;p&gt;El error más común de un agente IDE es la invención confiada.&lt;/p&gt;

&lt;p&gt;Puede escribir:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight http"&gt;&lt;code&gt;&lt;span class="err"&gt;POST /v1/users
Content-Type: application/json

{
  "name": "Ana"
}
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;porque es un patrón frecuente en APIs públicas. Sin embargo, tu API podría requerir esto:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight http"&gt;&lt;code&gt;&lt;span class="err"&gt;POST /v1/accounts
X-Tenant-ID: tenant_123
Content-Type: application/json

{
  "full_name": "Ana García"
}
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;El primer ejemplo puede compilar sin problemas y fallar en la primera llamada real.&lt;/p&gt;

&lt;p&gt;Una instrucción mejor no resuelve completamente el problema: el agente no es perezoso, sino que no conoce tu esquema. La solución es darle acceso a la especificación que ya mantienes.&lt;/p&gt;

&lt;p&gt;Para eso sirve el &lt;a href="https://modelcontextprotocol.io" rel="noopener noreferrer"&gt;Protocolo de Contexto del Modelo (MCP)&lt;/a&gt;. MCP permite que un agente consulte contexto externo, como una definición de API, mientras escribe código.&lt;/p&gt;

&lt;p&gt;Conecta tu especificación mediante MCP para que el agente pueda consultar:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Rutas reales.&lt;/li&gt;
&lt;li&gt;Parámetros requeridos.&lt;/li&gt;
&lt;li&gt;Esquemas de solicitud y respuesta.&lt;/li&gt;
&lt;li&gt;Métodos de autenticación.&lt;/li&gt;
&lt;li&gt;Encabezados obligatorios.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;a href="https://apidog.com/es/blog/apidog-mcp-server?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;El Servidor MCP de Apidog&lt;/a&gt; ofrece esta integración. Puedes iniciarlo con:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;npx apidog-mcp-server
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Después, apúntalo a tu proyecto API o a un archivo OpenAPI. Tu especificación queda disponible dentro de Cursor, GitHub Copilot, Claude Code o Cline.&lt;/p&gt;

&lt;p&gt;El flujo práctico es:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Mantén tu definición OpenAPI como fuente de verdad.&lt;/li&gt;
&lt;li&gt;Inicia el servidor MCP:
&lt;/li&gt;
&lt;/ol&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;   npx apidog-mcp-server
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;ol&gt;
&lt;li&gt;Configura tu agente IDE para usar el servidor MCP.&lt;/li&gt;
&lt;li&gt;Pide al agente que implemente una operación usando la especificación disponible.&lt;/li&gt;
&lt;li&gt;Revisa el código generado y ejecuta la llamada.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;El comando no requiere cuenta para probarlo. Puedes validar primero si el agente deja de inventar rutas o campos antes de iniciar sesión.&lt;/p&gt;

&lt;p&gt;Consulta el tutorial de &lt;a href="https://apidog.com/es/blog/vibe-coding-with-apidog-mcp-server?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;codificación con vibra con el Servidor MCP de Apidog&lt;/a&gt;. Si MCP es nuevo para ti, revisa también &lt;a href="https://apidog.com/es/blog/what-is-mcp-client?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;qué es un cliente MCP&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;La especificación que proporcionas es la definición de &lt;a href="https://www.openapis.org/" rel="noopener noreferrer"&gt;OpenAPI&lt;/a&gt; que ya mantienes. No necesitas crear otro formato ni duplicar la fuente de verdad.&lt;/p&gt;

&lt;h2&gt;
  
  
  Brecha 2: algo tiene que ejecutar lo que el agente escribió
&lt;/h2&gt;

&lt;p&gt;Fundamentar al agente mejora lo que escribe, pero no confirma que la llamada funcione.&lt;/p&gt;

&lt;p&gt;Un agente puede generar una prueba como esta:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight typescript"&gt;&lt;code&gt;&lt;span class="nf"&gt;it&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="s2"&gt;creates an account&lt;/span&gt;&lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="k"&gt;async &lt;/span&gt;&lt;span class="p"&gt;()&lt;/span&gt; &lt;span class="o"&gt;=&amp;gt;&lt;/span&gt; &lt;span class="p"&gt;{&lt;/span&gt;
  &lt;span class="kd"&gt;const&lt;/span&gt; &lt;span class="nx"&gt;response&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="k"&gt;await&lt;/span&gt; &lt;span class="nf"&gt;fetch&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="s2"&gt;`&lt;/span&gt;&lt;span class="p"&gt;${&lt;/span&gt;&lt;span class="nx"&gt;baseUrl&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="s2"&gt;/v1/accounts`&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="p"&gt;{&lt;/span&gt;
    &lt;span class="na"&gt;method&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="s2"&gt;POST&lt;/span&gt;&lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="na"&gt;headers&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="p"&gt;{&lt;/span&gt;
      &lt;span class="na"&gt;Authorization&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="s2"&gt;`Bearer &lt;/span&gt;&lt;span class="p"&gt;${&lt;/span&gt;&lt;span class="nx"&gt;token&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="s2"&gt;`&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
      &lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="s2"&gt;X-Tenant-ID&lt;/span&gt;&lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="nx"&gt;tenantId&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
      &lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="s2"&gt;Content-Type&lt;/span&gt;&lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="s2"&gt;application/json&lt;/span&gt;&lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="p"&gt;},&lt;/span&gt;
    &lt;span class="na"&gt;body&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="nx"&gt;JSON&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;stringify&lt;/span&gt;&lt;span class="p"&gt;({&lt;/span&gt;
      &lt;span class="na"&gt;full_name&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="s2"&gt;Ana García&lt;/span&gt;&lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="p"&gt;}),&lt;/span&gt;
  &lt;span class="p"&gt;});&lt;/span&gt;

  &lt;span class="nf"&gt;expect&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="nx"&gt;response&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;status&lt;/span&gt;&lt;span class="p"&gt;).&lt;/span&gt;&lt;span class="nf"&gt;toBe&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="mi"&gt;201&lt;/span&gt;&lt;span class="p"&gt;);&lt;/span&gt;
&lt;span class="p"&gt;});&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Pero todavía necesitas ejecutarla contra un entorno real y comprobar:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;¿El endpoint devuelve &lt;code&gt;200&lt;/code&gt;, &lt;code&gt;201&lt;/code&gt; u otro estado esperado?&lt;/li&gt;
&lt;li&gt;¿El cuerpo de respuesta coincide con el contrato?&lt;/li&gt;
&lt;li&gt;¿La autenticación funciona?&lt;/li&gt;
&lt;li&gt;¿Los encabezados requeridos se enviaron realmente?&lt;/li&gt;
&lt;li&gt;¿La comprobación falla de forma consistente en CI?&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Un agente puede variar de una ejecución a otra. Una puerta de fusión no debe hacerlo: para el mismo commit, debe producir el mismo resultado de éxito o fallo.&lt;/p&gt;

&lt;p&gt;Aquí encaja la &lt;a href="https://apidog.com/es/blog/apidog-cli-ai-agent-workflows?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;CLI de Apidog en un flujo de trabajo de agente&lt;/a&gt;. La CLI ejecuta casos de prueba guardados sin interfaz, devuelve un código de salida real y puede fallar la compilación cuando un contrato se rompe.&lt;/p&gt;

&lt;p&gt;El flujo es directo:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;El agente redacta o actualiza la prueba.&lt;/li&gt;
&lt;li&gt;Guardas el caso de prueba.&lt;/li&gt;
&lt;li&gt;La CLI lo ejecuta en CI.&lt;/li&gt;
&lt;li&gt;El pipeline usa el código de salida para aprobar o bloquear la fusión.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;El agente redacta la verificación; la CLI la ejecuta repetidamente sin variar.&lt;/p&gt;

&lt;h2&gt;
  
  
  Ver lo que envió el agente
&lt;/h2&gt;

&lt;p&gt;Cuando falla una llamada generada, el resumen del agente no reemplaza la solicitud real.&lt;/p&gt;

&lt;p&gt;Por ejemplo, el agente puede indicar que usó un token válido, pero la solicitud enviada podría contener un token caducado. Para depurar el problema necesitas inspeccionar:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;URL final.&lt;/li&gt;
&lt;li&gt;Método HTTP.&lt;/li&gt;
&lt;li&gt;Encabezados exactos.&lt;/li&gt;
&lt;li&gt;Cuerpo enviado.&lt;/li&gt;
&lt;li&gt;Código de estado.&lt;/li&gt;
&lt;li&gt;Cuerpo de respuesta.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Un cliente API mantiene un historial de solicitudes inspeccionable para ese trabajo.&lt;/p&gt;

&lt;p&gt;Apidog también incluye un Cliente MCP y un Depurador de Agentes de IA para revisar llamadas realizadas por un agente. El flujo visual se explica en &lt;a href="https://apidog.com/es/blog/from-apis-to-ai-agents-visual-debugging-with-apidog-mcp-client?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;depuración visual con el Cliente MCP de Apidog&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;Es importante distinguir responsabilidades: estas son superficies de inspección. Apidog lee y verifica lo que hizo tu agente en la capa API; no escribe ni ejecuta el agente por ti.&lt;/p&gt;

&lt;h2&gt;
  
  
  Cuándo basta un agente IDE por sí solo
&lt;/h2&gt;

&lt;p&gt;Hay casos donde puedes omitir el cliente API:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Estás escribiendo un script desechable y una llamada es suficiente.&lt;/li&gt;
&lt;li&gt;Estás probando dos o tres endpoints que ya conoces perfectamente.&lt;/li&gt;
&lt;li&gt;Nadie más depende del resultado.&lt;/li&gt;
&lt;li&gt;No estás enviando cambios a otro equipo ni integrándote con un servicio externo.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;En esos casos, un agente más una línea de &lt;code&gt;curl&lt;/code&gt; puede bastar:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;curl &lt;span class="nt"&gt;-X&lt;/span&gt; GET &lt;span class="s2"&gt;"https://api.example.com/v1/users"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;-H&lt;/span&gt; &lt;span class="s2"&gt;"Authorization: Bearer &lt;/span&gt;&lt;span class="nv"&gt;$API_TOKEN&lt;/span&gt;&lt;span class="s2"&gt;"&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;El cliente API se vuelve necesario cuando la llamada debe ser correcta para otra persona:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Envías cambios a usuarios reales.&lt;/li&gt;
&lt;li&gt;Otros equipos dependen de tu contrato.&lt;/li&gt;
&lt;li&gt;Necesitas verificaciones repetibles en CI.&lt;/li&gt;
&lt;li&gt;Una respuesta incorrecta tiene impacto operativo o económico.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Dónde encaja Apidog
&lt;/h2&gt;

&lt;p&gt;&lt;a href="https://apidog.com?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt; funciona como capa de fundamentación y verificación alrededor de cualquier agente que escriba código.&lt;/p&gt;

&lt;p&gt;No reemplaza a Cursor ni a Copilot. Les proporciona la especificación real para reducir suposiciones y ejecuta las llamadas o pruebas generadas para comprobar el resultado.&lt;/p&gt;

&lt;p&gt;Para empezar con un flujo de trabajo basado en agente IDE:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;npx apidog-mcp-server
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Usa el servidor MCP para exponer tu especificación al agente y utiliza la CLI para ejecutar pruebas en un pipeline.&lt;/p&gt;

&lt;p&gt;Cuando el proyecto supera unos pocos endpoints, el diseño, el mock inteligente y las pruebas automatizadas con aserciones visuales residen en la misma plataforma. &lt;a href="https://apidog.com/download?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Descarga Apidog&lt;/a&gt; si quieres seguir el ejemplo; el nivel gratuito cubre la fundamentación y la ejecución.&lt;/p&gt;

&lt;h2&gt;
  
  
  Preguntas frecuentes
&lt;/h2&gt;

&lt;h3&gt;
  
  
  ¿Copilot necesita Postman u otro cliente API?
&lt;/h3&gt;

&lt;p&gt;Para un script rápido, no necesariamente. Para algo que entregas, generalmente sí.&lt;/p&gt;

&lt;p&gt;Copilot puede escribir la llamada, pero no conoce tus endpoints reales sin una especificación y no puede confirmar por sí solo que la llamada funciona contra el servicio. Un cliente con servidor MCP y ejecutor de pruebas cubre ambas tareas.&lt;/p&gt;

&lt;p&gt;La misma respuesta aplica a Copilot, Cursor, Claude Code y Cline.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Cómo conoce el agente mis endpoints?
&lt;/h3&gt;

&lt;p&gt;Solo si se los proporcionas.&lt;/p&gt;

&lt;p&gt;Sin contexto, un agente IDE infiere rutas a partir de patrones de entrenamiento y puede inventar endpoints plausibles pero incorrectos. Alimenta tu especificación mediante MCP con:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;npx apidog-mcp-server
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Así podrá consultar rutas, campos y autenticación reales antes de escribir código.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Puede Cursor probar la API que escribió?
&lt;/h3&gt;

&lt;p&gt;Puede escribir una prueba y ejecutarla una vez durante una sesión de chat. Eso sirve para exploración.&lt;/p&gt;

&lt;p&gt;Para CI necesitas un resultado determinista en cada commit. Ejecuta las pruebas con una herramienta como la &lt;a href="https://apidog.com/es/blog/apidog-cli-ai-agent-workflows?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;CLI de Apidog&lt;/a&gt; y controla el pipeline mediante el código de salida.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Necesito una cuenta para probar esto?
&lt;/h3&gt;

&lt;p&gt;No. Tanto &lt;code&gt;npx apidog-mcp-server&lt;/code&gt; como la CLI se ejecutan sin iniciar sesión, por lo que puedes conectar la especificación a tu IDE y ejecutar pruebas en un pipeline antes de que alguien cree una cuenta.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Está muerto el cliente API independiente ahora que los agentes escriben llamadas?
&lt;/h3&gt;

&lt;p&gt;No, pero su función cambió.&lt;/p&gt;

&lt;p&gt;La escritura manual de solicitudes disminuyó. En cambio, crecieron dos necesidades:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Fundamentar al agente en la especificación real.&lt;/li&gt;
&lt;li&gt;Verificar lo que el agente generó contra la API.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Un cliente que solo ofrece una superficie para escribir solicitudes tiene menos trabajo. Uno que ayuda a fundamentar, ejecutar e inspeccionar tiene más.&lt;/p&gt;

&lt;h2&gt;
  
  
  La verdadera pregunta
&lt;/h2&gt;

&lt;p&gt;Nunca fue Cursor contra un cliente API, ni Copilot contra Apidog. La pregunta es quién hace cada trabajo.&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;El agente IDE redacta la llamada y el código cliente rápidamente.&lt;/li&gt;
&lt;li&gt;La especificación real evita que el borrador se base en suposiciones.&lt;/li&gt;
&lt;li&gt;Un cliente API y una CLI ejecutan la llamada y verifican el resultado.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Conserva ambos. Empieza con:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;npx apidog-mcp-server
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Después añade la &lt;a href="https://apidog.com/es/blog/apidog-cli-ai-agent-workflows?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;CLI de Apidog&lt;/a&gt; para ejecutar lo que el agente escribe, o &lt;a href="https://apidog.com/download?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;prueba Apidog gratis&lt;/a&gt;.&lt;/p&gt;

</description>
    </item>
    <item>
      <title>¿Puede la IA reemplazar las pruebas de API? Qué pueden y no pueden hacer los agentes</title>
      <dc:creator>Roobia</dc:creator>
      <pubDate>Thu, 23 Jul 2026 06:43:57 +0000</pubDate>
      <link>https://dev.to/roobia/puede-la-ia-reemplazar-las-pruebas-de-api-que-pueden-y-no-pueden-hacer-los-agentes-3pgp</link>
      <guid>https://dev.to/roobia/puede-la-ia-reemplazar-las-pruebas-de-api-que-pueden-y-no-pueden-hacer-los-agentes-3pgp</guid>
      <description>&lt;p&gt;Tu agente escribió la prueba. Cursor sugirió tres casos extremos en los que no habías pensado. Copilot completó el cuerpo de la solicitud y Claude ejecutó todo una vez e informó que estaba en verde. La pregunta es válida: si el agente hace todo eso, ¿puede la IA reemplazar por completo las pruebas de API?&lt;/p&gt;

&lt;p&gt;&lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation" class="crayons-btn crayons-btn--primary"&gt;Prueba Apidog hoy&lt;/a&gt;
&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;No. La IA puede reemplazar gran parte de la escritura de pruebas, pero no la verificación determinista.&lt;/strong&gt; Los agentes pueden redactar casos, sugerir casos extremos y generar cuerpos de solicitud. Sin embargo, no deben ser quienes decidan si una suite pasa en CI, bloqueen una fusión o determinen que un contrato es correcto. Para eso necesitas un ejecutor determinista y revisión humana.&lt;/p&gt;

&lt;p&gt;Esta es la rama de pruebas de una pregunta más amplia: &lt;a href="https://apidog.com/es/blog/still-need-api-tool-ai-agents?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;¿sigues necesitando una herramienta de API en la era de los agentes de IA?&lt;/a&gt; Entender el límite evita dos errores:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Usar un agente como puerta de fusión.&lt;/li&gt;
&lt;li&gt;Descartar agentes cuando son muy útiles para escribir pruebas.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  En qué se diferencia esto de una guía práctica
&lt;/h2&gt;

&lt;p&gt;Si buscas una implementación paso a paso, consulta la guía sobre &lt;a href="https://apidog.com/es/blog/ai-agents-api-testing?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;cómo usar agentes de IA para pruebas de API&lt;/a&gt;. Explica cómo dar endpoints a un agente y obtener pruebas iniciales.&lt;/p&gt;

&lt;p&gt;Este artículo responde otra pregunta: &lt;strong&gt;qué parte del flujo puedes delegar al agente y dónde debe terminar esa delegación&lt;/strong&gt;.&lt;/p&gt;

&lt;p&gt;Una forma práctica de separar responsabilidades es:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;El agente genera y mejora artefactos de prueba.&lt;/li&gt;
&lt;li&gt;Un humano revisa la intención y los riesgos.&lt;/li&gt;
&lt;li&gt;Un ejecutor determinista valida el resultado en cada commit.&lt;/li&gt;
&lt;li&gt;CI usa el código de salida del ejecutor para permitir o bloquear una fusión.&lt;/li&gt;
&lt;/ol&gt;

&lt;h2&gt;
  
  
  Lo que la IA hace bien en las pruebas de API
&lt;/h2&gt;

&lt;p&gt;Los agentes ya eliminan bastante trabajo de autoría. Úsalos como aceleradores para crear el primer borrador de tu suite.&lt;/p&gt;

&lt;h3&gt;
  
  
  1. Redactar una suite inicial desde una especificación
&lt;/h3&gt;

&lt;p&gt;Dale al agente un endpoint, una especificación OpenAPI o una respuesta de ejemplo. Puede generar rápidamente comprobaciones de estado, aserciones básicas y una solicitud de ruta feliz.&lt;/p&gt;

&lt;p&gt;Por ejemplo, para un endpoint &lt;code&gt;POST /users&lt;/code&gt;, el primer borrador podría incluir:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;- Debe devolver 201 al crear un usuario válido.
- La respuesta debe incluir id, email y createdAt.
- Debe devolver 400 si falta email.
- Debe devolver 409 si el email ya existe.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;El resultado no debe entrar directamente en CI sin revisión, pero evita empezar desde un archivo vacío.&lt;/p&gt;

&lt;h3&gt;
  
  
  2. Sugerir casos extremos
&lt;/h3&gt;

&lt;p&gt;Pregunta al agente qué puede romper un endpoint. Suele ampliar la cobertura más allá de los casos obvios.&lt;/p&gt;

&lt;p&gt;Para &lt;code&gt;POST /orders&lt;/code&gt;, pídele algo como:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Analiza este endpoint y genera casos límite relacionados con:
- campos obligatorios
- valores null
- arrays vacíos
- fechas y zonas horarias
- autenticación expirada
- límites de tamaño
- duplicados e idempotencia
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Es probable que proponga casos como:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Un array vacío de productos.&lt;/li&gt;
&lt;li&gt;Un &lt;code&gt;null&lt;/code&gt; en un campo obligatorio.&lt;/li&gt;
&lt;li&gt;Un token de acceso caducado.&lt;/li&gt;
&lt;li&gt;Una fecha en el límite de una zona horaria.&lt;/li&gt;
&lt;li&gt;Un importe negativo o con demasiados decimales.&lt;/li&gt;
&lt;li&gt;Una clave de idempotencia repetida.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;No detectará todos los riesgos de tu dominio, pero mejora la cobertura inicial.&lt;/p&gt;

&lt;h3&gt;
  
  
  3. Generar cuerpos de solicitud y datos de prueba
&lt;/h3&gt;

&lt;p&gt;Generar una carga útil válida con muchos campos o múltiples registros de prueba es una tarea ideal para un agente.&lt;/p&gt;

&lt;p&gt;Si conectas tu especificación mediante un protocolo como &lt;a href="https://modelcontextprotocol.io" rel="noopener noreferrer"&gt;Model Context Protocol&lt;/a&gt;, el agente puede trabajar con tus campos reales en lugar de inventarlos.&lt;/p&gt;

&lt;p&gt;Ejemplo de instrucción:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Genera tres cuerpos JSON válidos para POST /users según la especificación:
1. Usuario individual.
2. Usuario con dirección opcional.
3. Usuario con preferencias completas.
No agregues campos que no existan en el esquema.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;h3&gt;
  
  
  4. Escribir aserciones de primer borrador
&lt;/h3&gt;

&lt;p&gt;El agente puede transformar requisitos generales en aserciones concretas.&lt;/p&gt;

&lt;p&gt;En vez de escribir solo:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Comprobar que la respuesta devuelve un usuario válido.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Puede proponerte:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight javascript"&gt;&lt;code&gt;&lt;span class="nf"&gt;expect&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="nx"&gt;response&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;status&lt;/span&gt;&lt;span class="p"&gt;).&lt;/span&gt;&lt;span class="nf"&gt;toBe&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="mi"&gt;200&lt;/span&gt;&lt;span class="p"&gt;);&lt;/span&gt;
&lt;span class="nf"&gt;expect&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="nx"&gt;response&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;body&lt;/span&gt;&lt;span class="p"&gt;).&lt;/span&gt;&lt;span class="nf"&gt;toHaveProperty&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="s2"&gt;id&lt;/span&gt;&lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="p"&gt;);&lt;/span&gt;
&lt;span class="nf"&gt;expect&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="nx"&gt;response&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;body&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;email&lt;/span&gt;&lt;span class="p"&gt;).&lt;/span&gt;&lt;span class="nf"&gt;toMatch&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="sr"&gt;/.+@.+&lt;/span&gt;&lt;span class="se"&gt;\.&lt;/span&gt;&lt;span class="sr"&gt;.+/&lt;/span&gt;&lt;span class="p"&gt;);&lt;/span&gt;
&lt;span class="nf"&gt;expect&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="nx"&gt;response&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;body&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;createdAt&lt;/span&gt;&lt;span class="p"&gt;).&lt;/span&gt;&lt;span class="nf"&gt;toBeDefined&lt;/span&gt;&lt;span class="p"&gt;();&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Revisa siempre estas aserciones: un campo presente no implica necesariamente que tenga el valor, tipo o semántica correctos.&lt;/p&gt;

&lt;blockquote&gt;
&lt;p&gt;La IA es especialmente útil para &lt;strong&gt;crear artefactos de prueba&lt;/strong&gt;. Esa es la parte de autoría.&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  Lo que todavía necesita una herramienta determinista
&lt;/h2&gt;

&lt;p&gt;Hay trabajos que exigen que la misma entrada produzca el mismo resultado en cada ejecución. Un modelo no es la capa adecuada para esa responsabilidad.&lt;/p&gt;

&lt;h3&gt;
  
  
  Ejecutar la misma suite en cada commit
&lt;/h3&gt;

&lt;p&gt;Una puerta de fusión necesita una propiedad básica:&lt;/p&gt;

&lt;blockquote&gt;
&lt;p&gt;El mismo commit debe producir el mismo resultado: pasa o falla.&lt;/p&gt;
&lt;/blockquote&gt;

&lt;p&gt;Un agente puede ejecutar pruebas y resumirlas, pero su interpretación o salida puede variar. Esa variabilidad puede ser aceptable para explorar y depurar, pero no para aprobar código automáticamente.&lt;/p&gt;

&lt;h3&gt;
  
  
  Bloquear CI cuando una prueba falla
&lt;/h3&gt;

&lt;p&gt;CI necesita un proceso que devuelva un código de salida real:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;&lt;span class="c"&gt;# 0: pruebas correctas&lt;/span&gt;
&lt;span class="c"&gt;# distinto de 0: pruebas fallidas&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Un mensaje de chat como “parece que todo está bien” no es una señal fiable para una regla de fusión. Una pipeline necesita un ejecutor sin interfaz gráfica que pueda fallar de forma explícita.&lt;/p&gt;

&lt;h3&gt;
  
  
  Validar contratos y esquemas
&lt;/h3&gt;

&lt;p&gt;La pregunta:&lt;/p&gt;

&lt;blockquote&gt;
&lt;p&gt;¿Esta respuesta sigue cumpliendo el contrato OpenAPI que consumen otros equipos?&lt;/p&gt;
&lt;/blockquote&gt;

&lt;p&gt;No requiere creatividad ni interpretación. Requiere comparar una respuesta contra una definición fija.&lt;/p&gt;

&lt;p&gt;La &lt;a href="https://spec.openapis.org/" rel="noopener noreferrer"&gt;Especificación OpenAPI&lt;/a&gt; define ese contrato. Si desaparece un campo obligatorio o cambia un tipo, la validación debe fallar de la misma forma en cada ejecución.&lt;/p&gt;

&lt;h3&gt;
  
  
  Reproducir una llamada fallida
&lt;/h3&gt;

&lt;p&gt;Cuando falla una prueba, necesitas evidencia de la comunicación real:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;URL y método.&lt;/li&gt;
&lt;li&gt;Encabezados.&lt;/li&gt;
&lt;li&gt;Cuerpo enviado.&lt;/li&gt;
&lt;li&gt;Código de estado.&lt;/li&gt;
&lt;li&gt;Cuerpo recibido.&lt;/li&gt;
&lt;li&gt;Orden de las llamadas.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;El resumen de un agente no sustituye esos datos. Si el agente cree que envió un token válido, pero el cliente envió uno caducado, solo la solicitud real permite detectar la diferencia.&lt;/p&gt;

&lt;h2&gt;
  
  
  La división práctica: IA frente a ejecución determinista
&lt;/h2&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Tarea de prueba&lt;/th&gt;
&lt;th&gt;Agente de IA&lt;/th&gt;
&lt;th&gt;Enfoque recomendado&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Redactar una primera suite&lt;/td&gt;
&lt;td&gt;Lo hace bien&lt;/td&gt;
&lt;td&gt;Usarlo para crear el borrador&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Sugerir casos extremos&lt;/td&gt;
&lt;td&gt;Lo hace bien&lt;/td&gt;
&lt;td&gt;Revisar y priorizar según el dominio&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Generar cuerpos de solicitud y datos&lt;/td&gt;
&lt;td&gt;Lo hace bien&lt;/td&gt;
&lt;td&gt;Validar contra la especificación real&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Escribir aserciones iniciales&lt;/td&gt;
&lt;td&gt;Útil, con revisión&lt;/td&gt;
&lt;td&gt;Corregir semántica y cobertura&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Ejecutar la suite en cada commit&lt;/td&gt;
&lt;td&gt;No debe decidirlo&lt;/td&gt;
&lt;td&gt;Usar un ejecutor determinista&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Bloquear CI&lt;/td&gt;
&lt;td&gt;No debe decidirlo&lt;/td&gt;
&lt;td&gt;Usar códigos de salida reales&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Validar contrato y esquema&lt;/td&gt;
&lt;td&gt;No debe decidirlo&lt;/td&gt;
&lt;td&gt;Comparar contra OpenAPI&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Reproducir una llamada exacta&lt;/td&gt;
&lt;td&gt;Necesita datos inspeccionables&lt;/td&gt;
&lt;td&gt;Guardar solicitud y respuesta reales&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Decidir si el contrato es correcto&lt;/td&gt;
&lt;td&gt;No puede decidirlo&lt;/td&gt;
&lt;td&gt;Revisión humana de producto y arquitectura&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;Las primeras cuatro tareas son de autoría. Las últimas cinco son de verificación, gobernanza o decisión de producto.&lt;/p&gt;

&lt;h2&gt;
  
  
  Por qué un modelo no puede ser la puerta de CI
&lt;/h2&gt;

&lt;p&gt;No se trata de que los modelos sean inútiles. Se trata de cómo funcionan.&lt;/p&gt;

&lt;p&gt;Un LLM genera salida mediante muestreo. Factores como la temperatura, el contexto y rutas no deterministas del modelo pueden producir resultados o explicaciones distintos con el mismo prompt.&lt;/p&gt;

&lt;p&gt;Eso es útil para redactar:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Variantes de casos de prueba.&lt;/li&gt;
&lt;li&gt;Datos de prueba.&lt;/li&gt;
&lt;li&gt;Explicaciones de errores.&lt;/li&gt;
&lt;li&gt;Ideas de cobertura.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Pero es inadecuado para una puerta de fusión. Una puerta debe ser repetible y aburrida:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Verde significa verde por la misma razón.&lt;/li&gt;
&lt;li&gt;Rojo identifica el mismo contrato roto.&lt;/li&gt;
&lt;li&gt;La pipeline devuelve el mismo resultado para el mismo commit.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;El patrón correcto es:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Agente redacta la prueba
        ↓
Humano revisa la intención
        ↓
Ejecutor determinista ejecuta la suite
        ↓
CI bloquea o permite la fusión
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Para conocer problemas habituales al omitir esta separación, consulta &lt;a href="https://apidog.com/es/blog/production-ai-agent-reliability?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;por qué los agentes de IA fallan en producción&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Dónde encaja Apidog: inspeccionar y verificar
&lt;/h2&gt;

&lt;p&gt;&lt;a href="https://apidog.com?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt; se sitúa en la parte determinista del flujo. No es un marco para construir agentes, no ejecuta tu agente por ti y no toma decisiones de producto.&lt;/p&gt;

&lt;p&gt;Puedes usar sus componentes para cubrir dos necesidades distintas.&lt;/p&gt;

&lt;h3&gt;
  
  
  Inspeccionar lo que hizo el agente
&lt;/h3&gt;

&lt;p&gt;El &lt;a href="https://apidog.com/es/blog/ai-agent-debugger?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Depurador de Agente de IA de Apidog&lt;/a&gt;, lanzado en mayo de 2026, permite inspeccionar la ejecución de un agente:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Llamadas a LLM.&lt;/li&gt;
&lt;li&gt;Llamadas a herramientas MCP.&lt;/li&gt;
&lt;li&gt;Intercambios multi-turno.&lt;/li&gt;
&lt;li&gt;Actividad en la capa de API.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Su objetivo es ayudarte a investigar qué ocurrió cuando falla una llamada. Es una superficie de depuración, no un tiempo de ejecución de agentes.&lt;/p&gt;

&lt;h3&gt;
  
  
  Ejecutar pruebas de forma determinista
&lt;/h3&gt;

&lt;p&gt;La &lt;a href="https://apidog.com/es/blog/apidog-cli-ai-agent-workflows?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;CLI de Apidog&lt;/a&gt; ejecuta casos de prueba guardados sin interfaz gráfica y devuelve códigos de salida reales.&lt;/p&gt;

&lt;p&gt;Puedes integrarla en una pipeline para que una regresión de contrato falle la compilación:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;&lt;span class="c"&gt;# Ejecuta los casos guardados como parte de tu pipeline&lt;/span&gt;
apidog-cli run
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;La CLI puede ejecutarse sin iniciar sesión, por lo que puedes conectarla a CI antes de que alguien use la interfaz.&lt;/p&gt;

&lt;h3&gt;
  
  
  Conectar la especificación al agente
&lt;/h3&gt;

&lt;p&gt;Para que Cursor, Copilot o Claude Code trabajen contra endpoints reales, expón tu definición OpenAPI mediante:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;npx apidog-mcp-server
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;El &lt;a href="https://apidog.com/es/blog/apidog-mcp-server?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Servidor MCP de Apidog&lt;/a&gt; permite que el agente consulte la especificación antes de generar pruebas o cuerpos de solicitud.&lt;/p&gt;

&lt;p&gt;También puedes usar mocks para probar rutas de recuperación, por ejemplo:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Respuesta &lt;code&gt;429&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Respuesta &lt;code&gt;500&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Tiempo de espera.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Así puedes validar que el código del agente maneja fallos reales de red y API. &lt;a href="https://apidog.com/download?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Descarga Apidog&lt;/a&gt; si quieres probar este flujo; la versión gratuita cubre estos casos.&lt;/p&gt;

&lt;p&gt;La separación es simple:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;El agente redacta.
Apidog inspecciona y verifica.
CI aplica el resultado.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;h2&gt;
  
  
  Flujo de implementación recomendado
&lt;/h2&gt;

&lt;p&gt;Una implementación mínima puede seguir estos pasos:&lt;/p&gt;

&lt;h3&gt;
  
  
  1. Publica o actualiza tu especificación OpenAPI
&lt;/h3&gt;

&lt;p&gt;Asegúrate de que el contrato describe:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Rutas y métodos.&lt;/li&gt;
&lt;li&gt;Parámetros.&lt;/li&gt;
&lt;li&gt;Cuerpos de solicitud.&lt;/li&gt;
&lt;li&gt;Respuestas esperadas.&lt;/li&gt;
&lt;li&gt;Campos obligatorios.&lt;/li&gt;
&lt;li&gt;Códigos de error.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  2. Conecta la especificación al agente
&lt;/h3&gt;

&lt;p&gt;Ejecuta:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;npx apidog-mcp-server
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Luego pide al agente que genere casos basándose únicamente en la especificación disponible.&lt;/p&gt;

&lt;h3&gt;
  
  
  3. Revisa las pruebas generadas
&lt;/h3&gt;

&lt;p&gt;Comprueba especialmente:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Aserciones demasiado superficiales.&lt;/li&gt;
&lt;li&gt;Campos que el agente asumió sin estar en el esquema.&lt;/li&gt;
&lt;li&gt;Casos de autorización.&lt;/li&gt;
&lt;li&gt;Reglas de negocio específicas de tu producto.&lt;/li&gt;
&lt;li&gt;Escenarios de datos duplicados, límites e idempotencia.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  4. Guarda los casos en una suite ejecutable
&lt;/h3&gt;

&lt;p&gt;Convierte los casos aprobados en pruebas que un ejecutor pueda lanzar sin intervención humana.&lt;/p&gt;

&lt;h3&gt;
  
  
  5. Ejecuta la suite en CI
&lt;/h3&gt;

&lt;p&gt;Configura la pipeline para que ejecute la suite en cada pull request o commit relevante.&lt;/p&gt;

&lt;p&gt;La regla debe depender del código de salida del ejecutor, no de un resumen generado por IA.&lt;/p&gt;

&lt;h3&gt;
  
  
  6. Usa el depurador cuando una integración falle
&lt;/h3&gt;

&lt;p&gt;Cuando un agente o flujo multi-turno produzca un resultado inesperado, inspecciona:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Qué herramientas llamó.&lt;/li&gt;
&lt;li&gt;Qué solicitudes envió.&lt;/li&gt;
&lt;li&gt;Qué respuestas recibió.&lt;/li&gt;
&lt;li&gt;Dónde cambió el contexto o se rompió el flujo.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Cuándo basta con IA y un script
&lt;/h2&gt;

&lt;p&gt;No todos los escenarios necesitan una suite completa ni una herramienta adicional. Puedes trabajar con un agente y una llamada &lt;code&gt;curl&lt;/code&gt; cuando:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Estás probando un script desechable.&lt;/li&gt;
&lt;li&gt;Un solo request responde la pregunta que necesitas resolver.&lt;/li&gt;
&lt;li&gt;Estás prototipando en solitario.&lt;/li&gt;
&lt;li&gt;Solo existen dos o tres endpoints.&lt;/li&gt;
&lt;li&gt;Ningún otro equipo depende del contrato.&lt;/li&gt;
&lt;li&gt;El cambio no llega a producción ni cruza el código de otra persona.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Por ejemplo:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;curl &lt;span class="nt"&gt;-i&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;-H&lt;/span&gt; &lt;span class="s2"&gt;"Authorization: Bearer &lt;/span&gt;&lt;span class="nv"&gt;$TOKEN&lt;/span&gt;&lt;span class="s2"&gt;"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;-H&lt;/span&gt; &lt;span class="s2"&gt;"Content-Type: application/json"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;-X&lt;/span&gt; POST https://api.example.com/users &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;-d&lt;/span&gt; &lt;span class="s1"&gt;'{"email":"test@example.com","name":"Ana"}'&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;En ese contexto, una revisión manual y una prueba puntual pueden ser suficientes.&lt;/p&gt;

&lt;p&gt;La capa determinista se vuelve necesaria cuando aumentan las consecuencias:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Publicas para otros equipos.&lt;/li&gt;
&lt;li&gt;Ejecutas CI.&lt;/li&gt;
&lt;li&gt;Mantienes un contrato consumido por terceros.&lt;/li&gt;
&lt;li&gt;Necesitas detectar regresiones.&lt;/li&gt;
&lt;li&gt;Una respuesta incorrecta puede costar tiempo o dinero.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Preguntas frecuentes
&lt;/h2&gt;

&lt;h3&gt;
  
  
  ¿Puede la IA reemplazar completamente las pruebas de API?
&lt;/h3&gt;

&lt;p&gt;No. Puede redactar pruebas, sugerir casos extremos y generar cuerpos de solicitud, pero la ejecución repetible, el bloqueo de CI y la validación de contratos requieren un ejecutor determinista. Decidir si un contrato es correcto sigue siendo responsabilidad humana.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Qué hacen bien los agentes de IA en pruebas de API?
&lt;/h3&gt;

&lt;p&gt;Son especialmente útiles para:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Redactar suites iniciales desde una especificación.&lt;/li&gt;
&lt;li&gt;Sugerir casos extremos.&lt;/li&gt;
&lt;li&gt;Generar datos y cuerpos de solicitud.&lt;/li&gt;
&lt;li&gt;Escribir aserciones de primer borrador.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Son tareas de autoría, no de verificación final.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Por qué un agente no debe ser la puerta de CI?
&lt;/h3&gt;

&lt;p&gt;Porque CI necesita resultados repetibles y códigos de salida reales. Un LLM puede variar su salida entre ejecuciones; una regla de fusión no puede depender de una interpretación o resumen conversacional.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Es lo mismo que una guía práctica de agentes para pruebas de API?
&lt;/h3&gt;

&lt;p&gt;No. La &lt;a href="https://apidog.com/es/blog/ai-agents-api-testing?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía práctica&lt;/a&gt; explica cómo generar pruebas con un agente. Este artículo explica dónde termina el papel del agente y dónde comienza la verificación determinista.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿El Depurador de Agente de IA de Apidog ejecuta mi agente?
&lt;/h3&gt;

&lt;p&gt;No. Inspecciona llamadas a LLM, herramientas MCP e intercambios multi-turno para ayudarte a depurar la actividad de API. Es una herramienta de inspección, no un runtime de agentes.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Necesito iniciar sesión para ejecutar pruebas en CI?
&lt;/h3&gt;

&lt;p&gt;No. La &lt;a href="https://apidog.com/es/blog/apidog-cli-ai-agent-workflows?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;CLI de Apidog&lt;/a&gt; puede ejecutar casos guardados sin interfaz gráfica y sin cuenta, devolviendo un código de salida que CI puede usar.&lt;/p&gt;

&lt;h2&gt;
  
  
  La línea real
&lt;/h2&gt;

&lt;p&gt;“¿Puede la IA reemplazar las pruebas de API?” mezcla dos preguntas.&lt;/p&gt;

&lt;p&gt;La primera es: &lt;strong&gt;¿puede escribir pruebas?&lt;/strong&gt; Cada vez más, sí. Dejar de usarla para esa parte desperdicia una ventaja real.&lt;/p&gt;

&lt;p&gt;La segunda es: &lt;strong&gt;¿puede ejecutar siempre igual, bloquear una fusión y mantener un contrato?&lt;/strong&gt; No. Por diseño, el modelo que resulta útil para redactar es no determinista donde una puerta de CI debe ser repetible.&lt;/p&gt;

&lt;p&gt;Usa ambos componentes para el trabajo adecuado:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Deja que el agente redacte suites, casos extremos y cuerpos de solicitud.&lt;/li&gt;
&lt;li&gt;Deja que un humano revise intención, riesgos y decisiones de producto.&lt;/li&gt;
&lt;li&gt;Deja que una herramienta determinista ejecute la suite y valide el contrato.&lt;/li&gt;
&lt;li&gt;Deja que CI decida con un código de salida real.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Empieza conectando tu especificación con &lt;code&gt;npx apidog-mcp-server&lt;/code&gt; y ejecutando la &lt;a href="https://apidog.com/es/blog/apidog-cli-ai-agent-workflows?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;CLI de Apidog&lt;/a&gt;, o &lt;a href="https://apidog.com/download?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;prueba Apidog gratis&lt;/a&gt;.&lt;/p&gt;

</description>
    </item>
  </channel>
</rss>
