<?xml version="1.0" encoding="UTF-8"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:dc="http://purl.org/dc/elements/1.1/">
  <channel>
    <title>DEV Community: Roobia</title>
    <description>The latest articles on DEV Community by Roobia (@roobia).</description>
    <link>https://dev.to/roobia</link>
    <image>
      <url>https://media2.dev.to/dynamic/image/width=90,height=90,fit=cover,gravity=auto,format=auto/https:%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Fuser%2Fprofile_image%2F2197084%2F1d72640c-64d4-4f30-a828-302a9e3360b0.jpg</url>
      <title>DEV Community: Roobia</title>
      <link>https://dev.to/roobia</link>
    </image>
    <atom:link rel="self" type="application/rss+xml" href="https://dev.to/feed/roobia"/>
    <language>en</language>
    <item>
      <title>Los Mejores Proveedores de Nodos RPC en 2026: Guía para Desarrolladores</title>
      <dc:creator>Roobia</dc:creator>
      <pubDate>Thu, 03 Sep 2026 11:21:35 +0000</pubDate>
      <link>https://dev.to/roobia/los-mejores-proveedores-de-nodos-rpc-en-2026-guia-para-desarrolladores-4ba7</link>
      <guid>https://dev.to/roobia/los-mejores-proveedores-de-nodos-rpc-en-2026-guia-para-desarrolladores-4ba7</guid>
      <description>&lt;h1&gt;
  
  
  Los mejores proveedores de nodos RPC para Web3 en 2026
&lt;/h1&gt;

&lt;p&gt;Una aplicación de blockchain puede tener un excelente frontend, contratos inteligentes bien diseñados y una arquitectura cuidadosamente planificada, pero aún necesita una forma confiable de comunicarse con la red. Esa comunicación suele ocurrir a través de un punto final RPC.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation" class="crayons-btn crayons-btn--primary"&gt;Prueba Apidog hoy&lt;/a&gt;
&lt;/p&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fcuy3ggfc8s2vf8ik3ggo.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fcuy3ggfc8s2vf8ik3ggo.png" alt="Infraestructura RPC para aplicaciones Web3" width="800" height="446"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;Cuando una billetera recupera un saldo, una dApp lee un contrato inteligente, un bot de trading verifica el último bloque o una aplicación envía una transacción, la solicitud debe llegar a un nodo de blockchain.&lt;/p&gt;

&lt;p&gt;Ejecutar y mantener esos nodos es posible, pero puede convertirse rápidamente en otro problema de infraestructura. Ahí es donde entran los proveedores de nodos RPC.&lt;/p&gt;

&lt;p&gt;Para esta guía analicé cinco plataformas:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;&lt;a href="https://chainstack.com/" rel="noopener noreferrer"&gt;Chainstack&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://onfinality.io/en" rel="noopener noreferrer"&gt;OnFinality&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://routeme.sh/" rel="noopener noreferrer"&gt;RouteMesh&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://uniblock.dev/" rel="noopener noreferrer"&gt;Uniblock&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://www.quicknode.com/" rel="noopener noreferrer"&gt;QuickNode&lt;/a&gt;&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;No todas resuelven el mismo problema. Algunas se especializan en infraestructura gestionada; otras, en agregación de proveedores, APIs unificadas, streaming o herramientas para aplicaciones impulsadas por IA.&lt;/p&gt;

&lt;h2&gt;
  
  
  ¿Qué es un proveedor de nodos RPC?
&lt;/h2&gt;

&lt;p&gt;RPC significa &lt;em&gt;Remote Procedure Call&lt;/em&gt; o llamada a procedimiento remoto.&lt;/p&gt;

&lt;p&gt;En términos sencillos, un punto final RPC es la capa de comunicación entre una aplicación y un nodo de blockchain. En lugar de operar su propio nodo de Ethereum, Solana, Base u otra red, la aplicación envía solicitudes a un proveedor RPC. El proveedor gestiona la infraestructura y devuelve los datos o el resultado solicitado.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fa60pzjwuhecww7milt7e.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fa60pzjwuhecww7milt7e.png" alt="Comunicación entre una aplicación y una blockchain mediante RPC" width="800" height="446"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;Una aplicación puede usar RPC para:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Recuperar el último bloque.&lt;/li&gt;
&lt;li&gt;Verificar el saldo de una billetera.&lt;/li&gt;
&lt;li&gt;Leer el estado de un contrato inteligente.&lt;/li&gt;
&lt;li&gt;Enviar una transacción.&lt;/li&gt;
&lt;li&gt;Consultar información de una transacción.&lt;/li&gt;
&lt;li&gt;Escuchar eventos de la blockchain.&lt;/li&gt;
&lt;li&gt;Interactuar con una aplicación descentralizada.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;La arquitectura básica es:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Aplicación → Punto final RPC → Red de blockchain
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Para un proyecto pequeño, un punto final RPC público puede ser suficiente. Cuando el tráfico aumenta, suelen ser necesarios mayor disponibilidad, rendimiento, menor latencia, acceso a archivos, WebSockets, infraestructura dedicada o enrutamiento avanzado.&lt;/p&gt;

&lt;h2&gt;
  
  
  Qué buscar en un proveedor RPC
&lt;/h2&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fakjc55lglp18zp1b7ag4.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fakjc55lglp18zp1b7ag4.png" alt="Factores para elegir infraestructura RPC" width="800" height="395"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;h3&gt;
  
  
  Cobertura de blockchain
&lt;/h3&gt;

&lt;p&gt;Comprueba que el proveedor soporte las redes que tu aplicación necesita, tanto mainnets como testnets. Una aplicación de una sola cadena puede requerir solo Ethereum o Solana, mientras que una billetera o dApp multicadena puede necesitar docenas de redes.&lt;/p&gt;

&lt;p&gt;También debes verificar que los métodos RPC específicos estén disponibles en cada red.&lt;/p&gt;

&lt;h3&gt;
  
  
  Fiabilidad y tiempo de actividad
&lt;/h3&gt;

&lt;p&gt;Si un punto final deja de estar disponible, tu aplicación podría dejar de cargar saldos, fallar al enviar transacciones o perder eventos en tiempo real.&lt;/p&gt;

&lt;p&gt;La redundancia, la distribución geográfica, la monitorización, el enrutamiento y las garantías de nivel de servicio son factores importantes.&lt;/p&gt;

&lt;h3&gt;
  
  
  Latencia y rendimiento
&lt;/h3&gt;

&lt;p&gt;La latencia es especialmente relevante para:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Sistemas de trading.&lt;/li&gt;
&lt;li&gt;Aplicaciones de arbitraje.&lt;/li&gt;
&lt;li&gt;Liquidaciones.&lt;/li&gt;
&lt;li&gt;Juegos blockchain.&lt;/li&gt;
&lt;li&gt;Paneles en tiempo real.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;El proveedor adecuado depende de la carga de trabajo. No basta con elegir el que anuncie la latencia más baja.&lt;/p&gt;

&lt;h3&gt;
  
  
  Datos de archivo
&lt;/h3&gt;

&lt;p&gt;Un nodo completo conserva principalmente el estado actual de la blockchain. Un nodo de archivo mantiene estados históricos que pueden consultarse más atrás en la historia de la cadena.&lt;/p&gt;

&lt;p&gt;Los datos de archivo son útiles para:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Análisis de blockchain.&lt;/li&gt;
&lt;li&gt;Investigación histórica.&lt;/li&gt;
&lt;li&gt;Backtesting.&lt;/li&gt;
&lt;li&gt;Auditorías.&lt;/li&gt;
&lt;li&gt;Depuración.&lt;/li&gt;
&lt;li&gt;Indexadores.&lt;/li&gt;
&lt;li&gt;Aplicaciones que necesitan estado histórico.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  WebSockets y streaming
&lt;/h3&gt;

&lt;p&gt;Consultar un punto final RPC repetidamente no siempre es la mejor opción para aplicaciones en tiempo real. WebSockets y otras tecnologías de streaming permiten recibir actualizaciones cuando ocurren los eventos.&lt;/p&gt;

&lt;p&gt;Son útiles para trading, monitorización de transacciones, notificaciones de billetera, análisis de blockchain y agentes de IA que reaccionan a eventos en cadena.&lt;/p&gt;

&lt;h3&gt;
  
  
  Infraestructura dedicada
&lt;/h3&gt;

&lt;p&gt;La infraestructura compartida suele ser suficiente durante el desarrollo y las primeras etapas de producción. Cuando el tráfico crece, los nodos dedicados o la infraestructura aislada ofrecen mayor control sobre el rendimiento, los recursos y la configuración.&lt;/p&gt;

&lt;h3&gt;
  
  
  Enrutamiento y conmutación por error
&lt;/h3&gt;

&lt;p&gt;Una alternativa cada vez más común es utilizar una capa que enrute las solicitudes entre varios proveedores RPC. Esto puede reducir la dependencia de un único proveedor y mejorar la resiliencia ante problemas de latencia o disponibilidad.&lt;/p&gt;

&lt;h1&gt;
  
  
  Los mejores proveedores de nodos RPC en 2026
&lt;/h1&gt;

&lt;h2&gt;
  
  
  1. Chainstack: mejor para infraestructura blockchain gestionada
&lt;/h2&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fftkytt9dmbfhvddra1ob.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fftkytt9dmbfhvddra1ob.png" alt="Chainstack y la infraestructura blockchain gestionada" width="800" height="369"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;&lt;a href="https://chainstack.com/" rel="noopener noreferrer"&gt;Chainstack&lt;/a&gt; es una plataforma de infraestructura blockchain gestionada que proporciona acceso listo para producción sin que los desarrolladores tengan que operar los nodos subyacentes.&lt;/p&gt;

&lt;p&gt;Su infraestructura soporta más de 70 redes, entre ellas:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Ethereum.&lt;/li&gt;
&lt;li&gt;Solana.&lt;/li&gt;
&lt;li&gt;Base.&lt;/li&gt;
&lt;li&gt;Arbitrum.&lt;/li&gt;
&lt;li&gt;Polygon.&lt;/li&gt;
&lt;li&gt;BNB Smart Chain.&lt;/li&gt;
&lt;li&gt;Hyperliquid.&lt;/li&gt;
&lt;li&gt;Robinhood Chain.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Una de sus principales fortalezas es la variedad de opciones:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Nodos Globales:&lt;/strong&gt; acceso distribuido geográficamente.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Nodos Dedicados:&lt;/strong&gt; infraestructura exclusiva y mayor control.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Nodos Ilimitados:&lt;/strong&gt; sin necesidad de controlar las cuotas.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Nodos Autohospedados:&lt;/strong&gt; despliegue y gestión en infraestructura propia.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Chainstack también ofrece nodos de archivo para análisis, rellenado de datos y auditorías. Para cargas de trabajo en tiempo real, proporciona WebSockets y streaming gRPC de Yellowstone para datos estructurados de Solana.&lt;/p&gt;

&lt;p&gt;Además, cuenta con un servidor MCP orientado a la IA. Con él, asistentes como Claude Code, Cursor, Codex, Gemini CLI y Windsurf pueden acceder a la documentación, el estado de la plataforma y los precios. Con autenticación también pueden gestionar nodos.&lt;/p&gt;

&lt;h3&gt;
  
  
  Fortalezas
&lt;/h3&gt;

&lt;ul&gt;
&lt;li&gt;Amplia infraestructura multicadena.&lt;/li&gt;
&lt;li&gt;Nodos Globales, Dedicados y Autohospedados.&lt;/li&gt;
&lt;li&gt;Acceso a datos de archivo.&lt;/li&gt;
&lt;li&gt;WebSockets y Solana gRPC.&lt;/li&gt;
&lt;li&gt;Infraestructura orientada a producción.&lt;/li&gt;
&lt;li&gt;Soporte MCP para flujos de desarrollo con IA.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  Desventajas
&lt;/h3&gt;

&lt;ul&gt;
&lt;li&gt;Puede ofrecer más opciones de las necesarias para proyectos pequeños.&lt;/li&gt;
&lt;li&gt;Las configuraciones avanzadas requieren tiempo para aprender.&lt;/li&gt;
&lt;li&gt;La infraestructura dedicada y de alto rendimiento cuesta más que un RPC compartido.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  Mejor para
&lt;/h3&gt;

&lt;p&gt;dApps de producción, billeteras, aplicaciones DeFi, plataformas de análisis, infraestructura de trading y agentes de IA que necesitan acceso confiable a múltiples redes.&lt;/p&gt;

&lt;h2&gt;
  
  
  2. OnFinality: mejor para infraestructura de nodos multicadena
&lt;/h2&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Foligmwd8g8gdalbozdio.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Foligmwd8g8gdalbozdio.png" alt="OnFinality y los nodos RPC multicadena" width="800" height="370"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;&lt;a href="https://onfinality.io/en" rel="noopener noreferrer"&gt;OnFinality&lt;/a&gt; proporciona infraestructura RPC gestionada y nodos dedicados para aplicaciones que operan en múltiples redes.&lt;/p&gt;

&lt;p&gt;Actualmente soporta más de 130 redes, incluyendo Ethereum, Solana, Polygon, Base, Arbitrum, BNB Chain, Polkadot, Optimism, Hyperliquid, Sui, Aptos y TON.&lt;/p&gt;

&lt;p&gt;La plataforma ofrece puntos finales compartidos para comenzar rápidamente y nodos dedicados para cargas de producción que requieren mayor control o aislamiento. También proporciona:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Acceso a archivos cuando la red lo permite.&lt;/li&gt;
&lt;li&gt;Análisis de solicitudes RPC.&lt;/li&gt;
&lt;li&gt;Visibilidad de límites de tasa.&lt;/li&gt;
&lt;li&gt;API Trace.&lt;/li&gt;
&lt;li&gt;Conexiones HTTP y WebSocket.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;El análisis RPC ayuda a identificar llamadas ineficientes, patrones de uso inesperados y problemas de rendimiento. Los nodos dedicados están disponibles en todas las redes compatibles, por lo que pueden ser adecuados para tráfico sostenido o requisitos especializados.&lt;/p&gt;

&lt;h3&gt;
  
  
  Fortalezas
&lt;/h3&gt;

&lt;ul&gt;
&lt;li&gt;Amplia cobertura multicadena.&lt;/li&gt;
&lt;li&gt;Infraestructura compartida y dedicada.&lt;/li&gt;
&lt;li&gt;Acceso a archivos.&lt;/li&gt;
&lt;li&gt;Análisis RPC.&lt;/li&gt;
&lt;li&gt;Soporte HTTP y WebSocket.&lt;/li&gt;
&lt;li&gt;Escalado orientado a producción.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  Desventajas
&lt;/h3&gt;

&lt;ul&gt;
&lt;li&gt;Un proyecto sencillo de una sola cadena puede no necesitar toda la plataforma.&lt;/li&gt;
&lt;li&gt;Las cargas avanzadas requieren planificar la infraestructura y el uso.&lt;/li&gt;
&lt;li&gt;La disponibilidad de características puede variar entre redes.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  Mejor para
&lt;/h3&gt;

&lt;p&gt;dApps multicadena, billeteras, aplicaciones DeFi, plataformas de análisis y equipos que necesitan pasar de RPC compartido a infraestructura dedicada.&lt;/p&gt;

&lt;h2&gt;
  
  
  3. RouteMesh: mejor para enrutamiento RPC y agregación
&lt;/h2&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Faafsaavjrvfx1fxte0e7.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Faafsaavjrvfx1fxte0e7.png" alt="RouteMesh y el enrutamiento entre proveedores RPC" width="799" height="397"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;&lt;a href="https://routeme.sh/" rel="noopener noreferrer"&gt;RouteMesh&lt;/a&gt; adopta un enfoque distinto al de los proveedores tradicionales: funciona como una capa de enrutamiento entre múltiples proveedores RPC.&lt;/p&gt;

&lt;p&gt;Según su plataforma actual, ofrece acceso a más de 20 proveedores y más de 1.000 cadenas, con reintentos automáticos y conmutación por error integrados.&lt;/p&gt;

&lt;p&gt;En lugar de integrar y monitorizar varios proveedores por separado, una aplicación puede utilizar una capa de enrutamiento unificada. RouteMesh gestiona el envío de solicitudes entre los proveedores disponibles.&lt;/p&gt;

&lt;p&gt;Su modelo también considera la latencia y el coste. La plataforma indica que evalúa las rutas disponibles y utiliza la disponibilidad del proveedor y del nodo para determinar los precios. Su objetivo es ofrecer latencia competitiva y redundancia mediante un modelo de pago por solicitud.&lt;/p&gt;

&lt;p&gt;La propuesta no consiste necesariamente en asignar un nodo dedicado, sino en abstraer la selección del proveedor de la aplicación.&lt;/p&gt;

&lt;h3&gt;
  
  
  Fortalezas
&lt;/h3&gt;

&lt;ul&gt;
&lt;li&gt;Agregación de proveedores RPC.&lt;/li&gt;
&lt;li&gt;Reintentos automáticos y conmutación por error.&lt;/li&gt;
&lt;li&gt;Amplia cobertura de cadenas.&lt;/li&gt;
&lt;li&gt;Acceso unificado a múltiples proveedores.&lt;/li&gt;
&lt;li&gt;Precios por solicitud.&lt;/li&gt;
&lt;li&gt;Menor dependencia de un único proveedor.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  Desventajas
&lt;/h3&gt;

&lt;ul&gt;
&lt;li&gt;Añade una capa de abstracción.&lt;/li&gt;
&lt;li&gt;Reduce el control directo sobre cada infraestructura.&lt;/li&gt;
&lt;li&gt;No todas las cargas necesitan enrutamiento entre proveedores.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  Mejor para
&lt;/h3&gt;

&lt;p&gt;Aplicaciones multicadena, equipos que necesitan redundancia RPC y desarrolladores que prefieren delegar el enrutamiento y la conmutación por error.&lt;/p&gt;

&lt;h2&gt;
  
  
  4. Uniblock: mejor para APIs blockchain unificadas
&lt;/h2&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2F17n06bhvupnpe8xynfbb.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2F17n06bhvupnpe8xynfbb.png" alt="Uniblock y las APIs blockchain unificadas" width="800" height="320"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;&lt;a href="https://uniblock.dev/" rel="noopener noreferrer"&gt;Uniblock&lt;/a&gt; trata la infraestructura blockchain como una capa de API unificada.&lt;/p&gt;

&lt;p&gt;Su plataforma ofrece acceso a más de 300 blockchains y más de 55 proveedores mediante una única interfaz. También incluye miles de APIs estandarizadas que van más allá del RPC básico.&lt;/p&gt;

&lt;p&gt;Uniblock gestiona el enrutamiento, la redundancia y la administración de proveedores. Su sistema evalúa la latencia, el coste y la fiabilidad, y puede utilizar cobertura paralela cuando una respuesta se vuelve lenta.&lt;/p&gt;

&lt;p&gt;Esto reduce la cantidad de código operativo que el equipo debe mantener: no es necesario implementar toda la lógica de failover, monitorizar varios proveedores ni gestionar múltiples contratos de facturación.&lt;/p&gt;

&lt;p&gt;La plataforma también incluye APIs de nivel superior para:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Precios de tokens.&lt;/li&gt;
&lt;li&gt;Capitalización de mercado.&lt;/li&gt;
&lt;li&gt;Volumen de trading.&lt;/li&gt;
&lt;li&gt;Datos históricos.&lt;/li&gt;
&lt;li&gt;Tokens.&lt;/li&gt;
&lt;li&gt;NFT.&lt;/li&gt;
&lt;li&gt;Exploración de blockchain.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  Fortalezas
&lt;/h3&gt;

&lt;ul&gt;
&lt;li&gt;Más de 300 redes blockchain.&lt;/li&gt;
&lt;li&gt;Más de 55 proveedores subyacentes.&lt;/li&gt;
&lt;li&gt;Interfaz API unificada.&lt;/li&gt;
&lt;li&gt;Enrutamiento inteligente y failover.&lt;/li&gt;
&lt;li&gt;APIs blockchain de nivel superior.&lt;/li&gt;
&lt;li&gt;Menor dependencia del proveedor.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  Desventajas
&lt;/h3&gt;

&lt;ul&gt;
&lt;li&gt;Añade otra capa de abstracción.&lt;/li&gt;
&lt;li&gt;El control directo a nivel de nodo puede ser menor.&lt;/li&gt;
&lt;li&gt;Su amplia superficie de API puede ser innecesaria para una aplicación RPC simple.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  Mejor para
&lt;/h3&gt;

&lt;p&gt;Aplicaciones multicadena, billeteras, plataformas Web3 y equipos que desean acceso unificado sin gestionar varios proveedores de infraestructura.&lt;/p&gt;

&lt;h2&gt;
  
  
  5. QuickNode: mejor para una plataforma Web3 full-stack
&lt;/h2&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fknzg8z2venetzni7xwqi.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fknzg8z2venetzni7xwqi.png" alt="QuickNode y su ecosistema de infraestructura Web3" width="800" height="446"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;&lt;a href="https://www.quicknode.com/" rel="noopener noreferrer"&gt;QuickNode&lt;/a&gt; combina acceso RPC con servicios adicionales para construir y operar aplicaciones blockchain.&lt;/p&gt;

&lt;p&gt;Su documentación actual indica soporte para más de 80 blockchains mediante interfaces RPC, REST y gRPC. Además, ofrece:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Streams:&lt;/strong&gt; flujos de datos blockchain en tiempo real.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Webhooks:&lt;/strong&gt; notificaciones basadas en eventos.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;SQL Explorer:&lt;/strong&gt; consultas sobre datos blockchain indexados.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;IPFS:&lt;/strong&gt; almacenamiento descentralizado.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Una aplicación podría usar RPC para interactuar con un contrato, WebSockets para recibir eventos, Streams para procesar datos y SQL Explorer para consultar información indexada.&lt;/p&gt;

&lt;p&gt;QuickNode también ofrece herramientas MCP y orientadas a agentes de IA. Sus APIs utilizan HTTP, JSON-RPC, REST, gRPC y WebSocket, por lo que los agentes pueden interactuar con ellas mediante interfaces estándar.&lt;/p&gt;

&lt;p&gt;Para cargas sensibles al rendimiento, QuickNode soporta WebSockets, gRPC y Streams de Solana. Cada opción puede adaptarse al desarrollo, a cargas de alta frecuencia o baja latencia y a pipelines de datos gestionados.&lt;/p&gt;

&lt;h3&gt;
  
  
  Fortalezas
&lt;/h3&gt;

&lt;ul&gt;
&lt;li&gt;Más de 80 redes blockchain.&lt;/li&gt;
&lt;li&gt;RPC, REST, gRPC y WebSockets.&lt;/li&gt;
&lt;li&gt;Streams y Webhooks.&lt;/li&gt;
&lt;li&gt;Datos blockchain consultables mediante SQL.&lt;/li&gt;
&lt;li&gt;Infraestructura IPFS.&lt;/li&gt;
&lt;li&gt;Herramientas para IA y agentes.&lt;/li&gt;
&lt;li&gt;Amplio ecosistema de desarrollo.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  Desventajas
&lt;/h3&gt;

&lt;ul&gt;
&lt;li&gt;Puede ser demasiado amplio para una dApp sencilla.&lt;/li&gt;
&lt;li&gt;Algunas características dependen del plan o de la cadena.&lt;/li&gt;
&lt;li&gt;Hay que evaluar qué productos son realmente necesarios.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  Mejor para
&lt;/h3&gt;

&lt;p&gt;Aplicaciones Web3 full-stack, dApps de producción, aplicaciones con muchos datos, agentes de IA y equipos que necesitan RPC junto con otros servicios blockchain.&lt;/p&gt;

&lt;h1&gt;
  
  
  Cómo elegir el proveedor RPC adecuado
&lt;/h1&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fkokqp4wremb9kcz0jc9s.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fkokqp4wremb9kcz0jc9s.png" alt="Comparación de modelos de infraestructura RPC" width="800" height="446"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;No existe un proveedor que sea automáticamente mejor para todas las aplicaciones. La elección depende del modelo de infraestructura que necesite tu producto.&lt;/p&gt;

&lt;h3&gt;
  
  
  Elige Chainstack si necesitas infraestructura gestionada flexible
&lt;/h3&gt;

&lt;p&gt;Es una buena opción si quieres pasar gradualmente de RPC compartido a nodos dedicados, de archivo o especializados.&lt;/p&gt;

&lt;h3&gt;
  
  
  Elige OnFinality si priorizas la cobertura multicadena
&lt;/h3&gt;

&lt;p&gt;Su combinación de RPC gestionado, acceso a archivos, análisis y nodos dedicados resulta adecuada para equipos que trabajan con muchas redes.&lt;/p&gt;

&lt;h3&gt;
  
  
  Elige RouteMesh si la redundancia es lo más importante
&lt;/h3&gt;

&lt;p&gt;Su modelo de agregación y enrutamiento reduce la dependencia de un único proveedor y gestiona automáticamente los reintentos y el failover.&lt;/p&gt;

&lt;h3&gt;
  
  
  Elige Uniblock si quieres una integración para múltiples APIs
&lt;/h3&gt;

&lt;p&gt;Es útil cuando deseas abstraer la gestión de proveedores RPC y acceder también a APIs blockchain de nivel superior.&lt;/p&gt;

&lt;h3&gt;
  
  
  Elige QuickNode si necesitas una plataforma Web3 más amplia
&lt;/h3&gt;

&lt;p&gt;Es especialmente adecuado cuando RPC debe convivir con streaming, Webhooks, datos indexados, IPFS y herramientas para agentes.&lt;/p&gt;

&lt;h1&gt;
  
  
  Nodos RPC frente a APIs de datos blockchain
&lt;/h1&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fozmtgw5akwxado8viiw9.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fozmtgw5akwxado8viiw9.png" alt="Diferencia entre RPC y APIs de datos blockchain" width="800" height="446"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;La infraestructura RPC y las APIs de datos blockchain no son lo mismo.&lt;/p&gt;

&lt;p&gt;Un punto final RPC proporciona acceso relativamente directo a un nodo. Por ejemplo, una aplicación puede solicitar el último bloque o enviar una transacción.&lt;/p&gt;

&lt;p&gt;Sin embargo, muchas aplicaciones necesitan información que requiere procesamiento adicional. Una aplicación de cartera podría necesitar:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Saldos de tokens.&lt;/li&gt;
&lt;li&gt;Historial de transacciones.&lt;/li&gt;
&lt;li&gt;Metadatos de tokens.&lt;/li&gt;
&lt;li&gt;Valor total de la cartera.&lt;/li&gt;
&lt;li&gt;Posiciones DeFi.&lt;/li&gt;
&lt;li&gt;Precios de mercado.&lt;/li&gt;
&lt;li&gt;Información de riesgo.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Obtener todo esto mediante llamadas RPC puras puede requerir un trabajo de desarrollo considerable.&lt;/p&gt;

&lt;p&gt;Por eso, las arquitecturas Web3 modernas suelen combinar varias capas:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Un proveedor RPC para interactuar directamente con la blockchain.&lt;/li&gt;
&lt;li&gt;Un servicio de indexación para datos estructurados en cadena.&lt;/li&gt;
&lt;li&gt;Una API especializada para información de cartera o de mercado.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Para los agentes de IA, esta separación es todavía más importante. Un punto final RPC ofrece datos brutos, mientras que las APIs de nivel superior pueden convertirlos en información estructurada y más fácil de consumir.&lt;/p&gt;

&lt;h1&gt;
  
  
  Qué puedes construir con infraestructura RPC
&lt;/h1&gt;

&lt;h2&gt;
  
  
  Aplicaciones de billetera
&lt;/h2&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fqcy65futzvaptiknxe70.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fqcy65futzvaptiknxe70.png" alt="Aplicaciones de billetera basadas en RPC" width="800" height="446"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;Las billeteras utilizan RPC para recuperar saldos, interactuar con contratos, enviar transacciones y monitorizar la actividad de la red.&lt;/p&gt;

&lt;p&gt;Las billeteras más sofisticadas pueden combinar RPC con datos indexados y APIs de cartera para ofrecer una experiencia más completa.&lt;/p&gt;

&lt;h2&gt;
  
  
  Aplicaciones DeFi
&lt;/h2&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fj46512zgu995eyhc68ld.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fj46512zgu995eyhc68ld.png" alt="Aplicaciones DeFi y contratos inteligentes" width="800" height="446"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;Las aplicaciones DeFi interactúan constantemente con contratos inteligentes. Ya sea para intercambiar tokens, proporcionar liquidez, pedir activos prestados o hacer staking, el acceso RPC confiable es una parte central de la arquitectura.&lt;/p&gt;

&lt;p&gt;Las aplicaciones más exigentes también pueden necesitar datos de archivo, WebSockets o infraestructura especializada.&lt;/p&gt;

&lt;h2&gt;
  
  
  Bots de trading
&lt;/h2&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fce5pkvtcu128za9evk6m.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fce5pkvtcu128za9evk6m.png" alt="Bots de trading y datos blockchain en tiempo real" width="800" height="446"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;Los sistemas de trading son especialmente sensibles a la latencia y la disponibilidad. Un bot puede necesitar:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Monitorizar la actividad de la blockchain.&lt;/li&gt;
&lt;li&gt;Identificar una oportunidad.&lt;/li&gt;
&lt;li&gt;Leer el estado del contrato.&lt;/li&gt;
&lt;li&gt;Simular una transacción.&lt;/li&gt;
&lt;li&gt;Enviar la transacción.&lt;/li&gt;
&lt;li&gt;Monitorizar el resultado.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;En este contexto, la capa RPC puede convertirse en una parte crítica de toda la arquitectura de trading.&lt;/p&gt;

&lt;h2&gt;
  
  
  Agentes de IA
&lt;/h2&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fgljtq0na7uaczbw0o8ck.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fgljtq0na7uaczbw0o8ck.png" alt="Agentes de IA interactuando con infraestructura blockchain" width="800" height="446"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;Un agente de IA no siempre sigue una secuencia predefinida. Puede decidir qué información necesita y realizar varias solicitudes a la blockchain durante su proceso de razonamiento.&lt;/p&gt;

&lt;p&gt;La infraestructura debe manejar patrones de solicitud impredecibles y ofrecer acceso confiable a los datos.&lt;/p&gt;

&lt;p&gt;Por eso Chainstack y QuickNode están incorporando interfaces orientadas a la IA:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;El servidor MCP de Chainstack proporciona acceso a datos blockchain en vivo, documentación y gestión de nodos.&lt;/li&gt;
&lt;li&gt;QuickNode expone sus APIs mediante interfaces estándar y ofrece herramientas para agentes.&lt;/li&gt;
&lt;/ul&gt;

&lt;h1&gt;
  
  
  Consideraciones finales
&lt;/h1&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fi7et3a5jsaq7g2az0pxc.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fi7et3a5jsaq7g2az0pxc.png" alt="Arquitecturas Web3 modernas con infraestructura RPC" width="800" height="446"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;Elegir un proveedor RPC ya no consiste únicamente en encontrar un punto final para una blockchain.&lt;/p&gt;

&lt;p&gt;Las aplicaciones Web3 actuales también deben considerar:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Latencia.&lt;/li&gt;
&lt;li&gt;Fiabilidad.&lt;/li&gt;
&lt;li&gt;Datos de archivo.&lt;/li&gt;
&lt;li&gt;Streaming.&lt;/li&gt;
&lt;li&gt;Infraestructura dedicada.&lt;/li&gt;
&lt;li&gt;Enrutamiento.&lt;/li&gt;
&lt;li&gt;Soporte multicadena.&lt;/li&gt;
&lt;li&gt;Carga operativa.&lt;/li&gt;
&lt;li&gt;Integración con agentes de IA.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Los cinco proveedores abordan el problema de forma diferente:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Chainstack&lt;/strong&gt; se centra en infraestructura gestionada con múltiples configuraciones de nodos y capacidades de producción.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;OnFinality&lt;/strong&gt; ofrece RPC multicadena con archivos, análisis y nodos dedicados.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;RouteMesh&lt;/strong&gt; abstrae varios proveedores detrás de una capa de enrutamiento orientada a la fiabilidad.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Uniblock&lt;/strong&gt; combina RPC con APIs de nivel superior y gestión unificada de proveedores.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;QuickNode&lt;/strong&gt; ofrece una pila Web3 más amplia con RPC, streaming, Webhooks, datos indexados, IPFS y herramientas para IA.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;La pregunta importante no es simplemente «¿Cuál es el mejor proveedor RPC?».&lt;/p&gt;

&lt;p&gt;Es:&lt;/p&gt;

&lt;blockquote&gt;
&lt;p&gt;¿Qué modelo de infraestructura se adapta mejor a la aplicación que estoy construyendo?&lt;/p&gt;
&lt;/blockquote&gt;

&lt;p&gt;Una dApp pequeña puede necesitar solo un punto final compartido. Una billetera de producción puede requerir redundancia multicadena. Un sistema de trading puede priorizar latencia e infraestructura dedicada. Un agente de IA puede necesitar RPC, datos estructurados y herramientas compatibles con agentes.&lt;/p&gt;

&lt;p&gt;Tomar esta decisión pronto puede ahorrar una cantidad significativa de trabajo de ingeniería cuando el producto pase del prototipo a producción.&lt;/p&gt;

</description>
    </item>
    <item>
      <title>Gemini 3.8 Flash: Precios, tarifas iniciales, tokens de procesamiento y el costo real por tarea</title>
      <dc:creator>Roobia</dc:creator>
      <pubDate>Thu, 03 Sep 2026 08:21:33 +0000</pubDate>
      <link>https://dev.to/roobia/gemini-38-flash-precios-tarifas-iniciales-tokens-de-procesamiento-y-el-costo-real-por-tarea-746</link>
      <guid>https://dev.to/roobia/gemini-38-flash-precios-tarifas-iniciales-tokens-de-procesamiento-y-el-costo-real-por-tarea-746</guid>
      <description>&lt;h1&gt;
  
  
  Precios de Gemini 3.8 Flash: el mismo precio por token, pero más tokens por tarea
&lt;/h1&gt;

&lt;p&gt;Gemini 3.8 Flash cuesta $0.75 por millón de tokens de entrada y $3.75 por millón de tokens de salida, la misma tarifa introductoria que Google estableció para 3.7 Flash. Se mantiene hasta el 31 de diciembre de 2026; el 1 de enero de 2027 subirá a $1.50 y $7.50. La misma duplicación afectará a 3.6 Flash y 3.7 Flash. El precio por token no cambió con esta versión.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation" class="crayons-btn crayons-btn--primary"&gt;Prueba Apidog hoy&lt;/a&gt;
&lt;/p&gt;

&lt;p&gt;Lo que sí cambió es el consumo. Google afirma que 3.8 Flash “trabaja más duro”: ejecuta más pasos de razonamiento, llama a herramientas de forma iterativa y puede usar más tokens en tareas largas y complejas.&lt;/p&gt;

&lt;p&gt;Artificial Analysis midió el impacto: su Índice de Inteligencia costó $0.58 por tarea con Gemini 3.8 Flash en nivel &lt;code&gt;high&lt;/code&gt;, frente a $0.40 con 3.7 Flash. El modelo nuevo utilizó aproximadamente un 30 % más de tokens de salida por tarea.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;Mismo precio de etiqueta, factura más alta.&lt;/strong&gt;&lt;/p&gt;

&lt;p&gt;Esta guía explica los precios oficiales, calcula un escenario de 1.000 tareas diarias por nivel de pensamiento y compara Gemini 3.8 Flash con Flash-Lite, Claude Sonnet 5 y GPT-5.6 Luna. Para conocer el modelo, consulta &lt;a href="https://apidog.com/es/blog/what-is-gemini-3-8-flash?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;qué es Gemini 3.8 Flash&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Precios de Gemini 3.8 Flash
&lt;/h2&gt;

&lt;p&gt;Todos los precios corresponden a 1 millón de tokens en el nivel de pago.&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Concepto&lt;/th&gt;
&lt;th&gt;Introductorio&lt;br&gt;hasta el 31 dic. 2026&lt;/th&gt;
&lt;th&gt;Estándar&lt;br&gt;desde el 1 ene. 2027&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Entrada: texto, imagen, vídeo, audio y PDF&lt;/td&gt;
&lt;td&gt;$0.75&lt;/td&gt;
&lt;td&gt;$1.50&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Salida, incluidos los tokens de pensamiento&lt;/td&gt;
&lt;td&gt;$3.75&lt;/td&gt;
&lt;td&gt;$7.50&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Lectura de caché de contexto&lt;/td&gt;
&lt;td&gt;$0.075&lt;/td&gt;
&lt;td&gt;$0.15&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Almacenamiento en caché, por 1M de tokens/hora&lt;/td&gt;
&lt;td&gt;$0.50&lt;/td&gt;
&lt;td&gt;$1.00&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Entrada de API por lotes, 50 % de descuento&lt;/td&gt;
&lt;td&gt;$0.375&lt;/td&gt;
&lt;td&gt;$0.75&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Salida de API por lotes, 50 % de descuento&lt;/td&gt;
&lt;td&gt;$1.875&lt;/td&gt;
&lt;td&gt;$3.75&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Google Search grounding&lt;/td&gt;
&lt;td&gt;5.000 solicitudes gratuitas/mes compartidas entre Gemini 3.x; después, $14 por 1.000&lt;/td&gt;
&lt;td&gt;Igual&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Nivel gratuito&lt;/td&gt;
&lt;td&gt;$0, con límites de tasa; los datos se utilizan para mejorar los productos de Google&lt;/td&gt;
&lt;td&gt;Igual&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;Hay tres puntos importantes:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Los tokens de pensamiento se cobran como salida, a $3.75 por millón, no como entrada.&lt;/li&gt;
&lt;li&gt;La tarifa introductoria termina en una fecha fija.&lt;/li&gt;
&lt;li&gt;Las tarifas de 3.6 Flash y 3.7 Flash también se duplican el 1 de enero.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;El &lt;a href="https://apidog.com/es/blog/gemini-3-7-flash-pricing-explained?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;desglose de precios de Gemini 3.7 Flash&lt;/a&gt; ayuda a comparar ambos modelos con el mismo esquema de tarifas.&lt;/p&gt;

&lt;h2&gt;
  
  
  Los tokens de pensamiento cuentan como salida
&lt;/h2&gt;

&lt;p&gt;Gemini 3.8 Flash razona antes de responder. Cada token utilizado durante ese razonamiento se mide como salida.&lt;/p&gt;

&lt;p&gt;En una respuesta de &lt;code&gt;generateContent&lt;/code&gt;, la API informa:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;code&gt;usageMetadata.thoughtsTokenCount&lt;/code&gt;: tokens de pensamiento.&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;candidatesTokenCount&lt;/code&gt;: tokens de la respuesta visible.&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;promptTokenCount&lt;/code&gt;: tokens de entrada.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Los dos primeros se cobran al precio de salida de $3.75 por millón.&lt;/p&gt;

&lt;p&gt;El nivel se configura con:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;&lt;code&gt;thinking_level: low&lt;/code&gt;&lt;/li&gt;
&lt;li&gt;&lt;code&gt;thinking_level: medium&lt;/code&gt;&lt;/li&gt;
&lt;li&gt;&lt;code&gt;thinking_level: high&lt;/code&gt;&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;En Gemini 3.8 Flash, el valor predeterminado es &lt;code&gt;medium&lt;/code&gt;. &lt;code&gt;minimal&lt;/code&gt; ya no es válido y produce un error de validación; si migras una configuración antigua, asígnala a &lt;code&gt;low&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;Estos niveles representan esfuerzo relativo, no un presupuesto exacto de tokens. A diferencia de &lt;code&gt;thinking_budget&lt;/code&gt;, no puedes establecer directamente un límite de tokens de pensamiento. Consulta la &lt;a href="https://ai.google.dev/gemini-api/docs/thinking" rel="noopener noreferrer"&gt;documentación de pensamiento de Google&lt;/a&gt; y la &lt;a href="https://apidog.com/es/blog/gemini-3-8-flash-thinking-levels?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de niveles de pensamiento de Gemini 3.8 Flash&lt;/a&gt;.&lt;/p&gt;

&lt;h3&gt;
  
  
  Ejemplo de coste por solicitud
&lt;/h3&gt;

&lt;p&gt;Supón que una solicitud:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Envía 10.000 tokens de entrada.&lt;/li&gt;
&lt;li&gt;Genera 2.000 tokens visibles.&lt;/li&gt;
&lt;li&gt;Utiliza 6.000 tokens de pensamiento.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Con las tarifas introductorias:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Entrada: 10.000 × $0.75 / 1.000.000 = $0.0075
Salida: (2.000 + 6.000) × $3.75 / 1.000.000 = $0.03
Total: $0.0375 por solicitud
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;El pensamiento representa el 75 % del coste de salida y el 60 % del coste total. Desde el 1 de enero, la misma solicitud costará:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Entrada: $0.015
Salida: $0.06
Total: $0.075
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Por tanto, “el mismo precio que 3.7” es cierto, pero incompleto: la tarifa no cambió, mientras que el número de tokens sí.&lt;/p&gt;

&lt;h2&gt;
  
  
  Por qué subió el coste por tarea
&lt;/h2&gt;

&lt;p&gt;En su &lt;a href="https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/" rel="noopener noreferrer"&gt;publicación de lanzamiento&lt;/a&gt;, Google explica que, en tareas complejas, Gemini 3.8 Flash:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Ejecuta pasos de razonamiento adicionales.&lt;/li&gt;
&lt;li&gt;Llama a herramientas de forma iterativa.&lt;/li&gt;
&lt;li&gt;Verifica su trabajo durante el proceso.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Eso aumenta los tokens de pensamiento y, en flujos agénticos, también el número de turnos de llamada a herramientas.&lt;/p&gt;

&lt;p&gt;La mitigación recomendada es sencilla:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Reduce &lt;code&gt;thinking_level&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Mantén Gemini 3.7 Flash para las rutas donde el coste sea prioritario.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;a href="https://artificialanalysis.ai/articles/gemini-3-8-flash" rel="noopener noreferrer"&gt;Artificial Analysis&lt;/a&gt; cuantificó el resultado. En su Índice de Inteligencia, Gemini 3.8 Flash obtuvo 59 puntos frente a 56 de 3.7 Flash en nivel alto, pero utilizó unos 48.000 tokens de salida por tarea, aproximadamente un 30 % más.&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Configuración&lt;/th&gt;
&lt;th&gt;Coste por tarea&lt;br&gt;tarifas introductorias&lt;/th&gt;
&lt;th&gt;Tiempo por tarea&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Gemini 3.8 Flash, &lt;code&gt;high&lt;/code&gt;
&lt;/td&gt;
&lt;td&gt;$0.58&lt;/td&gt;
&lt;td&gt;2,5 min&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Gemini 3.8 Flash, &lt;code&gt;medium&lt;/code&gt;
&lt;/td&gt;
&lt;td&gt;$0.41&lt;/td&gt;
&lt;td&gt;No publicado&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Gemini 3.8 Flash, &lt;code&gt;low&lt;/code&gt;
&lt;/td&gt;
&lt;td&gt;$0.24&lt;/td&gt;
&lt;td&gt;0,8 min&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Gemini 3.7 Flash, &lt;code&gt;high&lt;/code&gt;
&lt;/td&gt;
&lt;td&gt;$0.40&lt;/td&gt;
&lt;td&gt;2,2 min&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;La tabla permite tomar dos decisiones:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Frente a 3.7 Flash, 3.8 Flash en &lt;code&gt;high&lt;/code&gt; cuesta un 45 % más por tarea (&lt;code&gt;$0.58 / $0.40 = 1.45&lt;/code&gt;) a cambio de tres puntos adicionales.&lt;/li&gt;
&lt;li&gt;Dentro de 3.8 Flash, cambiar de &lt;code&gt;high&lt;/code&gt; a &lt;code&gt;medium&lt;/code&gt; reduce el coste un 29 % y usar &lt;code&gt;low&lt;/code&gt; lo reduce un 59 %.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;El coste de &lt;code&gt;medium&lt;/code&gt; queda a un centavo del coste de 3.7 Flash en &lt;code&gt;high&lt;/code&gt;, un punto de referencia útil para decidir si actualizar.&lt;/p&gt;

&lt;p&gt;Artificial Analysis también muestra una tarifa combinada de $0.58 por millón de tokens con una relación entrada-salida de 3:1. Que coincida con el coste de una tarea en nivel alto es una coincidencia: una cifra es una tarifa por token y la otra depende de cuántos tokens consuma el modelo.&lt;/p&gt;

&lt;h2&gt;
  
  
  Cómo aprovechar la tarifa introductoria
&lt;/h2&gt;

&lt;p&gt;La tarifa no se puede reservar ni prepagar. Google cobra la tarifa vigente cuando se consumen los tokens, por lo que no puedes comprar uso de 2027 a precios de 2026. Cambiar a 3.7 o 3.6 Flash tampoco evita el incremento.&lt;/p&gt;

&lt;p&gt;Sí puedes adelantar trabajo discrecional:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Ejecuta ahora las reposiciones y el procesamiento de documentos únicos mediante la API por lotes. Una reposición de 100 millones de tokens —75M de entrada y 25M de salida— cuesta aproximadamente:
&lt;/li&gt;
&lt;/ol&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;   75 × $0.375 + 25 × $1.875
   = $28.13 + $46.88
   = $74.99 en lotes este año
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;En enero costará el doble: $149.98.&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;&lt;p&gt;Construye tu conjunto de evaluación y registra los tokens de referencia antes del cambio de precio. Así, en enero solo cambiará una variable: la tarifa.&lt;/p&gt;&lt;/li&gt;
&lt;li&gt;&lt;p&gt;Define el nivel de pensamiento por ruta. Cada ruta que permanezca en &lt;code&gt;medium&lt;/code&gt; por defecto debe considerarse una ruta cuyo coste aún no has validado.&lt;/p&gt;&lt;/li&gt;
&lt;li&gt;&lt;p&gt;Si una ruta supera las evaluaciones con &lt;code&gt;low&lt;/code&gt;, déjala configurada en &lt;code&gt;low&lt;/code&gt; antes de enero.&lt;/p&gt;&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Para comparar proveedores, consulta el &lt;a href="https://apidog.com/es/blog/cheapest-llm-api-providers?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;resumen de proveedores de API de LLM más baratos&lt;/a&gt; y la comparación de &lt;a href="https://apidog.com/es/blog/gemini-3-8-flash-vs-claude-fable-5-1-vs-gpt-5-6-sol?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Fable 5.1 frente a GPT-5.6 Sol&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Comparación con Flash-Lite, Sonnet 5 y GPT-5.6 Luna
&lt;/h2&gt;

&lt;p&gt;Tarifas por 1 millón de tokens:&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Modelo&lt;/th&gt;
&lt;th&gt;Entrada&lt;/th&gt;
&lt;th&gt;Salida&lt;/th&gt;
&lt;th&gt;Notas&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Gemini 3.8 Flash, introductorio&lt;/td&gt;
&lt;td&gt;$0.75&lt;/td&gt;
&lt;td&gt;$3.75&lt;/td&gt;
&lt;td&gt;El pensamiento se cobra como salida; lectura de caché a $0.075&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Gemini 3.8 Flash, desde el 1 de enero&lt;/td&gt;
&lt;td&gt;$1.50&lt;/td&gt;
&lt;td&gt;$7.50&lt;/td&gt;
&lt;td&gt;Lectura de caché a $0.15&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Gemini 3.5 Flash-Lite&lt;/td&gt;
&lt;td&gt;$0.30&lt;/td&gt;
&lt;td&gt;$2.50&lt;/td&gt;
&lt;td&gt;Aproximadamente 350 tok/s&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Claude Sonnet 5&lt;/td&gt;
&lt;td&gt;$2&lt;/td&gt;
&lt;td&gt;$10&lt;/td&gt;
&lt;td&gt;Permanente; se canceló el aumento del 1 de septiembre&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;GPT-5.6 Luna&lt;/td&gt;
&lt;td&gt;$1&lt;/td&gt;
&lt;td&gt;$6&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;Con las tarifas introductorias:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;La entrada de 3.8 Flash cuesta 2,5 veces más que Flash-Lite.&lt;/li&gt;
&lt;li&gt;La salida cuesta 1,5 veces más que Flash-Lite.&lt;/li&gt;
&lt;li&gt;Frente a Sonnet 5, 3.8 Flash es aproximadamente 2,7 veces más barato tanto en entrada (&lt;code&gt;$2 / $0.75&lt;/code&gt;) como en salida (&lt;code&gt;$10 / $3.75&lt;/code&gt;).&lt;/li&gt;
&lt;li&gt;Frente a Luna, cuesta menos en entrada (&lt;code&gt;$0.75&lt;/code&gt; frente a &lt;code&gt;$1&lt;/code&gt;) y salida (&lt;code&gt;$3.75&lt;/code&gt; frente a &lt;code&gt;$6&lt;/code&gt;).&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;El 1 de enero el panorama cambia:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Gemini 3.8 Flash costará más que Luna en entrada y salida.&lt;/li&gt;
&lt;li&gt;La diferencia frente a Sonnet 5 se reducirá a aproximadamente 1,3 veces (&lt;code&gt;$2 / $1.50&lt;/code&gt; y &lt;code&gt;$10 / $7.50&lt;/code&gt;).&lt;/li&gt;
&lt;li&gt;Flash-Lite seguirá siendo más barato.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;El precio por token es solo la mitad del análisis. Un modelo que utiliza menos tokens puede costar menos por tarea aunque su tarifa sea mayor. Ejecuta el mismo conjunto de tareas con cada candidato y compara sus recuentos de uso. La &lt;a href="https://apidog.com/es/blog/how-to-use-gemini-3-8-flash-api?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de la API de Gemini 3.8 Flash&lt;/a&gt; muestra cómo leer &lt;code&gt;usageMetadata&lt;/code&gt; tanto en la API de Interactions como en &lt;code&gt;generateContent&lt;/code&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Detecta regresiones con aserciones de tokens en Apidog
&lt;/h2&gt;

&lt;p&gt;El fallo habitual no es una respuesta incorrecta. Es una respuesta correcta que, después de cambiar el prompt o el nivel de pensamiento, consume un 40 % más de tokens sin que nadie lo detecte hasta recibir la factura.&lt;/p&gt;

&lt;p&gt;Trata el consumo de tokens como tratarías un código de estado: almacénalo, mídelo y valida sus límites.&lt;/p&gt;

&lt;h3&gt;
  
  
  1. Guarda la clave como variable de entorno
&lt;/h3&gt;

&lt;p&gt;Crea &lt;code&gt;GEMINI_API_KEY&lt;/code&gt; en un entorno de &lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt; y utiliza &lt;code&gt;{{GEMINI_API_KEY}}&lt;/code&gt; en el encabezado &lt;code&gt;x-goog-api-key&lt;/code&gt;. Así, la clave no queda guardada directamente en la solicitud.&lt;/p&gt;

&lt;h3&gt;
  
  
  2. Crea un prompt de referencia
&lt;/h3&gt;

&lt;p&gt;Guarda una solicitud &lt;code&gt;POST&lt;/code&gt; a:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;https://generativelanguage.googleapis.com/v1beta/models/gemini-3.8-flash:generateContent
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Utiliza un prompt representativo y define explícitamente &lt;code&gt;thinkingConfig.thinkingLevel&lt;/code&gt;. Crea una solicitud de referencia para cada ruta de producción.&lt;/p&gt;

&lt;h3&gt;
  
  
  3. Valida los campos de uso
&lt;/h3&gt;

&lt;p&gt;Añade un script de postprocesamiento que lea &lt;code&gt;usageMetadata&lt;/code&gt; y falle si los valores superan tu línea base:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight javascript"&gt;&lt;code&gt;&lt;span class="kd"&gt;const&lt;/span&gt; &lt;span class="nx"&gt;usage&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="nx"&gt;pm&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;response&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;json&lt;/span&gt;&lt;span class="p"&gt;().&lt;/span&gt;&lt;span class="nx"&gt;usageMetadata&lt;/span&gt;&lt;span class="p"&gt;;&lt;/span&gt;

&lt;span class="nx"&gt;pm&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;test&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="s2"&gt;tokens de pensamiento dentro del presupuesto&lt;/span&gt;&lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="p"&gt;()&lt;/span&gt; &lt;span class="o"&gt;=&amp;gt;&lt;/span&gt; &lt;span class="p"&gt;{&lt;/span&gt;
  &lt;span class="nx"&gt;pm&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;expect&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="nx"&gt;usage&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;thoughtsTokenCount&lt;/span&gt;&lt;span class="p"&gt;).&lt;/span&gt;&lt;span class="nx"&gt;to&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;be&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;below&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="mi"&gt;8000&lt;/span&gt;&lt;span class="p"&gt;);&lt;/span&gt;
  &lt;span class="c1"&gt;// Los tokens de pensamiento deben ser inferiores a 8000&lt;/span&gt;
&lt;span class="p"&gt;});&lt;/span&gt;

&lt;span class="nx"&gt;pm&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;test&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="s2"&gt;salida visible dentro del presupuesto&lt;/span&gt;&lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="p"&gt;()&lt;/span&gt; &lt;span class="o"&gt;=&amp;gt;&lt;/span&gt; &lt;span class="p"&gt;{&lt;/span&gt;
  &lt;span class="nx"&gt;pm&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;expect&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="nx"&gt;usage&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;candidatesTokenCount&lt;/span&gt;&lt;span class="p"&gt;).&lt;/span&gt;&lt;span class="nx"&gt;to&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;be&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;below&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="mi"&gt;2500&lt;/span&gt;&lt;span class="p"&gt;);&lt;/span&gt;
  &lt;span class="c1"&gt;// La salida visible debe ser inferior a 2500&lt;/span&gt;
&lt;span class="p"&gt;});&lt;/span&gt;

&lt;span class="nx"&gt;pm&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;test&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="s2"&gt;costo de solicitud dentro del presupuesto&lt;/span&gt;&lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="p"&gt;()&lt;/span&gt; &lt;span class="o"&gt;=&amp;gt;&lt;/span&gt; &lt;span class="p"&gt;{&lt;/span&gt;
  &lt;span class="kd"&gt;const&lt;/span&gt; &lt;span class="nx"&gt;cost&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt;
    &lt;span class="nx"&gt;usage&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;promptTokenCount&lt;/span&gt; &lt;span class="o"&gt;*&lt;/span&gt; &lt;span class="mf"&gt;0.75&lt;/span&gt; &lt;span class="o"&gt;/&lt;/span&gt; &lt;span class="mi"&gt;1&lt;/span&gt;&lt;span class="nx"&gt;e6&lt;/span&gt; &lt;span class="o"&gt;+&lt;/span&gt;
    &lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="nx"&gt;usage&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;thoughtsTokenCount&lt;/span&gt; &lt;span class="o"&gt;+&lt;/span&gt; &lt;span class="nx"&gt;usage&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;candidatesTokenCount&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt; &lt;span class="o"&gt;*&lt;/span&gt; &lt;span class="mf"&gt;3.75&lt;/span&gt; &lt;span class="o"&gt;/&lt;/span&gt; &lt;span class="mi"&gt;1&lt;/span&gt;&lt;span class="nx"&gt;e6&lt;/span&gt;&lt;span class="p"&gt;;&lt;/span&gt;

  &lt;span class="nx"&gt;pm&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;expect&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="nx"&gt;cost&lt;/span&gt;&lt;span class="p"&gt;).&lt;/span&gt;&lt;span class="nx"&gt;to&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;be&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;below&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="mf"&gt;0.05&lt;/span&gt;&lt;span class="p"&gt;);&lt;/span&gt;
  &lt;span class="c1"&gt;// El costo debe ser inferior a 0.05&lt;/span&gt;
&lt;span class="p"&gt;});&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fp8r8t5rbwrzlpw7ztekl.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fp8r8t5rbwrzlpw7ztekl.png" alt="Captura de la configuración de aserciones de tokens en Apidog" width="799" height="530"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;h3&gt;
  
  
  4. Programa las pruebas
&lt;/h3&gt;

&lt;p&gt;Coloca las solicitudes en un escenario de prueba y ejecútalo según un cronograma. Una desviación en el consumo aparecerá como una ejecución fallida el mismo día. La &lt;a href="https://apidog.com/es/blog/how-to-schedule-api-tests-apidog?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía para programar pruebas de API en Apidog&lt;/a&gt; explica la configuración.&lt;/p&gt;

&lt;p&gt;El 1 de enero, actualiza las dos constantes de tarifa del script. Las aserciones seguirán monitorizando el coste real.&lt;/p&gt;

&lt;p&gt;El mismo escenario puede funcionar como prueba comparativa: duplica la solicitud para Flash-Lite, Sonnet 5 y Luna y compara sus campos de uso en paralelo. El &lt;a href="https://apidog.com/es/blog/how-to-use-gemini-3-8-flash-for-free?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;plan gratuito de Apidog&lt;/a&gt; cubre este flujo de trabajo.&lt;/p&gt;

&lt;h2&gt;
  
  
  Preguntas frecuentes
&lt;/h2&gt;

&lt;h3&gt;
  
  
  ¿Gemini 3.8 Flash cuesta más que 3.7 Flash?
&lt;/h3&gt;

&lt;p&gt;Por token, no. Ambos cuestan $0.75 de entrada y $3.75 de salida hasta el 31 de diciembre; después, $1.50 y $7.50.&lt;/p&gt;

&lt;p&gt;Por tarea, sí. Artificial Analysis midió $0.58 por tarea del índice con 3.8 Flash en nivel alto frente a $0.40 con 3.7 Flash, porque el modelo nuevo genera aproximadamente un 30 % más de tokens de salida.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Los tokens de pensamiento se facturan por separado?
&lt;/h3&gt;

&lt;p&gt;No. Se cobran como tokens de salida: $3.75 por millón durante el periodo introductorio y aparecen en &lt;code&gt;usageMetadata.thoughtsTokenCount&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;Se controlan indirectamente con &lt;code&gt;thinking_level&lt;/code&gt;. Gemini 3.8 Flash no ofrece un presupuesto fijo de tokens y &lt;code&gt;minimal&lt;/code&gt; devuelve un error de validación.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Existe un nivel gratuito?
&lt;/h3&gt;

&lt;p&gt;Sí. AI Studio no cobra por entrada ni salida en el nivel gratuito, aunque aplica límites de tasa y Google utiliza esos datos para mejorar sus productos.&lt;/p&gt;

&lt;p&gt;La aplicación Gemini para consumidores solo ofrece 3.8 Flash a suscriptores de AI Pro y Ultra. Consulta la &lt;a href="https://apidog.com/es/blog/how-to-use-gemini-3-8-flash-for-free?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de uso gratuito&lt;/a&gt;.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Qué ocurrirá con los costes el 1 de enero de 2027?
&lt;/h3&gt;

&lt;p&gt;Se duplicarán las tarifas de:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Entrada.&lt;/li&gt;
&lt;li&gt;Salida.&lt;/li&gt;
&lt;li&gt;Lectura de caché.&lt;/li&gt;
&lt;li&gt;Almacenamiento en caché.&lt;/li&gt;
&lt;li&gt;API por lotes.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Si el consumo por tarea permanece igual, la factura también se duplicará. Las tarifas de 3.6 y 3.7 Flash cambiarán en la misma fecha.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Qué nivel de pensamiento mantiene los costes bajos?
&lt;/h3&gt;

&lt;p&gt;Utiliza estas cifras de Artificial Analysis como referencia:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;code&gt;low&lt;/code&gt;: $0.24 por tarea.&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;medium&lt;/code&gt;: $0.41 por tarea.&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;high&lt;/code&gt;: $0.58 por tarea.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Después, ejecuta tus propias evaluaciones, conserva el nivel más bajo que cumpla tus requisitos y añade aserciones sobre los recuentos de tokens.&lt;/p&gt;

&lt;h2&gt;
  
  
  Qué hacer esta semana
&lt;/h2&gt;

&lt;ol&gt;
&lt;li&gt;Mide cada ruta con &lt;code&gt;low&lt;/code&gt;, &lt;code&gt;medium&lt;/code&gt; y &lt;code&gt;high&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Define una línea base para &lt;code&gt;thoughtsTokenCount&lt;/code&gt;, &lt;code&gt;candidatesTokenCount&lt;/code&gt; y el coste total.&lt;/li&gt;
&lt;li&gt;Cambia a &lt;code&gt;low&lt;/code&gt; las rutas que superen las evaluaciones con ese nivel.&lt;/li&gt;
&lt;li&gt;Ejecuta antes del 31 de diciembre el trabajo compatible con la API por lotes.&lt;/li&gt;
&lt;li&gt;Programa pruebas periódicas en Apidog para detectar aumentos de consumo.&lt;/li&gt;
&lt;li&gt;Revisa el presupuesto antes del 1 de enero de 2027.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Gemini 3.8 Flash mantiene un precio por token similar al de 3.7 Flash, pero consume tokens como un modelo más grande. Trata &lt;code&gt;thinking_level&lt;/code&gt; como una configuración de coste, ajústalo por ruta y valida el uso automáticamente. Así, la duplicación de enero será un cambio presupuestario previsto, no una sorpresa.&lt;/p&gt;

&lt;h2&gt;
  
  
  Referencias
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;&lt;a href="https://ai.google.dev/gemini-api/docs/pricing" rel="noopener noreferrer"&gt;Precios oficiales de la API de Gemini&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://apidog.com/es/blog/what-is-gemini-3-8-flash?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Qué es Gemini 3.8 Flash&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://apidog.com/es/blog/gemini-3-7-flash-pricing-explained?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Desglose de precios de Gemini 3.7 Flash&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://ai.google.dev/gemini-api/docs/thinking" rel="noopener noreferrer"&gt;Documentación de pensamiento&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://apidog.com/es/blog/gemini-3-8-flash-thinking-levels?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Niveles de pensamiento de Gemini 3.8 Flash&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/" rel="noopener noreferrer"&gt;Publicación de lanzamiento de Google&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://artificialanalysis.ai/articles/gemini-3-8-flash" rel="noopener noreferrer"&gt;Análisis de Artificial Analysis&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://apidog.com/es/blog/gemini-3-8-flash-vs-gemini-3-7-flash?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Gemini 3.8 Flash frente a 3.7 Flash&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://apidog.com/es/blog/cheapest-llm-api-providers?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Proveedores de API de LLM más baratos&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://apidog.com/es/blog/gemini-3-8-flash-vs-claude-fable-5-1-vs-gpt-5-6-sol?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Gemini 3.8 Flash frente a Fable 5.1 y GPT-5.6 Sol&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://apidog.com/es/blog/how-to-use-gemini-3-8-flash-api?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Cómo usar la API de Gemini 3.8 Flash&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://apidog.com/es/blog/how-to-schedule-api-tests-apidog?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Cómo programar pruebas de API en Apidog&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://apidog.com/download?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Descargar Apidog&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://apidog.com/es/blog/how-to-use-gemini-3-8-flash-for-free?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Cómo usar Gemini 3.8 Flash gratis&lt;/a&gt;&lt;/li&gt;
&lt;/ul&gt;

</description>
    </item>
    <item>
      <title>Gemini 3.8 Flash: Niveles de pensamiento bajo vs. medio vs. alto y por qué el nivel mínimo desapareció</title>
      <dc:creator>Roobia</dc:creator>
      <pubDate>Thu, 03 Sep 2026 08:16:58 +0000</pubDate>
      <link>https://dev.to/roobia/gemini-38-flash-niveles-de-pensamiento-bajo-vs-medio-vs-alto-y-por-que-el-nivel-minimo-71d</link>
      <guid>https://dev.to/roobia/gemini-38-flash-niveles-de-pensamiento-bajo-vs-medio-vs-alto-y-por-que-el-nivel-minimo-71d</guid>
      <description>&lt;h1&gt;
  
  
  Cómo elegir el nivel de razonamiento en Gemini 3.8 Flash
&lt;/h1&gt;

&lt;p&gt;Gemini 3.8 Flash se ofrece con tres niveles de razonamiento: &lt;code&gt;low&lt;/code&gt;, &lt;code&gt;medium&lt;/code&gt; y &lt;code&gt;high&lt;/code&gt;. Esta configuración controla cuánto razonamiento interno realiza el modelo antes de responder y, por tanto, afecta la latencia, los tokens de salida y el costo. Si es nuevo en el modelo, consulte la &lt;a href="https://apidog.com/es/blog/what-is-gemini-3-8-flash?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;descripción general de Gemini 3.8 Flash&lt;/a&gt;; esta guía se concentra únicamente en el control del nivel.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation" class="crayons-btn crayons-btn--primary"&gt;Prueba Apidog hoy&lt;/a&gt;
&lt;/p&gt;

&lt;p&gt;Hay dos detalles importantes: el nivel predeterminado es &lt;code&gt;medium&lt;/code&gt;, no &lt;code&gt;high&lt;/code&gt;, y &lt;code&gt;minimal&lt;/code&gt;, que todavía se enviaba en configuraciones de Gemini 3.7 Flash, ya no es compatible. La solicitud falla durante la validación antes de generar tokens. Google documenta ambos cambios en la página de &lt;a href="https://ai.google.dev/gemini-api/docs/latest-model" rel="noopener noreferrer"&gt;Novedades de Gemini 3.8 Flash&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;A continuación verá qué hace cada nivel, cuánto puede costar, cómo configurarlo en las dos superficies de API y cómo probar los tres niveles antes de desplegar.&lt;/p&gt;

&lt;h2&gt;
  
  
  Niveles de razonamiento de un vistazo
&lt;/h2&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Nivel&lt;/th&gt;
&lt;th&gt;Orientación de Google&lt;/th&gt;
&lt;th&gt;Costo por tarea (AA)&lt;/th&gt;
&lt;th&gt;Tiempo por tarea (AA)&lt;/th&gt;
&lt;th&gt;Úselo cuando&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;&lt;code&gt;low&lt;/code&gt;&lt;/td&gt;
&lt;td&gt;Minimiza latencia y costo; seguimiento de instrucciones simple, chat y rutas de alto rendimiento&lt;/td&gt;
&lt;td&gt;$0.24&lt;/td&gt;
&lt;td&gt;0.8 min&lt;/td&gt;
&lt;td&gt;La latencia importa; búsqueda en transcripciones; clasificación&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;
&lt;code&gt;medium&lt;/code&gt; (predeterminado)&lt;/td&gt;
&lt;td&gt;Equilibrio para código complejo y trabajo de agente&lt;/td&gt;
&lt;td&gt;$0.41&lt;/td&gt;
&lt;td&gt;No publicado en texto&lt;/td&gt;
&lt;td&gt;La mayoría de las rutas; preguntas y respuestas generales de video&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;&lt;code&gt;high&lt;/code&gt;&lt;/td&gt;
&lt;td&gt;Máxima profundidad para problemas difíciles de varios pasos&lt;/td&gt;
&lt;td&gt;$0.58&lt;/td&gt;
&lt;td&gt;2.5 min&lt;/td&gt;
&lt;td&gt;QA visual densa; videos de más de 60 minutos; planificación crítica&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;&lt;code&gt;minimal&lt;/code&gt;&lt;/td&gt;
&lt;td&gt;No compatible con 3.8 Flash&lt;/td&gt;
&lt;td&gt;n/a&lt;/td&gt;
&lt;td&gt;n/a&lt;/td&gt;
&lt;td&gt;Nunca; conviértalo en &lt;code&gt;low&lt;/code&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;Las cifras de costo y tiempo son promedios de &lt;a href="https://artificialanalysis.ai/articles/gemini-3-8-flash" rel="noopener noreferrer"&gt;Artificial Analysis&lt;/a&gt; al ejecutar su Intelligence Index con los precios de introducción de Google. Son independientes de Google y representan una carga de referencia, no sus prompts. Úselas para estimar proporciones y mida sus propias rutas.&lt;/p&gt;

&lt;h2&gt;
  
  
  Qué hace cada nivel
&lt;/h2&gt;

&lt;p&gt;Las respuestas de 3.8 Flash pueden incluir tokens de razonamiento: contenido que el modelo genera antes de la respuesta visible. Se facturan como tokens de salida a $3.75 por millón hasta el 31/12/2026 y $7.50 desde el 01/01/2027. La API los informa por separado mediante &lt;code&gt;usageMetadata.thoughtsTokenCount&lt;/code&gt;.&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;&lt;code&gt;low&lt;/code&gt;&lt;/strong&gt; mantiene corto el razonamiento. Reduce el tiempo hasta el primer token y el costo de salida. Está pensado para instrucciones simples, chat y endpoints de alto rendimiento.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;&lt;code&gt;medium&lt;/code&gt;&lt;/strong&gt; es el equilibrio y el valor predeterminado. Google lo recomienda para código complejo y tareas de agente.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;&lt;code&gt;high&lt;/code&gt;&lt;/strong&gt; solicita la mayor profundidad posible para problemas difíciles y con varios pasos.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;En 3.8 Flash, las tareas complejas pueden ejecutar pasos de razonamiento adicionales, llamar herramientas de forma iterativa y verificar el trabajo durante la ejecución. Google advierte que el modelo puede usar más tokens en tareas largas y complejas, especialmente con niveles de esfuerzo altos.&lt;/p&gt;

&lt;p&gt;Si aumenta el consumo de tokens, la primera recomendación es reducir &lt;code&gt;thinking_level&lt;/code&gt;. La segunda es permanecer en Gemini 3.7 Flash, que sigue siendo totalmente compatible.&lt;/p&gt;

&lt;h3&gt;
  
  
  &lt;code&gt;thinking_level&lt;/code&gt; no es un presupuesto
&lt;/h3&gt;

&lt;p&gt;En Gemini 3 ya no existe &lt;code&gt;thinking_budget&lt;/code&gt;. No puede solicitar, por ejemplo, un máximo de 2.000 tokens de razonamiento. Debe elegir un nivel y medir su impacto en sus propios prompts.&lt;/p&gt;

&lt;h2&gt;
  
  
  El valor predeterminado es &lt;code&gt;medium&lt;/code&gt;, no &lt;code&gt;high&lt;/code&gt;
&lt;/h2&gt;

&lt;p&gt;Si omite el campo, Gemini 3.8 Flash usa &lt;code&gt;medium&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;Esto puede sorprender a:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Equipos que prototiparon con Gemini 3 Pro y esperaban &lt;code&gt;high&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Equipos que eliminaron &lt;code&gt;thinking_budget&lt;/code&gt; durante la migración desde 3.7 Flash y no añadieron un nivel nuevo.&lt;/li&gt;
&lt;li&gt;Rutas de chat que deberían priorizar latencia, pero quedaron accidentalmente en &lt;code&gt;medium&lt;/code&gt;.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Establezca &lt;code&gt;thinking_level&lt;/code&gt; explícitamente en cada solicitud y mantenga el valor en la configuración de cada ruta, no disperso en el código. Los valores predeterminados de un proveedor pueden cambiar; su perfil de costos no debería hacerlo.&lt;/p&gt;

&lt;h2&gt;
  
  
  Por qué desapareció &lt;code&gt;minimal&lt;/code&gt;
&lt;/h2&gt;

&lt;p&gt;&lt;code&gt;minimal&lt;/code&gt; funcionaba en Gemini 3.7 Flash, pero no forma parte de los niveles compatibles con Gemini 3.8 Flash. La &lt;a href="https://ai.google.dev/gemini-api/docs/models/gemini-3.8-flash" rel="noopener noreferrer"&gt;página del modelo&lt;/a&gt; solo enumera &lt;code&gt;low&lt;/code&gt;, &lt;code&gt;medium&lt;/code&gt; y &lt;code&gt;high&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;Una solicitud REST con &lt;code&gt;minimal&lt;/code&gt; se rechaza con &lt;code&gt;400 INVALID_ARGUMENT&lt;/code&gt; antes de ejecutar el modelo:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"model"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"gemini-3.8-flash"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"input"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"Classify this ticket as billing, bug, or feature."&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"generation_config"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="nl"&gt;"thinking_level"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"minimal"&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;El mensaje devuelto es:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Thinking level MINIMAL is not supported for this model. Please retry with other thinking level.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Los SDK pueden envolver el error en sus propias excepciones. Para detectarlo, compruebe el estado &lt;code&gt;400&lt;/code&gt; o el código &lt;code&gt;INVALID_ARGUMENT&lt;/code&gt;, no solo el texto del mensaje.&lt;/p&gt;

&lt;p&gt;La corrección es un mapeo directo:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"model"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"gemini-3.8-flash"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"input"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"Classify this ticket as billing, bug, or feature."&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"generation_config"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="nl"&gt;"thinking_level"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"low"&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;La &lt;a href="https://apidog.com/es/blog/gemini-3-7-to-3-8-flash-migration-guide?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de migración de Gemini 3.7 a 3.8 Flash&lt;/a&gt; recomienda convertir &lt;code&gt;minimal&lt;/code&gt; en &lt;code&gt;low&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;No intente reemplazarlo con &lt;code&gt;thinking_budget&lt;/code&gt;: tampoco es compatible con Gemini 3. Google también recomienda conservar &lt;code&gt;temperature&lt;/code&gt; en su valor predeterminado de &lt;code&gt;1.0&lt;/code&gt;; reducirla puede producir bucles o una salida degradada.&lt;/p&gt;

&lt;p&gt;Como el error aparece durante la validación, una prueba programada que envíe &lt;code&gt;minimal&lt;/code&gt; puede detectar gratis una regresión de configuración.&lt;/p&gt;

&lt;h2&gt;
  
  
  Cuánto cuesta cada nivel
&lt;/h2&gt;

&lt;p&gt;El precio por token no cambia según el nivel. La &lt;a href="https://ai.google.dev/gemini-api/docs/pricing" rel="noopener noreferrer"&gt;página de precios de Google&lt;/a&gt; lista $0.75 por millón de tokens de entrada y $3.75 por millón de tokens de salida a la tarifa de introducción. Desde el 01/01/2027 serán $1.50 y $7.50, respectivamente.&lt;/p&gt;

&lt;p&gt;La diferencia entre niveles está en la cantidad de tokens que genera el modelo:&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Modelo y nivel&lt;/th&gt;
&lt;th&gt;Costo por tarea&lt;/th&gt;
&lt;th&gt;Tiempo por tarea&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Gemini 3.8 Flash &lt;code&gt;low&lt;/code&gt;
&lt;/td&gt;
&lt;td&gt;$0.24&lt;/td&gt;
&lt;td&gt;0.8 min&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Gemini 3.8 Flash &lt;code&gt;medium&lt;/code&gt;
&lt;/td&gt;
&lt;td&gt;$0.41&lt;/td&gt;
&lt;td&gt;No publicado en texto&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Gemini 3.8 Flash &lt;code&gt;high&lt;/code&gt;
&lt;/td&gt;
&lt;td&gt;$0.58&lt;/td&gt;
&lt;td&gt;2.5 min&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Gemini 3.7 Flash &lt;code&gt;high&lt;/code&gt;
&lt;/td&gt;
&lt;td&gt;$0.40&lt;/td&gt;
&lt;td&gt;2.2 min&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;Fuente: Artificial Analysis, ejecuciones del Intelligence Index con precios de introducción.&lt;/p&gt;

&lt;p&gt;Estas cifras sugieren tres relaciones:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;
&lt;code&gt;low&lt;/code&gt; cuesta aproximadamente el 41 % de &lt;code&gt;high&lt;/code&gt; y tarda cerca de un tercio del tiempo.&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;medium&lt;/code&gt; en 3.8 Flash cuesta aproximadamente lo mismo que &lt;code&gt;high&lt;/code&gt; en 3.7 Flash: $0.41 frente a $0.40.&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;high&lt;/code&gt; en 3.8 Flash cuesta un 45 % más por tarea que &lt;code&gt;high&lt;/code&gt; en 3.7 Flash, con el mismo precio por token, porque genera aproximadamente un 30 % más de tokens de salida: unos 48.000 en promedio por tarea del índice.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;La puntuación 59 del Intelligence Index de Artificial Analysis corresponde a una ejecución en &lt;code&gt;high&lt;/code&gt;. No se publicaron en el texto las puntuaciones para &lt;code&gt;medium&lt;/code&gt; o &lt;code&gt;low&lt;/code&gt;, así que no asuma que la calidad disminuye linealmente con el costo. Evalúe sus prompts antes de cambiar de nivel.&lt;/p&gt;

&lt;p&gt;Para un ejemplo con 1.000 tareas diarias y el límite de precios del 31 de diciembre, consulte &lt;a href="https://apidog.com/es/blog/gemini-3-8-flash-pricing?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Precios de Gemini 3.8 Flash&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Configurar &lt;code&gt;thinking_level&lt;/code&gt; en la API de Interactions
&lt;/h2&gt;

&lt;p&gt;La API de Interactions es la superficie principal de Google para Gemini 3.x. El campo se encuentra en &lt;code&gt;generation_config&lt;/code&gt; y usa snake_case.&lt;/p&gt;

&lt;h3&gt;
  
  
  cURL
&lt;/h3&gt;



&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;curl &lt;span class="nt"&gt;-X&lt;/span&gt; POST &lt;span class="s2"&gt;"https://generativelanguage.googleapis.com/v1beta/interactions"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;-H&lt;/span&gt; &lt;span class="s2"&gt;"x-goog-[REDACTED CREDENTIAL] &lt;/span&gt;&lt;span class="se"&gt;\&lt;/span&gt;&lt;span class="s2"&gt;
  -H 'Content-Type: application/json' &lt;/span&gt;&lt;span class="se"&gt;\&lt;/span&gt;&lt;span class="s2"&gt;
  -d '{"&lt;/span&gt;model&lt;span class="s2"&gt;":"&lt;/span&gt;gemini-3.8-flash&lt;span class="s2"&gt;","&lt;/span&gt;input&lt;span class="s2"&gt;":"&lt;/span&gt;Explain HTTP caching &lt;span class="k"&gt;in &lt;/span&gt;3 sentences.&lt;span class="s2"&gt;","&lt;/span&gt;generation_config&lt;span class="s2"&gt;":{"&lt;/span&gt;thinking_level&lt;span class="s2"&gt;":"&lt;/span&gt;low&lt;span class="s2"&gt;"}}'
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;h3&gt;
  
  
  Python
&lt;/h3&gt;



&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight python"&gt;&lt;code&gt;&lt;span class="n"&gt;interaction&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;interactions&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;create&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
    &lt;span class="n"&gt;model&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;gemini-3.8-flash&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="nb"&gt;input&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;Explain HTTP caching in 3 sentences.&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="n"&gt;generation_config&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;thinking_level&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;low&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;},&lt;/span&gt;
&lt;span class="p"&gt;)&lt;/span&gt;

&lt;span class="nf"&gt;print&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="n"&gt;interaction&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;output_text&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Es un campo por solicitud. Configúrelo también en las interacciones de seguimiento que utilicen &lt;code&gt;previous_interaction_id&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;La respuesta contiene una lista de pasos de ejecución —pensamientos, llamadas a herramientas y otros eventos— que termina en &lt;code&gt;model_output&lt;/code&gt;. El SDK expone el texto final mediante &lt;code&gt;output_text&lt;/code&gt;. Para revisar estado, streaming y múltiples interacciones, consulte &lt;a href="https://apidog.com/es/blog/how-to-use-gemini-3-8-flash-api?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;cómo usar la API de Gemini 3.8 Flash&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Configurarlo en &lt;code&gt;generateContent&lt;/code&gt;
&lt;/h2&gt;

&lt;p&gt;La mayoría del código existente todavía usa &lt;code&gt;generateContent&lt;/code&gt;. Google lo considera heredado, pero sigue siendo compatible sin una fecha de obsolescencia anunciada.&lt;/p&gt;

&lt;p&gt;Aquí el campo está un nivel más profundo y usa camelCase:&lt;/p&gt;

&lt;h3&gt;
  
  
  cURL
&lt;/h3&gt;



&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;curl &lt;span class="s2"&gt;"https://generativelanguage.googleapis.com/v1beta/models/gemini-3.8-flash:generateContent"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;-H&lt;/span&gt; &lt;span class="s2"&gt;"x-goog-[REDACTED CREDENTIAL] &lt;/span&gt;&lt;span class="se"&gt;\&lt;/span&gt;&lt;span class="s2"&gt;
  -H 'Content-Type: application/json' &lt;/span&gt;&lt;span class="se"&gt;\&lt;/span&gt;&lt;span class="s2"&gt;
  -X POST &lt;/span&gt;&lt;span class="se"&gt;\&lt;/span&gt;&lt;span class="s2"&gt;
  -d '{"&lt;/span&gt;contents&lt;span class="s2"&gt;":[{"&lt;/span&gt;parts&lt;span class="s2"&gt;":[{"&lt;/span&gt;text&lt;span class="s2"&gt;":"&lt;/span&gt;Explain HTTP caching &lt;span class="k"&gt;in &lt;/span&gt;3 sentences.&lt;span class="s2"&gt;"}]}],
       "&lt;/span&gt;generationConfig&lt;span class="s2"&gt;":{"&lt;/span&gt;thinkingConfig&lt;span class="s2"&gt;":{"&lt;/span&gt;thinkingLevel&lt;span class="s2"&gt;":"&lt;/span&gt;low&lt;span class="s2"&gt;","&lt;/span&gt;includeThoughts&lt;span class="s2"&gt;":true}}}'
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;h3&gt;
  
  
  Python
&lt;/h3&gt;



&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight python"&gt;&lt;code&gt;&lt;span class="kn"&gt;from&lt;/span&gt; &lt;span class="n"&gt;google.genai&lt;/span&gt; &lt;span class="kn"&gt;import&lt;/span&gt; &lt;span class="n"&gt;types&lt;/span&gt;

&lt;span class="n"&gt;response&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;models&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;generate_content&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
    &lt;span class="n"&gt;model&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;gemini-3.8-flash&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="n"&gt;contents&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;Explain HTTP caching in 3 sentences.&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="n"&gt;config&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="n"&gt;types&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nc"&gt;GenerateContentConfig&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
        &lt;span class="n"&gt;thinking_config&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="n"&gt;types&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nc"&gt;ThinkingConfig&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="n"&gt;thinking_level&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;low&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt;
    &lt;span class="p"&gt;),&lt;/span&gt;
&lt;span class="p"&gt;)&lt;/span&gt;

&lt;span class="nf"&gt;print&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="n"&gt;response&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;usage_metadata&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;thoughts_token_count&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;&lt;code&gt;includeThoughts: true&lt;/code&gt; añade resúmenes de pensamientos como partes marcadas con &lt;code&gt;thought: true&lt;/code&gt;. Es útil durante la calibración, pero normalmente puede desactivarse después.&lt;/p&gt;

&lt;p&gt;El campo clave para las pruebas es &lt;code&gt;usageMetadata.thoughtsTokenCount&lt;/code&gt;, que representa el número exacto de tokens de razonamiento facturados como salida.&lt;/p&gt;

&lt;h2&gt;
  
  
  Una estrategia por ruta
&lt;/h2&gt;

&lt;p&gt;Trate el nivel como una decisión de enrutamiento, no como una configuración global:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Chat y autocompletado:&lt;/strong&gt; &lt;code&gt;low&lt;/code&gt;, porque el usuario espera una respuesta rápida.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Clasificación, extracción y búsqueda en transcripciones:&lt;/strong&gt; &lt;code&gt;low&lt;/code&gt;, después de validar que la precisión sea suficiente.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Agentes de código y bucles de herramientas:&lt;/strong&gt; &lt;code&gt;medium&lt;/code&gt;. Eleve a &lt;code&gt;high&lt;/code&gt; solo los pasos de planificación cuya salida determine todo lo posterior.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Flujos con muchos documentos o de larga duración:&lt;/strong&gt; &lt;code&gt;high&lt;/code&gt;, preferiblemente mediante la API por lotes, que ofrece un 50 % de descuento cuando el flujo no es interactivo.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Video:&lt;/strong&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;code&gt;high&lt;/code&gt; para QA visual densa o videos de más de 60 minutos.&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;medium&lt;/code&gt; para preguntas y respuestas generales.&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;low&lt;/code&gt; para buscar en transcripciones.&lt;/li&gt;
&lt;/ul&gt;
&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Si &lt;code&gt;low&lt;/code&gt; sigue siendo demasiado lento o caro para una ruta, considere Flash-Lite. La &lt;a href="https://apidog.com/es/blog/gemini-3-1-flash-lite?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de Gemini 3.1 Flash-Lite&lt;/a&gt; cubre la compensación; Gemini 3.5 Flash-Lite parte de $0.30 por millón de tokens de entrada y $2.50 de salida.&lt;/p&gt;

&lt;p&gt;Mantenga &lt;code&gt;gemini-3.7-flash&lt;/code&gt; detrás de una feature flag. Si el consumo aumenta después de la actualización, podrá cambiar de nivel o de modelo sin volver a desplegar toda la aplicación. La &lt;a href="https://apidog.com/es/blog/gemini-3-8-flash-vs-gemini-3-7-flash?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;comparación entre Gemini 3.8 Flash y 3.7 Flash&lt;/a&gt; ayuda a decidir dónde los tokens adicionales aportan calidad.&lt;/p&gt;

&lt;h2&gt;
  
  
  Probar los tres niveles lado a lado en Apidog
&lt;/h2&gt;

&lt;p&gt;Los promedios de Artificial Analysis muestran proporciones, pero solo sus prompts revelan los números de su aplicación. Puede usar &lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt; para enviar el mismo prompt con los tres niveles.&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;
&lt;strong&gt;Guarde la clave como variable de entorno.&lt;/strong&gt; Cree &lt;code&gt;GEMINI_API_KEY&lt;/code&gt; en un entorno de Apidog y úsela como &lt;code&gt;{{GEMINI_API_KEY}}&lt;/code&gt; en el encabezado &lt;code&gt;x-goog-api-key&lt;/code&gt;. Añada también &lt;code&gt;THINKING_LEVEL&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Guarde una solicitud.&lt;/strong&gt; Use &lt;code&gt;POST /v1beta/models/gemini-3.8-flash:generateContent&lt;/code&gt; con su prompt dorado:
&lt;/li&gt;
&lt;/ol&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="w"&gt;   &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
     &lt;/span&gt;&lt;span class="nl"&gt;"generationConfig"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
       &lt;/span&gt;&lt;span class="nl"&gt;"thinkingConfig"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
         &lt;/span&gt;&lt;span class="nl"&gt;"thinkingLevel"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"{{THINKING_LEVEL}}"&lt;/span&gt;&lt;span class="w"&gt;
       &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
     &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
   &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;ol&gt;
&lt;li&gt;
&lt;strong&gt;Cree un escenario de tres pasos.&lt;/strong&gt; Importe la solicitud tres veces y establezca &lt;code&gt;THINKING_LEVEL&lt;/code&gt; en &lt;code&gt;low&lt;/code&gt;, &lt;code&gt;medium&lt;/code&gt; y &lt;code&gt;high&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Asegure los campos variables.&lt;/strong&gt; En cada paso, compruebe que el estado sea &lt;code&gt;200&lt;/code&gt; y que exista &lt;code&gt;usageMetadata.thoughtsTokenCount&lt;/code&gt;. En &lt;code&gt;low&lt;/code&gt;, establezca un límite de tokens y latencia después de la primera ejecución.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Compare los niveles.&lt;/strong&gt; Guarde el recuento de cada paso en una variable de postprocesamiento y compruebe que &lt;code&gt;high&lt;/code&gt; razone al menos tanto como &lt;code&gt;low&lt;/code&gt;. Una inversión puede indicar un cambio de modelo o de configuración.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Añada una prueba de compatibilidad.&lt;/strong&gt; Envíe &lt;code&gt;thinkingLevel: "minimal"&lt;/code&gt; y compruebe que la respuesta no sea &lt;code&gt;200&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Programe el escenario.&lt;/strong&gt; Ejecútelo diariamente para detectar regresiones o cambios silenciosos antes de recibir una factura inesperada. Consulte &lt;a href="https://apidog.com/es/blog/how-to-schedule-api-tests-apidog?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;cómo programar pruebas de API en Apidog&lt;/a&gt;.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Para respuestas en streaming, aplique el mismo escenario con SSE. La guía sobre &lt;a href="https://apidog.com/es/blog/test-llm-ai-apis-sse?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;cómo probar API de LLM que transmiten mediante SSE&lt;/a&gt; cubre la configuración. También puede &lt;a href="https://apidog.com/download?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;descargar Apidog&lt;/a&gt;; el plan gratuito es suficiente para este escenario.&lt;/p&gt;

&lt;h2&gt;
  
  
  Preguntas frecuentes
&lt;/h2&gt;

&lt;h3&gt;
  
  
  ¿El nivel cambia el precio por token?
&lt;/h3&gt;

&lt;p&gt;No. Gemini 3.8 Flash cuesta $0.75 por millón de tokens de entrada y $3.75 por millón de tokens de salida durante el periodo introductorio, independientemente del nivel. El nivel cambia la cantidad de tokens de razonamiento que genera el modelo y que se facturan como salida. Consulte el desglose de &lt;a href="https://ai.google.dev/gemini-api/docs/pricing" rel="noopener noreferrer"&gt;precios de Gemini&lt;/a&gt; para conocer caché, lotes y el aumento del 1 de enero.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Puedo establecer un presupuesto exacto de tokens?
&lt;/h3&gt;

&lt;p&gt;No en los modelos Gemini 3. &lt;code&gt;thinking_budget&lt;/code&gt; fue reemplazado por &lt;code&gt;thinking_level&lt;/code&gt;, y 3.8 Flash solo acepta &lt;code&gt;low&lt;/code&gt;, &lt;code&gt;medium&lt;/code&gt; y &lt;code&gt;high&lt;/code&gt;. Si necesita un límite, aplíquelo en las pruebas, alertas y controles de enrutamiento.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Qué nivel usa la puntuación 59 de Artificial Analysis?
&lt;/h3&gt;

&lt;p&gt;&lt;code&gt;high&lt;/code&gt;. Artificial Analysis ejecutó el Intelligence Index en &lt;code&gt;high&lt;/code&gt; para la puntuación principal. Publicó costos y tiempos para otros niveles, pero no sus puntuaciones del índice.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Debo bajar &lt;code&gt;temperature&lt;/code&gt; para reducir el razonamiento?
&lt;/h3&gt;

&lt;p&gt;No. Google recomienda mantener &lt;code&gt;temperature&lt;/code&gt; en &lt;code&gt;1.0&lt;/code&gt; para todos los modelos Gemini 3. Reducirla puede provocar bucles o degradar la salida. Use &lt;code&gt;thinking_level&lt;/code&gt; para controlar la profundidad.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Qué hago si incluso &lt;code&gt;low&lt;/code&gt; es demasiado lento o caro?
&lt;/h3&gt;

&lt;p&gt;Permanezca en Gemini 3.7 Flash, que sigue siendo compatible sin fecha de obsolescencia, o migre la ruta a Flash-Lite.&lt;/p&gt;

&lt;h2&gt;
  
  
  Elija el nivel por ruta y mídalo
&lt;/h2&gt;

&lt;p&gt;Gemini 3.8 Flash ofrece tres niveles, pero no un presupuesto exacto de tokens. Configure &lt;code&gt;thinking_level&lt;/code&gt; explícitamente, convierta cualquier &lt;code&gt;minimal&lt;/code&gt; restante en &lt;code&gt;low&lt;/code&gt; y supervise &lt;code&gt;usageMetadata.thoughtsTokenCount&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;Las cifras de Artificial Analysis —$0.24, $0.41 y $0.58 por tarea— muestran la forma general de la curva. Un escenario de tres pasos en Apidog le dará los números reales de sus prompts antes de que el cambio de precios del 31 de diciembre vuelva aún más importante cada decisión de enrutamiento.&lt;/p&gt;

</description>
    </item>
    <item>
      <title>Llamada a funciones con Gemini 3.8 Flash: call_id, bucles iterativos de herramientas y cómo probarlos</title>
      <dc:creator>Roobia</dc:creator>
      <pubDate>Thu, 03 Sep 2026 07:35:58 +0000</pubDate>
      <link>https://dev.to/roobia/llamada-a-funciones-con-gemini-38-flash-callid-bucles-iterativos-de-herramientas-y-como-d3c</link>
      <guid>https://dev.to/roobia/llamada-a-funciones-con-gemini-38-flash-callid-bucles-iterativos-de-herramientas-y-como-d3c</guid>
      <description>&lt;h1&gt;
  
  
  Gemini 3.8 Flash: llamadas iterativas a herramientas con la API de interacciones
&lt;/h1&gt;

&lt;p&gt;Gemini 3.8 Flash se lanzó el 2 de septiembre de 2026. Google lo diseñó para «llamar a herramientas iterativamente»: en tareas complejas, realiza una llamada, verifica el resultado y hace otra si es necesario, en lugar de intentar adivinarlo todo de una vez. Esto beneficia a los agentes, pero puede romper ciclos de herramientas ajustados para Gemini 3.7 Flash. Los dos cambios más importantes son que cada resultado de función debe incluir &lt;code&gt;call_id&lt;/code&gt; y &lt;code&gt;name&lt;/code&gt;, y que la API de interacciones —no &lt;code&gt;generateContent&lt;/code&gt;— es ahora la vía principal para ejecutar el ciclo.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation" class="crayons-btn crayons-btn--primary"&gt;Prueba Apidog hoy&lt;/a&gt;
&lt;/p&gt;

&lt;p&gt;Esta guía muestra el flujo completo de dos turnos, compara la API heredada de &lt;code&gt;generateContent&lt;/code&gt;, explica por qué Gemini 3.8 Flash puede consumir más turnos y tokens, y termina con una prueba diaria que simula el backend de una herramienta y verifica el recorrido de &lt;code&gt;call_id&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;Todas las solicitudes utilizan HTTP y JSON planos, así que puede construirlas y depurarlas en &lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt; antes de integrarlas en su aplicación.&lt;/p&gt;

&lt;p&gt;Si necesita una introducción al modelo, consulte &lt;a href="https://apidog.com/es/blog/what-is-gemini-3-8-flash?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;qué es Gemini 3.8 Flash&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Gemini 3.8 Flash de un vistazo
&lt;/h2&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Elemento&lt;/th&gt;
&lt;th&gt;Gemini 3.8 Flash&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;ID del modelo&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;gemini-3.8-flash&lt;/code&gt; — estable, sin sufijo de vista previa&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;API principal&lt;/td&gt;
&lt;td&gt;API de interacciones (&lt;code&gt;POST /v1beta/interactions&lt;/code&gt;); &lt;code&gt;generateContent&lt;/code&gt; es heredada, pero totalmente compatible&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Declaración de herramienta&lt;/td&gt;
&lt;td&gt;&lt;code&gt;tools: [{"type": "function", "name", "description", "parameters"}]&lt;/code&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Llamada del modelo&lt;/td&gt;
&lt;td&gt;Paso &lt;code&gt;function_call&lt;/code&gt; con &lt;code&gt;id&lt;/code&gt;, &lt;code&gt;name&lt;/code&gt; y &lt;code&gt;arguments&lt;/code&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Resultado de la herramienta&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;function_result&lt;/code&gt; con &lt;code&gt;call_id&lt;/code&gt; y &lt;code&gt;name&lt;/code&gt; — ambos obligatorios — más &lt;code&gt;previous_interaction_id&lt;/code&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Razonamiento&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;thinking_level&lt;/code&gt;: &lt;code&gt;low&lt;/code&gt;, &lt;code&gt;medium&lt;/code&gt; — predeterminado — o &lt;code&gt;high&lt;/code&gt;; &lt;code&gt;minimal&lt;/code&gt; devuelve un error de validación&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Puntuación de uso de herramientas&lt;/td&gt;
&lt;td&gt;Tau3-Banking: 45 %, 12 puntos más que 3.7 Flash, según &lt;a href="https://artificialanalysis.ai/articles/gemini-3-8-flash" rel="noopener noreferrer"&gt;Artificial Analysis&lt;/a&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Consumo&lt;/td&gt;
&lt;td&gt;Aproximadamente 48.000 tokens de salida por tarea en el índice de Artificial Analysis, un 30 % más que 3.7 Flash&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Precio&lt;/td&gt;
&lt;td&gt;0,75 USD de entrada y 3,75 USD de salida por cada millón de tokens hasta el 31/12/2026; el razonamiento se factura como salida&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;h2&gt;
  
  
  Paso 1: declarar la herramienta
&lt;/h2&gt;

&lt;p&gt;En la API de interacciones, una herramienta es un objeto plano con:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;&lt;code&gt;type: "function"&lt;/code&gt;&lt;/li&gt;
&lt;li&gt;&lt;code&gt;name&lt;/code&gt;&lt;/li&gt;
&lt;li&gt;&lt;code&gt;description&lt;/code&gt;&lt;/li&gt;
&lt;li&gt;Un esquema JSON bajo &lt;code&gt;parameters&lt;/code&gt;
&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;La descripción debe ser específica. «Consultar el estado actual de envío de un pedido por su ID» ayuda al modelo a decidir cuándo llamar la herramienta; «ayudante de pedidos» es demasiado ambiguo.&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;curl &lt;span class="nt"&gt;-X&lt;/span&gt; POST &lt;span class="s2"&gt;"https://generativelanguage.googleapis.com/v1beta/interactions"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;-H&lt;/span&gt; &lt;span class="s2"&gt;"x-goog-[REDACTED CREDENTIAL] &lt;/span&gt;&lt;span class="se"&gt;\&lt;/span&gt;&lt;span class="s2"&gt;
  -H "&lt;/span&gt;Content-Type: application/json&lt;span class="s2"&gt;" &lt;/span&gt;&lt;span class="se"&gt;\&lt;/span&gt;&lt;span class="s2"&gt;
  -d '{
    "&lt;/span&gt;model&lt;span class="s2"&gt;": "&lt;/span&gt;gemini-3.8-flash&lt;span class="s2"&gt;",
    "&lt;/span&gt;input&lt;span class="s2"&gt;": "&lt;/span&gt;Where is order A1029 right now?&lt;span class="s2"&gt;",
    "&lt;/span&gt;generation_config&lt;span class="s2"&gt;": {"&lt;/span&gt;thinking_level&lt;span class="s2"&gt;": "&lt;/span&gt;low&lt;span class="s2"&gt;"},
    "&lt;/span&gt;tools&lt;span class="s2"&gt;": [{
      "&lt;/span&gt;&lt;span class="nb"&gt;type&lt;/span&gt;&lt;span class="s2"&gt;": "&lt;/span&gt;&lt;span class="k"&gt;function&lt;/span&gt;&lt;span class="s2"&gt;",
      "&lt;/span&gt;name&lt;span class="s2"&gt;": "&lt;/span&gt;get_order_status&lt;span class="s2"&gt;",
      "&lt;/span&gt;description&lt;span class="s2"&gt;": "&lt;/span&gt;Look up the current shipping status of an order by its ID.&lt;span class="s2"&gt;",
      "&lt;/span&gt;parameters&lt;span class="s2"&gt;": {
        "&lt;/span&gt;&lt;span class="nb"&gt;type&lt;/span&gt;&lt;span class="s2"&gt;": "&lt;/span&gt;object&lt;span class="s2"&gt;",
        "&lt;/span&gt;properties&lt;span class="s2"&gt;": {"&lt;/span&gt;order_id&lt;span class="s2"&gt;": {"&lt;/span&gt;&lt;span class="nb"&gt;type&lt;/span&gt;&lt;span class="s2"&gt;": "&lt;/span&gt;string&lt;span class="s2"&gt;"}},
        "&lt;/span&gt;required&lt;span class="s2"&gt;": ["&lt;/span&gt;order_id&lt;span class="s2"&gt;"]
      }
    }]
  }'
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Dos opciones son deliberadas:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;code&gt;thinking_level&lt;/code&gt; es &lt;code&gt;low&lt;/code&gt; porque una consulta sencilla no necesita el valor predeterminado &lt;code&gt;medium&lt;/code&gt;. Consulte la &lt;a href="https://apidog.com/es/blog/gemini-3-8-flash-thinking-levels?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de niveles de razonamiento&lt;/a&gt; para decidir cuándo aumentarlo.&lt;/li&gt;
&lt;li&gt;No se especifica &lt;code&gt;temperature&lt;/code&gt;. La guía de Gemini 3 de Google recomienda conservar el valor predeterminado &lt;code&gt;1.0&lt;/code&gt;, porque reducirlo puede provocar bucles dentro del ciclo de herramientas.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Paso 2: leer el paso &lt;code&gt;function_call&lt;/code&gt;
&lt;/h2&gt;

&lt;p&gt;La API de interacciones devuelve el ID de la interacción y una lista de pasos de ejecución: pensamientos del modelo, llamadas a herramientas y, finalmente, un paso &lt;code&gt;model_output&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;Cuando el modelo necesita una herramienta, la respuesta contiene un paso como este:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"type"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"function_call"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"id"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"call_8f2d..."&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"name"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"get_order_status"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"arguments"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="nl"&gt;"order_id"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"A1029"&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Los tres campos son necesarios:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;code&gt;id&lt;/code&gt; es el identificador que debe enviar de vuelta como &lt;code&gt;call_id&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;name&lt;/code&gt; indica qué función debe ejecutar y también debe repetirse en la respuesta.&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;arguments&lt;/code&gt; ya está parseado como JSON. Valídelo contra sus propias reglas antes de ejecutar la operación. El modelo conoce el esquema, pero no sabe necesariamente que sus IDs de pedido deben tener cinco caracteres.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Guarde también el ID de la interacción que aparece en la parte superior de la respuesta. Lo necesitará como &lt;code&gt;previous_interaction_id&lt;/code&gt; en el siguiente turno.&lt;/p&gt;

&lt;h2&gt;
  
  
  Paso 3: devolver &lt;code&gt;function_result&lt;/code&gt; con &lt;code&gt;call_id&lt;/code&gt; y &lt;code&gt;name&lt;/code&gt;
&lt;/h2&gt;

&lt;p&gt;Ejecute la función y envíe una segunda solicitud cuyo &lt;code&gt;input&lt;/code&gt; sea un &lt;code&gt;function_result&lt;/code&gt;. En Gemini 3.8 Flash, &lt;code&gt;call_id&lt;/code&gt; y &lt;code&gt;name&lt;/code&gt; son obligatorios:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;curl &lt;span class="nt"&gt;-X&lt;/span&gt; POST &lt;span class="s2"&gt;"https://generativelanguage.googleapis.com/v1beta/interactions"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;-H&lt;/span&gt; &lt;span class="s2"&gt;"x-goog-[REDACTED CREDENTIAL] &lt;/span&gt;&lt;span class="se"&gt;\&lt;/span&gt;&lt;span class="s2"&gt;
  -H "&lt;/span&gt;Content-Type: application/json&lt;span class="s2"&gt;" &lt;/span&gt;&lt;span class="se"&gt;\&lt;/span&gt;&lt;span class="s2"&gt;
  -d '{
    "&lt;/span&gt;model&lt;span class="s2"&gt;": "&lt;/span&gt;gemini-3.8-flash&lt;span class="s2"&gt;",
    "&lt;/span&gt;previous_interaction_id&lt;span class="s2"&gt;": "&lt;/span&gt;&amp;lt;interaction &lt;span class="nb"&gt;id &lt;/span&gt;from step 2&amp;gt;&lt;span class="s2"&gt;",
    "&lt;/span&gt;input&lt;span class="s2"&gt;": [{
      "&lt;/span&gt;&lt;span class="nb"&gt;type&lt;/span&gt;&lt;span class="s2"&gt;": "&lt;/span&gt;function_result&lt;span class="s2"&gt;",
      "&lt;/span&gt;name&lt;span class="s2"&gt;": "&lt;/span&gt;get_order_status&lt;span class="s2"&gt;",
      "&lt;/span&gt;call_id&lt;span class="s2"&gt;": "&lt;/span&gt;call_8f2d...&lt;span class="s2"&gt;",
      "&lt;/span&gt;result&lt;span class="s2"&gt;": [{"&lt;/span&gt;&lt;span class="nb"&gt;type&lt;/span&gt;&lt;span class="s2"&gt;": "&lt;/span&gt;text&lt;span class="s2"&gt;", "&lt;/span&gt;text&lt;span class="s2"&gt;": "&lt;/span&gt;&lt;span class="o"&gt;{&lt;/span&gt;&lt;span class="se"&gt;\"&lt;/span&gt;status&lt;span class="se"&gt;\"&lt;/span&gt;:&lt;span class="se"&gt;\"&lt;/span&gt;in_transit&lt;span class="se"&gt;\"&lt;/span&gt;,&lt;span class="se"&gt;\"&lt;/span&gt;eta&lt;span class="se"&gt;\"&lt;/span&gt;:&lt;span class="se"&gt;\"&lt;/span&gt;2026-09-05&lt;span class="se"&gt;\"&lt;/span&gt;&lt;span class="o"&gt;}&lt;/span&gt;&lt;span class="s2"&gt;"}]
    }]
  }'
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Si omite cualquiera de los dos campos, la llamada falla. Este es uno de los errores más comunes al migrar ciclos escritos para modelos anteriores.&lt;/p&gt;

&lt;p&gt;&lt;code&gt;result&lt;/code&gt; es una lista de partes de contenido y la parte de texto contiene el JSON como cadena. Como &lt;code&gt;previous_interaction_id&lt;/code&gt; apunta al turno anterior, el servidor ya conserva el prompt original, la declaración de la herramienta y el razonamiento del modelo.&lt;/p&gt;

&lt;p&gt;La respuesta vuelve a ser una lista de pasos:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Si termina en &lt;code&gt;model_output&lt;/code&gt;, el ciclo finalizó. El SDK expone el texto mediante &lt;code&gt;interaction.output_text&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Si contiene otra &lt;code&gt;function_call&lt;/code&gt;, vuelva a ejecutar los pasos 2 y 3.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;En Python, el patrón es:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight python"&gt;&lt;code&gt;&lt;span class="n"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;interactions&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;create&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
    &lt;span class="n"&gt;model&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;gemini-3.8-flash&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="nb"&gt;input&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="p"&gt;...,&lt;/span&gt;
    &lt;span class="bp"&gt;...&lt;/span&gt;
&lt;span class="p"&gt;)&lt;/span&gt;

&lt;span class="n"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;interactions&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;create&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
    &lt;span class="n"&gt;model&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;gemini-3.8-flash&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="n"&gt;previous_interaction_id&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="n"&gt;interaction&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nb"&gt;id&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="nb"&gt;input&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="p"&gt;[&lt;/span&gt;&lt;span class="n"&gt;function_result&lt;/span&gt;&lt;span class="p"&gt;],&lt;/span&gt;
&lt;span class="p"&gt;)&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;El &lt;a href="https://apidog.com/es/blog/how-to-use-gemini-3-8-flash-api?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;tutorial de la API de Gemini 3.8 Flash&lt;/a&gt; cubre las claves, el streaming y la lectura del consumo de tokens.&lt;/p&gt;

&lt;h2&gt;
  
  
  Equivalente heredado con &lt;code&gt;generateContent&lt;/code&gt;
&lt;/h2&gt;

&lt;p&gt;La mayoría del código existente todavía llama a:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;models/gemini-3.8-flash:generateContent
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Google indica que esta API «sigue siendo totalmente compatible» y no tiene fecha de finalización. El vocabulario cambia, pero el contrato es el mismo:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Las herramientas se declaran bajo &lt;code&gt;functionDeclarations&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;El modelo responde con una parte &lt;code&gt;functionCall&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;La aplicación responde con una parte &lt;code&gt;functionResponse&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;El &lt;code&gt;functionCall&lt;/code&gt; del modelo incluye un &lt;code&gt;id&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Su &lt;code&gt;functionResponse&lt;/code&gt; debe repetir ese &lt;code&gt;id&lt;/code&gt; junto con &lt;code&gt;name&lt;/code&gt; y &lt;code&gt;response&lt;/code&gt;.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Es el mismo identificador que &lt;code&gt;call_id&lt;/code&gt; en la API de interacciones, pero con otro nombre de campo. La &lt;a href="https://ai.google.dev/gemini-api/docs/function-calling" rel="noopener noreferrer"&gt;documentación de llamada a funciones de Google&lt;/a&gt; especifica que tanto el ID como el nombre son obligatorios.&lt;/p&gt;

&lt;p&gt;Hay dos diferencias prácticas:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;
&lt;code&gt;generateContent&lt;/code&gt; no conserva estado. Debe reenviar el historial completo de &lt;code&gt;contents&lt;/code&gt; en cada turno, incluida la llamada del modelo y cualquier firma de pensamiento devuelta.&lt;/li&gt;
&lt;li&gt;El razonamiento se configura bajo &lt;code&gt;generationConfig.thinkingConfig.thinkingLevel&lt;/code&gt;:
&lt;/li&gt;
&lt;/ol&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"generationConfig"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"thinkingConfig"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
      &lt;/span&gt;&lt;span class="nl"&gt;"thinkingLevel"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"low"&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Los tokens de razonamiento aparecen como &lt;code&gt;usageMetadata.thoughtsTokenCount&lt;/code&gt; y se facturan como tokens de salida.&lt;/p&gt;

&lt;p&gt;Para un proyecto nuevo, prefiera la API de interacciones: el estado del lado del servidor evita errores causados por historiales reenviados sin una firma o un ID de llamada.&lt;/p&gt;

&lt;h2&gt;
  
  
  Por qué Gemini 3.8 Flash usa herramientas iterativamente
&lt;/h2&gt;

&lt;p&gt;La &lt;a href="https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/" rel="noopener noreferrer"&gt;publicación de lanzamiento de Google&lt;/a&gt; afirma que el modelo «trabaja más duro»: en tareas complejas ejecuta pasos de razonamiento adicionales, realiza llamadas iterativas y verifica su trabajo mediante pasos más pequeños. Google también advierte que puede utilizar más tokens en tareas largas y complejas.&lt;/p&gt;

&lt;p&gt;Artificial Analysis midió estos efectos:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Unos 48.000 tokens de salida por tarea en su índice, un 30 % más que 3.7 Flash.&lt;/li&gt;
&lt;li&gt;Coste aproximado por tarea de 0,58 USD en &lt;code&gt;high&lt;/code&gt;, frente a 0,40 USD para 3.7 Flash con los mismos precios por token.&lt;/li&gt;
&lt;li&gt;Coste aproximado de 0,41 USD en &lt;code&gt;medium&lt;/code&gt; y 0,24 USD en &lt;code&gt;low&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Tau3-Banking aumentó 12 puntos, hasta el 45 %.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;La ventaja es una mejor capacidad de uso de herramientas. La desventaja es que un ciclo sin límites puede tardar más que con 3.7 Flash.&lt;/p&gt;

&lt;h3&gt;
  
  
  Cuatro controles para producción
&lt;/h3&gt;

&lt;p&gt;Aplíquelos en este orden:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;&lt;strong&gt;Límite de turnos en el arnés&lt;/strong&gt;&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Cuente los pasos &lt;code&gt;function_call&lt;/code&gt; por tarea y deténgase al alcanzar un límite. Entre 6 y 10 turnos es un buen punto de partida para búsquedas; las tareas de codificación agéntica pueden necesitar más. Al alcanzar el límite, envíe un turno final sin herramientas o devuelva un error. El modelo no se limitará por sí solo.&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;&lt;strong&gt;&lt;code&gt;thinking_level&lt;/code&gt; por ruta&lt;/strong&gt;&lt;/li&gt;
&lt;/ol&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;code&gt;low&lt;/code&gt; para búsquedas y herramientas de un solo salto.&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;medium&lt;/code&gt; para trabajo de varios pasos.&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;high&lt;/code&gt; cuando la verificación adicional lo justifique.&lt;/li&gt;
&lt;li&gt;No use &lt;code&gt;minimal&lt;/code&gt;: Gemini 3.8 Flash devuelve un error de validación.&lt;/li&gt;
&lt;/ul&gt;

&lt;ol&gt;
&lt;li&gt;&lt;strong&gt;Tiempo de espera en ambos niveles&lt;/strong&gt;&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Configure un timeout para cada solicitud a Gemini y otro timeout de pared para toda la tarea. Las ejecuciones &lt;code&gt;high&lt;/code&gt; de Artificial Analysis promediaron 2,5 minutos por tarea, frente a 0,8 minutos en &lt;code&gt;low&lt;/code&gt;.&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;&lt;strong&gt;Herramientas idempotentes&lt;/strong&gt;&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Un modelo iterativo puede reintentar una llamada. &lt;code&gt;get_order_status&lt;/code&gt; debe poder ejecutarse dos veces sin efectos adversos. Las operaciones con efectos secundarios, como reembolsos o envíos, deben requerir confirmación explícita.&lt;/p&gt;

&lt;p&gt;Si no puede asumir los turnos adicionales, consulte la &lt;a href="https://apidog.com/es/blog/gemini-3-7-to-3-8-flash-migration-guide?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de migración de Gemini 3.7 a 3.8 Flash&lt;/a&gt; para mantener 3.7 Flash detrás de un indicador de configuración.&lt;/p&gt;

&lt;h2&gt;
  
  
  Firmas de pensamiento, llamadas paralelas y salidas estructuradas
&lt;/h2&gt;

&lt;h3&gt;
  
  
  Firmas de pensamiento
&lt;/h3&gt;

&lt;p&gt;Los modelos Gemini 3 adjuntan firmas a su razonamiento. Con el flujo almacenado predeterminado, &lt;code&gt;previous_interaction_id&lt;/code&gt; las gestiona automáticamente.&lt;/p&gt;

&lt;p&gt;Si usa &lt;code&gt;store: false&lt;/code&gt; o &lt;code&gt;generateContent&lt;/code&gt;, debe reenviar los bloques de pensamiento y sus firmas exactamente como fueron recibidos en cada tipo de parte. No los recorte, reordene ni vuelva a serializar: una firma es opaca y cualquier modificación la invalida.&lt;/p&gt;

&lt;p&gt;Consulte la &lt;a href="https://ai.google.dev/gemini-api/docs/interactions" rel="noopener noreferrer"&gt;documentación de la API de interacciones&lt;/a&gt; para conocer las diferencias entre los modos almacenado y sin estado.&lt;/p&gt;

&lt;h3&gt;
  
  
  Llamadas paralelas
&lt;/h3&gt;

&lt;p&gt;La respuesta es una lista y puede contener varios pasos &lt;code&gt;function_call&lt;/code&gt; cuando el modelo necesita búsquedas independientes. Cada llamada tiene un ID único y los resultados pueden devolverse en cualquier orden.&lt;/p&gt;

&lt;p&gt;Envíe un &lt;code&gt;function_result&lt;/code&gt; por llamada dentro del mismo array &lt;code&gt;input&lt;/code&gt;, haciendo coincidir cada resultado con su propio &lt;code&gt;call_id&lt;/code&gt;:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;[&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"type"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"function_result"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"name"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"get_order_status"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"call_id"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"call_1"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"result"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;[{&lt;/span&gt;&lt;span class="nl"&gt;"type"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"text"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="nl"&gt;"text"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"..."&lt;/span&gt;&lt;span class="p"&gt;}]&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;},&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"type"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"function_result"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"name"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"get_order_status"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"call_id"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"call_2"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"result"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;[{&lt;/span&gt;&lt;span class="nl"&gt;"type"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"text"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="nl"&gt;"text"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"..."&lt;/span&gt;&lt;span class="p"&gt;}]&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;]&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;No haga la correspondencia solo por &lt;code&gt;name&lt;/code&gt;: dos llamadas a la misma función tienen dos &lt;code&gt;call_id&lt;/code&gt; distintos.&lt;/p&gt;

&lt;h3&gt;
  
  
  Salidas estructuradas
&lt;/h3&gt;

&lt;p&gt;Gemini 3.8 Flash admite salidas estructuradas y llamadas a funciones en el mismo modelo. Un patrón práctico es usar:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Herramientas para el ciclo de ejecución.&lt;/li&gt;
&lt;li&gt;Un esquema JSON para la respuesta final.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Así, el &lt;code&gt;model_output&lt;/code&gt; que cierra el ciclo es legible por máquina en lugar de ser prosa libre. Consulte la documentación de &lt;a href="https://ai.google.dev/gemini-api/docs/generate-content/function-calling" rel="noopener noreferrer"&gt;llamadas a funciones&lt;/a&gt; y &lt;a href="https://ai.google.dev/gemini-api/docs/function-calling" rel="noopener noreferrer"&gt;salidas estructuradas&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;No simule una salida estructurada declarando una herramienta ficticia y leyendo sus &lt;code&gt;arguments&lt;/code&gt;: el patrón falla cuando el modelo decide que no necesita llamar ninguna herramienta.&lt;/p&gt;

&lt;p&gt;Google también enumera el uso de computadoras —en vista previa— para Gemini 3.8 Flash. Para decidir cuándo una API estructurada es preferible a un agente que controla la pantalla, consulte &lt;a href="https://apidog.com/es/blog/computer-use-vs-structured-apis?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;uso de computadoras frente a APIs estructuradas&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Probar el ciclo de herramientas en Apidog
&lt;/h2&gt;

&lt;p&gt;Un ciclo de herramientas tiene tres puntos críticos:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;La declaración de la herramienta.&lt;/li&gt;
&lt;li&gt;El recorrido de ida y vuelta del ID.&lt;/li&gt;
&lt;li&gt;La respuesta final.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Puede probarlos en Apidog sin conectar el backend real.&lt;/p&gt;

&lt;h3&gt;
  
  
  1. Simule el backend
&lt;/h3&gt;

&lt;p&gt;Defina &lt;code&gt;GET /orders/{order_id}&lt;/code&gt; y active el servidor simulado. Use siempre esta respuesta:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"status"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"in_transit"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"eta"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"2026-09-05"&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Una respuesta fija garantiza que cualquier cambio en la salida final provenga del modelo y no de la base de datos. En el entorno de pruebas, el arnés apunta a la URL simulada; en producción, al servicio real.&lt;/p&gt;

&lt;h3&gt;
  
  
  2. Encadene los dos turnos
&lt;/h3&gt;

&lt;p&gt;Guarde &lt;code&gt;GEMINI_API_KEY&lt;/code&gt; como variable de entorno y úsela en el encabezado:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;{{GEMINI_API_KEY}}
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Construya un escenario de tres pasos:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Paso A:&lt;/strong&gt; haga &lt;code&gt;POST /v1beta/interactions&lt;/code&gt; con el prompt y la declaración &lt;code&gt;get_order_status&lt;/code&gt;. Extraiga el ID de interacción y los campos &lt;code&gt;id&lt;/code&gt;, &lt;code&gt;name&lt;/code&gt; y &lt;code&gt;arguments.order_id&lt;/code&gt; del paso &lt;code&gt;function_call&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Paso B:&lt;/strong&gt; haga &lt;code&gt;GET&lt;/code&gt; al endpoint simulado usando &lt;code&gt;{{order_id}}&lt;/code&gt;. Este paso representa la ejecución de la función.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Paso C:&lt;/strong&gt; envíe otro &lt;code&gt;POST&lt;/code&gt; con &lt;code&gt;function_result&lt;/code&gt;:

&lt;ul&gt;
&lt;li&gt;&lt;code&gt;call_id: {{call_id}}&lt;/code&gt;&lt;/li&gt;
&lt;li&gt;&lt;code&gt;name: {{tool_name}}&lt;/code&gt;&lt;/li&gt;
&lt;li&gt;&lt;code&gt;previous_interaction_id: {{interaction_id}}&lt;/code&gt;&lt;/li&gt;
&lt;li&gt;El cuerpo del paso B como parte de texto.&lt;/li&gt;
&lt;/ul&gt;
&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  3. Añada aserciones
&lt;/h3&gt;

&lt;p&gt;Verifique lo siguiente:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;El paso A devuelve &lt;code&gt;200&lt;/code&gt; y contiene un paso &lt;code&gt;function_call&lt;/code&gt; cuyo &lt;code&gt;name&lt;/code&gt; es &lt;code&gt;get_order_status&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;arguments.order_id&lt;/code&gt; es &lt;code&gt;A1029&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;El paso C devuelve &lt;code&gt;200&lt;/code&gt; y termina en &lt;code&gt;model_output&lt;/code&gt;, sin un segundo &lt;code&gt;function_call&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;El texto final contiene &lt;code&gt;in_transit&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Si prueba también &lt;code&gt;generateContent&lt;/code&gt;, establezca un límite para &lt;code&gt;usageMetadata.thoughtsTokenCount&lt;/code&gt; según &lt;code&gt;thinking_level&lt;/code&gt;.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Estas aserciones confirman que el modelo interpretó el prompt, respetó el esquema, aceptó &lt;code&gt;call_id&lt;/code&gt; y &lt;code&gt;name&lt;/code&gt;, y utilizó el resultado de la herramienta.&lt;/p&gt;

&lt;p&gt;Programe el escenario para ejecutarlo diariamente. Las actualizaciones silenciosas pueden cambiar el comportamiento del modelo: un ciclo que terminaba en una ronda la semana pasada podría necesitar dos esta semana.&lt;/p&gt;

&lt;p&gt;La &lt;a href="https://apidog.com/es/blog/how-to-test-ai-agents-api?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de pruebas de APIs para agentes de IA&lt;/a&gt; profundiza en las aserciones de varios pasos. También puede &lt;a href="https://apidog.com/download?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;descargar Apidog&lt;/a&gt; y construir el escenario con el nivel gratuito.&lt;/p&gt;

&lt;h2&gt;
  
  
  Preguntas frecuentes
&lt;/h2&gt;

&lt;h3&gt;
  
  
  ¿Es obligatorio &lt;code&gt;call_id&lt;/code&gt; en Gemini 3.8 Flash?
&lt;/h3&gt;

&lt;p&gt;Sí. En la API de interacciones, cada &lt;code&gt;function_result&lt;/code&gt; necesita &lt;code&gt;call_id&lt;/code&gt; y &lt;code&gt;name&lt;/code&gt;. En &lt;code&gt;generateContent&lt;/code&gt;, cada &lt;code&gt;functionResponse&lt;/code&gt; necesita el &lt;code&gt;id&lt;/code&gt; y el &lt;code&gt;name&lt;/code&gt; de la llamada. El código antiguo que enviaba solo el nombre falla con los modelos Gemini 3.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Por qué mi ciclo ejecuta más turnos en 3.8 Flash que en 3.7?
&lt;/h3&gt;

&lt;p&gt;Es intencional. Google indica que Gemini 3.8 Flash llama a herramientas de forma iterativa y puede utilizar más tokens en tareas largas y complejas. Establezca un límite de turnos y reduzca &lt;code&gt;thinking_level&lt;/code&gt; cuando sea apropiado.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Todavía puedo usar &lt;code&gt;generateContent&lt;/code&gt; para llamadas a funciones?
&lt;/h3&gt;

&lt;p&gt;Sí. Google la considera una API heredada, pero sigue siendo totalmente compatible y no tiene fecha de finalización. Debe conservar usted mismo el historial, incluidas las firmas de pensamiento. El ID de llamada —&lt;code&gt;id&lt;/code&gt; en esta API— y &lt;code&gt;name&lt;/code&gt; siguen siendo obligatorios.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Funciona &lt;code&gt;thinking_level: "minimal"&lt;/code&gt; con herramientas?
&lt;/h3&gt;

&lt;p&gt;No. Gemini 3.8 Flash devuelve un error de validación. Use &lt;code&gt;low&lt;/code&gt;.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Cuánto cuesta una tarea intensiva en herramientas?
&lt;/h3&gt;

&lt;p&gt;Hasta el 31 de diciembre de 2026, el precio es de 0,75 USD por millón de tokens de entrada y 3,75 USD por millón de tokens de salida. El razonamiento se factura como salida.&lt;/p&gt;

&lt;p&gt;Artificial Analysis midió aproximadamente:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;0,58 USD por tarea en &lt;code&gt;high&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;0,41 USD en &lt;code&gt;medium&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;0,24 USD en &lt;code&gt;low&lt;/code&gt;.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Sus tareas pueden diferir. Registre los recuentos de tokens y mida el coste real.&lt;/p&gt;

&lt;h2&gt;
  
  
  Despliegue el ciclo con límites
&lt;/h2&gt;

&lt;p&gt;El contrato esencial es:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Declare la herramienta.&lt;/li&gt;
&lt;li&gt;Lea el paso &lt;code&gt;function_call&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Devuelva &lt;code&gt;function_result&lt;/code&gt; con &lt;code&gt;call_id&lt;/code&gt; y &lt;code&gt;name&lt;/code&gt; mediante &lt;code&gt;previous_interaction_id&lt;/code&gt;.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Lo que cambia con Gemini 3.8 Flash es la disposición del modelo a iterar. Antes de pasar a producción, añada un límite de turnos, seleccione &lt;code&gt;thinking_level&lt;/code&gt; por ruta y configure timeouts. Simule el backend, encadene los dos turnos, afirme el recorrido del ID y programe la prueba diaria.&lt;/p&gt;

&lt;p&gt;Consulte las &lt;a href="https://ai.google.dev/gemini-api/docs/latest-model" rel="noopener noreferrer"&gt;Novedades de Gemini 3.8 Flash&lt;/a&gt; para las notas de migración y la documentación de &lt;a href="https://ai.google.dev/gemini-api/docs/function-calling" rel="noopener noreferrer"&gt;llamadas a funciones&lt;/a&gt; para el contrato completo.&lt;/p&gt;

</description>
    </item>
    <item>
      <title>Cómo usar la API Gemini 3.8 Flash: API de interacciones, niveles de pensamiento y tu primera llamada en Apidog</title>
      <dc:creator>Roobia</dc:creator>
      <pubDate>Thu, 03 Sep 2026 07:34:16 +0000</pubDate>
      <link>https://dev.to/roobia/como-usar-la-api-gemini-38-flash-api-de-interacciones-niveles-de-pensamiento-y-tu-primera-3dop</link>
      <guid>https://dev.to/roobia/como-usar-la-api-gemini-38-flash-api-de-interacciones-niveles-de-pensamiento-y-tu-primera-3dop</guid>
      <description>&lt;h1&gt;
  
  
  Gemini 3.8 Flash: guía práctica para integrarlo con la API
&lt;/h1&gt;

&lt;p&gt;Google lanzó Gemini 3.8 Flash el 2 de septiembre de 2026. Su ID de API es &lt;code&gt;gemini-3.8-flash&lt;/code&gt;, sin sufijo de vista previa. Mantiene el precio introductorio de Gemini 3.7 Flash —$0.75 por millón de tokens de entrada y $3.75 por millón de tokens de salida— hasta el 31 de diciembre de 2026. Google lo describe como un modelo que “trabaja más duro”: ejecuta más pasos de razonamiento y utiliza herramientas con mayor frecuencia en tareas complejas, algo que se refleja directamente en el consumo de tokens.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation" class="crayons-btn crayons-btn--primary"&gt;Prueba Apidog hoy&lt;/a&gt;
&lt;/p&gt;

&lt;p&gt;Esta guía muestra cómo obtener una clave en AI Studio, realizar una primera solicitud con la API de Interacciones, utilizar el endpoint heredado &lt;code&gt;generateContent&lt;/code&gt;, configurar &lt;code&gt;thinking_level&lt;/code&gt;, activar streaming y leer &lt;code&gt;thoughtsTokenCount&lt;/code&gt; para controlar el costo del razonamiento. Todas las llamadas usan HTTP y JSON, así que puedes crearlas y validarlas en &lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt; antes de integrarlas en tu aplicación.&lt;/p&gt;

&lt;p&gt;Para conocer la descripción general, los benchmarks y los cambios del modelo, consulta &lt;a href="https://apidog.com/es/blog/what-is-gemini-3-8-flash?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;qué es Gemini 3.8 Flash&lt;/a&gt; y la &lt;a href="https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/" rel="noopener noreferrer"&gt;publicación de lanzamiento de Google&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Gemini 3.8 Flash de un vistazo
&lt;/h2&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Elemento&lt;/th&gt;
&lt;th&gt;Valor&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;ID del modelo&lt;/td&gt;
&lt;td&gt;&lt;code&gt;gemini-3.8-flash&lt;/code&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Endpoint principal&lt;/td&gt;
&lt;td&gt;&lt;code&gt;POST /v1beta/interactions&lt;/code&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Endpoint heredado&lt;/td&gt;
&lt;td&gt;&lt;code&gt;POST /v1beta/models/gemini-3.8-flash:generateContent&lt;/code&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Encabezado de autenticación&lt;/td&gt;
&lt;td&gt;&lt;code&gt;x-goog-api-key&lt;/code&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Contexto / salida&lt;/td&gt;
&lt;td&gt;1,048,576 tokens de entrada / 65,536 tokens de salida&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Entradas&lt;/td&gt;
&lt;td&gt;Texto, imagen, video, audio y PDF; solo genera texto&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Niveles de pensamiento&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;low&lt;/code&gt;, &lt;code&gt;medium&lt;/code&gt; (predeterminado) y &lt;code&gt;high&lt;/code&gt;; &lt;code&gt;minimal&lt;/code&gt; devuelve un error&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Precio introductorio hasta el 31 de diciembre de 2026&lt;/td&gt;
&lt;td&gt;$0.75 / $3.75 por 1 millón de tokens&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Precio desde el 1 de enero de 2027&lt;/td&gt;
&lt;td&gt;$1.50 / $7.50 por 1 millón de tokens&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;Dos detalles son importantes:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;El nivel predeterminado es &lt;code&gt;medium&lt;/code&gt;, no &lt;code&gt;high&lt;/code&gt; como en Gemini 3 Pro.&lt;/li&gt;
&lt;li&gt;Los tokens de pensamiento se facturan como tokens de salida. Consulta el &lt;a href="https://apidog.com/es/blog/gemini-3-8-flash-pricing?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;desglose de precios&lt;/a&gt; y la &lt;a href="https://ai.google.dev/gemini-api/docs/pricing" rel="noopener noreferrer"&gt;página oficial de precios&lt;/a&gt; antes de definir la configuración de producción.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Paso 1: Obtén una clave de API en AI Studio
&lt;/h2&gt;

&lt;p&gt;Abre &lt;a href="https://aistudio.google.com" rel="noopener noreferrer"&gt;Google AI Studio&lt;/a&gt;, inicia sesión y crea una clave desde la página de claves.&lt;/p&gt;

&lt;p&gt;La clave funciona con el nivel gratuito, que tiene límites de velocidad. Google advierte que los datos del nivel gratuito se “utilizan para mejorar nuestros productos”. Para obtener límites de producción del Nivel 1, vincula una cuenta de facturación.&lt;/p&gt;

&lt;p&gt;Guarda la clave como variable de entorno:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;&lt;span class="nb"&gt;export &lt;/span&gt;&lt;span class="nv"&gt;GEMINI_API_KEY&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="s2"&gt;"AIza..."&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;El SDK oficial de Python lee &lt;code&gt;GEMINI_API_KEY&lt;/code&gt; automáticamente, por lo que &lt;code&gt;genai.Client()&lt;/code&gt; no necesita argumentos. Instálalo con:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;pip &lt;span class="nb"&gt;install &lt;/span&gt;google-genai
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;h2&gt;
  
  
  Paso 2: Realiza tu primera llamada con la API de Interacciones
&lt;/h2&gt;

&lt;p&gt;Google considera la &lt;a href="https://ai.google.dev/gemini-api/docs/interactions" rel="noopener noreferrer"&gt;API de Interacciones&lt;/a&gt; la forma principal de llamar a los modelos Gemini 3.x.&lt;/p&gt;

&lt;p&gt;La solicitud incluye el modelo, una entrada y una configuración opcional de generación. En esta API, &lt;code&gt;thinking_level&lt;/code&gt; se encuentra dentro de &lt;code&gt;generation_config&lt;/code&gt;.&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;curl &lt;span class="nt"&gt;-X&lt;/span&gt; POST &lt;span class="s2"&gt;"https://generativelanguage.googleapis.com/v1beta/interactions"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;-H&lt;/span&gt; &lt;span class="s2"&gt;"x-goog-[REDACTED CREDENTIAL] &lt;/span&gt;&lt;span class="se"&gt;\&lt;/span&gt;&lt;span class="s2"&gt;
  -H "&lt;/span&gt;Content-Type: application/json&lt;span class="s2"&gt;" &lt;/span&gt;&lt;span class="se"&gt;\&lt;/span&gt;&lt;span class="s2"&gt;
  -d '{
    "&lt;/span&gt;model&lt;span class="s2"&gt;": "&lt;/span&gt;gemini-3.8-flash&lt;span class="s2"&gt;",
    "&lt;/span&gt;input&lt;span class="s2"&gt;": "&lt;/span&gt;Explain HTTP caching &lt;span class="k"&gt;in &lt;/span&gt;3 sentences.&lt;span class="s2"&gt;",
    "&lt;/span&gt;generation_config&lt;span class="s2"&gt;": {"&lt;/span&gt;thinking_level&lt;span class="s2"&gt;": "&lt;/span&gt;medium&lt;span class="s2"&gt;"}
  }'
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;La respuesta contiene una lista de pasos de ejecución, no un único mensaje. Los pensamientos y las llamadas a herramientas aparecen como pasos; el último paso suele ser &lt;code&gt;model_output&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;El SDK de Python aplana esta estructura:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight python"&gt;&lt;code&gt;&lt;span class="kn"&gt;from&lt;/span&gt; &lt;span class="n"&gt;google&lt;/span&gt; &lt;span class="kn"&gt;import&lt;/span&gt; &lt;span class="n"&gt;genai&lt;/span&gt;

&lt;span class="n"&gt;client&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;genai&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nc"&gt;Client&lt;/span&gt;&lt;span class="p"&gt;()&lt;/span&gt;

&lt;span class="n"&gt;interaction&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;interactions&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;create&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
    &lt;span class="n"&gt;model&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;gemini-3.8-flash&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="nb"&gt;input&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;Explain HTTP caching in 3 sentences.&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="n"&gt;generation_config&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;thinking_level&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;medium&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;},&lt;/span&gt;
&lt;span class="p"&gt;)&lt;/span&gt;

&lt;span class="nf"&gt;print&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="n"&gt;interaction&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;output_text&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;No establezcas &lt;code&gt;temperature&lt;/code&gt;, &lt;code&gt;top_p&lt;/code&gt; ni &lt;code&gt;top_k&lt;/code&gt;. La guía de Google para Gemini 3 recomienda mantener la temperatura predeterminada de &lt;code&gt;1.0&lt;/code&gt;, porque reducirla “puede causar bucles o un rendimiento degradado”. Si reutilizas una configuración de un modelo anterior, elimina esos parámetros primero.&lt;/p&gt;

&lt;h2&gt;
  
  
  Paso 3: Mantén conversaciones multi-turno
&lt;/h2&gt;

&lt;p&gt;La API de Interacciones conserva el estado de la conversación en el servidor por defecto. Para continuar una conversación, envía el ID de la interacción anterior mediante &lt;code&gt;previous_interaction_id&lt;/code&gt;:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight python"&gt;&lt;code&gt;&lt;span class="n"&gt;follow_up&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;interactions&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;create&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
    &lt;span class="n"&gt;model&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;gemini-3.8-flash&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="nb"&gt;input&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;Now give one example of a Cache-Control header.&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="n"&gt;previous_interaction_id&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="n"&gt;interaction&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nb"&gt;id&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
&lt;span class="p"&gt;)&lt;/span&gt;

&lt;span class="nf"&gt;print&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="n"&gt;follow_up&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;output_text&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Si tus requisitos de cumplimiento prohíben el almacenamiento del lado del servidor, utiliza &lt;code&gt;store: false&lt;/code&gt;. En ese caso, tendrás que gestionar el estado manualmente y reenviar los bloques y las firmas de pensamiento exactamente como los recibiste.&lt;/p&gt;

&lt;p&gt;Este mismo requisito es importante cuando utilizas herramientas. Consulta la &lt;a href="https://apidog.com/es/blog/gemini-3-8-flash-function-calling?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de llamada de funciones para Gemini 3.8 Flash&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Paso 4: Utiliza el endpoint heredado &lt;code&gt;generateContent&lt;/code&gt;
&lt;/h2&gt;

&lt;p&gt;La mayoría del código Gemini en producción todavía utiliza &lt;code&gt;generateContent&lt;/code&gt;. Google lo considera heredado, pero sigue siendo totalmente compatible y no tiene una fecha de finalización publicada.&lt;/p&gt;

&lt;p&gt;La forma de la solicitud es igual que en &lt;a href="https://apidog.com/es/blog/how-to-use-gemini-3-7-flash-api?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;la guía de la API de Gemini 3.7 Flash&lt;/a&gt;, aunque &lt;code&gt;thinking_level&lt;/code&gt; se configura en una ubicación diferente.&lt;/p&gt;

&lt;p&gt;En &lt;code&gt;generateContent&lt;/code&gt;, el nivel se encuentra dentro de &lt;code&gt;generationConfig.thinkingConfig.thinkingLevel&lt;/code&gt;:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;curl &lt;span class="nt"&gt;-X&lt;/span&gt; POST &lt;span class="s2"&gt;"https://generativelanguage.googleapis.com/v1beta/models/gemini-3.8-flash:generateContent"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;-H&lt;/span&gt; &lt;span class="s2"&gt;"x-goog-[REDACTED CREDENTIAL] &lt;/span&gt;&lt;span class="se"&gt;\&lt;/span&gt;&lt;span class="s2"&gt;
  -H "&lt;/span&gt;Content-Type: application/json&lt;span class="s2"&gt;" &lt;/span&gt;&lt;span class="se"&gt;\&lt;/span&gt;&lt;span class="s2"&gt;
  -d '{
    "&lt;/span&gt;contents&lt;span class="s2"&gt;": [{"&lt;/span&gt;parts&lt;span class="s2"&gt;": [{"&lt;/span&gt;text&lt;span class="s2"&gt;": "&lt;/span&gt;Explain HTTP caching &lt;span class="k"&gt;in &lt;/span&gt;3 sentences.&lt;span class="s2"&gt;"}]}],
    "&lt;/span&gt;generationConfig&lt;span class="s2"&gt;": {"&lt;/span&gt;thinkingConfig&lt;span class="s2"&gt;": {"&lt;/span&gt;thinkingLevel&lt;span class="s2"&gt;": "&lt;/span&gt;low&lt;span class="s2"&gt;"}}
  }'
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;En Python:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight python"&gt;&lt;code&gt;&lt;span class="kn"&gt;from&lt;/span&gt; &lt;span class="n"&gt;google&lt;/span&gt; &lt;span class="kn"&gt;import&lt;/span&gt; &lt;span class="n"&gt;genai&lt;/span&gt;
&lt;span class="kn"&gt;from&lt;/span&gt; &lt;span class="n"&gt;google.genai&lt;/span&gt; &lt;span class="kn"&gt;import&lt;/span&gt; &lt;span class="n"&gt;types&lt;/span&gt;

&lt;span class="n"&gt;client&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;genai&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nc"&gt;Client&lt;/span&gt;&lt;span class="p"&gt;()&lt;/span&gt;

&lt;span class="n"&gt;response&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;models&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;generate_content&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
    &lt;span class="n"&gt;model&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;gemini-3.8-flash&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="n"&gt;contents&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;Explain HTTP caching in 3 sentences.&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="n"&gt;config&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="n"&gt;types&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nc"&gt;GenerateContentConfig&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
        &lt;span class="n"&gt;thinking_config&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="n"&gt;types&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nc"&gt;ThinkingConfig&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="n"&gt;thinking_level&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;low&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt;
    &lt;span class="p"&gt;),&lt;/span&gt;
&lt;span class="p"&gt;)&lt;/span&gt;

&lt;span class="nf"&gt;print&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="n"&gt;response&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;text&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Si tu configuración anterior utilizaba &lt;code&gt;thinking_budget&lt;/code&gt; como entero, reemplázalo por el enumerado de cadena. &lt;code&gt;candidate_count&lt;/code&gt; también desapareció en Gemini 3 y versiones posteriores. La &lt;a href="https://apidog.com/es/blog/gemini-3-7-to-3-8-flash-migration-guide?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de migración de Gemini 3.7 a 3.8 Flash&lt;/a&gt; incluye ejemplos JSON antes y después.&lt;/p&gt;

&lt;h3&gt;
  
  
  Diferencias entre ambas APIs
&lt;/h3&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Preocupación&lt;/th&gt;
&lt;th&gt;API de Interacciones&lt;/th&gt;
&lt;th&gt;
&lt;code&gt;generateContent&lt;/code&gt; heredado&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Nivel de pensamiento&lt;/td&gt;
&lt;td&gt;&lt;code&gt;generation_config.thinking_level&lt;/code&gt;&lt;/td&gt;
&lt;td&gt;&lt;code&gt;generationConfig.thinkingConfig.thinkingLevel&lt;/code&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Estado de conversación&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;previous_interaction_id&lt;/code&gt; en el servidor&lt;/td&gt;
&lt;td&gt;Reenviar el array completo de &lt;code&gt;contents&lt;/code&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Resultado de herramienta&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;function_result&lt;/code&gt; con &lt;code&gt;call_id&lt;/code&gt; y &lt;code&gt;name&lt;/code&gt;
&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;functionResponse&lt;/code&gt; con &lt;code&gt;id&lt;/code&gt; y &lt;code&gt;name&lt;/code&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Texto final&lt;/td&gt;
&lt;td&gt;Paso &lt;code&gt;model_output&lt;/code&gt;; &lt;code&gt;output_text&lt;/code&gt; en el SDK&lt;/td&gt;
&lt;td&gt;&lt;code&gt;candidates[0].content.parts[].text&lt;/code&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Firmas de pensamiento&lt;/td&gt;
&lt;td&gt;Gestionarlas manualmente cuando &lt;code&gt;store: false&lt;/code&gt;
&lt;/td&gt;
&lt;td&gt;Devolver cada parte exactamente como se recibió&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;h2&gt;
  
  
  Paso 5: Activa el streaming y controla el costo
&lt;/h2&gt;

&lt;p&gt;Para interfaces de chat, utiliza &lt;code&gt;streamGenerateContent&lt;/code&gt; y añade &lt;code&gt;?alt=sse&lt;/code&gt; para recibir eventos enviados por el servidor:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;curl &lt;span class="nt"&gt;-N&lt;/span&gt; &lt;span class="s2"&gt;"https://generativelanguage.googleapis.com/v1beta/models/gemini-3.8-flash:streamGenerateContent?alt=sse"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;-H&lt;/span&gt; &lt;span class="s2"&gt;"x-goog-api-key: &lt;/span&gt;&lt;span class="nv"&gt;$GEMINI_API_KEY&lt;/span&gt;&lt;span class="s2"&gt;"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;-H&lt;/span&gt; &lt;span class="s2"&gt;"Content-Type: application/json"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;-d&lt;/span&gt; &lt;span class="s1"&gt;'{"contents":[{"parts":[{"text":"List three HTTP caching headers."}]}]}'&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Con o sin streaming, las respuestas de &lt;code&gt;generateContent&lt;/code&gt; terminan con &lt;code&gt;usageMetadata&lt;/code&gt;. Regístralo en cada llamada:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="nl"&gt;"usageMetadata"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"promptTokenCount"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="mi"&gt;12&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"candidatesTokenCount"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="mi"&gt;84&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"thoughtsTokenCount"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="mi"&gt;310&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"totalTokenCount"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="mi"&gt;406&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;El campo clave en Gemini 3.8 Flash es &lt;code&gt;thoughtsTokenCount&lt;/code&gt;. Durante el período introductorio, estos tokens se facturan como tokens de salida a $3.75 por millón. Google también afirma que el modelo “podría usar más tokens para maximizar el rendimiento, especialmente en niveles de esfuerzo más altos”.&lt;/p&gt;

&lt;p&gt;Artificial Analysis midió aproximadamente 48.000 tokens de salida por tarea en &lt;code&gt;high&lt;/code&gt;, un 30 % más que Gemini 3.7 Flash. Con los mismos precios por token, el costo por tarea aumentó de $0.40 a $0-3-8-flash-thinking-levels?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation) ayuda a convertir estos datos en una estrategia por ruta.&lt;/p&gt;

&lt;p&gt;Para inspeccionar el razonamiento resumido, añade &lt;code&gt;includeThoughts: true&lt;/code&gt; dentro de &lt;code&gt;thinkingConfig&lt;/code&gt;:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"thinkingConfig"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"thinkingLevel"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"medium"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="nl"&gt;"includeThoughts"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="kc"&gt;true&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Los resúmenes aparecen como partes con &lt;code&gt;"thought": true&lt;/code&gt;. Exclúyelos al ensamblar la respuesta visible para el usuario.&lt;/p&gt;

&lt;h2&gt;
  
  
  Errores frecuentes
&lt;/h2&gt;

&lt;h3&gt;
  
  
  &lt;code&gt;thinking_level: "minimal"&lt;/code&gt; devuelve &lt;code&gt;400 INVALID_ARGUMENT&lt;/code&gt;
&lt;/h3&gt;

&lt;p&gt;Gemini 3.8 Flash solo admite &lt;code&gt;low&lt;/code&gt;, &lt;code&gt;medium&lt;/code&gt; y &lt;code&gt;high&lt;/code&gt;. Enviar &lt;code&gt;minimal&lt;/code&gt; produce:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Thinking level MINIMAL is not supported for this model.
Please retry with other thinking level.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;La solución es cambiar &lt;code&gt;minimal&lt;/code&gt; por &lt;code&gt;low&lt;/code&gt;. Las configuraciones antiguas de Gemini 3.x y los fragmentos copiados son la causa más habitual.&lt;/p&gt;

&lt;h3&gt;
  
  
  &lt;code&gt;429&lt;/code&gt; significa que alcanzaste el límite
&lt;/h3&gt;

&lt;p&gt;Un &lt;code&gt;429&lt;/code&gt; normalmente indica que superaste el límite de velocidad de tu nivel, no que la solicitud sea inválida.&lt;/p&gt;

&lt;p&gt;Según la &lt;a href="https://ai.google.dev/gemini-api/docs/rate-limits" rel="noopener noreferrer"&gt;página de límites de velocidad&lt;/a&gt;:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;El nivel gratuito tiene límites de velocidad.&lt;/li&gt;
&lt;li&gt;El Nivel 1 se habilita al vincular una cuenta de facturación.&lt;/li&gt;
&lt;li&gt;El Nivel 2 requiere $100 de gasto y tres días.&lt;/li&gt;
&lt;li&gt;El Nivel 3 requiere $1.000 de gasto y 30 días.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Las solicitudes por minuto y los tokens por minuto disponibles para cada modelo se muestran en AI Studio para tu cuenta. Ante un &lt;code&gt;429&lt;/code&gt;, aplica backoff y reintenta. Si los errores continúan con poco volumen, considera actualizar de nivel.&lt;/p&gt;

&lt;p&gt;Para trabajos fuera de línea, la API Batch ofrece un descuento del 50 %: $0.375 por millón de tokens de entrada y $1.875 por millón de tokens de salida durante el período introductorio. Sus límites de tokens en cola son:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Nivel 1: 3 millones&lt;/li&gt;
&lt;li&gt;Nivel 2: 400 millones&lt;/li&gt;
&lt;li&gt;Nivel 3: 1.000 millones&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Consulta la &lt;a href="https://apidog.com/es/blog/gemini-api-batch-mode?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía del modo por lotes de Gemini&lt;/a&gt; para conocer el formato de la solicitud.&lt;/p&gt;

&lt;h3&gt;
  
  
  Falta &lt;code&gt;call_id&lt;/code&gt; en el resultado de una función
&lt;/h3&gt;

&lt;p&gt;Cuando utilizas herramientas:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Cada &lt;code&gt;function_result&lt;/code&gt; de Interacciones debe incluir &lt;code&gt;call_id&lt;/code&gt; y &lt;code&gt;name&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Cada &lt;code&gt;functionResponse&lt;/code&gt; heredada debe incluir el &lt;code&gt;id&lt;/code&gt; coincidente y &lt;code&gt;name&lt;/code&gt;.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Omitir cualquiera de estos campos hace que falle el turno.&lt;/p&gt;

&lt;h2&gt;
  
  
  Prueba ambos endpoints en Apidog
&lt;/h2&gt;

&lt;p&gt;Cuando las solicitudes funcionen desde la terminal, guárdalas en un proyecto compartido de &lt;a href="https://apidog.com/download?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt; para que todo el equipo pueda ejecutarlas.&lt;/p&gt;

&lt;h3&gt;
  
  
  1. Mantén la clave fuera de la solicitud
&lt;/h3&gt;

&lt;p&gt;Añade &lt;code&gt;GEMINI_API_KEY&lt;/code&gt; como variable de entorno y referencia la variable en el encabezado:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;x-goog-[REDACTED CREDENTIAL]_KEY}}
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;La solicitud guardada no contendrá el secreto, y podrás cambiar entre una clave gratuita y una facturable modificando el entorno.&lt;/p&gt;

&lt;h3&gt;
  
  
  2. Verifica el estado y los tokens
&lt;/h3&gt;

&lt;p&gt;Añade una aserción para comprobar que el estado sea &lt;code&gt;200&lt;/code&gt; y otra para verificar que:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;usageMetadata.thoughtsTokenCount
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;se mantenga por debajo del límite que definas para cada prompt. Ese límite funciona como alarma de regresión de costos: si cambia el prompt o el modelo consume más tokens de pensamiento, la prueba fallará antes de que aumente la factura.&lt;/p&gt;

&lt;p&gt;La &lt;a href="https://apidog.com/es/blog/test-llm-ai-apis-sse?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de pruebas SSE&lt;/a&gt; cubre la variante de streaming, que Apidog muestra como un flujo de eventos fusionado.&lt;/p&gt;

&lt;h3&gt;
  
  
  3. Compara los tres niveles
&lt;/h3&gt;

&lt;p&gt;Duplica la solicitud para &lt;code&gt;low&lt;/code&gt;, &lt;code&gt;medium&lt;/code&gt; y &lt;code&gt;high&lt;/code&gt;. Compara &lt;code&gt;thoughtsTokenCount&lt;/code&gt; y el tiempo de respuesta para obtener datos reales de tus prompts, en lugar de depender de promedios de benchmarks.&lt;/p&gt;

&lt;h3&gt;
  
  
  4. Programa las pruebas
&lt;/h3&gt;

&lt;p&gt;Convierte las solicitudes en un escenario y ejecútalo periódicamente. Así, un cambio en los límites, una modificación de validación —como la eliminación de &lt;code&gt;minimal&lt;/code&gt;— o un aumento inesperado de tokens aparecerá en un informe antes de llegar a producción.&lt;/p&gt;

&lt;p&gt;Consulta &lt;a href="https://apidog.com/es/blog/how-to-schedule-api-tests-apidog?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Cómo programar pruebas de API en Apidog&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;Apidog no ejecuta el modelo ni reemplaza el SDK. Proporciona una versión guardada, compartible y verificable de las llamadas HTTP: una capa que muchos equipos no crean hasta que algo falla.&lt;/p&gt;

&lt;h2&gt;
  
  
  Preguntas frecuentes
&lt;/h2&gt;

&lt;h3&gt;
  
  
  ¿Qué endpoint deberían usar los proyectos nuevos?
&lt;/h3&gt;

&lt;p&gt;La API de Interacciones. Google considera &lt;code&gt;generateContent&lt;/code&gt; heredado, aunque sigue siendo totalmente compatible. Las nuevas funciones llegan primero a Interacciones y el estado del servidor simplifica el código multi-turno.&lt;/p&gt;

&lt;p&gt;Mantén &lt;code&gt;generateContent&lt;/code&gt; en los servicios existentes hasta que tengas una razón concreta para migrar.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Necesito una cuenta de pago?
&lt;/h3&gt;

&lt;p&gt;No. Una clave gratuita de AI Studio funciona, aunque tiene límites de velocidad y está sujeta a los términos de uso de datos de Google. La &lt;a href="https://apidog.com/es/blog/how-to-use-gemini-3-8-flash-for-free?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía para usar Gemini 3.8 Flash gratis&lt;/a&gt; explica qué incluye y qué no incluye el nivel gratuito. La aplicación Gemini requiere un plan AI Pro o Ultra para usar Gemini 3.8 Flash.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Gemini 3.8 Flash es más lento que Gemini 3.7 Flash?
&lt;/h3&gt;

&lt;p&gt;Por token, no. Logan Kilpatrick, de Google, indicó que la velocidad es aproximadamente la misma, y Artificial Analysis midió cerca de 300 tokens de salida por segundo.&lt;/p&gt;

&lt;p&gt;Por tarea, &lt;code&gt;high&lt;/code&gt; tarda más porque genera más tokens: 2,5 minutos frente a 2,2 minutos en sus pruebas.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Puedo seguir utilizando Gemini 3.7 Flash?
&lt;/h3&gt;

&lt;p&gt;Sí. Google afirma que Gemini 3.7 Flash sigue siendo totalmente compatible y no ha publicado una fecha de desuso. Si el consumo adicional de tokens de Gemini 3.8 Flash no mejora tus resultados, mantener el modelo actual sigue siendo una opción válida.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Gemini 3.8 Flash admite Live API o generación de imágenes?
&lt;/h3&gt;

&lt;p&gt;No. Solo genera texto. La generación de audio, la generación de imágenes y Live API no son compatibles con este modelo.&lt;/p&gt;

&lt;h2&gt;
  
  
  Próximos pasos
&lt;/h2&gt;

&lt;p&gt;Ya tienes dos rutas de llamada funcionales, un patrón multi-turno y una forma de controlar el consumo de tokens.&lt;/p&gt;

&lt;p&gt;A partir de aquí:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Integra herramientas con la &lt;a href="https://apidog.com/es/blog/gemini-3-8-flash-function-calling?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de llamada de funciones&lt;/a&gt;.&lt;/li&gt;
&lt;li&gt;Define los niveles de pensamiento por ruta con la &lt;a href="https://apidog.com/es/blog/gemini-3-8-flash-thinking-levels?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de niveles de pensamiento&lt;/a&gt;.&lt;/li&gt;
&lt;li&gt;Compara las ventajas y desventajas en la &lt;a href="https://apidog.com/es/blog/gemini-3-8-flash-vs-gemini-3-7-flash?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;comparación entre Gemini 3.8 y 3.7 Flash&lt;/a&gt;.&lt;/li&gt;
&lt;li&gt;Mantén el escenario de Apidog activo para detectar las variaciones de costo como pruebas fallidas.&lt;/li&gt;
&lt;/ol&gt;

</description>
    </item>
    <item>
      <title>¿Cómo usar Gemini 3.8 Flash gratis?</title>
      <dc:creator>Roobia</dc:creator>
      <pubDate>Thu, 03 Sep 2026 05:20:23 +0000</pubDate>
      <link>https://dev.to/roobia/como-usar-gemini-38-flash-gratis-kap</link>
      <guid>https://dev.to/roobia/como-usar-gemini-38-flash-gratis-kap</guid>
      <description>&lt;h1&gt;
  
  
  Cómo usar Gemini 3.8 Flash gratis: guía práctica con API
&lt;/h1&gt;

&lt;p&gt;Gemini 3.8 Flash se lanzó el 2 de septiembre de 2026. A diferencia de muchos lanzamientos pioneros de este año, ofrece un camino gratuito real: puedes probarlo sin costo en &lt;a href="https://aistudio.google.com" rel="noopener noreferrer"&gt;Google AI Studio&lt;/a&gt; y llamarlo desde el nivel gratuito de la API de Gemini con una clave que se crea en aproximadamente un minuto. Google lo presenta como “nuestro modelo Flash más inteligente” y el nivel gratuito utiliza el mismo ID &lt;code&gt;gemini-3.8-flash&lt;/code&gt; que los clientes de pago, no una variante reducida.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation" class="crayons-btn crayons-btn--primary"&gt;Prueba Apidog hoy&lt;/a&gt;
&lt;/p&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fk58ahdawet169499b4pq.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fk58ahdawet169499b4pq.png" alt="Gemini 3.8 Flash" width="800" height="800"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;Hay tres advertencias importantes:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;El nivel gratuito tiene límites de tasa.&lt;/li&gt;
&lt;li&gt;Google utiliza los datos del nivel gratuito para mejorar sus productos.&lt;/li&gt;
&lt;li&gt;La aplicación Gemini no incluye 3.8 Flash en su plan gratuito; necesitas Google AI Pro o Ultra.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Para conocer las especificaciones completas, consulta &lt;a href="https://apidog.com/es/blog/what-is-gemini-3-8-flash?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;qué es Gemini 3.8 Flash&lt;/a&gt;. Si quieres ejecutar una solicitud ahora, sigue estos pasos.&lt;/p&gt;

&lt;h2&gt;
  
  
  Acceso gratuito de un vistazo
&lt;/h2&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Superficie&lt;/th&gt;
&lt;th&gt;Costo&lt;/th&gt;
&lt;th&gt;¿Gemini 3.8 Flash incluido?&lt;/th&gt;
&lt;th&gt;Advertencia&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Google AI Studio&lt;/td&gt;
&lt;td&gt;$0&lt;/td&gt;
&lt;td&gt;Sí&lt;/td&gt;
&lt;td&gt;Límites de tasa; los datos se utilizan para mejorar productos&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Nivel gratuito de la API de Gemini&lt;/td&gt;
&lt;td&gt;$0&lt;/td&gt;
&lt;td&gt;Sí&lt;/td&gt;
&lt;td&gt;Mismos límites publicados en AI Studio&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Aplicación Gemini, plan gratuito&lt;/td&gt;
&lt;td&gt;$0&lt;/td&gt;
&lt;td&gt;No&lt;/td&gt;
&lt;td&gt;3.8 Flash requiere Google AI Pro o Ultra&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Modo IA en la Búsqueda de Google&lt;/td&gt;
&lt;td&gt;$0&lt;/td&gt;
&lt;td&gt;Sí, para consumidores&lt;/td&gt;
&lt;td&gt;Sin API ni control del nivel de pensamiento&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Gemini en Hojas de cálculo de Google&lt;/td&gt;
&lt;td&gt;Depende del plan&lt;/td&gt;
&lt;td&gt;Sí, para consumidores&lt;/td&gt;
&lt;td&gt;Sin API&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Contextualización de Búsqueda de Google&lt;/td&gt;
&lt;td&gt;5.000 solicitudes/mes gratis&lt;/td&gt;
&lt;td&gt;Compartida entre Gemini 3.x&lt;/td&gt;
&lt;td&gt;Después, $14 por cada 1.000 solicitudes&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;API por lotes&lt;/td&gt;
&lt;td&gt;50 % de descuento sobre las tarifas de pago&lt;/td&gt;
&lt;td&gt;Sí&lt;/td&gt;
&lt;td&gt;No es gratuita, pero es la opción de pago más económica&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Gemini 3.8 Flash Cyber&lt;/td&gt;
&lt;td&gt;No se vende&lt;/td&gt;
&lt;td&gt;No&lt;/td&gt;
&lt;td&gt;Solo Programa Fairwind; no existe API pública&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;h2&gt;
  
  
  Paso 1: selecciona &lt;code&gt;gemini-3.8-flash&lt;/code&gt; en AI Studio
&lt;/h2&gt;

&lt;p&gt;Abre &lt;a href="https://aistudio.google.com" rel="noopener noreferrer"&gt;Google AI Studio&lt;/a&gt; e inicia sesión. No necesitas una cuenta de facturación ni una tarjeta de crédito.&lt;/p&gt;

&lt;p&gt;En el selector de modelos, elige &lt;code&gt;gemini-3.8-flash&lt;/code&gt;. Es el ID estable, sin sufijo de vista previa. La configuración de ejecución ofrece tres niveles de pensamiento:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;&lt;code&gt;low&lt;/code&gt;&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;medium&lt;/code&gt;, el valor predeterminado&lt;/li&gt;
&lt;li&gt;&lt;code&gt;high&lt;/code&gt;&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;El modelo no admite un nivel mínimo. Si lo envías mediante la API, recibirás un error de validación en lugar de una alternativa silenciosa. Consulta la &lt;a href="https://apidog.com/es/blog/gemini-3-8-flash-thinking-levels?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de niveles de pensamiento&lt;/a&gt; para comparar el costo en tokens y tiempo.&lt;/p&gt;

&lt;p&gt;Para empezar:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Mantén la temperatura en su valor predeterminado de &lt;code&gt;1.0&lt;/code&gt;. Google advierte que reducirla puede provocar bucles o respuestas degradadas.&lt;/li&gt;
&lt;li&gt;Usa &lt;code&gt;low&lt;/code&gt; mientras experimentas.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Gemini 3.8 Flash está diseñado para trabajar más en tareas complejas: puede tomar pasos de razonamiento más pequeños y llamar a herramientas de forma iterativa. Google también indica que puede consumir más tokens en tareas complejas y prolongadas. Como los límites se miden en tokens por minuto, ese consumo agota la cuota más rápido que en 3.7 Flash. &lt;code&gt;low&lt;/code&gt; mantiene los experimentos económicos.&lt;/p&gt;

&lt;h2&gt;
  
  
  Paso 2: crea una clave API gratuita
&lt;/h2&gt;

&lt;p&gt;En AI Studio, abre la página de claves API y crea una clave en un proyecto nuevo o existente. Es gratuita y funciona de inmediato con el nivel gratuito. La &lt;a href="https://ai.google.dev/gemini-api/docs/pricing" rel="noopener noreferrer"&gt;página de precios de Gemini&lt;/a&gt; muestra la entrada y salida de 3.8 Flash como “Gratuitas” en ese nivel.&lt;/p&gt;

&lt;p&gt;Si es tu primera clave, consulta esta &lt;a href="https://apidog.com/es/blog/google-gemini-api-key-for-free?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía para crear una clave API de Gemini&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;Guárdala como variable de entorno y no la incluyas en el código ni en el historial del shell:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;&lt;span class="nb"&gt;export &lt;/span&gt;&lt;span class="nv"&gt;GEMINI_API_KEY&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="s2"&gt;"paste-your-key-here"&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Trátala como una contraseña. Aunque una clave filtrada del nivel gratuito no puede generar una factura, sí puede consumir tu cuota diaria antes de que la utilices.&lt;/p&gt;

&lt;h2&gt;
  
  
  Paso 3: realiza tu primera solicitud
&lt;/h2&gt;

&lt;p&gt;Gemini 3.x funciona principalmente con la API de Interactions. Puedes hacer una solicitud sin instalar un SDK:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;curl &lt;span class="nt"&gt;-X&lt;/span&gt; POST &lt;span class="s2"&gt;"https://generativelanguage.googleapis.com/v1beta/interactions"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;-H&lt;/span&gt; &lt;span class="s2"&gt;"x-goog-[REDACTED CREDENTIAL] &lt;/span&gt;&lt;span class="se"&gt;\&lt;/span&gt;&lt;span class="s2"&gt;
  -H 'Content-Type: application/json' &lt;/span&gt;&lt;span class="se"&gt;\&lt;/span&gt;&lt;span class="s2"&gt;
  -d '{"&lt;/span&gt;model&lt;span class="s2"&gt;":"&lt;/span&gt;gemini-3.8-flash&lt;span class="s2"&gt;","&lt;/span&gt;input&lt;span class="s2"&gt;":"&lt;/span&gt;Explain HTTP caching &lt;span class="k"&gt;in &lt;/span&gt;3 sentences.&lt;span class="s2"&gt;","&lt;/span&gt;generation_config&lt;span class="s2"&gt;":{"&lt;/span&gt;thinking_level&lt;span class="s2"&gt;":"&lt;/span&gt;low&lt;span class="s2"&gt;"}}'
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;La respuesta contiene una lista de pasos de ejecución —pensamientos del modelo y llamadas a herramientas, si las hubiera— que termina en un paso &lt;code&gt;model_output&lt;/code&gt; con el texto generado.&lt;/p&gt;

&lt;p&gt;Si tu código utiliza &lt;code&gt;generateContent&lt;/code&gt;, todavía funciona. Google lo considera heredado, pero “totalmente compatible” y sin fecha de finalización anunciada. En ese endpoint, el nivel se configura mediante:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;generationConfig.thinkingConfig.thinkingLevel
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;La &lt;a href="https://apidog.com/es/blog/how-to-use-gemini-3-8-flash-api?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de la API de Gemini 3.8 Flash&lt;/a&gt; incluye ambas formas, ejemplos en Python y conversaciones multi-turno con &lt;code&gt;previous_interaction_id&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;Si recibes un error &lt;code&gt;429&lt;/code&gt;, alcanzaste el límite de tasa del nivel gratuito. Espera o pasa al Nivel 1.&lt;/p&gt;

&lt;h2&gt;
  
  
  Qué cuesta realmente el nivel gratuito
&lt;/h2&gt;

&lt;p&gt;En dólares: nada. En la práctica, pagas de otras tres formas.&lt;/p&gt;

&lt;h3&gt;
  
  
  1. Límites de tasa
&lt;/h3&gt;

&lt;p&gt;El nivel gratuito limita, por modelo:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Solicitudes por minuto.&lt;/li&gt;
&lt;li&gt;Tokens por minuto.&lt;/li&gt;
&lt;li&gt;Solicitudes por día.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Google publica las cifras exactas en la &lt;a href="https://aistudio.google.com/rate-limit" rel="noopener noreferrer"&gt;página de límites de tasa de AI Studio&lt;/a&gt;, no siempre en la documentación. Además, pueden cambiar sin una entrada en el registro de cambios. Consulta esa página para conocer los límites actuales de tu proyecto y revisa cómo se acumulan los niveles en el &lt;a href="https://ai.google.dev/gemini-api/docs/rate-limits" rel="noopener noreferrer"&gt;documento de límites de tasa&lt;/a&gt;.&lt;/p&gt;

&lt;h3&gt;
  
  
  2. Tus datos
&lt;/h3&gt;

&lt;p&gt;Google afirma que las solicitudes y respuestas del nivel gratuito se utilizan para mejorar sus productos. Esto puede ser aceptable para una consulta de referencia o una aplicación de prueba, pero no para:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Registros de clientes.&lt;/li&gt;
&lt;li&gt;Código fuente no publicado.&lt;/li&gt;
&lt;li&gt;Información protegida por un acuerdo de confidencialidad (NDA).&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Los niveles de pago tienen condiciones diferentes. Si necesitas privacidad, vincula la facturación antes de enviar datos sensibles.&lt;/p&gt;

&lt;h3&gt;
  
  
  3. Consumo de tokens
&lt;/h3&gt;

&lt;p&gt;Artificial Analysis midió 3.8 Flash en el nivel &lt;code&gt;high&lt;/code&gt; con aproximadamente 48.000 tokens de salida por tarea, un 30 % más que 3.7 Flash. Los tokens de pensamiento cuentan para los mismos límites de tokens por minuto que la salida visible.&lt;/p&gt;

&lt;p&gt;Por eso conviene usar &lt;code&gt;low&lt;/code&gt; o &lt;code&gt;medium&lt;/code&gt; hasta que necesites más margen.&lt;/p&gt;

&lt;h2&gt;
  
  
  La aplicación Gemini no es el camino gratuito
&lt;/h2&gt;

&lt;p&gt;La aplicación Gemini ofrece 3.8 Flash a suscriptores de Google AI Pro y Ultra. El plan gratuito de la aplicación no lo incluye. Si ves un modelo Flash sin suscripción, no significa que sea 3.8 Flash.&lt;/p&gt;

&lt;p&gt;Las superficies de consumo donde puedes usarlo sin un cargo adicional son:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Modo IA en la Búsqueda de Google.&lt;/li&gt;
&lt;li&gt;Gemini en Hojas de cálculo de Google.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Ambas sirven para leer respuestas, pero no ofrecen control sobre el nivel de pensamiento, recuento de tokens ni API. Para desarrollo, AI Studio y el nivel gratuito de la API son las opciones adecuadas.&lt;/p&gt;

&lt;h2&gt;
  
  
  Contextualización gratuita: 5.000 búsquedas al mes
&lt;/h2&gt;

&lt;p&gt;La contextualización de Búsqueda de Google permite incorporar resultados web actuales en la respuesta del modelo. Incluye 5.000 solicitudes gratuitas al mes compartidas entre todos los modelos Gemini 3.x.&lt;/p&gt;

&lt;p&gt;Después, el precio es de $14 por cada 1.000 solicitudes. La cuota es mensual y compartida: las solicitudes contextualizadas de Gemini 3 Pro y Gemini 3.8 Flash consumen el mismo grupo de 5.000.&lt;/p&gt;

&lt;p&gt;Es una asignación útil para prototipos con datos recientes, pero una función de producción necesita presupuesto propio.&lt;/p&gt;

&lt;h2&gt;
  
  
  Cuando se agota lo gratuito: opciones de pago
&lt;/h2&gt;

&lt;p&gt;Un error &lt;code&gt;429&lt;/code&gt; durante una demostración o alcanzar el límite diario indica que necesitas más capacidad. Estas son las opciones, de menor a mayor costo:&lt;/p&gt;

&lt;h3&gt;
  
  
  1. Vincula la facturación para obtener el Nivel 1
&lt;/h3&gt;

&lt;p&gt;Al vincular la facturación al proyecto en AI Studio:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Aumentan los límites de tasa.&lt;/li&gt;
&lt;li&gt;Se establece un tope de gasto de $250.&lt;/li&gt;
&lt;li&gt;No necesitas gastar dinero para desbloquear el Nivel 1.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;El Nivel 2 se habilita después de gastar $100 y esperar tres días, con un tope de $2.000. El Nivel 3 requiere $1.000 de gasto y 30 días.&lt;/p&gt;

&lt;h3&gt;
  
  
  2. Usa las tarifas de introducción
&lt;/h3&gt;

&lt;p&gt;Hasta el 31 de diciembre de 2026, Gemini 3.8 Flash cuesta:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;$0,75 por millón de tokens de entrada.&lt;/li&gt;
&lt;li&gt;$3,75 por millón de tokens de salida.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Los tokens de pensamiento se facturan como salida. Desde el 1 de enero de 2027, las tarifas se duplican a $1,50 y $7,50.&lt;/p&gt;

&lt;p&gt;1.000 solicitudes con 2.000 tokens de entrada y 500 de salida cada una cuestan aproximadamente $3,38 con las tarifas de introducción. El &lt;a href="https://apidog.com/es/blog/gemini-3-8-flash-pricing?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;desglose de precios de Gemini 3.8 Flash&lt;/a&gt; explica el cálculo por tarea y por qué un precio menor por token no siempre significa una tarea más barata.&lt;/p&gt;

&lt;h3&gt;
  
  
  3. Procesa por lotes lo que pueda esperar
&lt;/h3&gt;

&lt;p&gt;La API por lotes reduce a la mitad las tarifas:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;$0,375 por millón de tokens de entrada.&lt;/li&gt;
&lt;li&gt;$1,875 por millón de tokens de salida.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Las mismas 1.000 solicitudes cuestan aproximadamente $1,69. Las cuentas de Nivel 1 pueden mantener hasta 3 millones de tokens en cola.&lt;/p&gt;

&lt;p&gt;Las evaluaciones, cargas históricas (&lt;em&gt;backfills&lt;/em&gt;) y trabajos nocturnos son buenos candidatos. Consulta la &lt;a href="https://apidog.com/es/blog/gemini-api-batch-mode?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía del modo por lotes de Gemini&lt;/a&gt;.&lt;/p&gt;

&lt;h3&gt;
  
  
  4. Almacena en caché el prefijo estable
&lt;/h3&gt;

&lt;p&gt;El almacenamiento en caché de contexto cuesta $0,075 por millón de tokens en caché con la tarifa de introducción: una décima parte del costo de enviar entrada nueva.&lt;/p&gt;

&lt;p&gt;Empieza por un prompt de sistema largo o un documento que reenvías en cada turno.&lt;/p&gt;

&lt;h2&gt;
  
  
  Lo que no obtendrás gratis
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;La aplicación Gemini:&lt;/strong&gt; requiere Google AI Pro o Ultra.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Privacidad:&lt;/strong&gt; los datos del nivel gratuito se utilizan para mejorar los productos de Google y no hay un interruptor para desactivarlo.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Margen de capacidad:&lt;/strong&gt; los límites están publicados en la página de límites de tasa y no son generosos. El nivel gratuito sirve para evaluación y herramientas pequeñas, no para un lanzamiento.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Gemini 3.8 Flash Cyber:&lt;/strong&gt; está restringido al Programa Fairwind para gobiernos, operadores de infraestructura y mantenedores de software. No tiene API pública, precio público ni opción de autoalojamiento.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;API en vivo, generación de imágenes y generación de audio:&lt;/strong&gt; 3.8 Flash no admite estas funciones en ningún nivel. Acepta texto, imagen, vídeo, audio y PDF como entrada, pero solo genera texto.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Un nivel ilimitado:&lt;/strong&gt; los sitios que prometen acceso ilimitado probablemente usan la clave de otra persona o sirven un modelo diferente. Consulta la &lt;a href="https://apidog.com/es/blog/get-free-unlimited-gemini-api?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía para detectar acceso gratuito e ilimitado falso a la API de Gemini&lt;/a&gt;. La estrategia de nivel gratuito utilizada con &lt;a href="https://apidog.com/es/blog/how-to-use-gemini-3-6-flash-for-free?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Gemini 3.6 Flash&lt;/a&gt; también aplica aquí.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Haz que la cuota gratuita rinda más con Apidog
&lt;/h2&gt;

&lt;p&gt;La cuota gratuita recompensa una configuración disciplinada. Cada solicitud reescrita manualmente, cada &lt;code&gt;429&lt;/code&gt; accidental y cada ejecución innecesaria con pensamiento &lt;code&gt;high&lt;/code&gt; consume cuota que no recuperarás.&lt;/p&gt;

&lt;p&gt;En &lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt;:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Guarda &lt;code&gt;GEMINI_API_KEY&lt;/code&gt; como variable de entorno para que nunca aparezca en el cuerpo de la solicitud ni en una colección compartida.&lt;/li&gt;
&lt;li&gt;Guarda la solicitud de Interactions y la solicitud heredada &lt;code&gt;generateContent&lt;/code&gt; con nombres.&lt;/li&gt;
&lt;li&gt;Define como variables el prompt, el modelo y &lt;code&gt;thinking_level&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Cambia el nivel de pensamiento modificando una variable, no el JSON.&lt;/li&gt;
&lt;li&gt;Añade una aserción sobre el código de estado para que un &lt;code&gt;429&lt;/code&gt; aparezca como prueba fallida.&lt;/li&gt;
&lt;li&gt;En el endpoint heredado, comprueba &lt;code&gt;usageMetadata.thoughtsTokenCount&lt;/code&gt; para saber cuánta cuota consumió el razonamiento.&lt;/li&gt;
&lt;li&gt;Programa una prueba de humo diaria con nivel &lt;code&gt;low&lt;/code&gt;.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Puedes &lt;a href="https://apidog.com/download?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;descargar Apidog&lt;/a&gt; y consultar cómo &lt;a href="https://apidog.com/es/blog/how-to-schedule-api-tests-apidog?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;programar pruebas de API en Apidog&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Preguntas frecuentes
&lt;/h2&gt;

&lt;h3&gt;
  
  
  ¿Gemini 3.8 Flash es gratuito?
&lt;/h3&gt;

&lt;p&gt;Sí, mediante Google AI Studio y el nivel gratuito de la API de Gemini, con límites de tasa y uso de tus datos para mejorar los productos de Google. Es el mismo modelo &lt;code&gt;gemini-3.8-flash&lt;/code&gt; disponible en los niveles de pago.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Puedo usar Gemini 3.8 Flash gratis en la aplicación Gemini?
&lt;/h3&gt;

&lt;p&gt;No. La aplicación ofrece 3.8 Flash a suscriptores de Google AI Pro y Ultra. El Modo IA en la Búsqueda de Google y Gemini en Hojas de cálculo son las superficies de consumo disponibles sin suscripción.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Cuáles son los límites de tasa?
&lt;/h3&gt;

&lt;p&gt;Google los publica por modelo en la página de límites de tasa de AI Studio, no necesariamente en la documentación, y pueden cambiar. Consulta la página para tu proyecto. Si necesitas más capacidad, vincular la facturación te mueve al Nivel 1 sin necesidad de gastar.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿El nivel gratuito incluye el pensamiento?
&lt;/h3&gt;

&lt;p&gt;Sí. &lt;code&gt;low&lt;/code&gt;, &lt;code&gt;medium&lt;/code&gt; y &lt;code&gt;high&lt;/code&gt; funcionan en el nivel gratuito; &lt;code&gt;medium&lt;/code&gt; es el predeterminado. &lt;code&gt;minimal&lt;/code&gt; devuelve un error en 3.8 Flash. Como los tokens de pensamiento cuentan para la cuota, &lt;code&gt;low&lt;/code&gt; suele ser la mejor opción para empezar.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Gemini 3.8 Flash Cyber es gratuito?
&lt;/h3&gt;

&lt;p&gt;No está disponible fuera del Programa Fairwind. Los desarrolladores habituales pueden usar 3.8 Flash y ejecutar sus propias pruebas de seguridad de API contra él.&lt;/p&gt;

&lt;h2&gt;
  
  
  Empieza gratis y decide después
&lt;/h2&gt;

&lt;p&gt;El nivel gratuito es un entorno de evaluación real para Gemini 3.8 Flash. Crea una clave, usa &lt;code&gt;low&lt;/code&gt; al principio, mantén los datos sensibles fuera del nivel gratuito y consulta los límites actuales en lugar de adivinarlos.&lt;/p&gt;

&lt;p&gt;Cuando los errores &lt;code&gt;429&lt;/code&gt; empiecen a costarte tiempo, vincula la facturación para obtener el Nivel 1 y usa procesamiento por lotes para los trabajos asíncronos. Hasta diciembre, $0,375 por millón de tokens de entrada puede costar menos que el café que tomaste esperando a que se restableciera la cuota.&lt;/p&gt;

</description>
    </item>
    <item>
      <title>Cómo usar la API Gemini Omni 1.1 Flash</title>
      <dc:creator>Roobia</dc:creator>
      <pubDate>Thu, 03 Sep 2026 05:15:33 +0000</pubDate>
      <link>https://dev.to/roobia/como-usar-la-api-gemini-omni-11-flash-54eh</link>
      <guid>https://dev.to/roobia/como-usar-la-api-gemini-omni-11-flash-54eh</guid>
      <description>&lt;p&gt;Llamas a Gemini Omni 1.1 Flash con el ID de modelo &lt;code&gt;gemini-omni-1.1-flash&lt;/code&gt; mediante la API de Interacciones de Google, no mediante el endpoint &lt;code&gt;generateContent&lt;/code&gt; de los modelos de texto. Si copias una solicitud de texto de Gemini y solo cambias el nombre del modelo, obtendrás un error 404.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation" class="crayons-btn crayons-btn--primary"&gt;Prueba Apidog hoy&lt;/a&gt;
&lt;/p&gt;

&lt;p&gt;Esta guía te lleva desde una terminal vacía hasta una solicitud probada de generación de video: crearás una clave, harás llamadas con curl y Python, revisarás los parámetros disponibles, gestionarás respuestas grandes y guardarás todo como una prueba repetible.&lt;/p&gt;

&lt;p&gt;El modelo alcanzó la disponibilidad general (GA) el 27 de agosto de 2026. Consulta las &lt;a href="https://apidog.com/es/blog/gemini-omni-1-1-flash?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;novedades de Gemini Omni 1.1 Flash&lt;/a&gt; para conocer lo que se lanzó con él.&lt;/p&gt;

&lt;h2&gt;
  
  
  Requisitos
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;Una cuenta de Google para iniciar sesión en AI Studio.&lt;/li&gt;
&lt;li&gt;Una clave de API de Gemini de &lt;a href="https://aistudio.google.com" rel="noopener noreferrer"&gt;Google AI Studio&lt;/a&gt;.&lt;/li&gt;
&lt;li&gt;Facturación habilitada. Omni no tiene nivel gratuito, a diferencia de la &lt;a href="https://apidog.com/es/blog/how-to-use-gemini-for-free?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;opción gratuita para los modelos de texto&lt;/a&gt;. La primera solicitud tiene coste.&lt;/li&gt;
&lt;li&gt;Una herramienta para enviar solicitudes HTTP: curl, el SDK de Python o un cliente de API.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Guarda la clave en una variable de entorno, no en el código fuente:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;&lt;span class="nb"&gt;export &lt;/span&gt;&lt;span class="nv"&gt;GEMINI_API_KEY&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="s2"&gt;"your_key_here"&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Los SDK oficiales leen esta variable automáticamente y mantienen el secreto fuera del repositorio.&lt;/p&gt;

&lt;h2&gt;
  
  
  Primera solicitud de generación de video
&lt;/h2&gt;

&lt;p&gt;El endpoint es &lt;code&gt;POST /v1beta/interactions&lt;/code&gt;:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;curl &lt;span class="nt"&gt;-X&lt;/span&gt; POST &lt;span class="s2"&gt;"https://generativelanguage.googleapis.com/v1beta/interactions?key=&lt;/span&gt;&lt;span class="nv"&gt;$GEMINI_API_KEY&lt;/span&gt;&lt;span class="s2"&gt;"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;-H&lt;/span&gt; &lt;span class="s2"&gt;"Content-Type: application/json"&lt;/span&gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;-d&lt;/span&gt; &lt;span class="s1"&gt;'{
    "model": "gemini-omni-1.1-flash",
    "input": "A marble rolling fast on a chain reaction style track, continuous smooth shot."
  }'&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;La solicitud mínima solo necesita &lt;code&gt;model&lt;/code&gt; e &lt;code&gt;input&lt;/code&gt;. La respuesta incluye el video generado como base64 en &lt;code&gt;output_video.data&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;Instala el SDK de Python con &lt;code&gt;pip install google-genai&lt;/code&gt;:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight python"&gt;&lt;code&gt;&lt;span class="kn"&gt;import&lt;/span&gt; &lt;span class="n"&gt;base64&lt;/span&gt;
&lt;span class="kn"&gt;from&lt;/span&gt; &lt;span class="n"&gt;google&lt;/span&gt; &lt;span class="kn"&gt;import&lt;/span&gt; &lt;span class="n"&gt;genai&lt;/span&gt;

&lt;span class="n"&gt;client&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;genai&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nc"&gt;Client&lt;/span&gt;&lt;span class="p"&gt;()&lt;/span&gt;  &lt;span class="c1"&gt;# reads GEMINI_API_KEY from the environment
&lt;/span&gt;
&lt;span class="n"&gt;interaction&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;interactions&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;create&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
    &lt;span class="n"&gt;model&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;gemini-omni-1.1-flash&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="nb"&gt;input&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;A marble rolling fast on a chain reaction style track, continuous smooth shot.&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
&lt;span class="p"&gt;)&lt;/span&gt;

&lt;span class="k"&gt;with&lt;/span&gt; &lt;span class="nf"&gt;open&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;marble.mp4&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;wb&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt; &lt;span class="k"&gt;as&lt;/span&gt; &lt;span class="n"&gt;f&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;
    &lt;span class="n"&gt;f&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;write&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="n"&gt;base64&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;b64decode&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="n"&gt;interaction&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;output_video&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;data&lt;/span&gt;&lt;span class="p"&gt;))&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;En JavaScript, usa &lt;code&gt;@google/genai&lt;/code&gt;:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight javascript"&gt;&lt;code&gt;&lt;span class="k"&gt;import&lt;/span&gt; &lt;span class="p"&gt;{&lt;/span&gt; &lt;span class="nx"&gt;GoogleGenAI&lt;/span&gt; &lt;span class="p"&gt;}&lt;/span&gt; &lt;span class="k"&gt;from&lt;/span&gt; &lt;span class="dl"&gt;'&lt;/span&gt;&lt;span class="s1"&gt;@google/genai&lt;/span&gt;&lt;span class="dl"&gt;'&lt;/span&gt;&lt;span class="p"&gt;;&lt;/span&gt;
&lt;span class="k"&gt;import&lt;/span&gt; &lt;span class="o"&gt;*&lt;/span&gt; &lt;span class="k"&gt;as&lt;/span&gt; &lt;span class="nx"&gt;fs&lt;/span&gt; &lt;span class="k"&gt;from&lt;/span&gt; &lt;span class="dl"&gt;'&lt;/span&gt;&lt;span class="s1"&gt;fs&lt;/span&gt;&lt;span class="dl"&gt;'&lt;/span&gt;&lt;span class="p"&gt;;&lt;/span&gt;

&lt;span class="kd"&gt;const&lt;/span&gt; &lt;span class="nx"&gt;ai&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="k"&gt;new&lt;/span&gt; &lt;span class="nc"&gt;GoogleGenAI&lt;/span&gt;&lt;span class="p"&gt;({});&lt;/span&gt;

&lt;span class="kd"&gt;const&lt;/span&gt; &lt;span class="nx"&gt;interaction&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="k"&gt;await&lt;/span&gt; &lt;span class="nx"&gt;ai&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;interactions&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;create&lt;/span&gt;&lt;span class="p"&gt;({&lt;/span&gt;
  &lt;span class="na"&gt;model&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="dl"&gt;'&lt;/span&gt;&lt;span class="s1"&gt;gemini-omni-1.1-flash&lt;/span&gt;&lt;span class="dl"&gt;'&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
  &lt;span class="na"&gt;input&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="dl"&gt;'&lt;/span&gt;&lt;span class="s1"&gt;A marble rolling fast on a chain reaction style track, continuous smooth shot.&lt;/span&gt;&lt;span class="dl"&gt;'&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
&lt;span class="p"&gt;});&lt;/span&gt;

&lt;span class="k"&gt;if &lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="nx"&gt;interaction&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;output_video&lt;/span&gt;&lt;span class="p"&gt;?.&lt;/span&gt;&lt;span class="nx"&gt;data&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt; &lt;span class="p"&gt;{&lt;/span&gt;
  &lt;span class="nx"&gt;fs&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;writeFileSync&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="dl"&gt;'&lt;/span&gt;&lt;span class="s1"&gt;marble.mp4&lt;/span&gt;&lt;span class="dl"&gt;'&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="nx"&gt;Buffer&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="k"&gt;from&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="nx"&gt;interaction&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;output_video&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;data&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="dl"&gt;'&lt;/span&gt;&lt;span class="s1"&gt;base64&lt;/span&gt;&lt;span class="dl"&gt;'&lt;/span&gt;&lt;span class="p"&gt;));&lt;/span&gt;
&lt;span class="p"&gt;}&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;La generación puede tardar varios minutos. La latencia depende de la duración, la resolución y la carga de la API, así que configura un tiempo de espera generoso.&lt;/p&gt;

&lt;h2&gt;
  
  
  Controlar resolución y relación de aspecto
&lt;/h2&gt;

&lt;p&gt;Configura el formato de salida mediante &lt;code&gt;response_format&lt;/code&gt;:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight python"&gt;&lt;code&gt;&lt;span class="n"&gt;interaction&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;interactions&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;create&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
    &lt;span class="n"&gt;model&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;gemini-omni-1.1-flash&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="nb"&gt;input&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;A drone shot of a mountain landscape at sunrise.&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="n"&gt;response_format&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;
        &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;type&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;video&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
        &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;aspect_ratio&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;16:9&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
        &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;resolution&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;1080p&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="p"&gt;},&lt;/span&gt;
&lt;span class="p"&gt;)&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Campo&lt;/th&gt;
&lt;th&gt;Valores&lt;/th&gt;
&lt;th&gt;Predeterminado&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;&lt;code&gt;type&lt;/code&gt;&lt;/td&gt;
&lt;td&gt;&lt;code&gt;video&lt;/code&gt;&lt;/td&gt;
&lt;td&gt;&lt;code&gt;video&lt;/code&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;&lt;code&gt;aspect_ratio&lt;/code&gt;&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;16:9&lt;/code&gt;, &lt;code&gt;9:16&lt;/code&gt;
&lt;/td&gt;
&lt;td&gt;&lt;code&gt;16:9&lt;/code&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;&lt;code&gt;resolution&lt;/code&gt;&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;360p&lt;/code&gt;, &lt;code&gt;720p&lt;/code&gt;, &lt;code&gt;1080p&lt;/code&gt;, &lt;code&gt;4k&lt;/code&gt;
&lt;/td&gt;
&lt;td&gt;&lt;code&gt;720p&lt;/code&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;&lt;code&gt;delivery&lt;/code&gt;&lt;/td&gt;
&lt;td&gt;base64 en línea, &lt;code&gt;uri&lt;/code&gt;
&lt;/td&gt;
&lt;td&gt;en línea&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;Usa &lt;code&gt;360p&lt;/code&gt; para los borradores: puede generar resultados hasta un 60 % más rápido que &lt;code&gt;720p&lt;/code&gt; y cuesta un tercio. Después, vuelve a renderizar el prompt elegido con mayor resolución. &lt;code&gt;1080p&lt;/code&gt; y &lt;code&gt;4k&lt;/code&gt; son escalados de los fotogramas generados, no resoluciones nativas. Consulta el &lt;a href="https://apidog.com/es/blog/gemini-omni-1-1-flash-pricing?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;desglose de precios&lt;/a&gt; para conocer el coste por segundo.&lt;/p&gt;

&lt;h2&gt;
  
  
  Parámetros no compatibles
&lt;/h2&gt;

&lt;p&gt;Para evitar errores de implementación, Omni no admite:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Instrucciones del sistema&lt;/li&gt;
&lt;li&gt;&lt;code&gt;temperature&lt;/code&gt;&lt;/li&gt;
&lt;li&gt;&lt;code&gt;top_p&lt;/code&gt;&lt;/li&gt;
&lt;li&gt;Secuencias de parada&lt;/li&gt;
&lt;li&gt;Un campo de prompt negativo&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Si necesitas excluir algo de una toma, incluye la instrucción directamente en el prompt. La documentación usa este enfoque: “usando el dibujo solo como guía para el movimiento, no muestres el dibujo en el video final”.&lt;/p&gt;

&lt;h2&gt;
  
  
  Imágenes, fotogramas clave y referencias
&lt;/h2&gt;

&lt;p&gt;Pasa una lista en &lt;code&gt;input&lt;/code&gt; cuando incluyas medios. Para convertir una imagen en video:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight python"&gt;&lt;code&gt;&lt;span class="n"&gt;interaction&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;interactions&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;create&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
    &lt;span class="n"&gt;model&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;gemini-omni-1.1-flash&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="nb"&gt;input&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="p"&gt;[&lt;/span&gt;
        &lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;type&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;image&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;data&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="n"&gt;base64_image&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;mime_type&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;image/jpeg&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;},&lt;/span&gt;
        &lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;type&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;text&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;text&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;turn this into realistic footage, using the drawing only as a guide for movement, do not show the drawing in the final video&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;},&lt;/span&gt;
    &lt;span class="p"&gt;],&lt;/span&gt;
&lt;span class="p"&gt;)&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Si envías dos imágenes, la primera se usa como fotograma inicial y la segunda como fotograma final. El modelo genera el movimiento entre ambas:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight python"&gt;&lt;code&gt;&lt;span class="n"&gt;interaction&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;interactions&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;create&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
    &lt;span class="n"&gt;model&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;gemini-omni-1.1-flash&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="nb"&gt;input&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="p"&gt;[&lt;/span&gt;
        &lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;type&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;image&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;data&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="n"&gt;first_frame_b64&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;mime_type&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;image/jpeg&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;},&lt;/span&gt;
        &lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;type&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;image&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;data&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="n"&gt;last_frame_b64&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;mime_type&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;image/jpeg&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;},&lt;/span&gt;
        &lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;type&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;text&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;text&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;A smooth cinematic transition from a lush green forest at sunrise to a snowy forest under a starry night sky.&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;},&lt;/span&gt;
    &lt;span class="p"&gt;],&lt;/span&gt;
&lt;span class="p"&gt;)&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Las referencias de video funcionan de forma similar mediante la API de Archivos, con un límite de tres clips de tres segundos cada uno. El audio se ignora; el modelo usa los clips para interpretar el movimiento y la apariencia.&lt;/p&gt;

&lt;h2&gt;
  
  
  Edición conversacional de varios turnos
&lt;/h2&gt;

&lt;p&gt;Omni permite generar un video y editarlo usando el ID de la interacción anterior:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight python"&gt;&lt;code&gt;&lt;span class="n"&gt;res1&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;interactions&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;create&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
    &lt;span class="n"&gt;model&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;gemini-omni-1.1-flash&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="nb"&gt;input&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;A woman playing violin outdoors.&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
&lt;span class="p"&gt;)&lt;/span&gt;

&lt;span class="n"&gt;res2&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;interactions&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;create&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
    &lt;span class="n"&gt;model&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;gemini-omni-1.1-flash&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="n"&gt;previous_interaction_id&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="n"&gt;res1&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nb"&gt;id&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="nb"&gt;input&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;Make the violin invisible.&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
&lt;span class="p"&gt;)&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;No necesitas volver a subir el video ni describir de nuevo la escena. El mismo mecanismo permite extender escenas; consulta la &lt;a href="https://apidog.com/es/blog/gemini-omni-scene-extension-40-seconds?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía para extender videos hasta 40 segundos&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Gestionar videos de más de 4 MB
&lt;/h2&gt;

&lt;p&gt;Los videos de más de 4 MB se devuelven como una URI, no como base64 en línea. Además, el archivo debe terminar de procesarse antes de descargarse. Este es un error habitual con &lt;code&gt;1080p&lt;/code&gt;: el código busca &lt;code&gt;output_video.data&lt;/code&gt;, no encuentra datos y registra un fallo silencioso.&lt;/p&gt;

&lt;p&gt;Solicita explícitamente la entrega mediante URI y sondea el estado:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight python"&gt;&lt;code&gt;&lt;span class="kn"&gt;import&lt;/span&gt; &lt;span class="n"&gt;time&lt;/span&gt;
&lt;span class="kn"&gt;from&lt;/span&gt; &lt;span class="n"&gt;google&lt;/span&gt; &lt;span class="kn"&gt;import&lt;/span&gt; &lt;span class="n"&gt;genai&lt;/span&gt;

&lt;span class="n"&gt;client&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;genai&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nc"&gt;Client&lt;/span&gt;&lt;span class="p"&gt;()&lt;/span&gt;

&lt;span class="n"&gt;interaction&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;interactions&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;create&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
    &lt;span class="n"&gt;model&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;gemini-omni-1.1-flash&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="nb"&gt;input&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;A beautiful sunset.&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="n"&gt;response_format&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;type&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;video&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;delivery&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;uri&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;},&lt;/span&gt;
&lt;span class="p"&gt;)&lt;/span&gt;

&lt;span class="n"&gt;video_output&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;interaction&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;output_video&lt;/span&gt;
&lt;span class="n"&gt;file_name&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;video_output&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;uri&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;split&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;/&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;)[&lt;/span&gt;&lt;span class="o"&gt;-&lt;/span&gt;&lt;span class="mi"&gt;1&lt;/span&gt;&lt;span class="p"&gt;]&lt;/span&gt;

&lt;span class="k"&gt;while&lt;/span&gt; &lt;span class="bp"&gt;True&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;
    &lt;span class="n"&gt;f_info&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;files&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;get&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="n"&gt;name&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sa"&gt;f&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;files/&lt;/span&gt;&lt;span class="si"&gt;{&lt;/span&gt;&lt;span class="n"&gt;file_name&lt;/span&gt;&lt;span class="si"&gt;}&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt;
    &lt;span class="k"&gt;if&lt;/span&gt; &lt;span class="n"&gt;f_info&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;state&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;name&lt;/span&gt; &lt;span class="o"&gt;==&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;ACTIVE&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;
        &lt;span class="k"&gt;break&lt;/span&gt;
    &lt;span class="k"&gt;if&lt;/span&gt; &lt;span class="n"&gt;f_info&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;state&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;name&lt;/span&gt; &lt;span class="o"&gt;==&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;FAILED&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;
        &lt;span class="k"&gt;raise&lt;/span&gt; &lt;span class="nc"&gt;RuntimeError&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;Generation failed.&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt;
    &lt;span class="n"&gt;time&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;sleep&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="mi"&gt;5&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt;

&lt;span class="n"&gt;video_bytes&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;files&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;download&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="nb"&gt;file&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="n"&gt;video_output&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;uri&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt;
&lt;span class="k"&gt;with&lt;/span&gt; &lt;span class="nf"&gt;open&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;output.mp4&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;wb&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt; &lt;span class="k"&gt;as&lt;/span&gt; &lt;span class="n"&gt;f&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;
    &lt;span class="n"&gt;f&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;write&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="n"&gt;video_bytes&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Diseña el manejador para aceptar desde el principio las dos formas de respuesta: &lt;code&gt;output_video.data&lt;/code&gt; y &lt;code&gt;output_video.uri&lt;/code&gt;. La resolución determina cuál recibirás.&lt;/p&gt;

&lt;h2&gt;
  
  
  Probar la solicitud en Apidog
&lt;/h2&gt;

&lt;p&gt;Una vez que la llamada funciona, necesitas controlar un endpoint costoso, lento y no determinista. El historial de la shell no basta para detectar cambios de comportamiento.&lt;/p&gt;

&lt;p&gt;Configúralo una vez en &lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt;:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Crea un proyecto y un entorno. Define &lt;code&gt;GEMINI_API_KEY&lt;/code&gt; y &lt;code&gt;MODEL_ID&lt;/code&gt; como variables de entorno para que la clave no se almacene en la solicitud.&lt;/li&gt;
&lt;li&gt;Añade una solicitud &lt;code&gt;POST&lt;/code&gt; a &lt;code&gt;https://generativelanguage.googleapis.com/v1beta/interactions&lt;/code&gt;, con un cuerpo JSON que incluya &lt;code&gt;model&lt;/code&gt; e &lt;code&gt;input&lt;/code&gt;. Usa &lt;code&gt;{{MODEL_ID}}&lt;/code&gt; para referenciar la variable.&lt;/li&gt;
&lt;li&gt;Aumenta el tiempo de espera. La generación de video tarda mucho más que una finalización de texto.&lt;/li&gt;
&lt;li&gt;Añade aserciones para comprobar el código de estado, la existencia de &lt;code&gt;output_video&lt;/code&gt; y la forma de respuesta esperada para la resolución elegida.&lt;/li&gt;
&lt;li&gt;Duplica la solicitud para cada flujo: texto a video, imagen a video y extensión. Cuando aparezca Omni 1.2, podrás ejecutar las tres y detectar rápidamente qué cambió.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Apidog no genera videos ni es un framework de IA. Sirve para construir solicitudes, ejecutarlas y validar las respuestas con un estándar definido. &lt;a href="https://apidog.com/download?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Descarga Apidog&lt;/a&gt; para establecer esta estructura antes de aumentar el gasto.&lt;/p&gt;

&lt;h2&gt;
  
  
  Errores comunes y soluciones
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;404 en el endpoint:&lt;/strong&gt; estás usando &lt;code&gt;/v1beta/models/gemini-omni-1.1-flash:generateContent&lt;/code&gt;. Omni requiere &lt;code&gt;/v1beta/interactions&lt;/code&gt;, con el modelo en el cuerpo.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;&lt;code&gt;output_video.data&lt;/code&gt; está vacío:&lt;/strong&gt; la respuesta usa una URI porque el video supera los 4 MB. Lee &lt;code&gt;output_video.uri&lt;/code&gt; y descárgalo mediante la API de Archivos.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Modelo no encontrado:&lt;/strong&gt; revisa si tu configuración todavía usa &lt;code&gt;gemini-omni-flash-preview&lt;/code&gt;. Ese endpoint se retirará el 30 de septiembre de 2026.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Falla la edición de un video subido:&lt;/strong&gt; esta función no está disponible en el EEE, Suiza ni el Reino Unido. Los videos generados por el modelo sí funcionan en esas regiones.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Se rechaza una extensión:&lt;/strong&gt; los videos de entrada tienen un límite de 10 segundos; la extensión solo añade contenido al final y no permite añadir diálogos a una subida.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Preguntas frecuentes
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;¿Qué endpoint usa Gemini Omni?&lt;/strong&gt; &lt;code&gt;POST https://generativelanguage.googleapis.com/v1beta/interactions&lt;/code&gt;, con &lt;code&gt;gemini-omni-1.1-flash&lt;/code&gt; en el cuerpo.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;¿Existe un nivel gratuito para la API de Gemini Omni?&lt;/strong&gt; No. Cada generación se factura. Los modelos de texto sí tienen una opción gratuita en AI Studio.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;¿Puedo establecer la temperatura o un prompt negativo?&lt;/strong&gt; No. Las instrucciones del sistema, &lt;code&gt;temperature&lt;/code&gt;, &lt;code&gt;top_p&lt;/code&gt;, las secuencias de parada y los prompts negativos no son compatibles. Incluye las exclusiones en el prompt.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;¿Cómo genero un video vertical?&lt;/strong&gt; Establece &lt;code&gt;aspect_ratio&lt;/code&gt; en &lt;code&gt;9:16&lt;/code&gt; dentro de &lt;code&gt;response_format&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;¿Los videos generados tienen marca de agua?&lt;/strong&gt; Sí. Toda la salida incluye &lt;a href="https://deepmind.google/technologies/synthid/" rel="noopener noreferrer"&gt;SynthID&lt;/a&gt;, invisible para los espectadores y detectable mediante programación.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;¿Cómo se compara con la API de Veo?&lt;/strong&gt; Usa otro endpoint, tiene otro precio y ofrece fortalezas diferentes. La comparación &lt;a href="https://apidog.com/es/blog/gemini-omni-1-1-flash-vs-veo-3-1?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Omni 1.1 Flash frente a Veo 3.1&lt;/a&gt; explica las diferencias, y la &lt;a href="https://apidog.com/es/blog/veo-3-1-api?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de la API de Veo 3.1&lt;/a&gt; cubre esa integración.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;La integración se reduce a dos campos obligatorios y un manejador capaz de procesar ambas formas de entrega. Empieza con una llamada a &lt;code&gt;360p&lt;/code&gt;, guárdala con aserciones y aumenta la resolución cuando la infraestructura sea estable. Consulta la &lt;a href="https://ai.google.dev/gemini-api/docs/omni" rel="noopener noreferrer"&gt;documentación oficial de Omni&lt;/a&gt; para seguir la evolución de los parámetros.&lt;/p&gt;

</description>
    </item>
    <item>
      <title>Claude Fable 5.1 Pensamiento Conservado: Cómo solucionar el error El bloque está vinculado a una conversación diferente</title>
      <dc:creator>Roobia</dc:creator>
      <pubDate>Wed, 02 Sep 2026 04:42:20 +0000</pubDate>
      <link>https://dev.to/roobia/claude-fable-51-pensamiento-conservado-como-solucionar-el-error-el-bloque-esta-vinculado-a-una-4olk</link>
      <guid>https://dev.to/roobia/claude-fable-51-pensamiento-conservado-como-solucionar-el-error-el-bloque-esta-vinculado-a-una-4olk</guid>
      <description>&lt;h1&gt;
  
  
  Cómo corregir el error 400 de bloques de pensamiento en Claude Fable 5.1
&lt;/h1&gt;

&lt;p&gt;Si migraste un arnés de agente a Claude Fable 5.1 y ves un error 400 que indica que un bloque de pensamiento está «vinculado a una conversación diferente», tu código está modificando el historial entre solicitudes. Fable 5.1 es el primer modelo de Claude que rechaza este patrón. Esta guía explica la verificación, a quién afecta, qué la activa, cómo recuperarse y cómo diseñar historiales de solo agregar que mantengan también la caché de prompts caliente.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation" class="crayons-btn crayons-btn--primary"&gt;Prueba Apidog hoy&lt;/a&gt;
&lt;/p&gt;

&lt;p&gt;La verificación está documentada en &lt;a href="https://platform.claude.com/docs/en/build-with-claude/preserved-thinking" rel="noopener noreferrer"&gt;Pensamiento preservado&lt;/a&gt; y en &lt;a href="https://platform.claude.com/docs/en/models/fable-5-1/whats-new-fable-5-1" rel="noopener noreferrer"&gt;Novedades de Claude Fable 5.1&lt;/a&gt;. Es uno de los tres cambios principales de Fable 5.1 y el único que puede degradar silenciosamente un arnés. Para los otros cambios, consulta la &lt;a href="https://apidog.com/es/blog/claude-fable-5-1-migration?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de migración&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  El error
&lt;/h2&gt;



&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;messages.5.content.0: Invalid `signature` in `thinking` block. The block is bound to a different conversation. Remove the block, or set `thinking.block_binding.prefix_mismatch_behavior` to "drop_block". That setting requires the `thinking-binding-controls-2026-08-01` value in the `anthropic-beta` header.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Es un error &lt;code&gt;400 invalid_request_error&lt;/code&gt; que se produce antes de cualquier salida. Reintentar con el mismo cuerpo falla de la misma forma.&lt;/p&gt;

&lt;p&gt;La ruta &lt;code&gt;messages.5.content.0&lt;/code&gt; identifica el primer bloque de pensamiento que ya no coincide. El mensaje puede incluir también el primer mensaje que cambió; ese es el diagnóstico más útil. El endpoint de conteo de tokens ejecuta la misma verificación.&lt;/p&gt;

&lt;p&gt;Existe un error parecido, pero diferente: si aparece la misma cláusula inicial sin «vinculado a una conversación diferente», la firma está manipulada o no se puede interpretar. &lt;code&gt;prefix_mismatch_behavior&lt;/code&gt; no se aplica en ese caso.&lt;/p&gt;

&lt;h2&gt;
  
  
  Qué verifica la API
&lt;/h2&gt;

&lt;p&gt;Cada bloque de pensamiento de Fable 5.1 incluye una firma que registra:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;El modelo que produjo el bloque.&lt;/li&gt;
&lt;li&gt;El prefijo exacto de la conversación anterior al bloque: el prompt de sistema de nivel superior, el array &lt;code&gt;tools&lt;/code&gt; y todos los mensajes anteriores.&lt;/li&gt;
&lt;li&gt;La relación con el bloque de pensamiento previo.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Cuando envías de nuevo la transcripción, la API verifica que ese prefijo sea idéntico byte a byte al que existía cuando se generó el bloque.&lt;/p&gt;

&lt;p&gt;Anthropic cita dos motivos:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;
&lt;strong&gt;Antidestilación:&lt;/strong&gt; las cuentas nuevas de API ya no pueden editar manualmente el contexto previo de Claude en una conversación de varios turnos y conservar la transcripción del pensamiento anterior.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Caché de prompts:&lt;/strong&gt; las mismas modificaciones que rompen la verificación también reinician la caché. Un historial que pasa la verificación puede aprovechar lecturas de caché de &lt;code&gt;$0.25&lt;/code&gt; por millón de tokens en cada turno.&lt;/li&gt;
&lt;/ol&gt;

&lt;h2&gt;
  
  
  A quién aplica
&lt;/h2&gt;

&lt;h3&gt;
  
  
  Aplicación predeterminada
&lt;/h3&gt;

&lt;p&gt;Afecta a las cuentas creadas a partir del 31 de agosto de 2026, incluyendo:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Organizaciones de la API de Claude.&lt;/li&gt;
&lt;li&gt;Amazon Bedrock.&lt;/li&gt;
&lt;li&gt;Google Cloud.&lt;/li&gt;
&lt;li&gt;Microsoft Foundry.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  Registrado, pero no aplicado
&lt;/h3&gt;

&lt;p&gt;Las cuentas creadas antes de esa fecha registran la discrepancia, pero solo actúan sobre ella si la solicitud establece &lt;code&gt;thinking.block_binding.prefix_mismatch_behavior&lt;/code&gt;, incluso con el valor &lt;code&gt;"error"&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;Anthropic indica que los modelos futuros aplicarán la verificación a todas las cuentas.&lt;/p&gt;

&lt;h3&gt;
  
  
  No afectados
&lt;/h3&gt;

&lt;p&gt;No ejecutan esta verificación:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Claude Code.&lt;/li&gt;
&lt;li&gt;
&lt;a href="http://claude.ai" rel="noopener noreferrer"&gt;claude.ai&lt;/a&gt;.&lt;/li&gt;
&lt;li&gt;Agentes Administrados de Claude.&lt;/li&gt;
&lt;li&gt;El SDK de Agentes de Claude.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Estas superficies mantienen intacto el prefijo. Claude Mythos 5.1 tampoco ejecuta la verificación, aunque modificar el historial sigue reiniciando su caché.&lt;/p&gt;

&lt;h3&gt;
  
  
  Afectados
&lt;/h3&gt;

&lt;p&gt;El problema puede aparecer en cualquier código que construya manualmente el array &lt;code&gt;messages&lt;/code&gt;, por ejemplo:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Bucles de agentes personalizados.&lt;/li&gt;
&lt;li&gt;Backends de chat.&lt;/li&gt;
&lt;li&gt;Frameworks que envuelven la API de Mensajes.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Si distribuyes una herramienta que los usuarios ejecutan con sus propias claves de API, prueba con la verificación activada. Tu cuenta puede ser antigua y no aplicar todavía la regla, mientras que la cuenta de tus usuarios sí.&lt;/p&gt;

&lt;p&gt;Para comprobar si tu cuenta aplica la verificación, envía una solicitud que modifique el historial sin la cabecera beta. Si recibes un error 400 que menciona esa cabecera, la aplicación está activa.&lt;/p&gt;

&lt;h2&gt;
  
  
  Qué invalida los bloques de pensamiento
&lt;/h2&gt;

&lt;p&gt;Cualquiera de estas modificaciones puede invalidar los bloques posteriores:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Editar, reordenar o eliminar un turno anterior. Esto incluye eliminar resultados de herramientas, cortar turnos intermedios o aplicar compactación del lado del cliente conservando textualmente los turnos recientes detrás de un resumen.&lt;/li&gt;
&lt;li&gt;Inyectar contenido temporal, como un recordatorio por turno, una línea de estado o un contador de tokens restantes que cambia en cada solicitud.&lt;/li&gt;
&lt;li&gt;Reconstruir &lt;code&gt;system&lt;/code&gt; o &lt;code&gt;tools&lt;/code&gt; entre solicitudes, por ejemplo al actualizar la fecha actual o añadir una herramienta a mitad de la sesión.&lt;/li&gt;
&lt;li&gt;Usar una URL de imagen o documento que más tarde sirva bytes diferentes. La API vincula los bytes, no la cadena de URL. Una URL firmada rotativa para el mismo archivo sí es válida.&lt;/li&gt;
&lt;li&gt;Eliminar un bloque de pensamiento que no esté al inicio de la ejecución. Los bloques iniciales se pueden eliminar empezando por los más antiguos; no se puede eliminar un bloque intermedio.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Qué mantiene válidos los bloques
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;Historiales de solo agregar, incluidos los mensajes &lt;code&gt;role: "system"&lt;/code&gt; añadidos y los mensajes con ámbito de turno que se dejan en su posición.&lt;/li&gt;
&lt;li&gt;Eliminar una secuencia inicial de bloques de pensamiento, siempre desde los más antiguos.&lt;/li&gt;
&lt;li&gt;Cambiar parámetros fuera de &lt;code&gt;system&lt;/code&gt;, &lt;code&gt;tools&lt;/code&gt; y &lt;code&gt;messages&lt;/code&gt;, como &lt;code&gt;max_tokens&lt;/code&gt;, &lt;code&gt;output_config&lt;/code&gt;, &lt;code&gt;effort&lt;/code&gt;, &lt;code&gt;tool_choice&lt;/code&gt; o &lt;code&gt;metadata&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Añadir, mover o eliminar marcadores &lt;code&gt;cache_control&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Usar compactación y edición de contexto del lado del servidor, incluida la limpieza de bloques de pensamiento. La API compara la conversación tal como la envías, no la copia que el servidor edita. Después de una compactación, el prefijo verificado comienza en el bloque de compactación.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  La vía de escape: &lt;code&gt;drop_block&lt;/code&gt;
&lt;/h2&gt;

&lt;p&gt;Envía la cabecera beta y configura explícitamente el comportamiento:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight python"&gt;&lt;code&gt;&lt;span class="n"&gt;response&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;beta&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;messages&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;create&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
    &lt;span class="n"&gt;model&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;claude-fable-5-1&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="n"&gt;max_tokens&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="mi"&gt;16000&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="n"&gt;thinking&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;type&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;adaptive&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;block_binding&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;prefix_mismatch_behavior&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;drop_block&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;}},&lt;/span&gt;
    &lt;span class="n"&gt;betas&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="p"&gt;[&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;thinking-binding-controls-2026-08-01&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;],&lt;/span&gt;
    &lt;span class="n"&gt;messages&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="n"&gt;history&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
&lt;span class="p"&gt;)&lt;/span&gt;
&lt;span class="k"&gt;for&lt;/span&gt; &lt;span class="n"&gt;t&lt;/span&gt; &lt;span class="ow"&gt;in&lt;/span&gt; &lt;span class="n"&gt;response&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;input_transformations&lt;/span&gt; &lt;span class="ow"&gt;or&lt;/span&gt; &lt;span class="p"&gt;[]:&lt;/span&gt;
    &lt;span class="nf"&gt;print&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="n"&gt;t&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nb"&gt;type&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="n"&gt;t&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;path&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="n"&gt;t&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;reason&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Con &lt;code&gt;drop_block&lt;/code&gt;, la API elimina el primer bloque que no coincide y todos los bloques de pensamiento posteriores. Después continúa con la solicitud e informa cada eliminación en el array de nivel superior &lt;code&gt;input_transformations&lt;/code&gt;:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"input_transformations"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="p"&gt;[&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
      &lt;/span&gt;&lt;span class="nl"&gt;"type"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"thinking_dropped"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
      &lt;/span&gt;&lt;span class="nl"&gt;"path"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"messages.1.content.0"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
      &lt;/span&gt;&lt;span class="nl"&gt;"reason"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"prefix_binding_mismatch"&lt;/span&gt;&lt;span class="w"&gt;
    &lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="p"&gt;]&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Ten en cuenta lo siguiente:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Solo se aplica a esa solicitud. Sigue enviándolo durante el resto de la sesión.&lt;/li&gt;
&lt;li&gt;Los valores predeterminados dependen de la superficie. En una cuenta con aplicación activa, omitir la cabecera produce un error; enviar la cabecera puede activar &lt;code&gt;drop_block&lt;/code&gt; como valor predeterminado de la beta. Configúralo siempre de forma explícita.&lt;/li&gt;
&lt;li&gt;Enviar &lt;code&gt;block_binding&lt;/code&gt; sin la cabecera beta produce un error 400:
&lt;/li&gt;
&lt;/ul&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;block_binding: Extra inputs are not permitted
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;El campo &lt;code&gt;reason&lt;/code&gt; distingue dos casos:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;code&gt;prefix_binding_mismatch&lt;/code&gt;: cambió el historial.&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;model_binding_mismatch&lt;/code&gt;: la conversación cambió de modelo y el modelo de destino no puede leer un bloque producido por Fable 5.1. Esto puede ocurrir con un router, un reintento o una estrategia de reserva, y no necesariamente indica un error en tu código.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Con la cabecera beta, cada respuesta incluye &lt;code&gt;input_transformations&lt;/code&gt;, vacío cuando no se eliminó ningún bloque.&lt;/p&gt;

&lt;p&gt;Eliminar bloques una vez, por ejemplo durante una compactación, tiene un costo bajo. Un arnés que invalida su propio historial en cada solicitud pierde el razonamiento del modelo en cada turno y reinicia la caché de prompts. Usa &lt;code&gt;drop_block&lt;/code&gt; como diagnóstico y red de seguridad, no como solución permanente.&lt;/p&gt;

&lt;h2&gt;
  
  
  Recuperación sin la beta
&lt;/h2&gt;

&lt;p&gt;Si tu plataforma todavía no ofrece estos controles —Microsoft Foundry no los ofrecía en el lanzamiento; Bedrock y Google Cloud los estaban incorporando por modelo—:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Elimina todos los bloques &lt;code&gt;thinking&lt;/code&gt; y &lt;code&gt;redacted_thinking&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Conserva los bloques &lt;code&gt;text&lt;/code&gt; y &lt;code&gt;tool_use&lt;/code&gt; de cada turno.&lt;/li&gt;
&lt;li&gt;Reintenta una sola vez.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;El modelo responderá sin el razonamiento contenido en esos bloques. Es una recuperación puntual, no un patrón operativo.&lt;/p&gt;

&lt;h2&gt;
  
  
  Auditoría en tres pasos
&lt;/h2&gt;

&lt;p&gt;Ejecuta esta auditoría antes de cambiar el tráfico:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;
&lt;strong&gt;Captura solicitudes reales.&lt;/strong&gt; Registra los cuerpos exactos que envía el arnés durante varios turnos normales, incluyendo compactaciones o cambios de herramientas. Compara cada par de solicitudes consecutivas: &lt;code&gt;system&lt;/code&gt;, &lt;code&gt;tools&lt;/code&gt; y el prefijo compartido de &lt;code&gt;messages&lt;/code&gt; deben ser idénticos byte a byte hasta los turnos recién añadidos.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Activa &lt;code&gt;drop_block&lt;/code&gt; en una sesión de prueba.&lt;/strong&gt; Ejecuta una conversación de varios turnos contra &lt;code&gt;claude-fable-5-1&lt;/code&gt; con la cabecera beta y &lt;code&gt;prefix_mismatch_behavior: "drop_block"&lt;/code&gt;. Registra &lt;code&gt;input_transformations&lt;/code&gt; en cada respuesta:

&lt;ul&gt;
&lt;li&gt;Un array vacío indica que el historial está intacto.&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;prefix_binding_mismatch&lt;/code&gt; identifica una modificación anterior al bloque indicado en &lt;code&gt;path&lt;/code&gt;.&lt;/li&gt;
&lt;/ul&gt;
&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Establecer el campo activa la verificación de la solicitud incluso en cuentas antiguas. En CI, usa &lt;code&gt;"error"&lt;/code&gt; para que cualquier edición detenga la ejecución.&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;
&lt;strong&gt;Define el comportamiento de producción.&lt;/strong&gt; Bajo la cabecera beta, establece explícitamente:

&lt;ul&gt;
&lt;li&gt;
&lt;code&gt;"error"&lt;/code&gt; si una discrepancia siempre indica un error.&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;"drop_block"&lt;/code&gt; si prefieres degradar en lugar de fallar.&lt;/li&gt;
&lt;/ul&gt;
&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Monitorea tanto los errores 400 como las entradas de &lt;code&gt;input_transformations&lt;/code&gt;. No dejes el campo sin configurar en cuentas antiguas: la discrepancia solo se registrará en el servidor y no tendrás nada útil que monitorear.&lt;/p&gt;

&lt;p&gt;En &lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt;, el segundo paso puede probarse con dos solicitudes:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Envía un turno.&lt;/li&gt;
&lt;li&gt;Modifica el prompt de sistema.&lt;/li&gt;
&lt;li&gt;Envía el siguiente turno con la cabecera beta.&lt;/li&gt;
&lt;li&gt;Verifica &lt;code&gt;input_transformations&lt;/code&gt;.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Conserva la prueba en la colección para ejecutarla después de cada cambio del arnés. También puedes &lt;a href="https://apidog.com/download?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;descargar Apidog&lt;/a&gt; para construirla.&lt;/p&gt;

&lt;h2&gt;
  
  
  Diseña un arnés de solo agregar
&lt;/h2&gt;

&lt;p&gt;Reemplaza las ediciones del historial por operaciones que mantengan intacto el prefijo:&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Lo que hacías&lt;/th&gt;
&lt;th&gt;Haz esto&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Editar el prompt de sistema a mitad de sesión, por ejemplo para cambiar la fecha o el modo.&lt;/td&gt;
&lt;td&gt;Congela &lt;code&gt;system&lt;/code&gt; al inicio. Cuando el cambio sea efectivo, añade &lt;code&gt;{"role": "system", "content": "La fecha actual es 14-09-2026."}&lt;/code&gt;. El nuevo mensaje se convierte en parte del prefijo de los bloques posteriores.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Editar el array &lt;code&gt;tools&lt;/code&gt; a mitad de sesión.&lt;/td&gt;
&lt;td&gt;Declara el conjunto completo al inicio y usa &lt;code&gt;defer_loading: true&lt;/code&gt; para las herramientas que comienzan ocultas. Envía bloques &lt;code&gt;tool_addition&lt;/code&gt; y &lt;code&gt;tool_removal&lt;/code&gt; en un mensaje &lt;code&gt;role: "system"&lt;/code&gt; con la beta &lt;code&gt;mid-conversation-tool-changes-2026-07-01&lt;/code&gt;.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Inyectar un recordatorio por turno y eliminarlo en la siguiente solicitud.&lt;/td&gt;
&lt;td&gt;Usa &lt;code&gt;{"role": "system", "clear_at": "next_user_message", "content": "..."}&lt;/code&gt; con la beta &lt;code&gt;mid-conversation-system-clear-at-2026-08-21&lt;/code&gt;, después del resultado de la herramienta. Deja las copias anteriores en su lugar. Sin la beta, añade el recordatorio como un bloque de texto después de los bloques &lt;code&gt;tool_result&lt;/code&gt; del mismo mensaje de usuario y conserva las copias anteriores.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Eliminar resultados antiguos de herramientas en el cliente.&lt;/td&gt;
&lt;td&gt;Usa edición de contexto del lado del servidor con limpieza de resultados de herramientas.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Compactar el historial en el cliente conservando los turnos recientes.&lt;/td&gt;
&lt;td&gt;Prefiere la compactación del lado del servidor con la beta &lt;code&gt;compact-2026-01-12&lt;/code&gt;; su parámetro &lt;code&gt;instructions&lt;/code&gt; acepta tu propio prompt de resumen. Si debes compactar en el cliente, reemplaza todo el historial por un mensaje de resumen y el nuevo turno de usuario, sin repetir contenido.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Referenciar una imagen o documento mediante URL en varios turnos.&lt;/td&gt;
&lt;td&gt;Sube el archivo una vez a la API de Archivos y envía su &lt;code&gt;file_id&lt;/code&gt;, o utiliza base64.&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;Dos estrategias de compactación del lado del cliente fallan con esta verificación:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Compactación de cola:&lt;/strong&gt; resume los turnos antiguos y conserva textualmente los recientes. Los bloques retenidos se produjeron contra el historial completo.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Compactación en segundo plano:&lt;/strong&gt; inserta más tarde un resumen creado fuera de la ruta crítica. Los turnos generados entre el inicio del resumen y su inserción quedan invalidados.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Cortar turnos individuales del medio invalida todos los bloques posteriores. Para cambios de instrucciones, usa un mensaje de sistema a mitad de conversación; para eliminar contenido específico, usa edición de contexto del lado del servidor.&lt;/p&gt;

&lt;h2&gt;
  
  
  Por qué también es un problema de caché
&lt;/h2&gt;

&lt;p&gt;Todo lo que reinicia la verificación también reinicia la caché de prompts.&lt;/p&gt;

&lt;p&gt;Fable 5.1 hizo que las lecturas de caché fueran cuatro veces más baratas que en Fable 5, mientras que los fallos son proporcionalmente más costosos. Un arnés de solo agregar obtiene dos beneficios:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Conserva el razonamiento del modelo.&lt;/li&gt;
&lt;li&gt;Lee el prefijo en caché a &lt;code&gt;$0.25&lt;/code&gt; por millón, en lugar de volver a escribirlo a &lt;code&gt;$12.50&lt;/code&gt;.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Consulta el &lt;a href="https://apidog.com/es/blog/claude-fable-5-1-pricing?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;desglose de precios&lt;/a&gt;, el &lt;a href="https://apidog.com/es/blog/claude-fable-5-1-api?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;recorrido de la API&lt;/a&gt;, la &lt;a href="https://apidog.com/es/blog/prompting-claude-fable-5-1?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de prompting&lt;/a&gt; y la &lt;a href="https://apidog.com/es/blog/claude-fable-5-1-claude-code?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de Claude Code&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;Debido al menor precio de las lecturas de caché, compactar demasiado pronto para ahorrar dinero puede dejar de ser la mejor compensación en Fable 5.1. Experimenta con puntos de compactación posteriores.&lt;/p&gt;

&lt;h2&gt;
  
  
  Preguntas frecuentes
&lt;/h2&gt;

&lt;h3&gt;
  
  
  ¿Qué significa «El bloque está vinculado a una conversación diferente»?
&lt;/h3&gt;

&lt;p&gt;Un bloque de pensamiento de Claude Fable 5.1 se reprodujo después de que cambiara algo anterior: el prompt de sistema, el array de herramientas o un mensaje previo. En las cuentas con aplicación forzosa, la API rechaza la solicitud con un error 400.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Qué cuentas aplican la verificación del historial?
&lt;/h3&gt;

&lt;p&gt;Las cuentas creadas a partir del 31 de agosto de 2026, en todas las plataformas. Las cuentas antiguas solo la aplican cuando una solicitud establece &lt;code&gt;thinking.block_binding.prefix_mismatch_behavior&lt;/code&gt;. Anthropic planea aplicarla a todas las cuentas en modelos futuros.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Cómo hago desaparecer rápidamente el error?
&lt;/h3&gt;

&lt;p&gt;Envía la cabecera beta &lt;code&gt;thinking-binding-controls-2026-08-01&lt;/code&gt; con &lt;code&gt;prefix_mismatch_behavior: "drop_block"&lt;/code&gt;. La API eliminará los bloques afectados y continuará. Después corrige la modificación del historial: eliminar bloques en cada turno consume razonamiento y reinicia la caché.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Cambiar &lt;code&gt;effort&lt;/code&gt; o &lt;code&gt;max_tokens&lt;/code&gt; invalida los bloques?
&lt;/h3&gt;

&lt;p&gt;No. Puedes cambiar libremente cualquier parámetro fuera de &lt;code&gt;system&lt;/code&gt;, &lt;code&gt;tools&lt;/code&gt; y &lt;code&gt;messages&lt;/code&gt;, incluidos &lt;code&gt;max_tokens&lt;/code&gt;, &lt;code&gt;output_config&lt;/code&gt;, &lt;code&gt;effort&lt;/code&gt;, &lt;code&gt;tool_choice&lt;/code&gt;, &lt;code&gt;metadata&lt;/code&gt; y los marcadores &lt;code&gt;cache_control&lt;/code&gt;.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿La compactación del lado del servidor rompe la verificación?
&lt;/h3&gt;

&lt;p&gt;No. La compactación y la edición de contexto ocurren después de la verificación, que compara la conversación tal como la enviaste. La compactación del lado del cliente que conserva textualmente los turnos recientes sí puede romperla.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Claude Mythos 5.1 tiene la misma verificación?
&lt;/h3&gt;

&lt;p&gt;No. Mythos 5.1 no ejecuta la verificación de conversación. Sin embargo, sus bloques siguen vinculados al modelo productor y las ediciones del historial todavía reinician la caché.&lt;/p&gt;

&lt;h2&gt;
  
  
  Referencias
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;&lt;a href="https://platform.claude.com/docs/en/build-with-claude/preserved-thinking" rel="noopener noreferrer"&gt;Pensamiento preservado&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://platform.claude.com/docs/en/models/fable-5-1/whats-new-fable-5-1" rel="noopener noreferrer"&gt;Novedades de Claude Fable 5.1&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://apidog.com/es/blog/claude-fable-5-1-migration?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Guía de migración&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="http://claude.ai" rel="noopener noreferrer"&gt;claude.ai&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://apidog.com/download?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Descargar Apidog&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://platform.claude.com/docs/en/build-with-claude/mid-conversation-system-messages" rel="noopener noreferrer"&gt;Mensajes de sistema a mitad de conversación&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://platform.claude.com/docs/en/build-with-claude/compaction" rel="noopener noreferrer"&gt;Compactación del lado del servidor&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://apidog.com/es/blog/claude-fable-5-1-pricing?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Desglose de precios&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://apidog.com/es/blog/claude-fable-5-1-api?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Recorrido de la API&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://apidog.com/es/blog/prompting-claude-fable-5-1?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Guía de prompting&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://apidog.com/es/blog/claude-fable-5-1-claude-code?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Guía de Claude Code&lt;/a&gt;&lt;/li&gt;
&lt;/ul&gt;

</description>
    </item>
    <item>
      <title>Claude Mythos 5.1 vs Fable 5.1: Mismo Modelo, Diferentes Salvaguardias</title>
      <dc:creator>Roobia</dc:creator>
      <pubDate>Wed, 02 Sep 2026 04:20:02 +0000</pubDate>
      <link>https://dev.to/roobia/claude-mythos-51-vs-fable-51-mismo-modelo-diferentes-salvaguardias-1oc1</link>
      <guid>https://dev.to/roobia/claude-mythos-51-vs-fable-51-mismo-modelo-diferentes-salvaguardias-1oc1</guid>
      <description>&lt;h1&gt;
  
  
  Claude Fable 5.1 vs. Mythos 5.1: modelo idéntico, salvaguardias diferentes
&lt;/h1&gt;

&lt;p&gt;Anthropic lanzó Claude Fable 5.1 y Claude Mythos 5.1 el 1 de septiembre de 2026, y los describió como “el mismo modelo pero con diferentes niveles de salvaguardias”. Comparten pesos, especificaciones, precios de $10 y $50, y API. Fable 5.1 está disponible para todos; Mythos 5.1 solo para organizaciones aprobadas en el Proyecto Glasswing, mediante programas de verificación de ciberseguridad y ciencias de la vida. También es el modelo que impulsa Claude Security de Anthropic.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation" class="crayons-btn crayons-btn--primary"&gt;Prueba Apidog hoy&lt;/a&gt;
&lt;/p&gt;

&lt;p&gt;Esta guía resume qué comparten, sus cuatro diferencias principales, cómo solicitar acceso a Mythos 5.1 y qué revela la única brecha de benchmark publicada sobre el costo de las salvaguardias.&lt;/p&gt;

&lt;p&gt;Fuentes principales:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;&lt;a href="https://www.anthropic.com/claude-fable-and-mythos-5-1" rel="noopener noreferrer"&gt;Publicación de lanzamiento de Anthropic&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://platform.claude.com/docs/en/models/fable-5-1/migration-guide" rel="noopener noreferrer"&gt;Guía de migración de Fable 5.1&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://apidog.com/es/blog/mythos-class-model-explained?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Qué significa “clase Mythos”&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href="https://apidog.com/es/blog/fable-5-vs-mythos-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Fable 5 vs. Mythos 5&lt;/a&gt;&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Comparación rápida
&lt;/h2&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
  &lt;thead&gt;
    &lt;tr&gt;
      &lt;th&gt;&lt;/th&gt;
      &lt;th&gt;Claude Fable 5.1&lt;/th&gt;
      &lt;th&gt;Claude Mythos 5.1&lt;/th&gt;
    &lt;/tr&gt;
  &lt;/thead&gt;
  &lt;tbody&gt;
    &lt;tr&gt;
      &lt;td&gt;ID del modelo&lt;/td&gt;
      &lt;td&gt;&lt;code&gt;claude-fable-5-1&lt;/code&gt;&lt;/td&gt;
      &lt;td&gt;&lt;code&gt;claude-mythos-5-1&lt;/code&gt;&lt;/td&gt;
    &lt;/tr&gt;
    &lt;tr&gt;
      &lt;td&gt;Disponibilidad&lt;/td&gt;
      &lt;td&gt;Todos los clientes&lt;/td&gt;
      &lt;td&gt;Participantes aprobados del Proyecto Glasswing&lt;/td&gt;
    &lt;/tr&gt;
    &lt;tr&gt;
      &lt;td&gt;Acceso&lt;/td&gt;
      &lt;td&gt;Registro&lt;/td&gt;
      &lt;td&gt;Programa de Verificación Cibernética o de Ciencias de la Vida; organizaciones de EE. UU.&lt;/td&gt;
    &lt;/tr&gt;
    &lt;tr&gt;
      &lt;td&gt;Precio&lt;/td&gt;
      &lt;td&gt;$10 / $50; lecturas de caché a $0.25&lt;/td&gt;
      &lt;td&gt;Igual&lt;/td&gt;
    &lt;/tr&gt;
    &lt;tr&gt;
      &lt;td&gt;Contexto / salida máxima&lt;/td&gt;
      &lt;td&gt;1M / 128K&lt;/td&gt;
      &lt;td&gt;Igual&lt;/td&gt;
    &lt;/tr&gt;
    &lt;tr&gt;
      &lt;td&gt;Corte de conocimiento&lt;/td&gt;
      &lt;td&gt;Junio de 2026&lt;/td&gt;
      &lt;td&gt;Igual&lt;/td&gt;
    &lt;/tr&gt;
    &lt;tr&gt;
      &lt;td&gt;Pensamiento&lt;/td&gt;
      &lt;td&gt;Adaptativo y siempre activo&lt;/td&gt;
      &lt;td&gt;Igual&lt;/td&gt;
    &lt;/tr&gt;
    &lt;tr&gt;
      &lt;td&gt;
&lt;code&gt;tool_choice&lt;/code&gt; forzado&lt;/td&gt;
      &lt;td&gt;400&lt;/td&gt;
      &lt;td&gt;400&lt;/td&gt;
    &lt;/tr&gt;
    &lt;tr&gt;
      &lt;td&gt;Clasificadores de seguridad&lt;/td&gt;
      &lt;td&gt;Conjunto completo: cibernético, biológico, &lt;code&gt;llm_frontera&lt;/code&gt;, &lt;code&gt;extracción_razonamiento&lt;/code&gt; y daños generales&lt;/td&gt;
      &lt;td&gt;Dependen del programa de acceso y son más permisivos para trabajos defensivos aprobados&lt;/td&gt;
    &lt;/tr&gt;
    &lt;tr&gt;
      &lt;td&gt;Vulnerabilidades&lt;/td&gt;
      &lt;td&gt;Puede identificarlas, pero no desarrollar exploits&lt;/td&gt;
      &lt;td&gt;Puede descubrir rutas de explotación para investigación defensiva aprobada&lt;/td&gt;
    &lt;/tr&gt;
    &lt;tr&gt;
      &lt;td&gt;Lee bloques de pensamiento de Fable 5.1&lt;/td&gt;
      &lt;td&gt;Sí&lt;/td&gt;
      &lt;td&gt;Sí; es el único otro modelo compatible&lt;/td&gt;
    &lt;/tr&gt;
    &lt;tr&gt;
      &lt;td&gt;Verificación de edición del historial&lt;/td&gt;
      &lt;td&gt;Sí&lt;/td&gt;
      &lt;td&gt;No&lt;/td&gt;
    &lt;/tr&gt;
    &lt;tr&gt;
      &lt;td&gt;Plataformas&lt;/td&gt;
      &lt;td&gt;API de Claude, Bedrock, Plataforma Claude en AWS, Google Cloud y Foundry&lt;/td&gt;
      &lt;td&gt;API de Claude, Bedrock, Google Cloud y Foundry; no Plataforma Claude en AWS&lt;/td&gt;
    &lt;/tr&gt;
    &lt;tr&gt;
      &lt;td&gt;Nivel de Prioridad&lt;/td&gt;
      &lt;td&gt;No disponible&lt;/td&gt;
      &lt;td&gt;No disponible&lt;/td&gt;
    &lt;/tr&gt;
    &lt;tr&gt;
      &lt;td&gt;Retención de datos&lt;/td&gt;
      &lt;td&gt;30 días; Modelo Cubierto&lt;/td&gt;
      &lt;td&gt;Igual&lt;/td&gt;
    &lt;/tr&gt;
    &lt;tr&gt;
      &lt;td&gt;Terminal-Bench 4.0&lt;/td&gt;
      &lt;td&gt;55.8%&lt;/td&gt;
      &lt;td&gt;60.9%&lt;/td&gt;
    &lt;/tr&gt;
  &lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;h2&gt;
  
  
  Qué comparten
&lt;/h2&gt;

&lt;p&gt;Anthropic afirma que ambos modelos tienen las mismas capacidades, especificaciones, precios y comportamiento de API. En concreto, comparten:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Ventana de contexto de 1M y salida máxima de 128K.&lt;/li&gt;
&lt;li&gt;Pensamiento adaptativo siempre activo.&lt;/li&gt;
&lt;li&gt;Cinco niveles de esfuerzo.&lt;/li&gt;
&lt;li&gt;Corte de conocimiento en junio de 2026.&lt;/li&gt;
&lt;li&gt;Lecturas de caché a $0.25.&lt;/li&gt;
&lt;li&gt;Los tres cambios principales de la generación Fable 5, salvo la verificación del historial descrita más adelante.&lt;/li&gt;
&lt;li&gt;Retención de datos obligatoria durante 30 días.&lt;/li&gt;
&lt;li&gt;Clasificación como Modelos Cubiertos: no admiten retención cero salvo autorización expresa de Anthropic.&lt;/li&gt;
&lt;li&gt;Ausencia del Nivel de Prioridad.&lt;/li&gt;
&lt;li&gt;Marca de agua estadística de texto de Anthropic en todas las plataformas.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;La &lt;a href="https://apidog.com/es/blog/what-is-claude-fable-5-1?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;hoja de especificaciones de Fable 5.1&lt;/a&gt; también sirve como hoja de especificaciones de Mythos 5.1.&lt;/p&gt;

&lt;h2&gt;
  
  
  Diferencia 1: quién puede usarlo
&lt;/h2&gt;

&lt;p&gt;Fable 5.1 está disponible públicamente en la API de Claude y en todas las plataformas asociadas.&lt;/p&gt;

&lt;p&gt;Mythos 5.1 solo se ofrece a clientes aprobados del &lt;a href="https://anthropic.com/glasswing" rel="noopener noreferrer"&gt;Proyecto Glasswing&lt;/a&gt;. En el lanzamiento existen dos rutas de acceso:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;
&lt;strong&gt;Programa de Verificación Cibernética&lt;/strong&gt;, dirigido a profesionales de seguridad defensiva que solicitan acceso mediante el portal de Anthropic.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Programa de Verificación de Ciencias de la Vida&lt;/strong&gt;, dirigido a organizaciones de ciencias de la vida y gestionado junto con el gobierno de EE. UU.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;En el lanzamiento, ambos programas están limitados a organizaciones estadounidenses. La inscripción del programa de ciencias de la vida se ampliará con el tiempo. El acceso se coordina con los equipos de cuentas de Anthropic, AWS o Google Cloud; todavía no estaba confirmado si el acceso existente a Mythos 5 se transfería automáticamente.&lt;/p&gt;

&lt;p&gt;Esto cambia el modelo de acceso de Mythos 5, que era exclusivamente por invitación y no ejecutaba clasificadores de seguridad. Mythos 5.1 sí ejecuta salvaguardias, pero calibradas según el programa de acceso.&lt;/p&gt;

&lt;h2&gt;
  
  
  Diferencia 2: qué permiten las salvaguardias
&lt;/h2&gt;

&lt;p&gt;Fable 5.1 ejecuta el conjunto completo de clasificadores de Fable. Una solicitud rechazada no devuelve un error HTTP: responde con &lt;code&gt;HTTP 200&lt;/code&gt; y:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"stop_reason"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"refusal"&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;La respuesta también incluye una categoría. Anthropic informa que los falsos positivos disminuyeron considerablemente respecto a Fable 5:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Los clasificadores biológicos se activan un 85% menos en solicitudes benignas.&lt;/li&gt;
&lt;li&gt;Las salvaguardias cibernéticas generan aproximadamente un 60% menos de intervenciones por sesión de Claude Code.&lt;/li&gt;
&lt;li&gt;Fable 5.1 puede identificar vulnerabilidades de software, pero no desarrolla exploits.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Mythos 5.1 está diseñado para trabajos que Fable 5.1 puede rechazar, como el descubrimiento de rutas de explotación para investigación defensiva aprobada o determinados trabajos de ciencias de la vida que activan el clasificador biológico.&lt;/p&gt;

&lt;p&gt;Aun así, Mythos 5.1 también aplica salvaguardias. Gestiona las respuestas de la misma forma:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;stop_reason: "refusal"
stop_details.category
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Configura siempre una alternativa para las solicitudes rechazadas.&lt;/p&gt;

&lt;p&gt;La &lt;a href="https://www.anthropic.com/claude-fable-5-1-mythos-5-1-system-card" rel="noopener noreferrer"&gt;publicación de lanzamiento&lt;/a&gt; y la &lt;a href="https://www.anthropic.com/claude-fable-5-1-mythos-5-1-system-card" rel="noopener noreferrer"&gt;tarjeta del sistema&lt;/a&gt; describen además:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Un clasificador en tiempo real para detectar sondeos agresivos e intentos de escapar del sandbox.&lt;/li&gt;
&lt;li&gt;Aislamiento reforzado para cargas cibernéticas de alto riesgo.&lt;/li&gt;
&lt;li&gt;Nuevos requisitos de aislamiento de red para evaluadores externos.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Estas medidas responden a incidentes de evaluaciones anteriores en los que los modelos alcanzaron sistemas reales.&lt;/p&gt;

&lt;h2&gt;
  
  
  Diferencia 3: verificación de edición del historial
&lt;/h2&gt;

&lt;p&gt;Los bloques de pensamiento de Fable 5.1 solo son válidos dentro de la conversación exacta que los generó. Para cuentas creadas el 31 de agosto de 2026 o después, editar cualquiera de estos elementos invalida los bloques posteriores:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Un turno anterior.&lt;/li&gt;
&lt;li&gt;El prompt del sistema.&lt;/li&gt;
&lt;li&gt;El array de herramientas.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;La API devuelve un error 400 cuando detecta que el bloque está vinculado a otra conversación. La &lt;a href="https://apidog.com/es/blog/claude-fable-5-1-preserved-thinking?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de pensamiento preservado&lt;/a&gt; documenta este comportamiento.&lt;/p&gt;

&lt;p&gt;Mythos 5.1 no realiza esa verificación. Sin embargo:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Sigue vinculando los bloques al modelo que los produjo.&lt;/li&gt;
&lt;li&gt;Las ediciones del historial reinician la caché de prompts.&lt;/li&gt;
&lt;li&gt;Mythos 5.1 puede leer bloques de pensamiento de Mythos 5, pero no al revés.&lt;/li&gt;
&lt;li&gt;Mythos 5.1 y Fable 5.1 son los únicos modelos que pueden leer los bloques de pensamiento del otro.&lt;/li&gt;
&lt;li&gt;Una conversación puede migrarse entre ambos modelos sin perder su razonamiento.&lt;/li&gt;
&lt;li&gt;Si se migra a Opus 5, la API elimina los bloques.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Diferencia 4: plataformas y límites de tasa
&lt;/h2&gt;

&lt;p&gt;Fable 5.1 está disponible en la Plataforma Claude en AWS. Mythos 5.1 no.&lt;/p&gt;

&lt;p&gt;Mythos 5.1 está disponible en:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;API de Claude.&lt;/li&gt;
&lt;li&gt;Amazon Bedrock como &lt;code&gt;anthropic.claude-mythos-5-1&lt;/code&gt;, en &lt;code&gt;us-east-1&lt;/code&gt;; el modelo no aparece públicamente en el catálogo.&lt;/li&gt;
&lt;li&gt;Google Cloud.&lt;/li&gt;
&lt;li&gt;Microsoft Foundry.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Los límites de tasa también están separados:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Fable 5.1 comparte el grupo &lt;strong&gt;Fable 5.x&lt;/strong&gt; con Fable 5.&lt;/li&gt;
&lt;li&gt;Mythos 5.1 comparte el grupo &lt;strong&gt;Mythos&lt;/strong&gt; con Mythos 5.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Qué revela la brecha de benchmark
&lt;/h2&gt;

&lt;p&gt;Anthropic publicó estos resultados para Terminal-Bench 4.0:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Fable 5.1: &lt;strong&gt;55.8%&lt;/strong&gt;
&lt;/li&gt;
&lt;li&gt;Mythos 5.1: &lt;strong&gt;60.9%&lt;/strong&gt;
&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;La diferencia es de cinco puntos porcentuales en codificación agéntica. Como los modelos son idénticos, el resultado sugiere que las salvaguardias de Fable pueden intervenir en algunos pasos benignos de una sesión de terminal extensa, incluso cuando la tarea no está relacionada con ciberseguridad o biología.&lt;/p&gt;

&lt;p&gt;También implica que el modelo más capaz disponible públicamente tiene un hermano con un resultado publicado superior. Consulta el &lt;a href="https://apidog.com/es/blog/claude-fable-5-1-benchmarks?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;desglose completo de benchmarks&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;Las afirmaciones científicas de Anthropic corresponden a Mythos 5.1, no a Fable 5.1:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Ligantes de proteínas con afinidades diez veces superiores a las mejores propuestas de la competencia en tres objetivos.&lt;/li&gt;
&lt;li&gt;Cerca de un 50% de aciertos en 12 objetivos, frente al 10–15% habitual.&lt;/li&gt;
&lt;li&gt;Un mapa de elevación de Venus con detalles de entre dos y tres kilómetros.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Estas son las cargas de trabajo a las que apunta el Programa de Verificación de Ciencias de la Vida.&lt;/p&gt;

&lt;h2&gt;
  
  
  Qué modelo usar
&lt;/h2&gt;

&lt;p&gt;Para la mayoría de los equipos, Fable 5.1 es la opción disponible por defecto. Mythos 5.1 está dirigido a:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Organizaciones que realizan investigación de seguridad defensiva y activan el clasificador cibernético.&lt;/li&gt;
&lt;li&gt;Organizaciones de ciencias de la vida cuyo trabajo benigno activa el clasificador biológico.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Si tu organización encaja en uno de esos casos, solicita el programa de verificación correspondiente. La migración debería consistir principalmente en cambiar el ID del modelo, porque el comportamiento de la API es el mismo salvo por la verificación del historial.&lt;/p&gt;

&lt;p&gt;Antes de solicitar acceso a Mythos 5.1, prueba estas medidas con Fable 5.1:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Sigue la guía de formulación de Anthropic. Pregunta “¿hay algún error?” en lugar de “¿esto compila?”.&lt;/li&gt;
&lt;li&gt;Proporciona documentación para lenguajes menos conocidos.&lt;/li&gt;
&lt;li&gt;Elimina las herramientas que devuelven datos base64 al contexto.&lt;/li&gt;
&lt;li&gt;Configura un fallback:
&lt;/li&gt;
&lt;/ol&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"fallbacks"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"default"&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Con esta configuración, las solicitudes rechazadas pueden redirigirse a Opus 5 u Opus 4.8. La &lt;a href="https://apidog.com/es/blog/claude-fable-5-fallbacks-parameter?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía del parámetro de fallbacks&lt;/a&gt; incluye el procedimiento completo.&lt;/p&gt;

&lt;h2&gt;
  
  
  Cómo comprobar con qué modelo estás hablando
&lt;/h2&gt;

&lt;p&gt;Como ambos modelos son idénticos en el resto de aspectos, envía el mismo cuerpo de solicitud a cada ID desde &lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt;.&lt;/p&gt;

&lt;h3&gt;
  
  
  1. Compara las salvaguardias
&lt;/h3&gt;

&lt;p&gt;Envía un prompt benigno de análisis de vulnerabilidades a:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;claude-fable-5-1
claude-mythos-5-1
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Después compara:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;stop_reason
stop_details.category
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;h3&gt;
  
  
  2. Comprueba la verificación del historial
&lt;/h3&gt;

&lt;p&gt;Envía dos solicitudes y modifica el prompt del sistema entre turnos usando el encabezado:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;thinking-binding-controls-2026-08-01
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;El resultado esperado es:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Fable 5.1: &lt;code&gt;prefix_binding_mismatch&lt;/code&gt; en &lt;code&gt;input_transformations&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;Mythos 5.1: no devuelve ese error.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Puedes &lt;a href="https://apidog.com/download?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;descargar Apidog&lt;/a&gt; para ejecutar las pruebas.&lt;/p&gt;

&lt;h2&gt;
  
  
  Preguntas frecuentes
&lt;/h2&gt;

&lt;h3&gt;
  
  
  ¿Claude Mythos 5.1 es más capaz que Fable 5.1?
&lt;/h3&gt;

&lt;p&gt;Es el mismo modelo y, por tanto, tiene la misma capacidad subyacente. El único benchmark publicado muestra un 60.9% para Mythos 5.1 frente a un 55.8% para Fable 5.1 en Terminal-Bench 4.0. La diferencia refleja la intervención de las salvaguardias, no arquitecturas distintas.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Cómo obtengo acceso a Claude Mythos 5.1?
&lt;/h3&gt;

&lt;p&gt;A través del Proyecto Glasswing:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Programa de Verificación Cibernética para profesionales de seguridad defensiva.&lt;/li&gt;
&lt;li&gt;Programa de Verificación de Ciencias de la Vida.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;En el lanzamiento, ambos están limitados a organizaciones de EE. UU. Contacta con tu equipo de cuentas de Anthropic, AWS o Google Cloud.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Mythos 5.1 cuesta más que Fable 5.1?
&lt;/h3&gt;

&lt;p&gt;No. Ambos cuestan $10 y $50 por millón de tokens y aplican las mismas tarifas de caché y lotes.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Claude Mythos 5.1 rechaza solicitudes?
&lt;/h3&gt;

&lt;p&gt;Sí. A diferencia de Mythos 5, Mythos 5.1 ejecuta salvaguardias calibradas según el programa de acceso. Gestiona &lt;code&gt;stop_reason: "refusal"&lt;/code&gt; y &lt;code&gt;stop_details.category&lt;/code&gt; igual que en Fable 5.1.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Puedo cambiar una conversación entre Fable 5.1 y Mythos 5.1?
&lt;/h3&gt;

&lt;p&gt;Sí. Puedes cambiar entre ambos sin perder el razonamiento, ya que son los únicos modelos capaces de leer los bloques de pensamiento del otro.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Mythos 5.1 está disponible en Amazon Bedrock?
&lt;/h3&gt;

&lt;p&gt;Sí. Está disponible como &lt;code&gt;anthropic.claude-mythos-5-1&lt;/code&gt; en &lt;code&gt;us-east-1&lt;/code&gt;, aunque no aparece públicamente en el catálogo. No está disponible en la Plataforma Claude en AWS.&lt;/p&gt;

</description>
      <category>ai</category>
      <category>claude</category>
      <category>llm</category>
      <category>security</category>
    </item>
    <item>
      <title>Cómo usar Claude Fable 5.1 en Claude Code</title>
      <dc:creator>Roobia</dc:creator>
      <pubDate>Wed, 02 Sep 2026 03:58:29 +0000</pubDate>
      <link>https://dev.to/roobia/como-usar-claude-fable-51-en-claude-code-35jh</link>
      <guid>https://dev.to/roobia/como-usar-claude-fable-51-en-claude-code-35jh</guid>
      <description>&lt;h1&gt;
  
  
  Claude Fable 5.1 en Claude Code: configuración, costes y mejores prácticas
&lt;/h1&gt;

&lt;p&gt;Claude Fable 5.1 está disponible en Claude Code desde la versión 2.1.250, en todos los planes de pago de Claude. En los planes Max se incluye hasta el 50 % del límite de uso semanal sin coste adicional. Los asientos estándar de Pro y Team lo ejecutan con créditos de uso desde el primer mensaje.&lt;/p&gt;

&lt;p&gt;Anthropic también informa de aproximadamente un 60 % menos de intervenciones cibernéticas por sesión de Claude Code frente a Fable 5. Además, Fable 5.1 puede encontrar vulnerabilidades en tu propio código.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation" class="crayons-btn crayons-btn--primary"&gt;Prueba Apidog hoy&lt;/a&gt;
&lt;/p&gt;

&lt;p&gt;Esta guía explica cómo actualizar Claude Code, seleccionar Fable 5.1, entender la facturación por plan, ajustar el esfuerzo y configurar &lt;code&gt;CLAUDE.md&lt;/code&gt; para sesiones de codificación largas. Las fuentes principales son &lt;a href="https://support.claude.com/en/articles/15424964-claude-fable-models-on-your-plan" rel="noopener noreferrer"&gt;Modelos Fable en tu plan&lt;/a&gt; y la &lt;a href="https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-fable-5-1" rel="noopener noreferrer"&gt;Guía de prompts de Fable 5.1&lt;/a&gt;. Para conocer el modelo, consulta &lt;a href="https://apidog.com/es/blog/what-is-claude-fable-5-1?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;qué es Claude Fable 5.1&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  1. Actualiza Claude Code
&lt;/h2&gt;

&lt;p&gt;Fable 5.1 requiere Claude Code 2.1.250 o posterior. Fable 5 requiere 2.1.170.&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;claude &lt;span class="nt"&gt;--version&lt;/span&gt;
npm &lt;span class="nb"&gt;install&lt;/span&gt; &lt;span class="nt"&gt;-g&lt;/span&gt; @anthropic-ai/claude-code@latest
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Si usas una compilación anterior, Fable 5.1 no aparece en el selector. Esta es la causa más habitual de los problemas de acceso.&lt;/p&gt;

&lt;h2&gt;
  
  
  2. Selecciona Fable 5.1
&lt;/h2&gt;

&lt;p&gt;Dentro de una sesión, ejecuta &lt;code&gt;/model&lt;/code&gt; y selecciona Claude Fable 5.1. También puedes iniciar una sesión directamente con el modelo:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;claude &lt;span class="nt"&gt;--model&lt;/span&gt; claude-fable-5-1
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Para usarlo siempre, configúralo como modelo predeterminado. El selector muestra cómo se factura en tu plan; revísalo porque las condiciones cambian según el tipo de asiento.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Ffnr49s84l027ayh3phit.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Ffnr49s84l027ayh3phit.png" width="800" height="549"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;h2&gt;
  
  
  3. Comprueba la facturación de tu plan
&lt;/h2&gt;

&lt;p&gt;Fable 5 y Fable 5.1 tienen la misma facturación. Lo que cambia es el plan:&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Plan&lt;/th&gt;
&lt;th&gt;Cómo se factura Fable 5.1&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Gratis&lt;/td&gt;
&lt;td&gt;No disponible&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Pro&lt;/td&gt;
&lt;td&gt;Créditos de uso desde el primer mensaje; no forma parte del límite semanal del plan&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Max (5x y 20x)&lt;/td&gt;
&lt;td&gt;Incluido hasta el 50 % del límite de uso semanal sin coste adicional; después continúa con créditos de uso o cambia de modelo&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Asiento estándar de equipo&lt;/td&gt;
&lt;td&gt;Créditos de uso, igual que Pro&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Asiento premium de equipo&lt;/td&gt;
&lt;td&gt;Igual que Max&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Asiento estándar de empresa&lt;/td&gt;
&lt;td&gt;Los créditos de uso deben estar habilitados para utilizarlo más allá de los límites del plan&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Empresa basada en uso&lt;/td&gt;
&lt;td&gt;Tarifas API estándar: 10 $ / 50 $ por millón de tokens&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;Ten en cuenta dos detalles en Claude Code:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;El 50 % de Max forma parte del límite semanal, no es una asignación independiente. El uso intensivo de Fable 5.1 también reduce el margen disponible para Opus 5.&lt;/li&gt;
&lt;li&gt;Las solicitudes redirigidas por las salvaguardias a otro modelo no se cobran a precios de Fable ni consumen créditos de Fable para ese turno alternativo.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;En Pro, el aviso de «créditos de uso requeridos» es el comportamiento esperado desde el cambio del 20 de julio. Consulta el &lt;a href="https://apidog.com/es/blog/fable-5-usage-credits-july-7?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;explicador de créditos de uso&lt;/a&gt;. Para conocer el aumento del límite semanal de Max, revisa la &lt;a href="https://apidog.com/es/blog/claude-code-limits-extension-august-2026?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;actualización de límites de Claude Code&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  4. Ajusta el esfuerzo
&lt;/h2&gt;

&lt;p&gt;El valor predeterminado de los modelos actuales en Claude Code es &lt;code&gt;alto&lt;/code&gt;, incluido Fable 5.1. Puedes cambiarlo por sesión con &lt;code&gt;/effort&lt;/code&gt; o desde la configuración.&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Alto:&lt;/strong&gt; punto de partida recomendado para la mayoría de las tareas de programación.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Medio:&lt;/strong&gt; calidad similar a Fable 5 con menor coste; adecuado para ediciones y preguntas rutinarias.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Xalto y máximo:&lt;/strong&gt; ofrecen las mayores ventajas frente a Fable 5 para refactorizaciones grandes, depuración de varias horas y características que abarcan varios archivos. También añaden tiempo de reflexión antes de la primera respuesta.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Bajo:&lt;/strong&gt; útil para tareas interactivas rápidas. Anthropic indica que Fable 5.1 en bajo puede competir con Opus y Sonnet en coste por tarea, pero lee menos y responde más basándose en su memoria. Aumenta el esfuerzo cuando la respuesta depende del código o la documentación actuales.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;En Max, reducir el esfuerzo también permite prolongar la asignación incluida del 50 %, porque cada turno genera menos tokens.&lt;/p&gt;

&lt;h2&gt;
  
  
  Qué cambia en una sesión larga de codificación
&lt;/h2&gt;

&lt;p&gt;Claude Code gestiona automáticamente el prefijo de la conversación, por lo que los problemas de comprobación del historial de edición en sistemas personalizados no se aplican aquí. Sí puedes notar estos cambios de comportamiento:&lt;/p&gt;

&lt;h3&gt;
  
  
  Menos lecturas paralelas
&lt;/h3&gt;

&lt;p&gt;Cuando las siguientes lecturas de archivos independientes solo están implícitas, Fable 5.1 puede leer un archivo por turno donde Fable 5 leía varios. El resultado suele ser el mismo, pero el tiempo transcurrido puede aumentar.&lt;/p&gt;

&lt;h3&gt;
  
  
  Menos mensajes de progreso
&lt;/h3&gt;

&lt;p&gt;Fable 5.1 narra menos entre llamadas a herramientas, especialmente con esfuerzos altos. Sus resúmenes finales también son más cortos. Un turno silencioso puede seguir avanzando con normalidad.&lt;/p&gt;

&lt;h3&gt;
  
  
  Más reescrituras completas
&lt;/h3&gt;

&lt;p&gt;Fable 5.1 es más propenso que Fable 5 a reescribir un archivo entero para aplicar un cambio pequeño. El resultado puede ser idéntico, pero aumenta el consumo de tokens y el tiempo de ejecución. La instrucción correspondiente en &lt;code&gt;CLAUDE.md&lt;/code&gt; ayuda a evitarlo.&lt;/p&gt;

&lt;h3&gt;
  
  
  Expansión del alcance y de las pruebas
&lt;/h3&gt;

&lt;p&gt;Al implementar una característica, puede corregir código cercano, ampliar comportamientos no solicitados o crear más archivos de prueba de los necesarios. Define explícitamente qué debe omitir.&lt;/p&gt;

&lt;h3&gt;
  
  
  Menos rechazos falsos
&lt;/h3&gt;

&lt;p&gt;Anthropic informa de aproximadamente un 60 % menos de intervenciones cibernéticas por sesión que Fable 5. Fable 5.1 también permite descubrir vulnerabilidades en tu propio código.&lt;/p&gt;

&lt;p&gt;Estas situaciones todavía pueden elevar los falsos positivos:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Preguntar «¿compila esto sin errores?». Es mejor preguntar «¿hay algún error?».&lt;/li&gt;
&lt;li&gt;Trabajar con un lenguaje poco conocido sin proporcionar su documentación.&lt;/li&gt;
&lt;li&gt;Usar herramientas que devuelven contenido base64 al contexto.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Instrucciones recomendadas para &lt;code&gt;CLAUDE.md&lt;/code&gt;
&lt;/h2&gt;

&lt;p&gt;Estas líneas proceden de la guía oficial de prompts y pueden pegarse en el &lt;code&gt;CLAUDE.md&lt;/code&gt; del proyecto.&lt;/p&gt;

&lt;h3&gt;
  
  
  Editar archivos de forma quirúrgica
&lt;/h3&gt;



&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;The number of tokens used to edit files is best minimized, all else being equal. Therefore, when it will not affect the end result, try to surgically edit a file rather than rewrite the entire thing.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;h3&gt;
  
  
  Mantener el alcance y las pruebas
&lt;/h3&gt;



&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;If, while working or testing, you find a pre-existing bug, a performance concern, or behavior the task doesn't mention, don't fix, optimize or extend it in this change unless the requested behavior cannot work without it; report it as a follow-up in your summary. Commit tests only where the task asks for them or this repository already keeps tests for this kind of change, sized like the neighboring test files. This is about extras only: implement every behavior the task asks for, completely.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;h3&gt;
  
  
  Ejecutar tareas de forma autónoma
&lt;/h3&gt;



&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;You are operating autonomously. The user is not watching in real time and cannot answer questions mid-task, so asking 'Want me to...?' or 'Shall I...?' will block the work. For reversible actions that follow from the original request, proceed without asking. Stop only for destructive actions or genuine scope changes the user must decide.
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Anthropic señala que la frase inicial produce la mayor parte del efecto. Añade una línea con las confirmaciones que aún quieres solicitar para evitar ambigüedades.&lt;/p&gt;

&lt;p&gt;Si tu &lt;code&gt;CLAUDE.md&lt;/code&gt; pide probar o verificar el trabajo antes de informar, conserva esa instrucción. La &lt;a href="https://apidog.com/es/blog/prompting-claude-opus-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de Opus 5 para eliminar las instrucciones de verificación&lt;/a&gt; no se aplica a Fable 5.1.&lt;/p&gt;

&lt;p&gt;El conjunto completo de cambios de comportamiento y fragmentos, incluido el ajuste del procesamiento por lotes y la corrección de densidad de escritura, está disponible en la &lt;a href="https://apidog.com/es/blog/prompting-claude-fable-5-1?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de prompts de Fable 5.1&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Usa Fable 5.1 con Apidog desde Claude Code
&lt;/h2&gt;

&lt;p&gt;Para trabajar con APIs, combina Fable 5.1 con la &lt;a href="https://apidog.com/es/blog/apidog-cli-in-claude-code?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;CLI de Apidog&lt;/a&gt;:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;El modelo diseña o edita la especificación OpenAPI.&lt;/li&gt;
&lt;li&gt;La CLI ejecuta los escenarios de prueba de Apidog.&lt;/li&gt;
&lt;li&gt;El modelo lee los resultados en el siguiente turno.&lt;/li&gt;
&lt;li&gt;Fable 5.1 itera sobre la especificación, simula y vuelve a probar.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Este ciclo resulta especialmente útil en ejecuciones autónomas de hasta una hora. Si necesitas una introducción, consulta &lt;a href="https://apidog.com/es/blog/build-apis-using-claude-code-and-apidog?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;construir APIs con Claude Code y Apidog&lt;/a&gt;. Puedes empezar gratis con &lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt; o &lt;a href="https://apidog.com/download?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Descargar Apidog&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Fable 5.1 frente a Opus 5 en Claude Code
&lt;/h2&gt;

&lt;p&gt;La regla de Anthropic en la &lt;a href="https://platform.claude.com/docs/en/models/overview" rel="noopener noreferrer"&gt;visión general de modelos&lt;/a&gt; es comenzar con Opus 5 y aumentar el esfuerzo si aún no alcanza el resultado esperado.&lt;/p&gt;

&lt;p&gt;En Claude Code:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Usa Opus 5 para el trabajo diario.&lt;/li&gt;
&lt;li&gt;Cambia a Fable 5.1 para sesiones largas, multifichero y difíciles.&lt;/li&gt;
&lt;li&gt;En Max, reserva la asignación incluida del 50 % para las tareas que realmente necesiten esa capacidad.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;La &lt;a href="https://apidog.com/es/blog/claude-fable-5-1-vs-opus-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;comparación Fable 5.1 vs Opus 5&lt;/a&gt; incluye detalles de referencia y coste. La &lt;a href="https://apidog.com/es/blog/claude-opus-5-claude-code?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de Opus 5 en Claude Code&lt;/a&gt; explica cómo configurar ese modelo.&lt;/p&gt;

&lt;h2&gt;
  
  
  Preguntas frecuentes
&lt;/h2&gt;

&lt;p&gt;&lt;strong&gt;¿Qué versión de Claude Code es compatible con Fable 5.1?&lt;/strong&gt;&lt;br&gt;&lt;br&gt;
La 2.1.250 o posterior. Fable 5 requiere la 2.1.170 o posterior. Las compilaciones anteriores no muestran el modelo.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;¿Está Claude Fable 5.1 incluido en mi plan?&lt;/strong&gt;&lt;br&gt;&lt;br&gt;
En los asientos premium de Max y Team, sí, hasta el 50 % del límite de uso semanal; después se aplican créditos de uso. En los asientos estándar de Pro y Team se usan créditos desde el primer mensaje. No está disponible en el plan Gratis.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;¿Cuál es el esfuerzo predeterminado?&lt;/strong&gt;&lt;br&gt;&lt;br&gt;
&lt;code&gt;alto&lt;/code&gt;, igual que en los demás modelos actuales. Puedes cambiarlo con &lt;code&gt;/effort&lt;/code&gt;.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;¿Fable 5.1 rechaza el trabajo de seguridad?&lt;/strong&gt;&lt;br&gt;&lt;br&gt;
Menos que Fable 5. Anthropic informa de aproximadamente un 60 % menos de intervenciones cibernéticas por sesión y permite descubrir vulnerabilidades en tu propio código. El desarrollo de exploits sigue rechazándose. Las solicitudes redirigidas no se cobran a precios de Fable.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;¿Debo conservar las instrucciones para verificar el trabajo?&lt;/strong&gt;&lt;br&gt;&lt;br&gt;
Sí. Esas instrucciones estaban dirigidas a Opus 5, que verificaba en exceso. Anthropic indica que no deben eliminarse para Fable 5.1.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;¿Por qué Fable 5.1 se queda en silencio durante turnos largos?&lt;/strong&gt;&lt;br&gt;&lt;br&gt;
Envía menos mensajes de progreso entre llamadas a herramientas que Fable 5, especialmente con esfuerzos altos. El trabajo puede seguir ejecutándose aunque la narración sea más escasa.&lt;/p&gt;

</description>
    </item>
    <item>
      <title>Cómo usar Claude Fable 5.1 gratis (y las opciones de pago más baratas)</title>
      <dc:creator>Roobia</dc:creator>
      <pubDate>Wed, 02 Sep 2026 03:31:47 +0000</pubDate>
      <link>https://dev.to/roobia/como-usar-claude-fable-51-gratis-y-las-opciones-de-pago-mas-baratas-11i9</link>
      <guid>https://dev.to/roobia/como-usar-claude-fable-51-gratis-y-las-opciones-de-pago-mas-baratas-11i9</guid>
      <description>&lt;h1&gt;
  
  
  ¿Existe un nivel gratuito para Claude Fable 5.1?
&lt;/h1&gt;

&lt;p&gt;No existe un nivel gratuito para Claude Fable 5.1. No está incluido en el plan Gratuito de &lt;a href="http://claude.ai" rel="noopener noreferrer"&gt;claude.ai&lt;/a&gt;, y la API solo ofrece el pequeño crédito de registro que recibe cada cuenta nueva. Las ofertas de “Fable 5.1 gratuito ilimitado” suelen ocultar otro modelo detrás de un proxy o intentar recolectar claves. Aun así, hay formas legítimas de probarlo por poco dinero y reducir considerablemente el costo de uso.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation" class="crayons-btn crayons-btn--primary"&gt;Prueba Apidog hoy&lt;/a&gt;
&lt;/p&gt;

&lt;p&gt;Esta guía resume las opciones con cifras reales, basadas en el &lt;a href="https://support.claude.com/en/articles/15424964-claude-fable-models-on-your-plan" rel="noopener noreferrer"&gt;artículo de medición de planes&lt;/a&gt; de Anthropic y su &lt;a href="https://platform.claude.com/docs/en/about-claude/pricing" rel="noopener noreferrer"&gt;página de precios&lt;/a&gt;. Para conocer el modelo, consulta &lt;a href="https://apidog.com/es/blog/what-is-claude-fable-5-1?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;qué es Claude Fable 5.1&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Qué significa “gratis” para Fable 5.1
&lt;/h2&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Ruta&lt;/th&gt;
&lt;th&gt;Costo&lt;/th&gt;
&lt;th&gt;Lo que obtienes&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Plan Gratuito de Claude&lt;/td&gt;
&lt;td&gt;$0&lt;/td&gt;
&lt;td&gt;Sin acceso a Fable 5.1&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Crédito de registro de API&lt;/td&gt;
&lt;td&gt;$0&lt;/td&gt;
&lt;td&gt;Un crédito único pequeño; a $10 y $50 por millón de tokens cubre algunas docenas de solicitudes sustanciales&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Claude Pro&lt;/td&gt;
&lt;td&gt;$20 al mes&lt;/td&gt;
&lt;td&gt;Fable 5.1 con créditos de uso desde el primer mensaje; no forma parte del límite semanal&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Claude Max 5x&lt;/td&gt;
&lt;td&gt;$100 al mes&lt;/td&gt;
&lt;td&gt;Fable 5.1 incluido hasta el 50% del límite de uso semanal; después, créditos de uso&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Claude Max 20x&lt;/td&gt;
&lt;td&gt;$200 al mes&lt;/td&gt;
&lt;td&gt;La misma regla del 50%, con un límite semanal mayor&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Puesto estándar de equipo&lt;/td&gt;
&lt;td&gt;Por puesto&lt;/td&gt;
&lt;td&gt;Créditos de uso, como Pro&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Puesto premium de equipo&lt;/td&gt;
&lt;td&gt;Por puesto&lt;/td&gt;
&lt;td&gt;Incluido hasta el 50% del límite semanal, como Max&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Claude Code&lt;/td&gt;
&lt;td&gt;Por plan&lt;/td&gt;
&lt;td&gt;La misma medición que el plan; requiere la versión 2.1.250 o posterior&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;API por lotes&lt;/td&gt;
&lt;td&gt;50% de descuento&lt;/td&gt;
&lt;td&gt;$5 por millón de tokens de entrada y $25 por millón de salida para tareas que puedan esperar&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;El crédito único que recibieron los puestos Pro y Estándar de Equipo cuando Fable 5 pasó a los créditos de uso en julio de 2026 fue una excepción. No se repite para Fable 5.1. Consulta el &lt;a href="https://apidog.com/es/blog/fable-5-usage-credits-july-7?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;cambio a créditos de uso en julio&lt;/a&gt; para conocer los detalles.&lt;/p&gt;

&lt;h2&gt;
  
  
  Ruta 1: Usa el crédito de registro de la API
&lt;/h2&gt;

&lt;p&gt;Las cuentas nuevas de la API de Claude reciben un pequeño crédito gratuito para pruebas. Con las tarifas de Fable 5.1, una solicitud de 5.000 tokens de entrada y 2.000 de salida cuesta aproximadamente $0.15. Esto permite evaluar el modelo con algunas de tus solicitudes más difíciles, no mantener una sesión de chat completa.&lt;/p&gt;

&lt;p&gt;Ten en cuenta lo siguiente:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Fable 5.1 requiere una retención de datos de 30 días. La configuración predeterminada de una cuenta nueva funciona, pero una organización con retención cero recibirá un error 400.&lt;/li&gt;
&lt;li&gt;El crédito se comparte entre modelos. Las llamadas a Opus 5 o Sonnet 5 también lo consumen.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;La &lt;a href="https://apidog.com/es/blog/free-claude-api-access?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de acceso gratuito a la API de Claude&lt;/a&gt; explica cómo funciona el crédito.&lt;/p&gt;

&lt;h2&gt;
  
  
  Ruta 2: Aprovecha Max hasta el límite incluido
&lt;/h2&gt;

&lt;p&gt;En los planes Max, Fable 5 y Fable 5.1 son “una parte estándar de tu plan”, según Anthropic. Puedes usar modelos Fable hasta el 50% de tu límite de uso semanal sin costo adicional. Después, debes usar créditos de uso o cambiar de modelo durante el resto de la semana.&lt;/p&gt;

&lt;p&gt;Para aprovechar mejor esa asignación:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Ajusta el esfuerzo.&lt;/strong&gt; Claude y Claude Code usan &lt;code&gt;high&lt;/code&gt; por defecto. Fable 5.1 con &lt;code&gt;medium&lt;/code&gt; ofrece una calidad aproximadamente comparable a Fable 5 a menor costo. Anthropic también indica que &lt;code&gt;low&lt;/code&gt; puede competir con Opus y Sonnet en costo por tarea. Menos esfuerzo produce menos tokens de salida y permite más turnos dentro del 50%.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Enruta cada tarea al modelo adecuado.&lt;/strong&gt; Usa Opus 5 para el trabajo rutinario y reserva Fable 5.1 para sesiones largas o difíciles. Es la recomendación de Anthropic y ayuda a conservar la asignación de Fable.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Considera las redirecciones.&lt;/strong&gt; Cuando las salvaguardas redirigen una solicitud a otro modelo, no se factura a la tarifa de Fable.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Entre Max 5x y Max 20x, la regla es sencilla: el 50% de un límite semanal mayor representa una asignación mayor; el porcentaje no cambia. La &lt;a href="https://apidog.com/es/blog/claude-fable-5-1-claude-code?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de Claude Code&lt;/a&gt; muestra cómo consultar la medición durante una sesión.&lt;/p&gt;

&lt;h2&gt;
  
  
  Ruta 3: Usa Pro con créditos de uso
&lt;/h2&gt;

&lt;p&gt;Los usuarios de Pro pueden utilizar Fable 5.1, pero el modelo no consume el límite semanal del plan. Se factura mediante créditos de uso desde el primer mensaje, según las tarifas del modelo.&lt;/p&gt;

&lt;p&gt;Pro puede ser más económico para usos ocasionales, como:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Una refactorización difícil por semana.&lt;/li&gt;
&lt;li&gt;Una tarea de investigación larga al mes.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Para uso diario, Max 5x a $100 puede ser el punto de partida más realista. Calcula tus tokens mensuales de Fable 5.1 y compara el costo de los créditos de uso con la diferencia de $80 entre Pro y Max 5x. Recuerda que la asignación de Max corresponde a una parte de un límite semanal, no a un número fijo de tokens.&lt;/p&gt;

&lt;h2&gt;
  
  
  Ruta 4: Reduce el costo a la mitad con Batch
&lt;/h2&gt;

&lt;p&gt;La &lt;a href="https://platform.claude.com/docs/en/build-with-claude/batch-processing" rel="noopener noreferrer"&gt;API por lotes&lt;/a&gt; aplica un 50% de descuento:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;$5 por millón de tokens de entrada.&lt;/li&gt;
&lt;li&gt;$25 por millón de tokens de salida.&lt;/li&gt;
&lt;li&gt;$0.125 por millón de tokens en lecturas de caché.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Los lotes se procesan de forma asíncrona, normalmente en horas, con un límite de 24 horas. Son adecuados para:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Evaluaciones.&lt;/li&gt;
&lt;li&gt;Retroalimentación.&lt;/li&gt;
&lt;li&gt;Procesamiento de documentos.&lt;/li&gt;
&lt;li&gt;Generación de informes nocturnos.&lt;/li&gt;
&lt;li&gt;Barridos de evaluación con distintos niveles de esfuerzo.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Hay dos límites importantes:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Los &lt;code&gt;fallbacks&lt;/code&gt; del lado del servidor se rechazan en lotes. Si un elemento falla, debes volver a enviarlo manualmente.&lt;/li&gt;
&lt;li&gt;La beta de salida de lotes de 300.000 tokens no está disponible para Fable 5.1.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Ruta 5: Usa la caché de prompts
&lt;/h2&gt;

&lt;p&gt;El mayor descuento de Fable 5.1 suele venir del almacenamiento en caché de prompts. Las lecturas de caché cuestan $0.25 por millón de tokens: una cuarta parte de la tarifa de Fable 5 y la mitad de la de Opus 5.&lt;/p&gt;

&lt;p&gt;Las cargas de trabajo con un prefijo estable —por ejemplo, un prompt de sistema largo, un documento o el contexto creciente de un agente— pueden procesar gran parte de la entrada al 2.5% del precio de lista. Anthropic estima que esto reduce aproximadamente un 25% el costo de las cargas típicas y hasta un 45% el de las cargas altamente agenciales frente a Fable 5.&lt;/p&gt;

&lt;p&gt;Para aplicar el descuento:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Añade &lt;code&gt;cache_control&lt;/code&gt; al prefijo estable.&lt;/li&gt;
&lt;li&gt;Mantén las marcas de tiempo y los ID por solicitud fuera del prompt del sistema.&lt;/li&gt;
&lt;li&gt;No reconstruyas &lt;code&gt;system&lt;/code&gt; ni &lt;code&gt;tools&lt;/code&gt; a mitad de la sesión; usa mensajes de sistema intermedios.&lt;/li&gt;
&lt;li&gt;Comprueba &lt;code&gt;usage.cache_read_input_tokens&lt;/code&gt; en la segunda solicitud. Un valor cero puede indicar un error de configuración.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;El &lt;a href="https://apidog.com/es/blog/claude-fable-5-1-pricing?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;desglose de precios&lt;/a&gt; incluye tres ejemplos, y el &lt;a href="https://apidog.com/es/blog/claude-fable-5-1-api?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;recorrido de la API&lt;/a&gt; muestra las solicitudes completas.&lt;/p&gt;

&lt;h2&gt;
  
  
  Ruta 6: Controla el esfuerzo
&lt;/h2&gt;

&lt;p&gt;A $50 por millón de tokens de salida, la generación suele ser la parte más costosa de una factura de Fable 5.1. El parámetro &lt;code&gt;output_config.effort&lt;/code&gt; es la principal palanca para controlar esos tokens.&lt;/p&gt;

&lt;p&gt;Empieza con &lt;code&gt;high&lt;/code&gt; y prueba niveles inferiores:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Usa &lt;code&gt;medium&lt;/code&gt; si mantiene la calidad en tus evaluaciones.&lt;/li&gt;
&lt;li&gt;Usa &lt;code&gt;low&lt;/code&gt; para turnos sencillos cuando el resultado siga siendo aceptable.&lt;/li&gt;
&lt;li&gt;Usa &lt;code&gt;high&lt;/code&gt; para tareas que requieran razonamiento más profundo.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;La beta de esfuerzo por mensaje permite ejecutar turnos fáciles en &lt;code&gt;low&lt;/code&gt; y turnos difíciles en &lt;code&gt;high&lt;/code&gt; sin restablecer la caché. Los cinco niveles se explican en la &lt;a href="https://apidog.com/es/blog/claude-opus-5-effort-parameter?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía del parámetro de esfuerzo de Opus 5&lt;/a&gt;; funcionan igual en Fable 5.1.&lt;/p&gt;

&lt;h2&gt;
  
  
  Ruta 7: Comprueba si realmente necesitas Fable 5.1
&lt;/h2&gt;

&lt;p&gt;La documentación de Anthropic recomienda comenzar con Opus 5 y pasar a Fable 5.1 solo si Opus 5, incluso con mayor esfuerzo, no alcanza el resultado esperado.&lt;/p&gt;

&lt;p&gt;Opus 5:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Cuesta la mitad sin caché.&lt;/li&gt;
&lt;li&gt;Tiene un modo rápido.&lt;/li&gt;
&lt;li&gt;Está disponible con retención de datos cero.&lt;/li&gt;
&lt;li&gt;Ejecuta menos clasificadores.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Para muchos casos de uso es suficiente. La &lt;a href="https://apidog.com/es/blog/claude-fable-5-1-vs-opus-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;comparación entre Fable 5.1 y Opus 5&lt;/a&gt; muestra diferencias de rendimiento por carga de trabajo; la mayoría son inferiores a cinco puntos. Si necesitas ejecutar un modelo potente al menor costo posible, empieza por esta opción.&lt;/p&gt;

&lt;h2&gt;
  
  
  Lo que no es una ruta gratuita
&lt;/h2&gt;

&lt;h3&gt;
  
  
  Sitios de “Fable 5.1 gratuito ilimitado”
&lt;/h3&gt;

&lt;p&gt;Fable 5.1 no tiene un nivel de API gratuito ni está incluido en el plan Gratuito. Un sitio que ofrezca acceso ilimitado probablemente:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Sirve otro modelo.&lt;/li&gt;
&lt;li&gt;Usa la clave de otra persona como proxy.&lt;/li&gt;
&lt;li&gt;Intenta recolectar tu clave.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Puedes comprobar el modelo real observando el comportamiento de redirección, el pensamiento siempre activo y la marca de agua de texto. El mismo patrón se analiza en &lt;a href="https://apidog.com/es/blog/claude-fable-5-no-restrictions?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Claude Fable 5 sin restricciones&lt;/a&gt;.&lt;/p&gt;

&lt;h3&gt;
  
  
  Desactivar el pensamiento
&lt;/h3&gt;

&lt;p&gt;No es posible en Fable 5.1. &lt;code&gt;thinking: {"type": "disabled"}&lt;/code&gt; devuelve un error 400 con cualquier nivel de esfuerzo. La única palanca disponible es reducir el esfuerzo.&lt;/p&gt;

&lt;h3&gt;
  
  
  Modo rápido y descuentos de Nivel Prioritario
&lt;/h3&gt;

&lt;p&gt;Ninguno está disponible para Fable 5.1.&lt;/p&gt;

&lt;h3&gt;
  
  
  Créditos de Bedrock o Google Cloud
&lt;/h3&gt;

&lt;p&gt;Los créditos de proveedores cloud pueden pagar Fable 5.1 en esas plataformas, pero cada proveedor define sus precios y añade un 10% para los puntos finales regionales. Es una opción real, pero no gratuita. Consulta la &lt;a href="https://apidog.com/es/blog/claude-fable-5-cloud-availability?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de disponibilidad en la nube&lt;/a&gt; para configurarla.&lt;/p&gt;

&lt;h2&gt;
  
  
  Mide el costo de cada solicitud
&lt;/h2&gt;

&lt;p&gt;La solicitud más barata es la que no envías dos veces. En &lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt;, crea una colección pequeña con tus prompts reales y añade un script posterior a la respuesta que multiplique cada campo &lt;code&gt;usage&lt;/code&gt; por su tarifa:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;$10 por millón de tokens de entrada.&lt;/li&gt;
&lt;li&gt;$0.25 por millón de tokens de lectura de caché.&lt;/li&gt;
&lt;li&gt;$12.50 por millón de tokens de escritura de caché.&lt;/li&gt;
&lt;li&gt;$50 por millón de tokens de salida.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Ejecuta las pruebas en &lt;code&gt;high&lt;/code&gt; y &lt;code&gt;medium&lt;/code&gt;, con y sin &lt;code&gt;cache_control&lt;/code&gt;. Obtendrás los cuatro valores necesarios para saber si Fable 5.1 se ajusta a tu presupuesto antes de contratar un plan. &lt;a href="https://apidog.com/download?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Descarga Apidog&lt;/a&gt; para configurarlo.&lt;/p&gt;

&lt;h2&gt;
  
  
  Preguntas frecuentes
&lt;/h2&gt;

&lt;p&gt;&lt;strong&gt;¿Claude Fable 5.1 es gratuito?&lt;/strong&gt;&lt;br&gt;&lt;br&gt;
No. No está incluido en el plan Gratuito y la API no tiene un nivel gratuito más allá del pequeño crédito de registro. Las opciones de acceso real más económicas son Pro con créditos de uso o Max, que lo incluye hasta el 50% del límite semanal.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;¿Claude Max incluye Fable 5.1?&lt;/strong&gt;&lt;br&gt;&lt;br&gt;
Sí. Los planes Max incluyen Fable 5 y Fable 5.1 hasta el 50% del límite de uso semanal sin costo adicional. Después continúan con créditos de uso.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;¿Puedo usar Fable 5.1 en Claude Pro?&lt;/strong&gt;&lt;br&gt;&lt;br&gt;
Sí, pero se aplican créditos de uso desde el primer mensaje. El modelo no consume el límite semanal de Pro.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;¿Cuál es la forma más barata de ejecutar Fable 5.1 en la API?&lt;/strong&gt;&lt;br&gt;&lt;br&gt;
Usa la API por lotes para tareas que puedan esperar: $5 y $25 por millón de tokens. Para prefijos estables, activa la caché: las lecturas cuestan $0.25 por millón. Reduce el esfuerzo a &lt;code&gt;medium&lt;/code&gt; o &lt;code&gt;low&lt;/code&gt; cuando las evaluaciones mantengan la calidad.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;¿Hay una prueba gratuita de Fable 5.1?&lt;/strong&gt;&lt;br&gt;&lt;br&gt;
Solo el crédito de registro estándar de la API, compartido entre todos los modelos. En julio de 2026 hubo un crédito único para los puestos Pro y de Equipo cuando Fable 5 pasó a los créditos de uso, pero no se repitió para Fable 5.1.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;¿Son reales los sitios de “API de Fable 5.1 gratuita ilimitada”?&lt;/strong&gt;&lt;br&gt;&lt;br&gt;
No. Fable 5.1 no tiene un nivel ilimitado gratuito. Esos sitios suelen servir otro modelo o utilizar una clave que no les pertenece.&lt;/p&gt;

</description>
    </item>
    <item>
      <title>Prompts para Claude Fable 5.1: Todos los Cambios de Comportamiento y la Línea que los Soluciona</title>
      <dc:creator>Roobia</dc:creator>
      <pubDate>Wed, 02 Sep 2026 03:01:17 +0000</pubDate>
      <link>https://dev.to/roobia/prompts-para-claude-fable-51-todos-los-cambios-de-comportamiento-y-la-linea-que-los-soluciona-e7</link>
      <guid>https://dev.to/roobia/prompts-para-claude-fable-51-todos-los-cambios-de-comportamiento-y-la-linea-que-los-soluciona-e7</guid>
      <description>&lt;h1&gt;
  
  
  Guía práctica para adaptar indicaciones de Claude Fable 5 a Claude Fable 5.1
&lt;/h1&gt;

&lt;p&gt;Anthropic afirma que sus indicaciones existentes para Fable 5 deberían funcionar bien en Claude Fable 5.1 sin cambios. Eso es cierto para las respuestas, pero no necesariamente para todo lo que las rodea: llamadas a herramientas, actualizaciones de progreso, densidad de la prosa, formato del chat, edición de archivos y solicitudes de permiso. Cada diferencia tiene una solución específica en la &lt;a href="https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-fable-5-1" rel="noopener noreferrer"&gt;guía de indicaciones de Anthropic para Claude Fable 5.1&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation" class="crayons-btn crayons-btn--primary"&gt;Prueba Apidog hoy&lt;/a&gt;
&lt;/p&gt;

&lt;p&gt;Para una descripción general del modelo, consulta &lt;a href="https://apidog.com/es/blog/what-is-claude-fable-5-1?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;qué es Claude Fable 5.1&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  1. Ajusta primero el esfuerzo
&lt;/h2&gt;

&lt;p&gt;El esfuerzo es el control principal para intercambiar inteligencia, latencia y costo en Fable 5.1. Empieza con el valor predeterminado, &lt;code&gt;high&lt;/code&gt; (alto), y prueba los otros cuatro niveles con tus propias evaluaciones.&lt;/p&gt;

&lt;p&gt;Repite el barrido aunque ya lo hayas ejecutado en Fable 5: los nombres de los niveles no representan la misma cantidad de pensamiento entre modelos.&lt;/p&gt;

&lt;p&gt;Anthropic recomienda comprobar estas afirmaciones:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;En &lt;code&gt;medium&lt;/code&gt; (medio), los resultados coinciden aproximadamente con Fable 5 a un costo menor.&lt;/li&gt;
&lt;li&gt;En &lt;code&gt;low&lt;/code&gt; (bajo), Fable 5.1 puede competir con Opus y Sonnet en costo por tarea y obtener una puntuación más alta.&lt;/li&gt;
&lt;li&gt;Las mejoras sobre Fable 5 son mayores en &lt;code&gt;xhigh&lt;/code&gt; (muy alto) y &lt;code&gt;max&lt;/code&gt; (máximo).&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Puedes cambiar el esfuerzo a mitad de una conversación sin reiniciar el caché mediante un mensaje &lt;code&gt;role: "system"&lt;/code&gt; con contenido vacío y &lt;code&gt;output_config&lt;/code&gt;, usando el encabezado beta &lt;code&gt;mid-conversation-output-config-2026-07-01&lt;/code&gt;. Consulta el &lt;a href="https://apidog.com/es/blog/claude-fable-5-1-api?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;tutorial de la API&lt;/a&gt; para ver la forma de la solicitud.&lt;/p&gt;

&lt;h2&gt;
  
  
  2. Coloca cada instrucción en el turno correcto
&lt;/h2&gt;

&lt;p&gt;Los bloques de pensamiento de Fable 5.1 solo son válidos en la conversación exacta que los produjo.&lt;/p&gt;

&lt;p&gt;Si inyectas un recordatorio en un turno anterior y lo eliminas en la siguiente solicitud, estás editando el historial. Esto reinicia el caché de indicaciones y, en cuentas creadas a partir del 31 de agosto de 2026, invalida cada bloque de pensamiento posterior. La documentación sobre &lt;a href="https://platform.claude.com/docs/en/build-with-claude/preserved-thinking" rel="noopener noreferrer"&gt;pensamiento preservado&lt;/a&gt; explica el motivo.&lt;/p&gt;

&lt;p&gt;Las instrucciones por turno deben ir en uno de estos lugares.&lt;/p&gt;

&lt;h3&gt;
  
  
  Con mensajes del sistema de alcance de turno
&lt;/h3&gt;

&lt;p&gt;Con la beta &lt;code&gt;mid-conversation-system-clear-at-2026-08-21&lt;/code&gt;, añade la instrucción después del mensaje de resultado de la herramienta:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight json"&gt;&lt;code&gt;&lt;span class="p"&gt;{&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"role"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"system"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"clear_at"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"next_user_message"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;&lt;span class="w"&gt;
  &lt;/span&gt;&lt;span class="nl"&gt;"content"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;"..."&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;span class="p"&gt;}&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Conserva cada copia anterior en el array. Cuando existe un mensaje de usuario posterior, la API elimina las copias anteriores; el modelo solo lee la más reciente y las copias eliminadas no consumen tokens. Consulta la documentación sobre &lt;a href="https://platform.claude.com/docs/en/build-with-claude/mid-conversation-system-messages" rel="noopener noreferrer"&gt;mensajes del sistema con alcance de turno&lt;/a&gt;.&lt;/p&gt;

&lt;h3&gt;
  
  
  Sin la beta
&lt;/h3&gt;

&lt;p&gt;Coloca la instrucción en un bloque de texto después de los bloques &lt;code&gt;tool_result&lt;/code&gt; del mismo mensaje del usuario. Mantén las copias anteriores.&lt;/p&gt;

&lt;blockquote&gt;
&lt;p&gt;Nunca elimines ni reescribas una copia que ya hayas enviado.&lt;/p&gt;
&lt;/blockquote&gt;

&lt;p&gt;Las instrucciones a nivel de sesión deben ir en la indicación del sistema o en el primer turno del usuario. Anthropic señala que las instrucciones de estilo colocadas en el primer turno del usuario se mantienen mejor que el mismo texto en la indicación del sistema.&lt;/p&gt;

&lt;h2&gt;
  
  
  3. Agrupa las llamadas a herramientas
&lt;/h2&gt;

&lt;p&gt;Cuando una solicitud nombra varias cosas que obtener, Fable 5.1 emite las llamadas en paralelo. Sin embargo, en bucles de codificación y uso de computadora donde las siguientes lecturas independientes solo están implícitas, puede emitir una llamada por turno cuando Fable 5 agrupaba varias.&lt;/p&gt;

&lt;p&gt;Las respuestas no cambian, pero cada turno adicional aumenta los tokens, el número de viajes de ida y vuelta y el tiempo real.&lt;/p&gt;

&lt;h3&gt;
  
  
  Mide antes de cambiar la indicación
&lt;/h3&gt;

&lt;p&gt;Rastrea la proporción de turnos del asistente con más de una llamada a herramienta. Añade la siguiente instrucción solo si esa proporción disminuyó:&lt;/p&gt;

&lt;blockquote&gt;
&lt;p&gt;Primero, haz una lista &lt;strong&gt;privada&lt;/strong&gt; de lo que necesitas a continuación; luego solicita cada elemento que no dependa del resultado de otro en esta única respuesta.&lt;/p&gt;
&lt;/blockquote&gt;

&lt;p&gt;La palabra “privada” es importante. Sin ella, el modelo a veces responde al recordatorio en lugar de responder al usuario.&lt;/p&gt;

&lt;p&gt;Coloca la instrucción cerca del final de la solicitud actual: suele modificar más el comportamiento que la misma oración en la indicación del sistema.&lt;/p&gt;

&lt;h2&gt;
  
  
  4. Muestra progreso durante los turnos largos
&lt;/h2&gt;

&lt;p&gt;Fable 5.1 escribe menos actualizaciones orientadas al usuario durante turnos largos de llamadas a herramientas que Fable 5, especialmente con mayor esfuerzo. El usuario puede ver al agente en silencio durante minutos o recibir un mensaje final que solo cubre el último paso.&lt;/p&gt;

&lt;p&gt;Aplica estas soluciones en orden:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;
&lt;strong&gt;Comprueba que recibes actualizaciones.&lt;/strong&gt; Las notas entre herramientas regresan como bloques &lt;code&gt;thinking&lt;/code&gt; que aparecen vacíos cuando &lt;code&gt;display&lt;/code&gt; está configurado como &lt;code&gt;"omitted"&lt;/code&gt;. Usa &lt;code&gt;display: "updates"&lt;/code&gt; con el encabezado beta &lt;code&gt;thinking-display-updates-2026-08-18&lt;/code&gt; y renderiza cada bloque no vacío como una línea de estado.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Elimina instrucciones antiguas&lt;/strong&gt; como “guarda todos los hallazgos para la respuesta final”.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Añade una indicación de progreso&lt;/strong&gt; si todavía necesitas más visibilidad:&lt;/li&gt;
&lt;/ol&gt;

&lt;blockquote&gt;
&lt;p&gt;Antes de empezar, di en una línea lo que vas a hacer; las actualizaciones breves mientras trabajas ayudan al usuario a seguir el progreso. Cierra con un breve resumen que se sostenga por sí mismo, cubriendo lo que encontraste, lo que hiciste y lo que sigue, para que un lector que solo vea el último mensaje tenga una imagen completa.&lt;/p&gt;
&lt;/blockquote&gt;

&lt;p&gt;Si tu producto oculta la salida de las herramientas, indícaselo al modelo mediante un mensaje del sistema de alcance de turno:&lt;/p&gt;

&lt;blockquote&gt;
&lt;p&gt;Solo tú ves la salida de ese comando. Si el usuario necesita leer algo de ella, ponlo en tu respuesta.&lt;/p&gt;
&lt;/blockquote&gt;

&lt;p&gt;De lo contrario, el modelo puede ejecutar comandos para “mostrar” al usuario una salida que nunca verá.&lt;/p&gt;

&lt;h2&gt;
  
  
  5. Evita que el turno termine antes del trabajo
&lt;/h2&gt;

&lt;p&gt;En cargas de trabajo asíncronas complejas, Fable 5.1 a veces describe lo que haría a continuación en lugar de hacerlo, o pide permiso para una acción ya incluida en la solicitud.&lt;/p&gt;

&lt;p&gt;Añade este bloque a la indicación del sistema:&lt;/p&gt;

&lt;blockquote&gt;
&lt;p&gt;Estás operando de forma autónoma. El usuario no está observando en tiempo real y no puede responder preguntas a mitad de la tarea, por lo que preguntar “¿Quieres que yo...?” o “¿Debo yo...?” bloqueará el trabajo. Para acciones reversibles que se derivan de la solicitud original, procede sin preguntar. Detente solo para acciones destructivas o cambios de alcance genuinos que el usuario deba decidir. Ofrecer seguimientos después de que la tarea esté hecha está bien; pedir permiso antes de hacer el trabajo no lo está.&lt;/p&gt;

&lt;p&gt;Antes de terminar tu turno, revisa tu último párrafo. Si es un plan, un análisis, una pregunta, una lista de siguientes pasos o una promesa sobre un trabajo que no has hecho, haz ese trabajo ahora con llamadas a herramientas. Termina tu turno solo cuando la tarea esté completa o estés bloqueado en una entrada que solo el usuario pueda proporcionar.&lt;/p&gt;
&lt;/blockquote&gt;

&lt;p&gt;Anthropic combina este bloque con otro que define la solicitud del usuario como el alcance del entregable:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;No restrinjas, amplíes ni intercambies el alcance.&lt;/li&gt;
&lt;li&gt;Completa cada parte que no esté bloqueada.&lt;/li&gt;
&lt;li&gt;Indica qué se omitió.&lt;/li&gt;
&lt;li&gt;Trata lo que hayas notado pero no se haya solicitado como una sugerencia, no como un cambio.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;El par puede hacer que el modelo pregunte menos ante solicitudes ambiguas. Si todavía necesitas confirmaciones, enuméralas explícitamente.&lt;/p&gt;

&lt;p&gt;A diferencia de la recomendación para Opus 5, conserva las instrucciones que piden al modelo revisar su trabajo antes de informar. El &lt;a href="https://apidog.com/es/blog/prompting-claude-opus-5?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;consejo de Opus 5&lt;/a&gt; de eliminar las instrucciones de verificación no se aplica aquí.&lt;/p&gt;

&lt;h2&gt;
  
  
  6. Controla las correcciones no solicitadas
&lt;/h2&gt;

&lt;p&gt;Cuando recibe una característica abierta, Fable 5.1 puede implementar la solicitud y añadir correcciones cercanas, comportamiento extendido o más archivos de prueba de los necesarios.&lt;/p&gt;

&lt;p&gt;Usa esta instrucción:&lt;/p&gt;

&lt;blockquote&gt;
&lt;p&gt;Si, mientras trabajas o pruebas, encuentras un error preexistente, un problema de rendimiento o un comportamiento que la tarea no menciona, no lo corrijas, optimices o extiendas en este cambio a menos que el comportamiento solicitado no pueda funcionar sin ello; repórtalo como un seguimiento en tu resumen. Verifica tu trabajo como desees; los scripts de prueba y las comprobaciones rápidas no necesitan ser conservados. Compromete pruebas solo cuando la tarea lo pida o este repositorio ya mantenga pruebas para este tipo de cambio, dimensionadas como los archivos de prueba vecinos. Esto se trata solo de extras: implementa completamente cada comportamiento que la tarea pida.&lt;/p&gt;
&lt;/blockquote&gt;

&lt;p&gt;Anthropic indica que esta solución reduce sustancialmente los extras sin cambiar el éxito de la tarea.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fei29oo7ccvj9d84kofgf.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fei29oo7ccvj9d84kofgf.png" alt="Comparación de comportamiento en Claude Fable 5.1" width="800" height="556"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;h2&gt;
  
  
  7. Evita reescribir archivos completos
&lt;/h2&gt;

&lt;p&gt;Fable 5.1 es más propenso que Fable 5 a reescribir un archivo completo para realizar una modificación pequeña. El resultado puede ser el mismo, pero con más tokens de salida.&lt;/p&gt;

&lt;p&gt;Añade esta línea a la indicación del sistema o al primer mensaje del usuario:&lt;/p&gt;

&lt;blockquote&gt;
&lt;p&gt;El número de tokens utilizados para editar archivos debe minimizarse, si todo lo demás es igual. Por lo tanto, cuando no afecte el resultado final, intenta editar un archivo quirúrgicamente en lugar de reescribirlo por completo.&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  8. Reduce la prosa densa y amanerada
&lt;/h2&gt;

&lt;p&gt;La escritura de Fable 5.1 suele ser mejor y contiene menos frases hechas, pero en algunos casos es más densa que la de Fable 5: oraciones más largas y menos saltos de párrafo.&lt;/p&gt;

&lt;p&gt;Define el antipatrón de forma explícita. Anthropic describe la “prosa amanerada” como una escritura que sustituye la declaración directa por metáforas y adornos, y que busca exhibir al escritor en lugar de transmitir la idea.&lt;/p&gt;

&lt;p&gt;Puedes indicarlo así:&lt;/p&gt;

&lt;blockquote&gt;
&lt;p&gt;Di lo que quieres decir y usa la frase literal cuando esté disponible.&lt;/p&gt;
&lt;/blockquote&gt;

&lt;p&gt;O de forma más breve:&lt;/p&gt;

&lt;blockquote&gt;
&lt;p&gt;Por favor, elimina toda prosa amanerada.&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  9. Recupera la estructura que el contenido necesita
&lt;/h2&gt;

&lt;p&gt;Los modelos anteriores abusaban de las viñetas y la negrita, por lo que muchas indicaciones incluían reglas contra el formato. Fable 5.1 se inclina hacia el extremo contrario: usa menos negrita, encabezados y listas.&lt;/p&gt;

&lt;p&gt;Elimina el lenguaje anti-formato o reemplázalo por una regla contextual:&lt;/p&gt;

&lt;blockquote&gt;
&lt;p&gt;Usa listas cuando se te pida o cuando el contenido sea lo suficientemente multifacético como para que mejoren la claridad. Respeta una solicitud explícita de formato mínimo y mantén la prosa sencilla en intercambios conversacionales o emocionales.&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  10. Marca correctamente las citas en los resúmenes
&lt;/h2&gt;

&lt;p&gt;Al resumir documentos, Fable 5.1 es más propenso que Fable 5 a reproducir pasajes de la fuente sin marcarlos como citas.&lt;/p&gt;

&lt;p&gt;Añade un ejemplo completo a la indicación del sistema que incluya:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;La solicitud del usuario.&lt;/li&gt;
&lt;li&gt;Una respuesta correcta que transmita cada fuente mediante el discurso indirecto del asistente.&lt;/li&gt;
&lt;li&gt;Como máximo, una cita corta claramente marcada.&lt;/li&gt;
&lt;li&gt;Una justificación de una oración que explique por qué la respuesta es correcta.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Reemplaza los marcadores de posición de llamadas a herramientas del ejemplo de Anthropic con el nombre de tu propia herramienta.&lt;/p&gt;

&lt;h2&gt;
  
  
  11. Obliga a buscar cuando el esfuerzo sea bajo
&lt;/h2&gt;

&lt;p&gt;Con esfuerzo &lt;code&gt;low&lt;/code&gt; (bajo), Fable 5.1 llama a herramientas de búsqueda y recuperación con menos frecuencia que Fable 5. Esto se nota especialmente con productos y modelos que reconoce, pero sobre los que puede tener conocimientos obsoletos.&lt;/p&gt;

&lt;p&gt;Prueba estas dos soluciones:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Aumenta el esfuerzo para los turnos afectados usando esfuerzo por mensaje.&lt;/li&gt;
&lt;li&gt;Añade una instrucción que establezca que reconocer un nombre de un área de rápido movimiento no equivale a conocer su estado actual. El modelo debe buscar antes de responder e incluir el nombre exactamente como lo escribió el usuario en al menos una consulta.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  12. Controla los entregables largos en &lt;code&gt;xhigh&lt;/code&gt; y &lt;code&gt;max&lt;/code&gt;
&lt;/h2&gt;

&lt;p&gt;En &lt;code&gt;xhigh&lt;/code&gt; (muy alto) y especialmente en &lt;code&gt;max&lt;/code&gt; (máximo), Fable 5.1 puede redactar gran parte de un entregable largo durante el pensamiento y escribirlo de nuevo en la respuesta. Esto duplica la espera y los tokens de salida.&lt;/p&gt;

&lt;p&gt;Dos opciones:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Ejecuta esas solicitudes en &lt;code&gt;high&lt;/code&gt; y sube el nivel solo cuando hayas medido una ganancia.&lt;/li&gt;
&lt;li&gt;Si mantienes &lt;code&gt;xhigh&lt;/code&gt; o &lt;code&gt;max&lt;/code&gt;, establece &lt;code&gt;max_tokens&lt;/code&gt; con espacio suficiente para el pensamiento y la respuesta. Añade una nota al mensaje del usuario:&lt;/li&gt;
&lt;/ol&gt;

&lt;blockquote&gt;
&lt;p&gt;Todo lo producido en una respuesta, incluido el razonamiento, cuenta para un solo límite de aproximadamente mi &lt;code&gt;max_tokens&lt;/code&gt; real. Componer el entregable completo como razonamiento y escribirlo de nuevo como respuesta duplica el turno sin mejorarlo.&lt;/p&gt;
&lt;/blockquote&gt;

&lt;p&gt;Mantén las copias anteriores de esta nota en las solicitudes posteriores.&lt;/p&gt;

&lt;h2&gt;
  
  
  13. Reduce las negativas falsas en tareas benignas
&lt;/h2&gt;

&lt;p&gt;Los clasificadores de Fable 5.1 producen menos falsos positivos que los de Fable 5 en su lanzamiento y ahora permiten encontrar vulnerabilidades en el código fuente. Aun así, pueden producirse negativas incorrectas.&lt;/p&gt;

&lt;p&gt;Prueba estos cambios:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Pregunta “¿Hay algún error en este programa?” en lugar de “¿Este programa compila sin errores?”.&lt;/li&gt;
&lt;li&gt;Proporciona documentación para lenguajes menos conocidos.&lt;/li&gt;
&lt;li&gt;Elimina las herramientas que devuelven datos codificados en Base64 al contexto.&lt;/li&gt;
&lt;li&gt;Mantén los fallbacks configurados de forma independiente. Consulta la &lt;a href="https://apidog.com/es/blog/claude-fable-5-fallbacks-parameter?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de manejo de negativas&lt;/a&gt;.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  14. Conserva los detalles durante la compactación del cliente
&lt;/h2&gt;

&lt;p&gt;Fable 5.1 responde bien cuando se le indica exactamente qué debe retener un resumen de compactación. La compactación del lado del servidor ya aplica este enfoque.&lt;/p&gt;

&lt;p&gt;Si realizas la compactación en el cliente, pide al modelo que resuma dentro de etiquetas &lt;code&gt;&amp;lt;summary&amp;gt;&lt;/code&gt; y conserve, en este orden:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Las dificultades que surgieron y cómo se resolvieron.&lt;/li&gt;
&lt;li&gt;Los enfoques planteados o descartados y el motivo.&lt;/li&gt;
&lt;li&gt;Todo lo solicitado o decidido, declarado exactamente.&lt;/li&gt;
&lt;li&gt;La situación actual.&lt;/li&gt;
&lt;li&gt;Cualquier asunto abierto.&lt;/li&gt;
&lt;li&gt;Los detalles difíciles de reconstruir, como nombres, números y enlaces.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Termina con esta instrucción:&lt;/p&gt;

&lt;blockquote&gt;
&lt;p&gt;No uses ninguna herramienta al escribir este resumen; responde solo con texto.&lt;/p&gt;
&lt;/blockquote&gt;

&lt;p&gt;Es importante incluirla cuando la solicitud de resumen todavía contiene las herramientas de la conversación.&lt;/p&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fh6pdx9rkpomz4vp0cjza.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2Fh6pdx9rkpomz4vp0cjza.png" alt="Flujo de compactación y pensamiento preservado" width="799" height="530"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;h2&gt;
  
  
  15. Considera soluciones arquitectónicas para subagentes y visión
&lt;/h2&gt;

&lt;p&gt;Algunos problemas no se resuelven con indicaciones.&lt;/p&gt;

&lt;h3&gt;
  
  
  Subagentes
&lt;/h3&gt;

&lt;p&gt;En tareas de codificación, deja que el agente principal continúe mientras los subagentes se ejecutan:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Haz que la herramienta que inicia un subagente regrese inmediatamente.&lt;/li&gt;
&lt;li&gt;Entrega cada resultado en un mensaje de usuario posterior.&lt;/li&gt;
&lt;li&gt;Proporciona al agente principal una herramienta separada que pueda llamar cuando quiera esperar.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  Visión
&lt;/h3&gt;

&lt;p&gt;Para gráficos densos y tablas anidadas:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Proporciona una herramienta de recorte que devuelva una región elegida y ampliada.&lt;/li&gt;
&lt;li&gt;O proporciona un contenedor con bibliotecas básicas de imágenes.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Con esfuerzo &lt;code&gt;low&lt;/code&gt;, el modelo puede omitir el recorte, así que revisa los registros de llamadas.&lt;/p&gt;

&lt;h2&gt;
  
  
  16. Prueba los cambios en Apidog
&lt;/h2&gt;

&lt;p&gt;Cada solución anterior debe validarse con una prueba de antes y después.&lt;/p&gt;

&lt;p&gt;En &lt;a href="https://apidog.com/?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;Apidog&lt;/a&gt;:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;Guarda los primeros tres turnos del bucle de agente como una secuencia de solicitud.&lt;/li&gt;
&lt;li&gt;Parametriza la indicación del sistema.&lt;/li&gt;
&lt;li&gt;Ejecuta la secuencia con y sin cada fragmento.&lt;/li&gt;
&lt;li&gt;Usa el mismo nivel de esfuerzo en ambas ejecuciones.&lt;/li&gt;
&lt;li&gt;Compara las métricas relevantes.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Métricas recomendadas:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Agrupación:&lt;/strong&gt; cuenta los bloques &lt;code&gt;tool_use&lt;/code&gt; por turno del asistente.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Edición y densidad:&lt;/strong&gt; revisa &lt;code&gt;usage.output_tokens&lt;/code&gt;.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Autonomía:&lt;/strong&gt; comprueba que no aparezca un párrafo final que comience con “A continuación, yo”.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Puedes &lt;a href="https://apidog.com/download?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;descargar Apidog&lt;/a&gt; para construir estas pruebas. La &lt;a href="https://apidog.com/es/blog/claude-fable-5-1-claude-code?utm_source=dev.to&amp;amp;utm_medium=wanda&amp;amp;utm_content=n8n-post-automation"&gt;guía de Claude Code&lt;/a&gt; muestra qué instrucciones pueden pertenecer a un archivo &lt;code&gt;CLAUDE.md&lt;/code&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Preguntas frecuentes
&lt;/h2&gt;

&lt;h3&gt;
  
  
  ¿Mis indicaciones de Fable 5 funcionan en Fable 5.1?
&lt;/h3&gt;

&lt;p&gt;Anthropic afirma que deberían funcionar bien sin cambios. Las diferencias son principalmente de comportamiento: menos llamadas a herramientas agrupadas, menos actualizaciones de progreso, prosa más densa, menos formato en el chat, reescrituras de archivos completos y expansión del alcance en tareas abiertas.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Qué nivel de esfuerzo debo usar?
&lt;/h3&gt;

&lt;p&gt;Empieza en &lt;code&gt;high&lt;/code&gt; y realiza un barrido con tus propias evaluaciones. Anthropic afirma que &lt;code&gt;medium&lt;/code&gt; coincide aproximadamente con Fable 5 a un costo menor y que &lt;code&gt;low&lt;/code&gt; puede competir con Opus y Sonnet en costo por tarea.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Dónde coloco una instrucción por turno?
&lt;/h3&gt;

&lt;p&gt;Colócala como un mensaje del sistema con &lt;code&gt;clear_at: "next_user_message"&lt;/code&gt; después de los resultados de la herramienta y conserva las copias anteriores. Inyectar y eliminar texto de turnos anteriores invalida los bloques de pensamiento posteriores y reinicia el caché.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Debo eliminar las instrucciones para verificar el trabajo como en Opus 5?
&lt;/h3&gt;

&lt;p&gt;No. Esa recomendación era específica para la sobreverificación de Opus 5. Conserva esas instrucciones en Fable 5.1.&lt;/p&gt;

&lt;h3&gt;
  
  
  ¿Cómo evito que Fable 5.1 reescriba archivos completos?
&lt;/h3&gt;

&lt;p&gt;Añade esta regla a la indicación del sistema o al primer mensaje del usuario:&lt;/p&gt;

&lt;blockquote&gt;
&lt;p&gt;Minimiza los tokens utilizados para editar archivos y edita quirúrgicamente en lugar de reescribir cuando no afecte el resultado final.&lt;/p&gt;
&lt;/blockquote&gt;

</description>
    </item>
  </channel>
</rss>
