<?xml version="1.0" encoding="UTF-8"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:dc="http://purl.org/dc/elements/1.1/">
  <channel>
    <title>DEV Community: Saul Hernandez</title>
    <description>The latest articles on DEV Community by Saul Hernandez (@saulemprendedor).</description>
    <link>https://dev.to/saulemprendedor</link>
    <image>
      <url>https://media2.dev.to/dynamic/image/width=90,height=90,fit=cover,gravity=auto,format=auto/https:%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Fuser%2Fprofile_image%2F4070320%2Fb9fd11d9-fc8e-448c-ad9c-c1f6d89a7f5b.jpg</url>
      <title>DEV Community: Saul Hernandez</title>
      <link>https://dev.to/saulemprendedor</link>
    </image>
    <atom:link rel="self" type="application/rss+xml" href="https://dev.to/feed/saulemprendedor"/>
    <language>en</language>
    <item>
      <title>Mi primer intento con agentes de IA fracasó. El problema no era el modelo</title>
      <dc:creator>Saul Hernandez</dc:creator>
      <pubDate>Sun, 09 Aug 2026 23:33:26 +0000</pubDate>
      <link>https://dev.to/saulemprendedor/mi-primer-intento-con-agentes-de-ia-fracaso-el-problema-no-era-el-modelo-4eoh</link>
      <guid>https://dev.to/saulemprendedor/mi-primer-intento-con-agentes-de-ia-fracaso-el-problema-no-era-el-modelo-4eoh</guid>
      <description>&lt;p&gt;Hace un año arranqué un piloto, con el respaldo de la empresa, para construir herramientas autónomas de IA sobre el trabajo de desarrollo.&lt;/p&gt;

&lt;p&gt;Un año después, dos desarrolladores del equipo entregaron el doble de los puntos que habían comprometido en un sprint — y el aumento no dependió de su seniority.&lt;/p&gt;

&lt;p&gt;Entre esas dos cosas hubo un fracaso completo. Empiezo por ahí, porque es la parte que nadie cuenta.&lt;/p&gt;

&lt;h2&gt;
  
  
  El piloto que se depreciaba solo
&lt;/h2&gt;

&lt;p&gt;Usé lo que se usaba entonces: orquestadores de agentes, roles, herramientas encadenadas. Cada agente con su prompt, su responsabilidad y su lugar en la cadena.&lt;/p&gt;

&lt;p&gt;Ayudaba. Y se depreciaba solo.&lt;/p&gt;

&lt;p&gt;El problema no era el modelo ni el framework — los dos hacían lo que prometían. Era que el conocimiento que yo les daba estaba &lt;strong&gt;congelado&lt;/strong&gt;. Cada agente sabía lo que yo había escrito en su prompt el día que lo escribí, y nada más.&lt;/p&gt;

&lt;p&gt;Y la mayor parte de lo que hace falta para tocar un sistema real no está escrita en ninguna parte. Está en la cabeza de la gente: por qué esa tabla tiene un campo raro, qué se rompe si tocás ese servicio, qué se decidió hace dos años y por qué nadie lo revirtió. Ese conocimiento vive sobre todo en los seniors, y no se transfiere escribiendo un prompt más largo.&lt;/p&gt;

&lt;p&gt;El sistema envejecía mientras el producto avanzaba. Cada semana sabía un poco menos del código sobre el que trabajaba.&lt;/p&gt;

&lt;p&gt;Lo dejé.&lt;/p&gt;

&lt;h2&gt;
  
  
  Un mes sin construir automatización
&lt;/h2&gt;

&lt;p&gt;Me tomé un mes de reinicio. No dejé de trabajar: seguí sacando mis tickets como siempre, con Cursor y Claude Code, las herramientas de todos los días. Lo que frené fue construir — no escribí una línea más de automatización en ese mes.&lt;/p&gt;

&lt;p&gt;Lo usé para leer y reenfocar. Fue el período en que Anthropic publicaba prácticamente todas las semanas, y me dediqué a entender qué estaba cambiando de verdad debajo del ruido.&lt;/p&gt;

&lt;p&gt;La pregunta con la que volví era otra. No &lt;em&gt;cómo hago un agente más listo&lt;/em&gt;, sino &lt;strong&gt;cómo dejo de perder el conocimiento&lt;/strong&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Documentación que no envejece
&lt;/h2&gt;

&lt;p&gt;Encontré una forma de documentar el histórico de decisiones del negocio. No la documentación que nadie actualiza y que a los tres meses miente — sino el registro de &lt;em&gt;por qué&lt;/em&gt; las cosas son como son: qué se decidió, contra qué alternativas y qué restricción lo motivó.&lt;/p&gt;

&lt;p&gt;Y le agregué la pieza que lo cambia todo: &lt;strong&gt;al terminar cada implementación, esa documentación se actualiza con el resultado.&lt;/strong&gt;&lt;/p&gt;

&lt;p&gt;Es un detalle chico y es toda la diferencia. El conocimiento deja de ser una foto y pasa a ser un registro vivo. El contexto deja de ser una suposición mía sobre lo que el agente necesita saber, y pasa a ser algo que el propio trabajo mantiene al día.&lt;/p&gt;

&lt;h2&gt;
  
  
  El experimento
&lt;/h2&gt;

&lt;p&gt;Lo probé conmigo. En mi máquina, sobre mis tickets del día, sin contarle a nadie.&lt;/p&gt;

&lt;p&gt;Los resultados fueron desproporcionados: la diferencia de tiempo entre un ticket chico y uno grande pasó a medirse en minutos, no en horas ni en días. No porque escribiera código más rápido — porque dejé de gastar el tiempo en reconstruir el contexto cada vez.&lt;/p&gt;

&lt;p&gt;Pero seguía viviendo en mi laptop.&lt;/p&gt;

&lt;p&gt;Que es donde vive casi todo lo que los desarrolladores construimos para nosotros mismos: la herramienta que te hace el doble de productivo y que nadie más usa, porque nunca salió de tu carpeta de scripts.&lt;/p&gt;

&lt;p&gt;Sacarlo de ahí fue el problema siguiente. Y resultó ser un problema de diseño, no de código.&lt;/p&gt;




&lt;p&gt;&lt;em&gt;Primer artículo de una serie de cinco sobre cómo construí un sistema de agentes que entrega software en producción.&lt;/em&gt;&lt;/p&gt;

</description>
      <category>agents</category>
      <category>ai</category>
      <category>llm</category>
      <category>softwareengineering</category>
    </item>
  </channel>
</rss>
