Noticias techJul 2026 · 3 min de lectura

Construir software real con agentes de IA: el harness pesa más que el modelo

Tras un año publicando con agentes, la lección es aburrida e importante. El harness alrededor del modelo, las herramientas, el contexto, el bucle de verificación, pesa más que el modelo que elegiste.

Raudin Moreno
Raudin MorenoIngeniero de Software

La programación con agentes pasó de un autocompletado más listo a un bucle cerrado: el agente lee una tarea, planifica, edita varios archivos, corre las pruebas y el build, lee los fallos e itera. La duración media de sesión creció de unos minutos a comienzos de 2025 a más de veinte en 2026, lo que en realidad mide cuánto trabajo puede cargar un agente antes de necesitar a un humano.

El harness pesa más que el modelo

El hallazgo más útil de los equipos que corren agentes a escala es poco glamoroso: la mayoría de los fallos no son de capacidad, son de configuración. Un modelo más débil con buen harness, es decir, las herramientas correctas, un armado cuidadoso del contexto, un bucle de verificación y barandillas, le gana a un modelo más fuerte sin nada de eso. Si tu agente sigue fallando, arregla el harness antes de cambiar el modelo.

Desarrollo guiado por especificación

La disciplina que hace publicables a los agentes es externalizar la intención como artefactos. El bucle que se impuso es Especificar, Planificar, Tareas, Implementar, cada uno con un punto de control humano. Un archivo de constitución del proyecto lleva el contexto permanente para no reexplicar el stack en cada sesión.

# AGENTS.md ## Stack Next.js 16, TypeScript, Payload 3, MongoDB. ## Reglas - Server Components por defecto; "use client" solo en las hojas. - Corre pnpm lint y pnpm typecheck antes de cada commit. - Sin secretos en el código. Lee la config del entorno.

Los modos de fallo son reales

Los agentes encuentran el archivo correcto con fiabilidad, pero suelen errar las líneas exactas a cambiar. Las pruebas end-to-end se rompen de unas pocas maneras predecibles: selectores frágiles, supuestos de tiempo implícitos, deriva de esquema. Y una porción relevante del código generado, los estudios la ubican cerca de un cuarto a un tercio de los fragmentos, trae una debilidad de seguridad. La revisión independiente, no el agente revisando su propio PR, es innegociable, porque la autorevisión valida contra el mismo modelo que escribió el bug.

El tejido conectivo es MCP, el Model Context Protocol, que se volvió el estándar de integración como el USB-C para los cables. No es solo demo: una organización de ingeniería grande reportó decenas de miles de invocaciones de herramientas al mes por su MCP interno y miles de horas de ingeniería ahorradas.

El hilo conductor es que el criterio de ingeniería se movió aguas arriba. Los requisitos, la arquitectura y la revisión importan más que teclear. Quienes más provecho sacan de los agentes son los que escriben las especificaciones más claras y dejan que la máquina haga la parte mecánica.

Volver al blog© 2026 Raudin Moreno