zetarıx

Blog

Tres agentes, un mismo problema

Escrito en febrero de 2026 · 2 min de lectura

Las herramientas y modelos que menciona esta nota cambian rápido; conviene leerla con su fecha en mente.

Este mes GitHub presentó Agent HQ: un panel para correr varios agentes (Claude, Codex, Copilot) sobre la misma tarea, al mismo tiempo. La noticia recorrió la industria por lo que dice del momento: la pregunta ya no es qué asistente usar, sino cómo coordinar varios.

El anuncio le puso interfaz a una práctica que veníamos probando por nuestra cuenta, con resultados que valen la pena contar.

Una debilidad que se vuelve método

En noviembre escribimos sobre algo que frustra a cualquiera que trabaje con estas herramientas: los modelos no son determinísticos. El mismo pedido, tres veces, devuelve tres soluciones distintas, y ninguna es más «la respuesta» que las otras.

Visto desde el chat, eso es un defecto. Visto desde la coordinación de agentes, es materia prima: si las muestras son distintas, pedir varias y comparar es información gratis. Donde coinciden, hay señal de que el camino es sólido. Donde difieren, hay una decisión de diseño que estaba escondida y que alguien tiene que tomar a conciencia.

Cómo se ve en la práctica

Hace unas semanas encaramos una migración de datos espinosa, de esas que se hacen una sola vez y sin red. En lugar de pedir una solución, pedimos tres en paralelo.

Dos propuestas coincidían en la estructura general y diferían en el manejo de un caso borde con registros huérfanos. La tercera tomó un camino que descartamos, pero traía un manejo de errores más prolijo que el de las otras dos, y lo incorporamos a la versión final. El resultado combinó lo mejor de las tres, y la comparación nos mostró un caso borde que con una sola propuesta habríamos descubierto en producción.

El costo que no se cuenta

Revisar tres propuestas lleva bastante más tiempo que revisar una, y consume más recursos de máquina. Para la tarea cotidiana no se justifica: un agente bien dirigido alcanza y sobra.

Nuestra regla, por ahora, es simple. Paralelo para lo difícil de revertir: esquemas de datos, decisiones de arquitectura, migraciones. Un solo agente para todo lo demás. La comparación es un seguro, y los seguros se contratan para lo que no se puede deshacer.

El trabajo cambia de forma

Coordinar varios agentes se parece poco a programar y bastante a dirigir una revisión de diseño: leer propuestas, detectar dónde discrepan, preguntar por qué, y decidir. Es un trabajo de criterio más que de tipeo, y sospechamos que va a ocupar una parte creciente de la semana de cualquier equipo de software.

Las plataformas van a competir por hacer cómodo el panel. Lo que no viene incluido en ningún panel es el criterio para leer las diferencias. Ahí seguimos poniendo el esfuerzo.