Sistemas multiagente: cuándo varios agentes ganan a uno
Los diagramas multiagente son el artefacto más seductor de este campo. Cajas con cargos, flechas entre ellas, un coordinador arriba: parece un organigrama, y los organigramas dan sensación de progreso.
Luego llega producción y empiezan las preguntas: qué agente produjo este número erróneo, por qué lo aceptó el coordinador y por qué una petición cuesta ahora once llamadas al modelo. Esta guía trata de cuándo aun así compensa y cómo construir uno que siga siendo depurable.
Las tres condiciones#
Varios agentes compensan cuando se cumplen las tres. Las subtareas son de verdad independientes: ninguna necesita la salida de la otra para empezar. Cada una requiere herramientas distintas o un nivel de modelo distinto, de modo que especializar compra algo real. Y el trabajo es lo bastante lento como para que el paralelismo cambie la experiencia. Si solo se cumplen dos, un bucle con más herramientas casi siempre es mejor, más barato y más fácil de arreglar.
Dos agentes que deben hablar entre sí constantemente son un agente con un bus de mensajes caro.
Topologías y su coste#
| Topología | Cómo funciona | Perfil de coste | Fallo principal |
|---|---|---|---|
| Supervisor | Un agente delega en especialistas | N+1 bucles | El supervisor enruta mal |
| Tubería | Traspasos fijos, etapas especializadas | Predecible | Una etapa se degrada en silencio |
| Abanico paralelo | Misma tarea, varias miradas, fusión | El más alto | La fusión se vuelve cuello de botella |
| Debate o crítico | Uno propone, otro rebate | 2× por intercambio | Acuerdo sin criterio |
| Pizarra | Estado compartido, todos leen y escriben | Impredecible | Carreras y bucles |
Reglas que lo mantienen depurable#
- Cada agente con contrato escrito: qué recibe, qué devuelve y qué nunca debe hacer.
- Pasa objetos estructurados entre agentes, nunca prosa libre.
- Un identificador de ejecución para toda la petición, en cada llamada de cada agente.
- Limita el coste del sistema completo, no por agente.
- Prohíbe ciclos salvo con contador explícito y condición de salida.
- Que cada agente pueda devolver `no pude` y el coordinador lo maneje.
El problema de evaluación que nadie planifica#
Con un agente evalúas resultados. Con varios debes evaluar además los traspasos, porque el sistema puede dar una respuesta errónea con todos los agentes comportándose bien: el router eligió mal, o la fusión descartó la mitad importante. Construye evaluación en ambos niveles: resultados de extremo a extremo y pares entrada-salida por agente capturados de ejecuciones reales.
Un ejemplo que sí compensa#
La investigación competitiva encaja de verdad: dadas diez empresas, reunir información pública de cada una. Las subtareas son independientes, cada una es lenta y la fusión es una agregación simple. Diez agentes en paralelo terminan en el tiempo de uno y un sintetizador escribe el resumen. Compáralo con un agente de soporte para una pregunta: allí los pasos dependen en secuencia y dividir solo añade traspasos y latencia.
Preguntas frecuentes
¿Un supervisor mejora la precisión?
Solo si el enrutado acierta. Un 90 % delante de especialistas al 95 % da un 85 % de extremo a extremo, invisible sin medir aparte. Mantén pocos especialistas, describibles en una frase.
¿Compensa el debate entre agentes?
A veces, en juicios realmente discutibles y cuando puedes dar pruebas al crítico. En consultas factuales suele producir acuerdo al doble de coste. Mídelo contra una línea base de un solo paso.
¿Cómo depuro un fallo multiagente?
Con identificador compartido en cada llamada, entradas y salidas guardadas por agente y una vista de los traspasos en orden. Si no puedes reconstruir quién dijo qué a quién, acabarás reescribiendo prompts al azar.
sistemas multiagenteagente supervisorcolaboración de agentesagentes en paralelotraspaso entre agentes