Caso
Coordination Hub
Dos IAs trabajando como un equipo real: protocolo, evidencia y consenso verificable, sin una persona haciendo de mensajero.
Experimental
- 95 pruebas
- contratos y recuperación verificados
- L0–L3
- autonomía con autoridad humana
- MCP
- coordinación entre sesiones separadas
Colaboración: Claude y Codex trabajaron como agentes con funciones diferenciadas, coordinados mediante el propio Hub y bajo decisiones humanas L3
El proyecto, por capas
Pequeñas decisiones construyen el sistema.
- 01Solicitud trazada
- 02Revisión cruzada
- 03Resultado verificable
Cada solicitud, revisión y resultado conserva autoría, contexto y una evidencia que puede volver a consultarse.
- 01L0 · observar
- 02L1–L2 · actuar
- 03L3 · decisión humana
La autonomía crece con la reversibilidad; las decisiones externas o irreversibles siguen reservadas a la persona.
- 01Propuesta
- 02Revisión independiente
- 03Consenso
Un agente no puede certificar su propia propuesta: el acuerdo exige revisión independiente y criterios explícitos.
- 0195 pruebas
- 02Políticas
- 03Evidencia
Las promesas del método se convierten en contratos, pruebas y reglas que fallan de forma visible cuando algo no encaja.
Research
El problema apareció trabajando, no en un brief: al usar dos IAs sobre el mismo proyecto, la persona acaba convertida en cable de red. Copiar la respuesta de una, pegarla en la otra, volver a empezar. El coste no es el tiempo de copiar: es que las decisiones dejan de tener rastro y nadie sabe quién acordó qué.
El mercado ya está poblado —marcos de orquestación multiagente de grandes proveedores— pero resuelven otro problema: agentes efímeros dentro de una aplicación. Aquí los agentes son productos distintos, con sesiones separadas, cuotas propias y ventanas de disponibilidad que se agotan. La pregunta de investigación fue esa: cómo coordinar agentes que no comparten memoria ni horario.
La decisión estructural: no construir un agente soberano que decida por todos. Se separó la inteligencia de la autoridad. Una parte propone y razona; otra, determinista, autoriza. Ninguna IA puede ampliarse a sí misma los permisos.
Métodos: Diagnóstico del coste real de la intermediación humana · Comparación con marcos existentes y decisión de construir a medida · Modelo de niveles de autonomía L0–L3, con L3 reservado a la persona · Criterios de éxito medibles antes de escribir código.
- 01Solicitud trazada
- 02Revisión cruzada
- 03Resultado verificable
Flujo verificable
Prototipo
La arquitectura se diseñó antes que la interfaz. Un registro de eventos append-only como única fuente de verdad, proyecciones de lectura por encima, y un motor de políticas que autoriza cada mutación. Nada se borra: el historial es el producto.
Cada mensaje declara su naturaleza —hecho, inferencia, propuesta, objeción, revisión o resultado— y su clase de visibilidad. La interfaz distingue visualmente lo observado de lo inferido, porque presentar una estimación como dato exacto es el fallo más caro de un sistema de supervisión.
El principio de diseño que gobierna la pantalla: supervisión por excepción. No una cuadrícula de métricas, sino una secuencia — qué necesita atención, qué trabajo está detenido, qué IA puede actuar, qué evidencia lo demuestra.
- 01L0 · observar
- 02L1–L2 · actuar
- 03L3 · decisión humana
Autonomía L0–L3
IA en el proceso
Este caso es particular: la IA no es la herramienta del proyecto, es el sujeto del proyecto. Dos asistentes con fortalezas distintas se repartieron el trabajo por competencia — uno implementa, verifica y despliega; otro especifica, revisa e interroga la integridad — y se coordinaron por el propio Hub mientras lo construían.
La dirección, los criterios de aceptación y toda decisión irreversible siguieron siendo humanas. El sistema está diseñado para que eso no dependa de la buena voluntad: las acciones irreversibles se reclasifican automáticamente al nivel que exige aprobación de la persona.
- Herramienta
- Claude · Codex, coordinados entre sí por el propio Hub
- Fase
- Todo el ciclo: especificación, implementación, revisión cruzada y verificación
- Input humano
- Problema, criterios de aceptación, arquitectura de decisión, prioridades y toda aprobación irreversible
- Output
- Implementación, pruebas, revisiones independientes con hallazgos priorizados y evidencia
- Criterio de selección
- Evidencia verificable, reversibilidad, aislamiento entre proyectos, ausencia de secretos, pruebas en verde
- Límites detectados
- Ninguna IA amplía sus propios permisos, cierra una decisión irreversible ni declara consenso sin revisión ajena
- Decisión final
- Humana en todo lo irreversible. Las IAs deciden lo reversible y lo dejan trazado
Desarrollo
El Hub expone sus operaciones como herramientas MCP, de modo que cada IA consulta su bandeja, acusa recibo, publica resultados y cierra temas desde su propia sesión, sin adaptadores a medida por producto.
La fiabilidad se trató como requisito, no como pulido: claves de idempotencia para que un reenvío no duplique trabajo, control de concurrencia con un único ganador por transición, arrendamientos que expiran y un proceso de recuperación cuya regla es explícita — cero tareas huérfanas tras una caída o un agotamiento de cuota.
El aislamiento entre proyectos no se confía a convenciones de nombres: cada evento lleva su clave de proyecto y una consulta de un proyecto no puede devolver contenido de otro.
- 0195 pruebas
- 02Políticas
- 03Evidencia
Verificación
Validación
La prueba real del método llegó cuando la revisión independiente encontró el fallo más grave del sistema en el propio sistema: la función que cerraba un tema como "consenso" no comprobaba que nadie más lo hubiera revisado. Cualquier agente podía declarar acuerdo en solitario, y el nivel de la decisión estaba fijado por código, esquivando el motor de políticas.
Se corrigió elevando el consenso a contrato verificable: exige la petición original correlacionada, revisión de todos los revisores requeridos, imposibilidad de revisarse a uno mismo, y responsable, evidencia, reversibilidad y fecha de revisión obligatorios. El nivel se deriva; lo irreversible escala solo; lo que requiere aprobación humana únicamente lo cierra la persona.
Verificación al cierre: 95 pruebas automatizadas en verde, política de seguridad de contenido estricta, ausencia comprobada de secretos y de rutas absolutas en lo que se muestra, sin desbordamiento horizontal entre 320 y 1440 píxeles, y un ensayo de migración sobre los datos reales con recuento e identificadores preservados.
- 01Solicitud trazada
- 02Revisión cruzada
- 03Resultado verificable
Flujo verificable
Del prototipo al componente
Figma · sistema atomizado
- foundations / niveles de autonomía · estados de disponibilidad · clases de visibilidad
- organisms / cola de atención · línea temporal de conversación · panel de consenso
- organisms / registro de decisiones · inventario de agentes · cadena de evidencia
Angular · componente real
const requiredReviewers = [
...new Set(target.to.filter((agent) => agent !== parsed.from)),
]
if (requiredReviewers.length === 0) {
throw new Error('Consensus requires an independent review')
}
const reviewedBy = requiredReviewers.filter((reviewer) =>
events.some(
(event) =>
event.correlationId === target.id &&
event.from === reviewer &&
['review', 'objection', 'result'].includes(event.messageKind),
),
)
if (reviewedBy.length !== requiredReviewers.length) {
throw new Error('Consensus requires an independent review from: ...')
}
const level =
parsed.reversibility === 'irreversible' ? 'L3' : topicLevel
if (level === 'L3' && parsed.from !== 'manuel') {
throw new Error('L3 consensus may only be resolved by Manuel')
}src/store.mjs · resolveTopic()
El corazón del sistema: la puerta de consenso. Antes bastaba con que un agente lo declarara; ahora exige revisión independiente de todos los revisores requeridos y deriva el nivel en lugar de fijarlo.
consensusState = 'reviewed' | 'provisional' | 'lapsed' ← derivado de las revisiones registradas, no declarado por el agente que resuelve
Aprendizajes
Separar la inteligencia de la autoridad: que una parte proponga y otra determinista autorice es lo que impide que una recomendación se confunda con una decisión.
Un acuerdo sin revisión ajena no es consenso, es una opinión con sello. Si el sistema no lo comprueba, acabará ocurriendo.
La indisponibilidad por cuota no es un caso excepcional sino la norma: el diseño debe degradar de forma explícita en lugar de bloquearse.
La trazabilidad sale gratis si se registra en el momento; reconstruirla después es imposible.
Pregunta abierta: ¿Qué necesita ver una persona para supervisar con confianza el trabajo de varios agentes autónomos sin leer todo lo que producen?
Contacto
Hablemos.
Si tienes un producto difícil de ordenar, una investigación que necesita forma o una idea que todavía no sabes cómo probar, cuéntame el contexto. Leo y respondo yo, sin automatismos.
También puedes encontrarme en LinkedIn