Saltar al contenido
Manuel García-Llera / Product Designer · Design EngineerContacto

Caso

Coordination Hub

Dos IAs trabajando como un equipo real: protocolo, evidencia y consenso verificable, sin una persona haciendo de mensajero.

Experimental

Coordination Hub

Trazabilidad, revisión independiente y autoridad humana.

Contexto
Producto propio · infraestructura de método, construida mientras se usaba
Contribución
Dirección de producto, arquitectura de decisión y definición de los contratos de supervisión humano‑IA
Stack
Node.jsMCPJSONLZodClaudeOpenAI/Codex
Año
2026
95 pruebas
contratos y recuperación verificados
L0–L3
autonomía con autoridad humana
MCP
coordinación entre sesiones separadas

Colaboración: Claude y Codex trabajaron como agentes con funciones diferenciadas, coordinados mediante el propio Hub y bajo decisiones humanas L3

El proyecto, por capas

Pequeñas decisiones construyen el sistema.

ClaudeDiseña · revisaEl usuarioDirige · decide L3CodexImplementa · verifica
  1. 01Solicitud trazada
  2. 02Revisión cruzada
  3. 03Resultado verificable
EvidenciaConsenso
Revisión independiente antes del consenso
01 / 04Flujo verificable

Cada solicitud, revisión y resultado conserva autoría, contexto y una evidencia que puede volver a consultarse.

ClaudeDiseña · revisaEl usuarioDirige · decide L3CodexImplementa · verifica
  1. 01L0 · observar
  2. 02L1–L2 · actuar
  3. 03L3 · decisión humana
EvidenciaConsenso
Revisión independiente antes del consenso
02 / 04Autonomía L0–L3

La autonomía crece con la reversibilidad; las decisiones externas o irreversibles siguen reservadas a la persona.

ClaudeDiseña · revisaEl usuarioDirige · decide L3CodexImplementa · verifica
  1. 01Propuesta
  2. 02Revisión independiente
  3. 03Consenso
EvidenciaConsenso
Revisión independiente antes del consenso
03 / 04Puerta de consenso

Un agente no puede certificar su propia propuesta: el acuerdo exige revisión independiente y criterios explícitos.

ClaudeDiseña · revisaEl usuarioDirige · decide L3CodexImplementa · verifica
  1. 0195 pruebas
  2. 02Políticas
  3. 03Evidencia
EvidenciaConsenso
Revisión independiente antes del consenso
04 / 04Verificación

Las promesas del método se convierten en contratos, pruebas y reglas que fallan de forma visible cuando algo no encaja.

Research

El problema apareció trabajando, no en un brief: al usar dos IAs sobre el mismo proyecto, la persona acaba convertida en cable de red. Copiar la respuesta de una, pegarla en la otra, volver a empezar. El coste no es el tiempo de copiar: es que las decisiones dejan de tener rastro y nadie sabe quién acordó qué.

El mercado ya está poblado —marcos de orquestación multiagente de grandes proveedores— pero resuelven otro problema: agentes efímeros dentro de una aplicación. Aquí los agentes son productos distintos, con sesiones separadas, cuotas propias y ventanas de disponibilidad que se agotan. La pregunta de investigación fue esa: cómo coordinar agentes que no comparten memoria ni horario.

La decisión estructural: no construir un agente soberano que decida por todos. Se separó la inteligencia de la autoridad. Una parte propone y razona; otra, determinista, autoriza. Ninguna IA puede ampliarse a sí misma los permisos.

Métodos: Diagnóstico del coste real de la intermediación humana · Comparación con marcos existentes y decisión de construir a medida · Modelo de niveles de autonomía L0–L3, con L3 reservado a la persona · Criterios de éxito medibles antes de escribir código.

ClaudeDiseña · revisaEl usuarioDirige · decide L3CodexImplementa · verifica
  1. 01Solicitud trazada
  2. 02Revisión cruzada
  3. 03Resultado verificable
EvidenciaConsenso
Revisión independiente antes del consenso

Flujo verificable

Prototipo

La arquitectura se diseñó antes que la interfaz. Un registro de eventos append-only como única fuente de verdad, proyecciones de lectura por encima, y un motor de políticas que autoriza cada mutación. Nada se borra: el historial es el producto.

Cada mensaje declara su naturaleza —hecho, inferencia, propuesta, objeción, revisión o resultado— y su clase de visibilidad. La interfaz distingue visualmente lo observado de lo inferido, porque presentar una estimación como dato exacto es el fallo más caro de un sistema de supervisión.

El principio de diseño que gobierna la pantalla: supervisión por excepción. No una cuadrícula de métricas, sino una secuencia — qué necesita atención, qué trabajo está detenido, qué IA puede actuar, qué evidencia lo demuestra.

ClaudeDiseña · revisaEl usuarioDirige · decide L3CodexImplementa · verifica
  1. 01L0 · observar
  2. 02L1–L2 · actuar
  3. 03L3 · decisión humana
EvidenciaConsenso
Revisión independiente antes del consenso

Autonomía L0–L3

IA en el proceso

Este caso es particular: la IA no es la herramienta del proyecto, es el sujeto del proyecto. Dos asistentes con fortalezas distintas se repartieron el trabajo por competencia — uno implementa, verifica y despliega; otro especifica, revisa e interroga la integridad — y se coordinaron por el propio Hub mientras lo construían.

La dirección, los criterios de aceptación y toda decisión irreversible siguieron siendo humanas. El sistema está diseñado para que eso no dependa de la buena voluntad: las acciones irreversibles se reclasifican automáticamente al nivel que exige aprobación de la persona.

Herramienta
Claude · Codex, coordinados entre sí por el propio Hub
Fase
Todo el ciclo: especificación, implementación, revisión cruzada y verificación
Input humano
Problema, criterios de aceptación, arquitectura de decisión, prioridades y toda aprobación irreversible
Output
Implementación, pruebas, revisiones independientes con hallazgos priorizados y evidencia
Criterio de selección
Evidencia verificable, reversibilidad, aislamiento entre proyectos, ausencia de secretos, pruebas en verde
Límites detectados
Ninguna IA amplía sus propios permisos, cierra una decisión irreversible ni declara consenso sin revisión ajena
Decisión final
Humana en todo lo irreversible. Las IAs deciden lo reversible y lo dejan trazado

Desarrollo

El Hub expone sus operaciones como herramientas MCP, de modo que cada IA consulta su bandeja, acusa recibo, publica resultados y cierra temas desde su propia sesión, sin adaptadores a medida por producto.

La fiabilidad se trató como requisito, no como pulido: claves de idempotencia para que un reenvío no duplique trabajo, control de concurrencia con un único ganador por transición, arrendamientos que expiran y un proceso de recuperación cuya regla es explícita — cero tareas huérfanas tras una caída o un agotamiento de cuota.

El aislamiento entre proyectos no se confía a convenciones de nombres: cada evento lleva su clave de proyecto y una consulta de un proyecto no puede devolver contenido de otro.

ClaudeDiseña · revisaEl usuarioDirige · decide L3CodexImplementa · verifica
  1. 0195 pruebas
  2. 02Políticas
  3. 03Evidencia
EvidenciaConsenso
Revisión independiente antes del consenso

Verificación

Validación

La prueba real del método llegó cuando la revisión independiente encontró el fallo más grave del sistema en el propio sistema: la función que cerraba un tema como "consenso" no comprobaba que nadie más lo hubiera revisado. Cualquier agente podía declarar acuerdo en solitario, y el nivel de la decisión estaba fijado por código, esquivando el motor de políticas.

Se corrigió elevando el consenso a contrato verificable: exige la petición original correlacionada, revisión de todos los revisores requeridos, imposibilidad de revisarse a uno mismo, y responsable, evidencia, reversibilidad y fecha de revisión obligatorios. El nivel se deriva; lo irreversible escala solo; lo que requiere aprobación humana únicamente lo cierra la persona.

Verificación al cierre: 95 pruebas automatizadas en verde, política de seguridad de contenido estricta, ausencia comprobada de secretos y de rutas absolutas en lo que se muestra, sin desbordamiento horizontal entre 320 y 1440 píxeles, y un ensayo de migración sobre los datos reales con recuento e identificadores preservados.

ClaudeDiseña · revisaEl usuarioDirige · decide L3CodexImplementa · verifica
  1. 01Solicitud trazada
  2. 02Revisión cruzada
  3. 03Resultado verificable
EvidenciaConsenso
Revisión independiente antes del consenso

Flujo verificable

Del prototipo al componente

Figma · sistema atomizado

  • foundations / niveles de autonomía · estados de disponibilidad · clases de visibilidad
  • organisms / cola de atención · línea temporal de conversación · panel de consenso
  • organisms / registro de decisiones · inventario de agentes · cadena de evidencia

Angular · componente real

const requiredReviewers = [
  ...new Set(target.to.filter((agent) => agent !== parsed.from)),
]
if (requiredReviewers.length === 0) {
  throw new Error('Consensus requires an independent review')
}

const reviewedBy = requiredReviewers.filter((reviewer) =>
  events.some(
    (event) =>
      event.correlationId === target.id &&
      event.from === reviewer &&
      ['review', 'objection', 'result'].includes(event.messageKind),
  ),
)
if (reviewedBy.length !== requiredReviewers.length) {
  throw new Error('Consensus requires an independent review from: ...')
}

const level =
  parsed.reversibility === 'irreversible' ? 'L3' : topicLevel
if (level === 'L3' && parsed.from !== 'manuel') {
  throw new Error('L3 consensus may only be resolved by Manuel')
}

src/store.mjs · resolveTopic()

El corazón del sistema: la puerta de consenso. Antes bastaba con que un agente lo declarara; ahora exige revisión independiente de todos los revisores requeridos y deriva el nivel en lugar de fijarlo.

consensusState = 'reviewed' | 'provisional' | 'lapsed' ← derivado de las revisiones registradas, no declarado por el agente que resuelve

Aprendizajes

Separar la inteligencia de la autoridad: que una parte proponga y otra determinista autorice es lo que impide que una recomendación se confunda con una decisión.

Un acuerdo sin revisión ajena no es consenso, es una opinión con sello. Si el sistema no lo comprueba, acabará ocurriendo.

La indisponibilidad por cuota no es un caso excepcional sino la norma: el diseño debe degradar de forma explícita en lugar de bloquearse.

La trazabilidad sale gratis si se registra en el momento; reconstruirla después es imposible.

Pregunta abierta: ¿Qué necesita ver una persona para supervisar con confianza el trabajo de varios agentes autónomos sin leer todo lo que producen?

Contacto

Hablemos.

Si tienes un producto difícil de ordenar, una investigación que necesita forma o una idea que todavía no sabes cómo probar, cuéntame el contexto. Leo y respondo yo, sin automatismos.

También puedes encontrarme en LinkedIn

Tu dirección se usa únicamente para responder a este mensaje.