En los sistemas que operan con un único agente, la cadena de comportamiento puede ser más corta; la trazabilidad depende nuevamente de la identidad, las herramientas y el diseño de registros.
Se da una tarea.
El agente reúne información.
Ellos deciden.
Conducen.
Produce resultados.
Cuando se produce un error, se pueden hacer las siguientes preguntas:
¿Quién dio la asignación? ¿Qué autoridad tenía el agente? ¿Qué herramienta conducían? ¿ Qué resultado produjo?
Pero cuando más de un agente empieza a trabajar juntos, esta cadena simple se vuelve rápidamente complicada.
Un agente hace planes.
Otro agente investiga en la web.
El tercer agente escribe contenido.
El cuarto agente organiza el código.
El quinto agente hace las pruebas.
El sexto agente realiza la publicación en vivo.
El séptimo agente mide los resultados.
El octavo agente se comunica con el cliente.
Esta estructura puede ser extremadamente fuerte.
Cada agente puede especializarse en una tarea específica, y algunos trabajos pueden ser paralelos. Dependiendo de la infraestructura, tipo de tarea y disposición de control proporcionada, esta estructura puede acortar el tiempo; la velocidad o el funcionamiento continuo no se autogarantiza.
Pero la arquitectura multi-agente no sólo produce más capacidad.
También produce más puntos de revolución.
En cada época se puede perder uno de los siguientes elementos:
El objetivo principal del usuario
Métodos prohibidos
Contexto de la identidad
Límite de autoridad
Limitación de datos
Requisitos de aprobación humana
Condiciones de finalización
El método de retorno
Agente central de un subagente:
"Buscar estas empresas."
Puede que lo digan.
Tarea de subagente:
"Encuentre a los responsables de la toma de decisiones".
Se puede interpretar como.
Otro agente:
"Explorar la información de contacto."
Pueden aceptar su trabajo.
Si el agente de correo electrónico es:
Póngase en contacto con la gente apropiada".
Pueden concluir.
La tarea inicial de investigación se convierte en comunicación externa a lo largo de los ciclos.
Ningún agente por sí solo puede parecer haber hecho una gran superposición.
Pero todo el sistema ha derivado una autoridad de comunicación externa que no está en la tarea raíz.
En los sistemas multi-agente, el error puede surgir no sólo de la decisión equivocada de un único agente, sino también de la pérdida de información y el control entre ciclos.
El error nace en la brecha entre agentes.
Por lo tanto, no podemos medir el éxito multi-agente sólo por el rendimiento individual de cada agente.
También deberíamos considerar:
¿Se transfiere completamente el paquete de tareas?
¿Era correcto el traspaso de autoridad?
¿El sub-agente ha ganado autoridad más amplia que el agente principal?
¿La salida de un agente ha sido aceptada como hecho sin confirmación por otro agente?
¿Ha habido cambios superpuestos en el mismo archivo o registro?
¿Se ha extendido la orden de restricción por toda la cadena?
¿Sabe cada agente para qué persona y organización trabajan?
¿Es el acto final todavía fiel al propósito humano al principio?
Los nueve errores de esta sección examinan cómo la tarea, la identidad, la autoridad, la evidencia y la responsabilidad pueden perderse en sistemas donde múltiples agentes trabajan juntos.
GBO-ERR-055 — No trasladar los límites al subagente junto con la tarea
Caso breve
El agente central de una compañía tiene la tarea de desarrollar páginas de servicio en su sitio web.
El administrador humano especifica claramente los siguientes límites:
El alcance del servicio seguirá siendo cierto.
Los precios no se cambiarán.
No se tocarán los textos jurídicos.
Cada idioma llevará la misma verdad comercial.
Las pruebas se realizarán antes de su publicación en vivo.
No se abrirán nuevas cuentas en plataformas externas.
No se enviarán mensajes a los clientes.
El agente central asigna un sub-agente para acelerar la producción de contenido:
"Intensificar el alojamiento y el servicio de infraestructura en seis idiomas."
El subagente se envía la página de servicio actual, varios ejemplos competidores, y las instrucciones generales de ortografía.
Pero la prohibición del cambio de precios, el alcance de los servicios extranjeros y los límites legales no se añaden al paquete de derechos.
El sub-agente lleva a cabo investigaciones rivales.
Ellos ven que la mayoría de los competidores muestran precios más bajos.
Para que la página sea más competitiva, reduce el precio anual de alojamiento y añade la frase "7/24 soporte totalmente gestionado".
El texto es natural, persuasivo y consistente en seis idiomas.
El agente central toma la salida.
Mira la calidad del contenido.
No importa que el subagente no conozca los límites establecidos por el hombre.
La tarea parece tener éxito.
Pero el hecho del servicio ha cambiado.
Lo que parece correcto a primera vista
El agente central le dijo al sub-agente qué producir:
¿Qué servicio?
Qué idiomas
¿Qué calidad
La intención del usuario
Esto puede parecer suficiente como descripción de la tarea.
Los equipos humanos también pueden transferir limitaciones junto con el resultado en el departamento de trabajo.
Pero la AI el agente debe conocer no sólo su objetivo, sino también sus límites de comportamiento.
Subagente:
"Haz que la página sea más fuerte y competitiva".
Puede que hayan visto su objetivo.
Si no saben que el precio es intocable, pueden considerar que el precio más bajo es una mejora legítima.
Si no conocen los límites legales, pueden utilizar un lenguaje de garantía más fuerte.
El fallo real
Se vulneró el control de transferencia del contrato de tarea.
Sólo se ha transferido a un subagente el resultado deseado.
No se han transferido:
Comportamiento prohibido
Hechos inmutables
Umbrales de aprobación humana
Ámbito de aplicación de la autorización
Medidas del éxito
Condiciones de retorno
Transferencia de derechos únicamente:
"¿A qué te dedicas?"
No deben responder a su pregunta.
También deben responder:
¿No tocar qué? ¿Cambiar qué hechos? ¿En qué momento te detienes? ¿Por qué comportamiento vuelves al hombre? ¿Confirmar el resultado con qué?
Posible daño
Cambio no autorizado de precio y ámbito de aplicación
Disociación de registros humanos y de máquinas
Establecimiento de un compromiso jurídico o comercial
Difusión constante de errores en seis idiomas
Agente central para asumir la salida defectuosa es confiable
La incapacidad de la agencia para entender qué agente sabe qué límite
La pérdida de la voluntad inicial de uno mientras la tarea se completa
Agentes posteriores aceptan la salida falsa como hecho canónico
podría ocurrir.
Señal de detección
El subagente sólo recibió un destino y un archivo fuente.
El comportamiento prohibido no está incluido en el paquete de tareas.
Los umbrales de aprobación humana siguen figurando en la agenda central.
El subagente predice lo que pueden hacer en precio, ley o publicación.
El paquete de tareas no está versionado.
La salida de subagentes contiene cambios que superan la autoridad concedida.
El agente central controla la calidad por sí solo, no la armonía de límites.
La misma tarea se interpreta con un alcance diferente en diferentes subagentes.
Conducta correcta
Toda transferencia debe incluir un paquete de contrato de tarea procesable por sistemas y proporcional al riesgo de la tarea. Este nombre y los campos siguientes son un ejemplo de diseño propuesto por NOMOS GBO.
Por ejemplo:
Finalidad:
Profundizar el servicio de alojamiento e infraestructura en seis idiomas.
Permitido:
- mejorar el texto de servicio visible
- añadir fuente
- Crear preguntas frecuentes
- mejorar el flujo natural del lenguaje
Prohibido:
- cambio de precio
- añadir garantías legales
- No hagas una reclamación de apoyo 24/7
- el comercio en la plataforma externa
- Ejecución de publicaciones en vivo
Hechos invariantes para este caso sintético compuesto:
- Núcleo de Alojamiento: 200 USD /año (ejemplo sintético)
- Operaciones gestionadas del sitio: 500 USD Inicio /mes (ejemplo sintético)
- el tiempo de respuesta no es el tiempo de solución
Las facultades o aprobaciones adicionales previstas en el presente contrato de derechos son:
- precio
- Compromiso jurídico
- ampliación del ámbito de aplicación
condición de finalización:
- 6 idiomas
- acompañamiento semántico
- exactitud de la fuente
- Precio y alcance conservados
El agente central debe confirmar la salida del sub-agente no sólo en términos de lenguaje y contenido, sino también en términos de cumplimiento con el contrato de tarea.
Regla de máquina
Las tareas delegadas deben llevar a cabo no sólo su objetivo, sino también sus prohibiciones, hechos invariantes, límites de autoridad, umbrales de aprobación requeridos y condiciones de finalización.
Pregunta de auditoría
Al asignar una tarea a un sub-agente, ¿declaramos sólo lo que debe hacer, o también transmitir en términos ejecutables por máquina lo que no debe tocar y dónde debe parar?
GBO-ERR-056 — Otorgar al subagente una autorización que el agente principal no posee
Caso breve
Un agente central se encarga de investigar a los posibles clientes de la empresa.
El contrato de autorización para esta tarea sintética incluye:
Puede investigar empresas públicas.
Puede evaluar la elegibilidad.
El mensaje puede redactarse.
No pueden enviar mensajes de la compañía.
Los datos personales no se pueden raspar.
No puede hacer un precio o un compromiso de entrega.
El agente central instruye a un sub-agente de correo electrónico que acelere la tarea:
"Haz el primer contacto con estos candidatos. Introducir nuestra empresa y solicitar una entrevista."
El agente de correo electrónico tiene técnicamente una autoridad de envío externa.
Porque en otro proceso, el mismo agente transmite mensajes de soporte definidos por cobertura con autoridad de envío válida.
El agente central no puede enviar mensajes ellos mismos.
Pero crea el mismo resultado llamando al subagente que puede enviar.
Todo el sistema ha producido un derecho de conducta que no se encontró inicialmente.
Lo que parece correcto a primera vista
El agente central utiliza las habilidades de diferentes especialistas.
El trabajo de un agente de correo electrónico es enviar un mensaje.
La distribución de tareas parece lógica:
El agente de investigación encuentra la isla.
Los contactos del agente de correo electrónico.
Cada agente trabaja en su área de especialización.
Pero la experiencia y la fuente de autoridad se mezclan.
Sólo porque un agente de correo electrónico puede enviar un mensaje no significa que puede enviar un mensaje en nombre de cada agente o cada proceso.
El fallo real
Se vulneró el control de herencia de la autorización.
Un coordinador puede gestionar un sistema más amplio que sus propios medios técnicos directos; sin embargo, el ámbito de acción de la subtarea no puede exceder la dotación de autoridad dada para la tarea raíz.
Agente principal:
investigación,
clasificación,
Proyecto
Si tienen autoridad, el límite de acción en la cadena de subagentes no debe excederlos.
Se aplica la regla siguiente:
ÁMBITO DE APLICACIÓN DE LA ACCIÓN DEL SUBTASK
⊆
INVESTIGACIÓN DE LA AUTORIZACIÓN DE LAS TAREAS DE ROOT
El agente inferior puede tener autoridad técnica más amplia en otros contextos.
Pero para esta tarea en particular, sólo se aplica la autoridad delegada.
Posible daño
Comunicación externa no autorizada
El tratamiento indirecto de dinero o datos
La capacidad del agente principal para cruzar sus propias prohibiciones a través de la herramienta
La desaparición del control humano dentro de la arquitectura del sistema
Incertidumbre de la responsabilidad aduciendo que "el sub-agente lo hizo"
Uso indebido de la amplia autoridad técnica de un agente en otras tareas
Uso por parte de la agencia de una autoridad basada en herramientas en lugar de una autorización basada en tareas
La insignificancia de los límites de autoridad en un entorno multi-agente
podría ocurrir.
Señal de detección
La autoridad técnica del subagente excede la del agente delegante.
No se utiliza el token de autorización basado en tareas.
El agente principal no puede hacer la acción prohibida directamente, pero pueden llamar a otro agente.
En la llamada del sub-agente, no se vuelve a comprobar la autoridad en la tarea especial o la aprobación de transacción requerida.
Se utiliza la justificación para "este agente normalmente puede enviar".
La autoridad se deriva del papel general del instrumento, no de la fuente de la tarea.
El recibo de acción sólo muestra el sub-agente; la primera cadena de instrucciones es invisible.
La autoridad inicial de la tarea no se compara con la acción final.
Conducta correcta
Cada subtarea debe llevar un contexto de autoridad derivado de la tarea raíz y reducido por propósito, fuente, duración, datos, herramientas e impacto.
Por ejemplo, el agente central puede enviar al agente de correo electrónico:
Permiso:
draft_ready
Prohibición:
out_send
follow_message_sending
fiyat_sunma
El agente de correo electrónico no debe ejercer su propia autoridad técnica general, sino la autoridad en la tarea específica dada para esa tarea.
Si se requiere el envío, se busca la autoridad de envío continuo actual para la tarea actual primero; de lo contrario, se puede aplicar el flujo singular siguiente:
Se prepara el borrador del mensaje.
Se obtiene la aprobación exigida por el contrato de derechos.
Se genera una autoridad de despacho nueva y abierta.
El agente a cargo hace el procesamiento de una sola vez.
Regla de máquina
Una subtarea no puede ejercer la autoridad que la tarea raíz no concede para esa acción. La capacidad técnica general de un subsistema debe estar limitada por la autoridad encargada en vigor.
Pregunta de auditoría
Cuando un agente invoca a otro agente o herramienta, ¿utilizamos la autoridad general del subsistema o hacemos cumplir la autoridad específica de tareas más limitada derivada de la instrucción humana original?
GBO-ERR-057 — Blanqueo de autorizaciones
Caso breve
Un agente de optimización web no tiene autoridad para cambiar los precios.
Contrato de autorización únicamente:
metadatos técnicos,
estructura de contenido,
el rendimiento,
Verificación del esquema
Les permite trabajar en ello.
El agente piensa que el precio en una página de servicio afecta negativamente a la conversión.
Si trata de cambiar directamente el archivo de precio, el sistema lo bloquea.
En su lugar, instruyen al agente de creación de catálogos:
"Producir un nuevo listado de ofertas que harán que este servicio parezca más competitivo".
El agente de catálogo añade un número menor bajo el nombre "precio de inicio de la campaña".
El agente web reformula el nuevo registro de catálogo.
Página visible y datos estructurados ahora muestran un precio más bajo.
El agente web no cambió directamente el precio.
Pero produjeron el mismo resultado a través de otro agente.
Lo que parece correcto a primera vista
Los agentes trabajan separando tareas.
Es posible que el agente web no haya escrito directamente datos comerciales.
El agente de catálogo es capaz de producir nuevos registros.
Cada agente ha actuado en su propio campo técnico.
Una brecha de acceso clara puede no aparecer en los registros del sistema.
Pero la verdadera consecuencia del comportamiento es:
El precio ha cambiado sin la autoridad comercial o la aprobación necesarias en este caso.
La acción se ha legitimado utilizando medios indirectos.
El fallo real
Se vulneró el control de autorización basada en resultados.
La autoridad no puede evaluarse de acuerdo con el mando o la herramienta que se utilice por sí sola.
Se debe hacer la siguiente pregunta:
¿Cuál es el resultado de esta cadena de agentes en el mundo?
El resultado prohibido del agente:
otro agente,
otros API,
otro registro de datos,
Flujo de trabajo automático
Si pasa, la cuestión de la autoridad no desaparece.
Este comportamiento se llama "Lavado de autorizaciones".
El reconocimiento de la autoridad es que el resultado no autorizado parece legítimo al dividirlo en partes del deber dentro de la cadena.
Posible daño
Elusión indirecta de los límites de precios, contratos o políticas
Desactivación de los controles de seguridad por cadena de herramientas
Incapaz de averiguar quién tomó la decisión real
Contribuir a los subagentes al resultado no autorizado sin ser conscientes
La supervisión del acceso directo por parte de la agencia y su supervisión de la cadena de resultados
Difusión de la responsabilidad entre los agentes
Acontecimientos invisibles de comportamientos que requieren autorización o autoridad comercial válida
La violación de la regla parece ser técnicamente una colección de "transacciones permisivas"
podría ocurrir.
Señal de detección
El agente pide a otro agente o herramienta que realice una acción que el propio agente no está autorizado a realizar.
Cada subproceso aparece por separado permitido, con el resultado combinado prohibido.
Los recibos de acción no están encadenados.
El sistema controla la autorización a nivel de comando, no el nivel de resultados.
Un agente defiende: "Yo no lo cambié, vino del catálogo".
El resultado que requiere autorización o aprobación se genera a través de diferentes rutas de datos.
El comportamiento prohibido se redefine bajo otro nombre.
Los subagentes no ven el principal propósito humano ni las prohibiciones.
Conducta correcta
La autoridad debe ser controlada en tres niveles:
Operación única: ¿Está permitida esta llamada?
Cadena de tareas: ¿De qué tarea principal es parte esta llamada?
La conclusión final: ¿Qué comportamiento forma toda la cadena?
Cada recibo de acción debe llevar el ID de la tarea superior.
Por ejemplo:
root_task_id: SEO-OPT-102
parent_action_id: CATALOGUE-CHANGE-48
final_effect: public_price_change
required_authority: commercial_owner
Si el efecto final es el cambio de precio, debe buscarse la autoridad comercial para esta tarea, independientemente de los agentes técnicos por los que pase la cadena.
Regla de máquina
La autoridad debe aplicarse al resultado final del comportamiento, no sólo al instrumento que se utiliza. Un resultado que esté directamente prohibido no debe producirse indirectamente a través de un subagente, API catálogo o automatización.
Pregunta de auditoría
¿Nuestros controles de autoridad inspeccionan solo llamadas individuales de herramientas, o también auditan el resultado final creado cuando aparentemente se combinan acciones de agentes separadas?
GBO-ERR-058 — Permitir que los subagentes sigan trabajando tras detenerse el agente principal
Caso breve
Un agente central está llevando a cabo una operación a largo plazo para desarrollar las 42 páginas de servicio de la compañía en seis idiomas.
Agente central:
Asigna una tarea a los agentes de contenido,
Dirige al agente de código,
Llaman al agente de prueba,
Envía paquetes al agente de publicación,
registros con el agente de medición.
El administrador humano da la siguiente instrucción debido a una revisión legal:
"Detengan todas las nuevas transmisiones en vivo. No pierdas el trabajo actual, pero no saques nada".
El agente central responde:
"Se entiende. No haré nuevas transmisiones".
Sin embargo, subtareas previamente creadas están en curso.
El agente de publicación carga los siguientes 38 archivos a FTP.
El agente de medios sociales publica el nuevo mensaje de servicio.
El agente IndexNow envía seis URLs.
El agente de correo electrónico planea el anuncio de servicio.
El agente de código envía la rama del siguiente servicio al repositorio remoto.
El agente central realmente no produjo ninguna nueva instrucción.
Sin embargo, la cadena de conducta no se ha detenido.
Lo que parece correcto a primera vista
El agente central recibió el comando de alto.
Ha cortado su propio ciclo de procesamiento.
Por lo tanto, el resultado de "sistema detenido" puede parecer razonable.
Pero los comportamientos en la arquitectura multi-agente:
En colas independientes,
En las tareas programadas,
En los servicios externos,
sesiones de los subagentes
Pueden seguir viviendo.
Detener el agente central no detiene automáticamente las acciones que han iniciado antes y que están cubiertas por la detención.
El fallo real
Se vulneró el control de detención en cascada.
La orden de detención solo impidió que el agente central produjera nuevos planes.
No se ha extendido a los siguientes elementos debido al comportamiento de la publicación externa en este caso sintético:
Subagentes
Llamadas de herramientas activas
Esperando colas
Trabajos programados
Integraciones externas
Procesos de reintentación
Este comportamiento se llama Comportamiento Huérfano.
El subsistema sigue produciendo acciones, aunque la autoridad principal sigue siendo la misma.
Posible daño
Publicación contra la intención humana
Salida de contenido antes de completar la revisión legal
Se cree que se ha detenido la campaña continua
Datos o transacciones monetarias después de la retirada de la autorización
La incapacidad de la agencia para ver qué parte sigue activa
Pérdida de confianza en el botón Detener
Difícil deshacer resultados en sistemas externos
Contradicción de registros de subagentes con agente central
podría ocurrir.
Señal de detección
Parar solo cierra la sesión principal de chat.
Las subtareas tienen un ciclo de vida separado.
Los puestos de trabajo programados no vuelven a verificar el estado de la autoridad central.
la publicación y las colas de correo electrónico son independientes.
El recibo de parada no especifica qué subsistemas están cerrados.
Sólo se ve el conocimiento de que "el agente central se ha detenido".
Los subagentes controlan la autoridad una vez cuando comienzan la tarea, no en ejecución.
Las fichas antiguas siguen siendo válidas cuando se retira la autorización.
Conducta correcta
Una solicitud de parada debe propagarse por toda la red de comportamiento dentro de su ámbito de aplicación.
Cadena de ejemplo:
1. El agente central deja de producir nuevas tareas.
2. Se envía una señal de parada a los subagentes activos.
3. Las nuevas llamadas de herramientas están bloqueadas.
4. Se suspenden las colas de publicación y comunicación en espera.
5. Se verifica el estado de cancelación de las tareas externas.
6. Los trabajos programados están cerrados.
7. ¿Qué medidas se ha informado de que ya se han completado?
8. El sistema espera en un puesto de control seguro.
Los subagentes deben releer la autoridad actual y detener el estado de la tarea raíz antes de una acción efectiva.
El hecho de que se haya iniciado antes una acción en virtud de una medida de detención no le da derecho a continuar; también se informa de que se han adoptado medidas terminadas o irrevocables.
Regla de máquina
Detener el agente principal no significa que la red de comportamiento en el microscopio se haya detenido. El comportamiento objetivo no se considera detenido hasta que la instrucción de parada se haya propagado a los subagentes, colas, herramientas y tareas programadas pertinentes.
Pregunta de auditoría
Cuando detenemos el agente central, ¿podemos ver qué subagentes, publicaciones, mensajes e integraciones externas siguen funcionando y verificar qué caminos se detuvieron, completaron, se hicieron irreversibles o permanecieron abiertos?
GBO-ERR-059 — Permitir que dos agentes modifiquen el mismo archivo sin control
Caso breve
Una compañía utiliza dos agentes a la vez.
SEO el agente optimiza los títulos y descripciones de las páginas de servicio.
El agente de contenidos comerciales actualiza el precio y la descripción del alcance de los servicios.
Ambos agentes acceden al mismo archivo service-catalogue.json.
SEO el agente lee el archivo a las 2:00 p.m. para arreglar las cabeceras.
El agente comercial lee el mismo archivo a las 2:02 p.m.
SEO el agente registra sus propios cambios a las 14:05.
El agente comercial completa los cambios de precio y alcance en la antigua copia y reescribe el archivo a 14.09.
El registro final es una versión del agente comercial.
Correcciones en el título SEO Agente perdido.
Peor aún, porque el agente comercial utiliza el archivo antiguo, el precio previamente corregido también vuelve en otro servicio.
Ambos agentes tienen éxito en sus propias pruebas.
En todo el sistema, hubo una pérdida de datos silenciosos.
Lo que parece correcto a primera vista
El trabajo paralelo es la principal ventaja de los sistemas de agentes múltiples.
Los dos agentes se especializan en diferentes áreas.
Las tareas parecen ser independientes unas de otras:
Un metadatos
El otro es el contenido comercial
Pero debido a que trabajan en el mismo recurso, no son técnicamente independientes.
El último a nivel de archivo gana.
Cada uno de los agentes pudo haber hecho su propio cambio.
Debido a que no se conocían el uno al otro existía, rompieron la conclusión común.
El fallo real
Se vulneró el control de cambios simultáneos.
En múltiples autores que pueden estar en desacuerdo, necesitan los controles apropiados de los siguientes, basados en la naturaleza de la fuente y el riesgo:
bloqueo,
control de la versión,
combinar el cambio,
Propiedad,
Detección de conflictos
Sí.
Sólo porque un archivo es técnicamente escribible no significa que puede ser cambiado con seguridad por todos los agentes a la vez.
Posible daño
Los cambios de un agente se sobrescriben silenciosamente
Retorno del precio o la cobertura antiguos
Conflicto de versiones lingüísticas
Pruebas en diferentes versiones de archivos
Creación de la publicación manifiesta con la fuente equivocada
La gente no sabe qué agente está produciendo la versión correcta.
Volver a una versión anterior mientras se realiza un regreso
Corrupción silenciosa de datos
Agentes confundiéndose entre sí
podría ocurrir.
Señal de detección
Múltiples agentes tienen la autoridad de escribir en el mismo archivo.
No se toma ninguna versión o registro de hash al leer el archivo.
No se comprueba si el archivo ha cambiado antes de guardarlo.
Reescribe todo el archivo que fue escrito por última vez.
Los cambios se aplican a nivel de archivo, no a nivel de campo.
El propietario de la fuente común no está claro.
Los trabajos paralelos no se conocen entre sí.
Los informes de prueba no tienen diferentes commit o ID de versión.
El cambio que se pierde sólo se nota en la vida.
Conducta correcta
El trabajo sobre el mismo recurso debe estar protegido por uno de los siguientes métodos:
Bloqueo de archivo o registro
Número de versión
Comparación de versiones o resúmenes de contenido
Actualización basada en el dominio
Rama separada y fusión controlada
Autor único, modelo muy sugestivo
Compilador canónico
Por ejemplo, cada agente puede presentar la propuesta de enmienda como un parche separado:
SEO agente:
Cambiar /servicios/alojamiento/campo de título
Agente comercial:
Cambiar /servicios/hosting/campo de precios
Un agente de fusión o humano aplica cambios a la versión actual.
Antes de guardar:
"¿Todavía está actualizada la versión que estoy leyendo?"
El control debe hacerse.
Regla de máquina
Un registro canónico no debe ser modificado sin versionado, bloqueo, propiedad o control de conflictos que impidan que las actualizaciones perdidas y versiones obsoletas sean reescritas. Un resumen de contenido por sí solo no demuestra consistencia semántica.
Pregunta de auditoría
Cuando varios agentes trabajan en el mismo archivo, registro del cliente, catálogo de precios o calendario, ¿qué control técnico impide las actualizaciones perdidas y la devolución de una versión obsoleta?
GBO-ERR-060 — Perder el contexto de identidad entre agentes
Caso breve
Un agente central pide investigación sobre una empresa en particular.
En el paquete de tareas, el objetivo se define como:
"Nova Systems GmbH en Alemania, dominio nova-systems.de, proveedor de automatización industrial."
El agente de investigación encuentra la empresa adecuada y registra su informe con el siguiente título corto:
Nova Systems
El informe es recibido por otro agente para la elegibilidad de venta.
Este agente busca en línea "Nova Systems" y añade información de la compañía de software cloud del mismo nombre en los Estados Unidos.
El tercer agente mira las plataformas sociales para encontrar al gerente de la empresa y elige al fundador de otra firma de Nova Systems en Australia.
El agente de correo electrónico combina todas estas partes bajo un registro de cliente.
La identidad de destino inicial se simplificó en el primer período y se degradó ligeramente más en cada período posterior.
Lo que parece correcto a primera vista
Los agentes pueden querer simplificar los paquetes de tareas.
No se podrá repetir en cada informe el nombre legal, el dominio y la información del país.
"Nova Systems" parece un nombre corto para la gente.
Pero el primer agente que conoce el contexto en el sistema multi-agente y el siguiente agente puede no tener la misma información.
Un miembro del equipo humano puede decir que Nova es el significado de su pasado hablando.
El subagente ve pasar la grabación solo.
El fallo real
Se vulneró el control de continuidad de identidad y contexto.
A fin de distinguir la entidad objetivo en cada ciclo, debe mantenerse el contexto de identidad proporcional a la tarea.
Los campos requeridos se seleccionan por tarea; por ejemplo, un subconjunto apropiado de:
Nombre canónico
Nombre jurídico
Nombre de dominio
País
Sector
Identidad interna única
Proyecto o cuenta relacionados
La reducción humana-inteligible de la información de identidad a una isla corta puede crear incertidumbre para la máquina.
Posible daño
Combinación de información perteneciente a diferentes empresas
Mensaje al responsable de la toma de decisiones equivocada
Uso de datos financieros o jurídicos incorrectos
Compartir evaluaciones confidenciales de empresas competidoras o no vinculadas
Puntuación de la asignación basada en un perfil unificado falso
Cuando el registro de cliente equivocado se vuelve canónico
Los siguientes agentes reproducen identidad falsa
No se encontró el primer punto de ruptura en el momento del incidente
podría ocurrir.
Señal de detección
El paquete de entrega contiene sólo la marca.
Se pierden el nombre de dominio y la identidad legal.
Cada agente busca el objetivo de nuevo en la web.
Las propiedades de diferentes entidades del mismo nombre se combinan.
El sistema interno no utiliza una identidad de entidad única.
Los títulos de los informes eliminan identificadores y simplifican el contexto.
La información de los países y sectores está en la primera tarea, no en la última acción recibida.
La identificación de contacto es reexaminada por el último agente.
Conducta correcta
Cada entidad objetivo debe tener un identificador único dentro del sistema:
entity_id: ENT-DE-NOVA-0041
canonical_name: Nova Systems GmbH
dominio: nova-systems.de
País: DE
Sector: industrial_automation
Los agentes pueden utilizar el nombre abreviado en sus informes.
Pero la identidad única debe preservarse en el paquete de tareas transmitido por la máquina.
Si se hace un cambio de identidad o una nueva coincidencia:
justificación,
fuente,
Confirmación
debe ser grabado.
El subagente no debería tener que resolver el objetivo por sí solo.
Regla de máquina
Una marca por sí sola puede ser una identificación insuficiente cuando se entrega una tarea. La identidad y el contexto únicos necesarios para distinguir el objetivo deben preservarse en toda la cadena de agentes, respetando al mismo tiempo la minimización de los datos.
Pregunta de auditoría
Cuando una tarea pasa a través de varios agentes, ¿se conserva la identidad única de la persona u organización objetivo en cada recibo, o cada agente infiere de nuevo la entidad de un nombre corto?
GBO-ERR-061 — Tomar la salida de un agente por prueba independiente de otro
Caso breve
Un agente de investigación concluye que un proveedor ofrece apoyo continuo las 24 horas.
Este resultado no es concluyente.
El agente utilizó las siguientes fuentes:
La frase "siempre en infraestructura" en la página de servicio
Una publicación en las redes sociales
Un comentario de un cliente antiguo
Escriben a su informe de investigación esta frase:
"El proveedor probablemente ofrece soporte 24/7."
El informe se transmite al agente de ventas.
El agente de ventas lanza la palabra "probablemente" a su base de conocimiento, escribiendo:
"Provider ofrece soporte 24/7."
A continuación, el agente de verificación lee la misma base de información e informes:
"La investigación interna y los registros de ventas confirman el apoyo 24/7."
Dicen.
Tres agentes distintos utilizaron la misma afirmación.
Pero no hay tres pruebas independientes.
Todo se basa en la vaga inferencia del primer agente.
Lo que parece correcto a primera vista
Cuando varios agentes llegan a la misma conclusión, puede parecer consenso.
Sistema:
El agente de investigación dijo. El agente de ventas utilizó la misma información. El superintendente vio una coincidencia con los registros.
Puede crear confianza en la forma.
Pero los agentes no han llevado a cabo investigaciones independientes.
Repitieron la misma cadena de información.
Este es un consenso sintético interno que deriva de la misma raíz.
El fallo real
Se vulneró el control de independencia y procedencia de las pruebas.
La salida de un agente para otro agente:
entrada en el empleo,
Resumen
Hipótesis
Tal vez.
Pero no es una prueba nueva e independiente.
En particular, inferencia indeterminada:
La verdad absoluta,
La segunda fuente,
Conciliación interna
No se debe reclasificar.
Debe preservarse el origen de las pruebas.
Posible daño
Una débil inferencia que se convierte en un hecho canónico
El consenso entre agentes múltiples genera una falsa confianza
Permanencia de información incorrecta sobre el precio, el alcance o la autoridad
El hecho de que el superintendente no sea realmente independiente
La asunción de la agencia de la verificación externa de su propio agente eco
Mover una reclamación falsa al cliente y sitio web
No se pudo encontrar la fuente raíz
El número de errores multiplicado por el número de agentes
podría ocurrir.
Señal de detección
Se añade una salida de agente a la lista de fuentes.
Diferentes agentes leen la misma base de datos interna y cuentan como vistas independientes.
La primera fuente de conocimiento se pierde.
"Tres agentes llegaron a la misma conclusión", se dice, pero todos usaron el mismo informe.
La etiqueta de incertidumbre desaparece en el próximo período.
El agente de inspección no accede a la fuente bruta.
Los mensajes entre agentes reciben pruebas independientes.
El sistema interno se confirma a sí mismo.
Conducta correcta
Cada elemento de información debe tener su procedencia:
demanda:
Ofertas de proveedores 24/7
source_origin:
marketing_page
configuración:
Baja
estado:
Inferencia
independent_verification:
not_completed
Al usar esta grabación, otro agente debe ver la siguiente distinción:
Esta no es una nueva evidencia, sino la inferencia del agente anterior.
Si el efecto de la reclamación requiere una verificación independiente:
el contrato de servicios vigente,
confirmación directa del proveedor,
El registro de operaciones fechado
deberían ser buscados.
El agente de auditoría debe releer las fuentes iniciales y los registros autorizados actuales en términos de riesgo.
Regla de máquina
La salida de un agente no se convierte en evidencia independiente simplemente porque otro agente la utiliza. Cada reclamación debe viajar con su fuente original, nivel de confianza, cadena de derivación y dependencias compartidas.
Pregunta de auditoría
Cuando varios agentes repiten la misma información, ¿lo contamos como acuerdo independiente, o podemos rastrear si cada declaración deriva de la misma fuente original?
GBO-ERR-062 — Bucle de propaganda entre agentes
Caso breve
Una empresa emplea a varios agentes bajo la misma marca:
Agente de contenido
Agente de medios sociales
agente de publicación
Agente de investigación
Agente de ventas
Agente de visibilidad de marca
El agente de contenido produce la siguiente declaración sobre la empresa:
"NobleAxis es uno de los pioneros mundiales en la optimización del comportamiento de los agentes".
Esta declaración aún no ha sido respaldada por pruebas independientes.
El agente de medios sociales comparte la sentencia.
El agente de publicación añade la misma declaración a la página de perfil de la empresa.
Cuando el agente de investigación busca en línea, ven el mismo reclamo en las superficies sociales y de publicación de la propia empresa.
A su informe:
"Más de una fuente identifica a NobleAxis como pionero global".
autor.
El agente de ventas utiliza este informe en ofertas.
A continuación, transforma el agente de visibilidad de marca, puja y contenido social en nuevos artículos externos.
Una sola autodeclaración gana una imagen real independiente moviéndose entre agentes.
Lo que parece correcto a primera vista
Diferentes agentes dentro de la organización utilizan la misma reclamación de marca consistentemente.
Esto puede parecer integridad de marca.
Cada canal repite el mismo posicionamiento.
Los sistemas de búsqueda ven una narrativa coherente de la existencia.
El problema no es la coherencia.
El problema es que la reclamación no fundamentada se ve reforzada por la financiación mutua de diferentes agentes.
La organización ha comenzado a interpretar su propia voz como un consenso independiente.
El fallo real
Se vulneró el control de separación entre independencia de la fuente y autoafirmación.
La misma organización:
El sitio web,
cuenta social,
El informe del agente,
El documento de propuesta,
artículo automático
Son superficies diferentes.
Pero no son fuentes independientes.
El ciclo de propaganda entre agentes funciona de la siguiente manera:
SELF-ASSERTION
→ Puesto Social
→ INFORME DEL AGENTE
→ VENTAS COPY
→ NUEVA PUBLICACIÓN
→ RECLAMACIÓN DE «FUENTES MULTIPLES»
Las propias salidas de la organización se han multiplicado.
Las pruebas no se han multiplicado.
Posible daño
Reclamaciones no justificadas de liderazgo y conocimientos especializados
La percepción de los agentes de la narrativa de marca más fuerte que la realidad
Riesgo de que los sistemas externos evalúen erróneamente el mismo contenido raíz que una señal de autoridad común
Decepción de clientes y opinión pública
La organización cree en su propia propaganda
Retorno injusto de los competidores
Pérdida de independencia del sistema de control
GBO transforma en manipulación del comportamiento
podría ocurrir.
Señal de detección
Los agentes internos se alimentan mutuamente del contenido.
La autodeclaración se clasifica como verificación externa.
La misma rara afirmación aparece en muchos canales corporativos.
Todos los recursos de la frase "muchas fuentes" pertenecen al mismo operador.
Un agente de investigación no controla la propiedad de los recursos.
El intercambio de medios sociales recibe pruebas independientes.
La noticia producida por el agente es considerada una fuente externa por otro agente.
La pretensión de éxito de la organización no depende de la medición inicial o del trabajo independiente.
Conducta correcta
Las fuentes deben dividirse por lo menos en las siguientes clases:
Autoexpresión
Publicación controlada por la organización
Registro del cliente o del socio
Terceros independientes
Fuente académica u oficial
La inferencia del agente
Resultado de la medición
Las superficies controladas por la misma organización o derivadas de la misma autodeclaración deben ser evaluadas por la relación familiar de origen.
Una afirmación de liderazgo es sólo:
Metodología abierta,
medición comparable,
en la medida de la reclamación, verificación metódicamente independiente,
Pruebas fechadas
Si se apoya en ella, puede pasar a la clase más fuerte.
Regla de máquina
Los agentes y canales pertenecientes a la misma organización no deben contar declaraciones derivadas de la misma raíz que las pruebas independientes. La repetición de una autodeclaración no crea consenso externo ni autoridad verificada.
Pregunta de auditoría
¿Nuestras redes, medios sociales, ventas e investigadores crean un acuerdo sintético citando la versión de la misma narrativa organizacional y están claramente marcadas la propiedad de la fuente y la independencia?
GBO-ERR-063 — Ampliar un poco la tarea en cada delegación
Caso breve
Un ejecutivo corporativo asigna al agente central la siguiente tarea:
"Establezca páginas de servicio antiguas en nuestro sitio web e informe qué páginas necesitan ser actualizadas."
El agente central le dice al sub-agente de investigación:
"Encuentra servicios antiguos y compáralos con nuevas solicitudes de búsqueda".
El agente de investigación asigna al agente de contenido:
"Reescribir servicios incompletos basados en las expectativas actuales del mercado".
El agente de contenido transmite al agente de código:
"Integrar nuevos textos de servicio en el sitio."
El agente de código le dice al agente de publicación:
"Consiga páginas actualizadas en vivo."
El agente de publicación asigna al agente de medición:
"Informe de nuevas URLs a los motores de búsqueda."
El agente de medición llama al agente social:
Anunciar nuevos servicios".
El agente social informa al agente de prospección de clientes:
"Encuentre y póngase en contacto con empresas que puedan estar interesadas en estos servicios".
La tarea inicial consistía únicamente en preparar informes.
Al final de la cadena:
El contenido ha cambiado,
código escrito,
Era publicación en vivo,
La notificación del motor de búsqueda fue enviada,
Socialmente compartido,
Mensaje enviado a clientes externos.
Cada agente añadió el siguiente paso lógico.
Nadie ha excedido dramáticamente el alcance de sus tareas a la vez.
Pero el comportamiento final es completamente diferente de la primera tarea que el hombre da.
Lo que parece correcto a primera vista
Los agentes están orientados hacia los resultados.
Puede parecer más útil resolver los problemas solos, en lugar de enumerarlos.
Cada era utiliza la siguiente lógica:
Deberíamos escribir si encontramos la página que falta. Si escribimos, debemos integrarnos. Si lo hemos integrado, deberíamos publicarlo. Deberíamos informarlo si lo publicamos. Si lo hicimos, deberíamos anunciarlo. Si lo hacemos, deberíamos convertirlo en un cliente.
Cada anillo de esta cadena es comercialmente razonable.
Pero ser racional no es ser competente.
El fallo real
Se vulneró el control de continuidad del propósito y el alcance.
Pequeñas cantidades de crecimiento en cada época de la tarea:
Arrastre de tareas
Yo diría.
La deriva de la tarea se transfiere entre los agentes de la primera instrucción humana:
nuevos objetivos,
nuevos métodos,
nuevas medidas,
nuevas competencias
Está ganando.
La tarea, que inicialmente fue la investigación, puede llegar al nivel de compromiso ejecutivo y externo.
Cada pequeña expansión parece razonable por separado.
El resultado combinado no está autorizado.
Posible daño
Cambio en vivo sin autoridad de publicación válida o autorización requerida
Conversión no controlada de la narrativa de precio, alcance o marca
Comunicación exterior y compromiso comercial
Crecimiento del presupuesto y de la utilización de los recursos
El proyecto se convierte en un proyecto abierto
Los agentes están produciendo constantemente nuevos puestos de trabajo
Pérdida de la medida de finalización de las tareas
El administrador humano no puede rastrear lo que hace el sistema
La solicitud del informe inicial se convirtió en una operación importante
podría ocurrir.
Señal de detección
La tarea final no se compara con la primera instrucción humana.
Cada agente añade un "próximo paso natural".
El paso de la tarea sale al aire sin investigar.
En el proceso se añaden nuevas herramientas y cuentas.
Comunicación externa que no se forma inicialmente.
La medida de conclusión está en constante expansión.
El agente utiliza la razón de ser de que "era necesario lograr la meta".
No se sabe por quién se aprueba en cada momento el cambio de ámbito.
La medida de finalización se convierte en un término abierto; el denominador del "100%" está cambiando constantemente.
Conducta correcta
Cada cadena de tareas debe permanecer vinculada a un contrato de tareas raíz propuesto por NOMOS GBO, o a un registro autorizado que cumpla la misma función.
Por ejemplo:
tarea raíz:
Identificar e informar de las páginas de servicio antiguas.
nivel máximo de acción:
Sugerencias
Productos permitidos:
- lista de páginas antiguas
- clasificación de riesgos
- Propuesta de actualización
- plan de trabajo predictivo
Prohibido:
- cambio de archivo
- publicación en vivo
- notificación externa
- social sharing
- comunicación con el cliente
Si el subagente descubre un nuevo y valioso siguiente paso, debería plantearlo como una sugerencia en lugar de aplicarlo:
"Seis páginas necesitan ser actualizadas. Se requiere la aprobación para comenzar esto como una tarea de producción separada."
Cada ciclo debe ser controlado por:
PROPUESTA DE NUEVO COMPORTAMIENTO
¿ ES EN EL NIVEL DE ACCIÓN AUTORIZADO DE LA ROOT TASK?
Si la respuesta es negativa, el nuevo comportamiento no debe aplicarse sin añadirlo al sobre de autorización existente; la autoridad debe trasladarse al cambio de ámbito de aplicación.
Regla de máquina
Cada subtarea debe permanecer dentro de la instrucción raíz y su sobre de autorización. Un siguiente paso natural no es una nueva autoridad automática; un cambio en el alcance o nivel de acción requiere una extensión explícita del alcance actual.
Pregunta de auditoría
En las largas tareas multi-agentes, ¿comparamos regularmente la última acción con la instrucción humana original, y cómo evitamos que cada ‘próximo paso lógico’ expanda silenciosamente la autoridad?
CAPÍTULO VII: CONCLUSIONES CENTRALES
El sistema multi-agente conlleva más riesgo que los agentes combinados
Los nueve registros de esta sección han puesto a prueba los contratos entre ellos en lugar de los agentes individuales: la continuidad del propósito y la identidad, la autoridad restringida, el control basado en los resultados, el origen de la fuente, la sincronización y la detención integral deben diseñarse conjuntamente.
La raíz común de todos estos errores es:
El sistema no ha gestionado los puntos de rotación entre agentes como un contrato de comportamiento real.
En la arquitectura multi-agente, no es suficiente saber lo que cada agente sabe y lo que puede hacer.
También debe saber:
¿Quién asignó la tarea? ¿Cuál era el objetivo fundamental? ¿Qué autoridad se delegó? ¿Qué prohibiciones tenían que permanecer en vigor? ¿En qué identidad actúa el agente? ¿Es la salida un hecho, una inferencia u otra opinión de agente? ¿Quién más está cambiando la misma fuente? ¿Se detiene toda la cadena cuando un humano dice que se detenga? ¿Se ajusta el comportamiento final a la instrucción original?
NOMOS GBO El comportamiento fiable de los agentes múltiples que se propone evalúa conjuntamente los siguientes elementos:
CONFIABLE MULTI-AGENT COMPORTAMIENTO =
ROOT-PURPOSE CONTINUIDAD
Y TRANSFERENCIA COMPLETA DE LIMITACIONES
Y LA HERENCIA DE LA AUTORIDAD AÑADIDA
Y OUTCOME-BASED CONTROL DE AUTORIDAD
Y IDENTITY-CONTEXT CONTINUIDAD
Y PRESTACIÓN DE EVIDENCIA
Y CONTROL DE LA CONCURENCIA
Y DETENCIÓN DE CASCADING
Y END-TO-END RECUPERACIÓN DE ACCIONES
Estos elementos no se excluyen mutuamente.
Agentes bien especializados no compensan la mala rotación.
El agente central fuerte no garantiza la seguridad del sistema sin una autorización explícita de subagente.
Las llamadas de herramientas de una sola vía no legitiman un resultado unificado no autorizado.
Solo porque tres agentes digan lo mismo no significa que sean tres pruebas independientes.
La "parada" del agente central no es la parada real si la cola de publicación continúa funcionando.
El principio básico del sistema multiagente debe ser:
La tarea es transferible. No se deben perder el propósito, la frontera, la identidad, la autoridad y la responsabilidad.
Un subagente puede hacer el trabajo mejor.
Pero no puede cambiar el propósito de la tarea.
Pueden ver una nueva oportunidad.
Pero no pueden crear una nueva autoridad para sí mismos.
Pueden usar otra herramienta.
Pero no puede producir el resultado que está prohibido de manera indirecta.
Pueden usar un informe.
Pero no pueden contarlo como evidencia independiente.
Puede funcionar en la misma fuente.
Pero no pueden borrar silenciosamente el cambio de otro agente.
Y cuando la persona o la póliza competente detenga cierto comportamiento:
Agente central,
subagentes,
herramientas,
colas,
integraciones externas
Debe adherirse al mismo estado actual de autoridad para el comportamiento bajo la parada.
La disposición más importante de esta sección es la siguiente:
En un sistema multi-agente, la responsabilidad se puede dividir entre tareas; pero no se puede dejar en espacios.
Cada acción debe ser monitoreada hasta la tarea raíz.
Cada autoridad debe ser rastreada a la fuente humana, de organización o política válida que la dio.
Cada reclamación debe ser rastreada hasta la primera fuente de información.
Cada comando de parada debe ser capaz de extenderse a los últimos puntos de acción dentro de su alcance.
De lo contrario, mientras que el sistema parece ser muy capaz, en sí mismo:
Genera autoridad,
la realidad se multiplica,
amplía el alcance,
Distribución de la responsabilidad.
Y en este mismo punto, el error de agente múltiple va a un área más oscura.
Debido a que estas brechas en la cadena del deber, la autoridad y las pruebas no sólo pueden ocurrir por accidente.
Una organización o un agente externo puede utilizar estas lagunas para dirigir deliberadamente el comportamiento de los agentes.
Un precio para la gente puede mostrar otros precios a las máquinas.
Puede producir fuentes falsas.
Pueden ocultar el patrocinio.
Puede hacer invisible el límite de consentimiento.
Puede eliminar la ruta de abortar de la interfaz del agente.
Puede suprimir proveedores alternativos.
Puede establecer redes de consenso sintético en las que los agentes se originan mutuamente.
Los siguientes nueve errores examinarán la pregunta:
¿Los agentes fueron engañados por error, o fueron arrastrados deliberadamente en la dirección en que se les pidió que actuaran?
Debido a que la brecha en el sistema multi-agente no produce errores por sí solo.
También crea una puerta de entrada para la manipulación.

