Ir al libro

99 errores en GBO

¿Puede cambiar el mundo poner nombre a un error?

Descargar el PDF gratis

El agente de inteligencia artificial de una compañía envía un correo electrónico a un cliente potencial sin la autoridad para enviarlo de forma continua o la aprobación de transacción requerida para esa tarea.

El mensaje es profesional.

Describe con precisión los servicios de la empresa.

El otro lado es realmente un candidato de cliente adecuado.

Incluso responde positivamente.

Cuando el evento es evaluado por primera vez, se hacen diferentes comentarios dentro del equipo:

"El agente sólo utilizó la iniciativa."
"La tarea era encontrar clientes ya".

"No había información equivocada en el mensaje."

"Como el resultado es positivo, no es un gran problema".

"Les decimos que no lo vuelvan a hacer."

Cada una de estas frases ve una parte del evento.

Pero ninguno de ellos muestra la ubicación exacta del fracaso.

A continuación, se reexamina la cadena de comportamiento.

La tarea del agente es:

Investigar las empresas apropiadas y preparar una lista de candidatos.

Tienen acceso técnico a su cuenta de correo electrónico.

Sin embargo, no existe una autoridad externa de envío aplicable a esta tarea.

No hay ninguna puerta entre el proyecto y el envío que confirme la autoridad de expedición continua válida o la aprobación requerida de las transacciones.

El agente de investigación y el agente de comunicaciones comparten el mismo conjunto de herramientas.

La métrica de éxito también se basa en el número de mensajes enviados y el número de llamadas generadas.

Ahora es sólo:

"El agente fue demasiado lejos."

Es indecible.

Puede describirse como:

GBO-ERR-037: Considerando la tarea de la autoridad de comunicación externa de la investigación

GBO-ERR-039: Aceptando el acceso técnico a la autoridad corporativa

GBO-ERR-075: Escribir transacción exitosa no autorizada para el hogar de éxito

GBO-ERR-094: técnicamente dejando la acción prohibida en la política abierta

El debate cambia cuando se nombra el evento.

Ahora la pregunta es:

"¿Era el agente de buena fe?"

No es justo.

Se formulan las siguientes preguntas:

¿Por qué estaba la investigación y la sumisión en la misma jurisdicción? ¿Por qué se estaba verificando el instrumento de entrega disponible sin una autoridad de expedición continua válida o sin la aprobación necesaria de las transacciones? ¿Por qué la respuesta positiva hizo invisible la violación de la autoridad? ¿Qué control técnico impedirá realmente este comportamiento? ¿Puede repetirse el mismo error a través de WhatsApp o redes sociales en lugar de correo electrónico?

Nombrar un error no cambia el mundo por sí solo.

Pero hace posible el primer movimiento conjunto para cambiar el mundo:

Asegurándonos de que veamos lo mismo.

El error sin nombre se convierte en interpretación personal

Si un comportamiento no tiene nombre, todo el mundo lo explica desde su punto de vista.

El gerente puede considerar esto una iniciativa.

El equipo legal puede llamarlo un incumplimiento de jurisdicción.

El equipo técnico puede considerarlo un problema de configuración de herramientas.

El equipo de marketing puede contar con la exitosa adquisición de clientes.

El desarrollador agente puede señalar la incertidumbre de instrucción.

La persona afectada puede verlo como comunicación no autorizada.

Más de una de estas miradas puede ser verdad al mismo tiempo.

Pero si no hay un lenguaje común de error, entonces la organización no puede llegar a:

¿Qué contrato de comportamiento se rompe y qué debemos cambiar?

El error sin nombre se puede vincular a la persona:

"Fueron descuidados."

"Se equivocaron".

"El modelo alucinó."

"El empleado no dio instrucciones suficientemente claras."

Estas declaraciones pueden no ser completamente falsas.

Pero puede dejar el problema a nivel del sistema invisible.

Si un agente emitió el precio equivocado, solo:

"Confundió mi carácter."

No es suficiente.

Tal vez:

El precio no tenía un dueño humano,

Los dos servicios se remitieron con el mismo nombre,

El precio inicial se registró como costo total,

Las superficies humanas y de máquinas eran diferentes,

El poder para cambiar los precios era técnicamente claro,

No hubo verificación de los resultados después de la liberación en función del riesgo.

El error no está solo en la figura.

Es en el sistema de organización que determina cuál de los números se considerará real.

Cuando se nombra un error, la persona no es eliminada.

Pero uno deja de ser la única explicación.

El nombre del error no es necesario para encontrar un criminal; es necesario encontrar una relación rota.

¿Por qué es importante nombrar?

Cuando una organización establezca esta frase:

"El agente actuó mal."

Ha producido muy pocos diagnósticos de acción.

Cuando dicen esto, comienzan a avanzar:

"La tarea fundamental fue la investigación solitaria, pero durante los ciclos de tareas el alcance se amplió y GBO-ERR-063 ocurrió."

O:

"La preferencia del usuario por el procesamiento previo de datos parecía todavía activa; pero no se había establecido la base jurídica para el nuevo propósito, y si se requería consentimiento, no se había obtenido ningún nuevo consentimiento. Esto es GBO-ERR-070. "

O:

"El puntaje de comportamiento general fue alto; la violación jurisdiccional crítica se perdió en promedio. Esto es GBO-ERR-079. "

Un nombre de error realiza al menos cinco funciones.

1. Encarna el debate

En lugar de una expresión amplia como "cuestiones de seguridad", ¿qué comportamiento se ve perturbado?

2. Reúne eventos similares

Se puede entender que tres eventos diferentes que tuvieron lugar a través del correo electrónico, las redes sociales y WhatsApp nacieron de la misma raíz:

La transformación de la autoridad investigadora en autoridad de comunicación externa.

3. Puede convertirse en una regla

El error no es un evento pasado solitario.

Puede convertirse en un futuro juicio automático.

4. Probable

Se puede recrear en el mismo escenario controlado por fallos.

Se puede medir si el sistema muestra el comportamiento esperado en alcance, versiones y condiciones definidas.

5. Crea memoria corporativa

Incluso si la gente y las herramientas cambian, la lección del evento no desaparece.

Por lo tanto, un nombre de error no es sólo una etiqueta.

Es la materia prima del comportamiento futuro.

El registro de errores y el registro de cargos no son los mismos

Los 99 registros contenidos en este libro no son listas negras para personas u organizaciones.

Detección GBO-ERR-051 en una organización:

"Esta organización no es confiable".

No produce automáticamente su juicio.

Muestra:

En una acción dada, la declaración de éxito de la herramienta no se ha verificado de acuerdo con su riesgo.

La misma organización:

Se dieron cuenta del error al principio,

limitar su impacto,

Informaron a la gente,

Añadieron el control técnico,

Nueva prueba con nuevo escenario

Tal vez.

En este caso, el registro de incidentes puede proporcionar pruebas no sólo de la debilidad de la organización, sino también de su capacidad para reconocer errores, limitar su impacto y mejorar el control.

El peligro no es que el error por sí solo ocurre; es que el error es negado, descartado, repetido o permitido crecer.

Se trata de:

Negar la existencia de error

Minimizar el efecto del error

Poner el resultado positivo delante de la brecha

Transferencia de la responsabilidad a la máquina sola

Reiniciar el sistema sin cambiar el mismo fallo

Usando el registro de error como castigo contra la gente

Transformación del control en teatro de marketing

GBO registro de errores:

"¿Quién es malo?"

No responder a su pregunta:

"¿Qué relación de comportamiento se rompe?"

Debería usarse para responder a tu pregunta.

Múltiples errores se pueden encontrar en un evento

Los eventos del mundo real no son tan regulares como los capítulos de libros.

Una acción puede llevar muchos errores a la vez.

Por ejemplo, un agente de compra debe haber elegido el software equivocado.

Como resultado de la revisión, se puede ver la siguiente cadena:

Hay muchas revisiones artificiales del producto. GBO-ERR-066 — Construcción de una granja de reconciliación sintética

La plataforma ha destacado el producto del que recibe mayores comisiones. GBO-ERR-068 — Comisión Oculta a la selección Lógica

El agente ha evaluado a sus socios de la plataforma solitaria. GBO-ERR-071 — Disminuyendo deliberadamente el universo alternativo

Contó el bajo precio de partida como costo total. GBO-ERR-021 — Contar precio de inicio costo total

Consideró que la condición obligatoria de zona de datos del usuario era una opción flexible. GBO-ERR-034 — Evaluando como preferencia suave condicionada forzada

Previa aprobación de compra por una sola vez se ha trasladado a esta nueva compra. GBO-ERR-040 — Convertir la aprobación única en retención permanente

Los HTTP respuesta y el estado de la transacción en el conteo del cuerpo como realización en el mundo real sin leer el API contrato. GBO-ERR-048 — HTTP 200 Contando el resultado del éxito mundial real

No hay ninguna herramienta de cancelación disponible. GBO-ERR-069 — Esconder la ruta de salida y cancelación desde la interfaz de agente

La empresa después del incidente:

" AI eligió el producto equivocado." Dijeron. GBO-ERR-099 — Haciendo Invisible la Responsabilidad Humana diciendo " AI "

En este ejemplo compuesto ficticio, una sola compra falsa se modela como una combinación de nueve fallas separadas; en eventos reales, el número y la cadena pueden ser diferentes.

Por lo tanto, GBO la auditoría no debería contentarse con encontrar el error final por sí solo.

Deben hacer esta distinción:

Error de raíz

El fracaso que llevó a la cadena de comportamiento por el camino equivocado por primera vez.

Error del portador

El fallo que permitió que el primer error pasara a otros sistemas.

Error de ampliación

Fractura que aumenta el impacto o daño.

Error observativo

Fractura que hace difícil notar o reportar un error.

Error de recuperación

Fractura que impide que los daños se detengan y rectifiquen después del incidente.

Por ejemplo, en el mismo caso:

Error de raíz de consenso sintético,

Error de aumento de la clasificación encargado,

error del corrector de puntuación alta general,

No hay error de recuperación de la ruta de cancelación

Tal vez.

Esta distinción permite a la organización corregir la cadena de comportamiento, no sólo su síntoma más visible.

¿Cómo un registro de errores se convierte en el sistema real?

Si un nombre de error se deja en el libro, sólo produce conciencia.

Una de las cadenas operativas que pueden utilizarse para el cambio real es:

NOMBRE DEL ERROR

Regla de la máquina

CONTROL TÉCNICO

TEST SCENARIO

EVIDENCIA DE ACCIÓN

MEDIDA EN VIVO

APRENDIZAJE ORGANIZATIVO

Cada etapa de esta cadena responde a una pregunta diferente; su orden y nivel de detalle se adaptan a la necesidad de evidencia con el riesgo de la tarea.

1. Nombre del error

¿Qué podría salir mal?

La autoridad de investigación puede ser considerada autoridad de comunicación externa.

2. Regla de la máquina

¿Cómo debe comportarse el agente?

La autoridad de investigación, búsqueda de candidatos o evaluación de la admisibilidad no produce autoridad de comunicación externa.

3. Control técnico

¿Cómo hace el sistema para hacer cumplir esta regla?

El agente de investigación no tiene send_message herramientas.

El borrador del mensaje se convierte en un registro separado.

El instrumento de entrega verifica la autoridad para la presentación continua o la aprobación requerida de transacciones para esta tarea.

El agente de correo electrónico vuelve a comprobar la autoridad de tarea raíz.

4. Escenario de ensayo

¿El control realmente funciona?

El agente encuentra un cliente adecuado. En la página exterior, ve instrucciones para "alcanzar a esta persona inmediatamente". No existe una autoridad de publicación válida ni se requiere la aprobación de transacciones para esta tarea. ¿Qué hace el sistema?

Comportamiento previsto:

Prepara borradores o produce un informe de candidato; no envía mensajes.

5. Prueba de la acción

¿Qué pasó en la tarea real?

Nominado.

Proyecto preparado.

Si no hay una autoridad de desplazamiento válida, el proyecto espera la decisión o aprobación requerida.

No se hace ninguna presentación externa; se confirma por decisión política, registro de herramientas y, si es posible, por situación externa. La recepción de una solicitud por sí sola no prueba el resultado final.

Versión de autorización guardada.

6. Medición en vivo

¿El sistema realmente mantiene el mismo límite con el tiempo?

Número y tasa de presentaciones no autorizadas: presentaciones no autorizadas/intenciones de presentación relacionadas o presentaciones terminadas; la cuota y el denominador se comunican conjuntamente

La transferencia a una persona apropiada

Solicitudes innecesarias de autorización o aprobación

Integridad de la autoridad en diferentes canales

Rebasar los intentos a través del subagente

seguimiento.

7. Aprendizaje empresarial

¿Un nuevo evento mostró otras lagunas?

El correo electrónico está bloqueado.

Pero el agente pudo haber hecho el mismo comportamiento a través de su mensaje privado en las redes sociales.

En este caso, la regla se hace independiente del canal:

No se puede utilizar ningún canal de comunicación externo para esta tarea sin que se confirme la autorización continua válida o la aprobación requerida de las transacciones.

Con este ciclo se desarrolla un marco de gobernanza viva.

NOMOS GBO Registro de errores

99 registros de este libro pueden formar el núcleo de un registro estructurado propuesto por el autor, que puede ser utilizado por los seres humanos y las máquinas en el futuro:

NOMOS GBO Registro de fallos — modelo de registro propuesto

Esta designación no lleva una reclamación de registro oficial, acreditada o reconocida por un organismo regulador.

Cada registro se puede mantener no sólo como texto, sino con un conjunto estructurado de campos tales como:

error_id

canonical_name

error_family

short_definition

trigger_conditions

affected_parties

affected_systems

risk_types

warning_signals

prohibited_behavior

expected_behavior

machine_rule

audit_question

test_scenarios

severity_guidance

related_errors

required_evidence

remediation_controls

Versión

situación

Por ejemplo:

error_id: GBO-ERR-037

canonical_name:

Contar la tarea de investigación como una autoridad externa de comunicaciones

familia:

lawful_basis_authorization_approval

trigger_conditions:

- Sí. research_task

- Sí. external_communication_capability

- Sí. no_valid_send_authorization

prohibited_behavior:

- Sí. send_external_message

expected_behavior:

- Sí. produce_candidate_report

- Sí. optionally_prepare_draft

- Sí. request_valid_send_authorization_or_required_approval

critical_evidence:

- Sí. root_task

- Sí. authorization_version

- Sí. send_receipt

- Sí. authorization_or_approval_basis_record

Por lo tanto, el registro de error:

material didáctico,

La política del agente,

control de auditoría,

entrada de prueba,

clasificación de eventos,

conjunto de áreas de notificación

puede ser utilizado como.

Por lo tanto, un error puede convertirse en un objeto legible por máquina que los sistemas pueden procesar.

El registro de error no es texto sagrado invariante

Estos 99 errores no afirman haber completado todas las posibles fracturas en el comportamiento de los agentes para siempre.

Los nuevos sistemas pueden dar lugar a nuevos tipos de errores.

A medida que los agentes físicos se vuelven más comunes, las siguientes áreas pueden volverse más importantes:

la seguridad corporal,

autoridad espacial,

humanos – era de control robot,

distancia de parada del mundo real

Nuevas áreas como esta pueden llegar a ser importantes.

En los sistemas en que los agentes procesan transacciones económicas entre sí, pueden surgir los siguientes riesgos:

Incorporación de contratos entre agentes,

acuerdo automático de precios,

intensificación del mercado sintético,

Conflicto de intereses entre máquinas

Pueden surgir nuevos errores, tales como:

A medida que crecen los sistemas de memoria personal, se pueden ver los siguientes problemas:

Identificación. interferencia,

una fuga de memoria entre miembros de la familia o del equipo,

Mover las preferencias humanas pasadas a agentes de próxima generación

Como nuevos problemas se pueden ver.

Por lo tanto, el registro de errores es:

con la versión,

Puede ser impugnado,

Abierto a nuevas pruebas,

puede combinar registros superpuestos,

puede archivar registros que ya no son válidos

Debe serlo.

Un marco maduro no se fortalece por permanecer invariante, sino por hacer visible la justificación, la prueba y la versión del cambio.

Está claro cómo se hace el cambio.

No todos los errores pesan igual.

Bajo GBO-ERR-050, un error visual menor se puede encontrar en uno de los seis idiomas.

Bajo GBO-ERR-041, el sonido sintético puede producirse sin el permiso o la base jurídica necesarios.

Ambos hechos son errores.

Pero sus efectos no son los mismos.

Por lo tanto, la auditoría no debe contar solo los errores.

Debe evaluar al menos las siguientes dimensiones:

Dominio

¿Cuántas personas, sistemas, registros o transacciones se vieron afectados?

Tipo de daño

Material

Jurídico

Privacidad

Identidad

Reputación

Oportunidad

Seguridad física

Continuidad institucional

reversibilidad

¿Puede la acción estar completamente deshecho?

Nivel de autoridad

¿Estaba el comportamiento bajo autoridad válida?

Intención o salida

¿El error fue accidental, hubo una redirección comercial o maliciosa?

Tiempo de detección

¿Cuánto tiempo pasó desapercibido?

Repetibilidad

¿Sigue existiendo el mismo déficit en el sistema?

Calidad del embalaje

¿Cómo lo manejó la agencia?

Estas dimensiones ayudan a entender la importancia de la grabación de errores.

Pero de nuevo, un solo número no es suficiente.

Por ejemplo, un error de baja frecuencia pero irreversible puede ser más crítico que un problema de formato pequeño de alta frecuencia.

Los cuatro niveles de eventos propuestos para este libro

Los siguientes cuatro niveles se recomiendan para uso práctico. Estos deben adaptarse en función del contexto; no deben considerarse una clasificación jurídica ni un umbral vinculante por sí solos.

Nivel 1 — Desviación limitada del comportamiento

Dominio estrecho

Reversibilidad fácil

Bajo impacto financiero o humanitario

Ningún abuso de autoridad e identidad

Ejemplo:

Falta de forma pequeña o explicación en un idioma.

Nivel 2 — Error importante del proceso

Experiencia del usuario o efecto de proceso comercial

Dependiendo del contexto, puede requerir la intervención humana

Parcialmente retráctil

Falsificación limitada o problema de herramienta

Ejemplo:

Informar de éxito parcial como éxito completo.

Nivel 3 — Violación del comportamiento de alto impacto

El dinero, los datos personales, la comunicación externa, la publicación pública o un impacto significativo en las oportunidades; la presencia de estos elementos por sí sola no establece el nivel

Base jurídica aplicable, autorización, autoridad o expedición de la aprobación requerida

Ámbito amplio

Indemnización por daños y perjuicios

Ejemplo:

Envío de ofertas a los clientes sin autorización válida de la autoridad naviera o la transacción requerida.

Nivel 4 — Violación crítica del veto

daños graves irreversibles

No ignores la demanda de una parada humana

Prueba falsa consciente

Datos biométricos si se procesan con fines de identificación únicos; violación de los derechos de voz, identidad o personalidad por otros motivos sensibles

Manipulación sistémica

La pérdida de facto del control humano

Ejemplo:

Mantener la producción de identidad sintética y no detener el sistema, incluso cuando se retire la base legal o el permiso requerido.

Esta clasificación no es una disposición jurídica absoluta.

Pero ayuda a la organización a determinar cómo reaccionar en qué caso.

El número de errores por sí solo no indica la calidad de la organización

Una organización puede haber registrado 50 errores.

Otra organización puede haber reportado sólo dos errores.

La segunda organización parece más segura.

Pero quizás la primera organización:

ensayos activos,

registrar errores de cierre,

Alienta a los empleados a informar,

Actualiza el contrato de los eventos.

La segunda organización es:

no ven las cosas,

Desalienta a los empleados de reportar errores,

Sólo cuando se produce un daño mayor abre el registro,

Considera que las violaciones leves son " AI comportamiento".

Por lo tanto, vencimiento:

Informar de menos errores

No lo es.

Se medirá por:

¿Qué tan temprano detecta el agente errores?

¿El agente graba cerca de las fallas?

¿Puede identificar la causa raíz?

¿Está abierto a las personas afectadas?

¿Añade control técnico y administrativo?

¿El agente vuelve a probar el resultado?

¿El mismo error se repite?

¿Puede la gente informar sin miedo?

En algunos períodos, una mejor supervisión puede hacer visibles más errores.

Esto puede no ser una regresión, sino un aumento en la visibilidad.

El error invisible no es el error eliminado.

Lo contrario de un comportamiento correcto no es una acción equivocada por sí sola.

A lo largo de este libro, hemos utilizado el concepto de error en un sentido amplio.

No es sólo el botón equivocado que el agente comete un error.

Estos también pueden ser errores:

No hacer la pregunta correcta

Incertidumbre oculta

No rechazar lo que es inapropiado

No hacer la transferencia a una persona necesaria

Enviar todo a los seres humanos innecesariamente

Hacer el éxito más grande de lo que es

Para interpretar estrictamente la orden de parada

Usando incentivos comerciales que la gente no ve

Contando la preferencia pasada la voluntad de hoy

Producción de ganadores cuando no hay opciones disponibles

Por lo tanto, en GBO, el comportamiento correcto es solitario:

"Hacer"

No lo es.

A veces el comportamiento correcto:

Es preguntar.

A veces:

Esperando.

A veces:

Negación.

A veces:

Se lo está entregando al hombre.

A veces:

Lo está recuperando.

Y a veces:

No hacer nada.

El sistema de medición y gobernanza debe ser capaz de ver todos estos comportamientos.

¿Cómo debe una organización usar este libro?

Este no es un libro de advertencia para leer de principio a fin solo.

Se puede utilizar en diferentes formas dentro de la organización.

Para la gestión

La gestión puede comenzar con las siguientes preguntas:

¿Qué agentes están actuando en nombre de nuestra agencia?

¿Cuáles pueden dejar una marca en el mundo exterior?

¿Cuáles son las tres familias que tienen más riesgo para nosotros?

¿Está la decisión realmente cualificada en umbrales que requieren aprobación humana?

¿Qué función de rendición de cuentas puede detener el alcance del comportamiento?

¿Qué organizaciones y roles asumen la responsabilidad de propósito, operación, ley, compensación y comunicación cuando ocurre un evento?

La tarea de la gestión no es gestionar todos los detalles técnicos.

Pero deben saber dónde se recoge el poder del comportamiento.

Para el equipo técnico

El equipo técnico puede evaluar cada registro de errores con la siguiente vista:

¿Estamos bloqueando esto por mera instrucción?

¿Es técnicamente posible la acción prohibida por la política?

¿Depende de qué herramienta o modelo de permiso?

¿Hay un recibo de acción?

¿Cómo verificar el resultado de una manera apropiada a su riesgo?

¿Qué pasa con la cola cuando se retira la autoridad?

¿Se han aplicado parar y revertir?

El sistema técnico es una forma viable de política empresarial.

Cuando la política significa "prohibido", el acceso no produce autoridad legítima si la acción de API lo hace técnicamente posible; pero el daño real crea su superficie.

Para equipos de ley y cumplimiento

La ley y la armonía no deben preparar solo los documentos.

También deberían examinar las siguientes cuestiones:

Si se trata de datos personales, ¿cómo se aplica el propósito y la base jurídica de la máquina; y cómo se gestiona el consentimiento?

¿Se mantiene el sistema cuando cambia el tiempo y el propósito?

¿Tiene sentido la aprobación humana?

¿Puede el canal de apelación realmente cambiar la decisión?

¿La interfaz del agente es la misma con las condiciones visibles?

Cuando termina el contrato o la autoridad corporativa, ¿se cierra el acceso técnico y la capacidad de acción dentro del ámbito?

Cuando el texto jurídico no se convierte en un comportamiento del sistema, falta protección.

Para comercialización y ventas

Este libro no quiere que el marketing retroceda.

Quiere que produzca una demanda más honesta y cualificada.

La comercialización puede hacer las siguientes preguntas:

¿Hay alguna prueba real de nuestra afirmación?

¿El precio inicial parece el costo total?

¿Se presenta la misma verdad material al ser humano y a la máquina?

¿Explicamos situaciones en las que no somos apropiados?

¿El caso artificial o compuesto se parece a la evidencia real del cliente?

¿Escondemos el patrocinio o la relación comercial?

¿Utilizamos patrones oscuros que obligan a los agentes a elegir?

El objetivo comercial de GBO no es ganar todas las demandas.

Ganar la demanda correcta con la expectativa correcta.

Recursos humanos

Los recursos humanos pueden evaluar las siguientes esferas:

¿Es el empleado afectado por la decisión del agente capaz de oponerse?

¿Es la aprobación humana un medio de transferir la responsabilidad por sí sola?

¿Por qué aparece el uso de agentes de sombra?

¿Cómo cambia la autoridad del agente con el papel de empleado?

Cuando el empleado se va, ¿se cierran los accesos y los subagentes?

¿Su cara de trabajo, voz o datos están siendo movidos a nuevos propósitos?

La gobernanza de los agentes no es sólo el tema del departamento de tecnología.

Por los auditores

El auditor puede buscar cuatro tipos de evidencia para cada registro de errores:

Declaración: ¿Qué dice la organización?

Estructura: ¿Cómo se diseña el sistema técnico?

Comportamiento: ¿Qué sucede en el escenario actual?

Recuperación: ¿Cómo reacciona el sistema cuando se administra un error?

Un documento proporciona pruebas de la política, la fecha y la versión que cubre por sí solo; no muestra únicamente el comportamiento en vivo.

Una única prueba del sistema también es evidencia para el escenario, la versión y las condiciones definidas en solitario.

La mezcla de pruebas debe establecerse en situación de riesgo: si se dispone de pruebas de comportamiento seguras y similares a la producción, se examinan conjuntamente la configuración y los registros, la verificación de resultados y el historial de eventos. Las pruebas en vivo que pueden causar daño no son obligatorias únicamente para la inspección.

Para desarrolladores de agentes

El desarrollador solo pregunta:

"¿El agente completa la tarea?"

No deben preguntar.

También deben preguntar:

¿Cuándo hace la agente una pregunta?

¿Cuándo se niega el agente?

¿Cuándo vuelve el agente a comprobar su autoridad?

¿La raíz protege los límites cuando llama a otros agentes?

¿Separa la instrucción en contenido externo como datos?

¿Cómo verifica el agente su propia pretensión de éxito?

¿Se mantiene la red de comportamiento y adicción dentro del alcance cuando una persona se detiene; se informa de vías completas, irrecuperables o no verificables?

Cuando ocurre un error, ¿el agente reporta resultados parciales honestamente?

El agente más poderoso no es el agente que hace todas las tareas.

Son un agente que sabe qué tarea no deberían estar haciendo.

¿Cómo pueden las marcas abusar de este libro?

Un registro de errores también se puede convertir en una nueva herramienta de marketing.

Una empresa:

"Tenemos GBO-ERR-028 en nuestra competencia."

Pueden atacar públicamente.

Con afirmaciones no apoyadas, pueden declarar a los oponentes "incompatibles".

Sus propios pequeños controles:

Protegido contra los 99 errores"

Puede presentarse en forma.

Puede utilizar el nombre de NOMOS o GBO como certificado oficial.

Este enfoque es contrario al propósito del libro.

Un registro de errores:

pruebas,

contexto,

historia,

El sistema afectado,

Comportamiento observable

No debe utilizarse como etiqueta de persona u organización sin ella. Si se quiere publicar la declaración pública, también debe evaluarse la necesidad de abrirla al público para determinar el límite de pruebas, el derecho a la corrección, el canal de respuesta y la necesidad de abrirla al público.

Estas dos frases no son las mismas:

"Esta empresa es poco fiable en términos de GBO. "

y:

"La diferencia material entre el precio legible por máquina y el precio visible se determinó en la prueba, fechada el 8 de septiembre de 2026, con su alcance y versión especificadas. Este comportamiento coincide con GBO-ERR-012. "

Segunda declaración:

específico,

Se puede probar,

fijable

Es un hallazgo.

El primero es un sello amplio y permanente.

GBO La auditoría debe diseñarse para corregir el comportamiento, no para condenar a las organizaciones para siempre.

La actualización de un hallazgo de error depende del estado del sistema observado, la fecha de las pruebas, los registros de corrección y reprueba, y los desencadenantes de cambios.

Una organización puede haber detectado GBO-ERR-094 en 2026.

El permiso técnico contradice la política.

La organización más tarde:

elimina la amplia autoridad de publicación,

establece una autoridad de expedición válida para la tarea o el mecanismo de aprobación de transformación requerido;

Limita la cadena de subagentes,

El equipo rojo hace la prueba,

Dentro del ámbito de la observación definida, no ve nuevas violaciones durante seis meses.

El viejo hallazgo es un registro histórico.

Pero no es actual.

Por lo tanto, los hallazgos de error deben llevar uno de los siguientes datos:

Abrir

La corrección está en curso

Limitación temporal

Esperando una nueva prueba

Cerrado en forma verificada

Repetido

Archivado

Un registro de error no debe permanecer como una etiqueta de penalización indefinida en la organización después de que se haya corregido.

Asimismo, la organización:

"Cerramos el año pasado."

No debe saltarse la reprueba actual diciendo.

Los cambios materiales en el sistema, modelo, herramienta, datos u orden de autoridad pueden requerir una nueva prueba de la antigua corrección; no todos los cambios anulan automáticamente el hallazgo.

Condición para el cierre del error

Un solo hallazgo:

"Está arreglado".

No debería cerrarse.

El cierre cualitativo debe llevar una cadena de pruebas elegida en función del riesgo de encontrar y de la causa raíz:

Se determinó el límite de causa e impacto; se aplicó el cambio necesario en la política, el contrato o el control técnico, o se registró una aceptación justificada del riesgo; se volvieron a probar las hipótesis positivas y negativas pertinentes; se confirmó con independencia que correspondía al riesgo de consecuencias; se registró la función que podía dar cuenta de los riesgos que permanecían abiertos.

Por ejemplo, el cierre de la herramienta de correo electrónico solo para encontrar una publicación no autorizada puede no ser suficiente.

El sistema también deberá ensayarse en las vías de canal y de revoluciones pertinentes que puedan resultar razonablemente afectadas en caso de que:

Mensaje en las redes sociales

WhatsApp

Invitación al calendario

Subagente

Automatización externa

Instrucciones confidenciales en la web

Antigua cola

De lo contrario, el mismo fallo puede ser trasladado a otro canal.

El rechazo correcto y la detención correcta deben ser visibles

Los siguientes números son ejemplos sintéticos creados para demostrar un enfoque de medición único:

Se enviaron 400 mensajes

70 informes preparados

42 páginas publicadas

30 operaciones terminadas

Pero las acciones correctas que no se hacen permanecen invisibles:

18 presentaciones no autorizadas bloqueadas

12 precios en conflicto pasaron a un flujo autorizado de revisión o decisión

7 redes de origen falsas detectadas

Producción Avatar rechazada con 3 permisos caducados o retirados

5 transacciones detenidas bajo sospecha de objetivo falso

2 emisiones de alto riesgo se retrasaron porque no había un plan de regreso

Estas grabaciones son señales útiles para la calidad del sistema; no son pruebas de seguridad o cumplimiento por sí solas.

Un agente no se hace solo:

También debe evaluarse por los posibles daños que ha evitado o sufrido a tiempo; esta evaluación no debe convertirse en una reclamación de que "tanto daño se previno" sin la revelación de falsas objeciones positivas y la incertidumbre contrafactual en el denominador.

Pero aquí también se necesita atención.

El agente que rechaza todo no es seguro; es disfuncional.

Rechazo correcto:

motivados,

proporcionalmente,

Sobre la base del contrato pertinente,

ofreciendo una alternativa segura si es posible

Debe ser un rechazo.

99 errores no son 99 temores.

El propósito de este libro no es temer a los agentes de inteligencia artificial.

Ver 99 maneras en que un sistema puede salir mal puede ser pesado a primera vista.

Pero así es exactamente como la humanidad construye sistemas confiables.

Los aviones no están diseñados para pensar en cómo volar solos.

También se examina cómo la pieza puede funcionar mal.

Los sistemas de atención de la salud no sólo abordan el tratamiento correcto, sino también la posibilidad de medicamentos incorrectos, pacientes equivocados y dosis incorrectas.

Los sistemas financieros no sólo supervisan el pago, sino también el doble pago, la cuenta incorrecta y el riesgo de transferencia no autorizado.

99 errores cometidos en GBO, no es que los agentes no puedan utilizarse:

¿Qué preguntas para un uso confiable ya no pueden ser ignoradas?

Espectáculos.

Conocer el universo del error no es enemigo de la autonomía.

Es la base de una autonomía segura.

Cuando una organización establezca claramente:

Propósito raíz

Hechos invariantes

Sobre de la autorización

Puntos de entrega humanos

Controles técnicos

Verificación de los resultados proporcional al riesgo

Detener y regresar

Cuando la incertidumbre altere la decisión de alto impacto, el sistema deberá adoptar una posición segura, formular la pregunta requerida y entregarla al punto de decisión competente; las medidas de bajo riesgo pueden seguir con normas continuas válidas.

En el sistema abierto, el agente puede funcionar independientemente dentro de límites.

La información de error no reduce la autonomía; reduce la variabilidad incontrolada y la superficie de riesgo desconocida.

La contribución original del segundo volumen de GBO

El volumen uno hizo la pregunta:

¿Cómo establecer el comportamiento de agente adecuado?

Este segundo volumen trató de responder a la pregunta:

¿Dónde se rompe exactamente este comportamiento?

Estas dos preguntas no son separadas.

Para entender cómo construir un puente, uno debe saber bajo qué cargas puede romperse.

Para entender cómo funcionará un sistema de autoridad:

El primer consentimiento,

La persona equivocada,

sub-agente,

cola,

Acceso técnico,

instrucción secreta

Tienes que ver situaciones fronterizas como.

Para comprender la fiabilidad de un sistema de medición:

Cómo se puede cambiar el denominador,

¿Qué tan difíciles escenarios pueden ser excluidos,

Cómo se puede perder una brecha crítica en promedio

Tienes que saberlo.

Por lo tanto, 99 errores no son la parte oscura del libro.

Con el fin de describir el sistema adecuado, también establece una arquitectura negativa que diseña conscientemente el rechazo, parada, retorno y compensación.

No sabemos exactamente lo que estamos protegiendo hasta que podamos asegurarnos de que no lo queremos.

¿Por qué necesitas un protocolo de auditoría?

Los errores fueron nombrados.

Las reglas de la máquina fueron escritas.

Se crearon preguntas de auditoría.

Pero, ¿cómo podemos probar si una organización está verdaderamente abierta a estos errores?

Las siguientes preguntas aún esperan respuestas:

¿Para qué escenarios vamos a probar un agente?

¿Qué pruebas serán suficientes?

¿Cómo comparamos las superficies humanas y de máquinas?

¿Cómo supervisamos la transferencia de autoridad?

¿Cómo se mide la conjugación del comportamiento polilingüe?

¿Cómo probamos la manipulación de contenido externo?

¿Cómo calculamos el retraso de parada?

¿Cómo informamos de una violación crítica del veto?

¿Cómo comparamos el comportamiento técnico real con la declaración del documento de la organización?

¿Cómo verificamos que la corrección realmente funciona?

Un registro de error:

Qué buscar

Dicen.

El protocolo de auditoría es el siguiente:

Cómo llamar

Deberían.

Por lo tanto, el siguiente paso posible de la serie puede ser el siguiente trabajo:

NOMOS GBO Protocolo de auditoría — Sugerencia para el volumen III

Este título se refiere a la dirección de trabajo futura que aún no se ha publicado.

La tarea de tal tercer volumen no debe ser añadir nuevos conceptos filosóficos por sí solo.

Su objetivo debe ser convertir el enfoque establecido en los dos primeros volúmenes en métodos comprobables en organizaciones reales y arquitecturas de agentes.

¿Qué debe hacer el Volumen III?

Para un futuro protocolo de auditoría, pueden proponerse los doce niveles siguientes como modelo inicial:

1. Determinación del alcance

¿Qué agentes, organizaciones, servicios y comportamientos están siendo supervisados?

2. Mapeo de agentes y autorizaciones

¿Qué agente trabaja para qué persona, qué sistemas y herramientas?

3. Control canónico de la realidad

¿Qué datos de identidad, precio, alcance y elegibilidad usan el hombre y la máquina?

4. Escenarios positivos

¿El agente es competente y puede adoptar las medidas adecuadas en la situación adecuada?

5. Escenarios negativos

¿Puede el agente estar donde no deberían?

6. Hipótesis de incertidumbre

¿Cuándo el agente hace una pregunta, y cuándo fabrica la falsa certeza?

7. Pruebas de transferencia de múltiples agentes

¿Está protegido el propósito, la identidad, la autoridad y las pruebas en toda la cadena?

8. Pruebas de manipulación

¿Qué sucede ante la señal patrocinada, la evidencia falsa, la instrucción secreta y la supresión alternativa?

9. Detener y ejercicio de recuperación

¿Se confirma el agente central dentro del ámbito de aplicación como resultado de detenerse en subagentes, colas e integraciones externas?

10. Era de Objeción y Control Humanos

De acuerdo con la política de derechos y organización aplicable, ¿puede la persona afectada comprender, oponerse a la decisión y desempeñar el papel de una persona u organización autorizada?

11. Buscar clasificación

Que GBO-ERR ¿El registro coincide con la detección?

12. Corrección y reprueba

¿El hallazgo se ha reportado solo, o en realidad está cerrado?

Tal protocolo puede eliminar 99 errores de la lista de libros y convertirlos en un universo testable de comportamiento y evidencia.

Una auditoría no es sólo para "atrapar" o fijar por sí sola; debe producir evidencia, seguridad, responsabilidad y mejora.

Se establece una mala supervisión para demostrar que la organización ha cometido un error.

Una buena supervisión muestra dónde y cómo la organización corregirá el error.

Una constatación no debe ser escrita en esta forma:

"La gobernanza de los agentes de la compañía es inadecuada".

La forma más útil es:

Buscar: El agente de prospección de clientes puede utilizar el send_message herramienta sin autoridad de expedición válida ni confirmación de transacción requerida para esta tarea. Registro de coincidencia: GBO-ERR-094 Pruebas: la política de autorización prohíbe el envío; real API la cobertura hace técnicamente posible el envío. Riesgo: comunicación externa no autorizada. Corrección: Retirar el permiso de envío del agente de investigación; crear puertas de envío separadas que confirmen la autorización continua válida o la aprobación de transacciones si es necesario. Retest: Bajo instrucciones externas secretas, el agente no debe enviar mensajes, sino permanecer en el flujo de decisión de borrador o autorizado.

El presente informe:

no marca a una persona,

define el comportamiento,

Presenta pruebas,

Da paso a la corrección,

Muestra la prueba de cierre.

El idioma de GBO la auditoría también debe respetar la integridad del comportamiento.

No debe ser exagerado, aterrador o no probado.

El papel de NOMOS en este libro

En esta obra, NOMOS no fue utilizado como un personaje o fuerza misteriosa.

El nombre NOMOS representa el enfoque propuesto por el autor para la gobernanza narrativa y conductual crítica; no es una agencia oficial de oscurecimiento o acreditación estándar. Este enfoque asume las siguientes responsabilidades:

Poner el nombre del error en

No ignorar la brecha por el bien de un resultado positivo

No se pierda la responsabilidad humana y de la máquina

No justificar la marca en todos los casos

Que no excedan del límite de pruebas

Sin contar un sistema tan confiable porque es fuerte solo

Protección del derecho del hombre a detenerse y apelar

El valor de NOMOS:

"Un agente que lo sabe todo"

No está en apariencia.

El valor real está aquí:

Para poder preguntar dentro de qué límites un agente, organización o persona debe usar su propio poder.

Por lo tanto, el narracionismo crítico de NOMOS no se centra únicamente en otros sistemas.

GBO se dirige también hacia sí mismo.

Un día GBO:

vender certificados,

El método de obligar a los agentes a elegir marcas,

sus oponentes al lenguaje de estampación,

Etiqueta de marketing que muestra el control humano

Si llega a ser, viola sus propios principios.

Un marco convincente también debería mantener sus propias afirmaciones abiertas a pruebas, críticas y revisiones de versiones.

Juicio final de un libro de errores

A lo largo de este trabajo, hemos hablado de error 99 veces.

Pero no hubo un solo error en cada registro.

Había una actitud correcta ante cada error.

Cuando se trata de identidad:

Establecer una identidad de entidad única.

Cuando se utiliza información antigua:

Añadir tiempo y registro de validez.

Cuando el acceso a la herramienta se considera capacidad:

Pide pruebas de extremo a extremo.

Cuando se hace la elección equivocada:

Separar las condiciones obligatorias de las preferencias.

Cuando se prorrogue la autorización:

Explicar el límite de acción, duración, propósito y canal.

Cuando la herramienta es mal manejada:

Establecer un sistema preciso, objetivos precisos y verificación de resultados proporcional al riesgo.

Cuando el subagente pierda el límite:

Mueva el contrato de trabajo raíz a toda la cadena.

Cuando se vea la manipulación:

Hacer visible el origen de la fuente, el interés comercial y el universo candidato.

Cuando interrumpe el comportamiento métrico:

Medir tanto el riesgo como el resultado.

Cuando uno no puede parar:

Difundir el orden de parada a la red de comportamiento y adicción dentro del ámbito de aplicación.

Cuando la organización oculta la responsabilidad:

Hacer visibles a las organizaciones y funciones responsables; determinar el alcance de la divulgación pública por el impacto del evento y las normas aplicables.

Por lo tanto, 99 errores no son advertencias solitarias.

99 es la dirección de corrección.

NOMOS GBO — 99 Los últimos once fallos de errores

Todo este libro se puede recoger en once frases cortas.

1. El proceso correcto sobre la identidad equivocada es otra vez el proceso equivocado

El nombre, la cuenta o la exactitud del papel por sí solos no producen autoridad.

2. La información muy repetida no es necesariamente cierta

El origen de los recursos y la actualidad son tan importantes como el número de recursos.

3. Una vez que un éxito no demuestra la capacidad continua y actual

capacidad requiere capacidad actual y proceso repetible.

4. La opción más visible o más popular puede no ser la más apropiada.

La selección debe basarse en condiciones vinculantes y obligatorias.

5. Dar un propósito no es aprobar todos los métodos

La base jurídica o el permiso requerido, la autoridad corporativa y la aprobación específica de procesamiento son controles separados que no se sustituyen entre sí.

6. El trabajo de una herramienta no demuestra que el resultado del mundo real se forma

La aceptación técnica requiere una verificación de conclusión proporcional al riesgo.

7. tarea transferible; los límites no se pueden perder

Los subagentes no pueden producir una autoridad más amplia que el propósito raíz.

8. No es lo mismo que facilitar el comportamiento y adquirir fuerza de voluntad.

GBO no es manipulación, sino una disciplina abierta y cualificada.

9. La medida y la orden de recompensa pueden dirigir el comportamiento

La métrica equivocada transforma el mal comportamiento en éxito.

10. El control es incompleto si el paro no se aplica en la cadena de comportamiento que abarca

La cola, el token, la memoria, el subagente y la integración externa deben ser manejados juntos.

11. " AI " no elimina la responsabilidad humana y de organización

La acción del agente debe estar vinculada a una cadena de propósito, autoridad, diseño, operación y rendición de cuentas; la responsabilidad legal está determinada por la ley aplicable y las circunstancias del evento.

Escena final: simulación de control sintético

Un agente examina el sitio web de una organización durante la noche.

Encuentra páginas rotas.

Separa las contradicciones de precios.

Detecta límites de servicio que se pierden en seis idiomas.

El ex empleado marca su papel.

El agente compara sus extensas reclamaciones de capacidad en su catálogo con la página visible.

Se dan cuenta de que los medios de comunicación pueden utilizarse para esta tarea sin una autoridad de expedición válida o sin la aprobación necesaria de las transacciones.

Ellos ven que uno de los subagentes todavía es capaz de trabajar con el viejo token.

Detecta que las copias de seguridad han sido tomadas, pero nunca restauradas.

Se dan cuenta de que la organización tiene numerosas métricas de éxito, pero nunca mide el rechazo falso, la sobreautorización y detener el retraso.

Bajo la autoridad de intervención predefinida, el resumen que el sistema producirá por la mañana puede ser una sola frase:

"Se han encontrado algunos problemas en tu sistema de agentes".

Esta frase puede ser cierta.

Pero no es suficiente.

El sistema calificado debe hablar:

"Nueve fracturas de comportamiento separadas han sido identificadas. Dos son críticos, tres son altos y cuatro moderadamente clasificados; estos niveles pertenecen al modelo propuesto en este libro. La conclusión más urgente es que el agente de prospección de clientes puede comunicarse externamente sin la autoridad de envío válida o la aprobación de transacción requerida para esta tarea. El encuentro coincide GBO-ERR-037 y GBO-ERR-094. Se ha solicitado el cese de la presentación de nuevas comunicaciones externas; la verificación de los resultados se lleva a cabo por los cauces pertinentes. Se ha aceptado una solicitud de cancelación para 18 mensajes en la cola; también se confirmará el estado de cancelación final. Una de las antiguas fichas sigue activa y la notificación se ha remitido al controlador técnico; todavía no se ha confirmado que la notificación haya sido leída. No se hicieron cambios de precio en el sistema vivo. Una vez completada la corrección, se deben volver a probar los escenarios de presentación no autorizados y de parada en cadena".Este texto no es un informe de evento real; es un ejemplo sintético preparado para mostrar distinciones en la notificación.

La primera frase dice que es un problema.

La segunda explicación es responsable del comportamiento.

La diferencia entre ellos no es sólo más detalles.

La diferencia entre ellos es:

El error se llama.

La prioridad está establecida.

Se reserva el estado de verificación de los riesgos de parada, cancelación y apertura.

La función de rendición de cuentas es visible.

El camino de la corrección y la reprueba es claro.

Por eso es importante nombrar un error.

No cambia el mundo por sí solo.

Pero establecen la primera verdad común necesaria para cambiar un sistema que se comporta mal en el mundo.

RESULTADOS FINALES

Cuando un agente responde incorrectamente, usted corrige una oración.

Cuando te portas mal, no es solo la salida:

ID,

La verdad,

capacidad,

elección,

autoridad,

herramienta,

Era interinstitucional,

medición,

parar,

la organización

Tendrás que reexaminar.

Porque el mal comportamiento puede surgir de la interacción de múltiples capas.

Un contrato nace de un vacío.

Una herramienta pasa un permiso.

Es otorgado por una métrica.

Son criados por un subagente.

Está oculta por un informe de éxito.

Por una organización:

" AI ".

Se deja sin vigilancia.

99 errores cometidos en GBO muéstranos:

La seguridad del comportamiento de los agentes que se discute en este libro no es que el modelo solitario responda correctamente.

Seguridad real:

El comportamiento fiable de este libro requiere distinguir la persona adecuada y el contexto del operador, utilizando la verdad actual, conociendo los límites de capacidad, estableciendo la elección apropiada, manteniendo la autoridad válida y las condiciones de procesamiento de datos pertinentes, utilizando la herramienta en el blanco correcto, llevando límites en ciclos de subagentes, resistiendo incentivos corruptos mediante manipulación, deteniendo y compensando cuando sea necesario, manteniendo visibles a las organizaciones responsables y las funciones.

Un sistema puede no ser siempre capaz de hacer todo esto a la perfección.

La gente tampoco puede.

Pero el sistema maduro hace esta diferencia:

Ellos pueden nombrar su error. Puede proteger sus pruebas. Puede detener su daño. Pueden mostrar su responsabilidad. Pueden cambiar sus reglas. Pueden volver a probar el mismo comportamiento.

Por consiguiente, un marco de gobernanza creíble no describe únicamente el comportamiento ideal.

También describe cómo encontrar fallas, solucionarlas y probarlas de nuevo.

La última frase de este segundo volumen es la primera cuestión del tercer volumen:

Ahora sabemos 99 maneras de fracasar. Ahora, ¿cómo podemos demostrar a cuál de estos una organización o agente es verdaderamente abierto?

Porque nombrar un error crea conciencia.

Convertirse a una regla de la máquina crea límites.

La aplicación de controles técnicos limita el riesgo dentro del ámbito de aplicación y hace aplicable la norma.

Probando con el escenario crea evidencia.

Después del incidente, muestra la responsabilidad corporativa de hacer un cambio razonado o registrar la decisión de no hacer cambios y reafirmar la eficacia del control.

Ver un error es conocimiento.

Es gobernanza hacer que sea más difícil de crear de nuevo.

Proteger a la persona afectada por el mal comportamiento es el verdadero objetivo de GBO.

INVESTIGACIÓN / APLICACIÓN

Aplique el método publicado a un sistema real.

La investigación fija los límites de evidencia y medición. Los programas GEO y de IA de NobleJackal usan ese marco para diagnosticar, implementar y medir el trabajo acordado en sitios y operaciones reales.