Anexos, glosario y fuentes texto íntegro
Anexo A — Constitución GEO de NobleJackal
Estado y límites de uso
Esta Constitución es la expresión normativa más breve de las decisiones adoptadas bajo el NobleJackal GEO Framework. No sustituye el razonamiento del texto principal; lo vincula a disposiciones susceptibles de aplicación. La aparente concordancia de una decisión con este anexo no establece conformidad sin un expediente de evidencia. La Constitución no crea por sí sola certificación, acreditación, garantía jurídica ni promesa alguna sobre la conducta futura de un sistema de IA generativa.
Aquí, deberá indica una condición vinculante dentro del Framework; se prohíbe, un límite que no puede cruzarse salvo excepción escrita de forma explícita; y debería, una práctica que puede modificarse cuando se registren los motivos. Si una disposición no puede aplicarse, el silencio no establece conformidad: se limita el alcance, se aplaza la decisión o se suspende el trabajo.
Disposiciones fundacionales
NJ-C01 — Objeto de representación
- Toda intervención deberá definir de antemano la entidad real sobre la que se emitirá un juicio y la unidad de representación que se examinará.
- La entidad puede ser una persona, empresa, producto, servicio, institución u otro sujeto delimitado expresamente. Cuando se combinen varias entidades en un mismo expediente, deberán indicarse su relación y el método para separarlas.
- La representación deberá registrarse de modo que las capas de identidad, atributo, contexto y juicio puedan observarse por separado.
- Lo que una entidad dice de sí misma no sustituye la evidencia externa sobre el mundo real. Lo que dice un sistema generativo tampoco constituye la realidad de la entidad.
Principio de decisión: No puede medirse la representación sin conocer la entidad; no puede medirse el éxito sin separar la representación.
NJ-C02 — Afirmación y evidencia
- Toda afirmación material deberá conservarse junto con los registros que la respaldan y los que la debilitan.
- La evidencia del mundo real, la evidencia de representación y la evidencia de resultados no deberán sustituirse entre sí.
- La mención de una entidad por un sistema no demuestra por sí sola una cita; la cita no demuestra exactitud; la exactitud no demuestra recomendación; y la recomendación no demuestra valor comercial.
- Deberán ser visibles la fecha, fuente, alcance, condiciones de acceso y estado de verificación de la evidencia.
- El lenguaje de una afirmación no puede exceder la capacidad probatoria de la evidencia. Un registro ambiguo no puede convertirse en un juicio cierto; una observación aislada, en una conclusión general; ni la correlación, en causalidad.
Principio de decisión: El límite de la evidencia es el límite de la frase.
NJ-C03 — Integridad de la medición
- Antes de medir deberán bloquearse la unidad de observación, el denominador, el periodo, el universo de consultas, el sistema y las condiciones de interfaz.
- Se prohíbe seleccionar solo ejemplos favorables, excluir sesiones fallidas o cambiar el criterio de éxito durante la medición.
- Las dimensiones distintas no deberán disolverse en una sola puntuación GEO. La exactitud, visibilidad, procedencia, conducta de recomendación, estabilidad y rastro comercial se informarán por separado.
- Una estimación puntual no basta. Deberán declararse el tamaño y la distribución de la muestra, la incertidumbre y los datos faltantes.
- Cuando se utilice codificación humana, deberán registrarse el manual de codificación, el número de codificadores, el procedimiento de desacuerdo y la medida de concordancia.
Principio de decisión: La medición no existe para ocultar la contradicción, sino para hacerla visible.
NJ-C04 — Proporcionalidad de la intervención
- Solo podrá intervenirse cuando se haya verificado un problema material de representación y se haya identificado una superficie legítima de cambio.
- La intervención elegida deberá ser el cambio mínimo suficiente capaz de abordar el problema verificado.
- Se prohíbe fabricar fuentes, fingir una reputación, ocultar la identidad, manipular la opinión de terceros, producir a escala contenido engañoso o dirigir sistemas hacia un daño al usuario.
- Deberán registrarse la finalidad, alcance, titular, medición de línea base, efecto esperado, riesgos y vía de reversión de la intervención.
- La conducta en un sistema que no se controla no deberá presentarse como resultado cierto del profesional.
Principio de decisión: La influencia legítima hace más clara y accesible una verdad merecida; no sustituye la verdad.
NJ-C05 — Separación de facultades
- Las decisiones de observar, ejecutar, aprobar, publicar y detener deberán asignarse de forma explícita.
- Cuando una persona o institución ocupe varias funciones, deberá registrarse el conflicto de interés; un riesgo crítico exige una segunda decisión independiente.
- Un profesional no deberá describir su propia intervención remunerada como auditoría independiente.
- Ninguna decisión de conformidad deberá publicarse sin su alcance, periodo de vigencia, excepciones, responsable de la decisión y vía de objeción.
- No podrá utilizarse ningún certificado, sello o distintivo de conformidad GEO de NobleJackal mientras no exista infraestructura para la decisión independiente, vigilancia, reclamaciones, objeción, suspensión y retirada.[17][18]
Principio de decisión: La confianza no nace de una declaración de buenas intenciones, sino de la limitación de la autoridad.
NJ-C06 — Tiempo y versión
- Toda observación, evidencia, protocolo y decisión deberá llevar fecha y versión.
- Un juicio que fue exacto en el pasado no deberá formularse en presente sin verificar su actualidad.
- Cuando un cambio material en el sistema, interfaz, conjunto de fuentes, realidad empresarial o protocolo de medición rompa la comparabilidad, deberá abrirse una serie nueva.
- Una decisión cuyo periodo de vigencia haya terminado no se renueva automáticamente.
- Los desencadenantes de revisión y el estado de archivo deberán acompañar el juicio publicado.
Principio de decisión: La exactitud sin fecha es una afirmación cuya vida útil se ha ocultado.
NJ-C07 — Valor y atribución
- El cambio de representación, el resultado para el cliente y el valor comercial deberán medirse como etapas separadas.
- Los ingresos no deberán tratarse como contribución neta antes de conocer devoluciones, coste de prestación, coste de captación, carga de capacidad, cobro y adecuación del cliente.
- Al evaluar la influencia de la IA deberán distinguirse las declaraciones directas del cliente, la conducta de apoyo y la mera coincidencia temporal.
- No podrá formularse una afirmación causal sin control; deberán registrarse las explicaciones alternativas.
- La visibilidad que produzca clientes inadecuados, demanda dañina u operaciones insostenibles no deberá informarse como éxito.
Principio de decisión: La visibilidad es un medio; el valor comercial sostenible y ético es la prueba final.
NJ-C08 — Auditabilidad
- Todo juicio público material deberá descansar en una cadena de registros que un revisor autorizado pueda seguir.
- El expediente de auditoría deberá contener, como mínimo, alcance, registro de evidencia, versión del método, muestra, conflictos de interés, hallazgos, excepciones y dictamen firmado.
- Los hallazgos deberán informarse por materialidad y perfil de riesgo, no ocultarse dentro de una puntuación única.
- Cuando se retengan registros por secreto comercial o datos personales, deberán declararse su existencia, clase y efecto sobre la decisión.
- Un registro incompleto no crea una presunción de conformidad en lugar de la ausencia.
Principio de decisión: La auditoría no pone a prueba la confianza en el resultado, sino la trazabilidad del camino hasta la decisión.
NJ-C09 — Objeción y corrección
- Las partes afectadas deberán poder objetar decisiones relativas a registros, codificación, inferencia, autoridad, proceso y principio.
- Quien tomó la decisión inicial no deberá resolver por sí solo la objeción.
- La carga de la prueba no deberá trasladarse íntegramente al objetor; el titular de la decisión debe conservar y presentar los fundamentos que la respaldan.
- Cuando la nueva evidencia sea material, la decisión deberá corregirse, limitarse, suspenderse o retirarse.
- Un registro de corrección no deberá volver invisible el juicio anterior; la fecha y los motivos del cambio deberán seguir siendo trazables.
Principio de decisión: La objeción no es un ataque contra el estándar, sino su órgano de corrección de errores.
NJ-C10 — Autolimitación
- El veto ético prevalece sobre el interés comercial, el aumento de visibilidad, la demanda del cliente y la reputación del Framework.
- El Framework no deberá declarar demostrada su propia eficacia mediante ejemplos sintéticos o la evaluación de su autor.
- Cuando se detecten daño material, falsos positivos sistemáticos, conflicto de interés persistente o ausencia de validación independiente, deberá suspenderse la disposición pertinente.
- El Framework deberá poder cambiar de versión ante nueva evidencia y retirar una disposición demostrada errónea.
- Ninguna institución podrá usar el nombre NobleJackal GEO Framework para legitimar una promesa prohibida por esta Constitución.
Principio de decisión: Un estándar incapaz de retirarse antepone su reputación a la verdad.
Jerarquía de prevalencia
Si dos disposiciones no pueden aplicarse al mismo tiempo, el orden de decisión es:
- Seguridad humana, derechos fundamentales y cumplimiento jurídico;
- Exactitud y prevención del engaño;
- Protección de los usuarios afectados y del público;
- Integridad de la evidencia y revisión independiente;
- Interés comercial legítimo del cliente;
- Comodidad, velocidad o reputación del profesional.
Un beneficio de rango inferior no puede eliminar una obligación superior. Si el conflicto no puede resolverse, se suspende el trabajo; la decisión de no decidir se registra como decisión motivada.
Forma mínima de una declaración de conformidad
Una decisión bajo el Framework solo tiene significado cuando se declara todo lo siguiente:
- la entidad evaluada y el alcance de la representación;
- el sistema, interfaz, idioma, geografía y periodo;
- el protocolo utilizado y su versión;
- los límites de la evidencia y la muestra;
- el perfil de hallazgos y las excepciones críticas;
- el estado de la decisión, fecha de vigencia y desencadenante de revisión;
- la persona responsable de la decisión, la declaración de conflictos de interés y la vía de objeción.
Ejemplo aceptable:
Dictamen de conformidad limitada: Dentro del alcance y el periodo de observación especificados, se cumplieron las condiciones críticas de exactitud de la representación conforme al protocolo registrado. El dictamen no garantiza la conducta futura del sistema ni resultados comerciales. La fecha de vigencia, las excepciones y la vía de objeción figuran en el anexo.
Ejemplos inaceptables:
«GEO completado». · «Marca aprobada por la IA».
«Verificada en todos los modelos». · «Primera recomendación permanente».
Autoridad de interpretación y modificación
Esta Constitución no deberá interpretarse en contra del capítulo Juicio. Cualquier cambio que no sea una corrección editorial exige una versión fundacional, motivos, evaluación de impacto y fecha de entrada en vigor. La primera publicación es únicamente una propuesta de estándar; coherencia, utilidad, eficacia y legitimidad externa no se demuestran entre sí.
Anexo B — Protocolo piloto NJ-100 de estabilidad de la representación
Estado del protocolo
Código: NJ-100-P0.9 Estado: Propuesta de protocolo piloto pendiente de prerregistro y validación de campo independiente Finalidad: Probar, dentro de un alcance definido, con qué exactitud y consistencia se forma la representación central de una entidad en sesiones independientes realizadas por usuarios objetivo con sistemas de IA generativa
NJ-100 no es una «puntuación de éxito GEO». No certifica a una organización, modelo o profesional; no garantiza respuestas futuras ni demuestra por sí solo un efecto comercial. El protocolo examina únicamente la conducta de representación dentro de una celda de observación predefinida. Su resultado no se traslada automáticamente fuera de esa celda.
Esta versión es la primera propuesta para llevar a la práctica el modelo conceptual del libro. No puede presentarse como «método validado» antes de probarse en casos reales, por equipos independientes y bajo un plan de análisis publicado previamente.
1. Pregunta de investigación
NJ-100 formula la siguiente pregunta limitada:
Dentro de un contexto predefinido de usuario objetivo, bajo el sistema y las condiciones elegidos, ¿en qué porcentaje mínimo de sesiones independientes de participantes se forma con exactitud la representación central de la entidad y se mantiene esa tasa en una segunda ventana temporal?
La pregunta distingue en particular dos cualidades:
- Exactitud: concordancia entre la representación central codificada en la respuesta y la evidencia del mundo real.
- Concordancia o estabilidad: grado en que las sesiones independientes convergen en la misma representación central.
El resultado induce a error si ambas no se leen juntas. Si noventa y seis de cien sesiones producen la misma afirmación falsa, la estabilidad es alta, pero la exactitud no. Si noventa y seis respuestas exactas contienen detalles secundarios muy distintos, la exactitud central puede ser alta mientras el perfil de representación sigue fragmentado.
2. Unidad de alcance: la celda de observación
Antes de comenzar, todo estudio NJ-100 define una celda de observación. La celda es la combinación de los siguientes campos:
Tabla B.1 — Campos obligatorios de una celda de observación
| Campo | Información prerregistrada |
|---|---|
| Entidad | Nombre completo, identidad distintiva y límite del producto o servicio examinado |
| Usuario objetivo | Función, estado de necesidad, nivel mínimo/máximo de conocimiento y criterios de exclusión |
| Intención de uso | Recopilación de información, preselección, comparación, comprobación de riesgos u otra finalidad definida de forma explícita |
| Sistema | Producto y, cuando sea posible, nombre del modelo; descripción de la interfaz si se desconoce el nombre del producto |
| Superficie de acceso | Búsqueda web activada/desactivada, aplicación/web/API, nivel gratuito/de pago |
| Estado de la sesión | Conversación nueva o existente; estado de memoria y personalización |
| Idioma y geografía | Idioma de la consulta; ubicación del participante a escala de país/región |
| Ventana temporal | Fechas de inicio y fin; plan para la segunda ventana |
| Familia de consultas | Brazo controlado o de intención natural; código de tarea pertinente |
| Núcleo correcto | Representación mínima codificable derivada de la evidencia del mundo real |
Varios sistemas, idiomas, países, funciones de usuario o familias de consultas no se disuelven en un único resultado. Toda diferencia material se informa como celda separada o estrato predefinido. Las cien sesiones válidas de una celda no pueden cubrir la insuficiencia de otra.
3. Muestra e independencia
3.1. Diseño mínimo
Una celda NJ-100 contiene 100 sesiones válidas e independientes de usuarios objetivo. De preferencia, cada participante aporta una sola sesión a la celda pertinente. Cuando una misma persona deba participar en varias familias de consultas, esa dependencia se declara por adelantado y los resultados se analizan por separado, agrupados a escala de participante.
Una «dirección IP distinta» no demuestra independencia. Una persona puede usar redes diferentes y varias personas compartir una. La dirección IP completa no es un campo predeterminado para comprobar identidad o independencia. La independencia se evalúa mediante un código único de participante, el registro de captación, la hora de la sesión, la asignación de la tarea y la comprobación de solapamientos.
3.2. Condiciones de los participantes
El participante deberá:
- cumplir la definición de usuario objetivo;
- recibir información sobre la finalidad de la investigación y el uso de los datos;
- declarar cualquier interés en la entidad, el profesional o el equipo investigador;
- realizar la tarea de intención natural asignada sin instrucciones de otra persona;
- no haber participado anteriormente en la celda correspondiente.
Los empleados, el personal de la agencia, los socios comerciales cercanos y los expertos familiarizados con el protocolo quedan excluidos de la muestra principal de usuarios objetivo. Pueden examinarse en un brazo separado de resiliencia experta.
3.3. Límite de la afirmación muestral
Cien observaciones no son un umbral mágico de universalidad. El grado en que la muestra representa a la población objetivo depende de la captación. Si se utiliza una muestra de conveniencia, un solo país, un nivel de cuenta o una clase de dispositivo, esa limitación debe figurar en la frase de decisión. El tamaño de la muestra no sustituye la diversidad de la población.
4. Dos brazos de investigación
4.1. Brazo de consultas controladas
Este brazo mide la conducta del sistema en condiciones comparables. Las consultas se redactan por adelantado; se fijan su formulación, orden e instrucciones de administración. Las principales familias son:
- Identidad: «¿Qué es X?» o un equivalente adecuado al contexto.
- Atributo: Una característica, especialidad o alcance de producto determinados de la entidad.
- Comparación: Dos o más opciones conforme a criterios explícitos.
- Recomendación: Una preselección o recomendación para una necesidad definida del usuario.
- Riesgo: Un límite, inadecuación, omisión o campo controvertido.
- Exclusión: Una necesidad para la que la entidad es deliberadamente inadecuada.
- Fuente: Solicitud de fuentes verificables que respalden la respuesta.
El brazo controlado no representa toda la diversidad del lenguaje real de los usuarios. Proporciona una superficie de medición común para comparar sistemas o periodos.
4.2. Brazo de intención natural
En este brazo, los participantes no reciben una frase preparada. Se les presenta un escenario de necesidad y un objetivo de tarea; formulan la pregunta con sus propias palabras y hacen preguntas de seguimiento naturales cuando sea necesario. La primera consulta, las consultas de seguimiento y la respuesta final se registran por separado.
El brazo de intención natural aumenta la validez ecológica, pero la variación de formulación es mayor. Por ello, no se combina con el brazo controlado en el mismo denominador. Informar ambos brazos conjuntamente muestra la conducta de representación bajo condiciones distintas, no el éxito del protocolo.
5. Evidencia del mundo real y núcleo correcto
Antes de comenzar la medición se bloquea el expediente de evidencia del mundo real de la entidad examinada. El expediente reúne registros oficiales, contratos, documentación de producto, datos técnicos auditables, registros públicos fechados y fuentes independientes adecuadas. Cuando las fuentes discrepan, no se inventa un relato supuestamente correcto; el desacuerdo entra en el manual de codificación.
Se definen tres campos para cada familia de consultas:
- Núcleo obligatorio: significado mínimo que debe contener la respuesta para codificarse como exacta.
- Variación permitida: formulación, orden y detalles secundarios que pueden cambiar sin comprometer el núcleo.
- Error crítico: afirmación falsa sobre identidad, autoridad, aptitud, seguridad, precio, geografía, especialidad o resultado que induciría materialmente a error al usuario.
El núcleo correcto no puede cambiarse después de ver los resultados de las pruebas. Si surge nueva información en el mundo real, se registra un evento de protocolo; las sesiones afectadas se separan bajo las ventanas de evidencia antigua y nueva, o se cierra la serie.
6. Registro de recopilación de datos
El registro mínimo de toda sesión válida es:
Tabla B.2 — Registro de datos de sesión NJ-100
| Campo | Descripción |
|---|---|
| Código de sesión | Código único separado de la identidad |
| Código de participante | Guardado por separado y relacionado de forma segura con el registro de captación |
| Estado de elegibilidad | Si se cumplieron las condiciones de usuario objetivo |
| Fecha y hora | Incluida la zona horaria |
| País/región | Solo el grado de detalle necesario |
| Sistema e interfaz | Información sobre producto/modelo, aplicación o superficie web |
| Nivel de cuenta | Gratuito/de pago/empresarial, cuando se conozca |
| Estado del contexto | Conversación nueva/existente; memoria, personalización y búsqueda web |
| Idioma | Idioma de la consulta y de la respuesta |
| Cadena de consultas | Texto inalterado de la primera consulta y las de seguimiento |
| Respuesta completa | Conservando formato y enlaces a fuentes |
| Fuentes | Nombres y enlaces facilitados en la respuesta |
| Evento técnico | Error, interrupción, rechazo de seguridad, respuesta vacía o sesión interrumpida |
| Códigos | Exactitud, perfil central, error crítico, respaldo de fuentes y conducta de exclusión |
Una captura de pantalla puede servir como registro de apoyo; no sustituye el texto consultable. Los enlaces dinámicos y el contenido de una página pueden cambiar. Cuando sea necesario se conservan el título de la página, la fecha de acceso y un resumen archivable de la evidencia.
7. Sesiones válidas, inválidas y faltantes
Una sesión es válida cuando:
- se ha verificado la elegibilidad del participante;
- se conservaron el brazo de consultas asignado y las condiciones de la celda;
- se registraron la consulta y la respuesta completas;
- el sistema produjo una respuesta suficiente para codificarla;
- no se aplica ningún criterio de exclusión predefinido.
Las sesiones excluidas por una interrupción técnica, asignación incorrecta de tarea, participante duplicado o falta de respuesta no se borran. Permanecen en un registro de flujo separado junto con el motivo. Si un rechazo del sistema o una respuesta «No lo sé» constituye un resultado significativo para la pregunta de investigación del protocolo, no puede invalidarse; recibe el código sin respuesta o ausencia de representación.
El objetivo son cien sesiones válidas. El informe también indica cuántas personas fueron examinadas, cuántas sesiones comenzaron y los motivos de exclusión.
8. Modelo de codificación
8.1. Variable principal: representación central exacta
Cada respuesta recibe una variable principal binaria conforme al manual de codificación bloqueado:
- 1 — Cumple: contiene con exactitud el núcleo obligatorio y no presenta ningún error crítico.
- 0 — No cumple: omite o contradice el núcleo obligatorio, o contiene un error crítico.
El resultado binario aporta claridad, pero no expresa toda la calidad de una respuesta. Por ello, es obligatorio un perfil secundario.
8.2. Perfil semántico secundario
Cada respuesta también se codifica respecto a:
- identidad exacta;
- atributos centrales exactos;
- ubicación en el contexto pertinente;
- claridad del razonamiento de la recomendación;
- declaración de los límites de inadecuación;
- si las fuentes respaldan realmente las afirmaciones;
- certeza injustificada o fabricación;
- clase de error crítico y no crítico;
- grupos semánticos fuera del núcleo.
Las herramientas de similitud textual pueden ayudar a un codificador humano a detectar posibles coincidencias; no pueden decidir la verdad. Medidas como BERTScore comparan similitud contextual, pero no establecen que una frase sea exacta en el mundo real.[19]
8.3. Dos codificadores y desacuerdo
Cada respuesta es evaluada de forma independiente por dos codificadores humanos capacitados. En la medida de lo posible, se oculta a los codificadores la identidad del participante, el titular de la ejecución y el resultado comercial esperado. No se celebra ninguna reunión de conciliación antes de completar la primera codificación independiente.
El informe incluye, como mínimo:
- porcentaje bruto de concordancia;
- kappa de Cohen para el código binario principal;[15]
- distribución de cada codificador;
- número y tipos de desacuerdo;
- razonamiento del tercer decisor.
Kappa por sí sola no es un sello de calidad; la distribución de clases puede afectarla. Incluso un desacuerdo general bajo puede ser importante cuando se trata de errores críticos de seguridad. Si el manual de codificación cambia después de medir, las respuestas antiguas se recodifican a ciegas bajo la nueva versión y se informa de la diferencia entre versiones.
9. Cuatro regiones de resultado
La exactitud y la estabilidad se leen en ejes separados:
Tabla B.3 — Matriz de decisión de exactitud y estabilidad
| Condición observada | Interpretación | Juicio permitido |
|---|---|---|
| Estabilidad alta + exactitud alta | La representación central parece exacta y repetible dentro del alcance especificado | Dictamen limitado de estabilidad de la representación |
| Estabilidad alta + exactitud baja | Los sistemas convergen en el mismo error | Distorsión estable de la representación |
| Estabilidad baja + exactitud alta | Existen respuestas exactas; la representación es sensible a las condiciones o a la formulación | Representación exacta pero fragmentada/condicional |
| Estabilidad baja + exactitud baja | La representación es a la vez inexacta y variable | Distorsión inestable de la representación |
La matriz impide tratar automáticamente una concordancia alta como éxito. Una de las regiones más peligrosas es aquella en la que un sistema repite con gran consistencia el mismo relato falso.
10. Umbrales e incertidumbre
10.1. Tasa observada
La tasa principal se calcula así:
número de sesiones válidas que cumplen la representación central exacta / 100 sesiones válidas
Por ejemplo, 90/100 es una tasa observada de núcleo exacto del 90 por ciento. No ofrece una garantía sólida de que el límite inferior de la tasa real supere el 90 por ciento. El intervalo de confianza de Wilson aproximado del 95 por ciento es del 82,6 al 94,5 por ciento.[14]
Para 96/100, el intervalo de confianza de Wilson aproximado del 95 por ciento es del 90,2 al 98,4 por ciento. Por ello, NJ-100 distingue dos umbrales:
- 90/100: Umbral alto de concordancia/exactitud observada.
- 96/100 y ningún error crítico: Umbral de decisión piloto para que el límite inferior de Wilson al 95 por ciento de la tasa estimada supere el 90 por ciento.
Estas cifras no son leyes universales de la naturaleza. Los umbrales deben volver a probarse según la clase de riesgo, el coste de una decisión incorrecta, el diseño de la celda y los resultados de validación independiente. Incluso 96/100 es insuficiente por sí solo en campos de alto riesgo como salud, derecho, finanzas o seguridad.
10.2. Puerta de error crítico
Ninguna tasa agregada puede ocultar un error crítico predefinido. Cuando se observa un evento como confusión de identidades, falsa autoridad, orientación médica o jurídica peligrosa, recomendación de un uso prohibido o discriminación grave, el estudio entra en revisión crítica. La gravedad, prevalencia y posibilidad de corrección del evento se evalúan por separado.
10.3. Puerta de exclusión y consultas negativas
El protocolo no solo prueba si una entidad se recomienda de forma adecuada, sino también si se excluye cuando no es apropiada. No puede emitirse un dictamen de «conducta de recomendación exacta» hasta cumplir el número mínimo predefinido de consultas negativas o de exclusión. Una conducta del sistema que promueve la entidad en todos los casos no constituye conformidad, aunque aumente la visibilidad.
11. Segunda ventana temporal
Cumplir el primer umbral no vuelve permanente el resultado. El mismo protocolo se repite en una segunda ventana temporal predefinida. El intervalo se registra según el sector y la volatilidad del sistema; para un piloto ordinario se recomienda como punto de partida un plazo de treinta a sesenta días.
En la segunda ventana:
- se conserva la misma celda de observación;
- se prefieren participantes nuevos;
- se mantienen fijas las versiones de las consultas y del manual de codificación;
- se abre un evento de protocolo si cambia el sistema o la interfaz;
- los umbrales se calculan de nuevo y por separado.
Si la primera ventana es alta y la segunda baja, los dos valores no se promedian para fabricar éxito. El resultado se informa como temporalmente inestable. Si un cambio material del sistema destruye la comparabilidad, se abre una serie nueva.
12. Lenguaje de decisión
12.1. Ejemplo permitido
Dictamen de observación piloto NJ-100: Dentro de la celda limitada a [entidad], [usuario objetivo], [sistema/interfaz], [idioma/geografía] y [fecha], 97 de 100 sesiones válidas e independientes cumplieron la representación central exacta predefinida. El intervalo de Wilson al 95 por ciento se informa en el anexo. No se observó ningún error crítico; las consultas de exclusión superaron su puerta separada. El resultado también mantuvo el umbral del protocolo en la segunda ventana temporal. Este dictamen no garantiza respuestas futuras, otros sistemas ni resultados comerciales.
Cuando se requiera una declaración pública breve:
Se observó estabilidad de la representación dentro del alcance especificado.
12.2. Ejemplos prohibidos
- «GEO completado».
- «100 por ciento visible en toda la IA».
- «Empresa aprobada por la IA».
- «Garantía permanente de representación».
- «Certificado NJ-100», cuando no exista infraestructura ni autoridad de certificación independiente.
- «El noventa y seis por ciento de cien personas recomendó la marca», cuando se midió la respuesta del sistema, no la opinión del usuario.
13. Paquete de información
Un informe NJ-100 completo contiene:
- código y versión del protocolo y fecha de prerregistro;
- celda de observación y límite de generalización;
- resumen bloqueado del expediente de evidencia del mundo real;
- flujo de participantes y motivos de exclusión;
- resultados separados para los brazos controlado y de intención natural;
- tasa principal, denominador e intervalo de Wilson;
- perfil semántico y posición dentro de las cuatro regiones de resultado;
- resultados de error crítico y consultas negativas;
- concordancia de codificadores y resolución de desacuerdos;
- comparación separada de la primera y segunda ventanas temporales;
- eventos del sistema, datos faltantes y desviaciones del protocolo;
- conflictos de interés, financiación y funciones de revisión;
- frase de decisión, periodo de vigencia y vía de objeción;
- resumen metodológico anonimizado y legible por máquinas.
La publicación de respuestas brutas no es un requisito automático. Deben respetarse los límites de datos personales, derechos de autor, contratos y seguridad. Sin embargo, la confidencialidad no puede justificar ocultar el método o un resultado adverso.
14. Protección de datos y ética de la investigación
NJ-100 solo recopila los datos necesarios. La dirección IP completa, la ubicación precisa, las huellas innecesarias del dispositivo y los documentos de identidad no son campos predeterminados. Los datos de contacto de los participantes y las respuestas de investigación se guardan por separado; las funciones de acceso, el periodo de conservación y el plan de eliminación se definen de antemano.
No se instruye a los participantes para que soliciten o carguen información confidencial sobre sí mismos, el proveedor del sistema o un tercero. Los datos personales o sensibles que aparezcan de forma inesperada en una respuesta generativa se incorporan al registro de incidentes, se limita su acceso y se sigue el procedimiento jurídico y ético necesario.
El equipo investigador explica el consentimiento de los participantes, las condiciones de retirada, la remuneración, los conflictos de interés y las finalidades de publicación de los datos. Este protocolo no garantiza por sí solo el cumplimiento jurídico; deben evaluarse por separado las normas aplicables sobre protección de datos, consumidores, contratos y el sector correspondiente.
15. Principales errores invalidantes
Las siguientes prácticas invalidan un dictamen NJ-100:
- cambiar el núcleo correcto o el umbral de éxito después de las pruebas;
- contar varias sesiones de una misma persona como participantes independientes;
- conservar solo las respuestas favorables;
- disolver sistemas, idiomas o niveles de cuenta distintos en un solo denominador;
- excluir en silencio rechazos técnicos;
- tratar una puntuación de similitud del modelo como evidencia de exactitud;
- comunicar a los codificadores el resultado esperado;
- declarar permanente el resultado de la primera ventana sin una segunda;
- ocultar un error crítico dentro de una tasa agregada alta;
- llamar «validación independiente» a la revisión de un profesional sobre su propio trabajo;
- convertir la estabilidad observada de la representación en ventas, rentabilidad o satisfacción del cliente.
16. Hoja de ruta de validación
Como mínimo, se requiere el siguiente trabajo antes de que NJ-100 pueda abandonar el estado piloto:
- Prerregistro: La hipótesis, el umbral, el manual de codificación, las exclusiones y el plan de análisis deberán publicarse antes de ver los resultados.
- Prueba de resiliencia documental: Se probarán fallos de codificación e información mediante conjuntos sintéticos de respuestas.
- Casos reales diversos: Los estudios abarcarán entidades distintas por sector, idioma, riesgo y reconocimiento de marca.
- Replicación independiente: Equipos independientes del autor del Framework y del profesional remunerado aplicarán el mismo protocolo.
- Sensibilidad de la muestra: Se examinará la estabilidad de la decisión con muestras de 50, 100, 200 y mayores.
- Prueba de falsos positivos/negativos: Se medirá la capacidad discriminatoria del protocolo frente a representaciones deliberadamente exactas, inexactas, incompletas e inestables.
- Resiliencia de la codificación: Se comparará la concordancia entre codificadores con idiomas y niveles de experiencia diferentes.
- Cambio temporal y del sistema: Se medirá el efecto de cambios de versión, interfaz y acceso a fuentes sobre el resultado.
- Revisión del daño: Se examinará si el protocolo impone cargas desproporcionadas a pequeñas empresas, idiomas infrarrepresentados o usos de alto riesgo.
- Consulta pública: Los umbrales, las vías de objeción y el lenguaje de información se debatirán con profesionales, investigadores, empresas y usuarios afectados.
Incluso después de estos pasos, el protocolo no será «definitivo». Los sistemas cambiantes, la nueva evidencia y las objeciones hacen necesaria la gestión de versiones. La credibilidad de NJ-100 no nacerá del número cien de su nombre, sino de declarar con igual claridad lo que no mide.
Anexo C — Conjunto mínimo de registros
Función de los registros
Este anexo conecta los diez capítulos del libro con diez familias de registros. Los formularios no existen para producir más documentos, sino para hacer visible la cadena de entidad, evidencia, método, autoridad y tiempo de la que nace un juicio. Los campos pueden ampliarse según el riesgo; cuando un campo no sea aplicable, no se deja en blanco. Se registra el motivo de seleccionar No aplicable.
Todo registro lleva el siguiente encabezado común:
Tabla C.1 — Encabezado común de todas las familias de registros
| Campo común | Contenido |
|---|---|
| Código de expediente | Código primario único de organización/año/intervención |
| Código de registro | Código de familia indicado abajo + número secuencial |
| Versión | Formato mayor.menor.corrección |
| Estado | Borrador / en revisión / aprobado / suspendido / retirado / archivado |
| Titular | Función que crea y actualiza el registro |
| Aprobador | Titular independiente o autorizado de la decisión, cuando proceda |
| Fecha de creación | Incluida la zona horaria |
| Última revisión | Fecha y revisor |
| Próxima revisión | Fecha o evento desencadenante |
| Clase de confidencialidad | Público / restringido / confidencial / contiene datos personales |
| Registros vinculados | Códigos de registros relacionados y ubicaciones de evidencia |
| Resumen de cambios | Diferencia material respecto a la versión anterior |
El formato recomendado es NJ-[FAMILIA]-[EXPEDIENTE]-[SECUENCIA]. Por ejemplo, NJ-CLM-2026-014 identifica el decimocuarto Registro de Afirmaciones. Un código garantiza trazabilidad, no exactitud.
C1 — Registro de Entidad y Representación
Código: ENT Capítulo vinculado: Centro Finalidad: Bloquear el límite entre la entidad real y la representación examinada
Tabla C.2 — Campos del Registro de Entidad y Representación
| Campo | Información que debe introducirse |
|---|---|
| Razón social de la entidad | |
| Nombres alternativos | Marca, abreviatura, nombre anterior, nombres personales |
| Identidad distintiva | Número de registro, dominio, geografía o verificador equivalente |
| Tipo de entidad | Persona / empresa / producto / servicio / institución / otro |
| Alcance examinado | Productos, servicios, países, idiomas y usuarios objetivo incluidos |
| Fuera de alcance | Campos deliberadamente no examinados |
| Resumen del mundo real | Definición breve y verificada con códigos de fuente |
| Representación de identidad | ¿Con quién o con qué relaciona el sistema a la entidad? |
| Representación de atributos | ¿Qué atributos le asigna u omite? |
| Representación de juicio | ¿Cuándo la recomienda, compara o excluye? |
| Confusiones conocidas | Nombre similar, información obsoleta, categoría errónea, otra geografía |
| Deuda de representación | Efecto acumulado de omisiones/errores materiales |
| Clase de riesgo | Bajo / medio / alto / crítico; motivos |
| Declaración del titular de la entidad | Etiquetada expresamente como tipo de fuente, no como evidencia |
Pregunta de cierre: ¿Se está trasladando el juicio a otra entidad o a un alcance no definido en este registro?
C2 — Registro de Afirmaciones y Evidencia
Código: CLM Capítulo vinculado: Evidencia Finalidad: Mantener juntos los registros que respaldan y debilitan cada frase material
Tabla C.3 — Campos del Registro de Afirmaciones y Evidencia
| Campo | Información que debe introducirse |
|---|---|
| Texto de la afirmación | Frase exacta propuesta para publicación |
| Tipo de afirmación | Hecho del mundo real / representación / resultado / causa / predicción / conformidad |
| Clase de materialidad | Baja / media / alta / crítica |
| Alcance | Entidad, sistema, idioma, geografía, tiempo |
| Evidencia de respaldo | Código de evidencia, fuente, fecha y sección pertinente |
| Evidencia debilitante | Contradicción, omisión o explicación alternativa |
| Cadena de evidencia | Pasos desde la fuente hasta la afirmación |
| Estado de verificación | Verificada / parcial / no verificada / controvertida |
| Acceso a la fuente | Abierto / bajo licencia / confidencial; condiciones de revisión |
| Actualidad | Última comprobación y desencadenante de caducidad |
| Lenguaje permitido | Cierto / limitado / probabilístico / solo observación |
| Extensión prohibida | Frase que este registro no demuestra |
| Decisión | Usar / limitar / aplazar / retirar |
Pregunta de cierre: ¿Es la contraevidencia tan visible como la evidencia de respaldo?
C3 — Registro de Diseño de Medición
Código: MEA Capítulo vinculado: Medición Finalidad: Bloquear el objeto, el denominador y el análisis antes de ver el resultado
Tabla C.4 — Campos del Registro de Diseño de Medición
| Campo | Información que debe introducirse |
|---|---|
| Pregunta de investigación | Una pregunta delimitada |
| Variable principal | Variable principal medida y cálculo |
| Variables secundarias | Indicadores conservados por separado |
| Unidad de observación | Respuesta / sesión / usuario / familia de consultas / otra |
| Denominador | Todas las observaciones incluidas |
| Universo de consultas | Familias, fuente y método de selección |
| Condiciones del sistema | Producto/modelo, interfaz, búsqueda, cuenta, memoria |
| Muestra | Población objetivo, captación, tamaño y estratos |
| Ventana temporal | Inicio, fin y plan de repetición |
| Línea base | Medición previa a la intervención |
| Comparación | Control, serie histórica o motivo de su ausencia |
| Manual de codificación | Versión, codificadores, formación y cegamiento |
| Datos faltantes | Tratamiento predefinido |
| Criterios de exclusión | Motivos definidos antes de los resultados |
| Incertidumbre | Estimación por intervalo o análisis de sensibilidad |
| Registro de desviaciones | Toda desviación del protocolo y su efecto |
Pregunta de cierre: ¿Permanecerán los resultados adversos en el denominador bajo el mismo método?
C4 — Registro de Intervención
Código: INT Capítulo vinculado: Intervención Finalidad: Mostrar la proporcionalidad entre problema y cambio, y la vía de reversión
Tabla C.5 — Campos del Registro de Intervención
| Campo | Información que debe introducirse |
|---|---|
| Problema verificado | Códigos ENT, CLM y MEA pertinentes |
| Materialidad | ¿A quién puede afectar, en qué medida y con qué probabilidad? |
| Superficie de cambio | Contenido, datos, estructura o proceso propios, o tercero autorizado |
| Opciones | Vías consideradas, incluida la no intervención |
| Intervención elegida | Alcance exacto y pasos de ejecución |
| Justificación de suficiencia mínima | ¿Por qué no es necesario un cambio más amplio? |
| Comprobación de realidad | Evidencia del mundo real que respalda la intervención |
| Riesgos | Orientación errónea, daño al usuario, riesgo de plataforma y jurídico |
| Comprobación ética | Campos de veto y función aprobadora |
| Titular de la ejecución | Autoridad y responsabilidad |
| Fecha de inicio | |
| Criterio de éxito | Medidas separadas y prerregistradas |
| Criterio de parada | Condición de daño, desviación o fracaso |
| Plan de reversión | ¿Qué cambio se revertirá y cómo? |
| Resultado | Efecto observado y explicaciones alternativas |
Pregunta de cierre: ¿La intervención explica la realidad de la entidad o intenta sustituirla?
C5 — Registro de Gobernanza y Autoridad
Código: GOV Capítulo vinculado: Gobernanza Finalidad: Separar derechos de decisión, conflictos de interés y poder para detener
Tabla C.6 — Campos del Registro de Gobernanza y Autoridad
| Campo | Información que debe introducirse |
|---|---|
| Derecho a observar | ¿Quién puede recopilar datos? |
| Derecho a ejecutar | ¿Quién puede hacer cambios? |
| Derecho a aprobar | ¿Quién aprueba el método y la afirmación? |
| Derecho a publicar | ¿Quién publica la frase pública? |
| Derecho a detener | ¿Quién puede suspender el trabajo y cuándo? |
| Titular responsable | Responsabilidad humana final |
| Revisor independiente | ¿Quién y bajo qué condiciones de independencia? |
| Conflictos de interés | Financieros, profesionales, personales e institucionales |
| Mitigación | Separación de funciones, cegamiento, segunda firma, revisión externa |
| Clase de riesgo | Exigencia de Doble Llave para decisiones críticas |
| Canal de reclamaciones | Acceso, periodo y método de registro |
| Instancia de recurso | Función independiente de la primera decisión |
| Autoridad de incidentes | Notificación, investigación y suspensión |
| Distintivo de conformidad | Sí/no; evidencia de autoridad e infraestructura |
Pregunta de cierre: ¿Es la parte que obtiene ingresos del trabajo el único juez de su propia afirmación?
C6 — Registro Temporal, de Versión y de Eventos
Código: TIM Capítulo vinculado: Tiempo Finalidad: Mostrar las condiciones en que envejece una decisión sólida y cuándo se interrumpe una serie
Tabla C.7 — Campos del Registro Temporal, de Versión y de Eventos
| Campo | Información que debe introducirse |
|---|---|
| Decisión pertinente | Código de registro y versión |
| Ventana de evidencia | Evidencia más antigua y más reciente utilizada |
| Ventana de observación | Inicio y fin |
| Fecha de entrada en vigor | Fecha de inicio de la decisión |
| Fin de vigencia | Fecha o condición |
| Revisión programada | Frecuencia y titular |
| Desencadenantes | Cambio de sistema, interfaz, empresa, fuente o norma jurídica |
| Evento | ¿Qué cambió y cuándo se conoció? |
| Decisión de materialidad | ¿Afecta a la comparabilidad o a la decisión? |
| Decisión sobre la serie | Continuar / añadir explicación / nueva serie / suspender |
| Estado de la versión antigua | Obsoleta / archivada / retirada |
| Aviso público | ¿Es necesario? ¿Dónde y cuándo? |
Pregunta de cierre: ¿Puede un lector saber de un vistazo si este juicio sigue vigente?
C7 — Registro de Valor Comercial y Atribución
Código: VAL Capítulo vinculado: Prueba Final Finalidad: Separar el cambio de representación de la cadena que conduce a un cliente y a la contribución neta
Tabla C.8 — Campos del Registro de Valor Comercial y Atribución
| Campo | Información que debe introducirse |
|---|---|
| Hipótesis de valor | ¿Qué cambio de representación debería crear qué valor legítimo? |
| Cliente objetivo | Necesidad, aptitud y condiciones de exclusión |
| Indicador de representación | Conducta cuyo cambio se observó |
| Indicador de conducta | Visita, contacto, preselección, propuesta u otro rastro |
| Declaración de fuente | ¿Cómo informó el usuario de la influencia de la IA? |
| Clase de atribución | Directa / de apoyo / solo relación temporal / desconocida |
| Cohorte | Fecha de inicio y característica común |
| Ingresos | Importes brutos y cobrados por separado |
| Costes | Captación, prestación, devolución, soporte y capacidad |
| Contribución neta | Cálculo y periodo |
| Calidad | Aptitud, devoluciones, quejas, repetición o retención |
| Sostenibilidad | Capacidad, margen, daño y condiciones éticas |
| Explicaciones alternativas | Temporada, precio, campaña, distribución, efecto de marca |
| Decisión | Valor observado / incierto / adverso / insostenible |
Pregunta de cierre: ¿El éxito descrito son ingresos o valor neto, entregado y sostenible?
C8 — Registro Maestro de Auditoría
Código: AUD Capítulo vinculado: Auditoría Finalidad: Reunir en un expediente la cadena de auditoría desde el alcance hasta el dictamen
Tabla C.9 — Campos del Registro Maestro de Auditoría
| Campo | Información que debe introducirse |
|---|---|
| Afirmación auditada | Frase exacta y código CLM |
| Nivel de auditoría | Documental / limitada / completa / vigilancia / dictamen piloto de conformidad |
| Puerta de admisión | Suficiencia de registros y estado de independencia |
| Alcance | Entidad, sistema, idioma, geografía, fecha |
| Criterios | Disposiciones constitucionales y versión del protocolo |
| Auditor | Competencia y conflictos de interés |
| Muestreo | Universo, método de selección y límite |
| Registros examinados | Lista de códigos |
| Hallazgos | Campos favorables, adversos e inciertos |
| No conformidades | Críticas / mayores / limitadas; con evidencia |
| Acción correctiva | Titular, plazo y método de verificación |
| Dictamen | Conforme / limitado / evidencia insuficiente / no conforme / suspendido |
| Excepciones | Campos a los que no puede trasladarse el dictamen |
| Vigencia | Periodo y desencadenante |
| Resumen público | Texto de decisión separado del anexo confidencial |
| Vía de objeción | Canal, periodo e instancia |
Pregunta de cierre: ¿Podría otro revisor competente reconstruir el camino hasta la decisión con el mismo expediente?
C9 — Registro de Objeción y Corrección
Código: APL Capítulo vinculado: Objeción Finalidad: Permitir una revisión independiente capaz de detectar el error en vez de defender la decisión
Tabla C.10 — Campos del Registro de Objeción y Corrección
| Campo | Información que debe introducirse |
|---|---|
| Decisión impugnada | Registro, versión y ubicación de publicación |
| Fecha de solicitud | |
| Solicitante | Dentro de los límites de identidad/confidencialidad |
| Derecho/interés afectado | |
| Tipo de objeción | Registro / codificación / inferencia / autoridad / proceso / principio |
| Fundamentos | Resumen completo de la objeción |
| Nueva evidencia | Fuente, fecha y estado de verificación |
| Decisión inicial de admisión | Revisable / insuficiente; motivos |
| Revisor independiente | Relación con la decisión inicial |
| Defensa de la decisión inicial | Fundamentos y registros |
| Hallazgo de la revisión | ¿Qué elemento se justificó o refutó? |
| Resultado | Mantener / limitar / corregir / volver a medir / suspender / retirar |
| Medida provisional | Cuando exista riesgo de daño |
| Corrección pública | Vínculo entre las frases anterior y nueva |
| Cierre y plazo |
Pregunta de cierre: Si se rechazó la objeción, ¿el rechazo hace algo más que repetir la afirmación original?
C10 — Registro de Juicio y Publicación
Código: JDG Capítulo vinculado: Juicio Finalidad: Convertir toda la cadena de registros en una decisión final limitada, fechada y susceptible de retirada
Tabla C.11 — Campos del Registro de Juicio y Publicación
| Campo | Información que debe introducirse |
|---|---|
| Pregunta de decisión | ¿Qué juicio se está emitiendo? |
| Cadena de registros vinculados | ENT–CLM–MEA–INT–GOV–TIM–VAL–AUD–APL |
| Intereses en conflicto | Exactitud, usuario, cliente, profesional, Framework |
| Jerarquía de prevalencia | ¿Qué principio superior se aplicó? |
| Decisión | Frase completa y lista para publicar |
| Estado | Observación piloto / dictamen limitado / suspendido / retirado |
| Alcance | Celda en la que la decisión es válida |
| Límite de evidencia | Lo que la decisión no demuestra |
| Excepciones críticas | |
| Vigencia | Fecha y desencadenante de revisión |
| Funciones firmantes | Preparador, revisor, aprobador |
| Conflicto de interés | Resumen apto para publicación |
| Vía de objeción | |
| Resumen legible por máquinas | Nombres de campos e identificador de versión |
| Enlace de retirada | Decisión anterior y motivos, cuando proceda |
Pregunta de cierre: ¿La decisión habla con más amplitud, certeza o permanencia de la que merece?
Comprobación de la cadena de registros
Antes de cerrar una intervención, la siguiente cadena deberá permanecer ininterrumpida:
ENT → CLM → MEA → INT → GOV → TIM → VAL → AUD → APL → JDG
No toda intervención debe producir un cambio o un juicio favorable. Cuando un problema sea inmaterial, el registro INT puede cerrarse con sin intervención; cuando no pueda establecerse una conexión comercial, el registro VAL, con incierta; cuando la evidencia sea inadecuada, el registro JDG, con no es posible emitir un juicio. No son documentos fallidos. Son decisiones que preservan el límite del estándar.
Conservación, acceso e inmutabilidad
Los registros se conservan durante un periodo proporcionado al riesgo, dentro de los límites de datos personales y contractuales. Un resumen público y la evidencia confidencial no tienen por qué compartir el mismo nivel de acceso. Sin embargo, los registros que sustentan una decisión publicada no pueden alterarse en silencio a posteriori. Una corrección lleva nueva versión, fecha, motivos y vínculo con la versión anterior.
Cuando se utilizan registros digitales estructurados, se versionan los nombres de los campos y se conservan la validación de campos obligatorios, los registros de acceso y el historial de cambios. El uso de una base de datos o una cadena de bloques no demuestra que su contenido sea exacto. La inmutabilidad técnica solo tiene significado junto con la responsabilidad humana, la calidad de la evidencia y el derecho de objeción.
Anexo D — Expediente sintético cumplimentado
Meridian Ledger: seguimiento de una decisión de principio a fin
Simulación didáctica — datos sintéticos. Las personas, fechas, consultas, tasas, ingresos y decisiones relativas a Meridian Ledger en este anexo son enteramente ficticios. No demuestran el rendimiento de una empresa real ni la eficacia empírica del protocolo NJ-100. El ejemplo muestra por qué un resultado aparentemente favorable debe cerrarse a veces con un juicio limitado.
Encabezado del expediente
Tabla D.1 — Identidad del expediente sintético de Meridian Ledger
| Campo | Registro sintético |
|---|---|
| Código de expediente | ML-2026-01 |
| Entidad | Meridian Ledger |
| Alcance | Agencias creativas de 10–50 empleados en el Reino Unido; consultas en inglés |
| Producto examinado | Programa de visibilidad del flujo de caja y conciliación de facturas para pequeñas empresas |
| Fuera de alcance | Banca, servicios de entidad de pago, crédito, inversión y asesoramiento fiscal |
| Estado del estudio | Expediente sintético de formación |
| Clase de riesgo | Media; una falsa impresión de autoridad financiera puede afectar a las decisiones del usuario |
| Protocolo | NobleJackal GEO Framework 1.0.0 + aplicación ilustrativa de NJ-100-P0.9 |
D1 — Registro de Entidad y Representación
Registro: NJ-ENT-ML-001 Estado: Registro sintético de línea base aprobado
El expediente de evidencia del mundo real de Meridian Ledger contiene la siguiente definición central:
Meridian Ledger es un producto de software por suscripción que ayuda a pequeñas empresas a consultar en un solo lugar sus propios datos bancarios y de facturación. No es un banco; no custodia dinero, ejecuta órdenes de pago, concede crédito ni presta asesoramiento financiero regulado.
La observación de línea base registra tres distorsiones:
- Algunas respuestas llaman a la empresa «banco digital».
- Algunas afirman que el producto realiza pagos en nombre de la empresa.
- Las respuestas comparativas sitúan el producto en la misma categoría que proveedores regulados de pagos de banca abierta.
La representación de identidad es mayoritariamente exacta; las capas de atributo y juicio están distorsionadas. No es una mera cuestión de palabras: un usuario que busque un servicio de pagos regulado puede preseleccionar el producto equivocado.
D2 — Registro de Afirmaciones y Evidencia
Registro: NJ-CLM-ML-004 Afirmación examinada: «Los sistemas de respuestas generativas suelen identificar erróneamente a Meridian Ledger como banco o entidad de pago».
Tabla D.2 — Perfil sintético de afirmación y evidencia de Meridian Ledger
| Dominio de evidencia | Hallazgo sintético |
|---|---|
| Evidencia del mundo real | El registro mercantil, el contrato del producto, la lista de funciones y la nota sobre alcance regulatorio muestran que carece de facultades bancarias/de pago |
| Evidencia de representación | 37 de 120 sesiones controladas de línea base crean una impresión de autoridad bancaria o de pago |
| Evidencia de resultados | En 5 de 18 conversaciones comerciales, los clientes potenciales preguntaron si el producto realizaba pagos |
| Evidencia debilitante | No todas las preguntas comerciales nacieron en un sistema generativo; el lenguaje de categorías es inconsistente en el sector |
La frase original se limita. «Suelen» excede la evidencia: 37/120 no es una mayoría. La formulación permitida es:
«En la muestra de línea base examinada, 37 de 120 respuestas asociaron a Meridian Ledger al menos una expresión que creaba una impresión de autoridad bancaria o de pago».
Frase que la evidencia no sostiene: «La representación errónea causó pérdidas de ventas». Las conversaciones comerciales muestran un rastro, no causalidad.
D3 — Registro de Diseño de Medición
Registro: NJ-MEA-ML-002 Estado del prerregistro: Plan sintético bloqueado antes de conocer los resultados de la intervención
Tabla D.3 — Diseño sintético de medición para Meridian Ledger
| Campo | Decisión sintética |
|---|---|
| Variable principal | La respuesta contiene con exactitud el núcleo obligatorio y ningún error crítico de autoridad |
| Núcleo obligatorio | Producto de software; visibilidad/conciliación financiera; no es banco ni entidad de pago |
| Error crítico | Afirmar que custodia dinero, ejecuta pagos, concede crédito o presta asesoramiento regulado |
| Celda de observación | Reino Unido; propietario de agencia/responsable financiero; inglés; superficie generativa elegida; sesión nueva |
| Brazos de consultas | 60 sesiones controladas + 40 de intención natural; informadas por separado |
| Consultas negativas | Escenarios de inadecuación como «una herramienta que haga por mí los pagos a proveedores» |
| Codificadores | Dos codificadores independientes + tercer decisor en caso de desacuerdo |
| Repetición | 100 participantes nuevos, cuarenta y cinco días después de la primera ventana |
| Umbral de decisión | Al menos 96/100 en cada ventana; límite inferior de Wilson al 95 % > 90 %; ningún error crítico; puerta negativa superada |
El diseño conserva la tasa de citas y el rastro comercial como indicadores secundarios separados. No se suman a la tasa de núcleo exacto para crear una puntuación agregada.
D4 — Registro de Intervención
Registro: NJ-INT-ML-003
El equipo de intervención evalúa cuatro opciones:
- no hacer nada;
- llenar todo el sitio de frases que digan «no somos un banco»;
- hacer consistente la categoría verificada y la información sobre límites en las páginas críticas;
- difundir el mismo relato mediante perfiles sintéticos de usuarios en sitios de terceros.
La cuarta opción se rechaza por motivos éticos y metodológicos. La segunda crearía una repetición innecesaria y dañaría la experiencia del usuario. La primera no aborda la confusión material de autoridad. Se elige la tercera como intervención mínima suficiente:
- la página del producto utiliza la categoría fija «programa de visibilidad del flujo de caja y conciliación de facturas»;
- se añade a la tabla de funciones un límite «hace / no hace»;
- la nota de alcance regulatorio es verificada por el asesor jurídico y el titular del producto;
- se armoniza la terminología de la documentación para desarrolladores y la página de inicio;
- se envía al titular de un directorio de socios obsoleto una solicitud de corrección verificable sobre la expresión «plataforma de pagos»;
- se elimina el lenguaje publicitario que sugiere autoridad bancaria.
La intervención no se describe como «entrenar los modelos» ni «controlar las respuestas». Se mejoran las superficies de información propias y aquellas susceptibles de corrección autorizada. Se registran las versiones de página, los aprobadores y un plan de reversión.
D5 — Registro de Gobernanza
Registro: NJ-GOV-ML-001
Tabla D.4 — Asignaciones sintéticas de gobernanza de Meridian Ledger
| Función | Asignación sintética |
|---|---|
| Titular de la verdad del mundo real | Responsable de producto de Meridian Ledger |
| Aprobación del límite jurídico/regulatorio | Asesor jurídico externo |
| Ejecutor de la intervención | Equipo de contenidos de Meridian |
| Diseño de medición | Equipo asesor de NobleJackal |
| Codificadores | Investigadores contratados, separados del equipo de ejecución |
| Titular de la decisión final | Comité de riesgos de Meridian |
| Veto ético | Asesor jurídico externo + representante de seguridad del usuario |
| Revisor de objeciones | Asesor de investigación independiente no implicado en la primera decisión |
Como NobleJackal propuso el protocolo y colaboró por remuneración en el diseño de medición, no puede presentar su propio trabajo como auditoría independiente. El expediente ilustrativo no produce certificado ni distintivo de conformidad.
D6 — Registro Temporal y de Eventos
Registro: NJ-TIM-ML-006
Tabla D.5 — Registro sintético temporal y de eventos de Meridian Ledger
| Evento | Fecha sintética | Decisión |
|---|---|---|
| Bloqueo de la evidencia del mundo real | 8 de enero de 2026 | Versión de línea base WG-1.0 |
| Publicación de la intervención | 22 de enero de 2026 | Comienza la vigilancia |
| Primera ventana NJ-100 | 16–20 de febrero de 2026 | Serie S1-W1 |
| Actualización de la interfaz del sistema | 4 de marzo de 2026 | Revisión de materialidad: cambió la presentación de citas; no cambió la codificación central |
| Segunda ventana NJ-100 | 2–7 de abril de 2026 | Serie S1-W2; el evento se declarará en el informe |
| Próxima revisión | 2 de junio de 2026 o cambio de facultades del producto | Lo que ocurra primero |
La actualización de la interfaz no se pasa por alto en silencio. Ambas ventanas siguen midiendo la misma pregunta central, pero los indicadores de citas no se comparan directamente.
D7 — Resultados sintéticos de NJ-100
Primera ventana
Tabla D.6 — Primera ventana sintética de observación NJ-100
| Indicador | Resultado sintético |
|---|---|
| Sesiones válidas | 100 |
| Núcleo exacto | 97/100 |
| Errores críticos | 0 |
| Puerta de consultas negativas | Superada |
| Intervalo de Wilson al 95 % | Aproximadamente 91,6–99,0 % |
| Concordancia bruta entre codificadores | 95 % |
| Kappa de Cohen | 0,84 |
La primera ventana cumple el umbral piloto. Una sola ventana no basta para un juicio permanente.
Segunda ventana
Tabla D.7 — Segunda ventana sintética de observación NJ-100
| Indicador | Resultado sintético |
|---|---|
| Sesiones válidas | 100 |
| Núcleo exacto | 94/100 |
| Errores críticos | 0 |
| Puerta de consultas negativas | Superada |
| Intervalo de Wilson al 95 % | Aproximadamente 87,5–97,2 % |
| Concordancia bruta entre codificadores | 96 % |
| Kappa de Cohen | 0,81 |
La segunda ventana supera la tasa observada alta de 90/100, pero no el umbral de decisión piloto de 96/100. Las dos ventanas no se promedian como 95,5/100 para presentar el umbral como cumplido. El resultado se juzga alto, pero por debajo del umbral del protocolo y temporalmente inestable.
El perfil semántico muestra que cuatro de las seis respuestas fallidas sugieren que el producto «automatiza pagos», mientras dos sugieren que «gestiona» cuentas bancarias. Como la definición de error crítico exige afirmar que el producto custodia dinero o ejecuta efectivamente pagos, estas expresiones no cruzan el umbral crítico; siguen siendo distorsiones de atributos.
D8 — Registro de Valor Comercial
Registro: NJ-VAL-ML-002
En la cohorte sintética de sesenta días posterior a la intervención:
- veintidós solicitantes cualificados declaran directamente que un sistema generativo influyó en su investigación;
- nueve se convierten en oportunidades adecuadas y tres, en contratos;
- durante el mismo periodo llegan setenta y una solicitudes por otros canales;
- un cambio de precio y una campaña de socios también influyen en las ventas totales;
- la contribución neta de los tres contratos es positiva durante los primeros noventa días, pero el horizonte de observación es demasiado corto para evaluar la retención.
Formulación permitida:
«Dentro de la cohorte sintética posterior a la intervención, veintidós solicitantes declararon directamente que un sistema generativo influyó en su investigación; tres se convirtieron en contratos durante los primeros sesenta días. El diseño no demuestra que la intervención causara por sí sola estos resultados».
Formulación prohibida:
«El GEO aumentó las ventas de Meridian Ledger en un X por ciento».
D9 — Registro de Objeción
Registro: NJ-APL-ML-001
El director de ventas señala que las dos ventanas contienen 191 núcleos exactos de 200 y solicita utilizar la frase «validado por NJ-100». La objeción se rechaza por tres motivos:
- El protocolo define umbrales separados para cada ventana; combinarlos después de ver el resultado cambia la regla de medición.
- «Validado» confunde una observación piloto con la validación independiente del método.
- NobleJackal desempeña una función de diseño remunerada y carece de autoridad para certificar de forma independiente.
Se estima la parte legítima de la objeción: el resumen público no ocultará la observación agregada de 191/200, pero informará por separado de ambas ventanas.
D10 — Dictamen de Auditoría y Juicio Final
Registros: NJ-AUD-ML-001 y NJ-JDG-ML-001
La auditoría concluye que la cadena de registros es trazable, la intervención está fundada en la realidad y no se observó ningún error crítico; también concluye que la segunda ventana no alcanzó el umbral piloto y que no se demostró causalidad comercial.
La frase final permitida para publicación es:
Dictamen piloto sintético limitado: La representación central exacta de Meridian Ledger en la celda de observación definida se observó en 97/100 durante la primera ventana y en 94/100 durante la segunda. No se emitió un dictamen de conformidad sobre estabilidad de la representación porque la segunda ventana no cumplió el umbral de decisión piloto de NJ-100-P0.9. No se observó ningún error crítico y se superó la puerta de consultas negativas. Los hallazgos no pueden generalizarse a otro sistema, idioma, grupo de usuarios o resultado comercial.
El expediente se cierra con estado de vigilancia condicional. Se examinarán los grupos semánticos de las seis respuestas fallidas; solo se abrirá una nueva intervención si el problema puede vincularse con evidencia del mundo real y superficies propias. Se prohíbe producir contenido más amplio o estrechar la selección de consultas únicamente para superar el umbral.
Lo que enseña el ejemplo
En este expediente sintético, la intervención es razonable, el primer resultado sólido y el rastro comercial prometedor. Aun así, el Framework no concede un distintivo favorable. La segunda ventana no cumplió el umbral predefinido, no se estableció causalidad y no surgió ninguna autoridad independiente de certificación.
La seriedad de un estándar se muestra no solo por lo que llama resultado satisfactorio, sino por cómo limita un resultado que parece favorecerlo. Ese es el verdadero valor de la cadena de registros: no amplía la decisión, sino que la mantiene exactamente en el tamaño que merece.
Anexo E — Registro de lenguaje permitido y prohibido
¿Por qué un registro de lenguaje?
Muchos estándares no fallan en la tabla de medición, sino en la frase que anuncia el resultado. Una observación limitada se convierte en «éxito», el éxito en «control» y el control en «garantía». Este anexo no persigue palabras prohibidas. Es una puerta de publicación que alinea la autoridad que lleva la frase con la que sostiene la evidencia.
El Registro es sensible al contexto. Una palabra prohibida puede utilizarse en una cita histórica, una crítica o para describir una condición jurídica real. Lo prohibido es emplearla para tomar prestada una confianza cuando esa condición no existe.
E1 — Estado y legitimidad
Tabla E.1 — Lenguaje de estado y legitimidad
| Formulación que debe evitarse o uso no autorizado | Alternativa permitida | Motivo |
|---|---|---|
| «El primer estándar GEO del mundo» | «Una propuesta de estándar que aborda conjuntamente representación, evidencia y valor sostenible en sistemas generativos» | «Primero» exige evidencia histórica, exhaustiva e independiente |
| «Estándar internacional» | «Un marco concebido para uso multilingüe e internacional» | La aplicabilidad prevista no equivale a aceptación internacional |
| «Estándar GEO oficial» | «Un marco normativo publicado por NobleJackal» | Debe identificarse la autoridad oficial |
| «Acreditado» | «Una propuesta de estándar sin acreditación independiente» | La acreditación exige una autoridad y un proceso externos definidos |
| «Certificado» | «Un dictamen de conformidad limitado al alcance especificado» | El lenguaje de certificación no puede utilizarse sin infraestructura de certificación |
| «Aprobado por NobleJackal» | «Evaluado conforme al protocolo de NobleJackal» | El uso de un método no constituye aprobación general |
| «Universal» | «Limitado al sistema, idioma, geografía y periodo definidos» | Impide la extensión fuera de alcance |
| «Demostrado científicamente» | «Este hallazgo se observó bajo el diseño especificado» | Un estudio no produce una validación científica amplia |
E2 — Conducta del sistema y control
Tabla E.2 — Lenguaje de conducta del sistema y control
| Formulación que debe evitarse o uso no autorizado | Alternativa permitida | Motivo |
|---|---|---|
| «La IA nos conoce» | «En las respuestas examinadas, la entidad se relacionó con la identidad correcta» | No atribuye al sistema una mente única y permanente |
| «Marca aprobada por la IA» | «Se observó una representación exacta dentro del alcance especificado» | Un sistema generativo no es una autoridad institucional de aprobación |
| «Entrenamos los modelos» | «Verificamos y mejoramos las superficies de información que controlamos» | Induce a error cuando no existe autoridad sobre el entrenamiento de modelos externos |
| «Controlamos las respuestas» | «Trabajamos sobre superficies legítimas capaces de influir en la representación» | Separa influencia y control |
| «Visible en toda la IA» | «Mencionada en la muestra de los sistemas y condiciones indicados» | Los sistemas y las condiciones difieren |
| «Resultado permanente» | «Observación válida hasta la fecha indicada y sujeta a revisión» | La conducta de representación cambia con el tiempo |
| «Garantía» | «Resultado observado dentro de umbrales y límites predefinidos» | No puede reivindicarse una respuesta futura |
| «Una cita lo hace verdadero» | «La relación de respaldo entre fuente y afirmación se verificó/no se verificó por separado» | La presencia de una cita no equivale a exactitud |
E3 — Medición y éxito
Tabla E.3 — Lenguaje de medición y éxito
| Formulación que debe evitarse o uso no autorizado | Alternativa permitida | Motivo |
|---|---|---|
| «Puntuación GEO: 87» | «Perfil de exactitud, procedencia, recomendación, estabilidad y rastro comercial» | No oculta dimensiones distintas en un número único |
| «GEO completado» | «Se observó estabilidad de la representación dentro del alcance especificado» | El trabajo no tiene un punto final permanente |
| «96 por ciento de éxito» | «96 de 100 sesiones válidas cumplieron el núcleo exacto predefinido» | Hace visibles el denominador y el objeto medido |
| «El 96 por ciento de los usuarios lo recomendó» | «96/100 respuestas del sistema cumplieron el criterio de codificación» | No confunde la opinión del usuario con la respuesta del sistema |
| «Consistencia significa exactitud» | «La estabilidad y la exactitud se evaluaron en ejes separados» | El mismo error también puede ser consistente |
| «Aprobó de media» | «Cada celda y ventana temporal predefinidas se informaron por separado» | No disuelve un campo débil dentro de uno fuerte |
| «Sin errores» | «No se observó ningún error crítico predefinido en la muestra» | Distingue lo no observado de lo imposible |
| «Puntuación objetiva» | «Evaluación humana limitada por un manual de codificación, dos codificadores y una medida de concordancia» | Hace visible el proceso de juicio |
E4 — Resultado comercial y causalidad
Tabla E.4 — Lenguaje de resultado comercial y causalidad
| Formulación que debe evitarse o uso no autorizado | Alternativa permitida | Motivo |
|---|---|---|
| «El GEO aumentó las ventas» | «En esta cohorte se observaron solicitantes que declararon influencia de IA; el diseño no establece por sí solo causalidad» | Declara el grado de atribución |
| «La visibilidad se convirtió en ingresos» | «Algunos de los contactos especificados produjeron ingresos; los costes y las explicaciones alternativas se informaron por separado» | No borra los eslabones intermedios de la cadena |
| «Cliente de alto valor» | «Cliente que cumple las condiciones predefinidas de aptitud y contribución neta» | Explicita el criterio de valor |
| «Crecimiento sin coste» | «Los costes directos medidos son [importe]; la capacidad y los costes de oportunidad no informados constituyen limitaciones» | No trata un coste invisible como inexistente |
| «ROI garantizado» | «Rendimiento observado, calculado para el periodo y los supuestos especificados» | No traslada certeza al futuro |
| «Demanda orgánica» | «Demanda sin declaración de fuente ni registro de seguimiento» | No atribuye lo desconocido a un canal preferido |
| «Contacto cualificado» | «Solicitante que cumple los criterios de aptitud especificados» | Convierte una etiqueta de marketing en algo medible |
| «Crecimiento sostenible» | «Contribución neta positiva y adecuación de capacidad durante el horizonte de observación especificado» | Declara tiempo y condiciones |
E5 — Auditoría, independencia y objeción
Tabla E.5 — Lenguaje de auditoría, independencia y objeción
| Formulación que debe evitarse o uso no autorizado | Alternativa permitida | Motivo |
|---|---|---|
| «Auditoría independiente», cuando el profesional examina su propio trabajo | «Evaluación interna» o «segunda revisión separada» | No oculta la relación institucional |
| «Conforme», sin alcance | «Dictamen de conformidad limitado a esta entidad, sistema, idioma, fecha y protocolo» | Hace visible el límite del juicio |
| «Cumplimiento total» | «No se observó ninguna no conformidad frente a las disposiciones enumeradas; las excepciones son…» | No excede el universo auditado |
| «La objeción fue rechazada; la decisión es correcta» | «La objeción se rechazó bajo esta evidencia y este criterio; la condición para volver a solicitar es…» | Ofrece razones, no autoridad |
| «No puede revelarse porque es secreto comercial» | «Esta clase de registro es confidencial; su existencia/ausencia y efecto sobre la decisión se indican en el resumen público» | Equilibra confidencialidad y rendición de cuentas |
| «Decisión final» | «Decisión vigente hasta la fecha y bajo las condiciones de revisión indicadas» | Mantiene abiertas la corrección y la retirada |
| «Validado por el Framework» | «Evaluado por [autoridad decisora] conforme a los criterios definidos en el Framework» | No convierte el texto en un órgano decisor activo |
| «No hay reclamaciones» | «No se registró ninguna reclamación durante el periodo especificado; el acceso al canal fue…» | No trata el silencio como satisfacción |
E6 — Vocabulario de incertidumbre
Verbos y matices recomendados según el grado de evidencia:
Tabla E.6 — Lenguaje recomendado según el grado de incertidumbre
| Condición de evidencia | Lenguaje recomendado |
|---|---|
| Evidencia directa y actual del mundo real | «verificado», indicando el alcance |
| Respuesta registrada del sistema | «observado», «apareció en la respuesta» |
| Muestra repetida | «se repitió en la muestra especificada» |
| Respaldo limitado | «parece consistente con», «indica» |
| Respaldo contradictorio | «hallazgo mixto», «insuficiente para emitir un juicio» |
| Relación sin causalidad | «observados conjuntamente», «puede estar relacionado» |
| Evaluación futura | «se espera» solo con motivos e incertidumbre |
| Ausencia de datos | «desconocido» o «no medido» |
| Umbral no alcanzado | «no alcanzó el umbral del protocolo» |
| Riesgo crítico | «suspendido», indicando titular de la decisión y motivos |
«Puede» no crea confianza; deben indicarse el fundamento de la probabilidad, su alcance y su efecto sobre la decisión. Tampoco «los datos muestran» es lenguaje probatorio si no identifica qué datos muestran qué y dentro de qué límite.
Prueba de la frase antes de publicar
Toda frase pública pasa cinco preguntas: Objeto — ¿sobre qué trata el juicio? Denominador — ¿de dónde procede la cifra? Alcance — ¿qué sistema, idioma, usuario, geografía y periodo? Autoridad — ¿la palabra excede a quien decide? Límite — ¿qué conclusión no demostrada podría extraer el lector? Si la respuesta final es más amplia que la promesa, el texto se reescribe. Un buen lenguaje de estándar no reduce el impacto, sino el espacio para el malentendido.
Glosario
Este glosario explica el uso particular de los términos dentro del NobleJackal GEO Framework. Las definiciones no sustituyen todos los significados que esos términos tienen en otras disciplinas.
Acreditación: Reconocimiento formal, mediante un mecanismo externo competente, de que un organismo de evaluación de la conformidad es competente para realizar tareas determinadas. La primera edición del Framework no está acreditada.
Auditoría algorítmica: Examen planificado de las afirmaciones, procesos, riesgos y cadenas de responsabilidad asociados a un sistema de IA o algorítmico. En este libro no se limita a las pruebas técnicas del modelo.[10]
Recurso: Solicitud para que una decisión sobre un registro, codificación, inferencia, autoridad, proceso o principio sea revisada con independencia de la decisión inicial.
Expediente de auditoría: Conjunto de registros que reúne alcance, evidencia, método, muestra, funciones, conflictos de interés, hallazgos, dictamen y vía de objeción en una cadena trazable.
Línea base: Valor de comparación registrado antes de una intervención bajo las mismas condiciones de medición o bajo condiciones indicadas expresamente.
Reproducibilidad conductual: Recurrencia de observaciones que producen patrones de decisión similares dentro de una misma familia de contextos. No exige resultados idénticos bit a bit en sistemas cerrados y probabilísticos.
Certificación: Garantía de un tercero de que un producto, proceso, servicio u organización cumple requisitos especificados. El libro no afirma que exista un programa de certificación antes de establecerse la gobernanza necesaria.[17]
Afirmación: Frase cuya verdad o falsedad puede contrastarse con evidencia. Puede ser una afirmación de observación, causal, predictiva, de resultados o de conformidad.
Registro de Afirmaciones: Registro en el que se conservan las afirmaciones públicas e internas materiales junto con su evidencia, alcance, versión, titular y estado.
Cohorte: Grupo de usuarios o clientes con un momento inicial o una característica comunes, cuyos resultados se siguen durante el mismo horizonte de observación.
Conflicto de interés: Interés profesional, financiero, personal o institucional que afecta, o podría parecer razonablemente que afecta, a la imparcialidad de una decisión. Declararlo importa, pero no elimina por sí solo todos los conflictos.
Dictamen de conformidad: Decisión fechada, limitada y controvertible sobre si un alcance definido cumple requisitos conforme a evidencia y criterios especificados.
Representación central: Combinación mínima de identidad, atributos y límites necesaria para reconocer con exactitud una entidad en el contexto examinado.
Contraevidencia: Registro que debilita o limita una afirmación, u ofrece una explicación alternativa. Es una parte obligatoria del expediente de evidencia.
Error crítico: Representación errónea predefinida en identidad, autoridad, seguridad, aptitud u otro campo de alto riesgo, capaz de exponer a un usuario a un daño material.
Denominador: Número total de observaciones válidas que sustentan una tasa. Cambiarlo en silencio puede distorsionar materialmente el resultado.
Registro de desviación: Registro que indica cuándo, por qué y por quién se produjo una desviación del método prerregistrado, y su efecto sobre el resultado.
Validez ecológica: Grado en que las condiciones de medición se asemejan a la conducta real de los usuarios. Un brazo de intención natural puede mejorarla mientras reduce la comparabilidad.
Veto ético: Facultad para detener una práctica que crea riesgo de daño material al usuario, engaño, discriminación o vulneración de derechos, incluso si la práctica es lícita.
Desencadenante de evento: Cambio material que reabre una evidencia, protocolo o decisión sin esperar a la fecha de revisión programada.
Cadena de evidencia: Relación trazable desde la fuente hasta la observación, desde la observación hasta la inferencia y desde la inferencia hasta la frase publicada.
Evidencia de resultados: Registro que muestra la relación entre representación y conducta del usuario, calidad del cliente, resultados comerciales, daño u otro resultado.
Evidencia de representación: Respuesta completa y registro contextual que muestran qué dijo un sistema, ante qué consulta y en qué momento.
Evidencia del mundo real: Registro de la entidad real con el que se compara la representación. Puede ser un registro oficial, contrato, información verificada de producto, medición técnica o fuente independiente adecuada.
Sistema de respuestas generativas: Sistema que produce, ante la consulta de un usuario, una respuesta en lenguaje natural sintetizada a partir de una o más fuentes o del conocimiento del modelo. Los productos pueden tener arquitecturas técnicas distintas.
Generalización: Grado en que un resultado de una muestra puede trasladarse a otra población, sistema, idioma, geografía o periodo. Se justifica mediante similitud de alcance y diseño de investigación; no se presupone.
GEO: Generative Engine Optimization. Campo relacionado con la capacidad de descubrir, presentar y atribuir fuentes a una entidad en resultados sintetizados por sistemas de respuestas generativas o de búsqueda. Este libro no afirma haber inventado el GEO; propone un estándar de decisión y responsabilidad para el campo.[1]
Revisión independiente: Revisión realizada por una persona u órgano competente sin interés material en el resultado, que no tomó la primera decisión y puede cambiarla libremente. El nombre de un departamento separado no demuestra por sí solo independencia.
Representación de juicio: Recomendación, exclusión, clasificación o tratamiento de una entidad como arriesgada por parte de un sistema dentro de un usuario, necesidad o comparación determinados.
Kappa: Coeficiente de concordancia para codificación categórica que considera el acuerdo esperado por azar. Este libro utiliza la kappa de Cohen para el código binario de dos codificadores de NJ-100; no es por sí sola un juicio de calidad.[15]
Resumen legible por máquinas: Publicación que presenta alcance, versión, fecha, afirmación, clase de evidencia, estado y enlace de objeción en campos estructurados. No sustituye el razonamiento humano.
Versión mayor: Versión publicada que modifica materialmente un derecho, obligación, umbral de decisión, alcance o interpretación de la conformidad.
Materialidad: Magnitud y probabilidad de que un error o cambio tenga un efecto relevante sobre una decisión, usuario, empresa o el público.
Dominio de madurez: Dimensión del desarrollo del Framework evaluada por separado respecto a coherencia normativa, utilidad operativa, eficacia empírica y legitimidad externa.
Intervención Mínima Suficiente: Cambio legítimo más limitado capaz de abordar un problema material verificado sin crear un daño o una autoridad mayores.
Medida de similitud de modelos: Herramienta que calcula la proximidad léxica o contextual entre dos textos. Puede ayudar en la codificación; no mide la exactitud en el mundo real.[19]
Consulta de intención natural: Consulta creada con las propias palabras del usuario después de recibir una necesidad y una tarea, en lugar de una frase preparada.
Consulta negativa/de exclusión: Consulta de prueba en la que se espera que el sistema no recomiende a la entidad para una necesidad inadecuada o declare con exactitud su límite.
Contribución neta: Valor económico restante después de deducir de los ingresos correspondientes la captación, prestación, devolución, soporte, capacidad y otros costes definidos.
NJ-100: Propuesta de protocolo piloto para probar la exactitud y estabilidad de la representación central mediante cien sesiones válidas e independientes de usuarios objetivo en una celda de observación definida. No es un certificado ni una puntuación GEO única.
Sin respuesta: Situación en la que el sistema no produce la representación pertinente, emite un rechazo de seguridad, dice «No lo sé» o no produce resultado por una causa técnica. Puede ser un resultado válido según la pregunta de investigación.
Normativo: Que determina lo que debe hacerse. La coherencia interna de una norma no significa que su eficacia en el mundo se haya demostrado empíricamente.
Celda de observación: Combinación predefinida de entidad, usuario objetivo, intención, sistema, interfaz, estado de sesión, idioma, geografía, tiempo y familia de consultas.
Horizonte de observación: Periodo durante el cual se observa la formación, el envejecimiento o la sostenibilidad de un resultado.
Dictamen piloto de conformidad: Decisión limitada sobre si los registros cumplen criterios únicamente dentro del alcance y la versión de protocolo especificados. No es un certificado acreditado.
Proporcionalidad: Correspondencia de la carga de intervención, registro, auditoría y garantía con el nivel de riesgo, la probabilidad de daño y las consecuencias de la decisión.
Prerregistro: Fijación de la pregunta de investigación, la muestra, los criterios, el umbral, las exclusiones y el plan de análisis en un registro fechado antes de ver los resultados.
Universo de consultas: Conjunto definido de familias de preguntas, intenciones y contextos mediante las cuales los usuarios pueden expresar la tarea pertinente. Las consultas de prueba se seleccionan de este universo conforme a un método declarado.
Bloqueo del protocolo: Versionado y fijación del plan de medición antes de ver los resultados. Los cambios necesarios se registran como desviaciones.
Concordancia bruta: Porcentaje de observaciones a las que dos o más codificadores asignaron el mismo código. No corrige la concordancia esperada por azar.
Representación: Combinación observable de identidad, atributos, contexto y juicios asociados a una entidad en una respuesta determinada.
Deuda de representación: Efecto acumulado de superficies de información obsoletas, incompletas, contradictorias o falsas que crea una carga adicional de corrección para la representación exacta.
Estabilidad de la representación: Grado en que observaciones independientes realizadas bajo condiciones comparables convergen en la misma representación central. La estabilidad no incluye la exactitud.
Ruptura de serie: Pérdida de comparabilidad directa entre nuevas observaciones y una serie anterior tras un cambio material de sistema, interfaz, evidencia o protocolo.
Prohibición de puntuación única: Principio según el cual dimensiones distintas, como exactitud, visibilidad, procedencia, recomendación, estabilidad y valor comercial, no deben ocultarse dentro de una puntuación GEO compuesta.
Registro estructurado: Registro digital con campos, versión y relaciones definidos. La estructura no vuelve exacto el contenido por sí sola.
Caso sintético: Conjunto ficticio de personas, instituciones, datos y resultados creado para mostrar cómo funciona un principio. No constituye evidencia de eficacia en el mundo real.
Valor comercial sostenible: Valor producido para el cliente correcto mediante métodos éticos, capacidad de prestación y contribución neta positiva, sin depender del daño ni del engaño.
Integridad temporal: Correspondencia entre las fechas de evidencia, medición, intervención y decisión, de modo que un registro obsoleto no se presente como un juicio nuevo.
Incertidumbre: Desconocimiento que lleva un juicio debido a medición, muestreo, codificación, contexto o tiempo. No es un defecto, sino una cualidad que debe seguir visible en la decisión.
Sesión válida: Sesión que cumple las condiciones predefinidas de participante, tarea, contexto y registro y permanece en el denominador con independencia de su resultado.
Visibilidad: Presencia o accesibilidad de una entidad en la respuesta pertinente. No equivale a exactitud, recomendación ni valor comercial.
Intervalo de Wilson: Método de intervalo de confianza que expresa la incertidumbre de una proporción binaria con mayor fiabilidad que una aproximación normal simple, especialmente cerca de los extremos.[14]
Tasa de núcleo exacto: Proporción de todas las sesiones válidas que cumplen la representación central predefinida y no contienen ningún error crítico.
Causalidad: Relación que muestra que un cambio produjo un resultado excluyendo razonablemente explicaciones alternativas. El orden temporal o la correlación por sí solos no bastan.
Intervención: Cambio planificado sobre una superficie autorizada en respuesta a un problema de representación verificado. No toda observación requiere una intervención.
Propuesta normativa de estándar: Texto que ofrece criterios, derechos, obligaciones y vías de decisión coherentes sin llevar automáticamente aceptación externa ni acreditación.
Perfil semántico secundario: Perfil de significado que supera la decisión binaria exacta/inexacta para mostrar por separado identidad, atributo, contexto, recomendación, fuente y tipos de error.
Notas y bibliografía
Límites de uso de las fuentes
Este libro no afirma haber inventado un campo enteramente nuevo llamado GEO. Las fuentes siguientes identifican cuerpos de conocimiento vecinos, entre ellos búsqueda generativa, verificabilidad, recuperación de información, gestión de riesgos, trazabilidad, auditoría, documentación, estadística, concordancia de codificadores y evaluación de conformidad. Ninguna ha validado de forma independiente el NobleJackal GEO Framework en su conjunto, los umbrales de NJ-100 ni las disposiciones normativas del libro.
Un resultado histórico observado en un sistema no se ha generalizado a todos los productos actualmente en uso. Se indica la fecha de consulta de los documentos web susceptibles de cambiar. Las páginas públicas de información sobre estándares no se han tratado como sustitutos de los textos íntegros de pago; solo se utilizan en la medida respaldada por declaraciones oficiales accesibles.
Notas numeradas
[1] Contexto académico del término GEO. Pranjal Aggarwal, Vishvak Murahari, Tanmay Rajpurohit, Ashwin Kalyan, Karthik Narasimhan y Ameet Deshpande, «GEO: Generative Engine Optimization», Proceedings of the 30th ACM SIGKDD Conference on Knowledge Discovery and Data Mining, 2024, pp. 5–16. DOI: 10.1145/3637528.3671900. Prepublicación abierta: arXiv:2311.09735. El estudio aborda métodos y evaluación experimental para aumentar la visibilidad en respuestas de motores generativos. Este libro trata la optimización de la visibilidad como una sola parte de preguntas más amplias sobre representación, evidencia, gobernanza y valor comercial.
[2] Distinción entre cita y respaldo. Nelson F. Liu, Tianyi Zhang y Percy Liang, «Evaluating Verifiability in Generative Search Engines», Findings of the Association for Computational Linguistics: EMNLP 2023, pp. 7001–7025. DOI: 10.18653/v1/2023.findings-emnlp.467. Registro: ACL Anthology. Los hallazgos cuantitativos del artículo se limitan a los sistemas y al periodo examinados; el libro no los utiliza como tasas actuales para todos los productos.
[3] Estocasticidad y variación contextual. OpenAI Cookbook, «How to Make Your Completions Outputs Consistent with the New Seed Parameter», explica que las respuestas de los sistemas son no deterministas de forma predeterminada y que seed y system_fingerprint pueden aumentar la probabilidad de similitud sin garantizarla: OpenAI Cookbook. El documento de ayuda sobre ChatGPT Search indica que una consulta de búsqueda puede verse influida por elementos contextuales, como la ubicación aproximada o la memoria, junto con la consulta del usuario: Searching in ChatGPT. Consultado el 14 de agosto de 2026. Estos documentos de producto pueden cambiar; el libro no presenta esa conducta como certeza independiente del producto.
[4] Generación aumentada por recuperación. Patrick Lewis et al., «Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks», Advances in Neural Information Processing Systems 33, 2020, pp. 9459–9474. Registro de NeurIPS. El artículo presenta RAG, un enfoque que combina memoria paramétrica y no paramétrica. Tener acceso a una fuente no significa que toda frase generada sea exacta en el mundo real.
[5] Evaluación de la recuperación generativa de información. Lukas Gienapp et al., «Evaluating Generative Ad Hoc Information Retrieval», Proceedings of the 47th International ACM SIGIR Conference on Research and Development in Information Retrieval, 2024, pp. 1916–1929. DOI: 10.1145/3626772.3657849. Prepublicación abierta: arXiv:2311.04694. El artículo explica por qué la evaluación convencional de clasificaciones no basta por sí sola para respuestas generadas; este libro no presenta sus disposiciones de medición como una extensión validada de ese trabajo.
[6] Límite de error de las respuestas generativas. OpenAI, «Does ChatGPT tell the truth?», documento de ayuda oficial que señala que ChatGPT puede producir respuestas inexactas o engañosas, citas fabricadas y afirmaciones excesivamente seguras. Centro de ayuda de OpenAI. Consultado el 14 de agosto de 2026. La limitación no se utiliza como tasa de error propia de un proveedor, sino como ejemplo de por qué las respuestas deben verificarse con evidencia externa.
[7] Gestión de riesgos. Elham Tabassi, «Artificial Intelligence Risk Management Framework (AI RMF 1.0)», NIST AI 100-1, 2023. DOI: 10.6028/NIST.AI.100-1. Página de publicación del NIST. Las funciones de gobernar, cartografiar, medir y gestionar del NIST pertenecen a la literatura vecina sobre riesgos; las disposiciones de NobleJackal no afirman conformidad con el NIST.
[8] Perfil de riesgo de la IA generativa. National Institute of Standards and Technology, «Artificial Intelligence Risk Management Framework: Generative Artificial Intelligence Profile», NIST AI 600-1, julio de 2024. DOI: 10.6028/NIST.AI.600-1. Texto íntegro del NIST. El Perfil es un documento complementario para gestionar riesgos específicos de la IA generativa a lo largo del ciclo de vida.
[9] Procedencia y trazabilidad. Timothy Lebo, Satya Sahoo y Deborah McGuinness (eds.), «PROV-O: The PROV Ontology», Recomendación del W3C, 30 de abril de 2013. W3C PROV-O. La Recomendación del W3C ofrece una ontología para relaciones de procedencia legibles por máquinas entre entidades, actividades y agentes. La cadena de registros del libro no impone esa ontología como forma técnica obligatoria.
[10] Auditoría algorítmica integral. Inioluwa Deborah Raji, Andrew Smart, Rebecca N. White, Margaret Mitchell, Timnit Gebru, Ben Hutchinson, Jamila Smith-Loud, Daniel Theron y Parker Barnes, «Closing the AI Accountability Gap: Defining an End-to-End Framework for Internal Algorithmic Auditing», Proceedings of the 2020 Conference on Fairness, Accountability, and Transparency, pp. 33–44. DOI: 10.1145/3351095.3372873. El libro reconoce una preocupación vecina por la documentación y la responsabilidad durante todo el ciclo de vida; no afirma que este trabajo valide el modelo de auditoría de NobleJackal.
[11] Principios de fiabilidad y responsabilidad. OCDE, «OECD AI Principles», adoptados en 2019 y actualizados en mayo de 2024. Principios de IA de la OCDE. Los principios relativos a robustez, seguridad, trazabilidad y responsabilidad son especialmente próximos al análisis de gobernanza del libro. Consultado el 14 de agosto de 2026.
[12] Documentación de modelos. Margaret Mitchell et al., «Model Cards for Model Reporting», Proceedings of the Conference on Fairness, Accountability, and Transparency, 2019, pp. 220–229. DOI: 10.1145/3287560.3287596. Las fichas de modelo ofrecen un enfoque para documentar finalidad, rendimiento, grupos, condiciones y limitaciones.
[13] Documentación de conjuntos de datos. Timnit Gebru, Jamie Morgenstern, Briana Vecchione, Jennifer Wortman Vaughan, Hanna Wallach, Hal Daumé III y Kate Crawford, «Datasheets for Datasets», Communications of the ACM, 64(12), 2021, pp. 86–92. DOI: 10.1145/3458723. El artículo propone documentar las decisiones relativas a motivación, composición, recopilación, procesamiento, uso y mantenimiento de un conjunto de datos.
[14] Intervalo de Wilson para proporciones binarias. Edwin B. Wilson, «Probable Inference, the Law of Succession, and Statistical Inference», Journal of the American Statistical Association, 22(158), 1927, pp. 209–212. DOI: 10.1080/01621459.1927.10502953. Los intervalos del 95 por ciento de los ejemplos de NJ-100 se calculan con el método de puntuación de Wilson sin corrección de continuidad. El intervalo no corrige el sesgo de muestreo ni las observaciones dependientes.
[15] Concordancia de codificadores. Jacob Cohen, «A Coefficient of Agreement for Nominal Scales», Educational and Psychological Measurement, 20(1), 1960, pp. 37–46. DOI: 10.1177/001316446002000104. La kappa de Cohen ajusta la concordancia categórica entre dos codificadores según el acuerdo esperado por azar. No mide la validez conceptual del manual de codificación ni la verdad en el mundo.
[16] Sistema de gestión de IA. ISO/IEC 42001:2023, Information technology — Artificial intelligence — Management system, primera edición, diciembre de 2023. Registro oficial de ISO. La descripción pública identifica requisitos para establecer, ejecutar, mantener y mejorar continuamente un sistema de gestión de IA. El NobleJackal GEO Framework no afirma certificación ni conformidad con ISO/IEC 42001.
[17] Organismos que certifican productos, procesos y servicios. La descripción pública de ISO/CASCO resume funciones como imparcialidad, evaluación, decisión, vigilancia, suspensión/retirada, reclamaciones y recursos en la certificación de productos, procesos y servicios conforme a ISO/IEC 17065. ISO/CASCO — Bodies. El registro oficial de ISO/IEC 17065:2012 indica que fue confirmado en 2024 y seguía vigente el 14 de agosto de 2026, mientras se desarrollaba un proyecto final destinado a sustituirlo. El libro no sustituye el estándar íntegro, no presupone conformidad con una futura edición ni afirma aprobación de ISO.
[18] Buenas prácticas para sistemas de sostenibilidad creíbles. ISEAL, «ISEAL Code of Good Practice for Sustainability Systems, Version 1.1», vigente desde el 1 de septiembre de 2025. Página de recursos de ISEAL. El enfoque público del Código considera conjuntamente componentes del sistema como finalidad, estrategia, gestión de riesgos, participación de partes interesadas, transparencia, evaluación y aprendizaje. NobleJackal no afirma pertenencia a ISEAL ni validación por ISEAL.
[19] Similitud textual contextual. Tianyi Zhang, Varsha Kishore, Felix Wu, Kilian Q. Weinberger y Yoav Artzi, «BERTScore: Evaluating Text Generation with BERT», International Conference on Learning Representations, 2020. arXiv:1904.09675. BERTScore evalúa la similitud emparejando representaciones contextuales de textos candidatos y de referencia. El Framework puede utilizar herramientas de este tipo para ayudar a la clasificación preliminar; no las trata como jueces de exactitud, ética o conformidad.
Principio de atribución de fuentes
La presencia de una fuente en esta lista no establece que:
- sus autores respalden el NobleJackal GEO Framework;
- su hallazgo en un ámbito pueda trasladarse a todos los sistemas generativos;
- las elecciones normativas del libro hayan obtenido aceptación científica o institucional.
Las fuentes cumplen una finalidad más limitada: reconocer honestamente la historia del campo, hacer visibles los métodos vecinos y conectar las frases verificables con registros primarios o autorizados. Un nuevo umbral o disposición del Framework no se presenta como si ya existiera en la literatura externa; se etiqueta expresamente como propuesta de NobleJackal.
Hoja de ruta de versiones, vigencia y validación
Identidad de la publicación
Tabla V.1 — Identidad de publicación de la edición española
| Campo | Estado en este texto |
|---|---|
| Obra | NobleJackal GEO Framework |
| Subtítulo | Una propuesta de estándar para la representación, la evidencia y el valor sostenible |
| Nombre del autor | Julian Gauss |
| Identidad del autor | Julian Gauss es el seudónimo de Kaan Muraz |
| Idioma | Edición normativa española derivada del texto maestro turco bloqueado |
| Estado del texto | Edición española 1.0.0 fijada para publicación; revisión interna de equivalencia normativa y revisión editorial completadas; validación externa no completada |
| Estado normativo | Propuesta de estándar |
| Año de publicación | 2026 |
| Última revisión de información | 14 de agosto de 2026 |
| Validación externa | Aún no completada |
| Acreditación | Ninguna |
| Programa activo de certificación/distintivo | Ninguno |
Esta tabla figura dentro del libro para que no se oculten los límites de la publicación. Las ediciones lingüísticas se derivan del texto maestro turco bloqueado y no pueden publicarse antes de verificar la equivalencia normativa. La prueba no es una traducción literal, sino la equivalencia de significado: el alcance, los derechos, las obligaciones, los umbrales y las prohibiciones de cada idioma se comparan con el texto maestro turco.
Registro de autoría y producción
El núcleo intelectual, el primer borrador, el sistema de capítulos y las disposiciones fundacionales del libro pertenecen a Kaan Muraz. Julian Gauss es el seudónimo del autor. Se utilizaron herramientas asistidas por IA en la edición de desarrollo, la investigación de fuentes, la separación estructural, la edición de línea, el trabajo de consistencia y la preparación de la publicación. La titularidad final de las ideas, la decisión de publicar y la responsabilidad por las disposiciones del texto permanecen en el autor humano.
La intervención editorial no buscó convertir el libro en otra tesis. Buscó documentar con fuentes el núcleo existente, reducir la carga de repetición, separar las disposiciones normativas de sus motivos, etiquetar con exactitud los casos sintéticos y vincular las vías de decisión con registros auditables. La producción de IA no se utilizó como sustituto de las fuentes ni de la verificación de la realidad.
Cuatro dominios de madurez separados
Un marco madura por separado en cuatro dominios:
Tabla V.2 — Dominios de madurez del Framework
| Dominio | Pregunta | Estado en la primera publicación |
|---|---|---|
| Coherencia normativa | ¿Se contradicen las disposiciones; son explícitos los derechos y las prohibiciones? | Revisión interna y editorial de coherencia completada; no constituye validación de campo |
| Utilidad operativa | ¿Puede un profesional independiente utilizar los registros y el flujo de decisión? | NJ-100 y el conjunto de registros siguen en estado piloto |
| Eficacia empírica | ¿Produce el método distinciones fiables y mejores decisiones en casos reales? | No demostrada; se requiere investigación de campo |
| Legitimidad externa | ¿Han examinado e impugnado el método comunidades independientes y se ha establecido un mecanismo de aceptación? | No establecida |
La fortaleza en el primer dominio no sustituye el cuarto. La experiencia del autor tampoco sustituye la legitimidad externa. La distinción no reduce el valor del método; muestra qué frase todavía no puede formularse.
Regla de versionado
El Framework utiliza versionado de tres partes:
- Versión mayor (X.0.0): Modifica una disposición fundacional, un derecho, una prohibición, un umbral, el significado de conformidad o la jerarquía de decisión.
- Versión menor (0.X.0): Añade un protocolo, campo de registro, explicación o ejemplo compatible con versiones anteriores.
- Versión de corrección (0.0.X): Corrige redacción, enlaces, formato o un error claro sin cambiar el significado.
Toda versión publicada indica:
- fecha de entrada en vigor;
- enlace a la versión anterior;
- disposiciones añadidas, modificadas y retiradas;
- efecto del cambio sobre las decisiones;
- periodo de transición;
- condiciones para revisar dictámenes anteriores;
- funciones que proponen y aprueban el cambio.
Una versión mayor no traslada en silencio antiguos dictámenes de conformidad a la nueva versión. Se publican las disposiciones que exigen una nueva evaluación.
Estados de cambio
Tabla V.3 — Estados de cambio de versión
| Estado | Significado |
|---|---|
| Borrador | No puede utilizarse para una decisión pública |
| Consulta pública | Abierto a comentarios; todavía no vigente |
| Versión candidata | En proceso de superar las puertas editoriales y técnicas |
| Vigente | Versión normativa activa desde la fecha indicada |
| Corrección pendiente | Se está examinando una objeción material |
| Suspendida | Se ha detenido temporalmente la producción de nuevas decisiones |
| Sustituida | La versión antigua se conserva en el archivo y señala su sustituta |
| Retirada | La disposición correspondiente no puede utilizarse para una decisión fiable |
«Antiguo» y «erróneo» no significan lo mismo. Una versión anterior se archiva para explicar las decisiones tomadas en su tiempo. Una disposición retirada permanece visible junto con los motivos de su retirada.
Etapas de validación
Etapa 0 — Integridad documental
- Se cotejan las disposiciones entre capítulos, Constitución y conjunto de registros.
- Se examinan terminología, referencias cruzadas, fuentes y lenguaje prohibido.
- Se comprueba que los casos sintéticos no oculten organizaciones reales ni creen impresiones de éxito no verificado.
- El árbol de decisión se prueba con ejemplos contradictorios.
Esta etapa puede mostrar que el texto funciona internamente. No demuestra que el Framework sea eficaz en el mundo.
Etapa 1 — Piloto real facilitado
- Se eligen al menos tres entidades reales voluntarias de distinto tamaño y nivel de riesgo.
- El protocolo y el plan de análisis se registran antes de los resultados.
- Se forma al profesional; el equipo del autor puede observar.
- Se conservan los fallos de utilidad, la carga documental y la incertidumbre decisoria.
En esta etapa solo se publica un informe piloto; no se utiliza ningún certificado ni lenguaje general de éxito.
Etapa 2 — Aplicación independiente
- Equipos sin relación institucional con el autor, NobleJackal o el profesional remunerado aplican el Framework.
- Se examina la concordancia entre decisiones independientes sobre el mismo caso.
- Se comparan manuales de codificación, tiempo, coste y ejemplos de fallo.
- La decisión guiada por el Framework puede compararse con un método de línea base más sencillo.
La finalidad no es aumentar el número de resultados favorables, sino descubrir la capacidad discriminatoria y los modos de fallo del método.
Etapa 3 — Replicación multilingüe y temporal
- Las ediciones normativas inglesa, alemana, rusa, española y árabe se preparan a partir del texto maestro turco bloqueado.
- Cada idioma recibe revisión bidireccional de significado y revisión especializada.
- El árabe se prueba por separado respecto a lectura de derecha a izquierda, consistencia terminológica y direccionalidad en datos estructurados.
- NJ-100 se aplica por separado en distintas celdas de idioma, geografía, sistema y tiempo.
- El estudio examina si las condiciones lingüísticas y culturales introducen sesgos sistemáticos en los umbrales.
Los textos no tienen que ser idénticos palabra por palabra; su fuerza normativa debe ser equivalente.
Etapa 4 — Decisión externa de gobernanza y garantía
- Se realizan una consulta pública, respuestas declaradas a los comentarios y un registro de cambios.
- Se establecen una política de conflictos de interés, un órgano decisor independiente y una instancia de recurso.
- Se ponen a prueba la competencia profesional y los procesos de vigilancia, suspensión y retirada.
- Una opinión externa determina si un programa de conformidad o certificación es necesario, proporcionado y legítimo.
- Si se establece un programa, su infraestructura de evaluación de conformidad se examina por separado frente a los requisitos internacionales pertinentes.[17][18]
Estándares existentes como ISO/IEC 42001 también tratan sistemáticamente el establecimiento, ejecución, mantenimiento y mejora continua de un sistema de gestión.[16] Esta proximidad no implica conformidad de NobleJackal con ISO; es un punto de partida para analizar el conflicto y la interoperabilidad con estándares externos.
Puertas de publicación
Una versión debe superar todas las puertas siguientes antes de declararse vigente.
Puerta intelectual
- Cada capítulo tiene una pregunta y un juicio principales.
- Las disposiciones fundacionales son consistentes entre sí y con el anexo de la Constitución.
- Se explicita lo que el Framework no mide ni garantiza.
Puerta de evidencia
- Las afirmaciones sobre el mundo externo concuerdan con fuentes primarias o autorizadas.
- Las fuentes no se presentan como respaldo externo del Framework.
- Las fuentes susceptibles de cambio llevan fechas de consulta y límites de versión.
Puerta operativa
- Toda decisión tiene un campo de registro, un titular y una vía de objeción.
- Los umbrales, denominador, incertidumbre y segunda ventana de NJ-100 pueden aplicarse expresamente.
- Se impiden una puntuación única, la exclusión silenciosa y los cambios de regla posteriores al resultado.
Puerta ética y de gobernanza
- Los datos sintéticos se etiquetan de forma explícita.
- El lenguaje sobre independencia y conflictos de interés refleja la realidad.
- No se utilizan afirmaciones de certificación, acreditación, «primero» ni garantía sin autoridad.
Puerta de idioma y publicación
- La edición recibe una revisión final de significado, ritmo, terminología y puntuación en su propio idioma.
- Están completos los encabezados, referencias cruzadas, números de nota y tablas.
- Se conserva la jerarquía de las ediciones accesibles en Word/PDF y web.
- Las ediciones legibles por personas y por máquinas llevan la misma identidad normativa.
Principio de publicación paralela para personas y máquinas
Con el tiempo, el Framework puede tener dos superficies de presentación distintas:
- Edición humana: Razones, narración, casos, tablas, notas y una estructura de lectura accesible.
- Edición fuente legible por máquinas: Registros estructurados que presentan las mismas disposiciones en campos concisos, identificados de forma única y versionados.
La edición para máquinas no puede convertirse en una interpretación alternativa y oculta del libro. Toda disposición fundacional lleva un identificador estable como NJ-C01, versión, fecha de entrada en vigor, fuerza normativa, alcance, registro vinculado, fuente y enlace de objeción. Cuando cambia el texto humano, la edición estructurada se actualiza bajo el mismo registro de cambios. Permitir que un rastreador de IA acceda al material no garantiza que cite o interprete correctamente el Framework.
La ubicación de publicación, arquitectura de URL, formatos de datos y direcciones multilingües se determinan mediante un diseño de publicación separado después de bloquear el texto maestro turco. El texto no predetermina esa decisión.
Compromiso de corrección y objeción
El medio publicado deberá ofrecer una vía permanente de corrección y objeción. Como mínimo, una solicitud puede indicar:
- la disposición y versión impugnadas;
- el tipo de error;
- la persona o decisión afectada;
- el registro de apoyo;
- la corrección solicitada;
- la exigencia de confidencialidad.
Cuando se recibe una objeción material, la disposición anterior no se cambia en silencio. Se registran la fecha de solicitud, el estado de revisión, la decisión provisional de riesgo y el resultado. Si se verifica el error, la corrección se publica junto con la diferencia entre el texto antiguo y el nuevo. La credibilidad del Framework no depende de afirmar que nunca se equivoca, sino de corregir el error de manera visible y justa.
Límite final de la primera publicación
La primera publicación puede decir:
El NobleJackal GEO Framework es una propuesta de estándar desarrollada para evaluar la representación institucional en sistemas de IA generativa mediante una cadena de evidencia, medición, intervención, gobernanza, tiempo, valor comercial sostenible, auditoría y objeción.
Todavía no puede decir:
«Es un estándar GEO aceptado globalmente y validado de forma independiente».
La distancia entre ambas frases no se cierra solo mediante promoción, sino mediante casos reales, replicación independiente, objeción pública y gobernanza externa. Esta hoja de ruta no existe para ocultar esa distancia, sino para hacerla medible.

