Aseguramiento y Falsación

Evidencia, Procedencia y la Filosofía de Refuto

Ingeniería donde las afirmaciones críticas deben poder rastrearse hasta evidencia criptográfica demostrable, y un agente no puede ser juez de su propia ejecución.

1. La Epistemología de TELHAR: Falsación sobre Marketing

La mayoría del software descansa en aserciones narrativas no verificadas. TELHAR sustituye la confianza subjetiva por una disciplina estricta de falsación:

"No demostrar que parece funcionar; demostrar que funciona y que intentos razonables de falsificarlo fallan."

Cada invariante crítica del ecosistema —desde las ecuaciones de física óptica (dispersión de Sellmeier, reflectancia de Fresnel) en Aesthesis, hasta el aislamiento de red en Explorator y la terminación del autómata en ARK— se somete a pruebas adversariales de falsación y verificaciones cuantitativas reproducibles.

2. El Ciclo de Vida Epistémico (cognitive-core)

Gobernado por el ADR-0011, ai/cognitive-core establece una jerarquía de dominio puro. Las inferencias no verificadas de un modelo tienen prohibido escribirse directamente como verdad o creencia duradera:

01. Observation Entrada sensorial o de red capturada con resumen criptográfico de fuente y marca temporal.
02. Claim Hipótesis derivada de la observación con intervalos explícitos de incertidumbre tipada.
03. Fact Afirmación corroborada con cero contradicciones no resueltas entre fuentes independientes.
04. Knowledge Estructura de creencia integrada y anclada en Mnḗmē con curvas de decaimiento temporal.

En TELHAR, la cognición de máquina no puede auto-promover sus aserciones. La salida de un LLM es únicamente un Claim no verificado hasta que la evidencia independiente lo corrobora.

3. Refuto: Gobierno Independiente para Agentes de Código

Refuto es el arnés de aseguramiento independiente de TELHAR, construido íntegramente con la biblioteca estándar de Python (cero dependencias de terceros ni pip install). Aplica una ley fundamental de los sistemas inteligentes:

La Invariante de Oro

"Un agente no puede ser juez de sí mismo."

Bajo presión de contexto, un agente autónomo tiende de forma natural a editar las pruebas o relajar los umbrales de aserción para dar la tarea por terminada. Refuto opera como un guardián fuera de proceso que intercepta la ejecución, aplica políticas inmutables y asienta un diario inmutable (append-only).

El Contrato Formal de 6 Estados

A diferencia de los ejecutores binarios tradicionales que camuflan ejecuciones vacías como éxitos, Refuto impone un contrato de 6 estados con cobertura declarada:

PASS Evaluado con ámbito no vacío y cobertura verificada.
FAIL Evaluado con confirmación explícita de violación de la invariante.
BLOCKED Requisitos previos no clasificados o no verificados; denegación por omisión.
NOT_RUN Comprobación declarada que nadie ejecutó. Nunca autoriza.
INCONCLUSIVE Contradicción entre fuentes de verdad (ej. el diario contradice al informe).
NOT_APPLICABLE Ámbito vacío. Por definición, un ámbito vacío jamás equivale a PASS.

4. Explorator: Descubrimiento Gobernado y Procedencia

Explorator no es un buscador web ni un wrapper de APIs comerciales. Es un proveedor subordinado de evidencia que conecta la red abierta no confiable con el núcleo cognitivo mediante invariantes estrictas fail-closed:

Egreso Fail-Closed y Protección SSRF

Ninguna petición HTTP sale del proceso sin autorización del PDP y una inspección automática contra SSRF. En ensayos empíricos de frontera, se barrieron 133,921 direcciones IPv4 e IPv6 con 0 fugas, a un costo operativo de 17.8 nanosegundos por decisión.

Grafo de Evidencia y Libro de Confianza

Los hechos recopilados de la web se descomponen en afirmaciones estructuradas: Pregunta → Descubrimiento → Fuente → Documento → Snapshot → Evidencia → Afirmación → Cobertura. La confianza se propaga exclusivamente sobre aristas de respaldo, jamás a través de contradicciones.

Afirmaciones Fundamentadas vs Ancladas (Alcance Honesto)

En observancia de nuestra política contra la inflación de capacidades, TELHAR documenta abiertamente que mientras las afirmaciones externas están fundamentadas mediante hashes de contenido y capturas de documentos, el anclaje centralizado en security/vestigium está actualmente vacante y reporta anchored: 0. Las afirmaciones permanecen fundamentadas y verificables sin recurrir a promesas no demostradas.

5. Cadena de Ejecución Verificable

Toda decisión consecuente del sistema genera un registro de auditoría verificable:

asiento = {
  runId:           "run_01j8k9x...",
  causationId:     "caus_01j8k9y...",
  actor:           "urn:telhar:identity:principal_...",
  tool:            "storage.write_encrypted",
  argsHash:        "sha256:7f83b1657ff1fc53...",
  policyVersion:   "2026.09.06-v2",
  decisionId:      "dec_01j8k9z...",
  resultado:       "VERIFIED",
  prevHash:        "sha256:3a4b5c6d...",
  hash:            "sha256:8e9f0a1b..."
}

Esta cadena de hash monótona asegura que las acciones no puedan ser repudiadas, modificadas en secreto ni insertadas retroactivamente en el historial.

6. Falsación de Física Perceptual (ai/aesthesis)

En TELHAR, la superficie sensorial se rige por los mismos estándares de falsación empírica que las capas criptográficas y de red. ai/aesthesis somete todos sus algoritmos ópticos, colorimétricos y de materiales a bancos de pruebas automatizados:

Conservación de Energía en Horno Blanco (GGX BRDF)

Evaluada mediante 67.1M de muestras Monte Carlo sobre el hemisferio (muestreo por importancia VNDF, Heitz 2018). Cota de error residual:

ΔE₂₀₀₀ ≤ 0.80 (por debajo del umbral de ruido CSS de 2.0 ΔE)

Invariantes Físicos BSDF (Basados en Propiedades)

Verificación proptest sobre subnormales, ángulos rasantes e índices de refracción (IOR) degenerados:

R + T + A = 1 (tolerancia ε = 10⁻⁹) · Reciprocidad de Helmholtz

Vectores Dorados Colorimétricos

Validación contra el conjunto de referencia CIEDE2000 de Sharma-Wu-Dalal (34 pares), racionales exactos de CSS Color 4 e ITU-R BT.2020:

ΔE_OK < 10⁻⁶ · Ciclo de ida y vuelta bit-exacto

Límites de Accesibilidad y Contraste (APCA-W3)

Compuerta dead-band que garantiza legibilidad de texto continuo en todas las membranas (Obsidiana, Regular, Gruesa, Esmerilada):

|L_c| ≥ 60 en el 100% de preajustes evaluados (Obsidiana L_c = -95.78)