ADVERSARIAL RISK & INTEGRITY ASSESSMENT

ARIA Adversarial Testing

ARIA intenta descubrir qué puede ser manipulado para hacer el sistema antes de que ese aprendizaje llegue en producción.

CIRCUITO DE ASSURANCE
Unidad de análisisSistema + cartera
DecisiónAPTO · APTO CON CONTROLES · NO APTO TODAVÍA · REVISIÓN ESPECIALIZADA
EvidenciaAssurance Case versionado
ActivaciónSolo con autorización humana

Pruebas ajustadas al sistema, no una lista universal de prompts.

01

Prompt & role manipulation

Prueba si instrucciones maliciosas, autoridad fingida o contexto contaminado alteran el rol autorizado.

02

Tool and permission abuse

Explora llamadas indebidas, combinaciones de herramientas, escalation y autoridad compuesta.

03

Data boundary pressure

Intenta extraer, mezclar, inferir o revelar datos fuera del propósito y del scope autorizado.

04

Memory and context poisoning

Evalúa cómo información persistente o instrucciones previas pueden degradar decisiones posteriores.

05

Failure and recovery

Fuerza errores, timeouts, dependencias caídas y estados parciales para observar fallback, rollback y contención.

06

Multi-agent failure paths

Analiza cadenas donde varios agentes producen una acción que ninguno controla por sí solo.

EVIDENCIA, NO TEATRO

Un test adversarial debe poder repetirse.

Cada hallazgo registra precondiciones, versión, payload, respuesta, efecto, severidad, control asociado y resultado del retest.

No demuestraQue el sistema sea imposible de comprometer o seguro bajo cualquier contexto futuro.
Sí demuestraQué versión fue probada, contra qué amenazas, con qué resultados y bajo qué límites.
TriggerCambios de modelo, prompt, herramientas, datos, permisos o arquitectura invalidan parte de la evidencia.
Relación con Vigilance: ARIA prueba la versión autorizable antes de producción. Vigilance debe detectar después cambios y trayectorias operativas que invaliden parte de esa evidencia y requieran repetir pruebas dirigidas.

Un ciclo completo, no una auditoría aislada

Cada etapa produce una decisión, un responsable y evidencia suficiente para que la siguiente no dependa de confianza ciega.

NecesidadOrbynDiseñoBlueprintEvaluaciónAegisPresiónARIAAutorizaciónHumanaObservaciónVigilanceRevalidaciónPortfolio
SIGUIENTE DECISIÓN

La primera pregunta no es qué puede hacer la IA.

Es qué sistema estás dispuesto a autorizar, bajo qué límites y con qué evidencia.

Solicitar una conversación