Prompt & role manipulation
Prueba si instrucciones maliciosas, autoridad fingida o contexto contaminado alteran el rol autorizado.
ARIA intenta descubrir qué puede ser manipulado para hacer el sistema antes de que ese aprendizaje llegue en producción.
Prueba si instrucciones maliciosas, autoridad fingida o contexto contaminado alteran el rol autorizado.
Explora llamadas indebidas, combinaciones de herramientas, escalation y autoridad compuesta.
Intenta extraer, mezclar, inferir o revelar datos fuera del propósito y del scope autorizado.
Evalúa cómo información persistente o instrucciones previas pueden degradar decisiones posteriores.
Fuerza errores, timeouts, dependencias caídas y estados parciales para observar fallback, rollback y contención.
Analiza cadenas donde varios agentes producen una acción que ninguno controla por sí solo.
Cada hallazgo registra precondiciones, versión, payload, respuesta, efecto, severidad, control asociado y resultado del retest.
Cada etapa produce una decisión, un responsable y evidencia suficiente para que la siguiente no dependa de confianza ciega.
Es qué sistema estás dispuesto a autorizar, bajo qué límites y con qué evidencia.