Secure AI Atlas mark Secure AI Atlas SECURITY & GOVERNANCE

Riesgo

Fuga de instrucciones del sistema

El prompt de sistema — instrucciones internas, reglas de negocio o configuración no destinadas al usuario final — se filtra a través de las respuestas del modelo, revelando lógica interna o facilitando ataques posteriores.

seguridad de promptsdivulgación de informaciónconfiguración

Exposición

El prompt de sistema — instrucciones internas, reglas de negocio o configuración no destinadas al usuario final — se filtra a través de las respuestas del modelo, revelando lógica interna o facilitando ataques posteriores.

Señales

Busca puntos donde lenguaje, datos, identidad, herramientas o autoridad se muevan más rápido que el gobierno de la organización. La señal crítica suele aparecer antes del incidente: permisos amplios, registros ausentes, propietarios ambiguos o decisiones sin revisión.

Fallos probables

El fallo aparece cuando una capacidad se interpreta como autorización. ATLAS marca esa zona como exposición hasta que exista control verificable.

Controles relacionados

  • Definir responsables y límites de uso.
  • Revisar datos, permisos, herramientas y registros disponibles.
  • Conectar la mitigación con controles operativos verificables.