1. Mapea los límites del sistema
Resultado: Todos los flujos de datos y autoridad son visibles.
Tareas
- →Marca entradas confiables y no confiables
- →Identifica secretos
- →Clasifica herramientas
Comprobaciones
- ✓La capacidad de escritura no está oculta
Construye un modelo de amenazas para un sistema de IA con casos de abuso, controles, pruebas de seguridad, riesgo residual y un playbook de incidentes.
Escenario
Un asistente de IA utiliza RAG y herramientas con acceso de escritura. Antes del lanzamiento a producción hay que definir límites de confianza, rutas de ataque y controles.
Resultado: Todos los flujos de datos y autoridad son visibles.
Tareas
Comprobaciones
Resultado: Las amenazas están vinculadas a flujos reales.
Tareas
Comprobaciones
Resultado: Los controles son verificables.
Tareas
Comprobaciones
Resultado: El equipo puede detectar, contener y recuperar.
Tareas
Comprobaciones
Rúbrica de evaluación
Datos, modelo, herramientas, usuarios, secretos y sistemas externos están completamente mapeados.
Insuficiente
Quedan ocultos flujos de autoridad o de datos.
Competente
Los límites principales son explícitos.
Sólido
La clasificación de datos, los límites entre tenants y el linaje de la cadena de suministro están documentados.
Evidencia requerida
Las amenazas tienen precondiciones, impacto, probabilidad y responsable.
Insuficiente
La lista es genérica y no está vinculada a flujos reales.
Competente
Las amenazas están contextualizadas y priorizadas.
Sólido
Hay árboles de ataque, casos de abuso encadenados y riesgo residual documentados.
Evidencia requerida
Los controles de prevención, detección y respuesta tienen evidencia de prueba.
Insuficiente
Los controles son solo declarativos.
Competente
Los controles principales están verificados.
Sólido
Hay evaluaciones de seguridad automatizadas, policy as code y una puerta de regresión.
Evidencia requerida
Kill switch, contención, rollback y procedimientos de postmortem están verificados.
Insuficiente
El plan de respuesta no se ha probado.
Competente
El simulacro está completo y tiene evidencia.
Sólido
Hay métricas temporizadas de recuperación y contención automatizada.
Evidencia requerida