Saltar al contenido principal
Avanzado12–20 horas

Modelo de amenazas y plan de controles de IA

Construye un modelo de amenazas para un sistema de IA con casos de abuso, controles, pruebas de seguridad, riesgo residual y un playbook de incidentes.

modelado de amenazasprompt injectionpermisos de agentesred teamingrespuesta a incidentes

Escenario

Tarea

Un asistente de IA utiliza RAG y herramientas con acceso de escritura. Antes del lanzamiento a producción hay que definir límites de confianza, rutas de ataque y controles.

Ejecución paso a paso

1. Mapea los límites del sistema

Resultado: Todos los flujos de datos y autoridad son visibles.

Tareas

  • Marca entradas confiables y no confiables
  • Identifica secretos
  • Clasifica herramientas

Comprobaciones

  • La capacidad de escritura no está oculta

2. Construye casos de abuso

Resultado: Las amenazas están vinculadas a flujos reales.

Tareas

  • Prompt injection
  • Envenenamiento de RAG
  • Exfiltración de datos
  • Abuso de herramientas
  • Compromiso de la cadena de suministro

Comprobaciones

  • Cada amenaza tiene precondición e impacto

3. Define controles y pruebas

Resultado: Los controles son verificables.

Tareas

  • Mínimo privilegio
  • Approval gates
  • Sandboxing
  • Evaluaciones de seguridad

Comprobaciones

  • Un control sin evidencia de prueba no se considera listo

4. Ejecuta un simulacro de incidente

Resultado: El equipo puede detectar, contener y recuperar.

Tareas

  • Activar escenario
  • Kill switch
  • Rollback
  • Postmortem

Comprobaciones

  • Se registran timestamps y evidencia

Criterios de aceptación

  • Los límites de confianza están completos
  • El registro de amenazas está priorizado
  • Los controles tienen pruebas
  • El riesgo residual tiene responsable
  • El simulacro de incidente está completo

Rúbrica de evaluación

Cómo se evalúa el resultado

Puntuación mínima: 75/100 · Distinción: 92/100

Sistema y límites de confianza

Datos, modelo, herramientas, usuarios, secretos y sistemas externos están completamente mapeados.

25 puntos

Insuficiente

Quedan ocultos flujos de autoridad o de datos.

Competente

Los límites principales son explícitos.

Sólido

La clasificación de datos, los límites entre tenants y el linaje de la cadena de suministro están documentados.

Evidencia requerida

  • ✓ Enlace al artefacto o código
  • ✓ README con decisiones y compromisos
  • ✓ Evidencia de las comprobaciones ejecutadas
  • ✓ Diagrama de arquitectura/amenazas

Registro de amenazas

Las amenazas tienen precondiciones, impacto, probabilidad y responsable.

25 puntos

Insuficiente

La lista es genérica y no está vinculada a flujos reales.

Competente

Las amenazas están contextualizadas y priorizadas.

Sólido

Hay árboles de ataque, casos de abuso encadenados y riesgo residual documentados.

Evidencia requerida

  • ✓ Enlace al artefacto o código
  • ✓ README con decisiones y compromisos
  • ✓ Evidencia de las comprobaciones ejecutadas
  • ✓ Registro de amenazas priorizado

Controles y pruebas de seguridad

Los controles de prevención, detección y respuesta tienen evidencia de prueba.

30 puntos

Insuficiente

Los controles son solo declarativos.

Competente

Los controles principales están verificados.

Sólido

Hay evaluaciones de seguridad automatizadas, policy as code y una puerta de regresión.

Evidencia requerida

  • ✓ Enlace al artefacto o código
  • ✓ README con decisiones y compromisos
  • ✓ Evidencia de las comprobaciones ejecutadas
  • ✓ Matriz de controles y pruebas

Preparación ante incidentes

Kill switch, contención, rollback y procedimientos de postmortem están verificados.

20 puntos

Insuficiente

El plan de respuesta no se ha probado.

Competente

El simulacro está completo y tiene evidencia.

Sólido

Hay métricas temporizadas de recuperación y contención automatizada.

Evidencia requerida

  • ✓ Enlace al artefacto o código
  • ✓ README con decisiones y compromisos
  • ✓ Evidencia de las comprobaciones ejecutadas
  • ✓ Informe del simulacro de incidente