Todos los vídeos Seguridad en IA 1:00

Red-teaming

Cómo probar la cadena causal completa desde una entrada adversaria hasta autorización, efecto externo, recuperación y una regresión reproducible de release.

Los enlaces con ?t= abren el vídeo en un segundo concreto.

Resumen del vídeo

Las ideas que debes retener

01

El threat model viene antes que el benchmark

Antes de elegir un dataset o una métrica, una evaluación debería fijar al menos:

02

Separar lo que el modelo sabe hacer de lo que el sistema ejecuta

Una evaluación debería separar al menos tres niveles:

03

Probar el modelo y probar el producto son experimentos distintos

Para estudiar capacidad base puede tener sentido evaluar configuraciones con mitigaciones reducidas o desactivadas. El objetivo no es desplegarlas, sino evitar confundir «el sistema…

Momentos clave

Ve directamente a una sección

  1. Del test a la cadena de ataque
  2. Cobertura adaptativa y validez del evaluador
  3. Evidencia y gate de release