Seguridad en IA
Cómo una entrada no confiable puede influir en un sistema con IA y qué fronteras de autorización limitan que esa influencia se convierta en una acción.
Los enlaces con ?t= abren el vídeo en un segundo concreto.
Las ideas que debes retener
1. Una orden escondida en un documento puede cambiar lo que hace el sistema
Qué se rompe exactamente cuando un LLM procesa el plano de control y el plano de datos en el mismo canal. Por qué la inyección indirecta puede ser más grave cuando el sistema conecta…
2. Pedir al modelo que ignore sus límites
Cómo funcionan los ataques que fuerzan al modelo a abandonar sus restricciones. Qué diferencia hay entre un bypass anecdótico y una familia de jailbreaks transferible. Qué papel pueden…
3. Guardar una señal peligrosa dentro del sistema
Qué ocurre cuando el sistema aprende, recuerda o recupera contenido que no debería tratar como confiable. Envenenamiento de bases RAG, memoria de trabajo de agentes y backdoors persistentes.