Los equipos de IA necesitan escenarios adversariales, pruebas de fuga de instrucciones, controles de herramientas y mecanismos de parada. Además, los resultados deben revisarse después de cada cambio relevante del modelo o de sus permisos.
La seguridad de IA se está convirtiendo en una disciplina continua. El modelo que era seguro ayer puede comportarse de otra forma mañana si cambian sus herramientas, contexto o capacidades.
Fuente original: https://www.ft.com/content/822f8902-1808-469f-97e0-634c552a7aa4