Introduzione
Sono stati illustrati i tipi di attacchi destinati ai sistemi di intelligenza artificiale e i controlli di sicurezza che è possibile implementare per proteggerli. Tuttavia, sapere che esistono vulnerabilità e sapere come individuarle prima degli attaccanti sono due competenze diverse. Ecco dove arrivano i test di sicurezza dell'intelligenza artificiale.
I test di sicurezza dell'IA, in particolare il red teaming di intelligenza artificiale, è il processo di probe dei sistemi di intelligenza artificiale con tecniche antagoniste per individuare le vulnerabilità prima che possano essere sfruttate. Si tratta di una pratica necessaria in qualsiasi ciclo di vita di sviluppo di intelligenza artificiale responsabile e funziona in modo diverso rispetto ai test di penetrazione tradizionali in modi che variano in base alla pianificazione e all'esecuzione.
In questo modulo si apprenderà cos'è il red teaming di intelligenza artificiale e perché differisce dai test di sicurezza tradizionali, dalle tre categorie di red teaming di intelligenza artificiale usate nella pratica e come pianificare un esercizio di red teaming per un'applicazione abilitata per LLM o intelligenza artificiale nell'organizzazione.
Obiettivi di apprendimento
Alla fine di questo modulo, sarai in grado di:
- Descrivere il red teaming di intelligenza artificiale e le differenze rispetto al red teaming della sicurezza tradizionale
- Identificare le tre categorie di red teaming per intelligenza artificiale e le competenze richieste
- Pianificare un esercizio di red teaming per l'intelligenza artificiale, inclusi composizione del team e metodologia di test.
- Spiegare come gli strumenti automatizzati di red teaming supportano i test manuali
Prerequisiti
Per ottenere un'esperienza di apprendimento ottimale da questo modulo, è necessario avere una conoscenza e un'esperienza di:
- Concetti fondamentali sulla sicurezza (ad esempio, autenticazione, controllo di accesso, crittografia)
- Concetti fondamentali dell'intelligenza artificiale (ad esempio, modelli, training, inferenza)
- I tipi di attacchi di intelligenza artificiale trattati nel modulo Concetti fondamentali della sicurezza dell'intelligenza artificiale
- Controlli di sicurezza dell'intelligenza artificiale trattati nei controlli di sicurezza dell'intelligenza artificiale del modulo