Poznámka:
Přístup k této stránce vyžaduje autorizaci. Můžete se zkusit přihlásit nebo změnit adresáře.
Přístup k této stránce vyžaduje autorizaci. Můžete zkusit změnit adresáře.
Školicí série AI Red Teaming 101 od Microsoftu pomáhá odborníkům zabezpečit systémy umělé inteligence před vznikajícími hrozbami. Tato série se zaměřuje na ohrožení zabezpečení, techniky útoku a strategie obrany a poskytuje praktické přehledy a praktické zkušenosti. Ať už jste odborníkem na zabezpečení, inženýrem strojového učení nebo obchodním vůdcem, získáte praktické znalosti prostřednictvím skutečných případových studií, modulárních epizod a automatizovaných testovacích nástrojů. Prozkoumejte témata, například útoky prostřednictvím vložení příkazu, víceotáčkové protivné techniky a škálovatelné metody ochrany, které posilují vaše znalosti zabezpečení AI.
Proč sledovat tuto trénovací řadu
Získejte užitečné rady, které vám pomůžou identifikovat, zneužít a bránit se kritickým chybám zabezpečení v systémech generující umělé inteligence. Seznamte se s osvědčenými postupy, technikami a pokyny založenými na skutečných lekcích od týmu Microsoftu pro AI Red Team.
Kdo by měl sledovat tuto trénovací řadu
Série školení je užitečná pro bezpečnostní týmy, techniky STROJOVÉho učení, odborníky na AI a vedoucí pracovníky, kteří pracují s AI. Zaměřuje se především na:
- Odborníci na zabezpečení: Seznamte se s vektory útoku specifickými pro AI a strategiemi ochrany.
- Odborníci na strojové učení a technici umělé inteligence: Přidejte testování zabezpečení do pracovních postupů vývoje umělé inteligence.
- Podnikoví a bezpečnostní architekti: vytvářejte zabezpečené systémy AI a prozkoumejte vznikající hrozby.
Návod
Videa AI Red Teaming 101 jsou modulární, takže můžete přejít na libovolnou část zájmu nebo začít na začátku a sledovat je všechny. Stáhněte si snímky a pokračujte vlastním tempem.
Co je v tréninkové sérii
Školicí série obsahuje pokyny k porozumění generačním chybám zabezpečení AI, provádění technik útoku a implementaci defenzivních opatření. Workshop obsahuje praktické ukázky, skutečné případové studie a automatizované testovací nástroje založené na postupech zabezpečení umělé inteligence Microsoftu v produkčním prostředí.
Návod
Všechny epizody zahrnují praktické ukázky a přístup k red teaming laboratořím Microsoftu, abyste získali praktické zkušenosti.
Úvod a základy
Epizoda 1: Co je red teaming v oblasti umělé inteligence? – Úvod k základům seskupování AI red, klíčovým rizikům v oblasti generování umělé inteligence a poslání červeného týmu umělé inteligence Microsoftu
Epizoda 2: Jak fungují modely generující umělé inteligence – principy architektury modelů, trénovacích fází a důvodů, proč tyto modely vytvářejí jedinečná rizika zabezpečení
Část A – Základní techniky útoku
Epizoda 3: Vysvětlení přímé injektáže výzvy – jak útočníci manipulují s chováním modelu vložením škodlivých instrukcí, včetně skutečných případových studií, jako je útok chatovacího robota SUV $1
Epizoda 4: Vysvětlení nepřímé injektáže příkazu – skryté útoky, kdy jsou škodlivé instrukce skryté v externích datových zdrojích, jako jsou e-mailové zprávy, weby nebo databáze
Epizoda 5: Single-Turn útoky – pokročilé techniky inženýrství promptů, včetně hackingu osobností, emocionální manipulace a obcházení filtrů pomocí triků se zakódováním
Epizoda 6: Víceotáčkové útoky - techniky, jako je Skeleton Key a Crescendo, které postupně nasměrují modely k obejití bezpečnostní ochrany
Část B – Obrana a zmírnění rizik
Epizoda 7: Obrana proti útokům – strategie zmírnění a preventivní techniky, včetně obranných metod zvýrazněných společností Microsoft (delimitace, označování dat a kódování)
Část C – Automatizace a škálování
Epizoda 8: Automatizace red teamingu umělé inteligence pomocí PyRIT – úvod do open-source nástroje Microsoftu pro automatizaci a škálování adversariálních testů generativních systémů AI, Python Risk Identification Tool (PyRIT)
Epizoda 9: Automatizace útoků Single-Turn – praktická ukázka konfigurace datových sad, cílů a logiky vyhodnocování pro odesílání mnoha výzev najednou pomocí PyRIT
Epizoda 10: Automatizace vícenásobných útoků – pokročilé techniky automatizace pro vícenásobné konverzace, včetně nežádoucích modelových konverzací a testování systémů generování textu i obrázků
Co se naučíte
Po dokončení této série školení pochopíte následující:
- Základy červeného seskupování umělé inteligence a tradičních přístupů k červenému seskupování
- Základní chyby zabezpečení v systémech generativní umělé inteligence, jako jsou injektáž promptu a nesoulad modelu
- Techniky útoku, od jednoduché manipulace vstupu až po sofistikované vícestupňové adversiální strategie.
- Strategie obrany, včetně osvědčených technik pro zmírnění rizik, jako jsou metody Spotlighting od Microsoftu
- Automatizační nástroje pro škálování red teamingu pomocí PyRIT a dalších open-source nástrojů
- Reálné aplikace s praktickými laboratořemi a případovými studiemi z produkční práce na zabezpečení umělé inteligence Microsoftu.