Stratégies de garde-fou par défaut pour Azure OpenAI (classique)

Affichage actuel :Version du portail - Passer à la version du nouveau portail Foundry

Azure OpenAI dans les modèles Foundry inclut des stratégies de sécurité par défaut appliquées à tous les modèles (à l’exception de Azure OpenAI Whisper). Ces configurations vous offrent une expérience responsable par défaut, notamment les modèles de filtrage de contenu, les listes de blocage, la transformation d’invite, les informations d’identification de contenu et d’autres fonctionnalités.

La sécurité par défaut vise à atténuer les risques dans différentes catégories telles que la haine et l’équité, le contenu à caractère sexuel, la violence, l'automutilation, le contenu protégé, et les attaques par injection de commande utilisateur. Pour en savoir plus sur le filtrage de contenu, consultez notre documentation décrivant les catégories et les niveaux de gravité.

Toutes les stratégies de sécurité sont configurables. Pour en savoir plus sur la configuration, consultez la documentation sur la configuration du filtrage de contenu.

Modèles de texte

Les modèles de texte dans la Azure OpenAI peuvent prendre et générer du texte et du code. Ces modèles tirent parti des filtres de contenu texte de Azure pour détecter et empêcher le contenu dangereux. Ce système fonctionne à la fois sur les invites et les complétions.

Catégorie de risque Invite de commande/complétion Seuil de gravité
Haine et équité Incitations et complétions Moyen
Violence Incitations et complétions Moyen
Sexuelle Incitations et complétions Moyen
Auto-mutilation Incitations et complétions Moyen
Attaque par injection d’invite utilisateur (Jailbreak) Invites N/A
Matériel protégé – Texte Achèvements N/A
Matériel protégé – Code Achèvements N/A

Modèles visionnels

Modèles de conversation compatibles avec vision

Catégorie de risque Invite de commande/complétion Seuil de gravité
Haine et équité Incitations et complétions Moyen
Violence Incitations et complétions Moyen
Sexuelle Incitations et complétions Moyen
Auto-mutilation Incitations et complétions Moyen
Identification des individus et inférence d’attributs sensibles Invites N/A
Attaque par injection d’invite utilisateur (Jailbreak) Invites N/A

Modèles de génération d’images

Catégorie de risque Invite de commande/complétion Seuil de gravité
Haine et équité Incitations et complétions Moyen
Violence Incitations et complétions Moyen
Sexuelle Incitations et complétions Moyen
Auto-mutilation Incitations et complétions Moyen
Crédits de contenu Achèvements N/A
Génération trompeuse de candidats politiques Invites N/A
Représentations de figures publiques Invites N/A
Attaque par injection d’invite utilisateur (Jailbreak) Invites N/A
Matériel protégé – Objets d’art et personnages de studio Invites N/A
Blasphème Invites N/A

Modèles audio

Catégorie de risque Invite de commande/complétion Seuil de gravité
Haine et équité Incitations et complétions Moyen
Violence Incitations et complétions Moyen
Sexuelle Incitations et complétions Moyen
Auto-mutilation Incitations et complétions Moyen
Attaque par injection d’invite utilisateur (Jailbreak) Invites N/A
Matériel protégé - Texte Achèvements N/A
Matériel protégé - Code Achèvements N/A