Azure informations de référence sur l’image OpenAI et l’API REST audio (2025-04-01-preview)

Cet article documente les opérations d’API REST d’inférence de plan de données (reconnaissance vocale) de génération d’images et de plan de données (speech) pour Azure OpenAI dans la 2025-04-01-preview version. Pour connaître les achèvements de conversation, les incorporations, les assistants, les réponses, les magasins vectoriels et toutes les autres opérations, consultez la référence officielle de l’API REST OpenAI Azure.

Spécifications de l’API

La gestion et l’interaction avec les modèles et ressources OpenAI Azure sont réparties sur trois surfaces principales d’API :

  • Plan de contrôle
  • Plan de données - création
  • Plan de données - inférence

Chaque surface/spécification API englobe un ensemble différent de capacités Azure OpenAI. Chaque API possède son propre ensemble unique de versions d’aperçu et d’API stable/généralement disponibles (GA). Les sorties de prévisualisation suivent actuellement un rythme mensuel.

Important

Il existe désormais une nouvelle API d’inférence d’aperçu. Découvrez-en plus dans notre guide du cycle de vie de l’API.

API Dernière version d’aperçu Dernière sortie de GA Spécifications Description
Plan de contrôle 2025-07-01-preview 2025-06-01 Fichiers de spécifications L’API du plan de contrôle est utilisée pour des opérations telles que la création de ressources, le déploiement de modèles et d’autres tâches de gestion des ressources de haut niveau. Le plan de contrôle régit également ce qui est possible à faire avec des fonctionnalités telles que Azure Resource Manager, Bicep, Terraform et Azure CLI.
Plan de données v1 preview v1 Fichiers de spécifications L’API du plan de données contrôle les opérations d’inférence et d’authoring.

Authentication

Azure OpenAI propose deux méthodes d’authentification. Vous pouvez utiliser soit API Keys, soit Microsoft Entra ID.

  • Authentification par clé API : Pour ce type d’authentification, toutes les requêtes API doivent inclure la clé API dans l’en-tête api-key HTTP. Le Quickstart fournit des conseils pour passer des appels avec ce type d’authentification.

  • Microsoft Entra ID : Vous pouvez authentifier un appel API à l’aide d’un jeton Microsoft Entra. Les jetons d’authentification sont inclus dans une requête en tant qu’en-tête Authorization . Le jeton fourni doit être précédé de Bearer, par exemple Bearer YOUR_AUTH_TOKEN. Vous pouvez lire notre guide pratique sur authentifier avec Microsoft Entra ID.

Versionnement de l’API REST

Les API de service sont versionnées à l’aide du api-version paramètre de requête. Toutes les versions suivent la structure de dates YYYY-MM-DD. Par exemple:

POST https://YOUR_RESOURCE_NAME.openai.azure.com/openai/deployments/YOUR_DEPLOYMENT_NAME/chat/completions?api-version=2024-06-01

Inférence dans les plans de données

Le reste de cet article traite des opérations d’image et audio dans la 2025-04-01-preview préversion de la spécification d’inférence du plan de données OpenAI Azure.

Pour connaître les opérations audio et d’image ga, consultez la référence de l’IMAGE GA et de l’API REST audio.

Transcriptions - Créer

POST https://{endpoint}/openai/deployments/{deployment-id}/audio/transcriptions?api-version=2025-04-01-preview

Transcrit l’audio dans la langue d’entrée.

Paramètres d’URI

Nom Dans Obligatoire Catégorie Description
endpoint path Oui URL en chaîne Pris en charge Azure terminaux OpenAI (protocole et nom d’hôte, par exemple : https://aoairesource.openai.azure.com. Remplacez « aoairesource » par le nom de votre ressource Azure OpenAI). https://{your-resource-name}.openai.azure.com
id-de-déploiement path Oui string
version de l'API Requête Oui string

En-tête de requête

Utilisez soit une authentification basée sur un jeton, soit une clé API. L’authentification par jeton est recommandée et plus sécurisée.

Nom Obligatoire Catégorie Description
Authorization True string Exemple :Authorization: Bearer {Azure_OpenAI_Auth_Token}

Pour générer un jeton d’authentification en utilisant Azure CLI : az account get-access-token --resource https://cognitiveservices.azure.com

Type : oauth2
URL d’autorisation : https://login.microsoftonline.com/common/oauth2/v2.0/authorize
Portée : https://ai.azure.com/.default
clé API True string Fournissez ici la clé API Azure OpenAI

Corps de la requête

Content-Type : multipart/form-data

Nom Catégorie Description Obligatoire Par défaut
model string ID du modèle à utiliser. Les options sont gpt-4o-transcribe, gpt-4o-mini-transcribe, gpt-4o-mini-transcribe-2025-12-15, whisper-1, et gpt-4o-transcribe-diarize. Oui
fichier string L’objet du fichier audio à transcrire. Oui
language string La langue de l’audio d’entrée. Fournir le langage d’entrée au format ISO-639-1 améliore la précision et la latence. Non
prompt string Un texte optionnel pour guider le style du modèle ou poursuivre un segment audio précédent. La consigne doit correspondre au langage audio. Non
format_de_réponse audioResponseFormat Définit le format de la sortie. Non
Température number La température d’échantillonnage, comprise entre 0 et 1. Des valeurs plus élevées comme 0,8 rendent la sortie plus aléatoire, tandis que des valeurs plus basses comme 0,2 la rendent plus ciblée et déterministe. Si elle est réglée à 0, le modèle utilise la probabilité logarithmique pour augmenter automatiquement la température jusqu’à atteindre certains seuils. Non 0
timestamp_granularities[] tableau Les détails temporels à remplir pour cette transcription. response_format doit être réglé verbose_json pour utiliser des granularités horodatages. L’une ou l’autre de ces options est prise en charge : word, ou segment. Remarque : Il n’y a pas de latence supplémentaire pour les horodatages de segments, mais la génération de horodatages de mots entraîne une latence supplémentaire. Non ['segment']

Responses

Code de statut : 200

Description : OK

Type de contenu Type Description
application/json Objet
texte brut string Texte transcrit dans le format de sortie (lorsque response_format était l’un des text, vtt ou srt).

Exemples

Example

Obtient le texte transcrit et les métadonnées associées à partir des données audio parlées fournies.

POST https://{endpoint}/openai/deployments/{deployment-id}/audio/transcriptions?api-version=2025-04-01-preview

Réponses : Code de statut : 200

{
  "body": {
    "text": "A structured object when requesting json or verbose_json"
  }
}

Example

Obtient le texte transcrit et les métadonnées associées à partir des données audio parlées fournies.

POST https://{endpoint}/openai/deployments/{deployment-id}/audio/transcriptions?api-version=2025-04-01-preview

"---multipart-boundary\nContent-Disposition: form-data; name=\"file\"; filename=\"file.wav\"\nContent-Type: application/octet-stream\n\nRIFF..audio.data.omitted\n---multipart-boundary--"

Réponses : Code de statut : 200

{
  "type": "string",
  "example": "plain text when requesting text, srt, or vtt"
}

Traductions - Create

POST https://{endpoint}/openai/deployments/{deployment-id}/audio/translations?api-version=2025-04-01-preview

Transcrit et traduit l’audio d’entrée en texte anglais.

Paramètres d’URI

Nom Dans Obligatoire Catégorie Description
endpoint path Oui URL en chaîne Pris en charge Azure terminaux OpenAI (protocole et nom d’hôte, par exemple : https://aoairesource.openai.azure.com. Remplacez « aoairesource » par le nom de votre ressource Azure OpenAI). https://{your-resource-name}.openai.azure.com
id-de-déploiement path Oui string
version de l'API Requête Oui string

En-tête de requête

Utilisez soit une authentification basée sur un jeton, soit une clé API. L’authentification par jeton est recommandée et plus sécurisée.

Nom Obligatoire Catégorie Description
Authorization True string Exemple :Authorization: Bearer {Azure_OpenAI_Auth_Token}

Pour générer un jeton d’authentification en utilisant Azure CLI : az account get-access-token --resource https://cognitiveservices.azure.com

Type : oauth2
URL d’autorisation : https://login.microsoftonline.com/common/oauth2/v2.0/authorize
Portée : https://ai.azure.com/.default
clé API True string Fournissez ici la clé API Azure OpenAI

Corps de la requête

Content-Type : multipart/form-data

Nom Catégorie Description Obligatoire Par défaut
fichier string Le fichier audio à traduire. Oui
prompt string Un texte optionnel pour guider le style du modèle ou poursuivre un segment audio précédent. Le prompt doit être en anglais. Non
format_de_réponse audioResponseFormat Définit le format de la sortie. Non
Température number La température d’échantillonnage, comprise entre 0 et 1. Des valeurs plus élevées comme 0,8 rendent la sortie plus aléatoire, tandis que des valeurs plus basses comme 0,2 la rendent plus ciblée et déterministe. Si elle est réglée à 0, le modèle utilise la probabilité logarithmique pour augmenter automatiquement la température jusqu’à atteindre certains seuils. Non 0

Responses

Code de statut : 200

Description : OK

Type de contenu Type Description
application/json Objet
texte brut string Texte transcrit au format de sortie (quand response_format était un texte de texte, vtt ou srt).

Exemples

Example

Obtient le texte transcrit en anglais et les métadonnées associées à partir des données audio parlées fournies.

POST https://{endpoint}/openai/deployments/{deployment-id}/audio/translations?api-version=2025-04-01-preview

"---multipart-boundary\nContent-Disposition: form-data; name=\"file\"; filename=\"file.wav\"\nContent-Type: application/octet-stream\n\nRIFF..audio.data.omitted\n---multipart-boundary--"

Réponses : Code de statut : 200

{
  "body": {
    "text": "A structured object when requesting json or verbose_json"
  }
}

Example

Obtient le texte transcrit en anglais et les métadonnées associées à partir des données audio parlées fournies.

POST https://{endpoint}/openai/deployments/{deployment-id}/audio/translations?api-version=2025-04-01-preview

"---multipart-boundary\nContent-Disposition: form-data; name=\"file\"; filename=\"file.wav\"\nContent-Type: application/octet-stream\n\nRIFF..audio.data.omitted\n---multipart-boundary--"

Réponses : Code de statut : 200

{
  "type": "string",
  "example": "plain text when requesting text, srt, or vtt"
}

Parole - Créer

POST https://{endpoint}/openai/deployments/{deployment-id}/audio/speech?api-version=2025-04-01-preview

Génère de l’audio à partir du texte d’entrée.

Paramètres d’URI

Nom Dans Obligatoire Catégorie Description
endpoint path Oui URL en chaîne Pris en charge Azure terminaux OpenAI (protocole et nom d’hôte, par exemple : https://aoairesource.openai.azure.com. Remplacez « aoairesource » par le nom de votre ressource Azure OpenAI). https://{your-resource-name}.openai.azure.com
id-de-déploiement path Oui string
version de l'API Requête Oui string

En-tête de requête

Utilisez soit une authentification basée sur un jeton, soit une clé API. L’authentification par jeton est recommandée et plus sécurisée.

Nom Obligatoire Catégorie Description
Authorization True string Exemple :Authorization: Bearer {Azure_OpenAI_Auth_Token}

Pour générer un jeton d’authentification en utilisant Azure CLI : az account get-access-token --resource https://cognitiveservices.azure.com

Type : oauth2
URL d’autorisation : https://login.microsoftonline.com/common/oauth2/v2.0/authorize
Portée : https://ai.azure.com/.default
clé API True string Fournissez ici la clé API Azure OpenAI

Corps de la requête

Content-Type : multipart/form-data

Nom Catégorie Description Obligatoire Par défaut
entrée string Le texte pour synthétiser l’audio. La longueur maximale est de 4 096 caractères. Oui
format_de_réponse enum Le format pour synthétiser l’audio.
Valeurs possibles : mp3, opus, aac, flac, wav, pcm
Non
Vitesse number La vitesse de l’audio synthétisé. Sélectionnez une valeur de 0.25 vers 4.0. 1.0 est la norme par défaut. Non 1.0
Voix enum La voix à utiliser pour la synthèse vocale.
Valeurs possibles : alloy, echo, fable, onyx, nova, shimmer
Oui

Responses

Code de statut : 200

Description : OK

Type de contenu Type Description
application/octet-stream string

Exemples

Example

Synthétise l’audio à partir du texte fourni.

POST https://{endpoint}/openai/deployments/{deployment-id}/audio/speech?api-version=2025-04-01-preview

{
 "input": "Hi! What are you going to make?",
 "voice": "fable",
 "response_format": "mp3"
}

Réponses : Code de statut : 200

{
  "body": "101010101"
}

Générations d’images - Créer

POST https://{endpoint}/openai/deployments/{deployment-id}/images/generations?api-version=2025-04-01-preview

Génère un lot d’images à partir d’une légende texte sur un déploiement donné du modèle de génération d’images

Paramètres d’URI

Nom Dans Obligatoire Catégorie Description
endpoint path Oui URL en chaîne Pris en charge Azure terminaux OpenAI (protocole et nom d’hôte, par exemple : https://aoairesource.openai.azure.com. Remplacez « aoairesource » par le nom de votre ressource Azure OpenAI). https://{your-resource-name}.openai.azure.com
id-de-déploiement path Oui string
version de l'API Requête Oui string

En-tête de requête

Utilisez soit une authentification basée sur un jeton, soit une clé API. L’authentification par jeton est recommandée et plus sécurisée.

Nom Obligatoire Catégorie Description
Authorization True string Exemple :Authorization: Bearer {Azure_OpenAI_Auth_Token}

Pour générer un jeton d’authentification en utilisant Azure CLI : az account get-access-token --resource https://cognitiveservices.azure.com

Type : oauth2
URL d’autorisation : https://login.microsoftonline.com/common/oauth2/v2.0/authorize
Portée : https://ai.azure.com/.default
clé API True string Fournissez ici la clé API Azure OpenAI

Corps de la requête

Content-Type : application/json

Nom Catégorie Description Obligatoire Par défaut
Arrière-plan imageBackground Permet de définir la transparence pour l’arrière-plan des images générées. Ce paramètre n’est pris en charge que pour les modèles série gpt-image-1. Non auto
n entier Le nombre d’images à générer. Pour dall-e-3, seul n=1 est pris en charge. Non 1
compression_de_sortie entier Le niveau de compression (0-100%) pour les images générées. Ce paramètre n’est pris en charge que pour les modèles série gpt-image-1 avec le format de sortie jpeg. Non 100
format de sortie imagesOutputFormat Le format de fichier dans lequel les images générées sont renvoyées. Pris en charge uniquement pour les modèles de la série GPT-image-1. Non png
prompt string Une description textuelle de l’image ou des images souhaitées. La longueur maximale est de 32 000 caractères pour la série gpt-image-1 et de 4 000 caractères pour dall-e-3 Oui
images partielles entier Le nombre d’images partielles à générer. Ce paramètre est utilisé pour les réponses en flux qui retournent des images partielles. La valeur doit être comprise entre 0 et 3. Lorsqu’elle est réglée à 0, la réponse sera une seule image envoyée lors d’un événement de streaming. Notez que l’image finale peut être envoyée avant que le nombre complet d’images partielles ne soit généré si l’image complète est générée plus rapidement. 0
stream booléen Modifie l’image en mode streaming. non false
Qualité imageQuality La qualité de l’image qui sera générée. Non auto
format_de_réponse imagesResponseFormat Le format dans lequel les images générées sont renvoyées. Ce paramètre n’est pas pris en charge pour gpt-image-1les modèles en série qui retournent toujours des images encodées en base64.
Valeurs possibles : url, b64_json.
Non url
size imageSize La taille des images générées. Non auto
style imageStyle Le style des images générées. Pris en charge uniquement pour DALL-E-3. Non vivid
utilisateur string Un identifiant unique représentant votre utilisateur final, qui peut aider à surveiller et détecter les abus. Non

Responses

Code de statut : 200

Description : Ok

Type de contenu Type Description
application/json generateImagesResponse

Code de statut : par défaut

Description : Une erreur s’est produite.

Type de contenu Type Description
application/json dalleErrorResponse

Exemples

Example

Crée des images à partir d’une invitation.

POST https://{endpoint}/openai/deployments/{deployment-id}/images/generations?api-version=2025-04-01-preview

{
 "prompt": "In the style of WordArt, Microsoft Clippy wearing a cowboy hat.",
 "n": 1,
 "style": "natural",
 "quality": "standard"
}

Réponses : Code de statut : 200

{
  "body": {
    "created": 1698342300,
    "data": [
      {
        "revised_prompt": "A vivid, natural representation of Microsoft Clippy wearing a cowboy hat.",
        "prompt_filter_results": {
          "sexual": {
            "severity": "safe",
            "filtered": false
          },
          "violence": {
            "severity": "safe",
            "filtered": false
          },
          "hate": {
            "severity": "safe",
            "filtered": false
          },
          "self_harm": {
            "severity": "safe",
            "filtered": false
          },
          "profanity": {
            "detected": false,
            "filtered": false
          },
          "custom_blocklists": {
            "filtered": false,
            "details": []
          }
        },
        "url": "https://dalletipusw2.blob.core.windows.net/private/images/e5451cc6-b1ad-4747-bd46-b89a3a3b8bc3/generated_00.png?se=2023-10-27T17%3A45%3A09Z&...",
        "content_filter_results": {
          "sexual": {
            "severity": "safe",
            "filtered": false
          },
          "violence": {
            "severity": "safe",
            "filtered": false
          },
          "hate": {
            "severity": "safe",
            "filtered": false
          },
          "self_harm": {
            "severity": "safe",
            "filtered": false
          }
        }
      }
    ]
  }
}

Générations d’images - Modifier

POST https://{endpoint}/openai/deployments/{deployment-id}/images/edits?api-version=2025-04-01-preview

Modifie une image à partir d’une légende texte sur un déploiement donné du modèle gpt-image-1

Paramètres d’URI

Nom Dans Obligatoire Catégorie Description
endpoint path Oui URL en chaîne Pris en charge Azure terminaux OpenAI (protocole et nom d’hôte, par exemple : https://aoairesource.openai.azure.com. Remplacez « aoairesource » par le nom de votre ressource Azure OpenAI). https://{your-resource-name}.openai.azure.com
id-de-déploiement path Oui string
version de l'API Requête Oui string

En-tête de requête

Utilisez soit une authentification basée sur un jeton, soit une clé API. L’authentification par jeton est recommandée et plus sécurisée.

Nom Obligatoire Catégorie Description
Authorization True string Exemple :Authorization: Bearer {Azure_OpenAI_Auth_Token}

Pour générer un jeton d’authentification en utilisant Azure CLI : az account get-access-token --resource https://cognitiveservices.azure.com

Type : oauth2
URL d’autorisation : https://login.microsoftonline.com/common/oauth2/v2.0/authorize
Portée : https://ai.azure.com/.default
clé API True string Fournissez ici la clé API Azure OpenAI

Corps de la requête

Content-Type : multipart/form-data

Nom Catégorie Description Obligatoire Par défaut
image chaîne ou tableau L’image à modifier. Il doit s’agir d’un fichier image pris en charge ou d’un tableau d’images. Chaque image doit être un fichier png ou jpg de moins de 50 Mo. Oui
input_fidelity string Contrôlez l’effort que le modèle fournira pour correspondre au style et aux caractéristiques, en particulier aux traits du visage, des images d’entrée. Ce paramètre n’est pris en charge que pour les modèles série gpt-image-1. Supports high et low. non low.
Masque string Une image supplémentaire dont les zones entièrement transparentes (par exemple, où alpha est zéro) indiquent où l’image doit être éditée. Si plusieurs images sont fournies, le masque sera appliqué sur la première image. Il doit s’agir d’un fichier PNG valide, de moins de 4 Mo, et avoir les mêmes dimensions que l’image. Non
n entier Le nombre d’images à générer. Ça doit être entre 1 et 10 ans. Non 1
prompt string Une description textuelle de l’image ou des images souhaitées. La longueur maximale est de 32 000 caractères. Oui
Qualité imageQuality La qualité de l’image qui sera générée. Non auto
images partielles Le nombre d’images partielles à générer. Ce paramètre est utilisé pour les réponses en flux qui retournent des images partielles. La valeur doit être comprise entre 0 et 3. Lorsqu’elle est réglée à 0, la réponse sera une seule image envoyée lors d’un événement de streaming. Notez que l’image finale peut être envoyée avant que le nombre complet d’images partielles ne soit généré si l’image complète est générée plus rapidement.
stream booléen Modifie l’image en mode streaming. non false
format_de_réponse imagesResponseFormat Le format dans lequel les images générées sont renvoyées. Non url
size imageSize La taille des images générées. Non auto
utilisateur string Un identifiant unique représentant votre utilisateur final, qui peut aider à surveiller et détecter les abus. Non

Responses

Code de statut : 200

Description : Ok

Type de contenu Type Description
application/json generateImagesResponse

Code de statut : par défaut

Description : Une erreur s’est produite.

Type de contenu Type Description
application/json dalleErrorResponse

Composants

Pour connaître les définitions de schéma utilisées par la conversation, les saisies semi-automatiques, les incorporations, les réponses et d’autres opérations de texte, consultez la référence de l’API REST OpenAI Azure. Les schémas suivants prennent en charge les opérations d’image et audio sur cette page.

innerErrorCode

Codes d’erreur pour l’objet d’erreur interne.

Propriété Valeur
Description Codes d’erreur pour l’objet d’erreur interne.
Type string
Valeurs ResponsibleAIPolicyViolation

dalleErrorResponse

Nom Catégorie Description Obligatoire Par défaut
erreur dalleError Non

dalleError

Nom Catégorie Description Obligatoire Par défaut
inner_error dalleInnerError Erreur intérieure avec des détails supplémentaires. Non
param string Non
type string Non

dalleInnerError

Erreur intérieure avec des détails supplémentaires.

Nom Catégorie Description Obligatoire Par défaut
code innerErrorCode Codes d’erreur pour l’objet d’erreur interne. Non
content_filter_results dalleFilterResults Informations sur la catégorie de filtrage de contenu (haine, sexuel, violence, self_harm), si elle a été détectée, ainsi que sur le niveau de gravité (very_low, faible, moyen, élevé qui détermine l’intensité et le niveau de risque du contenu nuisible) et si elle a été filtrée ou non. Informations sur le contenu jailbreak et les jurons, s’ils ont été détectés, et si ils ont été filtrés ou non. Et des informations sur la liste de blocage des clients, si elle a été filtrée et son identifiant. Non
revised_prompt string La demande utilisée pour générer l’image, s’il y avait une révision de la requête. Non

Résultat de la sévérité du filtre de contenu

Nom Catégorie Description Obligatoire Par défaut
filtered booléen Oui
severity string Non

contentFilterDetectedResult

Nom Catégorie Description Obligatoire Par défaut
détecté booléen Non
filtered booléen Oui

contentFilterDetailedResults

Le filtrage de contenu donne un détail des identifiants de filtre de contenu pour les segments filtrés.

Nom Catégorie Description Obligatoire Par défaut
details tableau Non
filtered booléen Oui

dalleFilterResults

Informations sur la catégorie de filtrage de contenu (haine, sexuel, violence, self_harm), si elle a été détectée, ainsi que sur le niveau de gravité (very_low, faible, moyen, élevé qui détermine l’intensité et le niveau de risque du contenu nuisible) et si elle a été filtrée ou non. Informations sur le contenu jailbreak et les jurons, s’ils ont été détectés, et si ils ont été filtrés ou non. Et des informations sur la liste de blocage des clients, si elle a été filtrée et son identifiant.

Nom Catégorie Description Obligatoire Par défaut
custom_blocklists contentFilterDetailedResults Le filtrage de contenu donne un détail des identifiants de filtre de contenu pour les segments filtrés. Non
Déteste résultatDeSévéritéDuFiltreDeContenu Non
jailbreak RésultatDeFiltreDeContenuDétecté Non
Blasphème RésultatDeFiltreDeContenuDétecté Non
self_harm résultatDeSévéritéDuFiltreDeContenu Non
Sexuelle résultatDeSévéritéDuFiltreDeContenu Non
violence résultatDeSévéritéDuFiltreDeContenu Non

audioResponseFormat

Définit le format de la sortie.

Propriété Valeur
Description Définit le format de la sortie.
Type string
Valeurs json
text
srt
verbose_json
vtt

imageQuality

La qualité de l’image qui sera générée.

Propriété Valeur
Description La qualité de l’image qui sera générée.
Type string
Par défaut auto
Valeurs auto
high
medium
low
hd
standard

imagesResponseFormat

Le format dans lequel les images générées sont renvoyées.

Propriété Valeur
Description Le format dans lequel les images générées sont renvoyées.
Type string
Par défaut url
Valeurs url
b64_json

imagesOutputFormat

Le format de fichier dans lequel les images générées sont renvoyées. Pris en charge uniquement pour les modèles de série.

Propriété Valeur
Description Le format de fichier dans lequel les images générées sont renvoyées. Pris en charge uniquement pour les modèles de la série GPT-image-1.
Type string
Par défaut png
Valeurs png
jpeg

taille de l’image

La taille des images générées.

Propriété Valeur
Description La taille des images générées.
Type string
Par défaut auto
Valeurs auto
1792x1024
1024x1792
1024x1024
1024x1536
1536x1024

imageStyle

Le style des images générées. Pris en charge uniquement pour DALL-E-3.

Propriété Valeur
Description Le style des images générées. Pris en charge uniquement pour DALL-E-3.
Type string
Par défaut vivid
Valeurs vivid
natural

imageBackground

Permet de définir la transparence pour l’arrière-plan de l’image ou des images générées. Ce paramètre n’est pris en charge que pour les modèles série gpt-image-1.

Propriété Valeur
Description Permet de définir la transparence pour l’arrière-plan de l’image ou des images générées. Ce paramètre n’est pris en charge que pour les modèles série gpt-image-1.
Type string
Par défaut auto
Valeurs transparent
opaque
auto

generateImagesResponse

Nom Catégorie Description Obligatoire Par défaut
créé entier L’horodatage Unix lors de la création de l’opération. Oui
Données tableau Les données de résultat de l’opération, si elles ont réussi Oui
utilisation imageGenerationsUsage Représente les détails d’utilisation des jetons pour les requêtes de génération d’images. Uniquement pour les modèles GPT-image-1. Non

imageGenerationsUsage

Représente les détails d’utilisation des jetons pour les requêtes de génération d’images. Uniquement pour les modèles GPT-image-1.

Nom Catégorie Description Obligatoire Par défaut
input_tokens entier Le nombre de jetons d’entrée. Non
input_tokens_details Objet Une analyse détaillée des jetons d’entrée. Non
└image_tokens entier Le nombre de jetons d’image. Non
└ text_tokens entier Le nombre de jetons textuels. Non
output_tokens entier Le nombre de jetons de sortie. Non
total_tokens entier Le nombre total de jetons utilisés. Non

Étapes suivantes

Découvrez les modèles et le réglage précis avec l’API REST. En savoir plus sur les modèles sous-jacents qui alimentent Azure OpenAI.