Azure مرجع واجهة برمجة تطبيقات REST للصورة والصوت OpenAI (2025-04-01-preview)

توثق هذه المقالة إنشاء الصور وعمليات واجهة برمجة تطبيقات REST لمستوى بيانات الصوت (الكلام) Azure OpenAI في 2025-04-01-preview الإصدار. لإكمال الدردشة والتضمينات والمساعدين والاستجابات ومخازن المتجهات وجميع العمليات الأخرى، راجع المرجع الرسمي Azure OpenAI REST API.

مواصفات واجهة برمجة التطبيقات

إدارة وتفاعل نماذج وموارد Azure OpenAI مقسمة عبر ثلاثة أسطح رئيسية لواجهات برمجة التطبيقات:

  • وحدة التحكم
  • مستوى البيانات - التأليف
  • مستوى البيانات - الاستدلال

كل سطح/مواصفة API تحتوي على مجموعة مختلفة من قدرات Azure OpenAI. لكل واجهة برمجة تطبيقات مجموعة فريدة من إصدارات المعاينة والمستقرة/المتاحة عموما (GA). إصدارات المعاينات حاليا تميل إلى اتباع وتيرة شهرية.

مهم

هناك الآن واجهة برمجة تطبيقات جديدة للاستدلالات التمهيدية. تعرف على المزيد في دليل دورة حياة واجهة برمجة التطبيقات الخاصة بنا.

API أحدث إصدار معاينة أحدث إصدار من GA المواصفات الوصف
وحدة التحكم 2025-07-01-preview 2025-06-01 ملفات المواصفات تستخدم واجهة برمجة تطبيقات مستوى التحكم في العمليات مثل إنشاء الموارد، ونشر النماذج، وغيرها من مهام إدارة الموارد على مستوى أعلى. كما يتحكم مستوى التحكم في ما يمكن فعله بقدرات مثل Azure Resource Manager وBicep وTerraform وAzure CLI.
مستوى البيانات v1 preview v1 ملفات المواصفات تتحكم واجهة برمجة التطبيقات في مستوى البيانات في عمليات الاستدلال والتأليف.

المصادقة

يوفر Azure OpenAI طريقتين للمصادقة. يمكنك استخدام مفاتيح API أو Microsoft Entra ID.

  • مصادقة مفتاح API: لهذا النوع من المصادقة، يجب أن تتضمن جميع طلبات API مفتاح API في api-key رأس HTTP. يوفر البدء السريع إرشادات حول كيفية إجراء المكالمات باستخدام هذا النوع من المصادقة.

  • Microsoft Entra ID المصادقة: يمكنك التحقق من استدعاء واجهة برمجة التطبيقات باستخدام رمز Microsoft Entra. يتم تضمين رموز المصادقة في الطلب كرأس Authorization رئيسي. يجب أن يسبق الرمز المقدم ب Bearer، على سبيل المثال Bearer YOUR_AUTH_TOKEN. يمكنك قراءة دليلنا التعليمي حول التحقق باستخدام Microsoft Entra ID.

إصدار REST API

يتم إصدار واجهات برمجة التطبيقات للخدمة باستخدام api-version معامل الاستعلام. جميع الإصدارات تتبع هيكل YYYY-MM-DD التاريخ. على سبيل المثال:

POST https://YOUR_RESOURCE_NAME.openai.azure.com/openai/deployments/YOUR_DEPLOYMENT_NAME/chat/completions?api-version=2024-06-01

استنتاج مستوى البيانات

تغطي بقية هذه المقالة عمليات الصور والصوت في إصدار المعاينة 2025-04-01-preview لمواصفات استدلال مستوى بيانات OpenAI Azure.

بالنسبة لعمليات صورة GA والصوت، راجع مرجع واجهة برمجة تطبيقات REST لصورة GA والصوت.

النسخ - إنشاء

POST https://{endpoint}/openai/deployments/{deployment-id}/audio/transcriptions?api-version=2025-04-01-preview

يقوم بنسخ الصوت إلى لغة الإدخال.

معلمات URI

Name In مطلوبة النوع الوصف
نقطه النهايه مسار ‏‏نعم‬ عنوان URL للسلسلة دعم Azure نقاط نهاية OpenAI (البروتوكول واسم المضيف، على سبيل المثال: https://aoairesource.openai.azure.com. استبدل "aoairesource" باسم مورد Azure OpenAI الخاص بك). https://{your-resource-name}.openai.azure.com
معرف التوزيع مسار ‏‏نعم‬ string
إصدار API استعلام ‏‏نعم‬ string

رأس الطلب

استخدم إما المصادقة المعتمدة على الرموز أو مفتاح واجهة برمجة التطبيقات. يوصى بالمصادقة باستخدام المصادقة المعتمدة على الرموز وأكثر أمانا.

Name مطلوبة النوع الوصف
التصريح صحيح string المثال:Authorization: Bearer {Azure_OpenAI_Auth_Token}

لإنشاء رمز مصادقة باستخدام Azure CLI: az account get-access-token --resource https://cognitiveservices.azure.com

النوع: oauth2
رابط التفويض: https://login.microsoftonline.com/common/oauth2/v2.0/authorize
النطاق: https://ai.azure.com/.default
مفتاح واجهة برمجة التطبيقات صحيح string قدم مفتاح API Azure OpenAI هنا

هيئة الطلب

نوع المحتوى: متعدد الأجزاء/بيانات الشكل

Name النوع الوصف مطلوبة افتراضي
النموذج string معرف النموذج الذي ستستخدمه. الخيارات هي gpt-4o-transcribe، gpt-4o-mini-transcribe، gpt-4o-mini-transcribe-2025-12-15، whisper-1و gpt-4o-transcribe-diarize. ‏‏نعم‬
ملف string ملف الصوت يجب نسخه. ‏‏نعم‬
اللغة string لغة الصوت المدخل. توفير لغة الإدخال بصيغة ISO-639-1 يحسن الدقة وسرعة التأخير. لا
الموضوع string نص اختياري لتوجيه أسلوب النموذج أو استمرار مقطع صوتي سابق. يجب أن يتطابق الموضوع مع لغة الصوت. لا
response_format تنسيق الاستجابة الصوتية يحدد تنسيق المخرج. لا
درجة الحرارة number درجة حرارة العينة، بين 0 و1. القيم الأعلى مثل 0.8 ستجعل الناتج أكثر عشوائية، بينما القيم الأقل مثل 0.2 تجعله أكثر تركيزا وحتمية. إذا تم ضبطه على 0، يستخدم النموذج احتمال لوغاريتمية لزيادة درجة الحرارة تلقائيا حتى يتم الوصول إلى عتبات معينة. لا 1
timestamp_granularities[] مصفوفة الطابع الزمني لملء التفاصيل لهذا النسخ. response_format يجب ضبطه verbose_json لاستخدام تعدد الطابع الزمني. يدعم أحد هذين الخيارين أو كلاهما: word، أو segment. ملاحظة: لا يوجد زمن تأخير إضافي لطوابع المقاطع الزمنية (مقاطع الزمن)، لكن توليد طوابع زمنية للكلمات يسبب زمن تأخير إضافي. لا ['segment']

Responses

رمز الحالة: 200

الوصف: موافق

نوع المحتوى نوع الوصف
application/json الهدف
النص/البسيط string نسخ النص بصيغة الإخراج (عندما response_format أحد أو textvttsrt).

الأمثلة

مثال

يحصل على النص المنقول والبيانات الوصفية المرتبطة به من بيانات الصوت المنطوقة المقدمة.

POST https://{endpoint}/openai/deployments/{deployment-id}/audio/transcriptions?api-version=2025-04-01-preview

الردود: رمز الحالة: 200

{
  "body": {
    "text": "A structured object when requesting json or verbose_json"
  }
}

مثال

يحصل على النص المنقول والبيانات الوصفية المرتبطة به من بيانات الصوت المنطوقة المقدمة.

POST https://{endpoint}/openai/deployments/{deployment-id}/audio/transcriptions?api-version=2025-04-01-preview

"---multipart-boundary\nContent-Disposition: form-data; name=\"file\"; filename=\"file.wav\"\nContent-Type: application/octet-stream\n\nRIFF..audio.data.omitted\n---multipart-boundary--"

الردود: رمز الحالة: 200

{
  "type": "string",
  "example": "plain text when requesting text, srt, or vtt"
}

الترجمات - إنشاء

POST https://{endpoint}/openai/deployments/{deployment-id}/audio/translations?api-version=2025-04-01-preview

يقوم بنسخ وترجمة الصوت المدخل إلى النص الإنجليزي.

معلمات URI

Name In مطلوبة النوع الوصف
نقطه النهايه مسار ‏‏نعم‬ عنوان URL للسلسلة دعم Azure نقاط نهاية OpenAI (البروتوكول واسم المضيف، على سبيل المثال: https://aoairesource.openai.azure.com. استبدل "aoairesource" باسم مورد Azure OpenAI الخاص بك). https://{your-resource-name}.openai.azure.com
معرف التوزيع مسار ‏‏نعم‬ string
إصدار API استعلام ‏‏نعم‬ string

رأس الطلب

استخدم إما المصادقة المعتمدة على الرموز أو مفتاح واجهة برمجة التطبيقات. يوصى بالمصادقة باستخدام المصادقة المعتمدة على الرموز وأكثر أمانا.

Name مطلوبة النوع الوصف
التصريح صحيح string المثال:Authorization: Bearer {Azure_OpenAI_Auth_Token}

لإنشاء رمز مصادقة باستخدام Azure CLI: az account get-access-token --resource https://cognitiveservices.azure.com

النوع: oauth2
رابط التفويض: https://login.microsoftonline.com/common/oauth2/v2.0/authorize
النطاق: https://ai.azure.com/.default
مفتاح واجهة برمجة التطبيقات صحيح string قدم مفتاح API Azure OpenAI هنا

هيئة الطلب

نوع المحتوى: متعدد الأجزاء/بيانات الشكل

Name النوع الوصف مطلوبة افتراضي
ملف string ملف الصوت للترجمة. ‏‏نعم‬
الموضوع string نص اختياري لتوجيه أسلوب النموذج أو استمرار مقطع صوتي سابق. يجب أن يكون الموضوع باللغة الإنجليزية. لا
response_format تنسيق الاستجابة الصوتية يحدد تنسيق المخرج. لا
درجة الحرارة number درجة حرارة العينة، بين 0 و1. القيم الأعلى مثل 0.8 ستجعل الناتج أكثر عشوائية، بينما القيم الأقل مثل 0.2 تجعله أكثر تركيزا وحتمية. إذا تم ضبطه على 0، يستخدم النموذج احتمال لوغاريتمية لزيادة درجة الحرارة تلقائيا حتى يتم الوصول إلى عتبات معينة. لا 1

Responses

رمز الحالة: 200

الوصف: موافق

نوع المحتوى نوع الوصف
application/json الهدف
النص/البسيط string كان النص المنسوخ بصيغة الإخراج (عندما response_format نصا أو vtt أو srt).

الأمثلة

مثال

يحصل على النص المنسوخ باللغة الإنجليزية والبيانات الوصفية المرتبطة به من بيانات الصوت المنطوقة المقدمة.

POST https://{endpoint}/openai/deployments/{deployment-id}/audio/translations?api-version=2025-04-01-preview

"---multipart-boundary\nContent-Disposition: form-data; name=\"file\"; filename=\"file.wav\"\nContent-Type: application/octet-stream\n\nRIFF..audio.data.omitted\n---multipart-boundary--"

الردود: رمز الحالة: 200

{
  "body": {
    "text": "A structured object when requesting json or verbose_json"
  }
}

مثال

يحصل على النص المنسوخ باللغة الإنجليزية والبيانات الوصفية المرتبطة به من بيانات الصوت المنطوقة المقدمة.

POST https://{endpoint}/openai/deployments/{deployment-id}/audio/translations?api-version=2025-04-01-preview

"---multipart-boundary\nContent-Disposition: form-data; name=\"file\"; filename=\"file.wav\"\nContent-Type: application/octet-stream\n\nRIFF..audio.data.omitted\n---multipart-boundary--"

الردود: رمز الحالة: 200

{
  "type": "string",
  "example": "plain text when requesting text, srt, or vtt"
}

الخطاب - الإبداع

POST https://{endpoint}/openai/deployments/{deployment-id}/audio/speech?api-version=2025-04-01-preview

يولد الصوت من النص المدخل.

معلمات URI

Name In مطلوبة النوع الوصف
نقطه النهايه مسار ‏‏نعم‬ عنوان URL للسلسلة دعم Azure نقاط نهاية OpenAI (البروتوكول واسم المضيف، على سبيل المثال: https://aoairesource.openai.azure.com. استبدل "aoairesource" باسم مورد Azure OpenAI الخاص بك). https://{your-resource-name}.openai.azure.com
معرف التوزيع مسار ‏‏نعم‬ string
إصدار API استعلام ‏‏نعم‬ string

رأس الطلب

استخدم إما المصادقة المعتمدة على الرموز أو مفتاح واجهة برمجة التطبيقات. يوصى بالمصادقة باستخدام المصادقة المعتمدة على الرموز وأكثر أمانا.

Name مطلوبة النوع الوصف
التصريح صحيح string المثال:Authorization: Bearer {Azure_OpenAI_Auth_Token}

لإنشاء رمز مصادقة باستخدام Azure CLI: az account get-access-token --resource https://cognitiveservices.azure.com

النوع: oauth2
رابط التفويض: https://login.microsoftonline.com/common/oauth2/v2.0/authorize
النطاق: https://ai.azure.com/.default
مفتاح واجهة برمجة التطبيقات صحيح string قدم مفتاح API Azure OpenAI هنا

هيئة الطلب

نوع المحتوى: متعدد الأجزاء/بيانات الشكل

Name النوع الوصف مطلوبة افتراضي
المدخلات string النص الذي يجب توليف الصوت من أجله. الطول الأقصى هو 4,096 حرفا. ‏‏نعم‬
response_format enum الصيغة التي تستخدم لتوليف الصوت.
القيم الممكنة: mp3، opus، aac، flac، wavpcm
لا
السرعة number سرعة الصوت المركب (synthice). اختر قيمة من 0.25 إلى 4.0. 1.0 هو الافتراضي. لا 1.0
الصوت enum الصوت المستخدم في توليف الكلام.
القيم الممكنة: alloy، echo، fable، onyx، novashimmer
‏‏نعم‬

Responses

رمز الحالة: 200

الوصف: موافق

نوع المحتوى نوع الوصف
application/octet-stream string

الأمثلة

مثال

يقوم بتوليد الصوت من النص المقدم.

POST https://{endpoint}/openai/deployments/{deployment-id}/audio/speech?api-version=2025-04-01-preview

{
 "input": "Hi! What are you going to make?",
 "voice": "fable",
 "response_format": "mp3"
}

الردود: رمز الحالة: 200

{
  "body": "101010101"
}

توليد الصور - إنشاء

POST https://{endpoint}/openai/deployments/{deployment-id}/images/generations?api-version=2025-04-01-preview

يولد دفعة من الصور من تعليق نصي على نشر نموذج إنشاء صورة معين

معلمات URI

Name In مطلوبة النوع الوصف
نقطه النهايه مسار ‏‏نعم‬ عنوان URL للسلسلة دعم Azure نقاط نهاية OpenAI (البروتوكول واسم المضيف، على سبيل المثال: https://aoairesource.openai.azure.com. استبدل "aoairesource" باسم مورد Azure OpenAI الخاص بك). https://{your-resource-name}.openai.azure.com
معرف التوزيع مسار ‏‏نعم‬ string
إصدار API استعلام ‏‏نعم‬ string

رأس الطلب

استخدم إما المصادقة المعتمدة على الرموز أو مفتاح واجهة برمجة التطبيقات. يوصى بالمصادقة باستخدام المصادقة المعتمدة على الرموز وأكثر أمانا.

Name مطلوبة النوع الوصف
التصريح صحيح string المثال:Authorization: Bearer {Azure_OpenAI_Auth_Token}

لإنشاء رمز مصادقة باستخدام Azure CLI: az account get-access-token --resource https://cognitiveservices.azure.com

النوع: oauth2
رابط التفويض: https://login.microsoftonline.com/common/oauth2/v2.0/authorize
النطاق: https://ai.azure.com/.default
مفتاح واجهة برمجة التطبيقات صحيح string قدم مفتاح API Azure OpenAI هنا

هيئة الطلب

نوع المحتوى: application/json

Name النوع الوصف مطلوبة افتراضي
الخلفية الصورة الخلفية يسمح بتعيين الشفافية لخلفية الصور المولدة. هذا المعامل مدعوم فقط لنماذج سلسلة gpt-image-1. لا أوتو
n integer عدد الصور التي يجب إنشاؤها. بالنسبة ل dall-e-3، يدعم فقط n=1. لا 1
output_compression integer مستوى الضغط (0-100%) للصور المولدة. يدعم هذا المعامل فقط لنماذج سلسلة gpt-image-1 التي تستخدم صيغة إخراج jpeg. لا 100
output_format imagesOutputFormat تنسيق الملف الذي تعاد به الصور المولدة. مدعوم فقط لنماذج سلسلة gpt-image-1. لا png
الموضوع string وصف نصي للصورة أو الصور المطلوبة. الحد الأقصى للطول هو 32000 حرف لسلسلة gpt-image-1 و4000 حرف لسلسلة dall-e-3 ‏‏نعم‬
partial_images integer عدد الصور الجزئية التي يجب توليدها. يستخدم هذا المعامل للاستجابات المتدفقة التي تعيد صورا جزئية. يجب أن تكون القيمة بين 0 و3. عند ضبطها على 0، سيكون الرد صورة واحدة ترسل في حدث بث واحد. لاحظ أنه يمكن إرسال الصورة النهائية قبل توليد العدد الكامل من الصور الجزئية إذا تم توليد الصورة الكاملة بشكل أسرع. 1
تدفق boolean قم بتحرير الصورة في وضع البث. لا false
الجودة imageQuality جودة الصورة التي سيتم إنشاؤها. لا أوتو
response_format imagesResponseFormat الصيغة التي تعاد بها الصور المولدة. هذا المعامل غير مدعوم لنماذج gpt-image-1السلسلة التي ستعيد دائما الصور المشفرة بنظام base64.
القيم الممكنة: url, b64_json.
لا عنوان URL
الحجم حجم الصورة حجم الصور المولدة. لا أوتو
الأسلوب imageStyle أسلوب الصور المولدة. مدعوم فقط ل dall-e-3. لا حيه
المستخدم string معرف فريد يمثل المستخدم النهائي، يمكن أن يساعد في مراقبة واكتشاف سوء الاستخدام. لا

Responses

رمز الحالة: 200

الوصف: موافق

نوع المحتوى نوع الوصف
application/json إنشاءImagesResponse

رمز الحالة: افتراضي

الوصف: حدث خطأ.

نوع المحتوى نوع الوصف
application/json داليErrorResponse

الأمثلة

مثال

ينشئ صورا مع توجيه.

POST https://{endpoint}/openai/deployments/{deployment-id}/images/generations?api-version=2025-04-01-preview

{
 "prompt": "In the style of WordArt, Microsoft Clippy wearing a cowboy hat.",
 "n": 1,
 "style": "natural",
 "quality": "standard"
}

الردود: رمز الحالة: 200

{
  "body": {
    "created": 1698342300,
    "data": [
      {
        "revised_prompt": "A vivid, natural representation of Microsoft Clippy wearing a cowboy hat.",
        "prompt_filter_results": {
          "sexual": {
            "severity": "safe",
            "filtered": false
          },
          "violence": {
            "severity": "safe",
            "filtered": false
          },
          "hate": {
            "severity": "safe",
            "filtered": false
          },
          "self_harm": {
            "severity": "safe",
            "filtered": false
          },
          "profanity": {
            "detected": false,
            "filtered": false
          },
          "custom_blocklists": {
            "filtered": false,
            "details": []
          }
        },
        "url": "https://dalletipusw2.blob.core.windows.net/private/images/e5451cc6-b1ad-4747-bd46-b89a3a3b8bc3/generated_00.png?se=2023-10-27T17%3A45%3A09Z&...",
        "content_filter_results": {
          "sexual": {
            "severity": "safe",
            "filtered": false
          },
          "violence": {
            "severity": "safe",
            "filtered": false
          },
          "hate": {
            "severity": "safe",
            "filtered": false
          },
          "self_harm": {
            "severity": "safe",
            "filtered": false
          }
        }
      }
    ]
  }
}

توليد الصور - تحرير

POST https://{endpoint}/openai/deployments/{deployment-id}/images/edits?api-version=2025-04-01-preview

تحرير صورة من تعليق نصي على نشر نموذج gpt-image-1

معلمات URI

Name In مطلوبة النوع الوصف
نقطه النهايه مسار ‏‏نعم‬ عنوان URL للسلسلة دعم Azure نقاط نهاية OpenAI (البروتوكول واسم المضيف، على سبيل المثال: https://aoairesource.openai.azure.com. استبدل "aoairesource" باسم مورد Azure OpenAI الخاص بك). https://{your-resource-name}.openai.azure.com
معرف التوزيع مسار ‏‏نعم‬ string
إصدار API استعلام ‏‏نعم‬ string

رأس الطلب

استخدم إما المصادقة المعتمدة على الرموز أو مفتاح واجهة برمجة التطبيقات. يوصى بالمصادقة باستخدام المصادقة المعتمدة على الرموز وأكثر أمانا.

Name مطلوبة النوع الوصف
التصريح صحيح string المثال:Authorization: Bearer {Azure_OpenAI_Auth_Token}

لإنشاء رمز مصادقة باستخدام Azure CLI: az account get-access-token --resource https://cognitiveservices.azure.com

النوع: oauth2
رابط التفويض: https://login.microsoftonline.com/common/oauth2/v2.0/authorize
النطاق: https://ai.azure.com/.default
مفتاح واجهة برمجة التطبيقات صحيح string قدم مفتاح API Azure OpenAI هنا

هيئة الطلب

نوع المحتوى: متعدد الأجزاء/بيانات الشكل

Name النوع الوصف مطلوبة افتراضي
صورة السلسلة أو المصفوفة الصورة (أو الصور) التي يجب تعديلها. يجب أن يكون ملف صورة مدعوم أو مصفوفة من الصور. يجب أن تكون كل صورة ملف png أو ملف jpg أقل من 50 ميجابايت. ‏‏نعم‬
input_fidelity string تحكم في مقدار الجهد الذي سيبذله النموذج لمطابقة أسلوب وملامح، خاصة ملامح الوجه، في صور الإدخال. هذا المعامل مدعوم فقط لنماذج سلسلة gpt-image-1. الدعم high و low. لا low.
قناع string صورة إضافية تكون مناطقها الشفافة بالكامل (مثل حيث الألفا صفرا) تشير إلى مكان تحرير الصورة. إذا تم توفير عدة صور، سيتم تطبيق القناع على الصورة الأولى. يجب أن يكون ملف PNG صالح، أقل من 4 ميجابايت، وله نفس أبعاد الصورة. لا
n integer عدد الصور التي يجب إنشاؤها. يجب أن تكون بين 1 و10. لا 1
الموضوع string وصف نصي للصورة أو الصور المطلوبة. الحد الأقصى للطول هو 32000 حرف. ‏‏نعم‬
الجودة imageQuality جودة الصورة التي سيتم إنشاؤها. لا أوتو
partial_images عدد الصور الجزئية التي يجب توليدها. يستخدم هذا المعامل للاستجابات المتدفقة التي تعيد صورا جزئية. يجب أن تكون القيمة بين 0 و3. عند ضبطها على 0، سيكون الرد صورة واحدة ترسل في حدث بث واحد. لاحظ أنه يمكن إرسال الصورة النهائية قبل توليد العدد الكامل من الصور الجزئية إذا تم توليد الصورة الكاملة بشكل أسرع.
تدفق boolean قم بتحرير الصورة في وضع البث. لا false
response_format imagesResponseFormat الصيغة التي تعاد بها الصور المولدة. لا عنوان URL
الحجم حجم الصورة حجم الصور المولدة. لا أوتو
المستخدم string معرف فريد يمثل المستخدم النهائي، يمكن أن يساعد في مراقبة واكتشاف سوء الاستخدام. لا

Responses

رمز الحالة: 200

الوصف: موافق

نوع المحتوى نوع الوصف
application/json إنشاءImagesResponse

رمز الحالة: افتراضي

الوصف: حدث خطأ.

نوع المحتوى نوع الوصف
application/json داليErrorResponse

المكونات

للحصول على تعريفات المخطط المستخدمة بواسطة الدردشة والإكمال والتضمينات والاستجابات والعمليات النصية الأخرى، راجع مرجع واجهة برمجة تطبيقات REST Azure OpenAI. تدعم المخططات التالية عمليات الصور والصوت في هذه الصفحة.

innerErrorCode

رموز الخطأ لكائن الخطأ الداخلي.

الملكية قيمة
الوصف رموز الخطأ لكائن الخطأ الداخلي.
نوع string
القيم ResponsibleAIPolicyViolation

داليErrorResponse

Name النوع الوصف مطلوبة افتراضي
خطأ داليError لا

داليError

Name النوع الوصف مطلوبة افتراضي
inner_error dalleInnerError خطأ داخلي مع تفاصيل إضافية. لا
برام string لا
النوع string لا

dalleInnerError

خطأ داخلي مع تفاصيل إضافية.

Name النوع الوصف مطلوبة افتراضي
الرمز innerErrorCode رموز الخطأ لكائن الخطأ الداخلي. لا
content_filter_results dalleFilterResults معلومات عن فئة تصفية المحتوى (الكراهية، الجنس، العنف، self_harm)، وإذا تم اكتشافها، بالإضافة إلى مستوى الشدة (very_low، منخفض، متوسط، عالي النطاق الذي يحدد شدة ومستوى خطر المحتوى الضار) وما إذا تم تصفيته أم لا. معلومات عن محتوى الجيلبريك والألفاظ النابية، وإذا تم اكتشافه، وإذا تم تصفيتها أم لا. ومعلومات عن قائمة حظر العملاء، إذا تم تصفيتها ومعرفها. لا
revised_prompt string المحفز الذي استخدم لإنشاء الصورة، إذا كان هناك أي تعديل على الطلب. لا

contentFilterSeverityResult

Name النوع الوصف مطلوبة افتراضي
مفلتر boolean ‏‏نعم‬
الشدة string لا

contentFilterDetectedResult

Name النوع الوصف مطلوبة افتراضي
تم اكتشافه boolean لا
مفلتر boolean ‏‏نعم‬

contentFilterDetailedResults

نتائج تصفية المحتوى مع تفاصيل معرفات تصفية المحتوى للأجزاء المفلترة.

Name النوع الوصف مطلوبة افتراضي
التفاصيل مصفوفة لا
مفلتر boolean ‏‏نعم‬

dalleFilterResults

معلومات عن فئة تصفية المحتوى (الكراهية، الجنس، العنف، self_harm)، وإذا تم اكتشافها، بالإضافة إلى مستوى الشدة (very_low، منخفض، متوسط، عالي النطاق الذي يحدد شدة ومستوى خطر المحتوى الضار) وما إذا تم تصفيته أم لا. معلومات عن محتوى الجيلبريك والألفاظ النابية، وإذا تم اكتشافه، وإذا تم تصفيتها أم لا. ومعلومات عن قائمة حظر العملاء، إذا تم تصفيتها ومعرفها.

Name النوع الوصف مطلوبة افتراضي
custom_blocklists contentFilterDetailedResults نتائج تصفية المحتوى مع تفاصيل معرفات تصفية المحتوى للأجزاء المفلترة. لا
الكراهية contentFilterSeverityResult لا
الهروب من السجن contentFilterDetectedResult لا
الألفاظ النابية contentFilterDetectedResult لا
self_harm contentFilterSeverityResult لا
الجنس contentFilterSeverityResult لا
العنف contentFilterSeverityResult لا

تنسيق الاستجابة الصوتية

يحدد تنسيق المخرج.

الملكية قيمة
الوصف يحدد تنسيق المخرج.
نوع string
القيم json
text
srt
verbose_json
vtt

imageQuality

جودة الصورة التي سيتم إنشاؤها.

الملكية قيمة
الوصف جودة الصورة التي سيتم إنشاؤها.
نوع string
الافتراضي أوتو
القيم auto
high
medium
low
hd
standard

imagesResponseFormat

الصيغة التي تعاد بها الصور المولدة.

الملكية قيمة
الوصف الصيغة التي تعاد بها الصور المولدة.
نوع string
الافتراضي عنوان URL
القيم url
b64_json

imagesOutputFormat

تنسيق الملف الذي تعاد به الصور المولدة. مدعوم فقط لنماذج السلسلة.

الملكية قيمة
الوصف تنسيق الملف الذي تعاد به الصور المولدة. مدعوم فقط لنماذج سلسلة gpt-image-1.
نوع string
الافتراضي png
القيم png
jpeg

حجم الصورة

حجم الصور المولدة.

الملكية قيمة
الوصف حجم الصور المولدة.
نوع string
الافتراضي أوتو
القيم auto
1792x1024
1024x1792
1024x1024
1024x1536
1536x1024

imageStyle

أسلوب الصور المولدة. مدعوم فقط ل dall-e-3.

الملكية قيمة
الوصف أسلوب الصور المولدة. مدعوم فقط ل dall-e-3.
نوع string
الافتراضي حيه
القيم vivid
natural

الصورة الخلفية

يسمح بتعيين الشفافية لخلفية الصورة أو الصور المولدة. هذا المعامل مدعوم فقط لنماذج سلسلة gpt-image-1.

الملكية قيمة
الوصف يسمح بتعيين الشفافية لخلفية الصورة أو الصور المولدة. هذا المعامل مدعوم فقط لنماذج سلسلة gpt-image-1.
نوع string
الافتراضي أوتو
القيم transparent
opaque
auto

إنشاءImagesResponse

Name النوع الوصف مطلوبة افتراضي
تم إنشاؤه integer طابع يونكس الزمني عند إنشاء العملية. ‏‏نعم‬
البيانات مصفوفة بيانات نتيجة العملية، إذا نجحت ‏‏نعم‬
الاستخدام استخدام إنشاء الصور يمثل تفاصيل استخدام الرموز لطلبات توليد الصور. فقط لنماذج سلسلة gpt-image-1. لا

استخدام إنشاء الصور

يمثل تفاصيل استخدام الرموز لطلبات توليد الصور. فقط لنماذج سلسلة gpt-image-1.

Name النوع الوصف مطلوبة افتراضي
input_tokens integer عدد رموز الإدخال. لا
input_tokens_details الهدف تفصيل مفصل لرموز الإدخال. لا
└─ image_tokens integer عدد رموز الصور. لا
└─ text_tokens integer عدد رموز النص. لا
output_tokens integer عدد رموز الإخراج. لا
total_tokens integer إجمالي عدد الرموز المستخدمة. لا

الخطوات التالية

تعرف على النماذج والضبط الدقيق مع واجهة برمجة تطبيقات REST. تعرف أكثر على النماذج الأساسية التي تشغل Azure OpenAI.