إشعار
يتطلب الوصول إلى هذه الصفحة تخويلاً. يمكنك محاولة تسجيل الدخول أو تغيير الدلائل.
يتطلب الوصول إلى هذه الصفحة تخويلاً. يمكنك محاولة تغيير الدلائل.
توثق هذه المقالة إنشاء الصور وعمليات واجهة برمجة تطبيقات REST لمستوى بيانات الصوت (الكلام) Azure OpenAI في 2025-04-01-preview الإصدار. لإكمال الدردشة والتضمينات والمساعدين والاستجابات ومخازن المتجهات وجميع العمليات الأخرى، راجع المرجع الرسمي Azure OpenAI REST API.
مواصفات واجهة برمجة التطبيقات
إدارة وتفاعل نماذج وموارد Azure OpenAI مقسمة عبر ثلاثة أسطح رئيسية لواجهات برمجة التطبيقات:
- وحدة التحكم
- مستوى البيانات - التأليف
- مستوى البيانات - الاستدلال
كل سطح/مواصفة API تحتوي على مجموعة مختلفة من قدرات Azure OpenAI. لكل واجهة برمجة تطبيقات مجموعة فريدة من إصدارات المعاينة والمستقرة/المتاحة عموما (GA). إصدارات المعاينات حاليا تميل إلى اتباع وتيرة شهرية.
مهم
هناك الآن واجهة برمجة تطبيقات جديدة للاستدلالات التمهيدية. تعرف على المزيد في دليل دورة حياة واجهة برمجة التطبيقات الخاصة بنا.
| API | أحدث إصدار معاينة | أحدث إصدار من GA | المواصفات | الوصف |
|---|---|---|---|---|
| وحدة التحكم | 2025-07-01-preview |
2025-06-01 |
ملفات المواصفات | تستخدم واجهة برمجة تطبيقات مستوى التحكم في العمليات مثل إنشاء الموارد، ونشر النماذج، وغيرها من مهام إدارة الموارد على مستوى أعلى. كما يتحكم مستوى التحكم في ما يمكن فعله بقدرات مثل Azure Resource Manager وBicep وTerraform وAzure CLI. |
| مستوى البيانات | v1 preview |
v1 |
ملفات المواصفات | تتحكم واجهة برمجة التطبيقات في مستوى البيانات في عمليات الاستدلال والتأليف. |
المصادقة
يوفر Azure OpenAI طريقتين للمصادقة. يمكنك استخدام مفاتيح API أو Microsoft Entra ID.
مصادقة مفتاح API: لهذا النوع من المصادقة، يجب أن تتضمن جميع طلبات API مفتاح API في
api-keyرأس HTTP. يوفر البدء السريع إرشادات حول كيفية إجراء المكالمات باستخدام هذا النوع من المصادقة.Microsoft Entra ID المصادقة: يمكنك التحقق من استدعاء واجهة برمجة التطبيقات باستخدام رمز Microsoft Entra. يتم تضمين رموز المصادقة في الطلب كرأس
Authorizationرئيسي. يجب أن يسبق الرمز المقدم بBearer، على سبيل المثالBearer YOUR_AUTH_TOKEN. يمكنك قراءة دليلنا التعليمي حول التحقق باستخدام Microsoft Entra ID.
إصدار REST API
يتم إصدار واجهات برمجة التطبيقات للخدمة باستخدام api-version معامل الاستعلام. جميع الإصدارات تتبع هيكل YYYY-MM-DD التاريخ. على سبيل المثال:
POST https://YOUR_RESOURCE_NAME.openai.azure.com/openai/deployments/YOUR_DEPLOYMENT_NAME/chat/completions?api-version=2024-06-01
استنتاج مستوى البيانات
تغطي بقية هذه المقالة عمليات الصور والصوت في إصدار المعاينة 2025-04-01-preview لمواصفات استدلال مستوى بيانات OpenAI Azure.
بالنسبة لعمليات صورة GA والصوت، راجع مرجع واجهة برمجة تطبيقات REST لصورة GA والصوت.
النسخ - إنشاء
POST https://{endpoint}/openai/deployments/{deployment-id}/audio/transcriptions?api-version=2025-04-01-preview
يقوم بنسخ الصوت إلى لغة الإدخال.
معلمات URI
| Name | In | مطلوبة | النوع | الوصف |
|---|---|---|---|---|
| نقطه النهايه | مسار | نعم | عنوان URL للسلسلة | دعم Azure نقاط نهاية OpenAI (البروتوكول واسم المضيف، على سبيل المثال: https://aoairesource.openai.azure.com. استبدل "aoairesource" باسم مورد Azure OpenAI الخاص بك). https://{your-resource-name}.openai.azure.com |
| معرف التوزيع | مسار | نعم | string | |
| إصدار API | استعلام | نعم | string |
رأس الطلب
استخدم إما المصادقة المعتمدة على الرموز أو مفتاح واجهة برمجة التطبيقات. يوصى بالمصادقة باستخدام المصادقة المعتمدة على الرموز وأكثر أمانا.
| Name | مطلوبة | النوع | الوصف |
|---|---|---|---|
| التصريح | صحيح | string |
المثال:Authorization: Bearer {Azure_OpenAI_Auth_Token}لإنشاء رمز مصادقة باستخدام Azure CLI: az account get-access-token --resource https://cognitiveservices.azure.comالنوع: oauth2 رابط التفويض: https://login.microsoftonline.com/common/oauth2/v2.0/authorizeالنطاق: https://ai.azure.com/.default |
| مفتاح واجهة برمجة التطبيقات | صحيح | string | قدم مفتاح API Azure OpenAI هنا |
هيئة الطلب
نوع المحتوى: متعدد الأجزاء/بيانات الشكل
| Name | النوع | الوصف | مطلوبة | افتراضي |
|---|---|---|---|---|
| النموذج | string | معرف النموذج الذي ستستخدمه. الخيارات هي gpt-4o-transcribe، gpt-4o-mini-transcribe، gpt-4o-mini-transcribe-2025-12-15، whisper-1و gpt-4o-transcribe-diarize. |
نعم | |
| ملف | string | ملف الصوت يجب نسخه. | نعم | |
| اللغة | string | لغة الصوت المدخل. توفير لغة الإدخال بصيغة ISO-639-1 يحسن الدقة وسرعة التأخير. | لا | |
| الموضوع | string | نص اختياري لتوجيه أسلوب النموذج أو استمرار مقطع صوتي سابق. يجب أن يتطابق الموضوع مع لغة الصوت. | لا | |
| response_format | تنسيق الاستجابة الصوتية | يحدد تنسيق المخرج. | لا | |
| درجة الحرارة | number | درجة حرارة العينة، بين 0 و1. القيم الأعلى مثل 0.8 ستجعل الناتج أكثر عشوائية، بينما القيم الأقل مثل 0.2 تجعله أكثر تركيزا وحتمية. إذا تم ضبطه على 0، يستخدم النموذج احتمال لوغاريتمية لزيادة درجة الحرارة تلقائيا حتى يتم الوصول إلى عتبات معينة. | لا | 1 |
| timestamp_granularities[] | مصفوفة | الطابع الزمني لملء التفاصيل لهذا النسخ.
response_format يجب ضبطه verbose_json لاستخدام تعدد الطابع الزمني. يدعم أحد هذين الخيارين أو كلاهما: word، أو segment. ملاحظة: لا يوجد زمن تأخير إضافي لطوابع المقاطع الزمنية (مقاطع الزمن)، لكن توليد طوابع زمنية للكلمات يسبب زمن تأخير إضافي. |
لا | ['segment'] |
Responses
رمز الحالة: 200
الوصف: موافق
| نوع المحتوى | نوع | الوصف |
|---|---|---|
| application/json | الهدف | |
| النص/البسيط | string | نسخ النص بصيغة الإخراج (عندما response_format أحد أو textvttsrt). |
الأمثلة
مثال
يحصل على النص المنقول والبيانات الوصفية المرتبطة به من بيانات الصوت المنطوقة المقدمة.
POST https://{endpoint}/openai/deployments/{deployment-id}/audio/transcriptions?api-version=2025-04-01-preview
الردود: رمز الحالة: 200
{
"body": {
"text": "A structured object when requesting json or verbose_json"
}
}
مثال
يحصل على النص المنقول والبيانات الوصفية المرتبطة به من بيانات الصوت المنطوقة المقدمة.
POST https://{endpoint}/openai/deployments/{deployment-id}/audio/transcriptions?api-version=2025-04-01-preview
"---multipart-boundary\nContent-Disposition: form-data; name=\"file\"; filename=\"file.wav\"\nContent-Type: application/octet-stream\n\nRIFF..audio.data.omitted\n---multipart-boundary--"
الردود: رمز الحالة: 200
{
"type": "string",
"example": "plain text when requesting text, srt, or vtt"
}
الترجمات - إنشاء
POST https://{endpoint}/openai/deployments/{deployment-id}/audio/translations?api-version=2025-04-01-preview
يقوم بنسخ وترجمة الصوت المدخل إلى النص الإنجليزي.
معلمات URI
| Name | In | مطلوبة | النوع | الوصف |
|---|---|---|---|---|
| نقطه النهايه | مسار | نعم | عنوان URL للسلسلة | دعم Azure نقاط نهاية OpenAI (البروتوكول واسم المضيف، على سبيل المثال: https://aoairesource.openai.azure.com. استبدل "aoairesource" باسم مورد Azure OpenAI الخاص بك). https://{your-resource-name}.openai.azure.com |
| معرف التوزيع | مسار | نعم | string | |
| إصدار API | استعلام | نعم | string |
رأس الطلب
استخدم إما المصادقة المعتمدة على الرموز أو مفتاح واجهة برمجة التطبيقات. يوصى بالمصادقة باستخدام المصادقة المعتمدة على الرموز وأكثر أمانا.
| Name | مطلوبة | النوع | الوصف |
|---|---|---|---|
| التصريح | صحيح | string |
المثال:Authorization: Bearer {Azure_OpenAI_Auth_Token}لإنشاء رمز مصادقة باستخدام Azure CLI: az account get-access-token --resource https://cognitiveservices.azure.comالنوع: oauth2 رابط التفويض: https://login.microsoftonline.com/common/oauth2/v2.0/authorizeالنطاق: https://ai.azure.com/.default |
| مفتاح واجهة برمجة التطبيقات | صحيح | string | قدم مفتاح API Azure OpenAI هنا |
هيئة الطلب
نوع المحتوى: متعدد الأجزاء/بيانات الشكل
| Name | النوع | الوصف | مطلوبة | افتراضي |
|---|---|---|---|---|
| ملف | string | ملف الصوت للترجمة. | نعم | |
| الموضوع | string | نص اختياري لتوجيه أسلوب النموذج أو استمرار مقطع صوتي سابق. يجب أن يكون الموضوع باللغة الإنجليزية. | لا | |
| response_format | تنسيق الاستجابة الصوتية | يحدد تنسيق المخرج. | لا | |
| درجة الحرارة | number | درجة حرارة العينة، بين 0 و1. القيم الأعلى مثل 0.8 ستجعل الناتج أكثر عشوائية، بينما القيم الأقل مثل 0.2 تجعله أكثر تركيزا وحتمية. إذا تم ضبطه على 0، يستخدم النموذج احتمال لوغاريتمية لزيادة درجة الحرارة تلقائيا حتى يتم الوصول إلى عتبات معينة. | لا | 1 |
Responses
رمز الحالة: 200
الوصف: موافق
| نوع المحتوى | نوع | الوصف |
|---|---|---|
| application/json | الهدف | |
| النص/البسيط | string | كان النص المنسوخ بصيغة الإخراج (عندما response_format نصا أو vtt أو srt). |
الأمثلة
مثال
يحصل على النص المنسوخ باللغة الإنجليزية والبيانات الوصفية المرتبطة به من بيانات الصوت المنطوقة المقدمة.
POST https://{endpoint}/openai/deployments/{deployment-id}/audio/translations?api-version=2025-04-01-preview
"---multipart-boundary\nContent-Disposition: form-data; name=\"file\"; filename=\"file.wav\"\nContent-Type: application/octet-stream\n\nRIFF..audio.data.omitted\n---multipart-boundary--"
الردود: رمز الحالة: 200
{
"body": {
"text": "A structured object when requesting json or verbose_json"
}
}
مثال
يحصل على النص المنسوخ باللغة الإنجليزية والبيانات الوصفية المرتبطة به من بيانات الصوت المنطوقة المقدمة.
POST https://{endpoint}/openai/deployments/{deployment-id}/audio/translations?api-version=2025-04-01-preview
"---multipart-boundary\nContent-Disposition: form-data; name=\"file\"; filename=\"file.wav\"\nContent-Type: application/octet-stream\n\nRIFF..audio.data.omitted\n---multipart-boundary--"
الردود: رمز الحالة: 200
{
"type": "string",
"example": "plain text when requesting text, srt, or vtt"
}
الخطاب - الإبداع
POST https://{endpoint}/openai/deployments/{deployment-id}/audio/speech?api-version=2025-04-01-preview
يولد الصوت من النص المدخل.
معلمات URI
| Name | In | مطلوبة | النوع | الوصف |
|---|---|---|---|---|
| نقطه النهايه | مسار | نعم | عنوان URL للسلسلة | دعم Azure نقاط نهاية OpenAI (البروتوكول واسم المضيف، على سبيل المثال: https://aoairesource.openai.azure.com. استبدل "aoairesource" باسم مورد Azure OpenAI الخاص بك). https://{your-resource-name}.openai.azure.com |
| معرف التوزيع | مسار | نعم | string | |
| إصدار API | استعلام | نعم | string |
رأس الطلب
استخدم إما المصادقة المعتمدة على الرموز أو مفتاح واجهة برمجة التطبيقات. يوصى بالمصادقة باستخدام المصادقة المعتمدة على الرموز وأكثر أمانا.
| Name | مطلوبة | النوع | الوصف |
|---|---|---|---|
| التصريح | صحيح | string |
المثال:Authorization: Bearer {Azure_OpenAI_Auth_Token}لإنشاء رمز مصادقة باستخدام Azure CLI: az account get-access-token --resource https://cognitiveservices.azure.comالنوع: oauth2 رابط التفويض: https://login.microsoftonline.com/common/oauth2/v2.0/authorizeالنطاق: https://ai.azure.com/.default |
| مفتاح واجهة برمجة التطبيقات | صحيح | string | قدم مفتاح API Azure OpenAI هنا |
هيئة الطلب
نوع المحتوى: متعدد الأجزاء/بيانات الشكل
| Name | النوع | الوصف | مطلوبة | افتراضي |
|---|---|---|---|---|
| المدخلات | string | النص الذي يجب توليف الصوت من أجله. الطول الأقصى هو 4,096 حرفا. | نعم | |
| response_format | enum | الصيغة التي تستخدم لتوليف الصوت. القيم الممكنة: mp3، opus، aac، flac، wavpcm |
لا | |
| السرعة | number | سرعة الصوت المركب (synthice). اختر قيمة من 0.25 إلى 4.0.
1.0 هو الافتراضي. |
لا | 1.0 |
| الصوت | enum | الصوت المستخدم في توليف الكلام. القيم الممكنة: alloy، echo، fable، onyx، novashimmer |
نعم |
Responses
رمز الحالة: 200
الوصف: موافق
| نوع المحتوى | نوع | الوصف |
|---|---|---|
| application/octet-stream | string |
الأمثلة
مثال
يقوم بتوليد الصوت من النص المقدم.
POST https://{endpoint}/openai/deployments/{deployment-id}/audio/speech?api-version=2025-04-01-preview
{
"input": "Hi! What are you going to make?",
"voice": "fable",
"response_format": "mp3"
}
الردود: رمز الحالة: 200
{
"body": "101010101"
}
توليد الصور - إنشاء
POST https://{endpoint}/openai/deployments/{deployment-id}/images/generations?api-version=2025-04-01-preview
يولد دفعة من الصور من تعليق نصي على نشر نموذج إنشاء صورة معين
معلمات URI
| Name | In | مطلوبة | النوع | الوصف |
|---|---|---|---|---|
| نقطه النهايه | مسار | نعم | عنوان URL للسلسلة | دعم Azure نقاط نهاية OpenAI (البروتوكول واسم المضيف، على سبيل المثال: https://aoairesource.openai.azure.com. استبدل "aoairesource" باسم مورد Azure OpenAI الخاص بك). https://{your-resource-name}.openai.azure.com |
| معرف التوزيع | مسار | نعم | string | |
| إصدار API | استعلام | نعم | string |
رأس الطلب
استخدم إما المصادقة المعتمدة على الرموز أو مفتاح واجهة برمجة التطبيقات. يوصى بالمصادقة باستخدام المصادقة المعتمدة على الرموز وأكثر أمانا.
| Name | مطلوبة | النوع | الوصف |
|---|---|---|---|
| التصريح | صحيح | string |
المثال:Authorization: Bearer {Azure_OpenAI_Auth_Token}لإنشاء رمز مصادقة باستخدام Azure CLI: az account get-access-token --resource https://cognitiveservices.azure.comالنوع: oauth2 رابط التفويض: https://login.microsoftonline.com/common/oauth2/v2.0/authorizeالنطاق: https://ai.azure.com/.default |
| مفتاح واجهة برمجة التطبيقات | صحيح | string | قدم مفتاح API Azure OpenAI هنا |
هيئة الطلب
نوع المحتوى: application/json
| Name | النوع | الوصف | مطلوبة | افتراضي |
|---|---|---|---|---|
| الخلفية | الصورة الخلفية | يسمح بتعيين الشفافية لخلفية الصور المولدة. هذا المعامل مدعوم فقط لنماذج سلسلة gpt-image-1. | لا | أوتو |
| n | integer | عدد الصور التي يجب إنشاؤها. بالنسبة ل dall-e-3، يدعم فقط n=1. | لا | 1 |
| output_compression | integer | مستوى الضغط (0-100%) للصور المولدة. يدعم هذا المعامل فقط لنماذج سلسلة gpt-image-1 التي تستخدم صيغة إخراج jpeg. | لا | 100 |
| output_format | imagesOutputFormat | تنسيق الملف الذي تعاد به الصور المولدة. مدعوم فقط لنماذج سلسلة gpt-image-1. | لا | png |
| الموضوع | string | وصف نصي للصورة أو الصور المطلوبة. الحد الأقصى للطول هو 32000 حرف لسلسلة gpt-image-1 و4000 حرف لسلسلة dall-e-3 | نعم | |
| partial_images | integer | عدد الصور الجزئية التي يجب توليدها. يستخدم هذا المعامل للاستجابات المتدفقة التي تعيد صورا جزئية. يجب أن تكون القيمة بين 0 و3. عند ضبطها على 0، سيكون الرد صورة واحدة ترسل في حدث بث واحد. لاحظ أنه يمكن إرسال الصورة النهائية قبل توليد العدد الكامل من الصور الجزئية إذا تم توليد الصورة الكاملة بشكل أسرع. | 1 | |
| تدفق | boolean | قم بتحرير الصورة في وضع البث. | لا | false |
| الجودة | imageQuality | جودة الصورة التي سيتم إنشاؤها. | لا | أوتو |
| response_format | imagesResponseFormat | الصيغة التي تعاد بها الصور المولدة. هذا المعامل غير مدعوم لنماذج gpt-image-1السلسلة التي ستعيد دائما الصور المشفرة بنظام base64.القيم الممكنة: url, b64_json. |
لا | عنوان URL |
| الحجم | حجم الصورة | حجم الصور المولدة. | لا | أوتو |
| الأسلوب | imageStyle | أسلوب الصور المولدة. مدعوم فقط ل dall-e-3. | لا | حيه |
| المستخدم | string | معرف فريد يمثل المستخدم النهائي، يمكن أن يساعد في مراقبة واكتشاف سوء الاستخدام. | لا |
Responses
رمز الحالة: 200
الوصف: موافق
| نوع المحتوى | نوع | الوصف |
|---|---|---|
| application/json | إنشاءImagesResponse |
رمز الحالة: افتراضي
الوصف: حدث خطأ.
| نوع المحتوى | نوع | الوصف |
|---|---|---|
| application/json | داليErrorResponse |
الأمثلة
مثال
ينشئ صورا مع توجيه.
POST https://{endpoint}/openai/deployments/{deployment-id}/images/generations?api-version=2025-04-01-preview
{
"prompt": "In the style of WordArt, Microsoft Clippy wearing a cowboy hat.",
"n": 1,
"style": "natural",
"quality": "standard"
}
الردود: رمز الحالة: 200
{
"body": {
"created": 1698342300,
"data": [
{
"revised_prompt": "A vivid, natural representation of Microsoft Clippy wearing a cowboy hat.",
"prompt_filter_results": {
"sexual": {
"severity": "safe",
"filtered": false
},
"violence": {
"severity": "safe",
"filtered": false
},
"hate": {
"severity": "safe",
"filtered": false
},
"self_harm": {
"severity": "safe",
"filtered": false
},
"profanity": {
"detected": false,
"filtered": false
},
"custom_blocklists": {
"filtered": false,
"details": []
}
},
"url": "https://dalletipusw2.blob.core.windows.net/private/images/e5451cc6-b1ad-4747-bd46-b89a3a3b8bc3/generated_00.png?se=2023-10-27T17%3A45%3A09Z&...",
"content_filter_results": {
"sexual": {
"severity": "safe",
"filtered": false
},
"violence": {
"severity": "safe",
"filtered": false
},
"hate": {
"severity": "safe",
"filtered": false
},
"self_harm": {
"severity": "safe",
"filtered": false
}
}
}
]
}
}
توليد الصور - تحرير
POST https://{endpoint}/openai/deployments/{deployment-id}/images/edits?api-version=2025-04-01-preview
تحرير صورة من تعليق نصي على نشر نموذج gpt-image-1
معلمات URI
| Name | In | مطلوبة | النوع | الوصف |
|---|---|---|---|---|
| نقطه النهايه | مسار | نعم | عنوان URL للسلسلة | دعم Azure نقاط نهاية OpenAI (البروتوكول واسم المضيف، على سبيل المثال: https://aoairesource.openai.azure.com. استبدل "aoairesource" باسم مورد Azure OpenAI الخاص بك). https://{your-resource-name}.openai.azure.com |
| معرف التوزيع | مسار | نعم | string | |
| إصدار API | استعلام | نعم | string |
رأس الطلب
استخدم إما المصادقة المعتمدة على الرموز أو مفتاح واجهة برمجة التطبيقات. يوصى بالمصادقة باستخدام المصادقة المعتمدة على الرموز وأكثر أمانا.
| Name | مطلوبة | النوع | الوصف |
|---|---|---|---|
| التصريح | صحيح | string |
المثال:Authorization: Bearer {Azure_OpenAI_Auth_Token}لإنشاء رمز مصادقة باستخدام Azure CLI: az account get-access-token --resource https://cognitiveservices.azure.comالنوع: oauth2 رابط التفويض: https://login.microsoftonline.com/common/oauth2/v2.0/authorizeالنطاق: https://ai.azure.com/.default |
| مفتاح واجهة برمجة التطبيقات | صحيح | string | قدم مفتاح API Azure OpenAI هنا |
هيئة الطلب
نوع المحتوى: متعدد الأجزاء/بيانات الشكل
| Name | النوع | الوصف | مطلوبة | افتراضي |
|---|---|---|---|---|
| صورة | السلسلة أو المصفوفة | الصورة (أو الصور) التي يجب تعديلها. يجب أن يكون ملف صورة مدعوم أو مصفوفة من الصور. يجب أن تكون كل صورة ملف png أو ملف jpg أقل من 50 ميجابايت. | نعم | |
| input_fidelity | string | تحكم في مقدار الجهد الذي سيبذله النموذج لمطابقة أسلوب وملامح، خاصة ملامح الوجه، في صور الإدخال. هذا المعامل مدعوم فقط لنماذج سلسلة gpt-image-1. الدعم high و low. |
لا |
low. |
| قناع | string | صورة إضافية تكون مناطقها الشفافة بالكامل (مثل حيث الألفا صفرا) تشير إلى مكان تحرير الصورة. إذا تم توفير عدة صور، سيتم تطبيق القناع على الصورة الأولى. يجب أن يكون ملف PNG صالح، أقل من 4 ميجابايت، وله نفس أبعاد الصورة. | لا | |
| n | integer | عدد الصور التي يجب إنشاؤها. يجب أن تكون بين 1 و10. | لا | 1 |
| الموضوع | string | وصف نصي للصورة أو الصور المطلوبة. الحد الأقصى للطول هو 32000 حرف. | نعم | |
| الجودة | imageQuality | جودة الصورة التي سيتم إنشاؤها. | لا | أوتو |
| partial_images | عدد الصور الجزئية التي يجب توليدها. يستخدم هذا المعامل للاستجابات المتدفقة التي تعيد صورا جزئية. يجب أن تكون القيمة بين 0 و3. عند ضبطها على 0، سيكون الرد صورة واحدة ترسل في حدث بث واحد. لاحظ أنه يمكن إرسال الصورة النهائية قبل توليد العدد الكامل من الصور الجزئية إذا تم توليد الصورة الكاملة بشكل أسرع. | |||
| تدفق | boolean | قم بتحرير الصورة في وضع البث. | لا | false |
| response_format | imagesResponseFormat | الصيغة التي تعاد بها الصور المولدة. | لا | عنوان URL |
| الحجم | حجم الصورة | حجم الصور المولدة. | لا | أوتو |
| المستخدم | string | معرف فريد يمثل المستخدم النهائي، يمكن أن يساعد في مراقبة واكتشاف سوء الاستخدام. | لا |
Responses
رمز الحالة: 200
الوصف: موافق
| نوع المحتوى | نوع | الوصف |
|---|---|---|
| application/json | إنشاءImagesResponse |
رمز الحالة: افتراضي
الوصف: حدث خطأ.
| نوع المحتوى | نوع | الوصف |
|---|---|---|
| application/json | داليErrorResponse |
المكونات
للحصول على تعريفات المخطط المستخدمة بواسطة الدردشة والإكمال والتضمينات والاستجابات والعمليات النصية الأخرى، راجع مرجع واجهة برمجة تطبيقات REST Azure OpenAI. تدعم المخططات التالية عمليات الصور والصوت في هذه الصفحة.
innerErrorCode
رموز الخطأ لكائن الخطأ الداخلي.
| الملكية | قيمة |
|---|---|
| الوصف | رموز الخطأ لكائن الخطأ الداخلي. |
| نوع | string |
| القيم | ResponsibleAIPolicyViolation |
داليErrorResponse
| Name | النوع | الوصف | مطلوبة | افتراضي |
|---|---|---|---|---|
| خطأ | داليError | لا |
داليError
| Name | النوع | الوصف | مطلوبة | افتراضي |
|---|---|---|---|---|
| inner_error | dalleInnerError | خطأ داخلي مع تفاصيل إضافية. | لا | |
| برام | string | لا | ||
| النوع | string | لا |
dalleInnerError
خطأ داخلي مع تفاصيل إضافية.
| Name | النوع | الوصف | مطلوبة | افتراضي |
|---|---|---|---|---|
| الرمز | innerErrorCode | رموز الخطأ لكائن الخطأ الداخلي. | لا | |
| content_filter_results | dalleFilterResults | معلومات عن فئة تصفية المحتوى (الكراهية، الجنس، العنف، self_harm)، وإذا تم اكتشافها، بالإضافة إلى مستوى الشدة (very_low، منخفض، متوسط، عالي النطاق الذي يحدد شدة ومستوى خطر المحتوى الضار) وما إذا تم تصفيته أم لا. معلومات عن محتوى الجيلبريك والألفاظ النابية، وإذا تم اكتشافه، وإذا تم تصفيتها أم لا. ومعلومات عن قائمة حظر العملاء، إذا تم تصفيتها ومعرفها. | لا | |
| revised_prompt | string | المحفز الذي استخدم لإنشاء الصورة، إذا كان هناك أي تعديل على الطلب. | لا |
contentFilterSeverityResult
| Name | النوع | الوصف | مطلوبة | افتراضي |
|---|---|---|---|---|
| مفلتر | boolean | نعم | ||
| الشدة | string | لا |
contentFilterDetectedResult
| Name | النوع | الوصف | مطلوبة | افتراضي |
|---|---|---|---|---|
| تم اكتشافه | boolean | لا | ||
| مفلتر | boolean | نعم |
contentFilterDetailedResults
نتائج تصفية المحتوى مع تفاصيل معرفات تصفية المحتوى للأجزاء المفلترة.
| Name | النوع | الوصف | مطلوبة | افتراضي |
|---|---|---|---|---|
| التفاصيل | مصفوفة | لا | ||
| مفلتر | boolean | نعم |
dalleFilterResults
معلومات عن فئة تصفية المحتوى (الكراهية، الجنس، العنف، self_harm)، وإذا تم اكتشافها، بالإضافة إلى مستوى الشدة (very_low، منخفض، متوسط، عالي النطاق الذي يحدد شدة ومستوى خطر المحتوى الضار) وما إذا تم تصفيته أم لا. معلومات عن محتوى الجيلبريك والألفاظ النابية، وإذا تم اكتشافه، وإذا تم تصفيتها أم لا. ومعلومات عن قائمة حظر العملاء، إذا تم تصفيتها ومعرفها.
| Name | النوع | الوصف | مطلوبة | افتراضي |
|---|---|---|---|---|
| custom_blocklists | contentFilterDetailedResults | نتائج تصفية المحتوى مع تفاصيل معرفات تصفية المحتوى للأجزاء المفلترة. | لا | |
| الكراهية | contentFilterSeverityResult | لا | ||
| الهروب من السجن | contentFilterDetectedResult | لا | ||
| الألفاظ النابية | contentFilterDetectedResult | لا | ||
| self_harm | contentFilterSeverityResult | لا | ||
| الجنس | contentFilterSeverityResult | لا | ||
| العنف | contentFilterSeverityResult | لا |
تنسيق الاستجابة الصوتية
يحدد تنسيق المخرج.
| الملكية | قيمة |
|---|---|
| الوصف | يحدد تنسيق المخرج. |
| نوع | string |
| القيم | jsontextsrtverbose_jsonvtt |
imageQuality
جودة الصورة التي سيتم إنشاؤها.
| الملكية | قيمة |
|---|---|
| الوصف | جودة الصورة التي سيتم إنشاؤها. |
| نوع | string |
| الافتراضي | أوتو |
| القيم | autohighmediumlowhdstandard |
imagesResponseFormat
الصيغة التي تعاد بها الصور المولدة.
| الملكية | قيمة |
|---|---|
| الوصف | الصيغة التي تعاد بها الصور المولدة. |
| نوع | string |
| الافتراضي | عنوان URL |
| القيم | urlb64_json |
imagesOutputFormat
تنسيق الملف الذي تعاد به الصور المولدة. مدعوم فقط لنماذج السلسلة.
| الملكية | قيمة |
|---|---|
| الوصف | تنسيق الملف الذي تعاد به الصور المولدة. مدعوم فقط لنماذج سلسلة gpt-image-1. |
| نوع | string |
| الافتراضي | png |
| القيم | pngjpeg |
حجم الصورة
حجم الصور المولدة.
| الملكية | قيمة |
|---|---|
| الوصف | حجم الصور المولدة. |
| نوع | string |
| الافتراضي | أوتو |
| القيم | auto1792x10241024x17921024x10241024x15361536x1024 |
imageStyle
أسلوب الصور المولدة. مدعوم فقط ل dall-e-3.
| الملكية | قيمة |
|---|---|
| الوصف | أسلوب الصور المولدة. مدعوم فقط ل dall-e-3. |
| نوع | string |
| الافتراضي | حيه |
| القيم | vividnatural |
الصورة الخلفية
يسمح بتعيين الشفافية لخلفية الصورة أو الصور المولدة. هذا المعامل مدعوم فقط لنماذج سلسلة gpt-image-1.
| الملكية | قيمة |
|---|---|
| الوصف | يسمح بتعيين الشفافية لخلفية الصورة أو الصور المولدة. هذا المعامل مدعوم فقط لنماذج سلسلة gpt-image-1. |
| نوع | string |
| الافتراضي | أوتو |
| القيم | transparentopaqueauto |
إنشاءImagesResponse
| Name | النوع | الوصف | مطلوبة | افتراضي |
|---|---|---|---|---|
| تم إنشاؤه | integer | طابع يونكس الزمني عند إنشاء العملية. | نعم | |
| البيانات | مصفوفة | بيانات نتيجة العملية، إذا نجحت | نعم | |
| الاستخدام | استخدام إنشاء الصور | يمثل تفاصيل استخدام الرموز لطلبات توليد الصور. فقط لنماذج سلسلة gpt-image-1. | لا |
استخدام إنشاء الصور
يمثل تفاصيل استخدام الرموز لطلبات توليد الصور. فقط لنماذج سلسلة gpt-image-1.
| Name | النوع | الوصف | مطلوبة | افتراضي |
|---|---|---|---|---|
| input_tokens | integer | عدد رموز الإدخال. | لا | |
| input_tokens_details | الهدف | تفصيل مفصل لرموز الإدخال. | لا | |
| └─ image_tokens | integer | عدد رموز الصور. | لا | |
| └─ text_tokens | integer | عدد رموز النص. | لا | |
| output_tokens | integer | عدد رموز الإخراج. | لا | |
| total_tokens | integer | إجمالي عدد الرموز المستخدمة. | لا |
الخطوات التالية
تعرف على النماذج والضبط الدقيق مع واجهة برمجة تطبيقات REST. تعرف أكثر على النماذج الأساسية التي تشغل Azure OpenAI.