Catatan
Akses ke halaman ini memerlukan otorisasi. Anda dapat mencoba masuk atau mengubah direktori.
Akses ke halaman ini memerlukan otorisasi. Anda dapat mencoba mengubah direktori.
Hanya berlaku untuk:Portal Foundry (versi klasik). Artikel ini tidak tersedia untuk portal Foundry baru.
Pelajari selengkapnya tentang portal baru.
Catatan
Tautan dalam artikel ini mungkin membuka konten dalam dokumentasi Microsoft Foundry baru alih-alih dokumentasi Foundry (klasik) yang Anda lihat sekarang.
Artikel ini menyediakan ringkasan rilis terbaru dan pembaruan dokumentasi utama untuk Azure OpenAI.
Mei 2026
Artikel konsep GPT Realtime 2.0
Artikel konsep baru menjelaskan kemampuan dan konsep utama untuk model realtime terbaru:
- Ikhtisar GPT Realtime 2.0 (pratinjau) — mencakup dukungan penalaran, fase respons (pembukaan dan jawaban akhir), serta kepatuhan yang lebih ketat terhadap instruksi.
GPT Realtime Translate dan GPT Realtime Whisper
Artikel konsep baru menjelaskan kemampuan dan kasus penggunaan untuk model terjemahan dan transkripsi real-time terbaru:
- GPT Realtime Translate — mencakup terjemahan audio berbasis aliran berkelanjutan untuk acara multibahasa langsung, dukungan pelanggan, dan asisten suara.
- GPT Realtime Whisper — mencakup transkripsi streaming latensi rendah untuk keterangan langsung, pemantauan, dan alur kerja arsip.
Februari 2026
Model GPT-Realtime-1.5 dan GPT-Audio-1.5 dirilis
Model gpt-realtime-1.5 dan gpt-audio-1.5 sekarang tersedia.
- Model-model ini dibangun berdasarkan GPT-Realtime dan GPT-Audio tahun lalu dengan peningkatan dalam mengikuti instruksi, dukungan multibahasa, dan panggilan alat, sambil mempertahankan latensi rendah, interaksi secara real-time yang dibutuhkan pengembang untuk aplikasi voice-first.
- Cobalah dengan API penyelesaian obrolan yang ada di Microsoft Foundry.
Desember 2025
Model GPT-image-1.5 sekarang tersedia
GPT-image-1.5 adalah model pembuatan gambar mutakhir terbaru OpenAI. Fitur ini menampilkan peningkatan performa, kualitas, kontrol pengeditan, dan pelestarian wajah. Dalam mode pengeditan, model mendukung input_fidelity tinggi dan menambahkan atau menghapus satu aspek dari citra masukan sambil mempertahankan aspek lainnya.
Meminta akses: aplikasi model akses terbatas
Kemampuan model utama:
- Mencakup semua kemampuan GPT-image-1:
- Pembuatan teks ke gambar
- Pembuatan gambar ke gambar (pengeditan)
- Pencatatan
- Generasi gambar berkualitas tinggi, hingga 1024x1536 dan 1536x1024 piksel
- Pelestarian wajah
Ikuti panduan cara pembuatan gambar untuk memulai model ini.
Pembaruan model pengenalan ucapan otomatis (ASR)
gpt-4o-mini-transcribe-2025-12-15
- Peningkatan akurasi transkripsi dan ketahanan untuk skenario real time, dengan sekitar 50% tingkat kesalahan kata yang lebih rendah (WER) daripada model sebelumnya
gpt-4o-transcribe-minipada tolok ukur bahasa Inggris. - Meningkatkan performa multibahasa pada bahasa Jepang, bahasa-bahasa di India, dan bahasa-bahasa lainnya.
- Mengurangi halusinasi pada keheningan hingga 4×, menjadikannya pilihan yang lebih dapat diandalkan untuk lingkungan yang bising dan aliran audio dunia nyata.
- Input tetap audio, dengan teks sebagai output, dan implementasi hanya API.
Pembaruan model realtime-mini (penerjemahan ucapan ke ucapan)
gpt-realtime-mini-2025-12-15
- Paritas fitur dengan model gpt-realtime penuh dalam mengikuti instruksi dan melakukan pemanggilan fungsi.
- Input dan output berupa audio, dan penggunaan hanya melalui API.
Pembaruan model teks ke ucapan
gpt-4o-mini-tts-2025-12-15
- Menetapkan tolok ukur baru untuk sintesis ucapan multibahasa.
- Menghasilkan ucapan yang lebih alami dan seperti manusia dengan lebih sedikit artefak dan peningkatan kesamaan pembicara.
- Input adalah teks, output adalah audio, dan penerapan hanya melalui API.
Oktober 2025
Dukungan API realtime untuk SIP
Realtime API sekarang mendukung SIP, memungkinkan koneksi telepon ke realtimeapi. Untuk informasi selengkapnya, lihat dokumentasi Realtime SIP.
Model GPT-4o untuk audio telah dirilis
- Model
gpt-4o-transcribe-diarizeucapan ke teks dirilis. Model ini adalah model Pengenalan Ucapan Otomatis (ASR) yang mengonversi bahasa lisan menjadi teks secara real time. Ini memungkinkan organisasi untuk membuka wawasan dari percakapan secara instan dengan latensi sangat rendah dan akurasi tinggi di 100+ bahasa. Kemampuan ini sangat penting untuk alur kerja di mana data suara mendorong keputusan—seperti dukungan pelanggan, rapat virtual, dan acara langsung.
Diarisasi adalah proses mengidentifikasi siapa yang berbicara ketika berada dalam aliran audio. Ini mengubah percakapan menjadi transkrip yang diatribusikan pembicara, memungkinkan bisnis mengekstrak wawasan yang dapat ditindak lanjuti dari rapat, panggilan pelanggan, dan acara langsung. Dengan model tingkat lanjut seperti gpt-4o-transcribe-diarize, organisasi mendapatkan kejelasan dan konteks real-time—mengubah suara menjadi data terstruktur yang mendorong keputusan yang lebih cerdas dan meningkatkan produktivitas, mendukung pengenalan ucapan otomatis.
Gunakan model ini melalui /audio API dan /realtime .
GPT-image-1-mini
Model gpt-image-1-mini ini sekarang tersedia untuk penyebaran global. Ini adalah versi gpt-image-1 model yang lebih kecil yang menawarkan keseimbangan yang baik antara performa dan biaya. Semua kasus penggunaan saat ini didukung, kecuali untuk pengeditan gambar dan keakuratan input.
Meminta akses: Aplikasi model akses terbatas
Ikuti panduan cara pembuatan gambar untuk memulai model ini.
Filter deteksi konten PII
Deteksi informasi pengidentifikasi pribadi (PII) sekarang tersedia sebagai filter konten bawaan. Fitur ini memungkinkan Anda mengidentifikasi dan memblokir informasi sensitif dalam output LLM, meningkatkan privasi data. Untuk informasi selengkapnya, lihat dokumentasi deteksi PII .
September 2025
GPT-5-codex sekarang tersedia
Untuk mempelajari selengkapnya tentang
gpt-5-codex, lihat halaman memulai model penalaran.gpt-5-codexdirancang untuk digunakan dengan CLI Codex dan ekstensi Codex Visual Studio Code.Pendaftaran diperlukan untuk akses ke model gpt-5-codex. Jika sebelumnya Anda telah mendaftar dan mendapatkan akses ke model akses terbatas lainnya seperti
gpt-5, Anda tidak perlu menerapkan kembali dan akan secara otomatis diberikan akses.
Dukungan video-ke-video Sora
Model Sora dari OpenAI sekarang mendukung pembuatan video ke video. Anda dapat menyediakan video singkat sebagai input untuk menghasilkan video baru yang lebih panjang yang menggabungkan video input. Lihat panduan cepat untuk memulai.
Agustus 2025
Dukungan gambar-ke-video Sora
Model Sora dari OpenAI sekarang mendukung pembuatan gambar ke video. Anda dapat memberikan gambar sebagai input ke model untuk menghasilkan video yang menggabungkan konten gambar. Anda juga dapat menentukan bingkai video tempat gambar akan muncul: tidak perlu menjadi awal. Lihat panduan cepat untuk memulai.
Model Sora ini sekarang tersedia di wilayah Swedia Tengah dan US Timur 2.
Model audio API waktu nyata GA
Model GPT RealTime dan Audio OpenAI sekarang tersedia secara umum dalam Microsoft Foundry Models.
Peningkatan model:
- Peningkatan dalam mengikuti instruksi: Dengan kemampuan yang lebih baik untuk menyesuaikan nada, kecepatan, dan mengikuti instruksi eskalasi secara lebih akurat dan andal. Juga dapat beralih bahasa.
- Suara standar baru, Marin dan Cedar, yang membawa peningkatan kealamian dan kejelasan pada sintesis ucapan.
- Kualitas audio yang ditingkatkan: Output bebas glitch, reproduksi alfanumerik yang ditingkatkan, dan kontrol modalitas.
Peningkatan layanan API realtime:
- Input Gambar: Tambahkan dan diskusikan gambar melalui suara tanpa persyaratan video.
- Pemanggilan fungsi yang ditingkatkan: Kemampuan yang ditingkatkan untuk memanggil kode kustom yang ditentukan oleh pengembang. Panggilan fungsi asinkron didukung, memungkinkan sesi untuk melanjutkan saat panggilan fungsi tertunda.
- Mode Percakapan: Perilaku pengambilan giliran dunia nyata untuk interaksi alami. Mode percakapan menggunakan VAD (Voice Activity Detection) untuk memberi petunjuk kepada pengguna jika tidak ada tanggapan yang terdeteksi, meningkatkan kegunaan dunia nyata untuk interaksi mirip telepon.
Kami sangat menyarankan agar semua pelanggan beralih ke model GA yang baru diluncurkan untuk memanfaatkan sepenuhnya fitur terbaru. Kunjungi dokumentasi Azure OpenAI dan portal Microsoft Foundry untuk menjelajahi kemampuan dan berintegrasi ke dalam aplikasi Anda.
Ketersediaan Umum spillover yang disediakan (GA)
Spillover sekarang Tersedia Secara Umum. Spillover mengelola fluktuasi lalu lintas pada penyebaran yang disediakan dengan merutekan kelebihan penggunaan ke penyebaran standar yang ditunjuk. Untuk mempelajari selengkapnya tentang cara memaksimalkan penggunaan untuk penyebaran yang telah disediakan dengan spillover, lihat Mengelola lalu lintas dengan spillover untuk penyebaran yang telah disediakan.
Model GPT-5 tersedia
gpt-5,gpt-5-mini,gpt-5-nanoUntuk mempelajari lebih lanjut, lihat halaman memulai model penalaran.gpt-5-chatsekarang tersedia. Untuk mempelajari selengkapnya, lihat halaman modelgpt-5sekarang tersedia untuk Unit Throughput yang Disediakan (PTU).gpt-5-mini,gpt-5-nano, dangpt-5-chattidak memerlukan pendaftaran.
Model-router versi baru
Router model sekarang mendukung model seri GPT-5.
Router model untuk Microsoft Foundry adalah model obrolan AI yang dapat disebarkan yang secara otomatis memilih model obrolan terbaik yang mendasar untuk menanggapi permintaan tertentu. Untuk informasi selengkapnya tentang cara kerja router model dan kelebihan dan batasannya, lihat Panduan konsep router model. Untuk menggunakan router model dengan Completions API, ikuti Panduan Cara Menggunakan.
Juli 2025
Pembaruan GPT-image-1 (pratinjau)
Parameter keakuratan input:
input_fidelityParameter dalam API pengeditan gambar memungkinkan Anda mengontrol seberapa dekat model menyampaikan gaya dan fitur subjek dalam gambar asli (input). Ini berguna untuk:- Mengedit foto sambil mempertahankan fitur wajah; membuat avatar yang terlihat seperti orang asli di berbagai gaya; menggabungkan wajah dari beberapa orang ke dalam satu gambar.
- Mempertahankan identitas merek dalam gambar yang dihasilkan untuk aset pemasaran, mockup, fotografi produk.
- E-niaga dan mode, di mana Anda perlu mengedit gambar pakaian atau detail produk tanpa mengorbankan realisme.
Streaming gambar parsial: API pembuatan gambar dan pengeditan gambar mendukung streaming gambar parsial, di mana mereka mengembalikan gambar dengan konten yang dirender sebagian sepanjang proses pembuatan gambar. Tampilkan gambar-gambar ini kepada pengguna untuk memberikan umpan balik visual sebelumnya dan menunjukkan kemajuan operasi pembuatan gambar.
Juni 2025
Model baru codex-mini & o3-pro dirilis
-
codex-minidano3-prosekarang tersedia. Untuk mempelajari selengkapnya, lihat halaman memulai model penalaran
Mei 2025
Pembuatan video Sora dirilis (pratinjau)
Model Sora (2025-05-02) adalah model pembuatan video dari OpenAI yang dapat menciptakan adegan video yang realistis dan imajinatif dari instruksi teks.
Ikuti Panduan Cepat Pembuatan Video untuk memulai. Untuk informasi selengkapnya, lihat Panduan konsep pembuatan video .
Penyorotan di perisai pengingat (pratinjau)
Spotlighting adalah sub-fitur dari perisai prompt yang meningkatkan perlindungan terhadap serangan tidak langsung (serangan dokumen tertanam) dengan menandai dokumen masukan menggunakan pemformatan khusus yang menunjukkan tingkat kepercayaan lebih rendah pada model. Untuk informasi selengkapnya, lihat dokumentasi filter Perisai prompt .
Router model (pratinjau)
Router model untuk Microsoft Foundry adalah model obrolan AI yang dapat disebarkan yang secara otomatis memilih model obrolan terbaik yang mendasar untuk menanggapi permintaan tertentu. Untuk informasi selengkapnya tentang cara kerja router model dan kelebihan dan batasannya, lihat Panduan konsep router model. Untuk menggunakan router model dengan Completions API, ikuti Panduan Cara Menggunakan.
April 2025
Dukungan API waktu nyata (pratinjau) untuk WebRTC
Realtime API (pratinjau) sekarang mendukung WebRTC, memungkinkan streaming audio real time dan interaksi latensi rendah. Fitur ini sangat ideal untuk aplikasi yang membutuhkan umpan balik langsung, seperti dukungan pelanggan langsung atau asisten suara interaktif. Untuk informasi selengkapnya, lihat dokumentasi Realtime API (pratinjau).
GPT-image-1 dirilis (pratinjau, akses terbatas)
GPT-image-1 (2025-04-15) adalah model pembuatan gambar terbaru dari Azure OpenAI. Ini menampilkan peningkatan besar atas DALL-E, termasuk:
- Lebih baik menanggapi instruksi yang tepat.
- Menampilkan teks dengan andal.
- Menerima gambar sebagai input, yang memungkinkan kemampuan baru pengeditan dan pemasukan gambar.
Meminta akses: Aplikasi model akses terbatas
Ikuti panduan cara pembuatan gambar untuk memulai model baru.
Model o4-mini dan o3 dirilis
o4-mini dan o3 model sekarang tersedia. Model-model ini adalah model penalaran terbaru dari Azure OpenAI yang menawarkan penalaran, kualitas, dan performa yang ditingkatkan. Untuk informasi selengkapnya, lihat halaman memulai model penalaran.
GPT-4.1 dirilis
GPT 4.1 dan GPT 4.1-nano sekarang tersedia. Model-model ini adalah model terbaru dari Azure OpenAI. GPT 4.1 memiliki batas konteks 1 juta token. Untuk informasi selengkapnya, lihat halaman model.
Dirilis model audio GPT-4o
Model audio baru yang didukung oleh GPT-4o sekarang tersedia.
gpt-4o-transcribedangpt-4o-mini-transcribemodel ucapan ke teks telah dirilis. Gunakan model ini melalui/audioAPI dan/realtime.Model
gpt-4o-mini-ttsteks ke suara dirilis. Gunakan modelgpt-4o-mini-ttsuntuk pembuatan teks ke ucapan melalui API/audio.
Untuk informasi selengkapnya tentang model yang tersedia, lihat dokumentasi model dan versi.
Maret 2025
Api Respons & model pratinjau penggunaan komputer
API Responses adalah API stateful baru dari Azure OpenAI. Ini menggabungkan kemampuan terbaik dari penyelesaian percakapan dan API Asisten dalam satu pengalaman terpadu. API Respons juga menambahkan dukungan untuk model baru computer-use-preview , yang mendukung kemampuan Penggunaan komputer .
Untuk akses ke pendaftaran computer-use-preview diperlukan, dan akses akan diberikan berdasarkan kriteria kelayakan Microsoft. Pelanggan yang memiliki akses ke model akses terbatas lainnya masih perlu meminta akses untuk model ini.
Meminta akses: computer-use-preview aplikasi model akses terbatas
Untuk informasi selengkapnya tentang kemampuan model, dan ketersediaan wilayah, lihat dokumentasi model.
Kode demo integrasi Playwright.
Pengalokasian spillover (pratinjau)
Spillover mengelola fluktuasi lalu lintas pada penyebaran yang disediakan dengan merutekan kelebihan penggunaan ke penyebaran standar yang ditunjuk. Untuk memaksimalkan pemanfaatan penyebaran yang sudah disiapkan dengan spillover, lihat Kelola lalu lintas dengan spillover untuk penyebaran yang sudah disiapkan (pratinjau).
Menentukan konfigurasi pemfilteran konten
Selain konfigurasi pemfilteran konten tingkat penyebaran, kami sekarang juga menyediakan header permintaan yang memungkinkan Anda menentukan konfigurasi kustom Anda pada waktu permintaan untuk setiap panggilan API. Untuk informasi selengkapnya, lihat Menggunakan filter konten (pratinjau).
Februari 2025
Pratinjau GPT-4.5
Model GPT terbaru yang unggul pada berbagai tugas teks dan gambar sekarang tersedia di Azure OpenAI.
Untuk informasi selengkapnya tentang kemampuan model, dan ketersediaan wilayah, lihat dokumentasi model.
API penyelesaian otomatis tersimpan
Penyelesaian tersimpan memungkinkan Anda mengambil riwayat percakapan dari sesi penyelesaian obrolan untuk digunakan sebagai himpunan data untuk evaluasi dan penyempurnaan.
Penyebaran standar zona data o3-mini
o3-mini sekarang tersedia untuk standar global dan penyebaran standar zona data bagi pelanggan yang terdaftar dengan akses terbatas.
Untuk informasi selengkapnya, lihat panduan model penalaran kami.
gpt-4o audio mini dirilis
Model gpt-4o-mini-audio-preview (2024-12-17) adalah model penyelesaian audio terbaru. Untuk informasi selengkapnya, lihat panduan memulai cepat pembuatan audio.
Model gpt-4o-mini-realtime-preview (2024-12-17) adalah model audio real-time terbaru. Model waktu nyata menggunakan model audio GPT-4o yang mendasar yang sama dengan API penyelesaian, tetapi dioptimalkan untuk interaksi audio waktu nyata dengan latensi rendah. Untuk informasi selengkapnya, lihat panduan cepat audio waktu nyata.
Untuk informasi selengkapnya tentang model yang tersedia, lihat dokumentasi model dan versi.
Januari 2025
o3-mini dirilis
o3-mini (2025-01-31) adalah model penalaran terbaru, menawarkan kemampuan penalaran yang ditingkatkan. Untuk informasi selengkapnya, lihat panduan model penalaran kami.
Hasil audio GPT-4o
Model gpt-4o-audio-preview ini sekarang tersedia untuk penyebaran global di wilayah US Timur 2 dan Swedia Tengah. Gunakan model gpt-4o-audio-preview untuk pembuatan audio.
Model gpt-4o-audio-preview ini memperkenalkan modalitas audio pada API /chat/completions yang ada. Model audio memperluas potensi aplikasi AI dalam interaksi teks dan berbasis suara dan analisis audio. Modalitas yang didukung dalam gpt-4o-audio-preview model meliputi: teks, audio, dan teks + audio. Untuk informasi selengkapnya, lihat panduan memulai cepat pembuatan audio.
Catatan
Realtime API menggunakan model audio GPT-4o yang sama dengan API penyelesaian, tetapi dioptimalkan untuk interaksi audio real-time berlatensi rendah.
GPT Realtime API 2024-12-17
Model gpt-4o-realtime-preview versi 2024-12-17 tersedia untuk penyebaran global di wilayah US Timur 2 dan Swedia Tengah.
gpt-4o-realtime-preview Gunakan model versi 2024-12-17 alih-alih gpt-4o-realtime-preview model pratinjau versi 2024-10-01 untuk interaksi audio real time.
- Dukungan ditambahkan untuk caching prompt dengan
gpt-4o-realtime-previewmodel. - Menambahkan dukungan untuk suara baru. Model
gpt-4o-realtime-previewsekarang mendukung suara berikut:alloy, ,ash,balladcoral,echo,sage,shimmer.verse - Batas tarif tidak lagi didasarkan pada koneksi per menit. Pembatasan tarif sekarang didasarkan pada RPM (permintaan per menit) dan TPM (token per menit) untuk
gpt-4o-realtime-previewmodel. Batas jumlah untuk setiap penyebaran modelgpt-4o-realtime-previewadalah 100 K TPM dan 1 K RPM. Selama pratinjau, portal Azure AI Foundry dan API mungkin secara tidak akurat menunjukkan batas tarif yang berbeda. Bahkan jika Anda mencoba menetapkan batas tarif yang berbeda, batas tarif aktual adalah 100 K TPM dan RPM 1 K.
Untuk informasi selengkapnya, lihat panduan cepat audio real-time GPT dan panduan cara.
Desember 2024
Model penalaran o1 dirilis untuk akses terbatas
Model terbaru o1 sekarang tersedia untuk akses API dan penyebaran model.
Registration diperlukan, dan akses akan diberikan berdasarkan kriteria kelayakan Microsoft. Pelanggan yang sebelumnya menerapkan dan menerima akses ke o1-preview, tidak perlu menerapkan kembali karena mereka secara otomatis berada di daftar tunggu untuk model terbaru.
Meminta akses: aplikasi model akses terbatas
Untuk mempelajari lebih lanjut, lihat tentang model seri lanjutan o1, memulai dengan model penalaran seri o1.
Ketersediaan wilayah
| Model | Wilayah |
|---|---|
o1 (Versi: 2024-12-17) |
East US2 (Standar Global) Swedia Tengah (Standar Global) |
Penyempurnaan preferensi (pratinjau)
Pengoptimalan preferensi langsung (DPO) adalah teknik penyelarasan baru untuk model bahasa besar, yang dirancang untuk menyesuaikan bobot model berdasarkan preferensi manusia. Tidak seperti pembelajaran penguatan dari umpan balik manusia (RLHF), DPO tidak memerlukan penyesuaian model imbalan dan menggunakan data yang lebih sederhana (preferensi biner) untuk pelatihan. Metode ini secara komputasi lebih ringan dan lebih cepat, membuatnya sama-sama efektif dalam penyelarasan sambil menjadi lebih efisien. DPO sangat berguna dalam skenario di mana elemen subjektif seperti nada, gaya, atau preferensi konten tertentu penting. Kami sangat senang mengumumkan versi pratinjau publik DPO di Azure OpenAI, dimulai dengan model gpt-4o-2024-08-06.
Untuk menyempurnakan ketersediaan wilayah model, lihat halaman model.
Penyelesaian tersimpan & distilasi
Penyelesaian tersimpan memungkinkan Anda mengambil riwayat percakapan dari sesi penyelesaian obrolan untuk digunakan sebagai himpunan data untuk evaluasi dan penyempurnaan.
GPT-4o 2024-11-20
gpt-4o-2024-11-20 sekarang tersedia untuk penyebaran standar global di:
- US Timur
- US Timur 2
- US Tengah Utara
- US Tengah Selatan
- US Barat
- Barat AS 3
- Swedia Tengah
Jenis penyebaran yang ditentukan untuk zona data BARU
Penyebaran berzona data tersedia di sumber daya Azure OpenAI yang sama dengan semua jenis penyebaran Azure OpenAI lainnya. Namun, penyebaran ini memungkinkan Anda menggunakan infrastruktur global Azure untuk secara dinamis merutekan lalu lintas ke pusat data di dalam zona data yang ditentukan oleh Microsoft dengan ketersediaan terbaik untuk setiap permintaan. Penyebaran yang disiapkan dalam zona data menyediakan kapasitas pemrosesan model yang dipesan untuk tingkat throughput tinggi dan dapat diprediksi menggunakan infrastruktur Azure di zona data yang ditentukan oleh Microsoft. Penyebaran yang tersedia oleh zona data didukung pada model gpt-4o-2024-08-06, gpt-4o-2024-05-13, dan gpt-4o-mini-2024-07-18.
Untuk informasi selengkapnya, lihat panduan jenis penyebaran.
Langkah berikutnya
Pelajari selengkapnya tentang model dasar yang mendukung Azure OpenAI.