Apa yang baru dalam Azure OpenAI di Microsoft Foundry Models (klasik)

Hanya berlaku untuk:Portal Foundry (versi klasik). Artikel ini tidak tersedia untuk portal Foundry baru. Pelajari selengkapnya tentang portal baru.

Catatan

Tautan dalam artikel ini mungkin membuka konten dalam dokumentasi Microsoft Foundry baru alih-alih dokumentasi Foundry (klasik) yang Anda lihat sekarang.

Artikel ini menyediakan ringkasan rilis terbaru dan pembaruan dokumentasi utama untuk Azure OpenAI.

Mei 2026

Artikel konsep GPT Realtime 2.0

Artikel konsep baru menjelaskan kemampuan dan konsep utama untuk model realtime terbaru:

GPT Realtime Translate dan GPT Realtime Whisper

Artikel konsep baru menjelaskan kemampuan dan kasus penggunaan untuk model terjemahan dan transkripsi real-time terbaru:

  • GPT Realtime Translate — mencakup terjemahan audio berbasis aliran berkelanjutan untuk acara multibahasa langsung, dukungan pelanggan, dan asisten suara.
  • GPT Realtime Whisper — mencakup transkripsi streaming latensi rendah untuk keterangan langsung, pemantauan, dan alur kerja arsip.

Februari 2026

Model GPT-Realtime-1.5 dan GPT-Audio-1.5 dirilis

Model gpt-realtime-1.5 dan gpt-audio-1.5 sekarang tersedia.

  • Model-model ini dibangun berdasarkan GPT-Realtime dan GPT-Audio tahun lalu dengan peningkatan dalam mengikuti instruksi, dukungan multibahasa, dan panggilan alat, sambil mempertahankan latensi rendah, interaksi secara real-time yang dibutuhkan pengembang untuk aplikasi voice-first.
  • Cobalah dengan API penyelesaian obrolan yang ada di Microsoft Foundry.

Desember 2025

Model GPT-image-1.5 sekarang tersedia

GPT-image-1.5 adalah model pembuatan gambar mutakhir terbaru OpenAI. Fitur ini menampilkan peningkatan performa, kualitas, kontrol pengeditan, dan pelestarian wajah. Dalam mode pengeditan, model mendukung input_fidelity tinggi dan menambahkan atau menghapus satu aspek dari citra masukan sambil mempertahankan aspek lainnya.

Meminta akses: aplikasi model akses terbatas

Kemampuan model utama:

  • Mencakup semua kemampuan GPT-image-1:
    • Pembuatan teks ke gambar
    • Pembuatan gambar ke gambar (pengeditan)
  • Pencatatan
  • Generasi gambar berkualitas tinggi, hingga 1024x1536 dan 1536x1024 piksel
  • Pelestarian wajah

Ikuti panduan cara pembuatan gambar untuk memulai model ini.

Pembaruan model pengenalan ucapan otomatis (ASR)

gpt-4o-mini-transcribe-2025-12-15

  • Peningkatan akurasi transkripsi dan ketahanan untuk skenario real time, dengan sekitar 50% tingkat kesalahan kata yang lebih rendah (WER) daripada model sebelumnya gpt-4o-transcribe-mini pada tolok ukur bahasa Inggris.
  • Meningkatkan performa multibahasa pada bahasa Jepang, bahasa-bahasa di India, dan bahasa-bahasa lainnya.
  • Mengurangi halusinasi pada keheningan hingga 4×, menjadikannya pilihan yang lebih dapat diandalkan untuk lingkungan yang bising dan aliran audio dunia nyata.
  • Input tetap audio, dengan teks sebagai output, dan implementasi hanya API.

Pembaruan model realtime-mini (penerjemahan ucapan ke ucapan)

gpt-realtime-mini-2025-12-15

  • Paritas fitur dengan model gpt-realtime penuh dalam mengikuti instruksi dan melakukan pemanggilan fungsi.
  • Input dan output berupa audio, dan penggunaan hanya melalui API.

Pembaruan model teks ke ucapan

gpt-4o-mini-tts-2025-12-15

  • Menetapkan tolok ukur baru untuk sintesis ucapan multibahasa.
  • Menghasilkan ucapan yang lebih alami dan seperti manusia dengan lebih sedikit artefak dan peningkatan kesamaan pembicara.
  • Input adalah teks, output adalah audio, dan penerapan hanya melalui API.

Oktober 2025

Dukungan API realtime untuk SIP

Realtime API sekarang mendukung SIP, memungkinkan koneksi telepon ke realtimeapi. Untuk informasi selengkapnya, lihat dokumentasi Realtime SIP.

Model GPT-4o untuk audio telah dirilis

  • Model gpt-4o-transcribe-diarize ucapan ke teks dirilis. Model ini adalah model Pengenalan Ucapan Otomatis (ASR) yang mengonversi bahasa lisan menjadi teks secara real time. Ini memungkinkan organisasi untuk membuka wawasan dari percakapan secara instan dengan latensi sangat rendah dan akurasi tinggi di 100+ bahasa. Kemampuan ini sangat penting untuk alur kerja di mana data suara mendorong keputusan—seperti dukungan pelanggan, rapat virtual, dan acara langsung.

Diarisasi adalah proses mengidentifikasi siapa yang berbicara ketika berada dalam aliran audio. Ini mengubah percakapan menjadi transkrip yang diatribusikan pembicara, memungkinkan bisnis mengekstrak wawasan yang dapat ditindak lanjuti dari rapat, panggilan pelanggan, dan acara langsung. Dengan model tingkat lanjut seperti gpt-4o-transcribe-diarize, organisasi mendapatkan kejelasan dan konteks real-time—mengubah suara menjadi data terstruktur yang mendorong keputusan yang lebih cerdas dan meningkatkan produktivitas, mendukung pengenalan ucapan otomatis.

Gunakan model ini melalui /audio API dan /realtime .

GPT-image-1-mini

Model gpt-image-1-mini ini sekarang tersedia untuk penyebaran global. Ini adalah versi gpt-image-1 model yang lebih kecil yang menawarkan keseimbangan yang baik antara performa dan biaya. Semua kasus penggunaan saat ini didukung, kecuali untuk pengeditan gambar dan keakuratan input.

Meminta akses: Aplikasi model akses terbatas

Ikuti panduan cara pembuatan gambar untuk memulai model ini.

Filter deteksi konten PII

Deteksi informasi pengidentifikasi pribadi (PII) sekarang tersedia sebagai filter konten bawaan. Fitur ini memungkinkan Anda mengidentifikasi dan memblokir informasi sensitif dalam output LLM, meningkatkan privasi data. Untuk informasi selengkapnya, lihat dokumentasi deteksi PII .

September 2025

GPT-5-codex sekarang tersedia

Dukungan video-ke-video Sora

Model Sora dari OpenAI sekarang mendukung pembuatan video ke video. Anda dapat menyediakan video singkat sebagai input untuk menghasilkan video baru yang lebih panjang yang menggabungkan video input. Lihat panduan cepat untuk memulai.

Agustus 2025

Dukungan gambar-ke-video Sora

Model Sora dari OpenAI sekarang mendukung pembuatan gambar ke video. Anda dapat memberikan gambar sebagai input ke model untuk menghasilkan video yang menggabungkan konten gambar. Anda juga dapat menentukan bingkai video tempat gambar akan muncul: tidak perlu menjadi awal. Lihat panduan cepat untuk memulai.

Model Sora ini sekarang tersedia di wilayah Swedia Tengah dan US Timur 2.

Model audio API waktu nyata GA

Model GPT RealTime dan Audio OpenAI sekarang tersedia secara umum dalam Microsoft Foundry Models.

Peningkatan model:

  • Peningkatan dalam mengikuti instruksi: Dengan kemampuan yang lebih baik untuk menyesuaikan nada, kecepatan, dan mengikuti instruksi eskalasi secara lebih akurat dan andal. Juga dapat beralih bahasa.
  • Suara standar baru, Marin dan Cedar, yang membawa peningkatan kealamian dan kejelasan pada sintesis ucapan.
  • Kualitas audio yang ditingkatkan: Output bebas glitch, reproduksi alfanumerik yang ditingkatkan, dan kontrol modalitas.

Peningkatan layanan API realtime:

  • Input Gambar: Tambahkan dan diskusikan gambar melalui suara tanpa persyaratan video.
  • Pemanggilan fungsi yang ditingkatkan: Kemampuan yang ditingkatkan untuk memanggil kode kustom yang ditentukan oleh pengembang. Panggilan fungsi asinkron didukung, memungkinkan sesi untuk melanjutkan saat panggilan fungsi tertunda.
  • Mode Percakapan: Perilaku pengambilan giliran dunia nyata untuk interaksi alami. Mode percakapan menggunakan VAD (Voice Activity Detection) untuk memberi petunjuk kepada pengguna jika tidak ada tanggapan yang terdeteksi, meningkatkan kegunaan dunia nyata untuk interaksi mirip telepon.

Kami sangat menyarankan agar semua pelanggan beralih ke model GA yang baru diluncurkan untuk memanfaatkan sepenuhnya fitur terbaru. Kunjungi dokumentasi Azure OpenAI dan portal Microsoft Foundry untuk menjelajahi kemampuan dan berintegrasi ke dalam aplikasi Anda.

Ketersediaan Umum spillover yang disediakan (GA)

Spillover sekarang Tersedia Secara Umum. Spillover mengelola fluktuasi lalu lintas pada penyebaran yang disediakan dengan merutekan kelebihan penggunaan ke penyebaran standar yang ditunjuk. Untuk mempelajari selengkapnya tentang cara memaksimalkan penggunaan untuk penyebaran yang telah disediakan dengan spillover, lihat Mengelola lalu lintas dengan spillover untuk penyebaran yang telah disediakan.

Model GPT-5 tersedia

Model-router versi baru

  • Router model sekarang mendukung model seri GPT-5.

  • Router model untuk Microsoft Foundry adalah model obrolan AI yang dapat disebarkan yang secara otomatis memilih model obrolan terbaik yang mendasar untuk menanggapi permintaan tertentu. Untuk informasi selengkapnya tentang cara kerja router model dan kelebihan dan batasannya, lihat Panduan konsep router model. Untuk menggunakan router model dengan Completions API, ikuti Panduan Cara Menggunakan.

Juli 2025

Pembaruan GPT-image-1 (pratinjau)

  • Parameter keakuratan input: input_fidelity Parameter dalam API pengeditan gambar memungkinkan Anda mengontrol seberapa dekat model menyampaikan gaya dan fitur subjek dalam gambar asli (input). Ini berguna untuk:

    • Mengedit foto sambil mempertahankan fitur wajah; membuat avatar yang terlihat seperti orang asli di berbagai gaya; menggabungkan wajah dari beberapa orang ke dalam satu gambar.
    • Mempertahankan identitas merek dalam gambar yang dihasilkan untuk aset pemasaran, mockup, fotografi produk.
    • E-niaga dan mode, di mana Anda perlu mengedit gambar pakaian atau detail produk tanpa mengorbankan realisme.
  • Streaming gambar parsial: API pembuatan gambar dan pengeditan gambar mendukung streaming gambar parsial, di mana mereka mengembalikan gambar dengan konten yang dirender sebagian sepanjang proses pembuatan gambar. Tampilkan gambar-gambar ini kepada pengguna untuk memberikan umpan balik visual sebelumnya dan menunjukkan kemajuan operasi pembuatan gambar.

Juni 2025

Model baru codex-mini & o3-pro dirilis

Mei 2025

Pembuatan video Sora dirilis (pratinjau)

Model Sora (2025-05-02) adalah model pembuatan video dari OpenAI yang dapat menciptakan adegan video yang realistis dan imajinatif dari instruksi teks.

Ikuti Panduan Cepat Pembuatan Video untuk memulai. Untuk informasi selengkapnya, lihat Panduan konsep pembuatan video .

Penyorotan di perisai pengingat (pratinjau)

Spotlighting adalah sub-fitur dari perisai prompt yang meningkatkan perlindungan terhadap serangan tidak langsung (serangan dokumen tertanam) dengan menandai dokumen masukan menggunakan pemformatan khusus yang menunjukkan tingkat kepercayaan lebih rendah pada model. Untuk informasi selengkapnya, lihat dokumentasi filter Perisai prompt .

Router model (pratinjau)

Router model untuk Microsoft Foundry adalah model obrolan AI yang dapat disebarkan yang secara otomatis memilih model obrolan terbaik yang mendasar untuk menanggapi permintaan tertentu. Untuk informasi selengkapnya tentang cara kerja router model dan kelebihan dan batasannya, lihat Panduan konsep router model. Untuk menggunakan router model dengan Completions API, ikuti Panduan Cara Menggunakan.

April 2025

Dukungan API waktu nyata (pratinjau) untuk WebRTC

Realtime API (pratinjau) sekarang mendukung WebRTC, memungkinkan streaming audio real time dan interaksi latensi rendah. Fitur ini sangat ideal untuk aplikasi yang membutuhkan umpan balik langsung, seperti dukungan pelanggan langsung atau asisten suara interaktif. Untuk informasi selengkapnya, lihat dokumentasi Realtime API (pratinjau).

GPT-image-1 dirilis (pratinjau, akses terbatas)

GPT-image-1 (2025-04-15) adalah model pembuatan gambar terbaru dari Azure OpenAI. Ini menampilkan peningkatan besar atas DALL-E, termasuk:

  • Lebih baik menanggapi instruksi yang tepat.
  • Menampilkan teks dengan andal.
  • Menerima gambar sebagai input, yang memungkinkan kemampuan baru pengeditan dan pemasukan gambar.

Meminta akses: Aplikasi model akses terbatas

Ikuti panduan cara pembuatan gambar untuk memulai model baru.

Model o4-mini dan o3 dirilis

o4-mini dan o3 model sekarang tersedia. Model-model ini adalah model penalaran terbaru dari Azure OpenAI yang menawarkan penalaran, kualitas, dan performa yang ditingkatkan. Untuk informasi selengkapnya, lihat halaman memulai model penalaran.

GPT-4.1 dirilis

GPT 4.1 dan GPT 4.1-nano sekarang tersedia. Model-model ini adalah model terbaru dari Azure OpenAI. GPT 4.1 memiliki batas konteks 1 juta token. Untuk informasi selengkapnya, lihat halaman model.

Dirilis model audio GPT-4o

Model audio baru yang didukung oleh GPT-4o sekarang tersedia.

  • gpt-4o-transcribe dan gpt-4o-mini-transcribe model ucapan ke teks telah dirilis. Gunakan model ini melalui /audio API dan /realtime .

  • Model gpt-4o-mini-tts teks ke suara dirilis. Gunakan model gpt-4o-mini-tts untuk pembuatan teks ke ucapan melalui API /audio.

Untuk informasi selengkapnya tentang model yang tersedia, lihat dokumentasi model dan versi.

Maret 2025

Api Respons & model pratinjau penggunaan komputer

API Responses adalah API stateful baru dari Azure OpenAI. Ini menggabungkan kemampuan terbaik dari penyelesaian percakapan dan API Asisten dalam satu pengalaman terpadu. API Respons juga menambahkan dukungan untuk model baru computer-use-preview , yang mendukung kemampuan Penggunaan komputer .

Untuk akses ke pendaftaran computer-use-preview diperlukan, dan akses akan diberikan berdasarkan kriteria kelayakan Microsoft. Pelanggan yang memiliki akses ke model akses terbatas lainnya masih perlu meminta akses untuk model ini.

Meminta akses: computer-use-preview aplikasi model akses terbatas

Untuk informasi selengkapnya tentang kemampuan model, dan ketersediaan wilayah, lihat dokumentasi model.

Animasi GIF dari model pratinjau penggunaan komputer yang terintegrasi dengan Playwright.

Kode demo integrasi Playwright.

Pengalokasian spillover (pratinjau)

Spillover mengelola fluktuasi lalu lintas pada penyebaran yang disediakan dengan merutekan kelebihan penggunaan ke penyebaran standar yang ditunjuk. Untuk memaksimalkan pemanfaatan penyebaran yang sudah disiapkan dengan spillover, lihat Kelola lalu lintas dengan spillover untuk penyebaran yang sudah disiapkan (pratinjau).

Menentukan konfigurasi pemfilteran konten

Selain konfigurasi pemfilteran konten tingkat penyebaran, kami sekarang juga menyediakan header permintaan yang memungkinkan Anda menentukan konfigurasi kustom Anda pada waktu permintaan untuk setiap panggilan API. Untuk informasi selengkapnya, lihat Menggunakan filter konten (pratinjau).

Februari 2025

Pratinjau GPT-4.5

Model GPT terbaru yang unggul pada berbagai tugas teks dan gambar sekarang tersedia di Azure OpenAI.

Untuk informasi selengkapnya tentang kemampuan model, dan ketersediaan wilayah, lihat dokumentasi model.

API penyelesaian otomatis tersimpan

Penyelesaian tersimpan memungkinkan Anda mengambil riwayat percakapan dari sesi penyelesaian obrolan untuk digunakan sebagai himpunan data untuk evaluasi dan penyempurnaan.

Penyebaran standar zona data o3-mini

o3-mini sekarang tersedia untuk standar global dan penyebaran standar zona data bagi pelanggan yang terdaftar dengan akses terbatas.

Untuk informasi selengkapnya, lihat panduan model penalaran kami.

gpt-4o audio mini dirilis

Model gpt-4o-mini-audio-preview (2024-12-17) adalah model penyelesaian audio terbaru. Untuk informasi selengkapnya, lihat panduan memulai cepat pembuatan audio.

Model gpt-4o-mini-realtime-preview (2024-12-17) adalah model audio real-time terbaru. Model waktu nyata menggunakan model audio GPT-4o yang mendasar yang sama dengan API penyelesaian, tetapi dioptimalkan untuk interaksi audio waktu nyata dengan latensi rendah. Untuk informasi selengkapnya, lihat panduan cepat audio waktu nyata.

Untuk informasi selengkapnya tentang model yang tersedia, lihat dokumentasi model dan versi.

Januari 2025

o3-mini dirilis

o3-mini (2025-01-31) adalah model penalaran terbaru, menawarkan kemampuan penalaran yang ditingkatkan. Untuk informasi selengkapnya, lihat panduan model penalaran kami.

Hasil audio GPT-4o

Model gpt-4o-audio-preview ini sekarang tersedia untuk penyebaran global di wilayah US Timur 2 dan Swedia Tengah. Gunakan model gpt-4o-audio-preview untuk pembuatan audio.

Model gpt-4o-audio-preview ini memperkenalkan modalitas audio pada API /chat/completions yang ada. Model audio memperluas potensi aplikasi AI dalam interaksi teks dan berbasis suara dan analisis audio. Modalitas yang didukung dalam gpt-4o-audio-preview model meliputi: teks, audio, dan teks + audio. Untuk informasi selengkapnya, lihat panduan memulai cepat pembuatan audio.

Catatan

Realtime API menggunakan model audio GPT-4o yang sama dengan API penyelesaian, tetapi dioptimalkan untuk interaksi audio real-time berlatensi rendah.

GPT Realtime API 2024-12-17

Model gpt-4o-realtime-preview versi 2024-12-17 tersedia untuk penyebaran global di wilayah US Timur 2 dan Swedia Tengah. gpt-4o-realtime-preview Gunakan model versi 2024-12-17 alih-alih gpt-4o-realtime-preview model pratinjau versi 2024-10-01 untuk interaksi audio real time.

  • Dukungan ditambahkan untuk caching prompt dengan gpt-4o-realtime-preview model.
  • Menambahkan dukungan untuk suara baru. Model gpt-4o-realtime-preview sekarang mendukung suara berikut: alloy, , ash, balladcoral, echo, sage, shimmer. verse
  • Batas tarif tidak lagi didasarkan pada koneksi per menit. Pembatasan tarif sekarang didasarkan pada RPM (permintaan per menit) dan TPM (token per menit) untuk gpt-4o-realtime-preview model. Batas jumlah untuk setiap penyebaran model gpt-4o-realtime-preview adalah 100 K TPM dan 1 K RPM. Selama pratinjau, portal Azure AI Foundry dan API mungkin secara tidak akurat menunjukkan batas tarif yang berbeda. Bahkan jika Anda mencoba menetapkan batas tarif yang berbeda, batas tarif aktual adalah 100 K TPM dan RPM 1 K.

Untuk informasi selengkapnya, lihat panduan cepat audio real-time GPT dan panduan cara.

Desember 2024

Model penalaran o1 dirilis untuk akses terbatas

Model terbaru o1 sekarang tersedia untuk akses API dan penyebaran model. Registration diperlukan, dan akses akan diberikan berdasarkan kriteria kelayakan Microsoft. Pelanggan yang sebelumnya menerapkan dan menerima akses ke o1-preview, tidak perlu menerapkan kembali karena mereka secara otomatis berada di daftar tunggu untuk model terbaru.

Meminta akses: aplikasi model akses terbatas

Untuk mempelajari lebih lanjut, lihat tentang model seri lanjutan o1, memulai dengan model penalaran seri o1.

Ketersediaan wilayah

Model Wilayah
o1
(Versi: 2024-12-17)
East US2 (Standar Global)
Swedia Tengah (Standar Global)

Penyempurnaan preferensi (pratinjau)

Pengoptimalan preferensi langsung (DPO) adalah teknik penyelarasan baru untuk model bahasa besar, yang dirancang untuk menyesuaikan bobot model berdasarkan preferensi manusia. Tidak seperti pembelajaran penguatan dari umpan balik manusia (RLHF), DPO tidak memerlukan penyesuaian model imbalan dan menggunakan data yang lebih sederhana (preferensi biner) untuk pelatihan. Metode ini secara komputasi lebih ringan dan lebih cepat, membuatnya sama-sama efektif dalam penyelarasan sambil menjadi lebih efisien. DPO sangat berguna dalam skenario di mana elemen subjektif seperti nada, gaya, atau preferensi konten tertentu penting. Kami sangat senang mengumumkan versi pratinjau publik DPO di Azure OpenAI, dimulai dengan model gpt-4o-2024-08-06.

Untuk menyempurnakan ketersediaan wilayah model, lihat halaman model.

Penyelesaian tersimpan & distilasi

Penyelesaian tersimpan memungkinkan Anda mengambil riwayat percakapan dari sesi penyelesaian obrolan untuk digunakan sebagai himpunan data untuk evaluasi dan penyempurnaan.

GPT-4o 2024-11-20

gpt-4o-2024-11-20 sekarang tersedia untuk penyebaran standar global di:

  • US Timur
  • US Timur 2
  • US Tengah Utara
  • US Tengah Selatan
  • US Barat
  • Barat AS 3
  • Swedia Tengah

Jenis penyebaran yang ditentukan untuk zona data BARU

Penyebaran berzona data tersedia di sumber daya Azure OpenAI yang sama dengan semua jenis penyebaran Azure OpenAI lainnya. Namun, penyebaran ini memungkinkan Anda menggunakan infrastruktur global Azure untuk secara dinamis merutekan lalu lintas ke pusat data di dalam zona data yang ditentukan oleh Microsoft dengan ketersediaan terbaik untuk setiap permintaan. Penyebaran yang disiapkan dalam zona data menyediakan kapasitas pemrosesan model yang dipesan untuk tingkat throughput tinggi dan dapat diprediksi menggunakan infrastruktur Azure di zona data yang ditentukan oleh Microsoft. Penyebaran yang tersedia oleh zona data didukung pada model gpt-4o-2024-08-06, gpt-4o-2024-05-13, dan gpt-4o-mini-2024-07-18.

Untuk informasi selengkapnya, lihat panduan jenis penyebaran.

Langkah berikutnya

Pelajari selengkapnya tentang model dasar yang mendukung Azure OpenAI.