Catatan
Akses ke halaman ini memerlukan otorisasi. Anda dapat mencoba masuk atau mengubah direktori.
Akses ke halaman ini memerlukan otorisasi. Anda dapat mencoba mengubah direktori.
Sedang menampilkan:Versi portal Foundry (klasik) - Beralih ke versi untuk portal Foundry yang baru
GPT Realtime 2 adalah model ucapan ke ucapan dengan penalaran bawaan. Ini menerima input audio dan menghasilkan output audio. Ini dirancang untuk pengalaman suara interaktif berlatensi rendah yang memerlukan kemampuan mengikuti instruksi dan penalaran yang lebih baik dibandingkan model real-time sebelumnya.
Note
Fitur ini saat ini dalam pratinjau publik. Pratinjau ini disediakan tanpa adanya perjanjian tingkat layanan, dan kami tidak menyarankan penggunaannya untuk beban kerja produksi. Fitur tertentu mungkin tidak didukung atau mungkin memiliki kemampuan terbatas. Untuk informasi lebih lanjut, lihat Supplemental Terms of Use for Microsoft Azure Previews.
Apa yang baru dalam GPT Realtime 2
-
Dukungan untuk penalaran dengan kontrol
reasoning.effortyang dapat disesuaikan. - Fase respons yang membedakan preambles ("commentary") dari jawaban akhir ("final_answer").
- Jendela konteks yang lebih panjang (256.000 token).
Konsep Utama
Upaya penalaran
Atur intensitas penalaran dengan parameter sesi reasoning.effort. Nilai yang valid adalah: minimal, low, medium, dan high.
Preambul dan fase respons
Respons realtime dapat mencakup beberapa item output per giliran. Setiap item memiliki phase yang menunjukkan perannya:
| Fase | Description |
|---|---|
commentary |
Preambule yang dapat diberi prompt, sering digunakan sebelum penalaran yang lebih panjang. |
final_answer |
Jawaban akhir setelah model menyelesaikan penalaran. |
Pendahuluan dapat mengurangi latensi yang dirasakan pengguna—misalnya, "Biar saya pikirkan dulu..."—dan juga dapat digunakan untuk pengumuman penggunaan alat atau pengisi jeda. Jika model terinterupsi saat sedang berpikir, model akan membuang alur pemikiran saat ini dan memulai putaran baru.
Instruksi berikut
Kepatuhan terhadap instruksi lebih ketat dibandingkan dengan model realtime sebelumnya. Jika permintaan sistem Anda berisi kata-kata sempit (misalnya, membedakan "ID pesanan" dari "kode konfirmasi"), Anda mungkin perlu memperluas atau mengulangi instruksi untuk mencocokkan frasa pengguna nyata.
Get started
Pola koneksi dan penggunaan untuk GPT Realtime 2 sama seperti pada versi sebelumnya—cukup deploy model baru dan arahkan kode yang sudah ada ke model tersebut. Pilih transportasi yang sesuai dengan skenario Anda: