Gambaran umum GPT Realtime 2.0 (pratinjau) (klasik)

Sedang menampilkan:Versi portal Foundry (klasik) - Beralih ke versi untuk portal Foundry yang baru

GPT Realtime 2 adalah model ucapan ke ucapan dengan penalaran bawaan. Ini menerima input audio dan menghasilkan output audio. Ini dirancang untuk pengalaman suara interaktif berlatensi rendah yang memerlukan kemampuan mengikuti instruksi dan penalaran yang lebih baik dibandingkan model real-time sebelumnya.

Note

Fitur ini saat ini dalam pratinjau publik. Pratinjau ini disediakan tanpa adanya perjanjian tingkat layanan, dan kami tidak menyarankan penggunaannya untuk beban kerja produksi. Fitur tertentu mungkin tidak didukung atau mungkin memiliki kemampuan terbatas. Untuk informasi lebih lanjut, lihat Supplemental Terms of Use for Microsoft Azure Previews.

Apa yang baru dalam GPT Realtime 2

  • Dukungan untuk penalaran dengan kontrol reasoning.effort yang dapat disesuaikan.
  • Fase respons yang membedakan preambles ("commentary") dari jawaban akhir ("final_answer").
  • Jendela konteks yang lebih panjang (256.000 token).

Konsep Utama

Upaya penalaran

Atur intensitas penalaran dengan parameter sesi reasoning.effort. Nilai yang valid adalah: minimal, low, medium, dan high.

Preambul dan fase respons

Respons realtime dapat mencakup beberapa item output per giliran. Setiap item memiliki phase yang menunjukkan perannya:

Fase Description
commentary Preambule yang dapat diberi prompt, sering digunakan sebelum penalaran yang lebih panjang.
final_answer Jawaban akhir setelah model menyelesaikan penalaran.

Pendahuluan dapat mengurangi latensi yang dirasakan pengguna—misalnya, "Biar saya pikirkan dulu..."—dan juga dapat digunakan untuk pengumuman penggunaan alat atau pengisi jeda. Jika model terinterupsi saat sedang berpikir, model akan membuang alur pemikiran saat ini dan memulai putaran baru.

Instruksi berikut

Kepatuhan terhadap instruksi lebih ketat dibandingkan dengan model realtime sebelumnya. Jika permintaan sistem Anda berisi kata-kata sempit (misalnya, membedakan "ID pesanan" dari "kode konfirmasi"), Anda mungkin perlu memperluas atau mengulangi instruksi untuk mencocokkan frasa pengguna nyata.

Get started

Pola koneksi dan penggunaan untuk GPT Realtime 2 sama seperti pada versi sebelumnya—cukup deploy model baru dan arahkan kode yang sudah ada ke model tersebut. Pilih transportasi yang sesuai dengan skenario Anda: