VoiceResponse interface

Eine anhaltende Sprachantwort, die eine Modell-Inferenz-Drehung innerhalb eines Gesprächs darstellt. In Listenergebnissen kann die output Projektion weggelassen werden; rufen Sie die vollständige Antwort (GET .../responses/{response_id}) oder die aussortierte Antwort-Elemente-Route (GET .../responses/{response_id}/items) für die Ausgabeelemente ab. created_at / completed_at sind Foundry Durable Order-Erweiterungen.

Extends

Eigenschaften

audio

Die für die Antwort verwendete Audiokonfiguration, einschließlich der Stimme und des Audioformats für die Ausgabe.

completed_at

Der Unix-Zeitstempel (in Sekunden) für den Zeitpunkt der Antwort.

conversation_id

Das Id des Gesprächs, zu dem diese Antwort gehört.

created_at

Der Unix-Zeitstempel (in Sekunden) für den Zeitpunkt, an dem die Antwort erstellt wurde.

id

Die einzigartige Identität der Antwort.

metadata

Eine Menge von Schlüssel-Wert-Paaren, die der Antwort zugeordnet sind.

output

Die ausgabeelemente, die von der Antwort erstellt wurden. Kann in den Listenergebnissen ausgelassen werden; die vollständige Antwort (GET .../responses/{response_id}) abrufen oder die ausgeführte Antwort-Items-Route (GET .../responses/{response_id}/items) für die Ausgabepunkte verwenden. Jeder Punkt response_id verknüpft ihn außerdem mit dieser Antwort in der Gesprächsebene-Itemliste.

temperature

Die für die Antwort verwendete Sampling-Temperatur.

Geerbte Eigenschaften

max_output_tokens

Maximale Anzahl von Ausgabetoken für eine einzelne Assistentenantwort, einschließlich der Tool-Aufrufe, die in dieser Antwort verwendet wurde.

object

Der Objekttyp muss sein realtime.response.

output_modalities

Die Menge der Modalitäten, die das Modell zur Antwort verwendet hat, sind [\"audio\"]derzeit die einzigen möglichen Werte , [\"text\"]. Die Audioausgabe enthält immer ein Texttranskript. Wenn man den Ausgang auf Modus text stellt, wird der Audioausgang des Modells deaktiviert.

status

Der Endstatus der Antwort (completed, cancelled, failed, oder incomplete, in_progress).

status_details

Weitere Details zum Status.

usage

Nutzungsstatistiken für die Antwort, das entspricht der Abrechnung. Eine Echtzeit-API-Sitzung verwaltet einen Gesprächskontext und fügt neue Items an die Konversation hinzu, sodass Ausgaben aus vorherigen Runden (Text- und Audio-Tokens) die Eingabe für spätere Runden werden.

Details zur Eigenschaft

audio

Die für die Antwort verwendete Audiokonfiguration, einschließlich der Stimme und des Audioformats für die Ausgabe.

audio?: VoiceResponseAudio

Eigenschaftswert

completed_at

Der Unix-Zeitstempel (in Sekunden) für den Zeitpunkt der Antwort.

completed_at?: Date

Eigenschaftswert

Date

conversation_id

Das Id des Gesprächs, zu dem diese Antwort gehört.

conversation_id: string

Eigenschaftswert

string

created_at

Der Unix-Zeitstempel (in Sekunden) für den Zeitpunkt, an dem die Antwort erstellt wurde.

created_at?: Date

Eigenschaftswert

Date

id

Die einzigartige Identität der Antwort.

id: string

Eigenschaftswert

string

metadata

Eine Menge von Schlüssel-Wert-Paaren, die der Antwort zugeordnet sind.

metadata?: Record<string, string>

Eigenschaftswert

Record<string, string>

output

Die ausgabeelemente, die von der Antwort erstellt wurden. Kann in den Listenergebnissen ausgelassen werden; die vollständige Antwort (GET .../responses/{response_id}) abrufen oder die ausgeführte Antwort-Items-Route (GET .../responses/{response_id}/items) für die Ausgabepunkte verwenden. Jeder Punkt response_id verknüpft ihn außerdem mit dieser Antwort in der Gesprächsebene-Itemliste.

output?: RealtimeConversationItemUnion[]

Eigenschaftswert

temperature

Die für die Antwort verwendete Sampling-Temperatur.

temperature?: number

Eigenschaftswert

number

Geerbte Eigenschaftsdetails

max_output_tokens

Maximale Anzahl von Ausgabetoken für eine einzelne Assistentenantwort, einschließlich der Tool-Aufrufe, die in dieser Antwort verwendet wurde.

max_output_tokens?: number | "inf"

Eigenschaftswert

number | "inf"

Geerbt vonVoiceResponseBase.max_output_tokens

object

Der Objekttyp muss sein realtime.response.

object?: "realtime.response"

Eigenschaftswert

"realtime.response"

Geerbt vonVoiceResponseBase.object

output_modalities

Die Menge der Modalitäten, die das Modell zur Antwort verwendet hat, sind [\"audio\"]derzeit die einzigen möglichen Werte , [\"text\"]. Die Audioausgabe enthält immer ein Texttranskript. Wenn man den Ausgang auf Modus text stellt, wird der Audioausgang des Modells deaktiviert.

output_modalities?: ("text" | "audio")[]

Eigenschaftswert

("text" | "audio")[]

Geerbt vonVoiceResponseBase.output_modalities

status

Der Endstatus der Antwort (completed, cancelled, failed, oder incomplete, in_progress).

status?: "failed" | "in_progress" | "cancelled" | "completed" | "incomplete"

Eigenschaftswert

"failed" | "in_progress" | "cancelled" | "completed" | "incomplete"

Geerbt vonVoiceResponseBase.status

status_details

Weitere Details zum Status.

status_details?: RealtimeResponseStatusDetails

Eigenschaftswert

Geerbt vonVoiceResponseBase.status_details

usage

Nutzungsstatistiken für die Antwort, das entspricht der Abrechnung. Eine Echtzeit-API-Sitzung verwaltet einen Gesprächskontext und fügt neue Items an die Konversation hinzu, sodass Ausgaben aus vorherigen Runden (Text- und Audio-Tokens) die Eingabe für spätere Runden werden.

usage?: RealtimeResponseUsage

Eigenschaftswert

Geerbt vonVoiceResponseBase.usage