VoiceResponse interface
Eine anhaltende Sprachantwort, die eine Modell-Inferenz-Drehung innerhalb eines Gesprächs darstellt. In Listenergebnissen kann die output Projektion weggelassen werden; rufen Sie die vollständige Antwort (GET .../responses/{response_id}) oder die aussortierte Antwort-Elemente-Route (GET .../responses/{response_id}/items) für die Ausgabeelemente ab.
created_at
/
completed_at sind Foundry Durable Order-Erweiterungen.
- Extends
Eigenschaften
| audio | Die für die Antwort verwendete Audiokonfiguration, einschließlich der Stimme und des Audioformats für die Ausgabe. |
| completed_at | Der Unix-Zeitstempel (in Sekunden) für den Zeitpunkt der Antwort. |
| conversation_id | Das Id des Gesprächs, zu dem diese Antwort gehört. |
| created_at | Der Unix-Zeitstempel (in Sekunden) für den Zeitpunkt, an dem die Antwort erstellt wurde. |
| id | Die einzigartige Identität der Antwort. |
| metadata | Eine Menge von Schlüssel-Wert-Paaren, die der Antwort zugeordnet sind. |
| output | Die ausgabeelemente, die von der Antwort erstellt wurden. Kann in den Listenergebnissen ausgelassen werden; die vollständige Antwort (GET .../responses/{response_id}) abrufen oder die ausgeführte Antwort-Items-Route (GET .../responses/{response_id}/items) für die Ausgabepunkte verwenden. Jeder Punkt |
| temperature | Die für die Antwort verwendete Sampling-Temperatur. |
Geerbte Eigenschaften
| max_output_tokens | Maximale Anzahl von Ausgabetoken für eine einzelne Assistentenantwort, einschließlich der Tool-Aufrufe, die in dieser Antwort verwendet wurde. |
| object | Der Objekttyp muss sein |
| output_modalities | Die Menge der Modalitäten, die das Modell zur Antwort verwendet hat, sind |
| status | Der Endstatus der Antwort ( |
| status_details | Weitere Details zum Status. |
| usage | Nutzungsstatistiken für die Antwort, das entspricht der Abrechnung. Eine Echtzeit-API-Sitzung verwaltet einen Gesprächskontext und fügt neue Items an die Konversation hinzu, sodass Ausgaben aus vorherigen Runden (Text- und Audio-Tokens) die Eingabe für spätere Runden werden. |
Details zur Eigenschaft
audio
Die für die Antwort verwendete Audiokonfiguration, einschließlich der Stimme und des Audioformats für die Ausgabe.
audio?: VoiceResponseAudio
Eigenschaftswert
completed_at
Der Unix-Zeitstempel (in Sekunden) für den Zeitpunkt der Antwort.
completed_at?: Date
Eigenschaftswert
Date
conversation_id
Das Id des Gesprächs, zu dem diese Antwort gehört.
conversation_id: string
Eigenschaftswert
string
created_at
Der Unix-Zeitstempel (in Sekunden) für den Zeitpunkt, an dem die Antwort erstellt wurde.
created_at?: Date
Eigenschaftswert
Date
id
Die einzigartige Identität der Antwort.
id: string
Eigenschaftswert
string
metadata
Eine Menge von Schlüssel-Wert-Paaren, die der Antwort zugeordnet sind.
metadata?: Record<string, string>
Eigenschaftswert
Record<string, string>
output
Die ausgabeelemente, die von der Antwort erstellt wurden. Kann in den Listenergebnissen ausgelassen werden; die vollständige Antwort (GET .../responses/{response_id}) abrufen oder die ausgeführte Antwort-Items-Route (GET .../responses/{response_id}/items) für die Ausgabepunkte verwenden. Jeder Punkt response_id verknüpft ihn außerdem mit dieser Antwort in der Gesprächsebene-Itemliste.
output?: RealtimeConversationItemUnion[]
Eigenschaftswert
temperature
Die für die Antwort verwendete Sampling-Temperatur.
temperature?: number
Eigenschaftswert
number
Geerbte Eigenschaftsdetails
max_output_tokens
Maximale Anzahl von Ausgabetoken für eine einzelne Assistentenantwort, einschließlich der Tool-Aufrufe, die in dieser Antwort verwendet wurde.
max_output_tokens?: number | "inf"
Eigenschaftswert
number | "inf"
Geerbt vonVoiceResponseBase.max_output_tokens
object
Der Objekttyp muss sein realtime.response.
object?: "realtime.response"
Eigenschaftswert
"realtime.response"
Geerbt vonVoiceResponseBase.object
output_modalities
Die Menge der Modalitäten, die das Modell zur Antwort verwendet hat, sind [\"audio\"]derzeit die einzigen möglichen Werte , [\"text\"]. Die Audioausgabe enthält immer ein Texttranskript. Wenn man den Ausgang auf Modus text stellt, wird der Audioausgang des Modells deaktiviert.
output_modalities?: ("text" | "audio")[]
Eigenschaftswert
("text" | "audio")[]
Geerbt vonVoiceResponseBase.output_modalities
status
Der Endstatus der Antwort (completed, cancelled, failed, oder incomplete, in_progress).
status?: "failed" | "in_progress" | "cancelled" | "completed" | "incomplete"
Eigenschaftswert
"failed" | "in_progress" | "cancelled" | "completed" | "incomplete"
Geerbt vonVoiceResponseBase.status
status_details
Weitere Details zum Status.
status_details?: RealtimeResponseStatusDetails
Eigenschaftswert
Geerbt vonVoiceResponseBase.status_details
usage
Nutzungsstatistiken für die Antwort, das entspricht der Abrechnung. Eine Echtzeit-API-Sitzung verwaltet einen Gesprächskontext und fügt neue Items an die Konversation hinzu, sodass Ausgaben aus vorherigen Runden (Text- und Audio-Tokens) die Eingabe für spätere Runden werden.
usage?: RealtimeResponseUsage
Eigenschaftswert
Geerbt vonVoiceResponseBase.usage