VoiceResponseBase interface
Eigenschaften, die durch persistierte Sprachantworten geteilt werden.
Eigenschaften
| max_output_tokens | Maximale Anzahl von Ausgabetoken für eine einzelne Assistentenantwort, einschließlich der Tool-Aufrufe, die in dieser Antwort verwendet wurde. |
| object | Der Objekttyp muss sein |
| output_modalities | Die Menge der Modalitäten, die das Modell zur Antwort verwendet hat, sind |
| status | Der Endstatus der Antwort ( |
| status_details | Weitere Details zum Status. |
| usage | Nutzungsstatistiken für die Antwort, das entspricht der Abrechnung. Eine Echtzeit-API-Sitzung verwaltet einen Gesprächskontext und fügt neue Items an die Konversation hinzu, sodass Ausgaben aus vorherigen Runden (Text- und Audio-Tokens) die Eingabe für spätere Runden werden. |
Details zur Eigenschaft
max_output_tokens
Maximale Anzahl von Ausgabetoken für eine einzelne Assistentenantwort, einschließlich der Tool-Aufrufe, die in dieser Antwort verwendet wurde.
max_output_tokens?: number | "inf"
Eigenschaftswert
number | "inf"
object
Der Objekttyp muss sein realtime.response.
object?: "realtime.response"
Eigenschaftswert
"realtime.response"
output_modalities
Die Menge der Modalitäten, die das Modell zur Antwort verwendet hat, sind [\"audio\"]derzeit die einzigen möglichen Werte , [\"text\"]. Die Audioausgabe enthält immer ein Texttranskript. Wenn man den Ausgang auf Modus text stellt, wird der Audioausgang des Modells deaktiviert.
output_modalities?: ("text" | "audio")[]
Eigenschaftswert
("text" | "audio")[]
status
Der Endstatus der Antwort (completed, cancelled, failed, oder incomplete, in_progress).
status?: "failed" | "in_progress" | "cancelled" | "completed" | "incomplete"
Eigenschaftswert
"failed" | "in_progress" | "cancelled" | "completed" | "incomplete"
status_details
Weitere Details zum Status.
status_details?: RealtimeResponseStatusDetails
Eigenschaftswert
usage
Nutzungsstatistiken für die Antwort, das entspricht der Abrechnung. Eine Echtzeit-API-Sitzung verwaltet einen Gesprächskontext und fügt neue Items an die Konversation hinzu, sodass Ausgaben aus vorherigen Runden (Text- und Audio-Tokens) die Eingabe für spätere Runden werden.
usage?: RealtimeResponseUsage