VoiceAgentRealtimeResponseBase interface
Eigenschaften, die durch Echtzeit-Antworten geteilt werden, die vom Sprachagentendienst zurückgegeben werden.
Eigenschaften
| conversation_id | Zu welchem Gespräch die Antwort hinzugefügt wird, wird durch das |
| id | Die eindeutige ID der Antwort sieht so aus |
| max_output_tokens | Maximale Anzahl von Ausgabetoken für eine einzelne Assistentenantwort, einschließlich der Tool-Aufrufe, die in dieser Antwort verwendet wurde. |
| metadata | Benutzerdefinierte Schlüssel-Wert-Paare, die mit der Antwort assoziiert sind. |
| object | Der Objekttyp muss sein |
| output_modalities | Die Menge der Modalitäten, die das Modell zur Antwort verwendet hat, sind |
| status | Der Endstatus der Antwort ( |
| status_details | Weitere Details zum Status. |
| usage | Nutzungsstatistiken für die Antwort, das entspricht der Abrechnung. Eine Echtzeit-API-Sitzung verwaltet einen Gesprächskontext und fügt neue Items an die Konversation hinzu, sodass Ausgaben aus vorherigen Runden (Text- und Audio-Tokens) die Eingabe für spätere Runden werden. |
Details zur Eigenschaft
conversation_id
Zu welchem Gespräch die Antwort hinzugefügt wird, wird durch das conversation Feld des jeweiligen response.create Ereignisses bestimmt. Wenn auto, wird die Antwort zur Standardkonversation hinzugefügt und der Wert von conversation_id ist ein id wie conv_1234. Wenn none, wird die Antwort zu keinem Gespräch hinzugefügt und der Wert von conversation_id beträgt null. Wenn Antworten automatisch durch VAD ausgelöst werden, wird die Antwort zur Standardkonversation hinzugefügt
conversation_id?: string
Eigenschaftswert
string
id
Die eindeutige ID der Antwort sieht so aus resp_1234.
id?: string
Eigenschaftswert
string
max_output_tokens
Maximale Anzahl von Ausgabetoken für eine einzelne Assistentenantwort, einschließlich der Tool-Aufrufe, die in dieser Antwort verwendet wurde.
max_output_tokens?: number | "inf"
Eigenschaftswert
number | "inf"
metadata
Benutzerdefinierte Schlüssel-Wert-Paare, die mit der Antwort assoziiert sind.
metadata?: Metadata
Eigenschaftswert
object
Der Objekttyp muss sein realtime.response.
object?: "realtime.response"
Eigenschaftswert
"realtime.response"
output_modalities
Die Menge der Modalitäten, die das Modell zur Antwort verwendet hat, sind [\"audio\"]derzeit die einzigen möglichen Werte , [\"text\"]. Die Audioausgabe enthält immer ein Texttranskript. Wenn man den Ausgang auf Modus text stellt, wird der Audioausgang des Modells deaktiviert.
output_modalities?: ("text" | "audio")[]
Eigenschaftswert
("text" | "audio")[]
status
Der Endstatus der Antwort (completed, cancelled, failed, oder incomplete, in_progress).
status?: "failed" | "in_progress" | "cancelled" | "completed" | "incomplete"
Eigenschaftswert
"failed" | "in_progress" | "cancelled" | "completed" | "incomplete"
status_details
Weitere Details zum Status.
status_details?: RealtimeResponseStatusDetails
Eigenschaftswert
usage
Nutzungsstatistiken für die Antwort, das entspricht der Abrechnung. Eine Echtzeit-API-Sitzung verwaltet einen Gesprächskontext und fügt neue Items an die Konversation hinzu, sodass Ausgaben aus vorherigen Runden (Text- und Audio-Tokens) die Eingabe für spätere Runden werden.
usage?: RealtimeResponseUsage