VoiceAgentResponseCreateParams interface
Parameter, die von einem Voice-Agent-Ereignis response.create akzeptiert werden.
Eigenschaften
| audio | Reaktionsspezifische Audioeinstellungen. |
| conversation | Kontrolliert, zu welchem Gespräch die Antwort hinzugefügt wird. Derzeit unterstützt |
| input | Gesprächspunkte werden als Inline-Antworteingabe verwendet. |
| instructions | Die standardmäßigen Systemanweisungen (d. h. Systemmeldungen) werden den Modellaufrufen vorangestellt. Dieses Feld ermöglicht es dem Client, das Modell auf die gewünschten Antworten zu leiten. Das Modell kann zu Antwortinhalten und -formaten angewiesen werden (z. B. "sehr prägnant", "freundlich verhalten", "hier sind Beispiele für gute Antworten") und über Audioverhalten (z. B. "schnell sprechen", "Emotionen in die Stimme einfügen", "häufig lachen"). Es kann nicht garantiert werden, dass die Anweisungen vom Modell befolgt werden, aber sie bieten dem Modell eine Orientierung für das gewünschte Verhalten.
Beachten Sie, dass der Server Standardanweisungen festlegt, die verwendet werden, wenn dieses Feld nicht festgelegt ist und im |
| interim_response | Zwischenantwort-Einstellungen für diese Antwort. |
| max_output_tokens | Maximale Anzahl von Ausgabetoken für eine einzelne Assistentenantwort, einschließlich Werkzeugaufrufe. Geben Sie eine ganze Zahl zwischen 1 und 4096 ein, um die Ausgabetoken zu begrenzen, oder verwenden Sie |
| metadata | Benutzerdefinierte Schlüssel-Wert-Paare, die mit der Antwort verknüpft werden. |
| output_modalities | Modalitäten, in denen die Antwort zurückkehren könnte. |
| parallel_tool_calls | Ob das Modell mehrere Werkzeuge parallel aufrufen kann. Nur unterstützt durch das Schließen von Echtzeitmodellen wie |
| pre_generated_assistant_message | Eine vorgefertigte Assistentennachricht wurde verwendet, um die Antwort zu beginnen. |
| reasoning | Argumentationseinstellungen für die Antwort bei Verwendung eines schlussfolgerfähigen Echtzeitmodells. |
| tools | Tools, die für das Modell verfügbar sind. |
| tool_choice | Wie das Modell Tools auswäht. Stellen Sie einen der String-Modi bereit oder erzwingen Sie eine bestimmte Funktion/MCP-Tool. |
Details zur Eigenschaft
audio
Reaktionsspezifische Audioeinstellungen.
audio?: PickPropertiesVoiceAgentAudioConfig
Eigenschaftswert
conversation
Kontrolliert, zu welchem Gespräch die Antwort hinzugefügt wird. Derzeit unterstützt auto und none, mit auto als Standardwert. Der Wert auto bedeutet, dass der Inhalt der Antwort zur Standardkonversation hinzugefügt wird. Setze dies auf none eine Out-of-Band-Antwort, die keine Elemente zum Standardgespräch hinzufügt.
conversation?: "auto" | "none"
Eigenschaftswert
"auto" | "none"
input
Gesprächspunkte werden als Inline-Antworteingabe verwendet.
input?: RealtimeConversationItemUnion[]
Eigenschaftswert
instructions
Die standardmäßigen Systemanweisungen (d. h. Systemmeldungen) werden den Modellaufrufen vorangestellt. Dieses Feld ermöglicht es dem Client, das Modell auf die gewünschten Antworten zu leiten. Das Modell kann zu Antwortinhalten und -formaten angewiesen werden (z. B. "sehr prägnant", "freundlich verhalten", "hier sind Beispiele für gute Antworten") und über Audioverhalten (z. B. "schnell sprechen", "Emotionen in die Stimme einfügen", "häufig lachen"). Es kann nicht garantiert werden, dass die Anweisungen vom Modell befolgt werden, aber sie bieten dem Modell eine Orientierung für das gewünschte Verhalten.
Beachten Sie, dass der Server Standardanweisungen festlegt, die verwendet werden, wenn dieses Feld nicht festgelegt ist und im session.created Ereignis zu Beginn der Sitzung sichtbar ist.
instructions?: string
Eigenschaftswert
string
interim_response
Zwischenantwort-Einstellungen für diese Antwort.
interim_response?: VoiceAgentInterimResponseConfigUnion
Eigenschaftswert
max_output_tokens
Maximale Anzahl von Ausgabetoken für eine einzelne Assistentenantwort, einschließlich Werkzeugaufrufe. Geben Sie eine ganze Zahl zwischen 1 und 4096 ein, um die Ausgabetoken zu begrenzen, oder verwenden Sie inf für die maximal verfügbaren Token eines bestimmten Modells. Wird standardmäßig auf inf festgelegt.
max_output_tokens?: number | "inf"
Eigenschaftswert
number | "inf"
metadata
Benutzerdefinierte Schlüssel-Wert-Paare, die mit der Antwort verknüpft werden.
metadata?: Metadata
Eigenschaftswert
output_modalities
Modalitäten, in denen die Antwort zurückkehren könnte.
output_modalities?: VoiceOutputModality[]
Eigenschaftswert
parallel_tool_calls
Ob das Modell mehrere Werkzeuge parallel aufrufen kann. Nur unterstützt durch das Schließen von Echtzeitmodellen wie gpt-realtime-2.
parallel_tool_calls?: boolean
Eigenschaftswert
boolean
pre_generated_assistant_message
Eine vorgefertigte Assistentennachricht wurde verwendet, um die Antwort zu beginnen.
pre_generated_assistant_message?: RealtimeConversationItemUnion
Eigenschaftswert
reasoning
Argumentationseinstellungen für die Antwort bei Verwendung eines schlussfolgerfähigen Echtzeitmodells.
reasoning?: RealtimeReasoning
Eigenschaftswert
tools
Tools, die für das Modell verfügbar sind.
tools?: (MCPTool | RealtimeFunctionTool)[]
Eigenschaftswert
(MCPTool | RealtimeFunctionTool)[]
tool_choice
Wie das Modell Tools auswäht. Stellen Sie einen der String-Modi bereit oder erzwingen Sie eine bestimmte Funktion/MCP-Tool.
tool_choice?: ToolChoiceFunction | ToolChoiceMCP | ToolChoiceOptions