VoiceAgentResponseCreateParams interface

Parameter, die von einem Voice-Agent-Ereignis response.create akzeptiert werden.

Eigenschaften

audio

Reaktionsspezifische Audioeinstellungen.

conversation

Kontrolliert, zu welchem Gespräch die Antwort hinzugefügt wird. Derzeit unterstützt auto und none, mit auto als Standardwert. Der Wert auto bedeutet, dass der Inhalt der Antwort zur Standardkonversation hinzugefügt wird. Setze dies auf none eine Out-of-Band-Antwort, die keine Elemente zum Standardgespräch hinzufügt.

input

Gesprächspunkte werden als Inline-Antworteingabe verwendet.

instructions

Die standardmäßigen Systemanweisungen (d. h. Systemmeldungen) werden den Modellaufrufen vorangestellt. Dieses Feld ermöglicht es dem Client, das Modell auf die gewünschten Antworten zu leiten. Das Modell kann zu Antwortinhalten und -formaten angewiesen werden (z. B. "sehr prägnant", "freundlich verhalten", "hier sind Beispiele für gute Antworten") und über Audioverhalten (z. B. "schnell sprechen", "Emotionen in die Stimme einfügen", "häufig lachen"). Es kann nicht garantiert werden, dass die Anweisungen vom Modell befolgt werden, aber sie bieten dem Modell eine Orientierung für das gewünschte Verhalten. Beachten Sie, dass der Server Standardanweisungen festlegt, die verwendet werden, wenn dieses Feld nicht festgelegt ist und im session.created Ereignis zu Beginn der Sitzung sichtbar ist.

interim_response

Zwischenantwort-Einstellungen für diese Antwort.

max_output_tokens

Maximale Anzahl von Ausgabetoken für eine einzelne Assistentenantwort, einschließlich Werkzeugaufrufe. Geben Sie eine ganze Zahl zwischen 1 und 4096 ein, um die Ausgabetoken zu begrenzen, oder verwenden Sie inf für die maximal verfügbaren Token eines bestimmten Modells. Wird standardmäßig auf inf festgelegt.

metadata

Benutzerdefinierte Schlüssel-Wert-Paare, die mit der Antwort verknüpft werden.

output_modalities

Modalitäten, in denen die Antwort zurückkehren könnte.

parallel_tool_calls

Ob das Modell mehrere Werkzeuge parallel aufrufen kann. Nur unterstützt durch das Schließen von Echtzeitmodellen wie gpt-realtime-2.

pre_generated_assistant_message

Eine vorgefertigte Assistentennachricht wurde verwendet, um die Antwort zu beginnen.

reasoning

Argumentationseinstellungen für die Antwort bei Verwendung eines schlussfolgerfähigen Echtzeitmodells.

tools

Tools, die für das Modell verfügbar sind.

tool_choice

Wie das Modell Tools auswäht. Stellen Sie einen der String-Modi bereit oder erzwingen Sie eine bestimmte Funktion/MCP-Tool.

Details zur Eigenschaft

audio

Reaktionsspezifische Audioeinstellungen.

audio?: PickPropertiesVoiceAgentAudioConfig

Eigenschaftswert

conversation

Kontrolliert, zu welchem Gespräch die Antwort hinzugefügt wird. Derzeit unterstützt auto und none, mit auto als Standardwert. Der Wert auto bedeutet, dass der Inhalt der Antwort zur Standardkonversation hinzugefügt wird. Setze dies auf none eine Out-of-Band-Antwort, die keine Elemente zum Standardgespräch hinzufügt.

conversation?: "auto" | "none"

Eigenschaftswert

"auto" | "none"

input

Gesprächspunkte werden als Inline-Antworteingabe verwendet.

input?: RealtimeConversationItemUnion[]

Eigenschaftswert

instructions

Die standardmäßigen Systemanweisungen (d. h. Systemmeldungen) werden den Modellaufrufen vorangestellt. Dieses Feld ermöglicht es dem Client, das Modell auf die gewünschten Antworten zu leiten. Das Modell kann zu Antwortinhalten und -formaten angewiesen werden (z. B. "sehr prägnant", "freundlich verhalten", "hier sind Beispiele für gute Antworten") und über Audioverhalten (z. B. "schnell sprechen", "Emotionen in die Stimme einfügen", "häufig lachen"). Es kann nicht garantiert werden, dass die Anweisungen vom Modell befolgt werden, aber sie bieten dem Modell eine Orientierung für das gewünschte Verhalten. Beachten Sie, dass der Server Standardanweisungen festlegt, die verwendet werden, wenn dieses Feld nicht festgelegt ist und im session.created Ereignis zu Beginn der Sitzung sichtbar ist.

instructions?: string

Eigenschaftswert

string

interim_response

Zwischenantwort-Einstellungen für diese Antwort.

interim_response?: VoiceAgentInterimResponseConfigUnion

Eigenschaftswert

max_output_tokens

Maximale Anzahl von Ausgabetoken für eine einzelne Assistentenantwort, einschließlich Werkzeugaufrufe. Geben Sie eine ganze Zahl zwischen 1 und 4096 ein, um die Ausgabetoken zu begrenzen, oder verwenden Sie inf für die maximal verfügbaren Token eines bestimmten Modells. Wird standardmäßig auf inf festgelegt.

max_output_tokens?: number | "inf"

Eigenschaftswert

number | "inf"

metadata

Benutzerdefinierte Schlüssel-Wert-Paare, die mit der Antwort verknüpft werden.

metadata?: Metadata

Eigenschaftswert

output_modalities

Modalitäten, in denen die Antwort zurückkehren könnte.

output_modalities?: VoiceOutputModality[]

Eigenschaftswert

parallel_tool_calls

Ob das Modell mehrere Werkzeuge parallel aufrufen kann. Nur unterstützt durch das Schließen von Echtzeitmodellen wie gpt-realtime-2.

parallel_tool_calls?: boolean

Eigenschaftswert

boolean

pre_generated_assistant_message

Eine vorgefertigte Assistentennachricht wurde verwendet, um die Antwort zu beginnen.

pre_generated_assistant_message?: RealtimeConversationItemUnion

Eigenschaftswert

reasoning

Argumentationseinstellungen für die Antwort bei Verwendung eines schlussfolgerfähigen Echtzeitmodells.

reasoning?: RealtimeReasoning

Eigenschaftswert

tools

Tools, die für das Modell verfügbar sind.

tools?: (MCPTool | RealtimeFunctionTool)[]

Eigenschaftswert

tool_choice

Wie das Modell Tools auswäht. Stellen Sie einen der String-Modi bereit oder erzwingen Sie eine bestimmte Funktion/MCP-Tool.

tool_choice?: ToolChoiceFunction | ToolChoiceMCP | ToolChoiceOptions

Eigenschaftswert