VoiceAgentResponseCreateParams interface

Parametri accettati da un evento voice-agent response.create .

Proprietà

audio

Impostazioni audio specifiche per la risposta.

conversation

Controlla a quale conversazione viene aggiunta la risposta. Attualmente supporta auto e none, con auto come valore predefinito. Il auto valore significa che il contenuto della risposta verrà aggiunto alla conversazione predefinita. Imposta questo modo per none creare una risposta fuori banda che non aggiunga elementi alla conversazione predefinita.

input

Elementi di conversazione usati come input di risposta in linea.

instructions

Le istruzioni di sistema predefinite (ad esempio il messaggio di sistema) vengono anteposte alle chiamate del modello. Questo campo consente al client di guidare il modello sulle risposte desiderate. Il modello può essere indicato sul contenuto e sul formato della risposta( ad esempio "essere estremamente succinti", "agire amichevole", "ecco esempi di buone risposte") e sul comportamento audio (ad esempio "parlare rapidamente", "inserire emozioni nella voce", "ridere frequentemente"). Le istruzioni non sono sicuramente seguite dal modello, ma forniscono indicazioni al modello sul comportamento desiderato. Si noti che il server imposta le istruzioni predefinite che verranno utilizzate se questo campo non è impostato e sono visibili nell'evento all'inizio session.created della sessione.

interim_response

Impostazioni di risposta intermedia per questa risposta.

max_output_tokens

Numero massimo di token di output per una singola risposta di assistente, inclusi i call degli strumenti. Specificare un numero intero compreso tra 1 e 4096 per limitare i token di output o inf per il numero massimo di token disponibili per un determinato modello. Di default è inf.

metadata

Coppie chiave-valore stringhe personalizzate da associare alla risposta.

output_modalities

Modalità a cui la risposta può restituire.

parallel_tool_calls

Se il modello può chiamare più strumenti in parallelo. Supportati solo da modelli Realtime di ragionamento come gpt-realtime-2.

pre_generated_assistant_message

Un messaggio assistente pre-generato usato per iniziare la risposta.

reasoning

Impostazioni di ragionamento per la risposta quando si utilizza un modello in tempo reale con capacità di ragionamento.

tools

Strumenti disponibili per il modello.

tool_choice

Modalità di scelta degli strumenti da parte del modello. Fornisci una delle modalità stringa o forzare una funzione specifica/strumento MCP.

Dettagli proprietà

audio

Impostazioni audio specifiche per la risposta.

audio?: PickPropertiesVoiceAgentAudioConfig

Valore della proprietà

conversation

Controlla a quale conversazione viene aggiunta la risposta. Attualmente supporta auto e none, con auto come valore predefinito. Il auto valore significa che il contenuto della risposta verrà aggiunto alla conversazione predefinita. Imposta questo modo per none creare una risposta fuori banda che non aggiunga elementi alla conversazione predefinita.

conversation?: "auto" | "none"

Valore della proprietà

"auto" | "none"

input

Elementi di conversazione usati come input di risposta in linea.

input?: RealtimeConversationItemUnion[]

Valore della proprietà

instructions

Le istruzioni di sistema predefinite (ad esempio il messaggio di sistema) vengono anteposte alle chiamate del modello. Questo campo consente al client di guidare il modello sulle risposte desiderate. Il modello può essere indicato sul contenuto e sul formato della risposta( ad esempio "essere estremamente succinti", "agire amichevole", "ecco esempi di buone risposte") e sul comportamento audio (ad esempio "parlare rapidamente", "inserire emozioni nella voce", "ridere frequentemente"). Le istruzioni non sono sicuramente seguite dal modello, ma forniscono indicazioni al modello sul comportamento desiderato. Si noti che il server imposta le istruzioni predefinite che verranno utilizzate se questo campo non è impostato e sono visibili nell'evento all'inizio session.created della sessione.

instructions?: string

Valore della proprietà

string

interim_response

Impostazioni di risposta intermedia per questa risposta.

interim_response?: VoiceAgentInterimResponseConfigUnion

Valore della proprietà

max_output_tokens

Numero massimo di token di output per una singola risposta di assistente, inclusi i call degli strumenti. Specificare un numero intero compreso tra 1 e 4096 per limitare i token di output o inf per il numero massimo di token disponibili per un determinato modello. Di default è inf.

max_output_tokens?: number | "inf"

Valore della proprietà

number | "inf"

metadata

Coppie chiave-valore stringhe personalizzate da associare alla risposta.

metadata?: Metadata

Valore della proprietà

output_modalities

Modalità a cui la risposta può restituire.

output_modalities?: VoiceOutputModality[]

Valore della proprietà

parallel_tool_calls

Se il modello può chiamare più strumenti in parallelo. Supportati solo da modelli Realtime di ragionamento come gpt-realtime-2.

parallel_tool_calls?: boolean

Valore della proprietà

boolean

pre_generated_assistant_message

Un messaggio assistente pre-generato usato per iniziare la risposta.

pre_generated_assistant_message?: RealtimeConversationItemUnion

Valore della proprietà

reasoning

Impostazioni di ragionamento per la risposta quando si utilizza un modello in tempo reale con capacità di ragionamento.

reasoning?: RealtimeReasoning

Valore della proprietà

tools

Strumenti disponibili per il modello.

tools?: (MCPTool | RealtimeFunctionTool)[]

Valore della proprietà

tool_choice

Modalità di scelta degli strumenti da parte del modello. Fornisci una delle modalità stringa o forzare una funzione specifica/strumento MCP.

tool_choice?: ToolChoiceFunction | ToolChoiceMCP | ToolChoiceOptions

Valore della proprietà