VoiceAgentResponseCreateParams interface
Parametri accettati da un evento voice-agent response.create .
Proprietà
| audio | Impostazioni audio specifiche per la risposta. |
| conversation | Controlla a quale conversazione viene aggiunta la risposta. Attualmente supporta |
| input | Elementi di conversazione usati come input di risposta in linea. |
| instructions | Le istruzioni di sistema predefinite (ad esempio il messaggio di sistema) vengono anteposte alle chiamate del modello. Questo campo consente al client di guidare il modello sulle risposte desiderate. Il modello può essere indicato sul contenuto e sul formato della risposta( ad esempio "essere estremamente succinti", "agire amichevole", "ecco esempi di buone risposte") e sul comportamento audio (ad esempio "parlare rapidamente", "inserire emozioni nella voce", "ridere frequentemente"). Le istruzioni non sono sicuramente seguite dal modello, ma forniscono indicazioni al modello sul comportamento desiderato.
Si noti che il server imposta le istruzioni predefinite che verranno utilizzate se questo campo non è impostato e sono visibili nell'evento all'inizio |
| interim_response | Impostazioni di risposta intermedia per questa risposta. |
| max_output_tokens | Numero massimo di token di output per una singola risposta di assistente, inclusi i call degli strumenti. Specificare un numero intero compreso tra 1 e 4096 per limitare i token di output o |
| metadata | Coppie chiave-valore stringhe personalizzate da associare alla risposta. |
| output_modalities | Modalità a cui la risposta può restituire. |
| parallel_tool_calls | Se il modello può chiamare più strumenti in parallelo. Supportati solo da modelli Realtime di ragionamento come |
| pre_generated_assistant_message | Un messaggio assistente pre-generato usato per iniziare la risposta. |
| reasoning | Impostazioni di ragionamento per la risposta quando si utilizza un modello in tempo reale con capacità di ragionamento. |
| tools | Strumenti disponibili per il modello. |
| tool_choice | Modalità di scelta degli strumenti da parte del modello. Fornisci una delle modalità stringa o forzare una funzione specifica/strumento MCP. |
Dettagli proprietà
audio
Impostazioni audio specifiche per la risposta.
audio?: PickPropertiesVoiceAgentAudioConfig
Valore della proprietà
conversation
Controlla a quale conversazione viene aggiunta la risposta. Attualmente supporta auto e none, con auto come valore predefinito. Il auto valore significa che il contenuto della risposta verrà aggiunto alla conversazione predefinita. Imposta questo modo per none creare una risposta fuori banda che non aggiunga elementi alla conversazione predefinita.
conversation?: "auto" | "none"
Valore della proprietà
"auto" | "none"
input
Elementi di conversazione usati come input di risposta in linea.
input?: RealtimeConversationItemUnion[]
Valore della proprietà
instructions
Le istruzioni di sistema predefinite (ad esempio il messaggio di sistema) vengono anteposte alle chiamate del modello. Questo campo consente al client di guidare il modello sulle risposte desiderate. Il modello può essere indicato sul contenuto e sul formato della risposta( ad esempio "essere estremamente succinti", "agire amichevole", "ecco esempi di buone risposte") e sul comportamento audio (ad esempio "parlare rapidamente", "inserire emozioni nella voce", "ridere frequentemente"). Le istruzioni non sono sicuramente seguite dal modello, ma forniscono indicazioni al modello sul comportamento desiderato.
Si noti che il server imposta le istruzioni predefinite che verranno utilizzate se questo campo non è impostato e sono visibili nell'evento all'inizio session.created della sessione.
instructions?: string
Valore della proprietà
string
interim_response
Impostazioni di risposta intermedia per questa risposta.
interim_response?: VoiceAgentInterimResponseConfigUnion
Valore della proprietà
max_output_tokens
Numero massimo di token di output per una singola risposta di assistente, inclusi i call degli strumenti. Specificare un numero intero compreso tra 1 e 4096 per limitare i token di output o inf per il numero massimo di token disponibili per un determinato modello. Di default è inf.
max_output_tokens?: number | "inf"
Valore della proprietà
number | "inf"
metadata
Coppie chiave-valore stringhe personalizzate da associare alla risposta.
metadata?: Metadata
Valore della proprietà
output_modalities
Modalità a cui la risposta può restituire.
output_modalities?: VoiceOutputModality[]
Valore della proprietà
parallel_tool_calls
Se il modello può chiamare più strumenti in parallelo. Supportati solo da modelli Realtime di ragionamento come gpt-realtime-2.
parallel_tool_calls?: boolean
Valore della proprietà
boolean
pre_generated_assistant_message
Un messaggio assistente pre-generato usato per iniziare la risposta.
pre_generated_assistant_message?: RealtimeConversationItemUnion
Valore della proprietà
reasoning
Impostazioni di ragionamento per la risposta quando si utilizza un modello in tempo reale con capacità di ragionamento.
reasoning?: RealtimeReasoning
Valore della proprietà
tools
Strumenti disponibili per il modello.
tools?: (MCPTool | RealtimeFunctionTool)[]
Valore della proprietà
(MCPTool | RealtimeFunctionTool)[]
tool_choice
Modalità di scelta degli strumenti da parte del modello. Fornisci una delle modalità stringa o forzare una funzione specifica/strumento MCP.
tool_choice?: ToolChoiceFunction | ToolChoiceMCP | ToolChoiceOptions