VoiceAgentResponseCreateParams interface

Parámetros aceptados por un evento de agente response.create de voz.

Propiedades

audio

Ajustes de audio específicos para respuesta.

conversation

Controla a qué conversación se añade la respuesta. Actualmente soporta auto y none, con auto el valor por defecto. El auto valor significa que el contenido de la respuesta se añadirá a la conversación predeterminada. Configura esto para none crear una respuesta fuera de banda que no añada elementos a la conversación predeterminada.

input

Elementos de conversación usados como entrada de respuesta en línea.

instructions

Las instrucciones del sistema predeterminadas (es decir, el mensaje del sistema) se anteponen a las llamadas de modelo. Este campo permite al cliente guiar el modelo en las respuestas deseadas. El modelo se puede instruir sobre el contenido y el formato de la respuesta (por ejemplo, "ser extremadamente conciso", "actuar de manera amistosa", "aquí hay ejemplos de buenas respuestas") y en el comportamiento de audio (por ejemplo, "hablar rápidamente", "poner emoción en su voz", "reír con frecuencia"). No se garantiza que el modelo siga las instrucciones, pero proporcionan instrucciones para el modelo en el comportamiento deseado. Tenga en cuenta que el servidor establece instrucciones predeterminadas que se usarán si este campo no está establecido y están visibles en el session.created evento al inicio de la sesión.

interim_response

Ajustes de respuesta intermedia para esta respuesta.

max_output_tokens

Número máximo de tokens de salida para una respuesta de un solo asistente, incluyendo llamadas a herramientas. Proporcione un entero entre 1 y 4096 para limitar los tokens de salida o inf para el número máximo de tokens disponibles para un modelo determinado. Tiene como valor predeterminado inf.

metadata

Pares clave-valor personalizados para asociar con la respuesta.

output_modalities

Modalidades que la respuesta puede devolver.

parallel_tool_calls

Si el modelo puede llamar a múltiples herramientas en paralelo. Solo soportado por modelos de razonamiento en tiempo real como gpt-realtime-2.

pre_generated_assistant_message

Un mensaje de asistente pregenerado se usaba para comenzar la respuesta.

reasoning

Ajustes de razonamiento para la respuesta cuando se utiliza un modelo de tiempo real con capacidad de razonamiento.

tools

Herramientas disponibles para el modelo.

tool_choice

Cómo elige el modelo las herramientas. Proporciona uno de los modos de cadena o fuerza una función o herramienta MCP específica.

Detalles de las propiedades

audio

Ajustes de audio específicos para respuesta.

audio?: PickPropertiesVoiceAgentAudioConfig

Valor de propiedad

conversation

Controla a qué conversación se añade la respuesta. Actualmente soporta auto y none, con auto el valor por defecto. El auto valor significa que el contenido de la respuesta se añadirá a la conversación predeterminada. Configura esto para none crear una respuesta fuera de banda que no añada elementos a la conversación predeterminada.

conversation?: "auto" | "none"

Valor de propiedad

"auto" | "none"

input

Elementos de conversación usados como entrada de respuesta en línea.

input?: RealtimeConversationItemUnion[]

Valor de propiedad

instructions

Las instrucciones del sistema predeterminadas (es decir, el mensaje del sistema) se anteponen a las llamadas de modelo. Este campo permite al cliente guiar el modelo en las respuestas deseadas. El modelo se puede instruir sobre el contenido y el formato de la respuesta (por ejemplo, "ser extremadamente conciso", "actuar de manera amistosa", "aquí hay ejemplos de buenas respuestas") y en el comportamiento de audio (por ejemplo, "hablar rápidamente", "poner emoción en su voz", "reír con frecuencia"). No se garantiza que el modelo siga las instrucciones, pero proporcionan instrucciones para el modelo en el comportamiento deseado. Tenga en cuenta que el servidor establece instrucciones predeterminadas que se usarán si este campo no está establecido y están visibles en el session.created evento al inicio de la sesión.

instructions?: string

Valor de propiedad

string

interim_response

Ajustes de respuesta intermedia para esta respuesta.

interim_response?: VoiceAgentInterimResponseConfigUnion

Valor de propiedad

max_output_tokens

Número máximo de tokens de salida para una respuesta de un solo asistente, incluyendo llamadas a herramientas. Proporcione un entero entre 1 y 4096 para limitar los tokens de salida o inf para el número máximo de tokens disponibles para un modelo determinado. Tiene como valor predeterminado inf.

max_output_tokens?: number | "inf"

Valor de propiedad

number | "inf"

metadata

Pares clave-valor personalizados para asociar con la respuesta.

metadata?: Metadata

Valor de propiedad

output_modalities

Modalidades que la respuesta puede devolver.

output_modalities?: VoiceOutputModality[]

Valor de propiedad

parallel_tool_calls

Si el modelo puede llamar a múltiples herramientas en paralelo. Solo soportado por modelos de razonamiento en tiempo real como gpt-realtime-2.

parallel_tool_calls?: boolean

Valor de propiedad

boolean

pre_generated_assistant_message

Un mensaje de asistente pregenerado se usaba para comenzar la respuesta.

pre_generated_assistant_message?: RealtimeConversationItemUnion

Valor de propiedad

reasoning

Ajustes de razonamiento para la respuesta cuando se utiliza un modelo de tiempo real con capacidad de razonamiento.

reasoning?: RealtimeReasoning

Valor de propiedad

tools

Herramientas disponibles para el modelo.

tools?: (MCPTool | RealtimeFunctionTool)[]

Valor de propiedad

tool_choice

Cómo elige el modelo las herramientas. Proporciona uno de los modos de cadena o fuerza una función o herramienta MCP específica.

tool_choice?: ToolChoiceFunction | ToolChoiceMCP | ToolChoiceOptions

Valor de propiedad