VoiceAgentResponseCreateParams interface
Parámetros aceptados por un evento de agente response.create de voz.
Propiedades
| audio | Ajustes de audio específicos para respuesta. |
| conversation | Controla a qué conversación se añade la respuesta. Actualmente soporta |
| input | Elementos de conversación usados como entrada de respuesta en línea. |
| instructions | Las instrucciones del sistema predeterminadas (es decir, el mensaje del sistema) se anteponen a las llamadas de modelo. Este campo permite al cliente guiar el modelo en las respuestas deseadas. El modelo se puede instruir sobre el contenido y el formato de la respuesta (por ejemplo, "ser extremadamente conciso", "actuar de manera amistosa", "aquí hay ejemplos de buenas respuestas") y en el comportamiento de audio (por ejemplo, "hablar rápidamente", "poner emoción en su voz", "reír con frecuencia"). No se garantiza que el modelo siga las instrucciones, pero proporcionan instrucciones para el modelo en el comportamiento deseado.
Tenga en cuenta que el servidor establece instrucciones predeterminadas que se usarán si este campo no está establecido y están visibles en el |
| interim_response | Ajustes de respuesta intermedia para esta respuesta. |
| max_output_tokens | Número máximo de tokens de salida para una respuesta de un solo asistente, incluyendo llamadas a herramientas. Proporcione un entero entre 1 y 4096 para limitar los tokens de salida o |
| metadata | Pares clave-valor personalizados para asociar con la respuesta. |
| output_modalities | Modalidades que la respuesta puede devolver. |
| parallel_tool_calls | Si el modelo puede llamar a múltiples herramientas en paralelo. Solo soportado por modelos de razonamiento en tiempo real como |
| pre_generated_assistant_message | Un mensaje de asistente pregenerado se usaba para comenzar la respuesta. |
| reasoning | Ajustes de razonamiento para la respuesta cuando se utiliza un modelo de tiempo real con capacidad de razonamiento. |
| tools | Herramientas disponibles para el modelo. |
| tool_choice | Cómo elige el modelo las herramientas. Proporciona uno de los modos de cadena o fuerza una función o herramienta MCP específica. |
Detalles de las propiedades
audio
Ajustes de audio específicos para respuesta.
audio?: PickPropertiesVoiceAgentAudioConfig
Valor de propiedad
conversation
Controla a qué conversación se añade la respuesta. Actualmente soporta auto y none, con auto el valor por defecto. El auto valor significa que el contenido de la respuesta se añadirá a la conversación predeterminada. Configura esto para none crear una respuesta fuera de banda que no añada elementos a la conversación predeterminada.
conversation?: "auto" | "none"
Valor de propiedad
"auto" | "none"
input
Elementos de conversación usados como entrada de respuesta en línea.
input?: RealtimeConversationItemUnion[]
Valor de propiedad
instructions
Las instrucciones del sistema predeterminadas (es decir, el mensaje del sistema) se anteponen a las llamadas de modelo. Este campo permite al cliente guiar el modelo en las respuestas deseadas. El modelo se puede instruir sobre el contenido y el formato de la respuesta (por ejemplo, "ser extremadamente conciso", "actuar de manera amistosa", "aquí hay ejemplos de buenas respuestas") y en el comportamiento de audio (por ejemplo, "hablar rápidamente", "poner emoción en su voz", "reír con frecuencia"). No se garantiza que el modelo siga las instrucciones, pero proporcionan instrucciones para el modelo en el comportamiento deseado.
Tenga en cuenta que el servidor establece instrucciones predeterminadas que se usarán si este campo no está establecido y están visibles en el session.created evento al inicio de la sesión.
instructions?: string
Valor de propiedad
string
interim_response
Ajustes de respuesta intermedia para esta respuesta.
interim_response?: VoiceAgentInterimResponseConfigUnion
Valor de propiedad
max_output_tokens
Número máximo de tokens de salida para una respuesta de un solo asistente, incluyendo llamadas a herramientas. Proporcione un entero entre 1 y 4096 para limitar los tokens de salida o inf para el número máximo de tokens disponibles para un modelo determinado. Tiene como valor predeterminado inf.
max_output_tokens?: number | "inf"
Valor de propiedad
number | "inf"
metadata
Pares clave-valor personalizados para asociar con la respuesta.
metadata?: Metadata
Valor de propiedad
output_modalities
Modalidades que la respuesta puede devolver.
output_modalities?: VoiceOutputModality[]
Valor de propiedad
parallel_tool_calls
Si el modelo puede llamar a múltiples herramientas en paralelo. Solo soportado por modelos de razonamiento en tiempo real como gpt-realtime-2.
parallel_tool_calls?: boolean
Valor de propiedad
boolean
pre_generated_assistant_message
Un mensaje de asistente pregenerado se usaba para comenzar la respuesta.
pre_generated_assistant_message?: RealtimeConversationItemUnion
Valor de propiedad
reasoning
Ajustes de razonamiento para la respuesta cuando se utiliza un modelo de tiempo real con capacidad de razonamiento.
reasoning?: RealtimeReasoning
Valor de propiedad
tools
Herramientas disponibles para el modelo.
tools?: (MCPTool | RealtimeFunctionTool)[]
Valor de propiedad
(MCPTool | RealtimeFunctionTool)[]
tool_choice
Cómo elige el modelo las herramientas. Proporciona uno de los modos de cadena o fuerza una función o herramienta MCP específica.
tool_choice?: ToolChoiceFunction | ToolChoiceMCP | ToolChoiceOptions