microsoft-cognitiveservices-speech-sdk package

Clases

ActivityReceivedEventArgs

Define el contenido de los eventos o mensajes recibidos. ActivityReceivedEventArgs

AudioConfig

Representa la configuración de entrada de audio utilizada para especificar qué tipo de entrada se va a usar (micrófono, archivo, secuencia). AudioConfig actualizado en la versión 1.11.0

AudioInputStream

Representa el flujo de entrada de audio usado para configuraciones de entrada de audio personalizadas. AudioInputStream

AudioOutputStream

Representa el flujo de salida de audio usado para configuraciones de salida de audio personalizadas. AudioOutputStream

AudioStreamFormat

Representa el formato de secuencia de audio usado para configuraciones de entrada de audio personalizadas. AudioStreamFormat

AutoDetectSourceLanguageConfig

Detección automática de idioma. AutoDetectSourceLanguageConfig añadido en la versión 1.13.0.

AutoDetectSourceLanguageResult

Formato de salida AutoDetectSourceLanguageResult

AvatarConfig

Define la configuración del avatar de conversación. AvatarConfig añadido en la versión 1.33.0

Esta función es experimental y puede cambiar o tener un soporte limitado.

AvatarEventArgs

Define el contenido para los eventos de avatar de conversación. AvatarEventArgs añadido en la versión 1.33.0

Esta función es experimental y puede cambiar o tener un soporte limitado.

AvatarSceneConfig

Define la configuración de la escena del avatar para controlar la posición y orientación del avatar. AvatarSceneConfig Añadido en la versión 1.44.0

Esta función es experimental y puede cambiar o tener un soporte limitado.

AvatarSynthesizer

Define el sintetizador de avatares. AvatarSynthesizer añadido en la versión 1.33.0

Esta función es experimental y puede cambiar o tener un soporte limitado.

AvatarVideoFormat

Define el formato de vídeo de salida del avatar. AvatarVideoFormat añadido en la versión 1.33.0

Esta función es experimental y podría cambiar en el futuro.

AvatarWebRTCConnectionResult

Define el resultado de la conexión webRTC del avatar. AvatarWebRTCConnectionResult añadido en la versión 1.33.0

Esta función es experimental y podría cambiar en el futuro.

BaseAudioPlayer

Clase TODO del reproductor de audio base: reproduce solo PCM por ahora.

BotFrameworkConfig

Clase que define configuraciones para el objeto del conector del servicio de diálogo para usar un back-end de Bot Framework. BotFrameworkConfig

CancellationDetails

Contiene información detallada sobre por qué se canceló un resultado. CancellationDetails

CancellationDetailsBase

Contiene información detallada sobre por qué se canceló un resultado. CancellationDetailsBase

Connection

Connection es una clase de proxy para administrar la conexión al servicio de voz del reconocedor especificado. De forma predeterminada, un Reconocedor administra de forma autónoma la conexión con el servicio cuando sea necesario. La clase Connection proporciona métodos adicionales para que los usuarios abran o cierren explícitamente una conexión y para suscribirse a los cambios de estado de conexión. El uso de Connection es opcional y principalmente para escenarios en los que se necesita el ajuste preciso del comportamiento de la aplicación en función del estado de conexión. Los usuarios pueden llamar opcionalmente a Open() para configurar manualmente una conexión de antemano antes de iniciar el reconocimiento en el reconocedor asociado a esta conexión. Si Recognizer necesita conectarse o desconectarse al servicio, configurará o apagará la conexión de forma independiente. En este caso, el cambio de estado de conexión se notificará mediante el cambio de estado de conexión a través de eventos conectados o desconectados. Se agregó en la versión 1.2.1.

ConnectionEventArgs

Define la carga de los eventos de conexión, como Connected/Disconnected. Agregado en la versión 1.2.0

ConnectionMessage

ConnectionMessage representa los mensajes específicos de implementación enviados y recibidos del servicio de voz. Estos mensajes se proporcionan con fines de depuración y no deben usarse para casos de uso de producción con El servicio voz de Azure Cognitive Services. Los mensajes enviados y recibidos desde el servicio voz están sujetos a cambios sin previo aviso. Esto incluye contenido de mensajes, encabezados, cargas, pedidos, etc. Se agregó en la versión 1.11.0.

ConnectionMessageEventArgs
ConversationTranscriber

Realiza el reconocimiento de voz con separación del hablante del micrófono, el archivo u otras secuencias de entrada de audio y obtiene texto transcrito como resultado. Transcriptor de Conversaciones

ConversationTranscriptionCanceledEventArgs

Define el contenido de recognitionErrorEvent. ConversationTranscriptionCanceledEventArgs

ConversationTranscriptionEventArgs

Define el contenido del evento transcribido o transcribido de conversación. ConversationTranscriptionEventArgs

ConversationTranscriptionResult

Define el resultado de la transcripción de conversaciones. ConversationTranscriptionResult

Coordinate

Define una coordenada en el espacio 2D. Coordenadas añadidas en la versión 1.33.0

CustomCommandsConfig

Clase que define configuraciones para el objeto del conector de servicio de diálogo para usar un back-end CustomCommands. CustomCommandsConfig

Diagnostics

Define la API de diagnóstico para administrar la salida de la consola agregada en la versión 1.21.0

DialogServiceConfig

Clase que define configuraciones base para el conector de servicios de diálogo DialogServiceConfig

DialogServiceConnector

Conector de Servicio de Diálogo Conector de Servicios de Diálogo

KeywordRecognitionModel

Representa un modelo de reconocimiento de palabras clave para reconocer cuándo el usuario dice una palabra clave para iniciar el reconocimiento de voz adicional. KeywordRecognitionModel

Meeting
MeetingTranscriber
MeetingTranscriptionCanceledEventArgs

Define el contenido de un meetingTranscriptionCanceledEvent. MeetingTranscriptionCanceledEventArgs

MeetingTranscriptionEventArgs

Define el contenido del evento transcribido o transcribido de la reunión. MeetingTranscriptionEventArgs

NoMatchDetails

Contiene información detallada sobre los resultados del reconocimiento NoMatch. NoMatchDetails

Participant

Representa a un participante en una reunión. Agregado en la versión 1.4.0

PhraseListGrammar

Permite adiciones de nuevas frases para mejorar el reconocimiento de voz.

Las frases agregadas al reconocedor son efectivas al principio del siguiente reconocimiento o la próxima vez que SpeechSDK debe volver a conectarse al servicio de voz.

PronunciationAssessmentConfig

Configuración de evaluación de pronunciación. PronunciationAssessmentConfig Añadido en la versión 1.15.0.

PronunciationAssessmentResult

Resultados de la evaluación de pronunciación. PronunciationAssessmentResult añadido en la versión 1.15.0.

PropertyCollection

Representa la colección de propiedades y sus valores. Colección de Propiedades

PullAudioInputStream

Representa el flujo de entrada de audio usado para configuraciones de entrada de audio personalizadas. AudioInputStream

PullAudioInputStreamCallback

Clase base abstracta que define métodos de devolución de llamada (read() y close()) para secuencias de entrada de audio personalizadas). PullAudioInputStreamCallback

PullAudioOutputStream

Representa el flujo de salida de audio de inserción con respaldo de memoria usado para configuraciones de salida de audio personalizadas. PullAudioOutputStream

PushAudioInputStream

Representa el flujo de entrada de audio de inserción con respaldo de memoria usado para configuraciones de entrada de audio personalizadas. PushAudioInputStream

PushAudioOutputStream

Representa el flujo de salida de audio usado para configuraciones de salida de audio personalizadas. AudioOutputStream

PushAudioOutputStreamCallback

Clase base abstracta que define métodos de devolución de llamada (write() y close()) para secuencias de salida de audio personalizadas). PushAudioOutputStreamCallback

RecognitionEventArgs

Define la carga de los eventos de sesión, como inicio de voz o finalización detectados.

RecognitionResult

Define el resultado del reconocimiento de voz. RecognitionResult

Recognizer

Define la clase base Recognizer que contiene principalmente controladores de eventos comunes. Sistema de reconocimiento

ServiceEventArgs

Define la carga de cualquier evento de mensaje de servicio agregado en la versión 1.9.0.

SessionEventArgs

Define contenido para eventos de sesión como SessionStarted/Stopped, SoundStarted/Stopped. SessionEventArgs

SourceLanguageConfig

Configuración del idioma de origen. SourceLanguageConfig

SpeakerAudioDestination

Representa el destino de audio de reproducción del altavoz, que solo funciona en el explorador. Nota: el SDK intentará usar extensiones de origen multimedia para reproducir audio. El formato Mp3 tiene mejor compatibilidad con Microsoft Edge, Chrome y Safari (escritorio), por lo que es mejor especificar el formato mp3 para la reproducción. SpeakerAudioDestination Actualizado en la versión 1.17.0

SpeechConfig

Configuración de voz. SpeechConfig

SpeechConfigImpl

SpeechConfigImpl

SpeechRecognitionCanceledEventArgs
SpeechRecognitionEventArgs

Define el contenido del evento de reconocimiento o reconocimiento de voz. SpeechRecognitionEventArgs

SpeechRecognitionResult

Define el resultado del reconocimiento de voz. SpeechRecognitionResult

SpeechRecognizer

Realiza el reconocimiento de voz desde el micrófono, el archivo u otras secuencias de entrada de audio y obtiene texto transcrito como resultado. Reconocedor de voz

SpeechSynthesisBookmarkEventArgs

Define el contenido del evento de marcador de síntesis de voz. SpeechSynthesisBookmarkEventArgs añadido en la versión 1.16.0

SpeechSynthesisEventArgs

Define el contenido de los eventos de síntesis de voz. SpeechSynthesisEventArgs añadido en la versión 1.11.0

SpeechSynthesisRequest

Representa una solicitud de síntesis de voz con soporte para transmisión de texto. Nota: Esta clase está en versión preliminar y puede estar sujeta a cambios en versiones futuras. Solicitud de Síntesis de Voz

SpeechSynthesisRequestInputStream

Representa un flujo de entrada para el flujo de texto de la solicitud de síntesis de voz. Nota: Esta clase está en versión preliminar y puede estar sujeta a cambios en versiones futuras. VozSíntesisSolicitudInputStream

SpeechSynthesisResult

Define el resultado de la síntesis de voz. SpeechSynthesisResult añadido en la versión 1.11.0

SpeechSynthesisVisemeEventArgs

Define el contenido del evento viseme de síntesis de voz. SpeechSynthesisVisemeEventArgs añadido en la versión 1.16.0

SpeechSynthesisWordBoundaryEventArgs

Define el contenido del evento de límite de palabra de síntesis de voz. SpeechSynthesisWordBoundaryEventArgs añadido en la versión 1.11.0

SpeechSynthesizer

Define la clase SpeechSynthesizer para texto a voz. Actualizado en la versión 1.16.0 SpeechSynthesizer

SpeechTranslationConfig

Configuración de traducción de voz. Configuración de Traducción de Voz

SynthesisResult

Clase base para resultados de síntesis Resultado de síntesis añadida en la versión 1.20.0

SynthesisVoicesResult

Define el resultado de la síntesis de voz. SynthesisVoicesResult añadido en la versión 1.20.0

Synthesizer
TranslationRecognitionCanceledEventArgs

Defina la carga de los eventos de resultados cancelados del reconocimiento de voz. TranslationRecognitionCanceledEventArgs

TranslationRecognitionEventArgs

Argumentos de evento de resultado de texto de traducción. TranslationRecognitionEventArgs

TranslationRecognitionResult

Resultado del texto de traducción. TranslationRecognitionResult

TranslationRecognizer

Reconocedor de traducción Reconocedor de traducción

TranslationSynthesisEventArgs

Argumentos de eventos de síntesis de traducción TranslationSynthesisEventArgs

TranslationSynthesisResult

Define el resultado de la síntesis de traducción, es decir, la salida de voz del texto traducido en el idioma de destino. TranslationSynthesisResult

Translations

Representa la colección de parámetros y sus valores. Traducciones

TurnStatusReceivedEventArgs

Define el contenido de los eventos o mensajes recibidos. TurnStatusReceivedEventArgs

User
VoiceInfo

Información sobre la voz de síntesis de voz agregada en la versión 1.20.0. VoiceInfo

Interfaces

CancellationEventArgs
IParticipant

Representa a un participante en una reunión. Agregado en la versión 1.4.0

IPlayer

Representa la interfaz del reproductor de audio para controlar la reproducción de audio, como pausa, reanudación, etc. IPlayer Añadido en la versión 1.12.0

IVoiceJson
MeetingInfo
VoiceSignature

Enumeraciones

AudioFormatTag
CancellationErrorCode

Define el código de error en caso de que CancellationReason sea Error. Se agregó en la versión 1.1.0.

CancellationReason

Define las posibles razones por las que se puede cancelar un resultado de reconocimiento. CancellationReason

LanguageIdMode

Modo de identificación de idiomas LanguageIdMode

LogLevel
NoMatchReason

Define las posibles razones por las que es posible que no se reconozca un resultado de reconocimiento. NoMatchReason

OutputFormat

Defina los formatos de salida de Speech Recognizer. OutputFormat

ProfanityOption

Opción soece. Se agregó en la versión 1.7.0.

PronunciationAssessmentGradingSystem

Define el sistema de puntos para la calibración de la puntuación de pronunciación; el valor predeterminado es FivePoint. Añadido en la versión 1.15.0 Sistema de Calificación de Evaluación de Pronunciación

PronunciationAssessmentGranularity

Define la granularidad de evaluación de pronunciación; el valor predeterminado es Phoneme. Añadido en la versión 1.15.0 PronunciaciónEvaluaciónGranularidad

PropertyId

Define los identificadores de propiedad de voz. PropertyId

ResultReason

Define las posibles razones por las que se puede generar un resultado de reconocimiento. Razón del Resultado

ServicePropertyChannel

Define los canales usados para pasar la configuración de propiedades al servicio. Se agregó en la versión 1.7.0.

SpeechSynthesisBoundaryType

Define el tipo de límite del evento de límite de síntesis de voz. SpeechSynthesisBoundaryType Añadido en la versión 1.21.0

SpeechSynthesisOutputFormat

Defina los formatos de salida de audio de síntesis de voz. SpeechSynthesisOutputFormat actualizado en la versión 1.17.0

SpeechSynthesisRequestInputType

Define el tipo de entrada de la solicitud de síntesis de voz. VozSíntesisSolicitudInputType

SynthesisVoiceGender

Define el género de las voces de síntesis. Se agregó en la versión 1.20.0.

SynthesisVoiceType