microsoft-cognitiveservices-speech-sdk package

Classes

ActivityReceivedEventArgs

Définit le contenu des messages/événements reçus. ActivitéReçuÉvénementArgs

AudioConfig

Représente la configuration d’entrée audio utilisée pour spécifier le type d’entrée à utiliser (microphone, fichier, flux). AudioConfig mis à jour dans la version 1.11.0

AudioInputStream

Représente le flux d’entrée audio utilisé pour les configurations d’entrée audio personnalisées. AudioInputStream

AudioOutputStream

Représente le flux de sortie audio utilisé pour les configurations de sortie audio personnalisées. AudioOutputStream

AudioStreamFormat

Représente le format de flux audio utilisé pour les configurations d’entrée audio personnalisées. AudioStreamFormat

AutoDetectSourceLanguageConfig

Configuration de détection automatique de la langue. AutoDetectSourceLanguageConfig ajouté dans la version 1.13.0.

AutoDetectSourceLanguageResult

Format de sortie AutoDetectSourceLanguageResult

AvatarConfig

Définit la configuration de l’avatar parlant. AvatarConfig ajouté dans la version 1.33.0

Cette fonctionnalité est expérimentale et peut changer ou avoir un support limité.

AvatarEventArgs

Définit du contenu pour parler des événements d’avatar. AvatarEventArgs ajouté dans la version 1.33.0

Cette fonctionnalité est expérimentale et peut changer ou avoir un support limité.

AvatarSceneConfig

Définit la configuration de la scène d’avatar pour contrôler le positionnement et l’orientation de l’avatar. AvatarSceneConfig ajouté dans la version 1.44.0

Cette fonctionnalité est expérimentale et peut changer ou avoir un support limité.

AvatarSynthesizer

Définit le synthétiseur d’avatar. AvatarSynthesizer ajouté dans la version 1.33.0

Cette fonctionnalité est expérimentale et peut changer ou avoir un support limité.

AvatarVideoFormat

Définit le format vidéo de sortie d’avatar. AvatarVideoFormat ajouté dans la version 1.33.0

Cette fonctionnalité est expérimentale et pourrait évoluer à l’avenir.

AvatarWebRTCConnectionResult

Définit le résultat de la connexion WebRTC d’avatar. AvatarWebRTCConnectionResult ajouté dans la version 1.33.0

Cette fonctionnalité est expérimentale et pourrait évoluer à l’avenir.

BaseAudioPlayer

Classe de lecteur audio de base TODO : lit uniquement PCM pour l’instant.

BotFrameworkConfig

Classe qui définit les configurations de l’objet connecteur de service de boîte de dialogue pour l’utilisation d’un back-end Bot Framework. BotFrameworkConfig

CancellationDetails

Contient des informations détaillées sur la raison pour laquelle un résultat a été annulé. Détails de l’annulation

CancellationDetailsBase

Contient des informations détaillées sur la raison pour laquelle un résultat a été annulé. CancellationDetailsBase

Connection

La connexion est une classe proxy pour la gestion de la connexion au service speech du module Recognizer spécifié. Par défaut, un Recognizer gère de manière autonome la connexion au service si nécessaire. La classe Connection fournit des méthodes supplémentaires pour permettre aux utilisateurs d’ouvrir ou de fermer explicitement une connexion et de s’abonner aux modifications d’état de connexion. L’utilisation de la connexion est facultative et principalement pour les scénarios où le réglage précis du comportement de l’application en fonction de l’état de la connexion est nécessaire. Les utilisateurs peuvent éventuellement appeler Open() pour configurer manuellement une connexion à l’avance avant de commencer la reconnaissance sur le module Recognizer associé à cette connexion. Si recognizer doit se connecter ou se déconnecter du service, il configure ou arrête la connexion indépendamment. Dans ce cas, la connexion sera avertie par le changement d’état de connexion via les événements connectés/déconnectés. Ajouté dans la version 1.2.1.

ConnectionEventArgs

Définit la charge utile pour les événements de connexion tels que Connecté/Déconnecté. Ajouté dans la version 1.2.0

ConnectionMessage

ConnectionMessage représente les messages spécifiques à l’implémentation envoyés et reçus par le service speech. Ces messages sont fournis à des fins de débogage et ne doivent pas être utilisés pour les cas d’utilisation de production avec azure Cognitive Services Speech Service. Les messages envoyés et reçus du service Speech sont susceptibles de changer sans préavis. Cela inclut le contenu du message, les en-têtes, les charges utiles, l’ordre, etc. Ajouté dans la version 1.11.0.

ConnectionMessageEventArgs
ConversationTranscriber

Effectue la reconnaissance vocale avec séparation du haut-parleur du microphone, du fichier ou d’autres flux d’entrée audio, et obtient ainsi du texte transcrit. Transcripteur de conversation

ConversationTranscriptionCanceledEventArgs

Définit le contenu d’un Objet RecognitionErrorEvent. ConversationTranscriptionCanceledEventArgs

ConversationTranscriptionEventArgs

Définit le contenu de l’événement transcrit/transcription de conversation. ConversationTranscriptionEventArgs

ConversationTranscriptionResult

Définit le résultat de la transcription de conversation. ConversationTranscriptionResult

Coordinate

Définit une coordonnée dans l’espace 2D. Coordonnée ajoutée dans la version 1.33.0

CustomCommandsConfig

Classe qui définit les configurations de l’objet connecteur de service de boîte de dialogue pour l’utilisation d’un back-end CustomCommands. CustomCommandsConfig

Diagnostics

Définit l’API de diagnostic pour la gestion de la sortie de la console ajoutée dans la version 1.21.0

DialogServiceConfig

Classe qui définit les configurations de base pour le connecteur de service de dialogue DialogServiceConfig

DialogServiceConnector

Connecteur de Service Dialogue Connecteur de Service DialogService

KeywordRecognitionModel

Représente un modèle de reconnaissance de mot clé pour la reconnaissance lorsque l’utilisateur indique un mot clé pour lancer une reconnaissance vocale supplémentaire. KeywordRecognitionModel

Meeting
MeetingTranscriber
MeetingTranscriptionCanceledEventArgs

Définit le contenu d’un MeetingTranscriptionCanceledEvent. MeetingTranscriptionCanceledEventArgs

MeetingTranscriptionEventArgs

Définit le contenu de l’événement transcrit/transcription de réunion. MeetingTranscriptionEventArgs

NoMatchDetails

Contient des informations détaillées pour les résultats de la reconnaissance NoMatch. NoMatchDetails

Participant

Représente un participant à une réunion. Ajouté dans la version 1.4.0

PhraseListGrammar

Permet d’ajouter de nouvelles expressions pour améliorer la reconnaissance vocale.

Les expressions ajoutées au module de reconnaissance sont effectives au début de la reconnaissance suivante, ou la prochaine fois que speechSDK doit se reconnecter au service speech.

PronunciationAssessmentConfig

Configuration de l’évaluation de la prononciation. PronunciationAssessmentConfig Ajouté dans la version 1.15.0.

PronunciationAssessmentResult

Résultats de l’évaluation de la prononciation. PronunciationAssessmentResult ajouté dans la version 1.15.0.

PropertyCollection

Représente la collection de propriétés et leurs valeurs. PropertyCollection

PullAudioInputStream

Représente le flux d’entrée audio utilisé pour les configurations d’entrée audio personnalisées. AudioInputStream

PullAudioInputStreamCallback

Classe de base abstraite qui définit les méthodes de rappel (read() et close()) pour les flux d’entrée audio personnalisés. Rappel PullAudioInputStream

PullAudioOutputStream

Représente le flux de sortie audio push en mémoire utilisé pour les configurations de sortie audio personnalisées. PullAudioOutputStream

PushAudioInputStream

Représente le flux d’entrée audio push en mémoire utilisé pour les configurations d’entrée audio personnalisées. PushAudioInputStream

PushAudioOutputStream

Représente le flux de sortie audio utilisé pour les configurations de sortie audio personnalisées. AudioOutputStream

PushAudioOutputStreamCallback

Classe de base abstraite qui définit les méthodes de rappel (write() et close()) pour les flux de sortie audio personnalisés. Rappel PushAudioOutputStream

RecognitionEventArgs

Définit la charge utile pour les événements de session tels que Speech Start/End Détectés

RecognitionResult

Définit le résultat de la reconnaissance vocale. RecognitionResult

Recognizer

Définit la classe de base Recognizer qui contient principalement des gestionnaires d’événements courants. Reconnaisseur

ServiceEventArgs

Définit la charge utile pour tout événement de message de service ajouté dans la version 1.9.0

SessionEventArgs

Définit le contenu des événements de session tels que SessionStarted/Stopped, SoundStarted/Stopped. SessionEventArgs

SourceLanguageConfig

Configuration du langage source. SourceLanguageConfig

SpeakerAudioDestination

Représente la destination audio de lecture du haut-parleur, qui fonctionne uniquement dans le navigateur. Remarque : le Kit de développement logiciel (SDK) tente d’utiliser extensions de source multimédia pour lire l’audio. Le format Mp3 offre de meilleures prise en charge sur Microsoft Edge, Chrome et Safari (bureau), il est donc préférable de spécifier le format mp3 pour la lecture. SpeakerAudioDestination mis à jour dans la version 1.17.0

SpeechConfig

Configuration vocale. SpeechConfig

SpeechConfigImpl

SpeechConfigImpl

SpeechRecognitionCanceledEventArgs
SpeechRecognitionEventArgs

Définit le contenu de l’événement reconnaissance vocale/reconnu. SpeechRecognitionEventArgs

SpeechRecognitionResult

Définit le résultat de la reconnaissance vocale. SpeechRecognitionResult

SpeechRecognizer

Effectue la reconnaissance vocale à partir du microphone, du fichier ou d’autres flux d’entrée audio, et obtient ainsi du texte transcrit. Reconnaissance vocale

SpeechSynthesisBookmarkEventArgs

Définit le contenu de l’événement de signet de synthèse vocale. SpeechSynthesisBookmarkEventArgs ajouté en version 1.16.0

SpeechSynthesisEventArgs

Définit le contenu des événements de synthèse vocale. SpeechSynthesisEventArgs ajouté dans la version 1.11.0

SpeechSynthesisRequest

Représente une requête de synthèse vocale avec prise en charge du flux textuel. Remarque : cette classe est en préversion et peut être susceptible de changer dans les versions ultérieures. Demande de synthèse vocale

SpeechSynthesisRequestInputStream

Représente un flux d’entrée pour le flux de texte par demande de synthèse vocale. Remarque : cette classe est en préversion et peut être susceptible de changer dans les versions ultérieures. SynthèseDeParoleDemandeEntréeFlux

SpeechSynthesisResult

Définit le résultat de la synthèse vocale. SpeechSynthesisResult ajouté dans la version 1.11.0

SpeechSynthesisVisemeEventArgs

Définit le contenu de l’événement viseme de synthèse vocale. SpeechSynthesisVisemeEventArgs ajouté en version 1.16.0

SpeechSynthesisWordBoundaryEventArgs

Définit le contenu de l’événement de limite de mot de synthèse vocale. SpeechSynthesisWordBoundaryEventArgs ajouté en version 1.11.0

SpeechSynthesizer

Définit la classe SpeechSynthesizer pour la synthèse vocale. Mise à jour dans la version 1.16.0 de SpeechSynthesizer

SpeechTranslationConfig

Configuration de la traduction vocale. SpeechTranslationConfig

SynthesisResult

Classe de base pour les résultats de synthèse SyntesisResult ajoutée dans la version 1.20.0

SynthesisVoicesResult

Définit le résultat de la synthèse vocale. SynthesisVoicesResult ajouté dans la version 1.20.0

Synthesizer
TranslationRecognitionCanceledEventArgs

Définissez la charge utile des événements de résultat annulés de reconnaissance vocale. TranslationRecognitionCanceledEventArgs

TranslationRecognitionEventArgs

Arguments d’événement de résultat de traduction de texte. TranslationRecognitionEventArgs

TranslationRecognitionResult

Résultat du texte de traduction. TranslationRecognitionResult

TranslationRecognizer

Reconnaissance de traduction Reconnaisseur de traduction

TranslationSynthesisEventArgs

Arguments d’événements de synthèse de traduction TraductionSynthèseÉvénementArgs

TranslationSynthesisResult

Définit le résultat de la synthèse de traduction, c’est-à-dire la sortie vocale du texte traduit dans la langue cible. TranslationSynthesisResult

Translations

Représente la collection de paramètres et leurs valeurs. Traductions

TurnStatusReceivedEventArgs

Définit le contenu des messages/événements reçus. TurnStatutReçuÉvénementArgs

User
VoiceInfo

Informations sur la voix de synthèse vocale ajoutée dans la version 1.20.0. VoiceInfo

Interfaces

CancellationEventArgs
IParticipant

Représente un participant à une réunion. Ajouté dans la version 1.4.0

IPlayer

Représente l’interface du lecteur audio pour contrôler la lecture audio, comme la pause, la reprise, etc. IPlayer Ajouté dans la version 1.12.0

IVoiceJson
MeetingInfo
VoiceSignature

Énumérations

AudioFormatTag
CancellationErrorCode

Définit le code d’erreur en cas d’erreur d’CancellationReason. Ajouté dans la version 1.1.0.

CancellationReason

Définit les raisons possibles pour lesquelles un résultat de reconnaissance peut être annulé. CancellationReason

LanguageIdMode

Mode d’identification linguistique LanguageIdMode

LogLevel
NoMatchReason

Définit les raisons possibles pour lesquelles un résultat de reconnaissance peut ne pas être reconnu. NoMatchReason

OutputFormat

Définissez les formats de sortie Speech Recognizer. OutputFormat

ProfanityOption

Option de profanité. Ajouté dans la version 1.7.0.

PronunciationAssessmentGradingSystem

Définit le système de points pour l’étalonnage du score de prononciation ; la valeur par défaut est FivePoint. Ajouté dans la version 1.15.0 Système de Notation de PrononciationÉvaluationÉvaluation

PronunciationAssessmentGranularity

Définit la granularité de l’évaluation de la prononciation ; la valeur par défaut est Phoneme. Ajouté dans la version 1.15.0 PrononciationÉvaluationGranularité

PropertyId

Définit les ID de propriété speech. PropertyId

ResultReason

Définit les raisons possibles pour lesquelles un résultat de reconnaissance peut être généré. Raison du Résultat

ServicePropertyChannel

Définit les canaux utilisés pour passer les paramètres de propriété au service. Ajouté dans la version 1.7.0.

SpeechSynthesisBoundaryType

Définit le type de limite de l’événement de limite de synthèse vocale. SpeechSynthesisBoundaryType ajouté dans la version 1.21.0

SpeechSynthesisOutputFormat

Définissez les formats de sortie audio de synthèse vocale. SpeechSynthesisOutputFormat Mis à jour dans la version 1.17.0

SpeechSynthesisRequestInputType

Définit le type d’entrée de la demande de synthèse vocale. RequêteSaisieType de Synthèse de la Parole

SynthesisVoiceGender

Définit le genre des voix de synthèse. Ajouté dans la version 1.20.0.

SynthesisVoiceType