microsoft-cognitiveservices-speech-sdk package

Klassen

ActivityReceivedEventArgs

Definiert den Inhalt der empfangenen Nachricht/Ereignisse. ActivityReceivedEventArgs

AudioConfig

Stellt die Audioeingabekonfiguration dar, die verwendet wird, um anzugeben, welche Art von Eingabe verwendet werden soll (Mikrofon, Datei, Stream). AudioConfig aktualisiert in Version 1.11.0

AudioInputStream

Stellt den Audioeingabedatenstrom dar, der für benutzerdefinierte Audioeingabekonfigurationen verwendet wird. AudioInputStream

AudioOutputStream

Stellt den Audioausgabedatenstrom dar, der für benutzerdefinierte Audioausgabekonfigurationen verwendet wird. AudioOutputStream

AudioStreamFormat

Stellt das Audiostreamformat dar, das für benutzerdefinierte Audioeingabekonfigurationen verwendet wird. AudioStreamFormat

AutoDetectSourceLanguageConfig

Automatische Spracherkennungskonfiguration. AutoDetectSourceLanguageConfig Hinzugefügt in Version 1.13.0.

AutoDetectSourceLanguageResult

Ausgabeformat AutoDetectSourceLanguageResult

AvatarConfig

Definiert die Konfiguration des sprechenden Avatars. AvatarConfig Hinzugefügt in Version 1.33.0

Diese Funktion ist experimentell und könnte sich ändern oder nur begrenzt unterstützt werden.

AvatarEventArgs

Definiert Inhalte zum Sprechen von Avatarereignissen. AvatarEventArgs Hinzugefügt in Version 1.33.0

Diese Funktion ist experimentell und könnte sich ändern oder nur begrenzt unterstützt werden.

AvatarSceneConfig

Definiert die Konfiguration der Avatar-Szene zur Steuerung der Positionierung und Ausrichtung des Avatars. AvatarSceneConfig hinzugefügt in Version 1.44.0

Diese Funktion ist experimentell und könnte sich ändern oder nur begrenzt unterstützt werden.

AvatarSynthesizer

Definiert den Avatar-Synthesizer. AvatarSynthesizer Hinzugefügt in Version 1.33.0

Diese Funktion ist experimentell und könnte sich ändern oder nur begrenzt unterstützt werden.

AvatarVideoFormat

Definiert das Avatarausgabevideoformat. AvatarVideoFormat Hinzugefügt in Version 1.33.0

Diese Funktion ist experimentell und könnte sich in Zukunft ändern.

AvatarWebRTCConnectionResult

Definiert das WebRTC-Verbindungsergebnis des Avatars. AvatarWebRTCConnectionResult Hinzugefügt in Version 1.33.0

Diese Funktion ist experimentell und könnte sich in Zukunft ändern.

BaseAudioPlayer

ToDO-Basis-Audioplayerklasse: Gibt derzeit nur PCM wieder.

BotFrameworkConfig

Klasse, die Konfigurationen für das Dialogdienstconnectorobjekt für die Verwendung eines Bot Framework-Back-End definiert. BotFrameworkConfig

CancellationDetails

Enthält detaillierte Informationen dazu, warum ein Ergebnis abgebrochen wurde. CancellationDetails

CancellationDetailsBase

Enthält detaillierte Informationen dazu, warum ein Ergebnis abgebrochen wurde. StornierungsdetailsBasis

Connection

Die Verbindung ist eine Proxyklasse zum Verwalten der Verbindung mit dem Sprachdienst der angegebenen Erkennung. Standardmäßig verwaltet ein Erkennungsmodul bei Bedarf die Verbindung mit dem Dienst autonom. Die Connection-Klasse bietet zusätzliche Methoden für Benutzer, um eine Verbindung explizit zu öffnen oder zu schließen und Verbindungsstatusänderungen zu abonnieren. Die Verwendung von "Connection" ist optional und hauptsächlich für Szenarien, in denen die Feinabstimmung des Anwendungsverhaltens basierend auf dem Verbindungsstatus erforderlich ist. Benutzer können optional Open() aufrufen, um eine Verbindung im Voraus manuell einzurichten, bevor die Erkennung für die dieser Verbindung zugeordnete Erkennung gestartet wird. Wenn die Erkennung eine Verbindung mit dem Dienst herstellen oder trennen muss, wird die Verbindung unabhängig voneinander eingerichtet oder heruntergefahren. In diesem Fall wird die Verbindung durch Änderung des Verbindungsstatus über Verbundene/Getrennte Ereignisse benachrichtigt. In Version 1.2.1 hinzugefügt.

ConnectionEventArgs

Definiert nutzlast für Verbindungsereignisse wie Connected/Disconnected. Hinzugefügt in Version 1.2.0

ConnectionMessage

ConnectionMessage stellt implementierungsspezifische Nachrichten dar, die an den Sprachdienst gesendet und empfangen werden. Diese Nachrichten werden für Debuggingzwecke bereitgestellt und sollten nicht für Produktionsanwendungsfälle mit dem Azure Cognitive Services Speech Service verwendet werden. Nachrichten, die an den Sprachdienst gesendet und empfangen werden, können ohne Vorherige Ankündigung geändert werden. Dazu gehören Nachrichteninhalte, Kopfzeilen, Nutzlasten, Sortierung usw. In Version 1.11.0 hinzugefügt.

ConnectionMessageEventArgs
ConversationTranscriber

Führt spracherkennung mit Lautsprechertrennung von Mikrofon- oder Dateidatenströmen oder anderen Audioeingabedatenströmen aus und ruft als Ergebnis transkribierten Text ab. Konversations-Transkriptor

ConversationTranscriptionCanceledEventArgs

Definiert den Inhalt eines RecognitionErrorEvent-Ereignisses. ConversationTranscriptionCanceledEventArgs

ConversationTranscriptionEventArgs

Definiert den Inhalt des transkribierten/transkribierten Ereignisses für Unterhaltungen. ConversationTranscriptionEventArgs

ConversationTranscriptionResult

Definiert das Ergebnis der Unterhaltungstranskription. ConversationTranscriptionResult

Coordinate

Definiert eine Koordinate im 2D-Raum. Koordinate hinzugefügt in Version 1.33.0

CustomCommandsConfig

Klasse, die Konfigurationen für das Dialogdienstconnectorobjekt für die Verwendung eines CustomCommands-Back-End definiert. CustomCommandsConfig

Diagnostics

Definiert die Diagnose-API zum Verwalten der Konsolenausgabe, die in Version 1.21.0 hinzugefügt wurde.

DialogServiceConfig

Klasse, die Basiskonfigurationen für den Dialogservice-Connector DialogServiceConfig definiert

DialogServiceConnector

Dialog Service Connector DialogServiceConnector

KeywordRecognitionModel

Stellt ein Schlüsselworterkennungsmodell für die Erkennung dar, wenn der Benutzer ein Schlüsselwort sagt, um eine weitere Spracherkennung zu initiieren. KeywordRecognitionModel

Meeting
MeetingTranscriber
MeetingTranscriptionCanceledEventArgs

Definiert den Inhalt eines MeetingTranscriptionCanceledEvent. MeetingTranscriptionCanceledEventArgs

MeetingTranscriptionEventArgs

Definiert den Inhalt des transkribierten/transkribierten Besprechungsereignisses. MeetingTranscriptionEventArgs

NoMatchDetails

Enthält detaillierte Informationen zu NoMatch-Erkennungsergebnissen. NoMatchDetails

Participant

Vertritt einen Teilnehmer an einer Besprechung. Hinzugefügt in Version 1.4.0

PhraseListGrammar

Ermöglicht das Hinzufügen neuer Ausdrücke zur Verbesserung der Spracherkennung.

Ausdrücke, die der Erkennung hinzugefügt werden, werden am Anfang der nächsten Erkennung wirksam, oder wenn die SpeechSDK das nächste Mal eine Verbindung mit dem Sprachdienst herstellen muss.

PronunciationAssessmentConfig

Konfiguration der Aussprachebewertung. PronunciationAssessmentConfig Hinzugefügt in Version 1.15.0.

PronunciationAssessmentResult

Ergebnisse der Aussprachebewertung. PronunciationAssessmentResult Hinzugefügt in Version 1.15.0.

PropertyCollection

Stellt eine Auflistung von Eigenschaften und deren Werten dar. PropertyCollection

PullAudioInputStream

Stellt den Audioeingabedatenstrom dar, der für benutzerdefinierte Audioeingabekonfigurationen verwendet wird. AudioInputStream

PullAudioInputStreamCallback

Eine abstrakte Basisklasse, die Rückrufmethoden (read() und close()) für benutzerdefinierte Audioeingabedatenströme definiert. PullAudioInputStreamCallback

PullAudioOutputStream

Stellt den speichergesicherten Push-Audioausgabedatenstrom dar, der für benutzerdefinierte Audioausgabekonfigurationen verwendet wird. PullAudioOutputStream

PushAudioInputStream

Stellt speichergesicherte Push-Audioeingabedatenstrom dar, der für benutzerdefinierte Audioeingabekonfigurationen verwendet wird. PushAudioInputStream

PushAudioOutputStream

Stellt den Audioausgabedatenstrom dar, der für benutzerdefinierte Audioausgabekonfigurationen verwendet wird. AudioOutputStream

PushAudioOutputStreamCallback

Eine abstrakte Basisklasse, die Rückrufmethoden (write() und close()) für benutzerdefinierte Audioausgabedatenströme definiert. PushAudioOutputStreamCallback

RecognitionEventArgs

Definiert Die Nutzlast für Sitzungsereignisse wie "Sprachstart/Ende erkannt"

RecognitionResult

Definiert das Ergebnis der Spracherkennung. RecognitionResult

Recognizer

Definiert die Basisklassenerkennung, die hauptsächlich allgemeine Ereignishandler enthält. Erkenner

ServiceEventArgs

Definiert die Nutzlast für jedes Dienstnachrichtenereignis, das in Version 1.9.0 hinzugefügt wurde.

SessionEventArgs

Definiert Inhalte für Sitzungsereignisse wie SessionStarted/Stopped, SoundStarted/Stopped. SessionEventArgs

SourceLanguageConfig

Quellsprachenkonfiguration. SourceLanguageConfig

SpeakerAudioDestination

Stellt das Audioziel der Lautsprecherwiedergabe dar, das nur im Browser funktioniert. Hinweis: Das SDK versucht, Medienquellenerweiterungen zum Wiedergeben von Audio zu verwenden. Das Mp3-Format unterstützt microsoft Edge, Chrome und Safari (Desktop), daher ist es besser, mp3-Format für die Wiedergabe anzugeben. SpeakerAudioDestination Aktualisiert in Version 1.17.0

SpeechConfig

Sprachkonfiguration. SpeechConfig

SpeechConfigImpl

SpeechConfigImpl

SpeechRecognitionCanceledEventArgs
SpeechRecognitionEventArgs

Definiert den Inhalt des Spracherkennungs-/erkannten Ereignisses. SpeechRecognitionEventArgs

SpeechRecognitionResult

Definiert das Ergebnis der Spracherkennung. SpeechRecognitionResult

SpeechRecognizer

Führt die Spracherkennung aus Mikrofon, Datei oder anderen Audioeingabedatenströmen aus und ruft als Ergebnis transkribierten Text ab. Spracherkenner

SpeechSynthesisBookmarkEventArgs

Definiert den Inhalt des Textmarkenereignisses für die Sprachsynthese. SpeechSynthesisBookmarkEventArgs Hinzugefügt in Version 1.16.0

SpeechSynthesisEventArgs

Definiert den Inhalt von Sprachsyntheseereignissen. SpeechSynthesisEventArgs Hinzugefügt in Version 1.11.0

SpeechSynthesisRequest

Stellt eine Sprachsynthese-Anfrage mit Unterstützung für Textstreaming dar. Hinweis: Diese Klasse befindet sich in der Vorschau und kann in zukünftigen Versionen geändert werden. SpeechSynthesisRequest

SpeechSynthesisRequestInputStream

Stellt einen Eingabestrom für das Textstreaming der Sprachsynthese dar. Hinweis: Diese Klasse befindet sich in der Vorschau und kann in zukünftigen Versionen geändert werden. SpeechSynthesisRequestInputStream

SpeechSynthesisResult

Definiert das Ergebnis der Sprachsynthese. SpeechSynthesisResult Hinzugefügt in Version 1.11.0

SpeechSynthesisVisemeEventArgs

Definiert den Inhalt des Sprachsynthese-Viseme-Ereignisses. SpeechSynthesisVisemeEventArgs Hinzugefügt in Version 1.16.0

SpeechSynthesisWordBoundaryEventArgs

Definiert den Inhalt des Sprachsynthesewortbegrenzungsereignisses. SpeechSynthesisWordBoundaryEventArgs Hinzugefügt in Version 1.11.0

SpeechSynthesizer

Definiert die Klasse SpeechSynthesizer für Text zu Sprache. Aktualisiert in Version 1.16.0 SpeechSynthesizer

SpeechTranslationConfig

Sprachübersetzungskonfiguration. SpeechTranslationConfig

SynthesisResult

Basisklasse für Synthese-Ergebnisse SynthesisResult Hinzugefügt in Version 1.20.0

SynthesisVoicesResult

Definiert das Ergebnis der Sprachsynthese. SynthesisVoicesResult Hinzugefügt in Version 1.20.0

Synthesizer
TranslationRecognitionCanceledEventArgs

Definieren sie die Nutzlast der abgebrochenen Ergebnisereignisse der Spracherkennung. TranslationRecognitionCanceledEventArgs

TranslationRecognitionEventArgs

Argumente für das Übersetzungsergebnisergebnis. TranslationRecognitionEventArgs

TranslationRecognitionResult

Übersetzungstextergebnis. TranslationRecognitionResult

TranslationRecognizer

Translation recognizer TranslationRecognizer

TranslationSynthesisEventArgs

Translation Synthesis Event-Argumente TranslationSynthesisEventArgs

TranslationSynthesisResult

Definiert das Übersetzungssyntheseergebnis, d. h. die Sprachausgabe des übersetzten Texts in der Zielsprache. TranslationSynthesisResult

Translations

Stellt eine Auflistung von Parametern und deren Werten dar. Übersetzungen

TurnStatusReceivedEventArgs

Definiert den Inhalt der empfangenen Nachricht/Ereignisse. TurnStatusReceivedEventArgs

User
VoiceInfo

Informationen zur Sprachsynthesestimme, die in Version 1.20.0 hinzugefügt wurde. VoiceInfo

Schnittstellen

CancellationEventArgs
IParticipant

Vertritt einen Teilnehmer an einer Besprechung. Hinzugefügt in Version 1.4.0

IPlayer

Repräsentiert die Audio-Player-Schnittstelle zur Steuerung der Audiowiedergabe, wie Pause, Fortsetzen usw. IPlayer Hinzugefügt in Version 1.12.0

IVoiceJson
MeetingInfo
VoiceSignature

Enumerationen

AudioFormatTag
CancellationErrorCode

Definiert den Fehlercode, wenn "CancellationReason" "Error" lautet. In Version 1.1.0 hinzugefügt.

CancellationReason

Definiert die möglichen Gründe, warum ein Erkennungsergebnis abgebrochen werden kann. CancellationReason

LanguageIdMode

Sprach-Identifikationsmodus LanguageIdMode

LogLevel
NoMatchReason

Definiert die möglichen Gründe, warum ein Erkennungsergebnis möglicherweise nicht erkannt wird. NoMatchReason

OutputFormat

Definieren von Ausgabeformaten für die Spracherkennung. OutputFormat

ProfanityOption

Profanitätsoption. In Version 1.7.0 hinzugefügt.

PronunciationAssessmentGradingSystem

Definiert das Punktsystem für die Aussprachebewertungskalibrierung; Der Standardwert ist FivePoint. Hinzugefügt in Version 1.15.0 PronunciationAssessmentGradingSystem

PronunciationAssessmentGranularity

Definiert die Granularität der Ausspracheauswertung; Der Standardwert ist "Phoneme". Hinzugefügt in Version 1.15.0 PronunciationAssessmentGranularity

PropertyId

Definiert Spracheigenschaften-IDs. PropertyId

ResultReason

Definiert die möglichen Gründe, warum ein Erkennungsergebnis generiert werden kann. ResultReason

ServicePropertyChannel

Definiert Kanäle, die zum Übergeben von Eigenschaftseinstellungen an den Dienst verwendet werden. In Version 1.7.0 hinzugefügt.

SpeechSynthesisBoundaryType

Definiert den Grenztyp des Grenzereignisses der Sprachsynthese. SpeechSynthesisBoundaryType Hinzugefügt in Version 1.21.0

SpeechSynthesisOutputFormat

Definieren Sie Audioausgabeformate für die Sprachsynthese. SpeechSynthesisOutputFormat Aktualisiert in Version 1.17.0

SpeechSynthesisRequestInputType

Definiert den Eingabetyp der Sprachsyntheseanfrage. SpeechSynthesisRequestInputType

SynthesisVoiceGender

Definiert das Geschlecht von Synthesestimmen. In Version 1.20.0 hinzugefügt.

SynthesisVoiceType