microsoft-cognitiveservices-speech-sdk package
Klassen
| ActivityReceivedEventArgs |
Definiert den Inhalt der empfangenen Nachricht/Ereignisse. ActivityReceivedEventArgs |
| AudioConfig |
Stellt die Audioeingabekonfiguration dar, die verwendet wird, um anzugeben, welche Art von Eingabe verwendet werden soll (Mikrofon, Datei, Stream). AudioConfig aktualisiert in Version 1.11.0 |
| AudioInputStream |
Stellt den Audioeingabedatenstrom dar, der für benutzerdefinierte Audioeingabekonfigurationen verwendet wird. AudioInputStream |
| AudioOutputStream |
Stellt den Audioausgabedatenstrom dar, der für benutzerdefinierte Audioausgabekonfigurationen verwendet wird. AudioOutputStream |
| AudioStreamFormat |
Stellt das Audiostreamformat dar, das für benutzerdefinierte Audioeingabekonfigurationen verwendet wird. AudioStreamFormat |
| AutoDetectSourceLanguageConfig |
Automatische Spracherkennungskonfiguration. AutoDetectSourceLanguageConfig Hinzugefügt in Version 1.13.0. |
| AutoDetectSourceLanguageResult |
Ausgabeformat AutoDetectSourceLanguageResult |
| AvatarConfig |
Definiert die Konfiguration des sprechenden Avatars. AvatarConfig Hinzugefügt in Version 1.33.0 Diese Funktion ist experimentell und könnte sich ändern oder nur begrenzt unterstützt werden. |
| AvatarEventArgs |
Definiert Inhalte zum Sprechen von Avatarereignissen. AvatarEventArgs Hinzugefügt in Version 1.33.0 Diese Funktion ist experimentell und könnte sich ändern oder nur begrenzt unterstützt werden. |
| AvatarSceneConfig |
Definiert die Konfiguration der Avatar-Szene zur Steuerung der Positionierung und Ausrichtung des Avatars. AvatarSceneConfig hinzugefügt in Version 1.44.0 Diese Funktion ist experimentell und könnte sich ändern oder nur begrenzt unterstützt werden. |
| AvatarSynthesizer |
Definiert den Avatar-Synthesizer. AvatarSynthesizer Hinzugefügt in Version 1.33.0 Diese Funktion ist experimentell und könnte sich ändern oder nur begrenzt unterstützt werden. |
| AvatarVideoFormat |
Definiert das Avatarausgabevideoformat. AvatarVideoFormat Hinzugefügt in Version 1.33.0 Diese Funktion ist experimentell und könnte sich in Zukunft ändern. |
| AvatarWebRTCConnectionResult |
Definiert das WebRTC-Verbindungsergebnis des Avatars. AvatarWebRTCConnectionResult Hinzugefügt in Version 1.33.0 Diese Funktion ist experimentell und könnte sich in Zukunft ändern. |
| BaseAudioPlayer |
ToDO-Basis-Audioplayerklasse: Gibt derzeit nur PCM wieder. |
| BotFrameworkConfig |
Klasse, die Konfigurationen für das Dialogdienstconnectorobjekt für die Verwendung eines Bot Framework-Back-End definiert. BotFrameworkConfig |
| CancellationDetails |
Enthält detaillierte Informationen dazu, warum ein Ergebnis abgebrochen wurde. CancellationDetails |
| CancellationDetailsBase |
Enthält detaillierte Informationen dazu, warum ein Ergebnis abgebrochen wurde. StornierungsdetailsBasis |
| Connection |
Die Verbindung ist eine Proxyklasse zum Verwalten der Verbindung mit dem Sprachdienst der angegebenen Erkennung. Standardmäßig verwaltet ein Erkennungsmodul bei Bedarf die Verbindung mit dem Dienst autonom. Die Connection-Klasse bietet zusätzliche Methoden für Benutzer, um eine Verbindung explizit zu öffnen oder zu schließen und Verbindungsstatusänderungen zu abonnieren. Die Verwendung von "Connection" ist optional und hauptsächlich für Szenarien, in denen die Feinabstimmung des Anwendungsverhaltens basierend auf dem Verbindungsstatus erforderlich ist. Benutzer können optional Open() aufrufen, um eine Verbindung im Voraus manuell einzurichten, bevor die Erkennung für die dieser Verbindung zugeordnete Erkennung gestartet wird. Wenn die Erkennung eine Verbindung mit dem Dienst herstellen oder trennen muss, wird die Verbindung unabhängig voneinander eingerichtet oder heruntergefahren. In diesem Fall wird die Verbindung durch Änderung des Verbindungsstatus über Verbundene/Getrennte Ereignisse benachrichtigt. In Version 1.2.1 hinzugefügt. |
| ConnectionEventArgs |
Definiert nutzlast für Verbindungsereignisse wie Connected/Disconnected. Hinzugefügt in Version 1.2.0 |
| ConnectionMessage |
ConnectionMessage stellt implementierungsspezifische Nachrichten dar, die an den Sprachdienst gesendet und empfangen werden. Diese Nachrichten werden für Debuggingzwecke bereitgestellt und sollten nicht für Produktionsanwendungsfälle mit dem Azure Cognitive Services Speech Service verwendet werden. Nachrichten, die an den Sprachdienst gesendet und empfangen werden, können ohne Vorherige Ankündigung geändert werden. Dazu gehören Nachrichteninhalte, Kopfzeilen, Nutzlasten, Sortierung usw. In Version 1.11.0 hinzugefügt. |
| ConnectionMessageEventArgs | |
| ConversationTranscriber |
Führt spracherkennung mit Lautsprechertrennung von Mikrofon- oder Dateidatenströmen oder anderen Audioeingabedatenströmen aus und ruft als Ergebnis transkribierten Text ab. Konversations-Transkriptor |
| ConversationTranscriptionCanceledEventArgs |
Definiert den Inhalt eines RecognitionErrorEvent-Ereignisses. ConversationTranscriptionCanceledEventArgs |
| ConversationTranscriptionEventArgs |
Definiert den Inhalt des transkribierten/transkribierten Ereignisses für Unterhaltungen. ConversationTranscriptionEventArgs |
| ConversationTranscriptionResult |
Definiert das Ergebnis der Unterhaltungstranskription. ConversationTranscriptionResult |
| Coordinate |
Definiert eine Koordinate im 2D-Raum. Koordinate hinzugefügt in Version 1.33.0 |
| CustomCommandsConfig |
Klasse, die Konfigurationen für das Dialogdienstconnectorobjekt für die Verwendung eines CustomCommands-Back-End definiert. CustomCommandsConfig |
| Diagnostics |
Definiert die Diagnose-API zum Verwalten der Konsolenausgabe, die in Version 1.21.0 hinzugefügt wurde. |
| DialogServiceConfig |
Klasse, die Basiskonfigurationen für den Dialogservice-Connector DialogServiceConfig definiert |
| DialogServiceConnector |
Dialog Service Connector DialogServiceConnector |
| KeywordRecognitionModel |
Stellt ein Schlüsselworterkennungsmodell für die Erkennung dar, wenn der Benutzer ein Schlüsselwort sagt, um eine weitere Spracherkennung zu initiieren. KeywordRecognitionModel |
| Meeting | |
| MeetingTranscriber | |
| MeetingTranscriptionCanceledEventArgs |
Definiert den Inhalt eines MeetingTranscriptionCanceledEvent. MeetingTranscriptionCanceledEventArgs |
| MeetingTranscriptionEventArgs |
Definiert den Inhalt des transkribierten/transkribierten Besprechungsereignisses. MeetingTranscriptionEventArgs |
| NoMatchDetails |
Enthält detaillierte Informationen zu NoMatch-Erkennungsergebnissen. NoMatchDetails |
| Participant |
Vertritt einen Teilnehmer an einer Besprechung. Hinzugefügt in Version 1.4.0 |
| PhraseListGrammar |
Ermöglicht das Hinzufügen neuer Ausdrücke zur Verbesserung der Spracherkennung. Ausdrücke, die der Erkennung hinzugefügt werden, werden am Anfang der nächsten Erkennung wirksam, oder wenn die SpeechSDK das nächste Mal eine Verbindung mit dem Sprachdienst herstellen muss. |
| PronunciationAssessmentConfig |
Konfiguration der Aussprachebewertung. PronunciationAssessmentConfig Hinzugefügt in Version 1.15.0. |
| PronunciationAssessmentResult |
Ergebnisse der Aussprachebewertung. PronunciationAssessmentResult Hinzugefügt in Version 1.15.0. |
| PropertyCollection |
Stellt eine Auflistung von Eigenschaften und deren Werten dar. PropertyCollection |
| PullAudioInputStream |
Stellt den Audioeingabedatenstrom dar, der für benutzerdefinierte Audioeingabekonfigurationen verwendet wird. AudioInputStream |
| PullAudioInputStreamCallback |
Eine abstrakte Basisklasse, die Rückrufmethoden (read() und close()) für benutzerdefinierte Audioeingabedatenströme definiert. PullAudioInputStreamCallback |
| PullAudioOutputStream |
Stellt den speichergesicherten Push-Audioausgabedatenstrom dar, der für benutzerdefinierte Audioausgabekonfigurationen verwendet wird. PullAudioOutputStream |
| PushAudioInputStream |
Stellt speichergesicherte Push-Audioeingabedatenstrom dar, der für benutzerdefinierte Audioeingabekonfigurationen verwendet wird. PushAudioInputStream |
| PushAudioOutputStream |
Stellt den Audioausgabedatenstrom dar, der für benutzerdefinierte Audioausgabekonfigurationen verwendet wird. AudioOutputStream |
| PushAudioOutputStreamCallback |
Eine abstrakte Basisklasse, die Rückrufmethoden (write() und close()) für benutzerdefinierte Audioausgabedatenströme definiert. PushAudioOutputStreamCallback |
| RecognitionEventArgs |
Definiert Die Nutzlast für Sitzungsereignisse wie "Sprachstart/Ende erkannt" |
| RecognitionResult |
Definiert das Ergebnis der Spracherkennung. RecognitionResult |
| Recognizer |
Definiert die Basisklassenerkennung, die hauptsächlich allgemeine Ereignishandler enthält. Erkenner |
| ServiceEventArgs |
Definiert die Nutzlast für jedes Dienstnachrichtenereignis, das in Version 1.9.0 hinzugefügt wurde. |
| SessionEventArgs |
Definiert Inhalte für Sitzungsereignisse wie SessionStarted/Stopped, SoundStarted/Stopped. SessionEventArgs |
| SourceLanguageConfig |
Quellsprachenkonfiguration. SourceLanguageConfig |
| SpeakerAudioDestination |
Stellt das Audioziel der Lautsprecherwiedergabe dar, das nur im Browser funktioniert. Hinweis: Das SDK versucht, Medienquellenerweiterungen zum Wiedergeben von Audio zu verwenden. Das Mp3-Format unterstützt microsoft Edge, Chrome und Safari (Desktop), daher ist es besser, mp3-Format für die Wiedergabe anzugeben. SpeakerAudioDestination Aktualisiert in Version 1.17.0 |
| SpeechConfig |
Sprachkonfiguration. SpeechConfig |
| SpeechConfigImpl |
SpeechConfigImpl |
| SpeechRecognitionCanceledEventArgs | |
| SpeechRecognitionEventArgs |
Definiert den Inhalt des Spracherkennungs-/erkannten Ereignisses. SpeechRecognitionEventArgs |
| SpeechRecognitionResult |
Definiert das Ergebnis der Spracherkennung. SpeechRecognitionResult |
| SpeechRecognizer |
Führt die Spracherkennung aus Mikrofon, Datei oder anderen Audioeingabedatenströmen aus und ruft als Ergebnis transkribierten Text ab. Spracherkenner |
| SpeechSynthesisBookmarkEventArgs |
Definiert den Inhalt des Textmarkenereignisses für die Sprachsynthese. SpeechSynthesisBookmarkEventArgs Hinzugefügt in Version 1.16.0 |
| SpeechSynthesisEventArgs |
Definiert den Inhalt von Sprachsyntheseereignissen. SpeechSynthesisEventArgs Hinzugefügt in Version 1.11.0 |
| SpeechSynthesisRequest |
Stellt eine Sprachsynthese-Anfrage mit Unterstützung für Textstreaming dar. Hinweis: Diese Klasse befindet sich in der Vorschau und kann in zukünftigen Versionen geändert werden. SpeechSynthesisRequest |
| SpeechSynthesisRequestInputStream |
Stellt einen Eingabestrom für das Textstreaming der Sprachsynthese dar. Hinweis: Diese Klasse befindet sich in der Vorschau und kann in zukünftigen Versionen geändert werden. SpeechSynthesisRequestInputStream |
| SpeechSynthesisResult |
Definiert das Ergebnis der Sprachsynthese. SpeechSynthesisResult Hinzugefügt in Version 1.11.0 |
| SpeechSynthesisVisemeEventArgs |
Definiert den Inhalt des Sprachsynthese-Viseme-Ereignisses. SpeechSynthesisVisemeEventArgs Hinzugefügt in Version 1.16.0 |
| SpeechSynthesisWordBoundaryEventArgs |
Definiert den Inhalt des Sprachsynthesewortbegrenzungsereignisses. SpeechSynthesisWordBoundaryEventArgs Hinzugefügt in Version 1.11.0 |
| SpeechSynthesizer |
Definiert die Klasse SpeechSynthesizer für Text zu Sprache. Aktualisiert in Version 1.16.0 SpeechSynthesizer |
| SpeechTranslationConfig |
Sprachübersetzungskonfiguration. SpeechTranslationConfig |
| SynthesisResult |
Basisklasse für Synthese-Ergebnisse SynthesisResult Hinzugefügt in Version 1.20.0 |
| SynthesisVoicesResult |
Definiert das Ergebnis der Sprachsynthese. SynthesisVoicesResult Hinzugefügt in Version 1.20.0 |
| Synthesizer | |
| TranslationRecognitionCanceledEventArgs |
Definieren sie die Nutzlast der abgebrochenen Ergebnisereignisse der Spracherkennung. TranslationRecognitionCanceledEventArgs |
| TranslationRecognitionEventArgs |
Argumente für das Übersetzungsergebnisergebnis. TranslationRecognitionEventArgs |
| TranslationRecognitionResult |
Übersetzungstextergebnis. TranslationRecognitionResult |
| TranslationRecognizer |
Translation recognizer TranslationRecognizer |
| TranslationSynthesisEventArgs |
Translation Synthesis Event-Argumente TranslationSynthesisEventArgs |
| TranslationSynthesisResult |
Definiert das Übersetzungssyntheseergebnis, d. h. die Sprachausgabe des übersetzten Texts in der Zielsprache. TranslationSynthesisResult |
| Translations |
Stellt eine Auflistung von Parametern und deren Werten dar. Übersetzungen |
| TurnStatusReceivedEventArgs |
Definiert den Inhalt der empfangenen Nachricht/Ereignisse. TurnStatusReceivedEventArgs |
| User | |
| VoiceInfo |
Informationen zur Sprachsynthesestimme, die in Version 1.20.0 hinzugefügt wurde. VoiceInfo |
Schnittstellen
| CancellationEventArgs | |
| IParticipant |
Vertritt einen Teilnehmer an einer Besprechung. Hinzugefügt in Version 1.4.0 |
| IPlayer |
Repräsentiert die Audio-Player-Schnittstelle zur Steuerung der Audiowiedergabe, wie Pause, Fortsetzen usw. IPlayer Hinzugefügt in Version 1.12.0 |
| IVoiceJson | |
| MeetingInfo | |
| VoiceSignature | |
Enumerationen
| AudioFormatTag | |
| CancellationErrorCode |
Definiert den Fehlercode, wenn "CancellationReason" "Error" lautet. In Version 1.1.0 hinzugefügt. |
| CancellationReason |
Definiert die möglichen Gründe, warum ein Erkennungsergebnis abgebrochen werden kann. CancellationReason |
| LanguageIdMode |
Sprach-Identifikationsmodus LanguageIdMode |
| LogLevel | |
| NoMatchReason |
Definiert die möglichen Gründe, warum ein Erkennungsergebnis möglicherweise nicht erkannt wird. NoMatchReason |
| OutputFormat |
Definieren von Ausgabeformaten für die Spracherkennung. OutputFormat |
| ProfanityOption |
Profanitätsoption. In Version 1.7.0 hinzugefügt. |
| PronunciationAssessmentGradingSystem |
Definiert das Punktsystem für die Aussprachebewertungskalibrierung; Der Standardwert ist FivePoint. Hinzugefügt in Version 1.15.0 PronunciationAssessmentGradingSystem |
| PronunciationAssessmentGranularity |
Definiert die Granularität der Ausspracheauswertung; Der Standardwert ist "Phoneme". Hinzugefügt in Version 1.15.0 PronunciationAssessmentGranularity |
| PropertyId |
Definiert Spracheigenschaften-IDs. PropertyId |
| ResultReason |
Definiert die möglichen Gründe, warum ein Erkennungsergebnis generiert werden kann. ResultReason |
| ServicePropertyChannel |
Definiert Kanäle, die zum Übergeben von Eigenschaftseinstellungen an den Dienst verwendet werden. In Version 1.7.0 hinzugefügt. |
| SpeechSynthesisBoundaryType |
Definiert den Grenztyp des Grenzereignisses der Sprachsynthese. SpeechSynthesisBoundaryType Hinzugefügt in Version 1.21.0 |
| SpeechSynthesisOutputFormat |
Definieren Sie Audioausgabeformate für die Sprachsynthese. SpeechSynthesisOutputFormat Aktualisiert in Version 1.17.0 |
| SpeechSynthesisRequestInputType |
Definiert den Eingabetyp der Sprachsyntheseanfrage. SpeechSynthesisRequestInputType |
| SynthesisVoiceGender |
Definiert das Geschlecht von Synthesestimmen. In Version 1.20.0 hinzugefügt. |
| SynthesisVoiceType | |