microsoft-cognitiveservices-speech-sdk package

Klasy

ActivityReceivedEventArgs

Definiuje zawartość odebranego komunikatu/zdarzeń. ActivityReceivedEventArgs

AudioConfig

Reprezentuje konfigurację danych wejściowych audio służącą do określania typu danych wejściowych do użycia (mikrofon, plik, strumień). AudioConfig Zaktualizowano w wersji 1.11.0

AudioInputStream

Reprezentuje strumień wejściowy audio używany do niestandardowych konfiguracji wejściowych audio. Strumień AudioInputStream

AudioOutputStream

Reprezentuje strumień wyjściowy audio używany do niestandardowych konfiguracji wyjściowych audio. AudioOutputStream

AudioStreamFormat

Reprezentuje format strumienia audio używany na potrzeby niestandardowych konfiguracji wejściowych audio. AudioStreamFormat

AutoDetectSourceLanguageConfig

Automatyczna konfiguracja wykrywania języka. AutoDetectSourceLanguageConfig dodano w wersji 1.13.0.

AutoDetectSourceLanguageResult

Format wyjściowy AutoDetectSourceLanguageResult

AvatarConfig

Definiuje konfigurację awatara rozmowy. AvatarConfig dodano w wersji 1.33.0

Ta funkcja jest eksperymentalna i może się zmieniać lub mieć ograniczone wsparcie.

AvatarEventArgs

Definiuje zawartość do mówienia zdarzeń awatara. AvatarEventArgs dodane w wersji 1.33.0

Ta funkcja jest eksperymentalna i może się zmieniać lub mieć ograniczone wsparcie.

AvatarSceneConfig

Definiuje konfigurację sceny awatara do sterowania pozycjonowaniem i orientacją awatara. AvatarSceneConfig dodano w wersji 1.44.0

Ta funkcja jest eksperymentalna i może się zmieniać lub mieć ograniczone wsparcie.

AvatarSynthesizer

Definiuje syntetyzator awatara. AvatarSynthesizer dodany w wersji 1.33.0

Ta funkcja jest eksperymentalna i może się zmieniać lub mieć ograniczone wsparcie.

AvatarVideoFormat

Definiuje format wideo wyjściowego awatara. AvatarVideoFormat dodany w wersji 1.33.0

Ta funkcja jest eksperymentalna i może się zmienić w przyszłości.

AvatarWebRTCConnectionResult

Definiuje wynik połączenia awatara WebRTC. AvatarWebRTCConnectionResult Dodano w wersji 1.33.0

Ta funkcja jest eksperymentalna i może się zmienić w przyszłości.

BaseAudioPlayer

Podstawowa klasa odtwarzacza audio TODO: odtwarza tylko PCM na razie.

BotFrameworkConfig

Klasa, która definiuje konfiguracje obiektu łącznika usługi dialogowej na potrzeby używania zaplecza platformy Bot Framework. BotFrameworkConfig

CancellationDetails

Zawiera szczegółowe informacje o tym, dlaczego wynik został anulowany. AnulowanieSzczegóły

CancellationDetailsBase

Zawiera szczegółowe informacje o tym, dlaczego wynik został anulowany. CancelDetailsBase

Connection

Połączenie to klasa serwera proxy do zarządzania połączeniem z usługą rozpoznawania mowy określonego rozpoznawania. Domyślnie rozpoznawanie autonomiczne zarządza połączeniem z usługą w razie potrzeby. Klasa Połączenie udostępnia dodatkowe metody umożliwiające użytkownikom jawne otwieranie lub zamykanie połączenia oraz subskrybowanie zmian stanu połączenia. Użycie połączenia jest opcjonalne i dotyczy głównie scenariuszy, w których wymagane jest precyzyjne dostrajanie zachowania aplikacji na podstawie stanu połączenia. Użytkownicy mogą opcjonalnie wywołać metodę Open(), aby ręcznie skonfigurować połączenie z wyprzedzeniem przed rozpoczęciem rozpoznawania w rozpoznawaniu skojarzonym z tym połączeniem. Jeśli narzędzie rozpoznawania musi nawiązać połączenie z usługą lub je rozłączyć, skonfiguruje lub niezależnie zamknij połączenie. W takim przypadku połączenie zostanie powiadomione przez zmianę stanu połączenia za pośrednictwem zdarzeń Połączony/Rozłączony. Dodano element w wersji 1.2.1.

ConnectionEventArgs

Definiuje ładunek dla zdarzeń połączenia, takich jak Połączone/Rozłączone. Dodano w wersji 1.2.0

ConnectionMessage

ConnectionMessage reprezentuje komunikaty specyficzne dla implementacji wysyłane do usługi rozpoznawania mowy i odbierane z tej usługi. Te komunikaty są udostępniane do celów debugowania i nie powinny być używane w przypadku przypadków użycia w środowisku produkcyjnym w usłudze Mowa w usługach Azure Cognitive Services. Komunikaty wysyłane do usługi rozpoznawania mowy i odbierane z tej usługi mogą ulec zmianie bez powiadomienia. Obejmuje to zawartość wiadomości, nagłówki, ładunki, kolejność itp. Dodano element w wersji 1.11.0.

ConnectionMessageEventArgs
ConversationTranscriber

Wykonuje rozpoznawanie mowy z separacją osoby mówiącej z mikrofonu, pliku lub innych strumieni wejściowych audio i pobiera transkrypcję tekstu w wyniku. KonwerterRozmów

ConversationTranscriptionCanceledEventArgs

Definiuje zawartość elementu RecognitionErrorEvent. ConversationTranscriptionCanceledEventArgs

ConversationTranscriptionEventArgs

Definiuje zawartość transkrypcji/transkrypcji zdarzenia konwersacji. ConversationTranscriptionEventArgs

ConversationTranscriptionResult

Definiuje wynik transkrypcji konwersacji. ConversationTranscriptionResult

Coordinate

Definiuje współrzędną w przestrzeni 2D. Współrzędne dodane w wersji 1.33.0

CustomCommandsConfig

Klasa, która definiuje konfiguracje obiektu łącznika usługi dialogowej do używania zaplecza CustomCommands. CustomCommandsConfig

Diagnostics

Definiuje interfejs API diagnostyki do zarządzania danymi wyjściowymi konsoli Dodany w wersji 1.21.0

DialogServiceConfig

Klasa definiująca podstawowe konfiguracje dla złącza usług dialogowych DialogServiceConfig

DialogServiceConnector

Dialog Service Connector DialogServiceConnector

KeywordRecognitionModel

Reprezentuje model rozpoznawania słów kluczowych do rozpoznawania, gdy użytkownik mówi słowo kluczowe, aby zainicjować dalsze rozpoznawanie mowy. Słowo kluczoweRecognitionModel

Meeting
MeetingTranscriber
MeetingTranscriptionCanceledEventArgs

Definiuje zawartość obiektu MeetingTranscriptionCanceledEvent. MeetingTranscriptionCanceledEventArgs

MeetingTranscriptionEventArgs

Definiuje zawartość zdarzenia transkrypcji/transkrypcji spotkania. MeetingTranscriptionEventArgs

NoMatchDetails

Zawiera szczegółowe informacje dotyczące wyników rozpoznawania NoMatch. NoMatchDetails

Participant

Reprezentuje uczestnika spotkania. Dodano w wersji 1.4.0

PhraseListGrammar

Umożliwia dodawanie nowych fraz w celu poprawy rozpoznawania mowy.

Frazy dodane do rozpoznawania są skuteczne na początku następnego rozpoznawania lub przy następnym połączeniu zestawu SpeechSDK z usługą rozpoznawania mowy.

PronunciationAssessmentConfig

Konfiguracja oceny wymowy. PronunciationAssessmentConfig Dodano w wersji 1.15.0.

PronunciationAssessmentResult

Wyniki oceny wymowy. PronunciationAssessmentResult Dodano w wersji 1.15.0.

PropertyCollection

Reprezentuje kolekcję właściwości i ich wartości. KolekcjaWłaściwości

PullAudioInputStream

Reprezentuje strumień wejściowy audio używany do niestandardowych konfiguracji wejściowych audio. Strumień AudioInputStream

PullAudioInputStreamCallback

Abstrakcyjna klasa bazowa, która definiuje metody wywołania zwrotnego (read() i close()) dla niestandardowych strumieni wejściowych audio). PullAudioInputStreamCallback

PullAudioOutputStream

Reprezentuje strumień wyjściowy wypychania audio oparty na pamięci używany na potrzeby niestandardowych konfiguracji danych wyjściowych audio. PullAudioOutputStream

PushAudioInputStream

Reprezentuje strumień danych wejściowych audio wypychanych opartych na pamięci używany na potrzeby niestandardowych konfiguracji danych wejściowych audio. PushAudioInputStream

PushAudioOutputStream

Reprezentuje strumień wyjściowy audio używany do niestandardowych konfiguracji wyjściowych audio. AudioOutputStream

PushAudioOutputStreamCallback

Abstrakcyjna klasa bazowa, która definiuje metody wywołania zwrotnego (write() i close()) dla niestandardowych strumieni wyjściowych audio). PushAudioOutputStreamCallback

RecognitionEventArgs

Definiuje ładunek dla zdarzeń sesji, takich jak rozpoczęcie/zakończenie mowy wykryte

RecognitionResult

Definiuje wynik rozpoznawania mowy. UznanieWynik

Recognizer

Definiuje rozpoznawanie klasy bazowej, która zawiera głównie typowe programy obsługi zdarzeń. Aparat rozpoznawania

ServiceEventArgs

Definiuje ładunek dla dowolnego zdarzenia komunikatu usługi Dodane w wersji 1.9.0

SessionEventArgs

Definiuje zawartość zdarzeń sesji, takich jak SessionStarted/Stopped, SoundStarted/Stopped. SessionEventArgs

SourceLanguageConfig

Konfiguracja języka źródłowego. SourceLanguageConfig

SpeakerAudioDestination

Reprezentuje miejsce docelowe odtwarzania dźwięku osoby mówiącej, które działa tylko w przeglądarce. Uwaga: zestaw SDK spróbuje użyć rozszerzenia źródła multimediów do odtwarzania dźwięku. Format Mp3 ma lepszą obsługę w przeglądarkach Microsoft Edge, Chrome i Safari (komputery), dlatego lepiej jest określić format mp3 na potrzeby odtwarzania. SpeakerAudioDestination Zaktualizowano w wersji 1.17.0

SpeechConfig

Konfiguracja mowy. SpeechConfig

SpeechConfigImpl

SpeechConfigImpl

SpeechRecognitionCanceledEventArgs
SpeechRecognitionEventArgs

Definiuje zawartość zdarzenia rozpoznawania/rozpoznawania mowy. SpeechRecognitionEventArgs

SpeechRecognitionResult

Definiuje wynik rozpoznawania mowy. SpeechRecognitionResult

SpeechRecognizer

Wykonuje rozpoznawanie mowy z mikrofonu, pliku lub innych strumieni wejściowych audio i pobiera transkrypcję tekstu w wyniku. Rozpoznawanie mowy

SpeechSynthesisBookmarkEventArgs

Definiuje zawartość zdarzenia zakładki syntezy mowy. SpeechSynthesisBookmarkEventArgs dodane w wersji 1.16.0

SpeechSynthesisEventArgs

Definiuje zawartość zdarzeń syntezy mowy. SpeechSynthesisEventArgs dodane w wersji 1.11.0

SpeechSynthesisRequest

Reprezentuje żądanie syntezy mowy z obsługą strumieniowania tekstu. Uwaga: ta klasa jest w wersji zapoznawczej i może ulec zmianie w przyszłych wersjach. SpeechSynthesisRequest

SpeechSynthesisRequestInputStream

Reprezentuje strumień wejściowy do przesyłania tekstu na żądanie syntezy mowy. Uwaga: ta klasa jest w wersji zapoznawczej i może ulec zmianie w przyszłych wersjach. Strumień PrzesłaniaPrzesłaniaTekstuTekstuSyntezy

SpeechSynthesisResult

Definiuje wynik syntezy mowy. SpeechSynthesisResult dodano w wersji 1.11.0

SpeechSynthesisVisemeEventArgs

Definiuje zawartość zdarzenia syntezy mowy. SpeechSynthesisVisemeEventArgs dodane w wersji 1.16.0

SpeechSynthesisWordBoundaryEventArgs

Definiuje zawartość zdarzenia granicy słowa syntezy mowy. SpeechSynthesisWordBoundaryEventArgs dodane w wersji 1.11.0

SpeechSynthesizer

Definiuje klasę SpeechSynthesizer dla zamiany tekstu na mowę. Zaktualizowano w wersji 1.16.0 SpeechSynthesizer

SpeechTranslationConfig

Konfiguracja tłumaczenia mowy. Konfiguracja Tłumaczenia Mowy

SynthesisResult

Klasa bazowa dla wyników syntezy SynthesisResult Dodano w wersji 1.20.0

SynthesisVoicesResult

Definiuje wynik syntezy mowy. SynthesisVoicesResult dodano w wersji 1.20.0

Synthesizer
TranslationRecognitionCanceledEventArgs

Zdefiniuj ładunek anulowanych zdarzeń wyników rozpoznawania mowy. TranslationRecognitionCanceledEventArgs

TranslationRecognitionEventArgs

Argumenty zdarzeń wyniku tłumaczenia tekstu. TranslationRecognitionEventArgs

TranslationRecognitionResult

Wynik tłumaczenia tekstu. TranslationRecognitionResult

TranslationRecognizer

Rozpoznawacz translacji TranslationRecognizer

TranslationSynthesisEventArgs

Argumenty zdarzeń Translation Synthesis TranslationSynthesisEventArgs

TranslationSynthesisResult

Definiuje wynik syntezy tłumaczenia, tj. dane wyjściowe głosu przetłumaczonego tekstu w języku docelowym. TranslationSynthesisResult

Translations

Reprezentuje kolekcję parametrów i ich wartości. Tłumaczenia

TurnStatusReceivedEventArgs

Definiuje zawartość odebranego komunikatu/zdarzeń. TurnStatusReceivedEventArgs

User
VoiceInfo

Informacje o głosie syntezy mowy Dodane w wersji 1.20.0. Informacje o głosach

Interfejsy

CancellationEventArgs
IParticipant

Reprezentuje uczestnika spotkania. Dodano w wersji 1.4.0

IPlayer

Reprezentuje interfejs odtwarzacza audio do sterowania odtwarzaniem dźwięku, takim jak pauza, wznowienie itp. IPlayer Dodano w wersji 1.12.0

IVoiceJson
MeetingInfo
VoiceSignature

Wyliczenia

AudioFormatTag
CancellationErrorCode

Definiuje kod błędu w przypadku, gdy wartość CancellationReason to Błąd. Dodano element w wersji 1.1.0.

CancellationReason

Definiuje możliwe przyczyny anulowania wyniku rozpoznawania. CancellationReason

LanguageIdMode

Tryb identyfikacji języka LanguageIdMode

LogLevel
NoMatchReason

Definiuje możliwe przyczyny, dla których wynik rozpoznawania może nie zostać rozpoznany. NoMatchReason

OutputFormat

Zdefiniuj formaty danych wyjściowych rozpoznawania mowy. OutputFormat

ProfanityOption

Opcja wulgaryzmów. Dodano element w wersji 1.7.0.

PronunciationAssessmentGradingSystem

Definiuje system punktów do kalibracji wyniku wymowy; wartość domyślna to FivePoint. Dodano w wersji 1.15.0 PronunciationAssessmentGradingSystem

PronunciationAssessmentGranularity

Definiuje stopień szczegółowości oceny wymowy; wartość domyślna to Phoneme. Dodano w wersji 1.15.0 PronunciationAssessmentGranularity

PropertyId

Definiuje identyfikatory właściwości mowy. PropertyId

ResultReason

Definiuje możliwe przyczyny wygenerowania wyniku rozpoznawania. Przyczyna Wyniku

ServicePropertyChannel

Definiuje kanały używane do przekazywania ustawień właściwości do usługi. Dodano element w wersji 1.7.0.

SpeechSynthesisBoundaryType

Definiuje typ granicy granicy mowy. SpeechSynthesisBoundaryType dodano w wersji 1.21.0

SpeechSynthesisOutputFormat

Zdefiniuj formaty danych wyjściowych syntezy mowy. SpeechSynthesisOutputFormat zaktualizowano w wersji 1.17.0

SpeechSynthesisRequestInputType

Definiuje typ wejściowy żądania syntezy mowy. SpeechSynthesisRequestInputType

SynthesisVoiceGender

Określa płeć głosów syntezy. Dodano element w wersji 1.20.0.

SynthesisVoiceType