microsoft-cognitiveservices-speech-sdk package
Klasy
| ActivityReceivedEventArgs |
Definiuje zawartość odebranego komunikatu/zdarzeń. ActivityReceivedEventArgs |
| AudioConfig |
Reprezentuje konfigurację danych wejściowych audio służącą do określania typu danych wejściowych do użycia (mikrofon, plik, strumień). AudioConfig Zaktualizowano w wersji 1.11.0 |
| AudioInputStream |
Reprezentuje strumień wejściowy audio używany do niestandardowych konfiguracji wejściowych audio. Strumień AudioInputStream |
| AudioOutputStream |
Reprezentuje strumień wyjściowy audio używany do niestandardowych konfiguracji wyjściowych audio. AudioOutputStream |
| AudioStreamFormat |
Reprezentuje format strumienia audio używany na potrzeby niestandardowych konfiguracji wejściowych audio. AudioStreamFormat |
| AutoDetectSourceLanguageConfig |
Automatyczna konfiguracja wykrywania języka. AutoDetectSourceLanguageConfig dodano w wersji 1.13.0. |
| AutoDetectSourceLanguageResult |
Format wyjściowy AutoDetectSourceLanguageResult |
| AvatarConfig |
Definiuje konfigurację awatara rozmowy. AvatarConfig dodano w wersji 1.33.0 Ta funkcja jest eksperymentalna i może się zmieniać lub mieć ograniczone wsparcie. |
| AvatarEventArgs |
Definiuje zawartość do mówienia zdarzeń awatara. AvatarEventArgs dodane w wersji 1.33.0 Ta funkcja jest eksperymentalna i może się zmieniać lub mieć ograniczone wsparcie. |
| AvatarSceneConfig |
Definiuje konfigurację sceny awatara do sterowania pozycjonowaniem i orientacją awatara. AvatarSceneConfig dodano w wersji 1.44.0 Ta funkcja jest eksperymentalna i może się zmieniać lub mieć ograniczone wsparcie. |
| AvatarSynthesizer |
Definiuje syntetyzator awatara. AvatarSynthesizer dodany w wersji 1.33.0 Ta funkcja jest eksperymentalna i może się zmieniać lub mieć ograniczone wsparcie. |
| AvatarVideoFormat |
Definiuje format wideo wyjściowego awatara. AvatarVideoFormat dodany w wersji 1.33.0 Ta funkcja jest eksperymentalna i może się zmienić w przyszłości. |
| AvatarWebRTCConnectionResult |
Definiuje wynik połączenia awatara WebRTC. AvatarWebRTCConnectionResult Dodano w wersji 1.33.0 Ta funkcja jest eksperymentalna i może się zmienić w przyszłości. |
| BaseAudioPlayer |
Podstawowa klasa odtwarzacza audio TODO: odtwarza tylko PCM na razie. |
| BotFrameworkConfig |
Klasa, która definiuje konfiguracje obiektu łącznika usługi dialogowej na potrzeby używania zaplecza platformy Bot Framework. BotFrameworkConfig |
| CancellationDetails |
Zawiera szczegółowe informacje o tym, dlaczego wynik został anulowany. AnulowanieSzczegóły |
| CancellationDetailsBase |
Zawiera szczegółowe informacje o tym, dlaczego wynik został anulowany. CancelDetailsBase |
| Connection |
Połączenie to klasa serwera proxy do zarządzania połączeniem z usługą rozpoznawania mowy określonego rozpoznawania. Domyślnie rozpoznawanie autonomiczne zarządza połączeniem z usługą w razie potrzeby. Klasa Połączenie udostępnia dodatkowe metody umożliwiające użytkownikom jawne otwieranie lub zamykanie połączenia oraz subskrybowanie zmian stanu połączenia. Użycie połączenia jest opcjonalne i dotyczy głównie scenariuszy, w których wymagane jest precyzyjne dostrajanie zachowania aplikacji na podstawie stanu połączenia. Użytkownicy mogą opcjonalnie wywołać metodę Open(), aby ręcznie skonfigurować połączenie z wyprzedzeniem przed rozpoczęciem rozpoznawania w rozpoznawaniu skojarzonym z tym połączeniem. Jeśli narzędzie rozpoznawania musi nawiązać połączenie z usługą lub je rozłączyć, skonfiguruje lub niezależnie zamknij połączenie. W takim przypadku połączenie zostanie powiadomione przez zmianę stanu połączenia za pośrednictwem zdarzeń Połączony/Rozłączony. Dodano element w wersji 1.2.1. |
| ConnectionEventArgs |
Definiuje ładunek dla zdarzeń połączenia, takich jak Połączone/Rozłączone. Dodano w wersji 1.2.0 |
| ConnectionMessage |
ConnectionMessage reprezentuje komunikaty specyficzne dla implementacji wysyłane do usługi rozpoznawania mowy i odbierane z tej usługi. Te komunikaty są udostępniane do celów debugowania i nie powinny być używane w przypadku przypadków użycia w środowisku produkcyjnym w usłudze Mowa w usługach Azure Cognitive Services. Komunikaty wysyłane do usługi rozpoznawania mowy i odbierane z tej usługi mogą ulec zmianie bez powiadomienia. Obejmuje to zawartość wiadomości, nagłówki, ładunki, kolejność itp. Dodano element w wersji 1.11.0. |
| ConnectionMessageEventArgs | |
| ConversationTranscriber |
Wykonuje rozpoznawanie mowy z separacją osoby mówiącej z mikrofonu, pliku lub innych strumieni wejściowych audio i pobiera transkrypcję tekstu w wyniku. KonwerterRozmów |
| ConversationTranscriptionCanceledEventArgs |
Definiuje zawartość elementu RecognitionErrorEvent. ConversationTranscriptionCanceledEventArgs |
| ConversationTranscriptionEventArgs |
Definiuje zawartość transkrypcji/transkrypcji zdarzenia konwersacji. ConversationTranscriptionEventArgs |
| ConversationTranscriptionResult |
Definiuje wynik transkrypcji konwersacji. ConversationTranscriptionResult |
| Coordinate |
Definiuje współrzędną w przestrzeni 2D. Współrzędne dodane w wersji 1.33.0 |
| CustomCommandsConfig |
Klasa, która definiuje konfiguracje obiektu łącznika usługi dialogowej do używania zaplecza CustomCommands. CustomCommandsConfig |
| Diagnostics |
Definiuje interfejs API diagnostyki do zarządzania danymi wyjściowymi konsoli Dodany w wersji 1.21.0 |
| DialogServiceConfig |
Klasa definiująca podstawowe konfiguracje dla złącza usług dialogowych DialogServiceConfig |
| DialogServiceConnector |
Dialog Service Connector DialogServiceConnector |
| KeywordRecognitionModel |
Reprezentuje model rozpoznawania słów kluczowych do rozpoznawania, gdy użytkownik mówi słowo kluczowe, aby zainicjować dalsze rozpoznawanie mowy. Słowo kluczoweRecognitionModel |
| Meeting | |
| MeetingTranscriber | |
| MeetingTranscriptionCanceledEventArgs |
Definiuje zawartość obiektu MeetingTranscriptionCanceledEvent. MeetingTranscriptionCanceledEventArgs |
| MeetingTranscriptionEventArgs |
Definiuje zawartość zdarzenia transkrypcji/transkrypcji spotkania. MeetingTranscriptionEventArgs |
| NoMatchDetails |
Zawiera szczegółowe informacje dotyczące wyników rozpoznawania NoMatch. NoMatchDetails |
| Participant |
Reprezentuje uczestnika spotkania. Dodano w wersji 1.4.0 |
| PhraseListGrammar |
Umożliwia dodawanie nowych fraz w celu poprawy rozpoznawania mowy. Frazy dodane do rozpoznawania są skuteczne na początku następnego rozpoznawania lub przy następnym połączeniu zestawu SpeechSDK z usługą rozpoznawania mowy. |
| PronunciationAssessmentConfig |
Konfiguracja oceny wymowy. PronunciationAssessmentConfig Dodano w wersji 1.15.0. |
| PronunciationAssessmentResult |
Wyniki oceny wymowy. PronunciationAssessmentResult Dodano w wersji 1.15.0. |
| PropertyCollection |
Reprezentuje kolekcję właściwości i ich wartości. KolekcjaWłaściwości |
| PullAudioInputStream |
Reprezentuje strumień wejściowy audio używany do niestandardowych konfiguracji wejściowych audio. Strumień AudioInputStream |
| PullAudioInputStreamCallback |
Abstrakcyjna klasa bazowa, która definiuje metody wywołania zwrotnego (read() i close()) dla niestandardowych strumieni wejściowych audio). PullAudioInputStreamCallback |
| PullAudioOutputStream |
Reprezentuje strumień wyjściowy wypychania audio oparty na pamięci używany na potrzeby niestandardowych konfiguracji danych wyjściowych audio. PullAudioOutputStream |
| PushAudioInputStream |
Reprezentuje strumień danych wejściowych audio wypychanych opartych na pamięci używany na potrzeby niestandardowych konfiguracji danych wejściowych audio. PushAudioInputStream |
| PushAudioOutputStream |
Reprezentuje strumień wyjściowy audio używany do niestandardowych konfiguracji wyjściowych audio. AudioOutputStream |
| PushAudioOutputStreamCallback |
Abstrakcyjna klasa bazowa, która definiuje metody wywołania zwrotnego (write() i close()) dla niestandardowych strumieni wyjściowych audio). PushAudioOutputStreamCallback |
| RecognitionEventArgs |
Definiuje ładunek dla zdarzeń sesji, takich jak rozpoczęcie/zakończenie mowy wykryte |
| RecognitionResult |
Definiuje wynik rozpoznawania mowy. UznanieWynik |
| Recognizer |
Definiuje rozpoznawanie klasy bazowej, która zawiera głównie typowe programy obsługi zdarzeń. Aparat rozpoznawania |
| ServiceEventArgs |
Definiuje ładunek dla dowolnego zdarzenia komunikatu usługi Dodane w wersji 1.9.0 |
| SessionEventArgs |
Definiuje zawartość zdarzeń sesji, takich jak SessionStarted/Stopped, SoundStarted/Stopped. SessionEventArgs |
| SourceLanguageConfig |
Konfiguracja języka źródłowego. SourceLanguageConfig |
| SpeakerAudioDestination |
Reprezentuje miejsce docelowe odtwarzania dźwięku osoby mówiącej, które działa tylko w przeglądarce. Uwaga: zestaw SDK spróbuje użyć rozszerzenia źródła multimediów do odtwarzania dźwięku. Format Mp3 ma lepszą obsługę w przeglądarkach Microsoft Edge, Chrome i Safari (komputery), dlatego lepiej jest określić format mp3 na potrzeby odtwarzania. SpeakerAudioDestination Zaktualizowano w wersji 1.17.0 |
| SpeechConfig |
Konfiguracja mowy. SpeechConfig |
| SpeechConfigImpl |
SpeechConfigImpl |
| SpeechRecognitionCanceledEventArgs | |
| SpeechRecognitionEventArgs |
Definiuje zawartość zdarzenia rozpoznawania/rozpoznawania mowy. SpeechRecognitionEventArgs |
| SpeechRecognitionResult |
Definiuje wynik rozpoznawania mowy. SpeechRecognitionResult |
| SpeechRecognizer |
Wykonuje rozpoznawanie mowy z mikrofonu, pliku lub innych strumieni wejściowych audio i pobiera transkrypcję tekstu w wyniku. Rozpoznawanie mowy |
| SpeechSynthesisBookmarkEventArgs |
Definiuje zawartość zdarzenia zakładki syntezy mowy. SpeechSynthesisBookmarkEventArgs dodane w wersji 1.16.0 |
| SpeechSynthesisEventArgs |
Definiuje zawartość zdarzeń syntezy mowy. SpeechSynthesisEventArgs dodane w wersji 1.11.0 |
| SpeechSynthesisRequest |
Reprezentuje żądanie syntezy mowy z obsługą strumieniowania tekstu. Uwaga: ta klasa jest w wersji zapoznawczej i może ulec zmianie w przyszłych wersjach. SpeechSynthesisRequest |
| SpeechSynthesisRequestInputStream |
Reprezentuje strumień wejściowy do przesyłania tekstu na żądanie syntezy mowy. Uwaga: ta klasa jest w wersji zapoznawczej i może ulec zmianie w przyszłych wersjach. Strumień PrzesłaniaPrzesłaniaTekstuTekstuSyntezy |
| SpeechSynthesisResult |
Definiuje wynik syntezy mowy. SpeechSynthesisResult dodano w wersji 1.11.0 |
| SpeechSynthesisVisemeEventArgs |
Definiuje zawartość zdarzenia syntezy mowy. SpeechSynthesisVisemeEventArgs dodane w wersji 1.16.0 |
| SpeechSynthesisWordBoundaryEventArgs |
Definiuje zawartość zdarzenia granicy słowa syntezy mowy. SpeechSynthesisWordBoundaryEventArgs dodane w wersji 1.11.0 |
| SpeechSynthesizer |
Definiuje klasę SpeechSynthesizer dla zamiany tekstu na mowę. Zaktualizowano w wersji 1.16.0 SpeechSynthesizer |
| SpeechTranslationConfig |
Konfiguracja tłumaczenia mowy. Konfiguracja Tłumaczenia Mowy |
| SynthesisResult |
Klasa bazowa dla wyników syntezy SynthesisResult Dodano w wersji 1.20.0 |
| SynthesisVoicesResult |
Definiuje wynik syntezy mowy. SynthesisVoicesResult dodano w wersji 1.20.0 |
| Synthesizer | |
| TranslationRecognitionCanceledEventArgs |
Zdefiniuj ładunek anulowanych zdarzeń wyników rozpoznawania mowy. TranslationRecognitionCanceledEventArgs |
| TranslationRecognitionEventArgs |
Argumenty zdarzeń wyniku tłumaczenia tekstu. TranslationRecognitionEventArgs |
| TranslationRecognitionResult |
Wynik tłumaczenia tekstu. TranslationRecognitionResult |
| TranslationRecognizer |
Rozpoznawacz translacji TranslationRecognizer |
| TranslationSynthesisEventArgs |
Argumenty zdarzeń Translation Synthesis TranslationSynthesisEventArgs |
| TranslationSynthesisResult |
Definiuje wynik syntezy tłumaczenia, tj. dane wyjściowe głosu przetłumaczonego tekstu w języku docelowym. TranslationSynthesisResult |
| Translations |
Reprezentuje kolekcję parametrów i ich wartości. Tłumaczenia |
| TurnStatusReceivedEventArgs |
Definiuje zawartość odebranego komunikatu/zdarzeń. TurnStatusReceivedEventArgs |
| User | |
| VoiceInfo |
Informacje o głosie syntezy mowy Dodane w wersji 1.20.0. Informacje o głosach |
Interfejsy
| CancellationEventArgs | |
| IParticipant |
Reprezentuje uczestnika spotkania. Dodano w wersji 1.4.0 |
| IPlayer |
Reprezentuje interfejs odtwarzacza audio do sterowania odtwarzaniem dźwięku, takim jak pauza, wznowienie itp. IPlayer Dodano w wersji 1.12.0 |
| IVoiceJson | |
| MeetingInfo | |
| VoiceSignature | |
Wyliczenia
| AudioFormatTag | |
| CancellationErrorCode |
Definiuje kod błędu w przypadku, gdy wartość CancellationReason to Błąd. Dodano element w wersji 1.1.0. |
| CancellationReason |
Definiuje możliwe przyczyny anulowania wyniku rozpoznawania. CancellationReason |
| LanguageIdMode |
Tryb identyfikacji języka LanguageIdMode |
| LogLevel | |
| NoMatchReason |
Definiuje możliwe przyczyny, dla których wynik rozpoznawania może nie zostać rozpoznany. NoMatchReason |
| OutputFormat |
Zdefiniuj formaty danych wyjściowych rozpoznawania mowy. OutputFormat |
| ProfanityOption |
Opcja wulgaryzmów. Dodano element w wersji 1.7.0. |
| PronunciationAssessmentGradingSystem |
Definiuje system punktów do kalibracji wyniku wymowy; wartość domyślna to FivePoint. Dodano w wersji 1.15.0 PronunciationAssessmentGradingSystem |
| PronunciationAssessmentGranularity |
Definiuje stopień szczegółowości oceny wymowy; wartość domyślna to Phoneme. Dodano w wersji 1.15.0 PronunciationAssessmentGranularity |
| PropertyId |
Definiuje identyfikatory właściwości mowy. PropertyId |
| ResultReason |
Definiuje możliwe przyczyny wygenerowania wyniku rozpoznawania. Przyczyna Wyniku |
| ServicePropertyChannel |
Definiuje kanały używane do przekazywania ustawień właściwości do usługi. Dodano element w wersji 1.7.0. |
| SpeechSynthesisBoundaryType |
Definiuje typ granicy granicy mowy. SpeechSynthesisBoundaryType dodano w wersji 1.21.0 |
| SpeechSynthesisOutputFormat |
Zdefiniuj formaty danych wyjściowych syntezy mowy. SpeechSynthesisOutputFormat zaktualizowano w wersji 1.17.0 |
| SpeechSynthesisRequestInputType |
Definiuje typ wejściowy żądania syntezy mowy. SpeechSynthesisRequestInputType |
| SynthesisVoiceGender |
Określa płeć głosów syntezy. Dodano element w wersji 1.20.0. |
| SynthesisVoiceType | |