microsoft-cognitiveservices-speech-sdk package
Třídy
| ActivityReceivedEventArgs |
Definuje obsah přijatých zpráv nebo událostí. ActivityReceivedEventArgs |
| AudioConfig |
Představuje konfiguraci zvukového vstupu použitou k určení typu vstupu, který se má použít (mikrofon, soubor, datový proud). AudioConfig aktualizováno ve verzi 1.11.0 |
| AudioInputStream |
Představuje zvukový vstupní datový proud používaný pro vlastní konfigurace zvukového vstupu. Zvukový vstupní stream |
| AudioOutputStream |
Představuje zvukový výstupní datový proud používaný pro vlastní konfigurace zvukového výstupu. AudioOutputStream |
| AudioStreamFormat |
Představuje formát zvukového streamu používaný pro vlastní konfigurace zvukového vstupu. AudioStreamFormat |
| AutoDetectSourceLanguageConfig |
Konfigurace automatického rozpoznávání jazyka AutoDetectSourceLanguageConfig přidán ve verzi 1.13.0. |
| AutoDetectSourceLanguageResult |
Výstupní formát AutoDetectSourceLanguageResult |
| AvatarConfig |
Definuje konfiguraci mluvícího avatara. AvatarConfig přidán ve verzi 1.33.0 Tato funkce je experimentální a může se měnit nebo mít omezenou podporu. |
| AvatarEventArgs |
Definuje obsah pro mluvení událostí avatarů. AvatarEventArgs přidán ve verzi 1.33.0 Tato funkce je experimentální a může se měnit nebo mít omezenou podporu. |
| AvatarSceneConfig |
Definuje konfiguraci scény s avatarem pro řízení polohy a orientace avatara. AvatarSceneConfig přidán ve verzi 1.44.0 Tato funkce je experimentální a může se měnit nebo mít omezenou podporu. |
| AvatarSynthesizer |
Definuje syntetizátor avataru. AvatarSynthesizer přidán ve verzi 1.33.0 Tato funkce je experimentální a může se měnit nebo mít omezenou podporu. |
| AvatarVideoFormat |
Definuje výstupní formát videa avatara. AvatarVideoFormat přidán ve verzi 1.33.0 Tato funkce je experimentální a může se v budoucnu změnit. |
| AvatarWebRTCConnectionResult |
Definuje výsledek připojení WebRTC avataru. AvatarWebRTCConnectionResult přidáno ve verzi 1.33.0 Tato funkce je experimentální a může se v budoucnu změnit. |
| BaseAudioPlayer |
Základní audio přehrávač třídy TODO: Přehrává pouze PCM prozatím. |
| BotFrameworkConfig |
Třída, která definuje konfigurace pro objekt konektoru služby dialog pro použití back-endu služby Bot Framework. BotFrameworkConfig |
| CancellationDetails |
Obsahuje podrobné informace o tom, proč byl výsledek zrušen. ZrušeníPodrobnosti |
| CancellationDetailsBase |
Obsahuje podrobné informace o tom, proč byl výsledek zrušen. CancellationDetailsBase |
| Connection |
Připojení je třída proxy pro správu připojení ke službě Speech zadaného rozpoznávání. Ve výchozím nastavení služba Recognizer v případě potřeby samostatně spravuje připojení ke službě. Třída Connection poskytuje uživatelům další metody, jak explicitně otevřít nebo zavřít připojení a přihlásit se k odběru změn stavu připojení. Použití připojení je volitelné a hlavně pro scénáře, ve kterých je potřeba jemně doladit chování aplikace na základě stavu připojení. Uživatelé můžou volitelně volat Open() a ručně nastavit připojení předem před zahájením rozpoznávání v nástroji Recognizer přidruženém k tomuto připojení. Pokud se služba Recognizer potřebuje připojit nebo odpojit ke službě, nastaví nebo vypne připojení nezávisle. V takovém případě bude připojení upozorněno změnou stavu připojení prostřednictvím událostí Připojeno/Odpojeno. Přidáno ve verzi 1.2.1. |
| ConnectionEventArgs |
Definuje datovou část pro události připojení, jako je Connected/Disconnected. Přidáno ve verzi 1.2.0 |
| ConnectionMessage |
ConnectionMessage představuje implementaci konkrétních zpráv odesílaných a přijatých ze služby Speech. Tyto zprávy jsou k dispozici pro účely ladění a neměly by se používat pro případy použití v produkčním prostředí se službou Azure Cognitive Services Speech Service. Zprávy odeslané službě Speech a přijaté ze služby Speech se můžou bez předchozího upozornění měnit. To zahrnuje obsah zpráv, záhlaví, datové části, řazení atd. Přidáno ve verzi 1.11.0. |
| ConnectionMessageEventArgs | |
| ConversationTranscriber |
Provádí rozpoznávání řeči s oddělením reproduktoru od mikrofonu, souboru nebo jiných streamů zvukového vstupu a v důsledku toho přepíše text. Přepisovač konverzací |
| ConversationTranscriptionCanceledEventArgs |
Definuje obsah funkce RecognitionErrorEvent. ConversationTranscriptionCanceledEventArgs |
| ConversationTranscriptionEventArgs |
Definuje obsah události přepisu nebo přepisu konverzace. ConversationTranscriptionEventArgs |
| ConversationTranscriptionResult |
Definuje výsledek přepisu konverzace. ConversationTranscriptionResult |
| Coordinate |
Definuje souřadnici v 2D prostoru. Souřadnice přidány ve verzi 1.33.0 |
| CustomCommandsConfig |
Třída, která definuje konfigurace pro objekt konektoru služby dialogového okna pro použití back-endu CustomCommands. CustomCommandsConfig |
| Diagnostics |
Definuje rozhraní API diagnostiky pro správu výstupu konzoly přidaného ve verzi 1.21.0. |
| DialogServiceConfig |
Třída, která definuje základní konfigurace pro konektor dialogových služeb DialogServiceConfig |
| DialogServiceConnector |
Dialog Service Connector DialogServiceConnector |
| KeywordRecognitionModel |
Představuje model rozpoznávání klíčových slov pro rozpoznávání, když uživatel říká klíčové slovo pro zahájení dalšího rozpoznávání řeči. KeywordRecognitionModel |
| Meeting | |
| MeetingTranscriber | |
| MeetingTranscriptionCanceledEventArgs |
Definuje obsah MeetingTranscriptionCanceledEvent. MeetingTranscriptionCanceledEventArgs |
| MeetingTranscriptionEventArgs |
Definuje obsah události, která se přepíše nebo přepíše. MeetingTranscriptionEventArgs |
| NoMatchDetails |
Obsahuje podrobné informace o výsledcích rozpoznávání NoMatch. NoMatchDetails |
| Participant |
Zastupuje účastníka schůzky. Přidáno ve verzi 1.4.0 |
| PhraseListGrammar |
Umožňuje přidávání nových frází ke zlepšení rozpoznávání řeči. Fráze přidané do rozpoznávání jsou efektivní na začátku dalšího rozpoznávání, nebo se při příštím připojení sady SpeechSDK ke službě SpeechSDK musí znovu připojit. |
| PronunciationAssessmentConfig |
Konfigurace posouzení výslovnosti PronunciationAssessmentConfig přidáno ve verzi 1.15.0. |
| PronunciationAssessmentResult |
Výsledky hodnocení výslovnosti. PronunciationAssessmentResult přidáno ve verzi 1.15.0. |
| PropertyCollection |
Představuje kolekci vlastností a jejich hodnot. KolekceVlastnosti |
| PullAudioInputStream |
Představuje zvukový vstupní datový proud používaný pro vlastní konfigurace zvukového vstupu. Zvukový vstupní stream |
| PullAudioInputStreamCallback |
Abstraktní základní třída, která definuje metody zpětného volání (read() a close()) pro vlastní zvukové vstupní streamy). PullAudioInputStreamCallback |
| PullAudioOutputStream |
Představuje stream zvukového výstupu s podporou paměti používaný pro vlastní konfigurace zvukového výstupu. PullAudioOutputStream |
| PushAudioInputStream |
Představuje stream zvukového vstupu s podporou paměti, který se používá pro vlastní konfigurace zvukového vstupu. PushAudioInputStream |
| PushAudioOutputStream |
Představuje zvukový výstupní datový proud používaný pro vlastní konfigurace zvukového výstupu. AudioOutputStream |
| PushAudioOutputStreamCallback |
Abstraktní základní třída, která definuje metody zpětného volání (write() a close()) pro vlastní zvukové výstupní streamy). PushAudioOutputStreamCallback |
| RecognitionEventArgs |
Definuje datovou část pro události relace, jako je start/konec rozpoznávání řeči. |
| RecognitionResult |
Definuje výsledek rozpoznávání řeči. OceněníVýsledek |
| Recognizer |
Definuje základní třídu Recognizer, která obsahuje hlavně běžné obslužné rutiny událostí. Rozpoznávač |
| ServiceEventArgs |
Definuje datovou část pro událost zprávy služby přidanou ve verzi 1.9.0. |
| SessionEventArgs |
Definuje obsah událostí relace, jako jsou SessionStarted/Stopped, SoundStarted/Stopped. SessionEventArgs |
| SourceLanguageConfig |
Konfigurace zdrojového jazyka SourceLanguageConfig |
| SpeakerAudioDestination |
Představuje cíl přehrávání zvuku mluvčího, který funguje jenom v prohlížeči. Poznámka: Sada SDK se pokusí použít rozšíření zdroje médií k přehrávání zvuku. Formát Mp3 má lepší podporu pro Microsoft Edge, Chrome a Safari (desktop), takže je lepší určit formát mp3 pro přehrávání. SpeakerAudioDestination Aktualizováno ve verzi 1.17.0 |
| SpeechConfig |
Konfigurace řeči SpeechConfig |
| SpeechConfigImpl |
SpeechConfigImpl |
| SpeechRecognitionCanceledEventArgs | |
| SpeechRecognitionEventArgs |
Definuje obsah rozpoznávání a rozpoznané události řeči. SpeechRecognitionEventArgs |
| SpeechRecognitionResult |
Definuje výsledek rozpoznávání řeči. SpeechRecognitionResult |
| SpeechRecognizer |
Provádí rozpoznávání řeči z mikrofonu, souboru nebo jiných zvukových vstupních datových proudů a v důsledku toho se přepíše text. Rozpoznávač řeči |
| SpeechSynthesisBookmarkEventArgs |
Definuje obsah události záložky syntézy řeči. SpeechSynthesisBookmarkEventArgs přidán ve verzi 1.16.0 |
| SpeechSynthesisEventArgs |
Definuje obsah událostí syntézy řeči. SpeechSynthesisEventArgs přidán ve verzi 1.11.0 |
| SpeechSynthesisRequest |
Představuje požadavek na syntézu řeči s podporou streamování textu. Poznámka: Tato třída je ve verzi Preview a může se v budoucích verzích měnit. Žádost o syntézu řeči |
| SpeechSynthesisRequestInputStream |
Představuje vstupní proud pro streamování textu na požadavek na syntézu řeči. Poznámka: Tato třída je ve verzi Preview a může se v budoucích verzích měnit. Proud SpeechSynthesisRequestInputStream |
| SpeechSynthesisResult |
Definuje výsledek syntézy řeči. SpeechSynthesisResult přidán ve verzi 1.11.0 |
| SpeechSynthesisVisemeEventArgs |
Definuje obsah události syntézy řeči viseme. SpeechSynthesisVisemeEventArgs přidán ve verzi 1.16.0 |
| SpeechSynthesisWordBoundaryEventArgs |
Definuje obsah události hranice slova syntézy řeči. SpeechSynthesisWordBoundaryEventArgs přidány ve verzi 1.11.0 |
| SpeechSynthesizer |
Definuje třídu SpeechSynthesizer pro převod textu na řeč. Aktualizováno ve verzi 1.16.0 SpeechSynthesizer |
| SpeechTranslationConfig |
Konfigurace překladu řeči Konfigurace překladu řeči |
| SynthesisResult |
Základní třída pro výsledky syntézy SynthesisResult Přidáno ve verzi 1.20.0 |
| SynthesisVoicesResult |
Definuje výsledek syntézy řeči. SynthesisVoicesResult přidáno ve verzi 1.20.0 |
| Synthesizer | |
| TranslationRecognitionCanceledEventArgs |
Definujte datovou část událostí zrušených výsledků rozpoznávání řeči. TranslationRecognitionCanceledEventArgs |
| TranslationRecognitionEventArgs |
Argumenty události výsledku překladu textu TranslationRecognitionEventArgs |
| TranslationRecognitionResult |
Výsledek překladu textu TranslationRecognitionResult |
| TranslationRecognizer |
Rozpoznávač překladů TranslationRecognizer |
| TranslationSynthesisEventArgs |
Argumenty událostí Translation Synthesis TranslationSynthesisEventArgs |
| TranslationSynthesisResult |
Definuje výsledek syntézy překladu, tj. hlasový výstup přeloženého textu v cílovém jazyce. TranslationSynthesisResult |
| Translations |
Představuje kolekci parametrů a jejich hodnot. Překlady |
| TurnStatusReceivedEventArgs |
Definuje obsah přijatých zpráv nebo událostí. TurnStatusReceivedEventArgs |
| User | |
| VoiceInfo |
Informace o hlasu syntézy řeči přidány ve verzi 1.20.0. VoiceInfo |
Rozhraní
| CancellationEventArgs | |
| IParticipant |
Zastupuje účastníka schůzky. Přidáno ve verzi 1.4.0 |
| IPlayer |
Představuje rozhraní přehrávače zvuku pro řízení přehrávání zvuku, například pauza, pokračování atd. IPlayer přidán ve verzi 1.12.0 |
| IVoiceJson | |
| MeetingInfo | |
| VoiceSignature | |
Výčty
| AudioFormatTag | |
| CancellationErrorCode |
Definuje kód chyby v případě, že CancellationReason je Chyba. Přidáno ve verzi 1.1.0. |
| CancellationReason |
Definuje možné důvody, proč může být výsledek rozpoznávání zrušen. CancellationReason |
| LanguageIdMode |
Režim identifikace jazyka LanguageIdMode |
| LogLevel | |
| NoMatchReason |
Definuje možné důvody, proč se výsledek rozpoznávání nemusí rozpoznat. NoMatchReason |
| OutputFormat |
Definujte výstupní formáty služby Rozpoznávání řeči. Výstupní formát |
| ProfanityOption |
Možnost vulgárních výrazů. Přidáno ve verzi 1.7.0. |
| PronunciationAssessmentGradingSystem |
Definuje bodový systém pro kalibraci skóre výslovnosti; výchozí hodnota je FivePoint. Přidáno ve verzi 1.15.0 PronunciationAssessmentGradingSystem |
| PronunciationAssessmentGranularity |
Definuje členitost vyhodnocení výslovnosti; výchozí hodnota je Phoneme. Přidáno ve verzi 1.15.0 PronunciationAssessmentGranularity |
| PropertyId |
Definuje ID vlastností řeči. PropertyId |
| ResultReason |
Definuje možné důvody, proč se může vygenerovat výsledek rozpoznávání. Důvod výsledku |
| ServicePropertyChannel |
Definuje kanály používané k předávání nastavení vlastností do služby. Přidáno ve verzi 1.7.0. |
| SpeechSynthesisBoundaryType |
Definuje typ hranice události hranice syntézy řeči. SpeechSynthesisBoundaryType přidán ve verzi 1.21.0 |
| SpeechSynthesisOutputFormat |
Definujte formáty zvukového výstupu syntézy řeči. SpeechSynthesisOutputFormat aktualizováno ve verzi 1.17.0 |
| SpeechSynthesisRequestInputType |
Definuje typ vstupu pro požadavek na syntézu řeči. SpeechSynthesisRequestInputType |
| SynthesisVoiceGender |
Definuje pohlaví syntetických hlasů. Přidáno ve verzi 1.20.0. |
| SynthesisVoiceType | |