microsoft-cognitiveservices-speech-sdk package

Třídy

ActivityReceivedEventArgs

Definuje obsah přijatých zpráv nebo událostí. ActivityReceivedEventArgs

AudioConfig

Představuje konfiguraci zvukového vstupu použitou k určení typu vstupu, který se má použít (mikrofon, soubor, datový proud). AudioConfig aktualizováno ve verzi 1.11.0

AudioInputStream

Představuje zvukový vstupní datový proud používaný pro vlastní konfigurace zvukového vstupu. Zvukový vstupní stream

AudioOutputStream

Představuje zvukový výstupní datový proud používaný pro vlastní konfigurace zvukového výstupu. AudioOutputStream

AudioStreamFormat

Představuje formát zvukového streamu používaný pro vlastní konfigurace zvukového vstupu. AudioStreamFormat

AutoDetectSourceLanguageConfig

Konfigurace automatického rozpoznávání jazyka AutoDetectSourceLanguageConfig přidán ve verzi 1.13.0.

AutoDetectSourceLanguageResult

Výstupní formát AutoDetectSourceLanguageResult

AvatarConfig

Definuje konfiguraci mluvícího avatara. AvatarConfig přidán ve verzi 1.33.0

Tato funkce je experimentální a může se měnit nebo mít omezenou podporu.

AvatarEventArgs

Definuje obsah pro mluvení událostí avatarů. AvatarEventArgs přidán ve verzi 1.33.0

Tato funkce je experimentální a může se měnit nebo mít omezenou podporu.

AvatarSceneConfig

Definuje konfiguraci scény s avatarem pro řízení polohy a orientace avatara. AvatarSceneConfig přidán ve verzi 1.44.0

Tato funkce je experimentální a může se měnit nebo mít omezenou podporu.

AvatarSynthesizer

Definuje syntetizátor avataru. AvatarSynthesizer přidán ve verzi 1.33.0

Tato funkce je experimentální a může se měnit nebo mít omezenou podporu.

AvatarVideoFormat

Definuje výstupní formát videa avatara. AvatarVideoFormat přidán ve verzi 1.33.0

Tato funkce je experimentální a může se v budoucnu změnit.

AvatarWebRTCConnectionResult

Definuje výsledek připojení WebRTC avataru. AvatarWebRTCConnectionResult přidáno ve verzi 1.33.0

Tato funkce je experimentální a může se v budoucnu změnit.

BaseAudioPlayer

Základní audio přehrávač třídy TODO: Přehrává pouze PCM prozatím.

BotFrameworkConfig

Třída, která definuje konfigurace pro objekt konektoru služby dialog pro použití back-endu služby Bot Framework. BotFrameworkConfig

CancellationDetails

Obsahuje podrobné informace o tom, proč byl výsledek zrušen. ZrušeníPodrobnosti

CancellationDetailsBase

Obsahuje podrobné informace o tom, proč byl výsledek zrušen. CancellationDetailsBase

Connection

Připojení je třída proxy pro správu připojení ke službě Speech zadaného rozpoznávání. Ve výchozím nastavení služba Recognizer v případě potřeby samostatně spravuje připojení ke službě. Třída Connection poskytuje uživatelům další metody, jak explicitně otevřít nebo zavřít připojení a přihlásit se k odběru změn stavu připojení. Použití připojení je volitelné a hlavně pro scénáře, ve kterých je potřeba jemně doladit chování aplikace na základě stavu připojení. Uživatelé můžou volitelně volat Open() a ručně nastavit připojení předem před zahájením rozpoznávání v nástroji Recognizer přidruženém k tomuto připojení. Pokud se služba Recognizer potřebuje připojit nebo odpojit ke službě, nastaví nebo vypne připojení nezávisle. V takovém případě bude připojení upozorněno změnou stavu připojení prostřednictvím událostí Připojeno/Odpojeno. Přidáno ve verzi 1.2.1.

ConnectionEventArgs

Definuje datovou část pro události připojení, jako je Connected/Disconnected. Přidáno ve verzi 1.2.0

ConnectionMessage

ConnectionMessage představuje implementaci konkrétních zpráv odesílaných a přijatých ze služby Speech. Tyto zprávy jsou k dispozici pro účely ladění a neměly by se používat pro případy použití v produkčním prostředí se službou Azure Cognitive Services Speech Service. Zprávy odeslané službě Speech a přijaté ze služby Speech se můžou bez předchozího upozornění měnit. To zahrnuje obsah zpráv, záhlaví, datové části, řazení atd. Přidáno ve verzi 1.11.0.

ConnectionMessageEventArgs
ConversationTranscriber

Provádí rozpoznávání řeči s oddělením reproduktoru od mikrofonu, souboru nebo jiných streamů zvukového vstupu a v důsledku toho přepíše text. Přepisovač konverzací

ConversationTranscriptionCanceledEventArgs

Definuje obsah funkce RecognitionErrorEvent. ConversationTranscriptionCanceledEventArgs

ConversationTranscriptionEventArgs

Definuje obsah události přepisu nebo přepisu konverzace. ConversationTranscriptionEventArgs

ConversationTranscriptionResult

Definuje výsledek přepisu konverzace. ConversationTranscriptionResult

Coordinate

Definuje souřadnici v 2D prostoru. Souřadnice přidány ve verzi 1.33.0

CustomCommandsConfig

Třída, která definuje konfigurace pro objekt konektoru služby dialogového okna pro použití back-endu CustomCommands. CustomCommandsConfig

Diagnostics

Definuje rozhraní API diagnostiky pro správu výstupu konzoly přidaného ve verzi 1.21.0.

DialogServiceConfig

Třída, která definuje základní konfigurace pro konektor dialogových služeb DialogServiceConfig

DialogServiceConnector

Dialog Service Connector DialogServiceConnector

KeywordRecognitionModel

Představuje model rozpoznávání klíčových slov pro rozpoznávání, když uživatel říká klíčové slovo pro zahájení dalšího rozpoznávání řeči. KeywordRecognitionModel

Meeting
MeetingTranscriber
MeetingTranscriptionCanceledEventArgs

Definuje obsah MeetingTranscriptionCanceledEvent. MeetingTranscriptionCanceledEventArgs

MeetingTranscriptionEventArgs

Definuje obsah události, která se přepíše nebo přepíše. MeetingTranscriptionEventArgs

NoMatchDetails

Obsahuje podrobné informace o výsledcích rozpoznávání NoMatch. NoMatchDetails

Participant

Zastupuje účastníka schůzky. Přidáno ve verzi 1.4.0

PhraseListGrammar

Umožňuje přidávání nových frází ke zlepšení rozpoznávání řeči.

Fráze přidané do rozpoznávání jsou efektivní na začátku dalšího rozpoznávání, nebo se při příštím připojení sady SpeechSDK ke službě SpeechSDK musí znovu připojit.

PronunciationAssessmentConfig

Konfigurace posouzení výslovnosti PronunciationAssessmentConfig přidáno ve verzi 1.15.0.

PronunciationAssessmentResult

Výsledky hodnocení výslovnosti. PronunciationAssessmentResult přidáno ve verzi 1.15.0.

PropertyCollection

Představuje kolekci vlastností a jejich hodnot. KolekceVlastnosti

PullAudioInputStream

Představuje zvukový vstupní datový proud používaný pro vlastní konfigurace zvukového vstupu. Zvukový vstupní stream

PullAudioInputStreamCallback

Abstraktní základní třída, která definuje metody zpětného volání (read() a close()) pro vlastní zvukové vstupní streamy). PullAudioInputStreamCallback

PullAudioOutputStream

Představuje stream zvukového výstupu s podporou paměti používaný pro vlastní konfigurace zvukového výstupu. PullAudioOutputStream

PushAudioInputStream

Představuje stream zvukového vstupu s podporou paměti, který se používá pro vlastní konfigurace zvukového vstupu. PushAudioInputStream

PushAudioOutputStream

Představuje zvukový výstupní datový proud používaný pro vlastní konfigurace zvukového výstupu. AudioOutputStream

PushAudioOutputStreamCallback

Abstraktní základní třída, která definuje metody zpětného volání (write() a close()) pro vlastní zvukové výstupní streamy). PushAudioOutputStreamCallback

RecognitionEventArgs

Definuje datovou část pro události relace, jako je start/konec rozpoznávání řeči.

RecognitionResult

Definuje výsledek rozpoznávání řeči. OceněníVýsledek

Recognizer

Definuje základní třídu Recognizer, která obsahuje hlavně běžné obslužné rutiny událostí. Rozpoznávač

ServiceEventArgs

Definuje datovou část pro událost zprávy služby přidanou ve verzi 1.9.0.

SessionEventArgs

Definuje obsah událostí relace, jako jsou SessionStarted/Stopped, SoundStarted/Stopped. SessionEventArgs

SourceLanguageConfig

Konfigurace zdrojového jazyka SourceLanguageConfig

SpeakerAudioDestination

Představuje cíl přehrávání zvuku mluvčího, který funguje jenom v prohlížeči. Poznámka: Sada SDK se pokusí použít rozšíření zdroje médií k přehrávání zvuku. Formát Mp3 má lepší podporu pro Microsoft Edge, Chrome a Safari (desktop), takže je lepší určit formát mp3 pro přehrávání. SpeakerAudioDestination Aktualizováno ve verzi 1.17.0

SpeechConfig

Konfigurace řeči SpeechConfig

SpeechConfigImpl

SpeechConfigImpl

SpeechRecognitionCanceledEventArgs
SpeechRecognitionEventArgs

Definuje obsah rozpoznávání a rozpoznané události řeči. SpeechRecognitionEventArgs

SpeechRecognitionResult

Definuje výsledek rozpoznávání řeči. SpeechRecognitionResult

SpeechRecognizer

Provádí rozpoznávání řeči z mikrofonu, souboru nebo jiných zvukových vstupních datových proudů a v důsledku toho se přepíše text. Rozpoznávač řeči

SpeechSynthesisBookmarkEventArgs

Definuje obsah události záložky syntézy řeči. SpeechSynthesisBookmarkEventArgs přidán ve verzi 1.16.0

SpeechSynthesisEventArgs

Definuje obsah událostí syntézy řeči. SpeechSynthesisEventArgs přidán ve verzi 1.11.0

SpeechSynthesisRequest

Představuje požadavek na syntézu řeči s podporou streamování textu. Poznámka: Tato třída je ve verzi Preview a může se v budoucích verzích měnit. Žádost o syntézu řeči

SpeechSynthesisRequestInputStream

Představuje vstupní proud pro streamování textu na požadavek na syntézu řeči. Poznámka: Tato třída je ve verzi Preview a může se v budoucích verzích měnit. Proud SpeechSynthesisRequestInputStream

SpeechSynthesisResult

Definuje výsledek syntézy řeči. SpeechSynthesisResult přidán ve verzi 1.11.0

SpeechSynthesisVisemeEventArgs

Definuje obsah události syntézy řeči viseme. SpeechSynthesisVisemeEventArgs přidán ve verzi 1.16.0

SpeechSynthesisWordBoundaryEventArgs

Definuje obsah události hranice slova syntézy řeči. SpeechSynthesisWordBoundaryEventArgs přidány ve verzi 1.11.0

SpeechSynthesizer

Definuje třídu SpeechSynthesizer pro převod textu na řeč. Aktualizováno ve verzi 1.16.0 SpeechSynthesizer

SpeechTranslationConfig

Konfigurace překladu řeči Konfigurace překladu řeči

SynthesisResult

Základní třída pro výsledky syntézy SynthesisResult Přidáno ve verzi 1.20.0

SynthesisVoicesResult

Definuje výsledek syntézy řeči. SynthesisVoicesResult přidáno ve verzi 1.20.0

Synthesizer
TranslationRecognitionCanceledEventArgs

Definujte datovou část událostí zrušených výsledků rozpoznávání řeči. TranslationRecognitionCanceledEventArgs

TranslationRecognitionEventArgs

Argumenty události výsledku překladu textu TranslationRecognitionEventArgs

TranslationRecognitionResult

Výsledek překladu textu TranslationRecognitionResult

TranslationRecognizer

Rozpoznávač překladů TranslationRecognizer

TranslationSynthesisEventArgs

Argumenty událostí Translation Synthesis TranslationSynthesisEventArgs

TranslationSynthesisResult

Definuje výsledek syntézy překladu, tj. hlasový výstup přeloženého textu v cílovém jazyce. TranslationSynthesisResult

Translations

Představuje kolekci parametrů a jejich hodnot. Překlady

TurnStatusReceivedEventArgs

Definuje obsah přijatých zpráv nebo událostí. TurnStatusReceivedEventArgs

User
VoiceInfo

Informace o hlasu syntézy řeči přidány ve verzi 1.20.0. VoiceInfo

Rozhraní

CancellationEventArgs
IParticipant

Zastupuje účastníka schůzky. Přidáno ve verzi 1.4.0

IPlayer

Představuje rozhraní přehrávače zvuku pro řízení přehrávání zvuku, například pauza, pokračování atd. IPlayer přidán ve verzi 1.12.0

IVoiceJson
MeetingInfo
VoiceSignature

Výčty

AudioFormatTag
CancellationErrorCode

Definuje kód chyby v případě, že CancellationReason je Chyba. Přidáno ve verzi 1.1.0.

CancellationReason

Definuje možné důvody, proč může být výsledek rozpoznávání zrušen. CancellationReason

LanguageIdMode

Režim identifikace jazyka LanguageIdMode

LogLevel
NoMatchReason

Definuje možné důvody, proč se výsledek rozpoznávání nemusí rozpoznat. NoMatchReason

OutputFormat

Definujte výstupní formáty služby Rozpoznávání řeči. Výstupní formát

ProfanityOption

Možnost vulgárních výrazů. Přidáno ve verzi 1.7.0.

PronunciationAssessmentGradingSystem

Definuje bodový systém pro kalibraci skóre výslovnosti; výchozí hodnota je FivePoint. Přidáno ve verzi 1.15.0 PronunciationAssessmentGradingSystem

PronunciationAssessmentGranularity

Definuje členitost vyhodnocení výslovnosti; výchozí hodnota je Phoneme. Přidáno ve verzi 1.15.0 PronunciationAssessmentGranularity

PropertyId

Definuje ID vlastností řeči. PropertyId

ResultReason

Definuje možné důvody, proč se může vygenerovat výsledek rozpoznávání. Důvod výsledku

ServicePropertyChannel

Definuje kanály používané k předávání nastavení vlastností do služby. Přidáno ve verzi 1.7.0.

SpeechSynthesisBoundaryType

Definuje typ hranice události hranice syntézy řeči. SpeechSynthesisBoundaryType přidán ve verzi 1.21.0

SpeechSynthesisOutputFormat

Definujte formáty zvukového výstupu syntézy řeči. SpeechSynthesisOutputFormat aktualizováno ve verzi 1.17.0

SpeechSynthesisRequestInputType

Definuje typ vstupu pro požadavek na syntézu řeči. SpeechSynthesisRequestInputType

SynthesisVoiceGender

Definuje pohlaví syntetických hlasů. Přidáno ve verzi 1.20.0.

SynthesisVoiceType