microsoft-cognitiveservices-speech-sdk package

Classi

ActivityReceivedEventArgs

Definisce il contenuto dei messaggi/eventi ricevuti. AttivitàRicevutEventoArgs

AudioConfig

Rappresenta la configurazione di input audio utilizzata per specificare il tipo di input da usare (microfono, file, flusso). AudioConfig Aggiornato nella versione 1.11.0

AudioInputStream

Rappresenta il flusso di input audio usato per configurazioni di input audio personalizzate. AudioInputStream

AudioOutputStream

Rappresenta il flusso di output audio usato per configurazioni di output audio personalizzate. AudioOutputStream

AudioStreamFormat

Rappresenta il formato del flusso audio usato per configurazioni di input audio personalizzate. AudioStreamFormat

AutoDetectSourceLanguageConfig

Configurazione del rilevamento automatico della lingua. AutoDetectSourceLanguageConfig aggiunto nella versione 1.13.0.

AutoDetectSourceLanguageResult

Formato di output AutoDetectSourceLanguageResult

AvatarConfig

Definisce la configurazione dell'avatar parlando. AvatarConfig aggiunto nella versione 1.33.0

Questa funzione è sperimentale e potrebbe cambiare o avere un supporto limitato.

AvatarEventArgs

Definisce il contenuto per gli eventi avatar di discussione. AvatarEventArgs aggiunto nella versione 1.33.0

Questa funzione è sperimentale e potrebbe cambiare o avere un supporto limitato.

AvatarSceneConfig

Definisce la configurazione della scena dell'avatar per controllare il posizionamento e l'orientamento dell'avatar. AvatarSceneConfig aggiunto nella versione 1.44.0

Questa funzione è sperimentale e potrebbe cambiare o avere un supporto limitato.

AvatarSynthesizer

Definisce il sintetizzatore avatar. AvatarSynthesizer Aggiunto nella versione 1.33.0

Questa funzione è sperimentale e potrebbe cambiare o avere un supporto limitato.

AvatarVideoFormat

Definisce il formato video di output avatar. AvatarVideoFormat aggiunto nella versione 1.33.0

Questa funzione è sperimentale e potrebbe cambiare in futuro.

AvatarWebRTCConnectionResult

Definisce il risultato della connessione WebRTC avatar. AvatarWebRTCConnectionResult aggiunto nella versione 1.33.0

Questa funzione è sperimentale e potrebbe cambiare in futuro.

BaseAudioPlayer

Classe di lettore audio di base TODO: riproduce solo PCM per il momento.

BotFrameworkConfig

Classe che definisce le configurazioni per l'oggetto connettore del servizio di dialogo per l'uso di un back-end di Bot Framework. BotFrameworkConfig

CancellationDetails

Contiene informazioni dettagliate sul motivo per cui un risultato è stato annullato. CancellazioneDettagli

CancellationDetailsBase

Contiene informazioni dettagliate sul motivo per cui un risultato è stato annullato. CancellationDetailsBase

Connection

La connessione è una classe proxy per la gestione della connessione al servizio di riconoscimento vocale specificato. Per impostazione predefinita, un Sistema di riconoscimento gestisce in modo autonomo la connessione al servizio quando necessario. La classe Connection fornisce metodi aggiuntivi per consentire agli utenti di aprire o chiudere una connessione in modo esplicito e di sottoscrivere le modifiche dello stato della connessione. L'uso di Connection è facoltativo e principalmente per gli scenari in cui è necessaria l'ottimizzazione del comportamento dell'applicazione in base allo stato della connessione. Gli utenti possono facoltativamente chiamare Open() per configurare manualmente una connessione in anticipo prima di avviare il riconoscimento nel Sistema di riconoscimento associato a questa connessione. Se riconoscimento deve connettersi o disconnettersi al servizio, verrà configurata o arrestata la connessione in modo indipendente. In questo caso, la connessione riceverà una notifica tramite la modifica dello stato della connessione tramite eventi connessi/disconnessi. Aggiunta nella versione 1.2.1.

ConnectionEventArgs

Definisce il payload per gli eventi di connessione, ad esempio Connected/Disconnected. Aggiunta nella versione 1.2.0

ConnectionMessage

ConnectionMessage rappresenta i messaggi specifici di implementazione inviati e ricevuti dal servizio di riconoscimento vocale. Questi messaggi vengono forniti a scopo di debug e non devono essere usati per i casi d'uso di produzione con il servizio Voce di Servizi cognitivi di Azure. I messaggi inviati e ricevuti dal servizio Voce sono soggetti a modifiche senza preavviso. Sono inclusi contenuti dei messaggi, intestazioni, payload, ordinamento e così via. Aggiunta nella versione 1.11.0.

ConnectionMessageEventArgs
ConversationTranscriber

Esegue il riconoscimento vocale con la separazione dell'altoparlante dal microfono, dal file o da altri flussi di input audio e ottiene il testo trascritto come risultato. Trascrittore di Conversazioni

ConversationTranscriptionCanceledEventArgs

Definisce il contenuto di un oggetto RecognitionErrorEvent. ConversationTranscriptionCanceledEventArgs

ConversationTranscriptionEventArgs

Definisce il contenuto dell'evento trascritto/trascritto della conversazione. ConversationTranscriptionEventArgs

ConversationTranscriptionResult

Definisce il risultato della trascrizione della conversazione. ConversationTranscriptionResult

Coordinate

Definisce una coordinata nello spazio 2D. Coordinate aggiunte nella versione 1.33.0

CustomCommandsConfig

Classe che definisce le configurazioni per l'oggetto connettore del servizio di dialogo per l'uso di un back-end CustomCommands. CustomCommandsConfig

Diagnostics

Definisce l'API di diagnostica per la gestione dell'output della console Aggiunto nella versione 1.21.0

DialogServiceConfig

Classe che definisce le configurazioni base per il connettore di servizi dialogo DialogServiceConfig

DialogServiceConnector

Connettore Servizi Dialogo Connettore Servizi Dialogo

KeywordRecognitionModel

Rappresenta un modello di riconoscimento delle parole chiave per il riconoscimento quando l'utente dice una parola chiave per avviare un ulteriore riconoscimento vocale. KeywordRecognitionModel

Meeting
MeetingTranscriber
MeetingTranscriptionCanceledEventArgs

Definisce il contenuto di un oggetto MeetingTranscriptionCanceledEvent. MeetingTranscriptionCanceledEventArgs

MeetingTranscriptionEventArgs

Definisce il contenuto dell'evento trascritto/trascritto della riunione. MeetingTranscriptionEventArgs

NoMatchDetails

Contiene informazioni dettagliate per i risultati del riconoscimento NoMatch. NoMatchDetails

Participant

Rappresenta un partecipante a una riunione. Aggiunta nella versione 1.4.0

PhraseListGrammar

Consente di aggiungere nuove frasi per migliorare il riconoscimento vocale.

Le frasi aggiunte al riconoscitore sono valide all'inizio del riconoscimento successivo o alla successiva riconnessione di SpeechSDK al servizio di riconoscimento vocale.

PronunciationAssessmentConfig

Configurazione della valutazione della pronuncia. PronunciationAssessmentConfig Aggiunto nella versione 1.15.0.

PronunciationAssessmentResult

Risultati della valutazione della pronuncia. PronunciationAssessmentResult aggiunto nella versione 1.15.0.

PropertyCollection

Rappresenta la raccolta di proprietà e i relativi valori. CollezioneDiProprietà

PullAudioInputStream

Rappresenta il flusso di input audio usato per configurazioni di input audio personalizzate. AudioInputStream

PullAudioInputStreamCallback

Classe base astratta che definisce i metodi di callback (read() e close()) per i flussi di input audio personalizzati. PullAudioInputStreamCallback

PullAudioOutputStream

Rappresenta il flusso di output audio push supportato dalla memoria usato per le configurazioni di output audio personalizzate. PullAudioOutputStream

PushAudioInputStream

Rappresenta il flusso di input audio push supportato dalla memoria usato per configurazioni di input audio personalizzate. PushAudioInputStream

PushAudioOutputStream

Rappresenta il flusso di output audio usato per configurazioni di output audio personalizzate. AudioOutputStream

PushAudioOutputStreamCallback

Classe base astratta che definisce i metodi di callback (write() e close()) per i flussi di output audio personalizzati. PushAudioOutputStreamCallback

RecognitionEventArgs

Definisce il payload per gli eventi di sessione, ad esempio l'inizio/fine del riconoscimento vocale rilevato

RecognitionResult

Definisce il risultato del riconoscimento vocale. RiconoscimentoRisultato

Recognizer

Definisce la classe base Recognizer che contiene principalmente gestori eventi comuni. Riconoscitore

ServiceEventArgs

Definisce il payload per qualsiasi evento di messaggio del servizio aggiunto nella versione 1.9.0

SessionEventArgs

Definisce il contenuto per gli eventi di sessione, ad esempio SessionStarted/Stopped, SoundStarted/Stopped. SessionEventArgs

SourceLanguageConfig

Configurazione del linguaggio di origine. SourceLanguageConfig

SpeakerAudioDestination

Rappresenta la destinazione audio di riproduzione dell'altoparlante, che funziona solo nel browser. Nota: l'SDK tenterà di usare estensioni di origine multimediale per riprodurre l'audio. Il formato Mp3 ha un supporto migliore in Microsoft Edge, Chrome e Safari (desktop), quindi è meglio specificare il formato mp3 per la riproduzione. SpeakerAudioDestination Aggiornato nella versione 1.17.0

SpeechConfig

Configurazione del riconoscimento vocale. SpeechConfig

SpeechConfigImpl

SpeechConfigImpl

SpeechRecognitionCanceledEventArgs
SpeechRecognitionEventArgs

Definisce il contenuto dell'evento di riconoscimento vocale/riconosciuto. SpeechRecognitionEventArgs

SpeechRecognitionResult

Definisce il risultato del riconoscimento vocale. SpeechRecognitionResult

SpeechRecognizer

Esegue il riconoscimento vocale da microfono, file o altri flussi di input audio e ottiene il testo trascritto come risultato. Riconoscitore vocale

SpeechSynthesisBookmarkEventArgs

Definisce il contenuto dell'evento segnalibro di sintesi vocale. SpeechSynthesisBookmarkEventArgs aggiunto nella versione 1.16.0

SpeechSynthesisEventArgs

Definisce il contenuto degli eventi di sintesi vocale. SpeechSynthesisEventArgs aggiunto nella versione 1.11.0

SpeechSynthesisRequest

Rappresenta una richiesta di sintesi vocale con supporto per lo streaming di testo. Nota: questa classe è in anteprima e potrebbe essere soggetta a modifiche nelle versioni future. Richiesta di Sintesi del Parlato

SpeechSynthesisRequestInputStream

Rappresenta un flusso di input per lo streaming di testo su richiesta di sintesi vocale. Nota: questa classe è in anteprima e potrebbe essere soggetta a modifiche nelle versioni future. Flusso di RichiestaSintesi del Parlato

SpeechSynthesisResult

Definisce il risultato della sintesi vocale. SpeechSynthesisResult aggiunto nella versione 1.11.0

SpeechSynthesisVisemeEventArgs

Definisce il contenuto dell'evento viseme di sintesi vocale. SpeechSynthesisVisemeEventArgs aggiunto nella versione 1.16.0

SpeechSynthesisWordBoundaryEventArgs

Definisce il contenuto dell'evento limite delle parole di sintesi vocale. SpeechSynthesisWordBoundaryEventArgs aggiunto nella versione 1.11.0

SpeechSynthesizer

Definisce la classe SpeechSynthesizer per la sintesi vocale. Aggiornato nella versione 1.16.0 SpeechSynthesizer

SpeechTranslationConfig

Configurazione della traduzione vocale. SpeechTranslationConfig

SynthesisResult

Classe base per i risultati della sintesi SynthesisResult Aggiunta nella versione 1.20.0

SynthesisVoicesResult

Definisce il risultato della sintesi vocale. SynthesisVoicesResult aggiunto nella versione 1.20.0

Synthesizer
TranslationRecognitionCanceledEventArgs

Definire il payload degli eventi di risultato annullati del riconoscimento vocale. TranslationRecognitionCanceledEventArgs

TranslationRecognitionEventArgs

Argomenti dell'evento di risultato del testo di traduzione. TranslationRecognitionEventArgs

TranslationRecognitionResult

Risultato del testo della traduzione. TranslationRecognitionResult

TranslationRecognizer

Riconoscimento traduzione Riconoscimento traduzione

TranslationSynthesisEventArgs

Argomenti di evento di sintesi di traduzione TraduzioneSintesiEventArgs

TranslationSynthesisResult

Definisce il risultato della sintesi della traduzione, ovvero l'output vocale del testo tradotto nella lingua di destinazione. TranslationSynthesisResult

Translations

Rappresenta la raccolta di parametri e i relativi valori. Traduzioni

TurnStatusReceivedEventArgs

Definisce il contenuto dei messaggi/eventi ricevuti. TurnStatusRicevutEventoArgs

User
VoiceInfo

Informazioni sulla voce Sintesi vocale aggiunta nella versione 1.20.0. VoiceInfo

Interfacce

CancellationEventArgs
IParticipant

Rappresenta un partecipante a una riunione. Aggiunta nella versione 1.4.0

IPlayer

Rappresenta l'interfaccia del lettore audio per controllare la riproduzione audio, come pausa, riprenda, ecc. IPlayer Aggiunto nella versione 1.12.0

IVoiceJson
MeetingInfo
VoiceSignature

Enumerazioni

AudioFormatTag
CancellationErrorCode

Definisce il codice di errore nel caso in cui CancellationReason sia Error. Aggiunta nella versione 1.1.0.

CancellationReason

Definisce i possibili motivi per cui un risultato di riconoscimento potrebbe essere annullato. CancellationReason

LanguageIdMode

Modalità di identificazione linguistica LanguageIdMode

LogLevel
NoMatchReason

Definisce i possibili motivi per cui un risultato di riconoscimento potrebbe non essere riconosciuto. NoMatchReason

OutputFormat

Definire i formati di output di Riconoscimento vocale. OutputFormat

ProfanityOption

Opzione volgarità. Aggiunta nella versione 1.7.0.

PronunciationAssessmentGradingSystem

Definisce il sistema di punti per la calibrazione del punteggio di pronuncia; il valore predefinito è FivePoint. Aggiunta nella versione 1.15.0 Sistema di valutazione della pronuncia

PronunciationAssessmentGranularity

Definisce la granularità della valutazione della pronuncia; il valore predefinito è Phoneme. Aggiunta nella versione 1.15.0 PronunciaValutazioneGranularità

PropertyId

Definisce gli ID proprietà voce. PropertyId

ResultReason

Definisce i possibili motivi per cui potrebbe essere generato un risultato di riconoscimento. Motivo del Risultato

ServicePropertyChannel

Definisce i canali usati per passare le impostazioni delle proprietà al servizio. Aggiunta nella versione 1.7.0.

SpeechSynthesisBoundaryType

Definisce il tipo di limite dell'evento limite di sintesi vocale. SpeechSynthesisBoundaryType Aggiunto nella versione 1.21.0

SpeechSynthesisOutputFormat

Definire i formati di output audio di sintesi vocale. SpeechSynthesisOutputFormat aggiornato nella versione 1.17.0

SpeechSynthesisRequestInputType

Definisce il tipo di input della richiesta di sintesi vocale. RichiestaInputType di Sintesi del Parlato

SynthesisVoiceGender

Definisce il genere delle voci di sintesi. Aggiunta nella versione 1.20.0.

SynthesisVoiceType