Notitie
Voor toegang tot deze pagina is autorisatie vereist. U kunt proberen u aan te melden of de directory te wijzigen.
Voor toegang tot deze pagina is autorisatie vereist. U kunt proberen de mappen te wijzigen.
In dit artikel leert u hoe u de Azure Speech CLI (ook wel SPX genoemd) gebruikt voor toegang tot spraakservices, zoals spraak-naar-tekst, tekst-naar-spraak en spraakomzetting, zonder dat u code hoeft te schrijven. De Speech CLI is gereed voor productie en u kunt deze gebruiken om eenvoudige werkstromen in de Speech-service te automatiseren met behulp van .bat of shellscripts.
In dit artikel wordt ervan uitgegaan dat u werkende kennis hebt van het opdrachtpromptvenster, de terminal of PowerShell.
Notitie
In PowerShell moet het stop-parsing-token (--%) volgen spx. Voer bijvoorbeeld uit spx --% config @region om de huidige regioconfiguratiewaarde weer te geven.
Downloaden en installeren van
Volg deze stappen om de Speech CLI te installeren voor Windows:
Installeer microsoft Visual C++ Redistributable voor Visual Studio voor uw platform. Voor de eerste keer dat u deze installeert, moet u deze mogelijk opnieuw opstarten.
Installeer .NET 8.
Installeer de Speech CLI via de .NET CLI door deze opdracht in te voeren:
dotnet tool install --global Microsoft.CognitiveServices.Speech.CLIVoer deze opdracht in om de Speech CLI bij te werken:
dotnet tool update --global Microsoft.CognitiveServices.Speech.CLI
Voer spx help voor de Speech CLI in of spx help om deze te bekijken.
Lettertypebeperkingen
In Windows kan de Speech CLI alleen lettertypen weergeven die beschikbaar zijn voor de opdrachtprompt op de lokale computer. Windows Terminal ondersteunt alle lettertypen die de Speech CLI interactief produceert.
Als u naar een bestand uitvoert, kunnen in een teksteditor zoals Kladblok of een webbrowser zoals Microsoft Edge ook alle lettertypen worden weergegeven.
Een resourceconfiguratie maken
Om aan de slag te gaan, hebt u een API-sleutel en regio-id nodig (bijvoorbeeld eastuswestus). Maak een Foundry-resource voor Spraak in Azure Portal. Zie Een Foundry-resource maken voor meer informatie.
Voer de volgende opdrachten uit om uw resourcesleutel en regio-id te configureren:
spx config @key --set SPEECH-KEY
spx config @region --set SPEECH-REGION
De sleutel en regio worden opgeslagen voor toekomstige Speech CLI-opdrachten. Voer de volgende opdrachten uit om de huidige configuratie weer te geven:
spx config @key
spx config @region
Neem indien nodig de optie op om een van de clear opgeslagen waarden te verwijderen:
spx config @key --clear
spx config @region --clear
Basaal gebruik
Belangrijk
Wanneer u de Speech CLI in een container gebruikt, neemt u de --host optie op. U moet ook opgeven --key none om ervoor te zorgen dat de CLI geen spraaksleutel probeert te gebruiken voor verificatie. Voer bijvoorbeeld uit spx recognize --key none --host wss://localhost:5000/ --file myaudio.wav om spraak te herkennen vanuit een audiobestand in een spraak-naar-tekstcontainer.
In deze sectie ziet u enkele eenvoudige SPX-opdrachten die vaak nuttig zijn als u voor de eerste keer gaat testen en experimenteren. Voer de volgende opdracht uit om de Help bij het hulpprogramma weer te geven:
spx
U kunt helponderwerpen doorzoeken op trefwoord. Als u bijvoorbeeld een lijst met voorbeelden van Speech CLI-gebruik wilt zien, voert u de volgende opdracht uit:
spx help find --topics "examples"
Voer de volgende opdracht uit om opties voor de recognize opdracht weer te geven:
spx help recognize
Meer Help-opdrachten worden weergegeven in de console-uitvoer. U kunt deze opdrachten invoeren om gedetailleerde hulp te krijgen over subopdrachten.
Spraak-naar-tekst (spraakherkenning)
Aanbeveling
Als u vastloopt of meer wilt weten over de spraak-CLI-herkenningsopties, kunt u uitvoeren spx help recognize.
Spraak herkennen met een microfoon
Voer de volgende opdracht uit om spraakherkenning vanaf een microfoon te starten:
spx recognize --microphone --source en-USPraat in de microfoon en u ziet transcriptie van uw woorden in realtime. De Speech CLI stopt na een stilteperiode, 30 seconden of wanneer u Ctrl
Connection CONNECTED... RECOGNIZED: I'm excited to try speech to text.
Notitie
U kunt de microfoon van uw computer niet gebruiken wanneer u de Speech CLI uitvoert in een Docker-container. U kunt audiobestanden echter lezen uit en opslaan in uw lokaal gekoppelde map.
Spraak herkennen uit een bestand
Als u spraak uit een audiobestand wilt herkennen, gebruikt --file u in plaats van --microphone. Installeer GStreamer en gebruik --formatvoor gecomprimeerde audiobestanden zoals MP4. Zie Gecomprimeerde invoeraudio gebruiken voor meer informatie.
spx recognize --file YourAudioFile.wav
spx recognize --file YourAudioFile.mp4 --format any
Fraselijsten
Gebruik een woordgroepenlijst om de nauwkeurigheid van herkenning van specifieke woorden of uitingen te verbeteren. Je neemt een frasenlijst in de regel op of gebruikt een tekstbestand samen met de recognize opdracht:
spx recognize --microphone --phrases "Contoso;Jessie;Rehaan;"
spx recognize --microphone --phrases @phrases.txt
Taalondersteuning
Als u de taal voor spraakherkenning wilt wijzigen, vervangt u deze door en-US een andere ondersteunde taal. Gebruik bijvoorbeeld es-ES voor Spaans (Spanje). Als u geen taal opgeeft, is de standaardwaarde en-US.
spx recognize --microphone --source es-ES
Doorlopende herkenning
Voor continue herkenning van audio die langer is dan 30 seconden, voegt u het volgende toe --continuous:
spx recognize --microphone --source es-ES --continuous
Tekst naar spraak (spraaksynthese)
Aanbeveling
Als u vastloopt of meer wilt weten over de spraak-CLI-herkenningsopties, kunt u uitvoeren spx help synthesize.
Met de volgende opdracht wordt tekst als invoer gebruikt en wordt de gesynthetiseerde spraak vervolgens uitgevoerd naar het huidige actieve uitvoerapparaat (bijvoorbeeld de luidsprekers van uw computer).
spx synthesize --text "Testing synthesis using the Speech CLI" --speakers
U kunt de gesynthetiseerde uitvoer ook opslaan in een bestand. In dit voorbeeld maken we een bestand met de naam my-sample.wav in de map waarin u de opdracht uitvoert.
spx synthesize --text "Enjoy using the Speech CLI." --audio output my-sample.wav
In deze voorbeelden wordt ervan uitgegaan dat u in het Engels test. Speech Service ondersteunt echter spraaksynthese in veel talen. U kunt een volledige lijst met stemmen omlaag halen door de volgende opdracht uit te voeren of door naar de ondersteuningspagina voor taal te gaan.
spx synthesize --voices
Hier volgt een opdracht voor het gebruik van een van de stemmen die u hebt ontdekt.
spx synthesize --text "Bienvenue chez moi." --voice fr-FR-AlainNeural --speakers
Spraak-naar-tekstomzetting
Aanbeveling
Als u vastloopt of meer wilt weten over de spraak-CLI-vertaalopties, kunt u uitvoeren spx help translate.
Spraak vertalen vanuit een microfoon
Voer de volgende opdracht uit om spraakomzetting vanaf een microfoon te starten:
spx translate --source en-US --target it --microphoneSpreek in de microfoon en u ziet de transcriptie van uw vertaalde spraak in realtime. De Speech CLI stopt na een stilteperiode, 30 seconden of wanneer u Ctrl
Connection CONNECTED... TRANSLATING into 'it': Sono (from 'I'm') TRANSLATING into 'it': Sono entusiasta (from 'I'm excited to') TRANSLATING into 'it': Sono entusiasta di provare la parola (from 'I'm excited to try speech') TRANSLATED into 'it': Sono entusiasta di provare la traduzione vocale. (from 'I'm excited to try speech translation.')
Notitie
U kunt de microfoon van uw computer niet gebruiken wanneer u de Speech CLI uitvoert in een Docker-container. U kunt audiobestanden echter lezen uit en opslaan in uw lokaal gekoppelde map.
Spraak vertalen vanuit een bestand
Als u spraak uit een audiobestand wilt vertalen, gebruikt --file u in plaats van --microphone. Installeer GStreamer en gebruik --formatvoor gecomprimeerde audiobestanden zoals MP4. Zie Gecomprimeerde invoeraudio gebruiken voor meer informatie.
spx translate --source en-US --target it --file YourAudioFile.wav
spx translate --source en-US --target it --file YourAudioFile.mp4 --format any
Fraselijsten
Gebruik een woordgroepenlijst om de nauwkeurigheid van herkenning van specifieke woorden of uitingen te verbeteren. Je neemt een frasenlijst in de regel op of gebruikt een tekstbestand samen met de translate opdracht:
spx translate --source en-US --target it --microphone --phrases "Contoso;Jessie;Rehaan;"
spx translate --source en-US --target it --microphone --phrases @phrases.txt
Taalondersteuning
Als u de taal voor spraakherkenning wilt wijzigen, vervangt u deze door en-US een andere ondersteunde taal. Geef de volledige landinstelling op met een streepje (-) scheidingsteken. Bijvoorbeeld, es-ES voor het Spaans (Spanje). De standaardtaal is en-US als u geen taal opgeeft.
spx translate --microphone --source es-ES
Als u de doeltaal van de vertaling wilt wijzigen, vervangt u deze door it een andere ondersteunde taal. Met een paar uitzonderingen geeft u alleen de taalcode op die voorafgaat aan het locale-scheidingsteken (-). Gebruik bijvoorbeeld es voor Spaans (Spanje) in plaats van es-ES. De standaardtaal is en als u geen taal opgeeft.
spx translate --microphone --target es
Meerdere doeltalen
Wanneer u vertaalt in meerdere talen, scheidt u de taalcodes met een puntkomma (;).
spx translate --microphone --source en-US --target 'ru-RU;fr-FR;es-ES'
Vertalingsuitvoer opslaan
Als u de uitvoer van uw vertaling wilt opslaan, gebruikt u de --output vlag. In dit voorbeeld leest u ook een bestand.
spx translate --file /some/file/path/input.wav --source en-US --target ru-RU --output file /some/file/path/russian_translation.txt
Continue vertaling
Voor continue vertaling van audio die langer is dan 30 seconden, voegt u het volgende toe --continuous:
spx translate --source en-US --target it --microphone --continuous