Notitie
Voor toegang tot deze pagina is autorisatie vereist. U kunt proberen u aan te melden of de directory te wijzigen.
Voor toegang tot deze pagina is autorisatie vereist. U kunt proberen de mappen te wijzigen.
U kunt het hulpprogramma voor het maken van audio-inhoud gebruiken in Microsoft Foundry-portal of Speech Studio voor text to speech zonder code te schrijven.
Aanbeveling
Kies Foundry portal of Speech Studio bovenaan dit artikel.
Bouw zeer natuurlijke audio-inhoud voor verschillende scenario's, zoals audioboeken, nieuwsuitzendingen, video gesproken tekst en chatbots. Met het maken van audio-inhoud kunt u efficiënt tekst-naar-spraak stemmen afstemmen en aangepaste audio-ervaringen ontwerpen.
Het hulpprogramma is gebaseerd op SSML (Speech Synthesis Markup Language). Hiermee kunt u uitvoerkenmerken van tekst-naar-spraak in realtime of batchsynthese aanpassen, zoals stemkarakters, stemstijlen, spreeksnelheid, uitspraak en prosodie.
- No-codebenadering: u kunt het hulpprogramma voor het maken van audio-inhoud gebruiken voor text to speech synthese zonder code te schrijven. De uitvoeraudio kan het uiteindelijke product zijn dat u wilt. U kunt bijvoorbeeld de uitvoeraudio gebruiken voor een podcast of gesproken video.
- Ontwikkelaarsvriendelijk: u kunt luisteren naar de uitvoeraudio en de SSML aanpassen om spraaksynthese te verbeteren. Vervolgens kunt u de Speech SDK of Speech CLI gebruiken om de SSML te integreren in uw toepassingen.
U hebt eenvoudig toegang tot een breed portfolio van talen en stemmen. Deze stemmen omvatten geavanceerde standaardstemmen en uw aangepaste stem, als u er een hebt gemaakt.
Het hulpprogramma voor het maken van audio-inhoud is gratis om te access; u betaalt alleen voor het gebruik van de Speech-service.
Prerequisites
- Een actief Azure-abonnement. Maak er gratis een.
- Toestemming voor het maken van resources in uw abonnement.
- Een Microsoft Foundry-project. Zie Maak een Microsoft Foundry-project voor meer informatie.
Het hulpprogramma voor het maken van audio-inhoud gebruiken
In het volgende diagram ziet u het proces voor het afstemmen van de text to speech uitvoer.
het hulpprogramma Access
Voer de volgende stappen uit om het hulpprogramma voor het maken van audio-inhoud in Microsoft Foundry te access:
Ga naar uw project in Microsoft Foundry.
Selecteer Speeltuinen vanuit het linkerpaneel.
Selecteer in de tegel Speech-speeltuinde optie Speech-speeltuin uitproberen.
Selecteer Text to speech>Audio-inhoud maken. Mogelijk moet u schuiven om de tegel te vinden.
Werkstroomoverzicht
Nadat u toegang tot de tool hebt, volgt u deze algemene werkstroom:
Maak een audioafstemmingsbestand met behulp van tekst zonder opmaak of SSML-scripts. Voer uw inhoud in of upload deze voor het creëren van audio-inhoud.
Kies de stem en de taal voor uw scriptinhoud. Het maken van audio-inhoud omvat alle standaard tekst-naar-spraak stemmen. U kunt standaardstemmen of een aangepaste stem gebruiken.
Note
Aangepaste spraaktoegang is beperkt op basis van geschiktheids- en gebruikscriteria. Vraag toegang aan op het intake formulier.
Selecteer de inhoud die u wilt bekijken en selecteer vervolgens Afspelen (via het driehoekpictogram) om een voorbeeld van de standaardsynthese-uitvoer te bekijken.
Als u wijzigingen aanbrengt in de tekst, selecteert u het pictogram Stoppen en selecteert u Opnieuw afspelen om de audio opnieuw te genereren met gewijzigde scripts.
Verbeter de uitvoer door de uitspraak, pauze, pitch, rate, intonatie, stemstijl en meer aan te passen. Zie Speech Synthesis Markup Language voor een volledige lijst met opties.
Sla uw afgestemde audio op en exporteer deze.
Wanneer u het afstemmingsspoor in het systeem opslaat, kunt u blijven werken en de uitvoer herhalen. Wanneer u tevreden bent met de uitvoer, kunt u een taak voor het maken van audio maken met de exportfunctie. U kunt de status van de exporttaak bekijken en de uitvoer downloaden voor gebruik met uw apps en producten.
Een audioconfiguratiebestand maken
U kunt uw inhoud op twee manieren ophalen in het hulpprogramma voor het maken van audio-inhoud:
Optie 1: Een nieuw audioafstemmingsbestand maken
Selecteer Nieuw>tekstbestand om een nieuw audioafstemmingsbestand te maken.
Voer uw inhoud in of plak deze in het bewerkingsvenster. Het toegestane aantal tekens voor elk bestand is 20.000 of minder. Als uw script meer dan 20.000 tekens bevat, kunt u optie 2 gebruiken om uw inhoud automatisch te splitsen in meerdere bestanden.
Selecteer Opslaan.
Optie 2: Een audioafstemmingsbestand uploaden
Selecteer Tekstbestand uploaden>om een of meer tekstbestanden te importeren. Zowel tekst zonder opmaak als SSML worden ondersteund.
Als uw scriptbestand meer dan 20.000 tekens bevat, splitst u de inhoud op alinea's, op tekens of op reguliere expressies.
Wanneer u uw tekstbestanden uploadt, moet u ervoor zorgen dat deze voldoen aan deze vereisten:
Property Description Bestandsformaat Tekst zonder opmaak (.txt) of SSML-tekst (.txt)
Zip-bestanden worden niet ondersteund.Coderingsformaat UTF-8 Bestandsnaam Elk bestand moet een unieke naam hebben. Dubbele bestanden worden niet ondersteund. Lengte van tekst Tekenlimiet is 20.000. Als uw bestanden de limiet overschrijden, splitst u ze op basis van de instructies in het hulpprogramma. SSML-beperkingen Elk SSML-bestand kan slechts één deel van SSML bevatten. Hier volgt een voorbeeld van tekst zonder opmaak:
Welcome to use audio content creation to customize audio output for your products.Hier volgt een SSML-voorbeeld:
<speak xmlns="http://www.w3.org/2001/10/synthesis" xmlns:mstts="http://www.w3.org/2001/mstts" version="1.0" xml:lang="en-US"> <voice name="en-US-AvaMultilingualNeural"> Welcome to use audio content creation <break time="10ms" />to customize audio output for your products. </voice> </speak>
Afgestemde audio exporteren
Nadat u de audio-uitvoer hebt bekeken en tevreden bent met uw afstemming en aanpassing, kunt u de audio exporteren.
Selecteer Exporteren om een taak voor het maken van audio te maken.
U wordt aangeraden te exporteren naar de audiobibliotheek om audio-uitvoer eenvoudig op te slaan, te zoeken en te zoeken in de cloud. U kunt beter integreren met uw toepassingen via Azure blob storage. U kunt de audio ook rechtstreeks naar uw lokale schijf downloaden.
Kies de uitvoerindeling voor uw afgestemde audio. De ondersteunde audio-indelingen en voorbeeldfrequenties worden vermeld in de volgende tabel:
Format 8 kHz voorbeeldfrequentie Samplefrequentie van 16 kHz Samplefrequentie van 24 kHz Samplefrequentie van 48 kHz wav riff-8khz-16bit-mono-pcm riff-16khz-16bit-mono-pcm riff-24khz-16bit-mono-pcm riff-48khz-16bit-mono-pcm mp3 N/A audio-16khz-128kbitrate-mono-mp3 audio-24khz-160kbitrate-mono-mp3 audio-48khz-192kbitrate-mono-mp3 Als u de status van de taak wilt weergeven, selecteert u het tabblad Takenlijst .
Als de taak mislukt, raadpleegt u de gedetailleerde informatiepagina voor een volledig rapport.
Wanneer de taak is voltooid, is uw audio beschikbaar om te downloaden in het deelvenster Audiobibliotheek .
Selecteer het bestand dat u wilt downloaden en downloaden.
Nu bent u klaar om uw aangepaste afgestemde audio in uw apps of producten te gebruiken.
Prerequisites
- Een actief Azure-abonnement. Maak er gratis een.
- Toestemming voor het maken van resources in uw abonnement.
- Een spraakresource. Maak er een in de Azure portal of Speech Studio.
Note
Het resourcetype Foundry wordt niet ondersteund in Speech Studio.
Het hulpprogramma voor het maken van audio-inhoud gebruiken
In het volgende diagram ziet u het proces voor het afstemmen van de text to speech uitvoer.
Ga als volgt te werk om het hulpprogramma voor het maken van audio-inhoud te gebruiken:
Meld u aan bij Speech Studio en selecteer vervolgens Audio-inhoud maken.
Selecteer het Azure-abonnement en de Speech-resource waarmee u wilt werken en selecteer vervolgens Resource gebruiken.
Note
Als u terugkeert naar het maken van audio-inhoud, kunt u een andere Spraak-resource selecteren waarmee u wilt werken. Ga naar uw accountinstellingen in de rechterbovenhoek van de pagina.
Maak een audioafstemmingsbestand met behulp van tekst zonder opmaak of SSML-scripts. Voer uw inhoud in of upload deze voor het creëren van audio-inhoud.
Kies de stem en de taal voor uw scriptinhoud. Het maken van audio-inhoud omvat alle standaard tekst-naar-spraak stemmen. U kunt standaardstemmen of een aangepaste stem gebruiken.
Note
Aangepaste spraaktoegang is beperkt op basis van geschiktheids- en gebruikscriteria. Vraag toegang aan op het intake formulier.
Selecteer de inhoud die u wilt bekijken en selecteer vervolgens Afspelen (via het driehoekpictogram) om een voorbeeld van de standaardsynthese-uitvoer te bekijken.
Als u wijzigingen aanbrengt in de tekst, selecteert u het pictogram Stoppen en selecteert u Opnieuw afspelen om de audio opnieuw te genereren met gewijzigde scripts.
Verbeter de uitvoer door de uitspraak, pauze, pitch, rate, intonatie, stemstijl en meer aan te passen. Zie Speech Synthesis Markup Language voor een volledige lijst met opties.
Zie de video how to convert text to speech op YouTube voor meer informatie over het aanpassen van de spraakuitvoer. De video is echter mogelijk niet beschikbaar in alle regio's en is mogelijk niet up-to-date op het moment dat u deze bekijkt.
Sla uw afgestemde audio op en exporteer deze.
Wanneer u het afstemmingsspoor in het systeem opslaat, kunt u blijven werken en de uitvoer herhalen. Wanneer u tevreden bent met de uitvoer, kunt u een taak voor het maken van audio maken met de exportfunctie. U kunt de status van de exporttaak bekijken en de uitvoer downloaden voor gebruik met uw apps en producten.
Een audioconfiguratiebestand maken
U kunt uw inhoud op twee manieren ophalen in het hulpprogramma voor het maken van audio-inhoud:
Optie 1: Een nieuw audioafstemmingsbestand maken
Selecteer Nieuw>tekstbestand om een nieuw audioafstemmingsbestand te maken.
Voer uw inhoud in of plak deze in het bewerkingsvenster. Het toegestane aantal tekens voor elk bestand is 20.000 of minder. Als uw script meer dan 20.000 tekens bevat, kunt u optie 2 gebruiken om uw inhoud automatisch te splitsen in meerdere bestanden.
Selecteer Opslaan.
Optie 2: Een audioafstemmingsbestand uploaden
Selecteer Tekstbestand uploaden>om een of meer tekstbestanden te importeren. Zowel tekst zonder opmaak als SSML worden ondersteund.
Als uw scriptbestand meer dan 20.000 tekens bevat, splitst u de inhoud op alinea's, op tekens of op reguliere expressies.
Wanneer u uw tekstbestanden uploadt, moet u ervoor zorgen dat deze voldoen aan deze vereisten:
Property Description Bestandsformaat Tekst zonder opmaak (.txt) of SSML-tekst (.txt)
Zip-bestanden worden niet ondersteund.Coderingsformaat UTF-8 Bestandsnaam Elk bestand moet een unieke naam hebben. Dubbele bestanden worden niet ondersteund. Lengte van tekst Tekenlimiet is 20.000. Als uw bestanden de limiet overschrijden, splitst u ze op basis van de instructies in het hulpprogramma. SSML-beperkingen Elk SSML-bestand kan slechts één deel van SSML bevatten. Hier volgt een voorbeeld van tekst zonder opmaak:
Welcome to use audio content creation to customize audio output for your products.Hier volgt een SSML-voorbeeld:
<speak xmlns="http://www.w3.org/2001/10/synthesis" xmlns:mstts="http://www.w3.org/2001/mstts" version="1.0" xml:lang="en-US"> <voice name="en-US-AvaMultilingualNeural"> Welcome to use audio content creation <break time="10ms" />to customize audio output for your products. </voice> </speak>
Afgestemde audio exporteren
Nadat u de audio-uitvoer hebt bekeken en tevreden bent met uw afstemming en aanpassing, kunt u de audio exporteren.
Selecteer Exporteren om een taak voor het maken van audio te maken.
U wordt aangeraden te exporteren naar de audiobibliotheek om audio-uitvoer eenvoudig op te slaan, te zoeken en te zoeken in de cloud. U kunt beter integreren met uw toepassingen via Azure blob storage. U kunt de audio ook rechtstreeks naar uw lokale schijf downloaden.
Kies de uitvoerindeling voor uw afgestemde audio. De ondersteunde audio-indelingen en voorbeeldfrequenties worden vermeld in de volgende tabel:
Format 8 kHz voorbeeldfrequentie Samplefrequentie van 16 kHz Samplefrequentie van 24 kHz Samplefrequentie van 48 kHz wav riff-8khz-16bit-mono-pcm riff-16khz-16bit-mono-pcm riff-24khz-16bit-mono-pcm riff-48khz-16bit-mono-pcm mp3 N/A audio-16khz-128kbitrate-mono-mp3 audio-24khz-160kbitrate-mono-mp3 audio-48khz-192kbitrate-mono-mp3 Als u de status van de taak wilt weergeven, selecteert u het tabblad Takenlijst .
Als de taak mislukt, raadpleegt u de gedetailleerde informatiepagina voor een volledig rapport.
Wanneer de taak is voltooid, is uw audio beschikbaar om te downloaden in het deelvenster Audiobibliotheek .
Selecteer het bestand dat u wilt downloaden en downloaden.
Nu bent u klaar om uw aangepaste afgestemde audio in uw apps of producten te gebruiken.
Configureer BYOS en anonieme openbare leesaccess voor blobs
Als u access machtiging voor bring your own storage (BYOS) verliest, kunt u geen bestanden weergeven, maken, bewerken of verwijderen. Als u uw access wilt hervatten, moet u de huidige storage verwijderen en de BYOS opnieuw configureren in de Azure portal. Zie Mount Azure Storage als een lokale share in App Service voor meer informatie over het configureren van BYOS.
Nadat u de BYOS-machtiging hebt geconfigureerd, moet u anonieme openbare lees-toegang configureren voor gerelateerde containers en blobs. Anders zijn blobgegevens niet beschikbaar voor openbare access en is uw lexiconbestand in de blob niet toegankelijk. Standaard is de openbare access-instelling van een container uitgeschakeld. Als u anonieme gebruikers access aan een container en de bijbehorende blobs wilt verlenen, stelt u eerst Allow Blob anonymous access in op Enabled om openbare access toe te staan voor het storage-account, stel vervolgens het openbare access niveau van de container (met de naam acc-public-files) in (anonieme leesbewerkingen access alleen voor blobs). Zie Anonieme openbare leesrechten configureren voor containers en blobs voor meer informatie over het configureren van anonieme openbare leesrechten.
Gebruikers van het maken van audio-inhoud toevoegen of verwijderen
Als meer dan één gebruiker audio-inhoud wil maken, kunt u deze access aan het Azure-abonnement en de Speech-resource verlenen. Als u gebruikers toevoegt aan een Azure-abonnement, kunnen ze alle resources onder het Azure-abonnement access. Maar als u gebruikers alleen toevoegt aan een Spraak-resource, hebben ze alleen access aan de Spraak-resource en niet aan andere resources in dit Azure abonnement. Gebruikers met access naar de Spraak-resource kunnen het hulpprogramma voor het maken van audio-inhoud gebruiken.
De gebruikers die u access verlenen, moeten een Microsoft-account instellen. Als ze geen Microsoft-account hebben, kunnen ze er binnen een paar minuten een maken. Ze kunnen hun bestaande e-mail gebruiken en deze koppelen aan een Microsoft-account, of ze kunnen een Outlook-e-mailadres als Microsoft-account maken en gebruiken.
Gebruikers toevoegen aan een Spraak-resource
Ga als volgt te werk om gebruikers toe te voegen aan een Spraak-resource, zodat ze audio-inhoud kunnen maken:
Selecteer in de Azure portalAll services in het linkerdeelvenster en zoek vervolgens naar Foundry Tools of Speech.
Selecteer uw Spraakbron.
Note
U kunt ook Azure RBAC instellen voor hele resourcegroepen, abonnementen of beheergroepen. Doe dit door het gewenste bereikniveau te selecteren en vervolgens naar het gewenste item te navigeren (bijvoorbeeld resourcegroepen selecteren en vervolgens uw resourcegroep selecteren).
Selecteer Access control (IAM) in het linkerdeelvenster.
Selecteer Toevoegen>Roltoewijzing toevoegen.
Selecteer op het tabblad Rol in het volgende scherm een rol (zoals Eigenaar) die u wilt toevoegen.
Voer op het tabblad Leden het e-mailadres van een gebruiker in en selecteer de naam van de gebruiker in de directory. Het e-mailadres moet zijn gekoppeld aan een Microsoft-account dat wordt vertrouwd door Microsoft Entra ID. Gebruikers kunnen zich eenvoudig registreren voor een Microsoft-account met hun persoonlijke e-mailadres.
Selecteer op het tabblad Beoordelen en toewijzen de optie Beoordelen en toewijzen om de rol toe te wijzen.
Dit is wat er daarna gebeurt:
Er wordt automatisch een e-mailuitnodiging verzonden naar gebruikers.
Note
Als gebruikers de uitnodigings-e-mail niet ontvangen, kunt u zoeken naar hun account onder Roltoewijzingen en naar hun profiel gaan. Identity>Uitnodiging geaccepteerd, en selecteer (beheren) om de e-mailuitnodiging opnieuw te verzenden. U kunt de uitnodigingskoppeling ook naar hen kopiëren en verzenden.
Ze kunnen deze accepteren door Accept-uitnodiging>Accept te selecteren om deel te nemen aan Azure in hun e-mail.
Ze worden vervolgens omgeleid naar de Azure portal. Ze hoeven geen verdere actie te ondernemen in de Azure portal.
Na enkele ogenblikken krijgen gebruikers de rol toegewezen binnen de spraakresource-scope, waardoor ze toegang tot deze spraakresource krijgen.
Gebruikers gaan nu naar de productpagina voor het maken van audio-inhoud en vernieuwen deze, en melden zich aan met hun Microsoft-account. Ze selecteren het blok Audio-inhoud maken in alle spraakproducten. Ze kiezen de Spraak-resource in het pop-upvenster of in de instellingen in de rechterbovenhoek.
Als ze de beschikbare Spraak-resource niet kunnen vinden, kunnen ze controleren of ze zich in de juiste map bevinden. Om dit te doen, selecteren ze het profiel van het account in de rechterbovenhoek en vervolgens Switch naast Current directory. Als er meer dan één map beschikbaar is, betekent dit dat ze access hebben voor meerdere mappen. Ze kunnen overschakelen naar verschillende mappen en naar Instellingen gaan om te zien of de juiste Spraak-resource beschikbaar is.
Gebruikers die zich in dezelfde Spraak-resource bevinden, zien elkaars werk in het hulpprogramma voor het maken van audio-inhoud. Als u wilt dat elke afzonderlijke gebruiker een unieke en privéwerkruimte heeft bij het maken van audio-inhoud, maakt u een nieuwe Spraak-resource.
Gebruikers verwijderen uit een Spraak-resource
Ga als volgt te werk om de machtiging van een gebruiker uit een Spraak-resource te verwijderen:
Zoek in de Azure portal naar Foundry Tools en selecteer de Spraakresource waaruit u gebruikers wilt verwijderen.
Selecteer Access control (IAM) en selecteer vervolgens het tabblad Role-toewijzingen om alle roltoewijzingen voor deze Spraak-resource weer te geven.
Selecteer de gebruikers die u wilt verwijderen, selecteer Verwijderen en selecteer vervolgens OK.
Gebruikers de mogelijkheid geven om toegang aan anderen te verlenen
Als u wilt toestaan dat een gebruiker access aan andere gebruikers toewijst, moet u de rol van eigenaar voor de spraakresource toewijzen en de gebruiker instellen als de Azure directorylezer.
Voeg de gebruiker toe als de eigenaar van de Spraak-resource. Zie Gebruikers toevoegen aan een spraakresource voor meer informatie.
Selecteer in de Azure portal het samengevouwen menu linksboven, selecteer Microsoft Entra ID en selecteer vervolgens Gebruikers.
Zoek naar het Microsoft-account van de gebruiker, ga naar de detailpagina en selecteer toegewezen rollen.
Selecteer Toewijzingen toevoegen>directorylezers. Als de knop Toevoegingstoewijzingen niet beschikbaar is, betekent dit dat u geen access hebt. U moet de rol van Owner of Gebruiker Access Administrator hebben om rollen toe te wijzen aan gebruikers.