Notitie
Voor toegang tot deze pagina is autorisatie vereist. U kunt proberen u aan te melden of de directory te wijzigen.
Voor toegang tot deze pagina is autorisatie vereist. U kunt proberen de mappen te wijzigen.
U hebt audio- of tekstgegevens nodig om de nauwkeurigheid van spraakherkenning te testen of uw aangepaste modellen te trainen. Raadpleeg Trainings- en testgegevenssets voor informatie over de gegevenstypes die worden ondersteund voor het testen of trainen van uw model.
Gegevenssets uploaden
Volg deze stappen om gegevenssets te uploaden voor het trainen (afstemmen) van uw aangepaste spraakmodel.
Belangrijk
Herhaal de stappen voor het uploaden van testgegevenssets (zoals alleen audio ) die u later nodig hebt wanneer u een test maakt. U kunt meerdere gegevenssets uploaden voor training en testen.
In de nieuwe Microsoft Foundry-portal verstrekt u de trainings- en validatiegegevenssets rechtstreeks in de wizard Een model verfijnen die u hebt geopend toen u aangepaste spraakverfijning startte.
- Maak in het deelvenster Trainingsgegevens verbinding met een gegevensbron en selecteer de gegevensset die u wilt gebruiken voor training. Klik daarna op Volgende.
- Selecteer in het deelvenster Validatiegegevens de gegevensset die u wilt gebruiken om het nauwkeurig afgestemde model te evalueren. Klik daarna op Volgende.
Houd het deelvenster Een model verfijnen open en ga verder met Een aangepast spraakmodel trainen om de taak voor het afstemmen te verzenden.
Als u uw eigen gegevenssets wilt uploaden in Speech Studio, voert u de volgende stappen uit:
Meld u aan bij Speech Studio.
Selecteer Custom Speech> de naam van uw project >Spraakgegevenssets>Gegevens uploaden.
Selecteer het tabblad Trainingsgegevens of Testgegevens .
Selecteer een type gegevensset en selecteer vervolgens Volgende.
Geef de locatie van de gegevensset op en selecteer vervolgens Volgende. U kunt een lokaal bestand kiezen of een externe locatie opgeven, zoals azure Blob-URL. Als u een externe locatie selecteert en u geen vertrouwd beveiligingsmechanisme voor Azure-services gebruikt, moet de externe locatie een URL zijn die kan worden opgehaald met behulp van een eenvoudige anonieme GET-aanvraag. Bijvoorbeeld een SAS-URL of een openbaar toegankelijke URL. URL's waarvoor extra autorisatie is vereist of waarin gebruikersinteractie wordt verwacht, worden niet ondersteund.
Notitie
Als u azure Blob-URL gebruikt, kunt u de maximale beveiliging van uw gegevenssetbestanden garanderen met behulp van een vertrouwd Azure Services-beveiligingsmechanisme. U gebruikt dezelfde technieken als voor batch-transcriptie en onbewerkte opslagaccount-URL's voor uw datasetbestanden. Hier vindt u meer informatie.
Voer de naam en beschrijving van de dataset in en selecteer vervolgens Volgende.
Controleer uw instellingen en selecteer Opslaan en sluiten.
Nadat uw gegevensset is geüpload, gaat u naar de pagina Aangepaste modellen trainen om een aangepast model te trainen.
Voordat u doorgaat, moet u ervoor zorgen dat de Speech CLI is geïnstalleerd en geconfigureerd.
Met de Speech CLI en Speech to text REST API, in tegenstelling tot de Microsoft Foundry-portal en Speech Studio, kiest u niet of een gegevensset moet worden getest of getraind op het moment van uploaden. U geeft op hoe een gegevensset wordt gebruikt wanneer u een model traint of een test uitvoert.
Hoewel u niet aangeeft of de gegevensset bedoeld is voor testen of trainen, moet u het type gegevensset opgeven. Het type gegevensset wordt gebruikt om te bepalen welk type gegevensset wordt gemaakt. In sommige gevallen wordt een gegevenssettype alleen gebruikt voor testen of trainen, maar u moet daar geen afhankelijkheid van nemen. De waarden van de Speech CLI en REST API kind komen overeen met de opties in de Microsoft Foundry-portal en Speech Studio , zoals beschreven in de volgende tabel:
| CLI- en API-soort | Portalopties |
|---|---|
| Akoestisch | Trainingsgegevens: audio + door mensen gelabeld transcript Testgegevens: Transcript (automatische audiosynthese) Testgegevens: Audio + door mensen gelabelde transcriptie |
| AudioFiles | Testgegevens: Audio |
| Taal | Trainingsgegevens: Tekst zonder opmaak |
| LanguageMarkdown | Trainingsgegevens: Gestructureerde tekst in Markdown-indeling |
| Uitspraak | Trainingsgegevens: Uitspraak |
| Uitvoeropmaak | Trainingsgegevens: Uitvoerindeling |
Belangrijk
U gebruikt de Speech CLI of REST API niet om gegevensbestanden rechtstreeks te uploaden. Eerst slaat u de trainings- of testgegevenssetbestanden op op een URL waartoe de Speech CLI of REST API toegang heeft. Nadat u de gegevensbestanden hebt geüpload, kunt u de Speech CLI of REST API gebruiken om een gegevensset te maken voor aangepaste spraaktests of -training.
Gebruik de spx csr dataset create opdracht om een gegevensset te maken en deze te verbinden met een bestaand project. Bouw de aanvraagparameters volgens de volgende instructies:
Stel de
projecteigenschap in op de id van een bestaand project. Gebruik deprojecteigenschap zodat u ook het afstemmen van aangepaste spraak in de Microsoft Foundry-portal kunt beheren. Zie de documentatie De project-id verkrijgen voor de REST API om de project-id te verkrijgen.Stel de vereiste
kindeigenschap in. De mogelijke waarden voor een soort trainingsgegevensset zijn: Acoustic, AudioFiles, Language, LanguageMarkdown en Pronunciation.Stel de vereiste
contentUrleigenschap in. Deze parameter is de locatie van de gegevensset. Als u geen vertrouwd Beveiligingsmechanisme voor Azure-services gebruikt (zie volgende opmerking), moet decontentUrleigenschap een URL zijn die kan worden opgehaald met een eenvoudige anonieme GET-aanvraag. Bijvoorbeeld een SAS-URL of een openbaar toegankelijke URL. URL's waarvoor extra autorisatie is vereist of verwacht dat gebruikersinteractie niet wordt ondersteund.Notitie
Als u azure Blob-URL gebruikt, kunt u de maximale beveiliging van uw gegevenssetbestanden garanderen met behulp van een vertrouwd Azure Services-beveiligingsmechanisme. U gebruikt dezelfde technieken als voor batch-transcriptie en onbewerkte opslagaccount-URL's voor uw datasetbestanden. Hier vindt u meer informatie.
Stel de vereiste
languageeigenschap in. De landinstelling van de gegevensset moet overeenkomen met de landinstelling van het project. De locale kan later niet meer worden gewijzigd. De speech CLI-eigenschaplanguagekomt overeen met delocaleeigenschap in de JSON-aanvraag en het antwoord.Stel de vereiste
nameeigenschap in. Deze parameter is de naam die wordt weergegeven in de Microsoft Foundry-portal. De speech CLI-eigenschapnamekomt overeen met dedisplayNameeigenschap in de JSON-aanvraag en het antwoord.
Hier volgt een voorbeeld van een Speech CLI-opdracht die een gegevensset maakt en deze verbindt met een bestaand project:
spx csr dataset create --api-version v3.2 --kind "Acoustic" --name "My Acoustic Dataset" --description "My Acoustic Dataset Description" --project YourProjectId --content YourContentUrl --language "en-US"
Belangrijk
U moet de --api-version v3.2 instellen. De Speech CLI maakt gebruik van de REST API, maar biedt nog geen ondersteuning voor versies later dan v3.2.
U ontvangt een antwoordtekst in de volgende indeling:
{
"self": "https://YourResourceName.cognitiveservices.azure.com/speechtotext/v3.2/datasets/aaaabbbb-0000-cccc-1111-dddd2222eeee",
"kind": "Acoustic",
"links": {
"files": "https://YourResourceName.cognitiveservices.azure.com/speechtotext/v3.2/datasets/23b6554d-21f9-4df1-89cb-f84510ac8d23/files"
},
"project": {
"self": "https://YourResourceName.cognitiveservices.azure.com/speechtotext/v3.2/projects/bbbbcccc-1111-dddd-2222-eeee3333ffff"
},
"properties": {
"textNormalizationKind": "Default",
"acceptedLineCount": 2,
"rejectedLineCount": 0,
"duration": "PT59S"
},
"lastActionDateTime": "2024-07-14T17:36:30Z",
"status": "Succeeded",
"createdDateTime": "2024-07-14T17:36:14Z",
"locale": "en-US",
"displayName": "My Acoustic Dataset",
"description": "My Acoustic Dataset Description",
"customProperties": {
"PortalAPIVersion": "3"
}
}
De eigenschap op het hoogste niveau self in de hoofdtekst van het antwoord is de URI van de gegevensset. Gebruik deze URI voor meer informatie over het project en de bestanden van de gegevensset. U gebruikt deze URI ook om een gegevensset bij te werken of te verwijderen.
Voer de volgende opdracht uit voor Speech CLI-hulp bij gegevenssets:
spx help csr dataset
Met de Speech CLI en Speech to text REST API, in tegenstelling tot de Microsoft Foundry-portal en Speech Studio, kiest u niet of een gegevensset moet worden getest of getraind op het moment van uploaden. U geeft op hoe een gegevensset wordt gebruikt wanneer u een model traint of een test uitvoert.
Hoewel u niet aangeeft of de gegevensset bedoeld is voor testen of trainen, moet u het type gegevensset opgeven. Het type gegevensset wordt gebruikt om te bepalen welk type gegevensset wordt gemaakt. In sommige gevallen wordt een gegevenssettype alleen gebruikt voor testen of trainen, maar u moet daar geen afhankelijkheid van nemen. De waarden van de Speech CLI en REST API kind komen overeen met de opties in de Microsoft Foundry-portal en Speech Studio , zoals beschreven in de volgende tabel:
| CLI- en API-soort | Portalopties |
|---|---|
| Akoestisch | Trainingsgegevens: audio + door mensen gelabeld transcript Testgegevens: Transcript (automatische audiosynthese) Testgegevens: Audio + door mensen gelabelde transcriptie |
| AudioFiles | Testgegevens: Audio |
| Taal | Trainingsgegevens: Tekst zonder opmaak |
| LanguageMarkdown | Trainingsgegevens: Gestructureerde tekst in Markdown-indeling |
| Uitspraak | Trainingsgegevens: Uitspraak |
| Uitvoeropmaak | Trainingsgegevens: Uitvoerindeling |
Belangrijk
U gebruikt de Speech CLI of REST API niet om gegevensbestanden rechtstreeks te uploaden. Eerst slaat u de trainings- of testgegevenssetbestanden op op een URL waartoe de Speech CLI of REST API toegang heeft. Nadat u de gegevensbestanden hebt geüpload, kunt u de Speech CLI of REST API gebruiken om een gegevensset te maken voor aangepaste spraaktests of -training.
Als u een gegevensset wilt maken en deze wilt verbinden met een bestaand project, gebruikt u de Datasets_Create bewerking van de Rest API voor spraak naar tekst. Stel de hoofdtekst van de aanvraag op volgens de volgende instructies:
Stel de
projecteigenschap in op de id van een bestaand project. Gebruik deprojecteigenschap zodat u ook het afstemmen van aangepaste spraak in de Microsoft Foundry-portal kunt beheren. Zie de documentatie De project-id verkrijgen voor de REST API om de project-id te verkrijgen.Stel de vereiste
kindeigenschap in. De mogelijke waarden voor een soort trainingsgegevensset zijn: Acoustic, AudioFiles, Language, LanguageMarkdown en Pronunciation.Stel de vereiste
contentUrleigenschap in. Deze eigenschap is de locatie van de gegevensset. Als u geen vertrouwd Beveiligingsmechanisme voor Azure-services gebruikt (zie volgende opmerking), moet decontentUrleigenschap een URL zijn die kan worden opgehaald met een eenvoudige anonieme GET-aanvraag. Bijvoorbeeld een SAS-URL of een openbaar toegankelijke URL. URL's waarvoor extra autorisatie is vereist of verwacht dat gebruikersinteractie niet wordt ondersteund.Notitie
Als u azure Blob-URL gebruikt, kunt u de maximale beveiliging van uw gegevenssetbestanden garanderen met behulp van een vertrouwd Azure Services-beveiligingsmechanisme. U gebruikt dezelfde technieken als voor batch-transcriptie en onbewerkte opslagaccount-URL's voor uw datasetbestanden. Hier vindt u meer informatie.
Stel de vereiste
localeeigenschap in. De landinstelling van de gegevensset moet overeenkomen met de landinstelling van het project. De locale kan later niet meer worden gewijzigd.Stel de vereiste
displayNameeigenschap in. Deze eigenschap is de naam die wordt weergegeven in de Microsoft Foundry-portal.
Maak een HTTP POST-aanvraag met behulp van de URI, zoals wordt weergegeven in het volgende voorbeeld. Vervang door YourSpeechResoureKey uw Spraak-resourcesleutel, vervang deze door YourResourceName de naam van de Spraak-resource en stel de eigenschappen van de aanvraagbody in zoals eerder beschreven.
curl -v -X POST -H "Ocp-Apim-Subscription-Key: YourSpeechResoureKey" -H "Content-Type: application/json" -d '{
"kind": "Acoustic",
"displayName": "My Acoustic Dataset",
"description": "My Acoustic Dataset Description",
"project": {
"self": "https://YourResourceName.cognitiveservices.azure.com/speechtotext/v3.2/projects/bbbbcccc-1111-dddd-2222-eeee3333ffff"
},
"contentUrl": "https://contoso.com/mydatasetlocation",
"locale": "en-US",
}' "https://YourResourceName.cognitiveservices.azure.com/speechtotext/v3.2/datasets"
U ontvangt een antwoordtekst in de volgende indeling:
{
"self": "https://YourResourceName.cognitiveservices.azure.com/speechtotext/v3.2/datasets/aaaabbbb-0000-cccc-1111-dddd2222eeee",
"kind": "Acoustic",
"links": {
"files": "https://YourResourceName.cognitiveservices.azure.com/speechtotext/v3.2/datasets/23b6554d-21f9-4df1-89cb-f84510ac8d23/files"
},
"project": {
"self": "https://YourResourceName.cognitiveservices.azure.com/speechtotext/v3.2/projects/bbbbcccc-1111-dddd-2222-eeee3333ffff"
},
"properties": {
"textNormalizationKind": "Default",
"acceptedLineCount": 2,
"rejectedLineCount": 0,
"duration": "PT59S"
},
"lastActionDateTime": "2024-07-14T17:36:30Z",
"status": "Succeeded",
"createdDateTime": "2024-07-14T17:36:14Z",
"locale": "en-US",
"displayName": "My Acoustic Dataset",
"description": "My Acoustic Dataset Description",
"customProperties": {
"PortalAPIVersion": "3"
}
}
De eigenschap op het hoogste niveau self in de hoofdtekst van het antwoord is de URI van de gegevensset. Gebruik deze URI om details op te halen over het project en de bestanden van de dataset. U gebruikt deze URI ook om de gegevensset bij te werken of te verwijderen .
Belangrijk
U hoeft geen gegevensset te verbinden met een aangepast spraakproject om een aangepast model te trainen en te testen met behulp van de REST API of Speech CLI. Als u de gegevensset echter niet verbindt met een project, kunt u deze niet selecteren voor training of testen in de Microsoft Foundry-portal.