Code migreren van versie 2024-11-15 naar versie 2025-10-15

Gebruik de spraak-naar-tekst-REST API voor snelle transcriptie, batchtranscriptie en aangepaste spraak. In dit artikel worden wijzigingen beschreven van versie 2024-11-15 in versie 2025-10-15.

Belangrijk

De nieuwste versie van de REST API voor spraak-naar-tekst is versie 2025-10-15 en is algemeen beschikbaar.

  • De REST API-versie2024-05-15-preview voor spraak-naar-tekst wordt buiten gebruik gesteld op een datum die moet worden aangekondigd.
  • Speech to text REST API v3.0en 3.2-preview.13.2-preview.2 werd buiten gebruik gesteld op 31 maart 2026.

Zie de migratiehandleidingen Speech to text rest API v3.0 naar v3.1, v3.1 naar v3.2 en v3.2 naar 2024-11-15 voor meer informatie over het upgraden.

Om de wijzigingen in deze versie samen te vatten:

  • De Transcribe-API heeft nieuwe functies verbeterde modus en woordgroepenlijst.
  • De Projects-API retourneert (afwezig in versie 2024-11-15) en heeft enkele wijzigingen.

Wijzigingen in transcriptie-API

Aanvraagstructuur

  • Nieuw eindpunt:
    POST <your_endpoint>/speechtotext/transcriptions:transcribe?api-version=2025-10-15
    
  • Headers en formuliergegevens:
    • Content-Type: multipart/form-data
    • Ocp-Apim-Subscription-Key: $KEY
    • Formuliervelden: definition, audio

Example:

curl --request POST \
  --url '<your_endpoint>/speechtotext/transcriptions:transcribe?api-version=2025-10-15' \
  --header 'Content-Type: multipart/form-data' \
  --header 'Ocp-Apim-Subscription-Key: $KEY' \
  --form 'definition=$DEFINITION' \
  --form 'audio=@C:\workspace\audios\test.wav'

Updates voor definitieobjecten

  • Verwijderd:
    • "models" woordenlijst (niet meer in aanvraagdefinitie)
  • Toegevoegd:
    • "phraseList": Ondersteunt nu biasingWeight voor het afstemmen van herkenningsvooroordelen
    • "enhancedMode" object bevat:
      • enabled (booleaanse waarde)
      • task (zoals "translate")
      • targetLanguage (zoals "ko")
      • prompt (array van instructies of lexicale versterkingen)

Example:

{
  "locales": ["en-US"],
  "profanityFilterMode": "Masked",
  "diarization": {
    "enabled": true,
    "maxSpeakers": 6
  },
  "channels": [0],
  "enhancedMode": {
    "enabled": true,
    "task": "translate",
    "targetLanguage": "ko",
    "prompt": [
      "Provide lexical output",
      "Boost the terms: CONTOSO, AAZZ; Replace ‘50cents’ to ’50-Cents’"
    ]
  },
  "phraseList": {
    "phrases": ["Kenichi Kumatani", "John McDonough", "Bhiksha Raj"],
    "biasingWeight": 1.6
  }
}

Resultaatstructuur

  • Uitvoer op basis van kanalen:
    • Resultaten zijn ingedeeld per kanaal
  • Woordgroepssegmentatie:
    • Elke woordgroep bevat kanaal-, begin- en eindtijd, spreker, tekst en betrouwbaarheid op woordniveau

Wijzigingen in projecten-API

Nieuwe functies

  • Foundry-projectnaam:
    • Nieuwe eigenschap: foundryProjectName in Maken, Ophalen, Bijwerken, Lijst-API's
  • Project maken:
    • Projecten worden gemaakt via Azure Resource Manager (ARM)-conventies
    • locale is nu vereist voor aangepaste spraakprojecten

Example:

POST {endpoint}/speechtotext/projects?api-version=2025-10-15
Headers:
  Ocp-Apim-Subscription-Key: <YOUR_SUBSCRIPTION_KEY>
  Content-Type: application/json
Body:
{
  "locale": "en-US",
  "displayName": "My speech project",
  "foundryProjectName": "MyFoundrySpeechProject"
}

Projectenlijst en filteren

  • Filter op Foundry-projectnaam:
    GET {endpoint}/speechtotext/projects?filter=foundryProjectName eq 'MyFoundrySpeechProject'&api-version=2025-10-15
    

Volgende stappen