Kontingente und Grenzwerte für Azure Sprache

Dieser Artikel enthält eine Kurzübersicht und eine detaillierte Beschreibung der Kontingente und Grenzwerte für Azure Sprache in Foundry Tools. Die Informationen gelten für alle Preisstufen von Azure Speech. Dieser Artikel enthält auch einige bewährte Methoden, um Anforderungsdrosselung zu vermeiden.

Die Preisstufe "Kostenlos (F0)" finden Sie auf der Preisseite unter den monatlichen Zulagen.

Referenz für Kontingente und Grenzwerte

In den folgenden Abschnitten finden Sie eine Kurzanleitung zu den Kontingenten und Grenzwerten, die für Azure Sprache gelten.

Informationen zu anpassbaren Kontingenten für Standardressourcen (S0) Azure Spracherkennung finden Sie unter weitere Erläuterungen, best Practices und Adjustment-Anweisungen weiter unten in diesem Artikel. Die Kontingente und Grenzwerte für freie (F0) Azure Sprachressourcen sind nicht anpassbar.

Wichtig

Wenn Sie eine Foundry-Ressource für Azure Sprache von der Preisstufe "Kostenlos(F0)" auf "Standard" (S0) wechseln, kann die Änderung der entsprechenden Kontingente bis zu mehreren Stunden dauern.

VoIP Live-Kontingente und Grenzwerte pro Ressource

In der folgenden Tabelle sind die Kontingente und Grenzwerte für Voice Live pro Azure Speech-Ressource zusammengefasst. Weitere Erläuterungen zu anpassbaren Kontingenten finden Sie weiter unten in diesem Artikel.

Kontingent Kostenlos (F0) Standard (S0)
Neue Verbindungen pro Minute Nicht anwendbar 30
Maximale Verbindungslänge Nicht anwendbar <= 60 Minuten pro Sitzung
Token pro Minute Nicht anwendbar <= 120.000

Avatare, die in Voice Live verwendet werden, folgen den Kontingenten und Grenzwerten, die später in diesem Artikel unter Echtzeit-Text-zu-Sprache-Avatar beschrieben werden.

LLM-Sprachkontingente und Grenzwerte pro Ressource

In der folgenden Tabelle sind die Kontingente und Grenzwerte für sprachbasierte Spracherkennung (LLM) pro Azure Speech-Ressource zusammengefasst. Zu diesem Zeitpunkt sind diese Grenzwerte nicht anpassbar.

Kontingent Kostenlos (F0) Standard (S0)
Maximale Größe der Audioeingabedatei Nicht anwendbar < 500 MB
Maximale Audiolänge Nicht anwendbar < 5 Stunden pro Datei
Maximale Anforderungen pro Minute Nicht anwendbar 600

Sprach-zu-Text-Kontingente und Grenzwerte pro Ressource

In den folgenden Abschnitten werden Sprach-zu-Text-Kontingente und Grenzwerte pro Azure Speech-Ressource beschrieben. Weitere Erläuterungen zu anpassbaren Kontingenten finden Sie in diesem Artikel.

Spracherkennung und Sprachübersetzung in Echtzeit

Mit dem Speech SDK oder der REST-API für Spracherkennung von Kurz-Audio können Sie Sprache in Echtzeit in Text umwandeln.

Diese Grenzwerte gelten für gleichzeitige Echtzeit-Sprach-zu-Text-Anforderungen und kombinierte Sprachübersetzungsanforderungen. Wenn Sie beispielsweise über 60 gleichzeitige Sprach-zu-Text-Anforderungen und 40 gleichzeitige Sprachübersetzungsanforderungen verfügen, erreichen Sie den Grenzwert von 100 gleichzeitigen Anforderungen.

Kontingent Kostenlos (F0) Standard (S0)
Grenzwert für gleichzeitige Anforderungen für den Basismodellendpunkt 1

Dieser Grenzwert ist nicht anpassbar.
100 (Standardwert)

Die Rate ist für Ressourcen vom Typ „Standard“ (S0) anpassbar. Weitere Erläuterungen, bewährte Methoden und Anpassungsanweisungen finden Sie weiter unten in diesem Artikel.
Grenzwert für gleichzeitige Anforderung für benutzerdefinierte Endpunkte 1

Dieser Grenzwert ist nicht anpassbar.
100 (Standardwert)

Die Rate ist für Ressourcen vom Typ „Standard“ (S0) anpassbar. Weitere Erläuterungen, bewährte Methoden und Anpassungsanweisungen finden Sie weiter unten in diesem Artikel.
Maximale Audiolänge für die Echtzeit-Diarisierung Nicht anwendbar 240 Minuten pro Sitzung

Schnelle Transkription

Kontingent Kostenlos (F0) Standard (S0)
Maximale Größe der Audioeingabedatei Nicht anwendbar < 500 MB
Maximale Audiolänge Nicht anwendbar < 5 Stunden pro Datei
Maximale Anforderungen pro Minute Nicht anwendbar 600

Batch-Transkription

Die folgenden Grenzwerte sind nicht anpassbar. Weitere Informationen zur Latenz bei der Batchtranskription finden Sie unter Bewährte Methoden zur Verbesserung der Leistung.

Kontingent Kostenlos (F0) Standard (S0)
REST-API-Grenzwert für Sprach-zu-Text Für F0 nicht verfügbar 100 Anforderungen pro 10 Sekunden (600 Anforderungen pro Minute)
Maximale Dateigröße für Audioeingabe Nicht anwendbar 1 GB
Maximale Anzahl von Blobs pro Container Nicht anwendbar 10.000
Maximale Anzahl von Dateien pro Transkriptionsanforderung (wenn Sie mehrere Inhalts-URLs als Eingabe verwenden) Nicht anwendbar 1.000
Maximale Audiolänge für Transkriptionen mit aktivierter Diarisierung Nicht anwendbar 240 Minuten pro Datei

Modellanpassung

Die Grenzwerte in dieser Tabelle gelten pro Azure Speech-Ressource, wenn Sie ein benutzerdefiniertes Sprachmodell erstellen.

Kontingent Kostenlos (F0) Standard (S0)
REST-API-Grenzwert 100 Anforderungen pro 10 Sekunden (600 Anforderungen pro Minute) 100 Anforderungen pro 10 Sekunden (600 Anforderungen pro Minute)
Maximale Anzahl von benutzerdefinierten Modellbereitstellungen pro Azure Speech-Ressource 1 50
Maximale Anzahl von Sprachdatensätzen 2 500
Maximale Dateigröße für das akustische Dataset für den Datenimport 2 GB 2 GB
Maximale Dateigröße für das Sprachdatenset für den Datenimport 200 MB 1,5 GB
Maximale Dateigröße für das Aussprache-Dataset für den Datenimport 1 KB 1 MB
Maximale Textgröße, wenn Sie den text Parameter in der Models_Create-API-Anforderung verwenden 200 KB 500 KB

Text-zu-Sprache-Kontingente und Grenzwerte pro Ressource

In den folgenden Abschnitten werden Text-zu-Sprache-Kontingente und Grenzwerte pro Azure Speech-Ressource beschrieben. Weitere Erläuterungen zu anpassbaren Kontingenten finden Sie weiter unten in diesem Artikel.

Sprachsynthese in Echtzeit

Sie können Text in Echtzeit mit dem Speech SDK oder der REST-API für Text-zu-Sprache verwenden. Sofern nicht anders angegeben, sind die Grenzwerte nicht anpassbar.

Kontingent Kostenlos (F0) Standard (S0)
Maximale Anzahl von Transaktionen pro Zeitraum für Standardstimmen und benutzerdefinierte Stimmen 20 Transaktionen pro 60 Sekunden

Dieser Grenzwert ist nicht anpassbar.
30 Transaktionen pro Sekunde (TPS) (Standardwert)

Die Rate ist bis zu 1.000 TPS für Standardressourcen (S0) einstellbar. Weitere Erläuterungen, bewährte Methoden und Anpassungsanweisungen finden Sie weiter unten in diesem Artikel.
Maximale Audiolänge pro Anforderung 10 Minuten 10 Minuten
Maximale Gesamtanzahl von eindeutigen <voice> Tags und <audio> Tags in SSML 50 50
Maximale SSML-Nachrichtengröße pro Turn für WebSocket 64 KB 64 KB

Hinweis

Die meisten HTTP 429-Fehler mit Text-zu-Sprache-Standardstimme werden durch eingeschränkte Back-End-Dienstkapazität für eine bestimmte Stimme in der ausgewählten Region und nicht durch Kontingentgrenzwerte verursacht. Durch das Erhöhen ihres Kontingents werden diese Fehler nicht behoben. Um optimale Ergebnisse zu erzielen, verwenden Sie die Stimme in Ihrer nativen Region oder wählen Sie eine beliebtere Stimme in Ihrer aktuellen Region aus.

Batchsynthese

Die folgenden Grenzwerte sind nicht anpassbar. Weitere Informationen zur Latenz in der Batchsynthese finden Sie unter Batchsyntheselatenz und bewährte Methoden.

Kontingent Kostenlos (F0) Standard (S0)
REST-API-Grenzwert Für F0 nicht verfügbar 100 Anforderungen pro zehn Sekunden
Maximale JSON-Nutzlastgröße zum Erstellen eines Syntheseauftrags Nicht anwendbar 2 MB
Gleichzeitige aktive Syntheseaufträge Nicht anwendbar Keine Begrenzung
Maximale Anzahl von Texteingaben pro Syntheseauftrag Nicht anwendbar 10.000
Maximale Time-to-Live für einen Synthese Job seit dem Eintritt in den endgültigen Status Nicht anwendbar Bis zu 31 Tage, angegeben durch Eigenschaften

Benutzerdefinierte professionelle Stimme

Die Grenzwerte in dieser Tabelle gelten pro Azure Sprachressource, wenn Sie eine professionelle Stimme erstellen.

Kontingent Kostenlos (F0) Standard (S0)
Maximale Anzahl von Transaktionen pro Sekunde Für F0 nicht verfügbar 30 TPS (Standardwert)
Maximale Anzahl von Datasets Nicht anwendbar 500
Maximale Anzahl gleichzeitiger Datasetuploads Nicht anwendbar 5
Maximale Datendateigröße für den Datenimport pro Dataset Nicht anwendbar 2 GB
Upload langer Audiospuren oder Audiospuren ohne Skript Nicht anwendbar Ja
Maximale Anzahl gleichzeitiger Modellschulungen Nicht anwendbar 4
Maximale Anzahl von benutzerdefinierten Endpunkten Nicht anwendbar 50

Benutzerdefinierte persönliche Stimme

Die Grenzwerte in dieser Tabelle gelten pro Azure Sprachressource, wenn Sie eine persönliche Stimme erstellen.

Kontingent Kostenlos (F0) Standard (S0)
REST-API-Grenzwert (ohne Sprachsynthese) Für F0 nicht verfügbar 50 Anforderungen pro 10 Sekunden
Maximale Anzahl von Transaktionen pro Sekunde für die Sprachsynthese Für F0 nicht verfügbar 30 TPS (Standardwert)

Batch-Text-zu-Sprache-Avatar

Kontingent Kostenlos (F0) Standard (S0)
REST-API-Grenzwert Für F0 nicht verfügbar 2 Anfragen pro Minute

Echtzeit-Avatar für Text-zu-Sprache

Kontingent Kostenlos (F0) Standard (S0)
Neue Verbindungen pro Minute Für F0 nicht verfügbar 2 neue Verbindungen pro Minute
Maximale Verbindungsdauer beim Sprechen Für F0 nicht verfügbar 30 Minuten1
Maximale Verbindungsdauer mit Leerlaufzustand Für F0 nicht verfügbar 5 Minuten

1 Um einen kontinuierlichen Betrieb des Echtzeit-Avatars für mehr als 30 Minuten sicherzustellen, können Sie die automatische Erneute Verbindung aktivieren. Informationen zum Einrichten der automatischen Wiederverbindung finden Sie unter diesem Beispielcode. Suchen Sie nach automatische Wiederverbindung.

Tool für die Audioinhaltserstellung

Kontingent Kostenlos (F0) Standard (S0)
Dateigröße (Nur-Text in SSML)1 3.000 Zeichen pro Datei 20.000 Zeichen pro Datei
Dateigröße (Lexicon-Datei)2 30 KB pro Datei 100 KB pro Datei
Abrechenbare Zeichen in SSML 15.000 Zeichen pro Datei 100.000 Zeichen pro Datei
In Audiobibliothek exportieren 1 gleichzeitige Aufgabe Nicht anwendbar

1 Der Grenzwert gilt nur für Nur-Text in SSML und enthält keine Tags.

2 Die Zeichen der Lexikon-Datei werden nicht berechnet. Nur die Lexikonelemente in SSML werden als abrechenbare Zeichen gezählt. Weitere Informationen finden Sie unter "Rechnungsfähige Zeichen".

Ausführliche Beschreibung, Kontingentanpassung und bewährte Methoden

Einige Azure Sprachkontingente sind anpassbar. Dieser Abschnitt enthält weitere Erläuterungen, bewährte Methoden und Anpassungsanweisungen.

Die folgenden Kontingente sind für Ressourcen vom Typ „Standard“ (S0) anpassbar. Die Grenzwerte für „Free“ (F0)-Anforderungen sind nicht anpassbar.

Bevor Sie eine Kontingenterhöhung anfordern (sofern zutreffend), überprüfen Sie Ihre aktuellen Transaktionen pro Sekunde (TPS) oder Token pro Minute (TPM), und stellen Sie sicher, dass Sie das Kontingent erhöhen müssen.

Hinweis

Batchtranskription und Batchsynthese sind asynchrone Prozesse. Sie verarbeiten Aufträge nacheinander in einer Warteschlange. Das Erhöhen des Kontingents verbessert also nicht die Transkriptionsleistung. Leistungsverbesserungen finden Sie unter Bewährte Methoden zur Verbesserung der Leistung oder Batchsyntheselatenz und bewährten Methoden.

Azure Speech verwendet Automatischkalierungstechnologien, um die erforderlichen Rechenressourcen in den On-Demand-Modus zu bringen. Gleichzeitig versucht Azure Sprache, Ihre Kosten niedrig zu halten, indem keine übermäßige Hardwarekapazität beibehalten wird.

Schauen wir uns ein Beispiel an. Angenommen, Ihre Anwendung empfängt den Antwortcode 429, der angibt, dass zu viele Anforderungen vorhanden sind. Ihre Anwendung empfängt diese Antwort, auch wenn Ihre Workload innerhalb der in der früheren Referenz für Kontingente und Grenzwerte definierten Grenzwerte liegt. Die wahrscheinlichste Erklärung ist, dass Azure Speech nach Ihrer Anforderung skaliert und die erforderliche Kapazität noch nicht erreicht hat. Daher verfügt Azure Speech nicht sofort über genügend Ressourcen, um die Anforderung zu erfüllen. In solchen Fällen hilft das Erhöhen des Kontingents nicht. In den meisten Fällen wird der Azure Speech-Dienst bald hochskaliert und das Problem beheben, das den Antwortcode 429 verursacht.

Als bewährte Methode sollte jede Implementierung 429 Fehler mit Wiederholungslogik ordnungsgemäß behandeln, um eine optimale Leistung sicherzustellen und die automatische Skalierung zu behandeln. Erwägen Sie die Implementierung dieser bewährten Methode, bevor Sie zusätzliches Kontingent anfordern, wie im nächsten Abschnitt beschrieben.

Allgemeine bewährte Methoden zur Behandlung der Drosselung während der automatischen Skalierung

Um Probleme im Zusammenhang mit der Drosselung zu minimieren, empfiehlt es sich, die folgenden Methoden zu verwenden:

  • Implementieren Sie die Wiederholungslogik in Ihrer Anwendung, um 429 Fehler zu behandeln.

  • Vermeiden Sie plötzliche Änderungen bei der Arbeitsauslastung. Erhöhen Sie die Workload nach und nach.

    Nehmen wir beispielsweise an, dass Ihre Anwendung Sprachsynthese verwendet und Ihre aktuelle Workload bei 5 TPS (Transaktionen pro Sekunde) liegt. In der nächsten Sekunde erhöhen Sie die Last auf 20 TPS (also auf das Vierfache). Azure Speech beginnt sofort mit der Skalierung, um die neue Last zu bewältigen, kann jedoch nicht innerhalb einer Sekunde wie benötigt skaliert werden. Einige Anforderungen erhalten den Antwortcode 429 (zu viele Anforderungen).

  • Testen Sie unterschiedliche Muster für Auslastungssteigerungen. Weitere Informationen finden Sie im Beispiel für das Arbeitsauslastungsmuster in diesem Artikel.

  • Erstellen Sie weitere Azure Sprachressourcen in different Regionen, und verteilen Sie die Arbeitsauslastung unter ihnen. Das Erstellen mehrerer Azure Sprachressourcen in derselben Region wirkt sich nicht auf die Leistung aus, da derselbe Back-End-Cluster allen Ressourcen dient.

In späteren Abschnitten werden bestimmte Fälle der Anpassung von Kontingenten beschrieben.

Beispiel für bewährte Methoden für Arbeitsauslastungsmuster

Im Folgenden finden Sie ein allgemeines Beispiel für einen guten Ansatz. Es dient nur als Vorlage, die Sie bei Bedarf für Ihre eigenen Zwecke anpassen können.

Angenommen, eine Azure Speech-Ressource hat den Grenzwert für die gleichzeitige Anforderung auf 300 festgelegt. Starten Sie die Workload von 20 gleichzeitigen Verbindungen und erhöhen Sie die Last um 20 gleichzeitige Verbindungen alle 90 bis 120 Sekunden. Steuern Sie die Azure-Sprachantworten und implementieren Sie die Logik, die auf ein Fallback zurückgreift, um die Auslastung zu reduzieren, wenn Sie zu viele Anforderungen erhalten (Antwortcode 429). Wiederholen Sie dann die Lasterhöhung in einer Minute. Wenn es immer noch nicht funktioniert, versuchen Sie es in zwei Minuten erneut. Verwenden Sie für die Intervalle ein Muster von 1-2-4-4 Minuten.

Im Allgemeinen sollten Sie die Arbeitsauslastung und die Arbeitsauslastungsmuster testen, bevor Sie zur Produktion wechseln.

Voice Live: Erhöhen des Grenzwerts für gleichzeitige Sprach-zu-Text-Anforderungen in Echtzeit

Vorbereiten der erforderlichen Informationen

Anweisungen zum Abrufen der allgemeinen Ressourceninformationen, die Sie benötigen, finden Sie unter Erstellen und Übermitteln einer Kontingenterhöhungsanforderung weiter unten in diesem Artikel.

Hinweis

Der Token-Grenzwert pro Minute (TPM) hängt von dem Grenzwert für neue Verbindungen pro Minute (NCPM) ab. Sie erhöht sich automatisch, wenn die NCPM-Grenze zunimmt.

Die Formel lautet: TPM = NCPM * 4.000 Token. Beispiel: 30 NCPM * 4.000 Token = 120.000 TPM.

Erstellen der Anforderung zur Erhöhung des Kontingents

Um die Anforderung mit den gesammelten Informationen zu erstellen, führen Sie die Schritte in "Erstellen" aus, und übermitteln Sie eine Anforderung zur Erhöhung des Kontingents weiter unten in diesem Artikel.

Sprache zu Text: Erhöhen der gleichzeitigen Anforderungsgrenze für Text in Echtzeit

Standardmäßig ist die Anzahl der gleichzeitigen Echtzeit-Sprach-zu-Text- und Sprachübersetzungsanforderungen beschränkt auf:

  • 100 pro Ressource im Basismodell.
  • 100 pro benutzerdefinierter Endpunkt im benutzerdefinierten Modell.

Für das Standard-Preisniveau können Sie diesen Betrag erhöhen. Bevor Sie die Anfrage einreichen, stellen Sie sicher, dass Sie mit dem weiter oben in diesem Artikel erläuterten Material vertraut sind, etwa die besten Methoden, um die Auswirkungen der Drosselung zu mindern.

Grenzwerte für gleichzeitige Anforderung im Basismodell und im benutzerdefinierten Modell müssen getrennt angepasst werden. Eine Azure Speech-Ressource kann vielen benutzerdefinierten Endpunkten zugeordnet werden, die viele benutzerdefinierte Modellbereitstellungen hosten. Sie müssen separat alle Grenzwertanpassungen pro benutzerdefiniertem Endpunkt anfordern.

Das Erhöhen des Grenzwerts für gleichzeitige Anforderungen wirkt sich nicht direkt auf Ihre Kosten aus. Azure Speech verwendet ein Zahlungsmodell, das erfordert, dass Sie nur für ihre Nutzung bezahlen. Das Limit legt fest, wie hoch Azure Speech skalieren kann, bevor es beginnt, Ihre Anfragen zu drosseln.

Der vorhandene Wert des Parameters für den gleichzeitigen Anforderungsgrenzwert wird im Azure Portal, den Befehlszeilentools oder API-Anforderungen nicht angezeigt. Um den vorhandenen Wert zu überprüfen, erstellen Sie eine Azure-Support Anforderung.

Hinweis

Azure Sprachcontainer erfordern keine Erhöhung des gleichzeitigen Anforderungslimits, da Container nur von den CPUs der Hardware eingeschränkt werden, auf der sie gehostet werden. Aber Azure Sprachcontainer haben ihre eigenen Kapazitätsbeschränkungen, die Sie berücksichtigen sollten. Weitere Informationen finden Sie unter Installieren und Ausführen von Spracherkennungscontainern mit Docker.

Vorbereiten der erforderlichen Informationen

Anweisungen zum Abrufen der allgemeinen Ressourceninformationen, die Sie benötigen, finden Sie unter Erstellen und Übermitteln einer Kontingenterhöhungsanforderung weiter unten in diesem Artikel.

Um eine Erhöhungsanforderung für benutzerdefinierte Spracherkennung zu erstellen, müssen Sie auch eine benutzerdefinierte Endpunkt-ID angeben. So rufen Sie diese Informationen für den benutzerdefinierten Sprachendpunkt ab:

  1. Wechseln Sie zum Speech Studio-Portal .
  2. Melden Sie sich bei Bedarf an, und wechseln Sie dann zu "Benutzerdefinierte Sprache".
  3. Wählen Sie Ihr Projekt aus, und wechseln Sie dann zur Bereitstellung.
  4. Wählen Sie den erforderlichen Endpunkt aus.
  5. Kopieren und speichern Sie den Endpunkt-ID-Wert .

Erstellen der Anforderung zur Erhöhung des Kontingents

Um die Anforderung mit den gesammelten Informationen zu erstellen, führen Sie die Schritte in "Erstellen" aus, und übermitteln Sie eine Anforderung zur Erhöhung des Kontingents weiter unten in diesem Artikel.

Schnelle Transkription: Erhöhen der maximalen Anforderungen pro Minute

Vorbereiten der erforderlichen Informationen

Anweisungen zum Abrufen der allgemeinen Ressourceninformationen, die Sie benötigen, finden Sie unter Erstellen und Übermitteln einer Kontingenterhöhungsanforderung weiter unten in diesem Artikel.

Um eine Erhöhungsanforderung für schnelle Transkription zu erstellen, müssen Sie auch die durchschnittliche Audiolänge pro API-Anforderung bereitstellen.

Eine Beispiellänge ist 5 minutes/request. Geben Sie eine Schätzung basierend auf der Workload an, die Sie verarbeiten möchten.

Erstellen der Anforderung zur Erhöhung des Kontingents

Um die Anforderung mit den gesammelten Informationen zu erstellen, führen Sie die Schritte in "Erstellen" aus, und übermitteln Sie eine Anforderung zur Erhöhung des Kontingents weiter unten in diesem Artikel.

Text-zu-Sprache: Echtzeit-Erhöhung der TPS-Grenze

Für das Standard-Preisniveau können Sie das TPS-Limit in Echtzeit erhöhen. Bevor Sie die Anfrage einreichen, stellen Sie sicher, dass Sie mit dem weiter oben in diesem Artikel erläuterten Material vertraut sind, etwa die besten Methoden, um die Auswirkungen der Drosselung zu mindern.

Schätzen Ihrer Anforderungen

  • Nutzung unter 10.000 $/Monat: In der Regel reicht der Standardgrenzwert von 30 TPS aus, vorausgesetzt, dass Ihre Spitzennutzung nicht mehr als das Zehnfache Ihrer durchschnittlichen Nutzung beträgt.
Beispielszenario

Gehen Sie beispielsweise davon aus, dass Sie ein Callcenter erstellen, in dem:

  • Die Anzahl der gleichzeitigen Anrufe beträgt 1.000.
  • Sie erwarten, dass Agenten halb so lange sprechen.
  • Die durchschnittliche TTS-Antwortlänge beträgt 5 Sekunden.

Das erforderliche TPS lautet: 1.000 Anrufe / (2×5 Sekunden) = 100 TPS.

Für eine TPS-Erhöhungsanforderung sind die folgenden Details erforderlich:

  • Spitzen-TPS
  • Durchschnittliche TPS
  • Durchschnittliche Länge der TTS-Anforderung (in Zeichen)

Mit diesen Daten können Sie Die monatliche TTS-Nutzung mithilfe dieser Formel schätzen: monatliche Nutzung = durchschnittliche TPS-× Anforderungslänge × 3600 × 24 × 30.

Multiplizieren Sie das Ergebnis mit dem Einzelpreis von 15 USD pro Million Zeichen, um die monatlichen Kosten zu schätzen.

Hinweis

Wenn Ihre geschätzte Nutzung Ihr Budget erheblich überschreitet, können Sie Ihre Anforderungen überschätzen.

Kostenaspekte

Das Erhöhen des Grenzwerts für gleichzeitige Anforderungen wirkt sich nicht direkt auf Ihre Kosten aus. Sie bezahlen nur, was Sie nutzen. Der Grenzwert definiert lediglich, wie weit Azure Speech skalieren kann, bevor die Drosselung beginnt.

Der vorhandene Wert des Parameters für den gleichzeitigen Anforderungsgrenzwert wird im Azure Portal, den Befehlszeilentools oder API-Anforderungen nicht angezeigt. Um den vorhandenen Wert zu überprüfen, erstellen Sie eine Azure-Support Anforderung.

Hinweis

Azure Sprachcontainer erfordern keine Erhöhung des gleichzeitigen Anforderungslimits, da Container nur von den CPUs der Hardware eingeschränkt werden, auf der sie gehostet werden.

Vorbereiten der erforderlichen Informationen

Anweisungen zum Abrufen der allgemeinen Ressourceninformationen, die Sie benötigen, finden Sie unter Erstellen und Übermitteln einer Kontingenterhöhungsanforderung weiter unten in diesem Artikel.

Um eine Erhöhungsanforderung für Standardstimme zu erstellen, müssen Sie auch die Sprachnamen angeben, für die Sie die Erhöhung anfordern. Sie finden eine Liste aller Sprachnamen in Sprach- und Sprachunterstützung für Azure Speech.

Um eine Erhöhungsanforderung für benutzerdefinierte VoIP zu erstellen, müssen Sie die benutzerdefinierte Endpunkt-ID angeben. So rufen Sie diese Informationen für benutzerdefinierte Stimmen ab:

  1. Wechseln Sie zum Speech Studio-Portal .
  2. Melden Sie sich bei Bedarf an, und wechseln Sie dann zu "Benutzerdefinierte Stimme".
  3. Wählen Sie Ihr Projekt aus, und wechseln Sie dann zum Bereitstellen des Modells.
  4. Wählen Sie den erforderlichen Endpunkt aus.
  5. Kopieren und speichern Sie den Endpunkt-ID-Wert .

Erstellen der Anforderung zur Erhöhung des Kontingents

Um die Anforderung mit den gesammelten Informationen zu erstellen, führen Sie die Schritte in "Erstellen" aus, und übermitteln Sie eine Anforderung zur Erhöhung des Kontingents weiter unten in diesem Artikel.

Avatar "Text-zu-Sprache": Erhöhen des Grenzwerts für neue Verbindungen

Vorbereiten der erforderlichen Informationen

Anweisungen zum Abrufen der allgemeinen Ressourceninformationen, die Sie benötigen, finden Sie unter Erstellen und Übermitteln einer Kontingenterhöhungsanforderung weiter unten in diesem Artikel.

Um einen Antrag auf Erhöhung für benutzerdefinierte Stimme zu erstellen, müssen Sie auch den Standard-Avatar oder den benutzerdefinierten Avatar bereitstellen.

Erstellen der Anforderung zur Erhöhung des Kontingents

Um die Anforderung mit den gesammelten Informationen zu erstellen, führen Sie die Schritte im nächsten Abschnitt aus, erstellen und übermitteln Sie eine Anforderung zur Erhöhung des Kontingents.

Erstellen und Übermitteln einer Anforderung zur Erhöhung des Kontingents

Führen Sie die folgenden Schritte aus, um die Ressourceninformationen abzurufen, die Sie für die Anforderung zur Erhöhung des Kontingents benötigen:

  1. Wechseln Sie zum portal Azure.

  2. Wählen Sie die Ressource aus, für die Sie den Grenzwert für Parallelitätsanforderungen erhöhen möchten.

  3. Wählen Sie in der Gruppe "Ressourcenverwaltung" die Option "Eigenschaften" aus.

  4. Kopieren sie die Werte der folgenden Felder, und speichern Sie sie:

    • Abonnement-ID
    • Ressourcen-ID
    • Standort (Ihre Endpunktregion)

Initiieren Sie die Erhöhung des Grenzwerts für gleichzeitige Anforderungen für Ihre Ressource, indem Sie eine Supportanfrage senden. Sie können auch eine Supportanfrage verwenden, um den aktuellen Grenzwert zu überprüfen. So übermitteln Sie eine Supportanfrage:

  1. Stellen Sie sicher, dass Die erforderlichen Informationen in den vorherigen Abschnitten aufgeführt sind.

  2. Wechseln Sie zum Formular für den Antrag auf Kontingenterhöhung von Foundry Tools.

  3. Geben Sie die Details des Anforderers an:

    1. Vorname
    2. Nachname
    3. E-Mail-Adresse Ihrer Firma oder Organisation

      Hinweis

      Anträge, die mit einer persönlichen E-Mail-Adresse (z. B. hotmail.com, outlook.com oder gmail.com) übermittelt werden, werden nicht akzeptiert.

    4. Firmen- oder Organisationsname

      Hinweis

      Sie können Kontingenterhöhungen nur im Namen Ihrer eigenen Organisation anfordern.

  4. Geben Sie die Ressourceninformationen an:

    1. Azure Abonnement-ID
    2. Ressourcen-ID der Foundry Tools
    3. Ressourcenbereich "Foundry Tools"
  5. Geben Sie die angeforderte Kontingenterhöhung an:

    1. Neue Kontingentbeschränkung angefordert (nur ganze Zahl, z. B. 300, 500 oder 1.000)
    2. Geschäftliche Begründung für die Erhöhung des Grenzwerts
  6. Wählen Sie das Produkt "Foundry Tools" Azure Speech aus, und wählen Sie dann Next aus.

  7. Wählen Sie die Azure Speech-Funktion aus, für die Sie die Erhöhung beantragen. Folgende Optionen stehen zur Verfügung:

    • Grenzwert für gleichzeitige Sprach-zu-Text-Anforderungen für den Basismodellendpunkt
    • Grenzwert für gleichzeitige Sprach-zu-Text-Anforderungen für den benutzerdefinierten Endpunkt
    • Maximale Anzahl von Anforderungen pro Minute für schnelle Transkription
    • Maximale Anzahl von Transaktionen pro Zeitraum für Standardstimmen bei Text-to-Speech
    • Maximale Anzahl von Transaktionen pro Zeitraum für Text-zu-Sprache für benutzerdefinierte Stimmen
    • Grenze gleichzeitiger Anfragen bei der Sprachübersetzung
    • Maximale Anforderungen pro Minute für Batchtext-zu-Sprache-Avatar
    • Neue Verbindungen pro Minute für Echtzeit-Text-zu-Sprache-Avatare
    • Voice Live-API-Token pro Minute
  8. Fügen Sie die zusätzlichen featurespezifischen Informationen hinzu, die im Formular angefordert werden, und wählen Sie dann "Weiter" aus.

  9. Geben Sie auf der letzten Seite zusätzliche Kontaktinformationen für Ihr Konto oder den Kontaktnamen und die E-Mail-Adresse Ihres Partners an.

  10. Überprüfen Sie die beiden Bestätigungsfragen, und wählen Sie dann "Absenden" aus.

  11. Notieren Sie sich die Supportanfragenummer in Azure Portalbenachrichtigungen. Sie werden in Kürze wegen Ihrer Anforderung kontaktiert.

Sie erhalten eine Bestätigungs-E-Mail, die Ihre Anwendungs-ID enthält. Überprüfen Sie Ihren Spamordner, wenn Sie die Bestätigungs-E-Mail nicht erhalten. Stellen Sie sicher, dass Sie eine Nachverfolgungskommunikation zu Ihrem Fall erhalten können.