Azure 語音的配額和限制

本文包含快速參考資料及 Foundry 工具中 Azure 語音配額與限制的詳細說明。 此資訊適用於 Azure Speech 的所有 定價層級。 本文也包含一些避免請求速率限制的最佳做法。

關於免費(F0)價格層級,請參閱 價格頁面上的每月津貼。

配額與限制參考

以下章節將快速說明適用於 Azure 語音的配額與限制。

關於標準(S0)Azure語音資源的可調整配額資訊,請參閱本文後面的更多解釋最佳實踐,以及調整指示。 免費(F0)Azure Speech 資源的配額和限制是無法調整的。

重要

如果你將 Foundry 的 Azure Speech 資源從免費(F0)價格層級切換到標準(S0),相應的配額變更可能需要數小時。

Voice Live 資源配額與限制

下表總結了 Azure 語音資源中各 Voice Live 的配額和限制。 關於可調整配額的資訊,請參閱本文後面 的更多說明

配額 免費 (F0) 標準 (S0)
每分鐘的新連線數 不適用 30
最大連線長度 不適用 <= 每次 60 分鐘
每分鐘令牌數 不適用 <= 120,000

Voice Live 中使用的虛擬化身遵循本文後面即時 文字轉語音化身 所描述的配額與限制。

LLM 語音配額與資源限制

下表總結了 Azure 語音資源中大型語言模型(LLM)語音的配額與限制。 目前這些限制是無法調整的。

配額 免費 (F0) 標準 (S0)
音訊輸入檔案大小上限 不適用 < 500 MB
音訊長度上限 不適用 < 每個檔案需5小時
每分鐘要求數上限 不適用 600

語音轉文字配額與資源限制

以下章節說明 Azure 語音資源的語音轉文字配額與限制。 關於可調配額的資訊,請參閱本文 中更多說明

即時語音轉換文字及語音翻譯

你可以使用語音轉文字 SDKREST API 來實現短音頻的即時語音轉文字。

這些限制適用於同時進行的即時語音轉文字請求與語音翻譯請求 的合併。 例如,如果你有 60 個同時語音轉文字請求和 40 個同時語音翻譯請求,你就達到 100 個同時請求的上限。

配額 免費 (F0) 標準 (S0)
基底模型端點的並行請求上限 1

此限制無法調整。
100 (預設值)

可調整標準 (S0) 資源的速率。 更多 說明最佳實務調整指引 請見本文後面。
自訂端點的並行請求限制 1

此限制無法調整。
100 (預設值)

可調整標準 (S0) 資源的速率。 更多 說明最佳實務調整指引 請見本文後面。
即時說話者分離的最長音訊長度 不適用 每次240分鐘

快速轉錄

配額 免費 (F0) 標準 (S0)
音訊輸入檔案大小上限 不適用 < 500 MB
音訊長度上限 不適用 < 每個檔案需5小時
每分鐘要求數上限 不適用 600

批次轉譯

以下限制無法調整。 欲了解更多批次轉錄延遲的資訊,請參閱 提升效能的最佳實務

配額 免費 (F0) 標準 (S0)
語音轉文字 REST API 限制 F0 無法使用 每 10 秒 100 個要求 (每分鐘 600 個要求)
音訊輸入的最大檔案大小 不適用 1 GB
每個容器的最大 Blob 數量 不適用 10,000
每次轉錄請求最多檔案數量(當你使用多個內容網址作為輸入時) 不適用 1,000
啟用日記化轉錄的最大音訊長度 不適用 每個檔案 240 分鐘

模型自訂

此表中的限制適用於建立自訂語音模型時的每一個 Azure 語音資源。

配額 免費 (F0) 標準 (S0)
REST API 限制 每 10 秒 100 個要求 (每分鐘 600 個要求) 每 10 秒 100 個要求 (每分鐘 600 個要求)
每個 Azure Speech 資源的最大自訂模型部署數量 1 50
語音資料集的最大數量 2 500
聲學資料集用於資料匯入的最大檔案大小 2 GB 2 GB
用於資料匯入的語言資料集最大檔案大小 200 MB 1.5 GB
資料匯入時發音資料集的最大檔案大小 1 KB 1 MB
text API 請求中使用參數時,最大文字大小 200 KB 500 KB

每資源的文字轉語音配額與限制

以下章節將說明 Azure 語音資源下的文字轉語音配額與限制。 關於可調整配額的資訊,請參閱本文後面 的更多說明

即時文字轉換語音

你可以用語音 SDK文字轉語音 REST API 使用即時文字轉語音。 除非另有指定,否則限制無法調整。

配額 免費 (F0) 標準 (S0)
標準語音與自訂語音的每時間段最大交易數 每 60 秒 20 筆交易

此限制無法調整。
每秒 30 筆交易(TPS)(預設值)

標準(S0)資源的費率可調整至最高1,000 TPS。 更多 說明最佳實務調整指引 請見本文後面。
每個請求產生的最大音訊長度 10 分鐘 10 分鐘
SSML 中不同的 <voice><audio> 標籤的最大總數 50 50
WebSocket 每回合最大 SSML 訊息大小 64 KB 64 KB

附註

大多數 HTTP 429 在文字轉語音標準語音中出現錯誤,是由於所選區域內特定語音的後端服務容量有限,而非配額限制所致。 增加配額並不能解決這些錯誤。 為獲得最佳效果,請在其原生區域使用該語音,或選擇您目前區域中更廣泛使用的語音。

批次合成

以下限制無法調整。 欲了解更多批次合成延遲資訊,請參閱批 次合成延遲與最佳實務

配額 免費 (F0) 標準 (S0)
REST API 限制 F0 無法使用 每 10 秒 100 個要求
建立合成任務的最大 JSON 資料量上限 不適用 2 MB
並行作用中合成作業 不適用 無限制
每個合成作業的最大文字輸入數 不適用 10,000
合成作業進入最終狀態後的最大存活時間 不適用 最多31天(由屬性指定)

客製化專業語音

建立專業語音時,此資料表中的限制會依每個 Azure 語音資源套用。

配額 免費 (F0) 標準 (S0)
每秒最大交易數 F0 無法使用 30 TPS(預設值)
最大資料集數量 不適用 500
同時上傳資料集的最大數量 不適用 5
每個資料集匯入資料的最大檔案大小 不適用 2 GB
上傳長音訊或不含指令碼的音訊 不適用 是的
最大同時進行模型訓練的數量 不適用 4
自訂端點的最大數量 不適用 50

自訂個人聲音

建立個人語音時,此資料表中的限制會依每個 Azure 語音資源套用。

配額 免費 (F0) 標準 (S0)
REST API 限制 (不包括語音合成) F0 無法使用 每 10 秒 50 個要求
語音合成每秒最大交易數 F0 無法使用 30 TPS(預設值)

批次文字轉語音虛擬人物

配額 免費 (F0) 標準 (S0)
REST API 限制 F0 無法使用 每分鐘2次請求

即時文字轉語音虛擬角色

配額 免費 (F0) 標準 (S0)
每分鐘的新連線數 F0 無法使用 每分鐘新增 2 個連線
說話時的最大連線時間 F0 無法使用 30 分鐘1
閒置狀態下的最大連線時間 F0 無法使用 5 分鐘

1 若要確保即時虛擬人偶的持續作業超過 30 分鐘,您可以啟用自動重新連線。 關於如何設定自動重新連線的資訊,請參考此範例代碼。 搜尋 自動重新連線

音訊內容建立工具

配額 免費 (F0) 標準 (S0)
檔案大小 (SSML 中的純文字)1 每個檔案 3,000 個字元 每個檔案 20,000 個字元
檔案大小 (語彙檔案)2 每個檔案 30 KB 每個檔案 100 KB
SSML 中的可計費字元 每個檔案 15,000 個字元 每個檔案 100,000 個字元
匯出至音訊庫 1 個並行工作 不適用

1 限制僅適用於 SSML 中的純文字,不包含標籤。

2 詞彙檔案的字元不收費。 只有 SSML 中的語彙元素會計入可計費字元。 若要深入了解,請參閱可計費字元

詳細說明、配額調整和最佳做法

有些 Azure 語音配額是可調整的。 本節提供更多說明、最佳做法和調整指示。

以下是可調整的標準 (S0) 資源配額。 免費(F0)請求限制無法調整。

在申請增加配額(如適用)之前,請檢查你目前的交易次數(TPS)或代幣數量(TPM),並確保是否需要增加配額。

附註

批次轉錄與批次合成是非同步過程。 系統會在佇列中逐一處理作業。 所以,增加配額並不會提升轉錄效能。 關於效能改進,請參閱 提升效能的最佳實務批次合成延遲和最佳實務

Azure Speech 採用自動擴展技術,將所需的計算資源提供到按需模式。 同時,Azure Speech 嘗試透過不維持過多硬體容量來降低成本。

讓我們看看下列範例。 假設您的應用程式收到回應碼 429,則表示要求太多。 即使你的工作量在先前配 額與限制參考 中定義的限制內,你的應用程式仍會收到此回應。 最可能的原因是 Azure Speech 正在擴展到你的需求,但還沒達到所需的規模。 所以 Azure Speech 目前沒有足夠的資源來處理這個請求。 在這種情況下,增加配額並無幫助。 大多數情況下,Azure Speech 很快就會擴展,解決導致回應代碼 429 的問題。

作為最佳實務,每個實作都應優雅地處理 429 錯誤,並搭配重試邏輯,以確保最佳效能並支援自動擴展。 在申請額外配額前,請考慮實施此最佳實務,詳情見下一節。

在自動調整期間降低節流的一般最佳做法

若要盡量減少與節流相關問題,最好使用下列技術:

  • 在你的應用程式中實作重試邏輯來處理 429 錯誤。

  • 避免工作負載急遽變化。 逐漸增加工作負載。

    例如,假設應用程式使用的是文字轉換語音,而您目前的工作負載是 5 TPS。 在下一秒,您將負載增加到 20 TPS (也就是超過四倍)。 Azure Speech 會立刻開始擴展以滿足新負載,但無法在一秒內按需擴展。 有些要求會收到回應碼 429 (太多要求)。

  • 測試不同的負載增加模式。 想了解更多資訊,請參閱本文中的 工作負載模式範例

  • different區域創造更多Azure語音資源,並將工作量分配給這些區域。 在同一區域建立多個 Azure Speech 資源不會影響效能,因為同一個後端叢集會服務所有資源。

後面章節描述調整配額的具體案例。

工作負載模式最佳實務範例

以下是採用良好方法的一般範例。 這只是一個範本,實際使用時可以視需要調整。

假設一個 Azure 語音資源的並行請求限制設為 300。 從 20 個同時連線開始工作負載,每 90 到 120 秒增加 20 個並行連線。 控制 Azure 語音回應,並實作當請求過多時(回應代碼 429)時回退(減少負載)的邏輯。 然後,一分鐘後再試一次負載增加。 如果還是不行,兩分鐘後再試一次。 請採用間隔時間 1-2-4-4 分鐘的模式。

一般來說,在進入生產環境前,先測試工作負載和工作模式是個好主意。

Voice Live:提高即時語音轉文字同時請求的上限

備妥所需的資訊

關於如何取得所需一般資源資訊的指引,請參閱本文後面的 「建立並提交配額增加請求 」。

附註

每分鐘令牌數(TPM)限制取決於每分鐘新增連線數(NCPM)限制。 當NCPM限制增加時,它會自動增加。

公式為:TPM = NCPM * 4,000 代幣。 例如:30 NCPM * 4,000 代幣 = 120,000 TPM。

建立配額增加請求

要用收集到的資訊建立申請,請依照本文後面「 建立並提交配額增加申請 」的步驟操作。

語音轉文字:提高即時語音轉文字同時請求的上限

預設情況下,同時進行的即時語音轉文字與語音翻譯 請求 總數限制為:

  • 在基礎模型中,每種資源 100 個。
  • 在自訂模型中,每個自訂端點最多可有 100 個。

在標準價格層級中,您可以提高此金額。 在提交申請前,請確保你熟悉本文前述的內容,例如減少限速的最佳實務。

基底和自訂模型的並行要求限制需要分別進行調整。 Azure 語音資源可以與許多承載多種自訂模型部署的自訂端點綁定。 你必須在每個自訂端點分別申請任何限制調整。

增加並行要求限制不會直接影響您的成本。 Azure Speech 採用付費模式,要求你只支付你所使用的部分。 此限制定義 Azure 語音在開始節流要求之前可擴展到多高。

你在 Azure 入口網站、命令列工具或 API 請求中,都看不到並行請求限制參數的現有值。 要驗證現有值,請建立 Azure 支援 請求。

附註

Azure語音容器不需要增加並行請求限制,因為容器只受其所在硬體的 CPU 限制。 但 Azure 語音容器也有其容量限制,你應該考慮。 更多資訊請參閱「 使用 Docker 安裝並執行語音容器」。

備妥所需的資訊

關於如何取得所需一般資源資訊的指引,請參閱本文後面的 「建立並提交配額增加請求 」。

若要建立自訂語音的提高限制要求,您也需要提供自訂端點 ID。 要取得自訂語音端點的這些資訊:

  1. 前往 Speech Studio 入口網站。
  2. 必要時登入,然後進入 自訂語音
  3. 選擇你的專案,然後進入 部署
  4. 選取所需的端點。
  5. 複製並儲存端 點 ID 值。

建立配額增加請求

要用收集到的資訊建立申請,請依照本文後面「 建立並提交配額增加申請 」的步驟操作。

快速轉寫:提高每分鐘的最大請求數量

備妥所需的資訊

關於如何取得所需一般資源資訊的指引,請參閱本文後面的 「建立並提交配額增加請求 」。

要建立快速轉錄的增益請求,你也需要提供 每個 API 請求的平均音訊長度

範例長度為 5 minutes/request。 根據你想處理的工作量,提供一個估算。

建立配額增加請求

要用收集到的資訊建立申請,請依照本文後面「 建立並提交配額增加申請 」的步驟操作。

文字轉語音:提高即時 TPS 限制

在標準定價層級,你可以提高即時 TPS 限制。 在提交申請前,請確保你熟悉本文前述的內容,例如減少限速的最佳實務。

估算你的需求

  • 每月使用量低於 $10,000:通常預設的 30 TPS 上限已足夠,前提是你的高峰使用量在平均值的 10 倍以內。
範例案例

舉例來說,假設你正在建立一個客服中心,其中有:

  • 同時通話次數為1,000通。
  • 您預期 Agent 有一半的時間會說話。
  • 平均 TTS 回應長度為 5 秒。

所需的 TPS 為:1,000 通話 / (2×5 秒)= 100 TPS。

TPS調漲申請需要以下細節:

  • TPS峰值
  • 平均 TPS
  • 平均 TTS 請求長度(以字元計)

根據這些資料,你可以用以下公式估算每月 TTS 使用量:每月使用 = 平均 TPS ×請求長度 × 3600 × 24 × 30。

將結果乘以每百萬字元15美元的單位價格,以估算每月成本。

附註

如果你預估的用電量遠超過預算,你可能高估了需求。

成本考量

增加並行請求 限制不會直接 影響您的成本。 您只需為您使用的部分付費。 限制主要是定義了 Azure Speech 在開始限流前可以擴展的範圍。

你在 Azure 入口網站、命令列工具或 API 請求中,都看不到並行請求限制參數的現有值。 要驗證現有值,請建立 Azure 支援 請求。

附註

Azure語音容器不需要增加並行請求限制,因為容器只受其所在硬體的 CPU 限制。

備妥所需的資訊

關於如何取得所需一般資源資訊的指引,請參閱本文後面的 「建立並提交配額增加請求 」。

要為標準語音類型建立增加請求,你還需要提供 你要增加的語音名稱。 你可以在 Language and voice support for Azure Speech 中找到所有語音名稱清單。

要建立自訂語音的增加請求,你需要提供 自訂端點 ID。 如需取得自訂語音的相關資訊:

  1. 前往 Speech Studio 入口網站。
  2. 必要時登入,然後切換到 自訂語音
  3. 選擇你的專案,然後進入 部署模型
  4. 選取所需的端點。
  5. 複製並儲存端 點 ID 值。

建立配額增加請求

要用收集到的資訊建立申請,請依照本文後面「 建立並提交配額增加申請 」的步驟操作。

文字轉語音頭像:增加新連結的上限

備妥所需的資訊

關於如何取得所需一般資源資訊的指引,請參閱本文後面的 「建立並提交配額增加請求 」。

若要建立自訂語音的提高限制要求,您也需要提供標準虛擬人偶或自訂虛擬人偶

建立配額增加請求

要用收集到的資訊建立申請,請依下一節步驟「 建立並提交配額增加申請」。

建立並提交配額提升申請

要取得配額增加申請所需的資源資訊,請遵循以下步驟:

  1. 前往Azure入口

  2. 選擇你想提高並發請求上限的資源。

  3. 資源管理 群組中,選擇 屬性

  4. 複製並儲存以下欄位的數值:

    • 訂用帳戶識別碼
    • 資源識別碼
    • 位置 (您的端點區域)

請提交支援要求,以啟動提高資源並行要求限制的作業。 你也可以用客服請求查詢目前的使用上限。 要提交支援請求:

  1. 確保你擁有前幾節所列的必要資訊。

  2. 前往 Foundry 工具配額增加要求表。

  3. 提供請求人資料:

    1. 名字
    2. 姓氏
    3. 您的工作或組織電子郵件地址

      附註

      使用個人電子郵件地址提交的申請(例如 hotmail.com、outlook.com 或 gmail.com)不被接受。

    4. 公司名稱或組織名稱

      附註

      你只能代表自己組織申請增加配額。

  4. 提供資源資訊:

    1. Azure 訂閱 ID
    2. Foundry Tools 資源識別碼
    3. 鑄造工具資源區域
  5. 提供所要求的配額增加:

    1. 新配額上限申請(僅整數;例如 300、500 或 1,000)
    2. 提高限額的商業理由
  6. 選擇 Foundry 工具產品 Azure Speech,然後選擇 Next

  7. 選擇你申請提升的 Azure 語音功能。 選項包括:

    • 基礎模型端點的語音轉文字並行請求限制
    • 自訂端點的語音轉文字同時請求限制
    • 快速轉錄的每分鐘最大請求數
    • 標準語音在每個時間期間內的文字轉換語音最大交易數
    • 自訂語音在每個時間期間內的文字轉換語音最大交易數
    • 語音翻譯的並行要求限制
    • 批次文字轉語音化身的每分鐘最大請求數
    • 即時文字轉換語音虛擬人偶每分鐘的新連線數
    • Voice Live API 每分鐘權杖
  8. 在表單中新增所需的功能專屬資訊,然後選擇 「下一步」。

  9. 在最後一頁,提供額外的聯絡資訊,包括你帳戶的詳細資料或伴侶的聯絡姓名和電子郵件地址。

  10. 請檢查兩個確認問題,然後選擇 提交

  11. 請注意 Azure 入口網站通知中的支援請求編號。 系統很快就會根據您的要求與您聯絡。

您會收到包含申請編號的確認電子郵件。 如果你沒收到確認郵件,請檢查你的垃圾郵件夾。 確保你能收到案件的後續聯繫。