Japan Eastでgpt-5などReasoningモデルでweb_search_previewを使用すると、ストリームの完了処理が遅くなる

津﨑 友一郎 5 評価のポイント
2026-02-14T10:27:09.6033333+00:00

Japan Eastでgpt-5などReasoningモデルでweb_search_previewを使用すると、ストリームの完了処理が遅くなる事象に出くわしました。

web検索と生成AIによるテキストの回答は問題なく進みますが、最後の最後で、終了処理が実行されずに数十秒待つ必要がある状態です。

他のリージョンですが、EastUS2では再現しませんでした。

リージョンに違いがあるように感じられました。

Foundry モデルの Azure OpenAI
Foundry モデルの Azure OpenAI

エンタープライズ機能を備えた OpenAI の GPT-3 モデルへのアクセスを提供する Azure サービス。


1 件の回答

並べ替え方法: 最も役に立つ
  1. Manas M 17,270 評価のポイント モデレーター
    2026-02-17T17:00:47.6566667+00:00

    Hi 津﨑 友一郎

    Could you share your observation in East US and Japan East. As per my trials, Japan East looked bit slower but looks Ok to operate (27 second in Japan East 3334 token, 20 second 2755 token in East US)

    Considering the fact, we are using GPT 5 reasoning models, with streaming response, response time look reasonable to me as per last experience with product group on this.

    Confirmed with product group.

    If you have any counter observation with respect to prompt size and TPM configuration. Please share the details requested via private message.

    Thank you for using Azure Services.

    この回答は役に立ちましたか?


お客様の回答

質問作成者は回答に "承認済み"、モデレーターは "おすすめ" とマークできます。これにより、ユーザーは作成者の問題が回答によって解決したことを把握できます。