Omówienie warstwy AI Gateway (wersja zapoznawcza)

DOTYCZY: warstwa AI Gateway (wersja zapoznawcza)

Important

Warstwa AI Gateway jest obecnie dostępna w publicznej wersji zapoznawczej. Podczas publicznej wersji zapoznawczej warstwa AI Gateway jest dostępna w następujących regionach:

  • Stany Zjednoczone — Wschodnie stany USA 2
  • Europa - Szwecja Centralna

AI Gateway tier (preview) od Azure API Management to w pełni zarządzana brama dla obciążeń AI. Daje zespołom jedno miejsce do publikowania, zabezpieczania, zarządzania i obserwowania dostępu do modeli AI oraz narzędzi Model Context Protocol (MCP).

Warstwa AI Gateway jest obecnie dostępna w publicznej wersji zapoznawczej. Funkcje podglądowe, regiony, limity usług i API mogą się zmieniać przed ogólną dostępnością. Ceny i model biznesowy zostaną ogłoszone później w zapowiedzi.

Jaki jest poziom AI Gateway?

Warstwa AI Gateway to zarządzana brama dla aplikacji, które wywołują modele i narzędzia. Aplikacje wywołują punkt końcowy bramy, zamiast bezpośrednio wywoływać backend każdego dostawcy lub narzędzia. Dla każdego żądania brama wykonuje następujące czynności:

  1. Uwierzytelnia klucz dostępu środowiska uruchomieniowego w nagłówku api-key.
  2. Ocenia polityki odnoszące się do docelowego modelu lub narzędzia.
  3. Kieruje żądanie do wybranego backendu — na podstawie pola model w przypadku modeli lub nazwy narzędzia w przypadku narzędzi — przy użyciu skonfigurowanych przez Ciebie poświadczeń backendu.
  4. Zwraca odpowiedź i emituje telemetrię — logi OpenTelemetry oraz metryki, takie jak liczba tokenów i opóźnienia.

Dlaczego używać tej opcji

Poziom AI Gateway daje zespołom platformowym jedną uregulowaną granicę czasową dla aplikacji, modeli i narzędzi. Używaj go do:

  • Umieść jeden punkt końcowy bramy przed wspieranymi dostawcami AI.
  • Ukryj poświadczenia dostawcy przed aplikacjami.
  • Zarządzaj modelami, serwerami MCP, kluczami dostępu w czasie rzeczywistym, politykami i monitorowaniem.
  • Stosuj mechanizmy zarządzania, takie jak limity prędkości tokenów, limity liczby żądań, bezpieczeństwo treści oraz filtry IP.
  • Publikuj zatwierdzone narzędzia MCP dla agentów AI.
  • Odkrywaj i korzystaj z dostępnych modeli oraz narzędzi poprzez katalog samoobsługowy.
  • Zaloguj się, aby zarządzać bramą za pomocą Microsoft Entra ID.

Wybierz ścieżkę

Szybki start

Dopiero zaczynasz korzystać z planu AI Gateway? Stwórz bramę, dodaj model i wykonaj pierwsze połączenie w około 20–30 minut.

Zarządzanie modelami i narzędziami

Dodaj modele Foundry oraz modele niestandardowe i udostępniaj serwery narzędzi MCP za pośrednictwem jednego zarządzanego punktu końcowego.

Rządzić, zabezpieczać i działać

Stosuj polityki, identyfikację, sieci i monitoring, aby działać w produkcji.

Kluczowe pojęcia

Gateway

Brama sieciowa stanowi granicę środowiska uruchomieniowego i zarządzania dla ruchu AI. To dedykowany zasób Azure, który można skonfigurować w około minutę, bez planowania jednostek skalowych. Aplikacje łączą się z jednym punktem końcowym bramy przy użyciu klucza dostępu używanego w czasie wykonywania, zamiast bezpośrednio łączyć się z zapleczami poszczególnych dostawców lub narzędzi. Zarządzasz modelami, narzędziami, politykami, kluczami i tożsamością w jednym miejscu.

Diagram aplikacji, agentów i agentów kodujących wywołujących warstwę AI Gateway, która uwierzytelnia klucz wykonawczy, stosuje polityki i emituje telemetrię przed kierowaniem żądań do dostawców modeli i backendów narzędzi MCP.

Modele

Model to model dostawcy, który publikujesz za pośrednictwem bramy. Aplikacje wybierają je po nazwie w polu model żądania. Wszyscy dostawcy kompatybilni z OpenAI (Microsoft Foundry, Azure OpenAI, AWS Bedrock, Google Vertex i OpenAI) dzielą jeden punkt końcowy. .../models/openai/v1 Brama kieruje ruch na podstawie dokładnego dopasowania do model, więc nadaj każdemu modelowi unikalną nazwę. Anthropic korzysta z niestandardowego dostawcy z bezpośrednim przekazywaniem do interfejsu Messages API pod adresem .../models/anthropic/v1/messages. Brama przechowuje dane uwierzytelniające backendowe, więc aplikacje nigdy nie obsługują kluczy dostawcy.

Serwery i narzędzia MCP

Serwer MCP to jeden z zarządzanych punktów końcowych (.../toolservers/<server-name>/mcp), który agenci wywołują, aby uzyskać dostęp do narzędzi. Federuje jeden lub więcej backendów z trzech źródeł: zdalnego serwera MCP (według URL), specyfikacji OpenAPI lub wbudowanego łącznika (ponad 1000 aplikacji SaaS, bez serwera do hostowania). Operacje każdego zaplecza stają się narzędziami. Wybierasz, jak brama uwierzytelnia się do każdego backendu: brak, klucz API, OAuth 2.0 lub tożsamość zarządzana.

Polityki

Polityka to zabezpieczenie w czasie działania, które konfigurujesz w postaci karty w portalu – bez XML.

Policy Co kontroluje
Bezpieczeństwo zawartości Sprawdzanie bezpieczeństwa poleceń i odpowiedzi.
Filtr IP Wywołania wykonywane z zatwierdzonych zakresów sieci klienta.
Limit szybkości tokenu Przepustowość tokenów w ujęciu minutowym kroczącym.
Limit liczby żądań Liczba żądań w ruchomym oknie minutowym.

Klucze tożsamości i dostępu

Administratorzy logują się, aby zarządzać bramą, korzystając z Microsoft Entra ID. Aplikacje uwierzytelniają się za pomocą kluczy dostępu w czasie rzeczywistym – utwórz te klucze na stronie Klucze portalu (Stwórz klucz API) i wysyłaj je w nagłówku api-key . Klucz działa na poziomie bramy: zapewnia dostęp do każdego modelu i narzędzia. W przypadku backendów brama używa tożsamości zarządzanej, jeśli jest dostępna (dzięki czemu nie są przechowywane żadne wpisy tajne), albo klucza dostępu dostawcy, który podajesz. Wydawaj jeden klucz dla każdej aplikacji i środowiska oraz przyznaj każdej tożsamości najmniejsze uprawnienia.

Katalog samoobsługowy

Deweloperzy znajdują modele i narzędzia w katalogu samoobsługowym — każde z informacjami o połączeniu i przykładami — przypinają ulubione pozycje i mogą przejść w dowolne miejsce za pomocą palety poleceń Ctrl+K (⌘K na macOS).

Dostępność regionalna

W publicznej wersji zapoznawczej warstwa AI Gateway jest dostępna w następujących regionach platformy Azure.

Geografia Region
Stany Zjednoczone Wschodnie stany USA 2
Europa Szwecja Środkowa

Dostępność regionu może się różnić w zależności od subskrypcji, chmury, pojemności, flagi funkcji oraz rejestracji podglądowej. Jeśli Twój docelowy region nie jest dostępny w portalu lub narzędziach wdrożeniowych, wybierz inny obsługiwany region podglądowy lub skontaktuj się ze swoim przedstawicielem Microsoft.

Wybierz region, który najlepiej odpowiada Twoim użytkownikom, aplikacjom, backendom AI i zależnościom sieciowym. Jeśli brama kieruje się do Azure OpenAI, Microsoft Foundry, modelowych endpointów, API lub serwerów MCP, rozważ także te lokalizacje. Rezydencja danych zależy od pełnej ścieżki żądań, nie tylko od regionu bramy. Przeanalizuj, gdzie każdy komponent jest wdrożony, w tym bramę, backendy AI, narzędzia, miejsca logowania, zarządzane tożsamości oraz aplikacje klienckie.

Często zadawane pytania

Kiedy powinienem używać poziomu AI Gateway zamiast dzwonić bezpośrednio do dostawców?

Korzystaj z poziomu AI Gateway, gdy chcesz mieć jeden zarządzany punkt końcowy przed wieloma modelami i narzędziami: centralne klucze uruchomieniowe zamiast poświadczeń dostawców w każdej aplikacji, wspólne polityki (limity tokenów i żądań, bezpieczeństwo treści, filtry IP), zunifikowana telemetria oraz katalog samoobsługowy. Jeśli wywołujesz pojedynczy model z jednej aplikacji i nie potrzebujesz zarządzania ani centralnych poświadczeń, bezpośrednie połączenie dostawcy może być prostsze.

Czy powinienem zaimportować z Foundry, czy dodać własny model?

Importuj z Foundry, gdy Twój model działa w zasobach Microsoft Foundry lub Azure OpenAI (Azure AI Services); kreator wykrywa wdrożenia tego zasobu za Ciebie. Dodaj niestandardowy model dla AWS Bedrock, Google Vertex, OpenAI, Anthropic lub dowolnego innego punktu końcowego zgodnego z OpenAI, w którym samodzielnie podajesz nazwę punktu końcowego i modelu. Zobacz Zarządzaj modelami i narzędziami.

Czy warstwa AI Gateway jest gotowa do użycia produkcyjnego?

Warstwa AI Gateway jest dostępna w publicznej wersji zapoznawczej: dostępność jest zapewniana w modelu best effort, bez umowy SLA, a interfejsy API, przepływy pracy portalu, telemetria, limity, regiony i ceny mogą ulec zmianie. Limity podglądu mogą ograniczyć liczbę modeli, narzędzi i kluczy dostępu w czasie rzeczywistym oraz przepustowość żądań i tokenów; Szczegółowe limity zostaną opublikowane przed ogólną dostępnością. Zacznij od niekrytycznych obciążeń, kontrolowanych pilotaży i jasnych planów wycofania.

Jak wygląda naliczanie opłat w okresie wersji zapoznawczej?

Ceny i model rozliczeń dla warstwy AI Gateway zostaną ogłoszone w późniejszym etapie wersji zapoznawczej. Możesz także ponosić opłaty za powiązane zasoby używane z bramą, takie jak dostawcy modeli, Application Insights, usługi sieciowe i platformy monitorowania.

Jakie regiony są dostępne?

Poziom AI Gateway jest dostępny w East US 2 i Sweden Central. Zobacz Dostępność regionalna.

Jak są obsługiwane moje dane?

Ty wybierasz, gdzie trafia telemetria. Dzięki Application Insights pozostaje w Twojej subskrypcji Azure. Inne miejsca docelowe OpenTelemetry (OTLP) podlegają Twojej konfiguracji i warunkom dostawcy. Telemetria wykorzystuje konwencje semantyczne GenAI OpenTelemetry (prefiks gen_ai.* ). Lokalizacja danych zależy od całej ścieżki żądania, dlatego umieszczaj bramę, backendy i miejsca docelowe danych telemetrycznych w zatwierdzonych regionach oraz włącz w to zespoły ds. bezpieczeństwa i ochrony prywatności.

Czy poziom AI Gateway obsługuje sieci prywatne?

Yes. Przychodzący Private Link i wychodząca integracja z siecią wirtualną są częścią publicznej wersji zapoznawczej. Zobacz Konfiguruj sieć prywatną dla konfiguracji, DNS i ograniczeń.

Jakiej wersji API powinienem użyć do automatyzacji?

Użyj API zarządzania podglądem w wersji 2026-05-01-preview. Zweryfikuj automatyzację przed szerokim wdrożeniem, ponieważ interfejs API jest w wersji zapoznawczej.