Overzicht van de AI Gateway-laag (previewversie)

VAN TOEPASSING OP: AI Gateway-tier (preview)

Important

De AI Gateway-tier bevindt zich momenteel in publieke preview. Tijdens de publieke preview is het AI Gateway-niveau beschikbaar in de volgende regio's:

  • Verenigde Staten - East US 2
  • Europa - Zweden Centraal

AI Gateway tier (preview) van Azure API Management is een volledig beheerde gateway voor AI-workloads. Het geeft teams één plek om AI-modellen en Model Context Protocol (MCP)-tools te publiceren, te beveiligen, te beheren en toegang te observeren.

Het AI Gateway-niveau is in openbare previewversie. Previewfuncties, regio's, servicelimieten en API's kunnen wijzigen voordat ze algemeen beschikbaar zijn. Prijzen en het businessmodel worden later in de preview bekendgemaakt.

Wat is het AI Gateway-niveau?

AI Gateway-laag is een beheerde gateway voor applicaties die modellen en tools oproepen. Applicaties roepen een gateway-endpoint aan in plaats van elke provider of tool backend direct aan te roepen. Voor elk verzoek voert de gateway het volgende uit:

  1. Verifieert de runtime-toegangssleutel in de api-key header.
  2. Evalueert de beleidsregels die van toepassing zijn op het doelmodel of -tool.
  3. Routeert het verzoek naar de geselecteerde backend - via het model veld voor modellen, of de toolnaam van tools - met de backend-credentials die je hebt ingesteld.
  4. Geeft het antwoord terug en genereert telemetrie — OpenTelemetry-logs en meetgegevens zoals aantallen tokens en latentie.

Redenen om dit te gebruiken

De AI Gateway-laag geeft platformteams één beheerde runtime-grens voor apps, modellen en tools. Gebruik deze voor het volgende:

  • Zet één gateway-endpoint voor de ondersteunde AI-providers.
  • Houd de inloggegevens van de aanbieder verborgen voor applicaties.
  • Beheer modellen, MCP-servers, runtime toegangssleutels, beleidsregels en monitoring.
  • Pas governance-controles toe zoals tokenrate-limieten, request rate-limieten, contentveiligheid en IP-filters.
  • Publiceer goedgekeurde MCP-tools voor AI-agenten.
  • Ontdek en gebruik beschikbare modellen en tools via een zelfbedieningscatalogus.
  • Log in om de gateway te beheren met Microsoft Entra ID.

Kies uw pad

Quickstart

Nieuw met de AI Gateway-tier? Maak een gateway, voeg een model toe en bel je eerste oproep over ongeveer 20–30 minuten.

Beheer modellen en tools

Voeg Foundry- en custom modellen toe, en publiceer MCP-toolservers achter één beheerd eindpunt.

Besturen, beveiligen en opereren

Pas beleid, identiteit, netwerk en bewaking toe voor gebruik in productie.

Sleutelbegrippen

Gateway

Een gateway is de runtime- en beheergrens voor AI-verkeer. Het is een specifieke Azure-resource die je in ongeveer een minuut kunt provisioneren, zonder dat je schaaleenheden hoeft te plannen. Applicaties roepen één gateway-endpoint aan met een runtime-toegangssleutel in plaats van elke provider of tool-backend direct aan te roepen. Je beheert de modellen, tools, beleidslijnen, sleutels en identiteit ervan op één plek.

Diagram van applicaties, agents en codeeragenten die de AI Gateway-laag aanroepen, die de runtime-sleutel authenticeert, beleidsregels toepast en telemetrie uitzendt voordat verzoeken worden doorgestuurd naar modelproviders en MCP-tool-backends.

Modellen

Een model is het model van een aanbieder dat je via de gateway publiceert. Applicaties selecteren het op naam in het model veld van het verzoek. Alle OpenAI-compatibele providers (Microsoft Foundry, Azure OpenAI, AWS Bedrock, Google Vertex en OpenAI) delen één endpoint. .../models/openai/v1 De gateway routeert op basis van een exacte overeenkomst met model, dus geef elk model een unieke naam. Anthropic gebruikt een aangepaste provider met een Messages API passthrough op .../models/anthropic/v1/messages. De gateway bevat backend-inloggegevens, dus applicaties verwerken nooit providersleutels.

MCP-servers en hulpmiddelen

Een MCP-server is een bestuurd eindpunt (.../toolservers/<server-name>/mcp) dat agenten aanroepen om tools te bereiken. Het federeert één of meer backends van drie bronnen: een externe MCP-server (via URL), een OpenAPI-specificatie, of een ingebouwde connector (meer dan 1.000 SaaS-apps, zonder server om te hosten). De operaties van elke backend worden hulpmiddelen. Je kiest hoe de gateway zich authenticeert naar elke backend: None, API Key, OAuth 2.0 of Managed identity.

Beleid

Een beleid is een runtime guardrail die je als kaart in het portaal configureert - geen XML.

Policy Wat het bestuurt
Inhoudsveiligheid Veiligheidscontroles voor prompts en reacties.
IP-filter Runtime-aanroepen vanuit goedgekeurde clientnetwerkbereiken.
Tokensnelheidslimiet Tokendoorvoer gedurende een rollende minuut.
Limiet voor aanvraagsnelheid Vraag volume aan tijdens een lopende minuut.

Identiteit en toegangssleutels

Beheerders loggen in om de gateway te beheren met behulp van Microsoft Entra ID. Applicaties authenticeren zich met runtime access keys - maak deze sleutels aan op de Keys-pagina van het portaal (Create API key) en stuur ze in de api-key header. Een sleutel is gateway-scoped: hij bereikt elk model en gereedschap. Voor backends gebruikt de gateway managed identity waar beschikbaar (zodat er geen geheimen worden opgeslagen) of een provider-sleutel die je aanlevert. Geef één sleutel per applicatie en omgeving uit, en verleen elke identiteit het minste privilege.

Zelfbedieningscatalogus

Ontwikkelaars ontdekken modellen en tools in een zelfbedieningscatalogus – elk met verbindingsdetails en voorbeelden – pinnen favorieten en springen ergens naartoe met het Ctrl+K (⌘K op macOS) commandopalet.

Regionale beschikbaarheid

Tijdens de publieke preview is de AI Gateway-laag beschikbaar in de volgende Azure-regio's.

Geografie Regio
Verenigde Staten Oostelijke Verenigde Staten 2
Europe Sweden Central

Beschikbaarheid van regio's kan variëren per abonnement, cloud, capaciteit, feature-vlag en preview-inschrijving. Als je doelregio niet beschikbaar is in het portaal of de implementatietools, kies dan een andere ondersteunde previewregio of neem contact op met je Microsoft-vertegenwoordiger.

Kies de regio die het beste past bij je gebruikers, applicaties, AI-backends en netwerkafhankelijkheden. Als de gateway naar Azure OpenAI, Microsoft Foundry, model-endpoints, API's of MCP-servers leidt, overweeg dan ook die locaties. De gegevensresidentie hangt af van het volledige aanvraagpad, niet alleen van de gateway-regio. Bekijk waar elke component is uitgerold, inclusief de gateway, AI-backends, tools, loggbestemmingen, beheerde identiteiten en clientapplicaties.

Veelgestelde vragen

Wanneer moet ik de AI Gateway-tier gebruiken in plaats van direct providers te bellen?

Gebruik de AI Gateway-laag wanneer je één beheerd eindpunt voor veel modellen en tools wilt hebben: centrale runtime-sleutels in plaats van provider-inloggegevens in elke applicatie, gedeelde beleidsregels (token- en verzoeklimieten, contentveiligheid, IP-filters), unified telemetriry en een selfservicecatalogus. Als je één model vanuit één applicatie aanroept en geen governance of centrale credentials nodig hebt, kan het direct bellen van de provider eenvoudiger zijn.

Moet ik importeren vanuit Foundry of een aangepast model toevoegen?

Importeer vanuit Foundry wanneer je model draait in een Microsoft Foundry of Azure OpenAI (Azure AI Services) resource; de wizard ontdekt de implementaties van de resource voor jou. Voeg een aangepast model toe voor AWS Bedrock, Google Vertex, OpenAI, Anthropic of een ander OpenAI-compatibel endpoint, waarbij je zelf de endpoint- en modelnamen invoert. Zie Beheren van modellen en tools.

Is het AI Gateway-niveau klaar voor productie?

De AI Gateway-laag is als openbare preview beschikbaar: de beschikbaarheid is naar beste vermogen, zonder service level agreement (SLA), en API's, werkstromen in de portal, telemetrie, limieten, regio's en de prijzen kunnen veranderen. Previewquota kunnen het aantal modellen, tools en runtime-toegangssleutels, evenals je request- en tokendoorvoer, beperken; Specifieke limieten zullen worden gepubliceerd voordat de algemene beschikbaarheid plaatsvindt. Begin met niet-kritieke werklasten, gecontroleerde piloten en duidelijke terugrolplannen.

Hoe wordt de prijsstelling tijdens de preview afgehandeld?

De prijsstelling en het businessmodel voor het AI Gateway-niveau worden later in de preview bekendgemaakt. Je kunt ook betalen voor gerelateerde bronnen die je met de gateway gebruikt, zoals modelproviders, Application Insights, netwerken en observabiliteitsplatforms.

Welke regio's zijn beschikbaar?

De AI Gateway-laag is beschikbaar in East US 2 en Sweden Central. Zie Regionale beschikbaarheid.

Hoe worden mijn gegevens verwerkt?

Jij kiest waar telemetrie naartoe gaat. Met Application Insights blijft het in je Azure-abonnement. Andere OpenTelemetry (OTLP) bestemmingen volgen uw configuratie en de voorwaarden van de provider. Telemetrie gebruikt OpenTelemetry GenAI semantische conventies (het gen_ai.* voorvoegsel). De gegevensresidentie hangt af van het volledige aanvraagpad, dus plaats de gateway, backends en telemetriebestemmingen in goedgekeurde regio's en betrek je beveiligings- en privacyteams.

Ondersteunt AI Gateway-niveau private netwerken?

Yes. Inbound Private Link en outbound virtual network-integratie maken deel uit van de publieke preview. Zie Configureer privénetwerk voor setup, DNS en beperkingen.

Welke API-versie moet ik gebruiken voor automatisering?

Gebruik de versie 2026-05-01-previewvan de preview management API. Valideer automatisering vóór een brede uitrol omdat de API in preview is.