Notitie
Voor toegang tot deze pagina is autorisatie vereist. U kunt proberen u aan te melden of de directory te wijzigen.
Voor toegang tot deze pagina is autorisatie vereist. U kunt proberen de mappen te wijzigen.
VAN TOEPASSING OP: AI Gateway-tier (preview)
Important
De AI Gateway-tier bevindt zich momenteel in publieke preview. Tijdens de publieke preview is het AI Gateway-niveau beschikbaar in de volgende regio's:
- Verenigde Staten - East US 2
- Europa - Zweden Centraal
AI Gateway tier (preview) van Azure API Management is een volledig beheerde gateway voor AI-workloads. Het geeft teams één plek om AI-modellen en Model Context Protocol (MCP)-tools te publiceren, te beveiligen, te beheren en toegang te observeren.
Het AI Gateway-niveau is in openbare previewversie. Previewfuncties, regio's, servicelimieten en API's kunnen wijzigen voordat ze algemeen beschikbaar zijn. Prijzen en het businessmodel worden later in de preview bekendgemaakt.
Wat is het AI Gateway-niveau?
AI Gateway-laag is een beheerde gateway voor applicaties die modellen en tools oproepen. Applicaties roepen een gateway-endpoint aan in plaats van elke provider of tool backend direct aan te roepen. Voor elk verzoek voert de gateway het volgende uit:
- Verifieert de runtime-toegangssleutel in de
api-keyheader. - Evalueert de beleidsregels die van toepassing zijn op het doelmodel of -tool.
- Routeert het verzoek naar de geselecteerde backend - via het
modelveld voor modellen, of de toolnaam van tools - met de backend-credentials die je hebt ingesteld. - Geeft het antwoord terug en genereert telemetrie — OpenTelemetry-logs en meetgegevens zoals aantallen tokens en latentie.
Redenen om dit te gebruiken
De AI Gateway-laag geeft platformteams één beheerde runtime-grens voor apps, modellen en tools. Gebruik deze voor het volgende:
- Zet één gateway-endpoint voor de ondersteunde AI-providers.
- Houd de inloggegevens van de aanbieder verborgen voor applicaties.
- Beheer modellen, MCP-servers, runtime toegangssleutels, beleidsregels en monitoring.
- Pas governance-controles toe zoals tokenrate-limieten, request rate-limieten, contentveiligheid en IP-filters.
- Publiceer goedgekeurde MCP-tools voor AI-agenten.
- Ontdek en gebruik beschikbare modellen en tools via een zelfbedieningscatalogus.
- Log in om de gateway te beheren met Microsoft Entra ID.
Kies uw pad
Nieuw met de AI Gateway-tier? Maak een gateway, voeg een model toe en bel je eerste oproep over ongeveer 20–30 minuten.
Voeg Foundry- en custom modellen toe, en publiceer MCP-toolservers achter één beheerd eindpunt.
Besturen, beveiligen en opereren
Pas beleid, identiteit, netwerk en bewaking toe voor gebruik in productie.
Sleutelbegrippen
Gateway
Een gateway is de runtime- en beheergrens voor AI-verkeer. Het is een specifieke Azure-resource die je in ongeveer een minuut kunt provisioneren, zonder dat je schaaleenheden hoeft te plannen. Applicaties roepen één gateway-endpoint aan met een runtime-toegangssleutel in plaats van elke provider of tool-backend direct aan te roepen. Je beheert de modellen, tools, beleidslijnen, sleutels en identiteit ervan op één plek.
Modellen
Een model is het model van een aanbieder dat je via de gateway publiceert. Applicaties selecteren het op naam in het model veld van het verzoek. Alle OpenAI-compatibele providers (Microsoft Foundry, Azure OpenAI, AWS Bedrock, Google Vertex en OpenAI) delen één endpoint. .../models/openai/v1 De gateway routeert op basis van een exacte overeenkomst met model, dus geef elk model een unieke naam. Anthropic gebruikt een aangepaste provider met een Messages API passthrough op .../models/anthropic/v1/messages. De gateway bevat backend-inloggegevens, dus applicaties verwerken nooit providersleutels.
MCP-servers en hulpmiddelen
Een MCP-server is een bestuurd eindpunt (.../toolservers/<server-name>/mcp) dat agenten aanroepen om tools te bereiken. Het federeert één of meer backends van drie bronnen: een externe MCP-server (via URL), een OpenAPI-specificatie, of een ingebouwde connector (meer dan 1.000 SaaS-apps, zonder server om te hosten). De operaties van elke backend worden hulpmiddelen. Je kiest hoe de gateway zich authenticeert naar elke backend: None, API Key, OAuth 2.0 of Managed identity.
Beleid
Een beleid is een runtime guardrail die je als kaart in het portaal configureert - geen XML.
| Policy | Wat het bestuurt |
|---|---|
| Inhoudsveiligheid | Veiligheidscontroles voor prompts en reacties. |
| IP-filter | Runtime-aanroepen vanuit goedgekeurde clientnetwerkbereiken. |
| Tokensnelheidslimiet | Tokendoorvoer gedurende een rollende minuut. |
| Limiet voor aanvraagsnelheid | Vraag volume aan tijdens een lopende minuut. |
Identiteit en toegangssleutels
Beheerders loggen in om de gateway te beheren met behulp van Microsoft Entra ID. Applicaties authenticeren zich met runtime access keys - maak deze sleutels aan op de Keys-pagina van het portaal (Create API key) en stuur ze in de api-key header. Een sleutel is gateway-scoped: hij bereikt elk model en gereedschap. Voor backends gebruikt de gateway managed identity waar beschikbaar (zodat er geen geheimen worden opgeslagen) of een provider-sleutel die je aanlevert. Geef één sleutel per applicatie en omgeving uit, en verleen elke identiteit het minste privilege.
Zelfbedieningscatalogus
Ontwikkelaars ontdekken modellen en tools in een zelfbedieningscatalogus – elk met verbindingsdetails en voorbeelden – pinnen favorieten en springen ergens naartoe met het Ctrl+K (⌘K op macOS) commandopalet.
Regionale beschikbaarheid
Tijdens de publieke preview is de AI Gateway-laag beschikbaar in de volgende Azure-regio's.
| Geografie | Regio |
|---|---|
| Verenigde Staten | Oostelijke Verenigde Staten 2 |
| Europe | Sweden Central |
Beschikbaarheid van regio's kan variëren per abonnement, cloud, capaciteit, feature-vlag en preview-inschrijving. Als je doelregio niet beschikbaar is in het portaal of de implementatietools, kies dan een andere ondersteunde previewregio of neem contact op met je Microsoft-vertegenwoordiger.
Kies de regio die het beste past bij je gebruikers, applicaties, AI-backends en netwerkafhankelijkheden. Als de gateway naar Azure OpenAI, Microsoft Foundry, model-endpoints, API's of MCP-servers leidt, overweeg dan ook die locaties. De gegevensresidentie hangt af van het volledige aanvraagpad, niet alleen van de gateway-regio. Bekijk waar elke component is uitgerold, inclusief de gateway, AI-backends, tools, loggbestemmingen, beheerde identiteiten en clientapplicaties.
Veelgestelde vragen
Wanneer moet ik de AI Gateway-tier gebruiken in plaats van direct providers te bellen?
Gebruik de AI Gateway-laag wanneer je één beheerd eindpunt voor veel modellen en tools wilt hebben: centrale runtime-sleutels in plaats van provider-inloggegevens in elke applicatie, gedeelde beleidsregels (token- en verzoeklimieten, contentveiligheid, IP-filters), unified telemetriry en een selfservicecatalogus. Als je één model vanuit één applicatie aanroept en geen governance of centrale credentials nodig hebt, kan het direct bellen van de provider eenvoudiger zijn.
Moet ik importeren vanuit Foundry of een aangepast model toevoegen?
Importeer vanuit Foundry wanneer je model draait in een Microsoft Foundry of Azure OpenAI (Azure AI Services) resource; de wizard ontdekt de implementaties van de resource voor jou. Voeg een aangepast model toe voor AWS Bedrock, Google Vertex, OpenAI, Anthropic of een ander OpenAI-compatibel endpoint, waarbij je zelf de endpoint- en modelnamen invoert. Zie Beheren van modellen en tools.
Is het AI Gateway-niveau klaar voor productie?
De AI Gateway-laag is als openbare preview beschikbaar: de beschikbaarheid is naar beste vermogen, zonder service level agreement (SLA), en API's, werkstromen in de portal, telemetrie, limieten, regio's en de prijzen kunnen veranderen. Previewquota kunnen het aantal modellen, tools en runtime-toegangssleutels, evenals je request- en tokendoorvoer, beperken; Specifieke limieten zullen worden gepubliceerd voordat de algemene beschikbaarheid plaatsvindt. Begin met niet-kritieke werklasten, gecontroleerde piloten en duidelijke terugrolplannen.
Hoe wordt de prijsstelling tijdens de preview afgehandeld?
De prijsstelling en het businessmodel voor het AI Gateway-niveau worden later in de preview bekendgemaakt. Je kunt ook betalen voor gerelateerde bronnen die je met de gateway gebruikt, zoals modelproviders, Application Insights, netwerken en observabiliteitsplatforms.
Welke regio's zijn beschikbaar?
De AI Gateway-laag is beschikbaar in East US 2 en Sweden Central. Zie Regionale beschikbaarheid.
Hoe worden mijn gegevens verwerkt?
Jij kiest waar telemetrie naartoe gaat. Met Application Insights blijft het in je Azure-abonnement. Andere OpenTelemetry (OTLP) bestemmingen volgen uw configuratie en de voorwaarden van de provider. Telemetrie gebruikt OpenTelemetry GenAI semantische conventies (het gen_ai.* voorvoegsel). De gegevensresidentie hangt af van het volledige aanvraagpad, dus plaats de gateway, backends en telemetriebestemmingen in goedgekeurde regio's en betrek je beveiligings- en privacyteams.
Ondersteunt AI Gateway-niveau private netwerken?
Yes. Inbound Private Link en outbound virtual network-integratie maken deel uit van de publieke preview. Zie Configureer privénetwerk voor setup, DNS en beperkingen.
Welke API-versie moet ik gebruiken voor automatisering?
Gebruik de versie 2026-05-01-previewvan de preview management API. Valideer automatisering vóór een brede uitrol omdat de API in preview is.