Kommentar
Åtkomst till den här sidan kräver auktorisering. Du kan prova att logga in eller ändra kataloger.
Åtkomst till den här sidan kräver auktorisering. Du kan prova att ändra kataloger.
Unity Gateway är företagskontrollplanet för att styra AI-kostnad, säkerhet och åtkomst över modeller, MCP-servrar och agenter som används i din organisation.
Note
Utsläpp sker etappvis. Ditt Azure Databricks-konto kanske inte uppdateras med en ny funktion förrän en vecka eller mer efter det ursprungliga releasedatumet.
Stöd för Unity Gateway för standarder för säkerhetsprofiler för regelefterlevnad
17 september 2026
Unity Gateway stöder nu alla efterlevnadssäkerhetsprofiler som stöds av Azure Databricks och är tillgängligt som standard för arbetsytor med efterlevnadsprofilen aktiverad.
En fullständig lista över efterlevnadsstandarder som stöds finns i Säkerhetsprofil för efterlevnad.
Unity Gateway API och utvecklarverktyg är allmänt tillgängliga
16 september 2026
Unity Gateway API för hantering av modelltjänster, modellleverantörstjänster och MCP-tjänster är nu allmänt tillgängligt, med stöd för skapa, läsa, uppdatera, lista och ta bort över Azure Databricks utvecklingsverktyg:
- Terraform-leverantör: 1.132.0 och senare
- Databricks CLI: v1.17.0 och senare
-
Python SDK:
databricks-sdk0.136.0 och senare -
Go SDK:
databricks-sdk-gov0.178.0 och senare -
Java SDK:
databricks-sdk-java0.153.0 och senare -
JavaScript SDK:
@databricks/sdk-aigateway0.19.0 och senare
Stöd för deklarativa automationspaket, via Databricks CLI 1.17.0 och senare, är i beta.
För API-dokumentation, se Unity Gateway API-referensen.
För exempel och handledningar, se följande:
- Skapa och hantera modell-API:er (modelltjänster)
- Skapa och hantera externa modellleverantörer (modellleverantörstjänster)
- Registrera en extern MCP-server.
DeepSeek V4.1 Flash finns nu tillgängligt på Unity Gateway
11 september 2026
DeepSeek V4.1 Flash finns nu tillgängligt på Unity Gateway med text- och bildindata. Se regioner som stöds. Du kan komma åt den här modellen med hjälp av FOUNDATION Model-API:er.
Kunderna ansvarar för att se till att de följer tillämpliga villkor.
OpenAI GPT-6 Astra finns nu tillgänglig på Unity Gateway
4 september 2026
OpenAI GPT-6 Astra finns nu tillgänglig på Unity Gateway för företagsresonemang, strukturerad dokumenthantering, kodning, agentsökning, multimodala indata och långkontextarbetsbelastningar. Du kan komma åt den här modellen med hjälp av Foundation Model API:er mot betalning per token.
Kunderna ansvarar för att se till att de följer tillämpliga villkor.
Google Gemini 3.8 Flash finns nu tillgänglig som en Databricks-hostad modell
2 september 2026
Model Serving stöder nu Google Gemini 3.8 Flash som en Databricks-hostad modell. Du kan komma åt den här modellen med hjälp av FOUNDATION Model-API:er.
Kunderna ansvarar för att se till att de följer tillämpliga villkor.
Anthropic Claude Fable 5.1 finns nu tillgänglig som Databricks-hostad modell
1 september 2026
Unity Gateway stöder nu Anthropic Claude Fable 5.1 som en Databricks-hostad modell. Du kan komma åt den här modellen med hjälp av FOUNDATION Model-API:er.
Kunderna ansvarar för att se till att de följer tillämpliga villkor.
Zhipu AI GLM 5.3 finns nu tillgänglig som en Databricks-hostad modell
29 augusti 2026
På Azure Databricks finns GLM 5.3 som en Databricks-hostad modell i stödda amerikanska regioner via ADI Services, som tillhandahålls av Databricks. Denna textbaserade expertblandningsmodell (MoE) har stöd för ett kontextfönster på upp till 1 048 576 token, upp till 65 536 token i utdata, funktionsanrop, strukturerade utdata, kodgenerering, agentbaserad verktygsanvändning och ständigt aktivt resonemang. För installation och åtkomst, se ADI Services.
Kunderna ansvarar för att se till att de följer tillämpliga villkor.
Övervaka och begränsa kostnader för externa leverantörer
28 augusti 2026
Unity Gateway kan nu spåra och begränsa utgifterna för externa modellleverantörer, såsom Amazon Bedrock och Azure AI Foundry, inte bara modeller som tillhandahålls av Azure Databricks. Om din organisation redan har kapacitetsåtaganden direkt med en leverantör blir Unity Gateway den enda punkten för att följa upp den användningen och upprätthålla utgiftsgränser över team och användningsfall. För att aktivera den, aktivera Extern modellutgift i budgetar (Beta) på kontokonsolens förhandsgranskningssida , och välj sedan Inkludera extern modellanvändning när du skapar en budget anpassad till resurstypen Unity Gateway.
Se Inkludera extern modellanvändning.
Zhipu AI GLM 5.3 Flash finns nu tillgänglig på Unity Gateway
26 augusti 2026
På Azure Databricks finns Zhipu AI GLM 5.3 Flash tillgängligt via ADI Services med enhetlig styrning via Unity Gateway, för multimodal logik, kodning och agentiska arbetsbelastningar. Tillgång till det via samma reglerade API som andra modeller, med centraliserade behörigheter, skyddsräcken, utgiftskontroller och observabilitet, och byt modeller utan att ändra applikationskoden.
Kunderna ansvarar för att se till att de följer tillämpliga villkor.
För installation och åtkomst, se ADI Services.
Unity Gateway stöder nu Provisioned Throughput
24 augusti 2026
Styr provisionerad genomströmningstrafik (PT) genom Unity Gateway så att PT-modeller omfattas av samma åtkomstkontroller, användningsspårning, frekvensbegränsningar, loggning av nyttolaster och skyddsmekanismer som övrig modelltrafik.
Se AI-styrning med Unity Gateway.
Övervaka all AI-aktivitet med den enhetliga spårningstabellen (Beta)
21 augusti 2026
Den enhetliga spårtabellen är i beta. Den samlar varje förfrågan och svar över dina Unity Gateway-tjänster i en enda Unity-katalogtabell i OpenTelemetriry-format, vilket ger dig en enda plats att övervaka, felsöka, säkra och granska all AI-aktivitet.
Se Övervaka all AI-aktivitet med den enhetliga spårningstabellen.
Google Gemini 3.7 Flash finns nu tillgängligt på Unity Gateway
13 augusti 2026
Google Gemini 3.7 Flash finns nu tillgängligt på Unity Gateway för snabba och kostnadseffektiva vardagsuppgifter. Tillgång till det via samma reglerade API som andra modeller, med centraliserade behörigheter, skyddsräcken, utgiftskontroller och observabilitet, och byt modeller utan att ändra applikationskoden.
Kunderna ansvarar för att se till att de följer tillämpliga villkor.
För att söka modellen och se stödda regioner, se Använd grundmodeller.
Blockera eller redigera känslig data i förfrågningar och svar
13 augusti 2026
Skyddet för känslig datadetektering (Beta) upptäcker strukturerad känslig data (såsom personnummer, kreditkortsnummer, IBAN och telefonnummer) och blockerar antingen interaktionen eller redigerar de matchade värdena på plats. Detektionen är deterministisk (reguljära uttryck plus kontrollsummor och kontextnyckelord, utan någon utvärderarmodell), så den adderar under 50 ms för en konversation på 100 rundor och ger samma resultat varje gång. För att använda den, aktivera förhandsvisningen Enhanced Unity Gateway på kontokonsolens förhandsgranskningssida .
Denna version innehåller också följande förbättringar:
- Blockerade interaktioner returnerar nu ett standard HTTP 200-svar med blockorsaken, istället för ett 4xx-fel, så kodagenter som skickar om historik triggar inte samma block varje tur.
- Inbyggda LLM-som-domare-skyddsräcken kan nu utvärdera ett fönster med senaste samtalsvändningar, eller hela samtalshistoriken, istället för bara det senaste meddelandet.
- En ny exekveringsflödesvy visar ordningen i vilken räcken går från början till slut.
Se Upptäck känslig data med en tjänstepolicy.
Smart routing: Sänk AI-kostnader genom att routa varje uppgift till rätt modell
13 augusti 2026
Smart Routing (Beta) väljer automatiskt rätt modell och agent-harness för varje uppgift, baserat på komplexitet, behörigheter och budget. Den flyttar rutinarbetet till billigare modeller och reserverar frontier-modeller för svåra problem, och varje routingbeslut är synligt och granskabart. Smart Routing fungerar med Claude Code och Codex när du kör dem genom Unity Gateway CLI eller Omnigent, och ruttar över både proprietära och öppna modeller. Endast Omnigent kan dirigera mellan kodningsramverk, inte bara modeller. I interna benchmarks nådde det gränsnivåkvalitet samtidigt som den totala uppgiftskostnaden minskade med mer än 30%.
Se Smart Routing för kodningsagenter.
ABAC-policyer GRANT täcker nu resurstyper av Unity Gateway (Beta)
11 augusti 2026
Attributbaserade åtkomstkontrollpolicyer (ABAC) GRANT ger dynamiskt Unity Catalog-privilegier till securables vars styrda taggar matchar ett villkor. De stödjer nu modelltjänster, modellleverantörstjänster, Model Context Protocol (MCP)-tjänster och agenttjänster, vilka är de resurstyper som Unity Gateway styr. Detta låter dig ge tillgång till gateway-resurser via tagg istället för en i taget. Alla stödda typer är i Beta.
Databricks-hanterade MCP-kontakter är nu integrerade med Unity Gateway (Beta)
6 augusti 2026
Alla Databricks-hanterade MCP-kontakter för Genie One och Genie Code har migrerats till Unity Gateway. Detta samlar Databricks-hanterade kopplingar under Unity Gateway, vilket möjliggör centraliserad styrning, åtkomstkontroller och insyn tillsammans med dina andra MCP-servrar och verktyg.
Användare måste autentisera sina kopplingar igen för att kunna fortsätta använda dem med Genie One och Genie Code. En notis i Genie uppmanar användare att återansluta sig.
Unity Gateway API: Hantera resurser med SDK:er, CLI och Terraform
6 augusti 2026
Du kan hantera Unity Gateway-resurser programmatiskt istället för att klicka dig igenom UI:t, med fullt stöd för skapa, läsa, uppdatera, lista och ta bort för endpoints, modellleverantörer och MCP-servrar. API:et finns tillgängligt i standardverktyg för Azure Databricks utvecklare:
- Python SDK:
databricks-sdk0.125.0 och senare - Go SDK:
databricks-sdk-gov0.170.0 och senare - Java SDK:
databricks-sdk-java0.143.0 och senare - Databricks CLI: v1.11.0 och senare
- Terraform-leverantör: 1.124.0 och senare
Se referensen för Unity Gateway API.
Unity Gateway är nu allmänt tillgänglig
4 augusti 2026
Unity Gateway är nu allmänt tillgänglig. Unity Gateway är Azure Databricks styrningslösning för företags-AI, en del av Unity Catalog. Med Unity Gateway kan du:
- Kontrollera vilka AI-tjänster team kan använda.
- Dirigera och hantera AI-trafik mellan leverantörer.
- Styr MCP-servrar för att kontrollera åtkomst och kostnader.
- Övervaka användning, kostnad, tillgång och härstamning från ett och samma ställe.
Vissa funktioner, inklusive servicepolicys och agenttjänster, är fortfarande i beta.
Se AI-styrning med Unity Gateway och AI-styrningsguiden.
Använd Unity Gateway med din egen Claude Enterprise-prenumeration
30 juli 2026
Dirigera Claude Code genom Unity Gateway med en befintlig Claude Pro-, Max-, Enterprise- eller Team-prenumeration, utan extra modellkostnad, medan din organisation behåller centraliserad styrning, användningsspårning och åtkomstkontroll. Azure Databricks vidarebefordrar din Anthropic OAuth-token vid varje förfrågan, så inga inloggningsuppgifter lagras, och förfrågningar debiteras mot din Anthropic-prenumeration. Åtkomsten styrs av standardprivilegier i Unity-katalogen på den modellleverantör du registrerar, och gateway-funktioner som användningsspårning, inferenstabeller, hastighetsgränser och utgiftsspårning fortsätter att fungera.
Se support för Claude Max och Anthropic Enterprise.
Koppla upp och styr alla externa modellleverantörer
den 17 juli 2026
Koppla upp och styr alla externa modellleverantörer (såsom OpenAI, Anthropic, Amazon Bedrock och nyligen släppta modeller som Metas Muse Spark 1.1) via Unity Gateway. Registrera en leverantör en gång som ett styrbart objekt i Unity Catalog, så kan varje team köra frågor mot den via Unity Gateway med fullständig styrning och observerbarhet.
Med externa modellleverantörer får du:
- Val: Anta vilken modell som helst från dag ett och byt mellan modeller eller OpenAI-kompatibla leverantörer utan att reintegrera.
-
Kontroll: Styr åtkomst med standard
GRANTochREVOKE(EXECUTEför att fråga,MANAGEuppdatera), och koppla till hastighetsgränser och skyddsräcken som gäller för varje förfrågan. - Tydlighet: Användnings- och konsumtionsspårning är påslagen som standard, med tokenantal, latens och kostnadsattribution per användare, team eller app. Bifoga inferenstabeller för att logga hela förfrågnings- och svarslaster till en styrd Delta-tabell.
Se Styr externa modellleverantörer (modellleverantörstjänster).