Notas de atualização do Unity Gateway

Unity Gateway é o plano de controle corporativo para governar custos, segurança e acesso de IA entre os modelos, servidores MCP e agentes usados em toda a sua organização.

Nota

As versões são disponibilizadas em fases. Sua conta do Azure Databricks pode não ser atualizada com um novo recurso até uma semana ou mais após a data inicial de lançamento.

O DeepSeek v4.1 Flash já está disponível no Unity Gateway

11 de setembro de 2026

O Flash DeepSeek V4.1 agora está disponível no Unity Gateway com entradas de texto e imagem. Consulte as regiões com suporte. Você pode acessar esse modelo usando APIs do Modelo de Fundação.

Os clientes são responsáveis por garantir sua conformidade com os termos aplicáveis.

O OpenAI GPT-6 Astra já está disponível no Unity Gateway

4 de setembro de 2026

O OpenAI GPT-6 Astra agora está disponível no Unity Gateway para raciocínio empresarial, processamento estruturado de documentos, codificação, busca agente, entradas multimodais e cargas de trabalho de longo contexto. Você pode acessar esse modelo usando APIs do Foundation Model pagas por token.

Os clientes são responsáveis por garantir sua conformidade com os termos aplicáveis.

O Google Gemini 3.8 Flash agora disponível como modelo hospedado no Databricks

2 de setembro de 2026

O Model Serving agora suporta o Google Gemini 3.8 Flash como um modelo hospedado em Databricks. Você pode acessar esse modelo usando APIs do Modelo de Fundação.

Os clientes são responsáveis por garantir sua conformidade com os termos aplicáveis.

Anthropic Claude Fable 5.1 agora disponível como modelo hospedado em Databricks

1º de setembro de 2026

O Unity Gateway agora suporta o Anthropic Claude Fable 5.1 como um modelo hospedado em Databricks. Você pode acessar esse modelo usando APIs do Modelo de Fundação.

Os clientes são responsáveis por garantir sua conformidade com os termos aplicáveis.

Zhipu AI GLM 5.3 agora disponível como modelo hospedado em Databricks

29 de agosto de 2026

No Azure Databricks, o GLM 5.3 está disponível como modelo hospedado no Databricks em regiões suportadas dos EUA por meio dos ADI Services, fornecidos pela Databricks. Este modelo de mistura apenas textual de especialistas (MoE) suporta uma janela de contexto de até 1.048.576 tokens, até 65.536 tokens de saída, chamada de funções, saída estruturada, codificação, uso de ferramentas agenticas e raciocínio sempre ativo. Para configuração e acesso, veja Serviços ADI.

Os clientes são responsáveis por garantir sua conformidade com os termos aplicáveis.

Monitorar e limitar os custos dos prestadores externos

28 de agosto de 2026

O Unity Gateway agora pode rastrear e limitar os gastos com provedores externos de modelos, como Amazon Bedrock e Fábrica de IA do Azure, e não apenas modelos fornecidos pelo Azure Databricks. Se sua organização já tem compromissos de capacidade diretamente com um provedor, o Unity Gateway se torna o ponto único para acompanhar esse uso e impor limites de gasto entre equipes e casos de uso. Para ativar, ative o Gasto de Modelo Externo em Orçamentos (Beta) na página de Prévias do console da conta, depois selecione Incluir uso de modelo externo ao criar um orçamento com escopo para o tipo de recurso do Unity Gateway.

Veja Incluir uso de modelos externos.

Zhipu AI GLM 5.3 Flash agora está disponível no Unity Gateway

26 de agosto de 2026

No Azure Databricks, o Zhipu AI GLM 5.3 Flash está disponível através dos Serviços ADI com governança unificada via Unity Gateway, para raciocínio multimodal, codificação e cargas de trabalho agentes. Acesse-a pela mesma API governada que outros modelos, com permissões centralizadas, proteções, controles de gasto e observabilidade, e alterne modelos sem alterar o código da aplicação.

Os clientes são responsáveis por garantir sua conformidade com os termos aplicáveis.

Para configuração e acesso, veja Serviços ADI.

O Unity Gateway agora oferece suporte à taxa de transferência provisionada

24 de agosto de 2026

Gerencie o tráfego de Throughput provisionado (PT) por meio do Unity Gateway, colocando os modelos PT sob os mesmos controles de acesso, rastreamento de uso, limites de taxa, registro de payloads e proteções aplicados ao tráfego de outros modelos.

Veja a governança de IA com o Unity Gateway.

Monitore toda a atividade de IA com a tabela unificada de rastreamento (Beta)

21 de agosto de 2026

A tabela unificada de traços está em Beta. Ele captura todas as requisições e respostas dos seus serviços Unity Gateway em uma única tabela do Catálogo Unity no formato OpenTelemetry, oferecendo a você um único local para monitorar, depurar, proteger e auditar toda a atividade de IA.

Veja Toda a atividade de IA na tabela unificada de rastreamento.

O Google Gemini 3.7 Flash agora está disponível no Unity Gateway

13 de agosto de 2026

O Google Gemini 3.7 Flash agora está disponível no Unity Gateway para tarefas diárias rápidas e econômicas. Acesse-a pela mesma API governada que outros modelos, com permissões centralizadas, proteções, controles de gasto e observabilidade, e alterne modelos sem alterar o código da aplicação.

Os clientes são responsáveis por garantir sua conformidade com os termos aplicáveis.

Para consultar o modelo e ver regiões suportadas, veja Usar modelos de fundação.

Bloqueie ou rediga dados sensíveis em solicitações e respostas

13 de agosto de 2026

O guardrail de Detecção de Dados Sensíveis (Beta) detecta dados sensíveis estruturados (como números de Previdência Social, números de cartão de crédito, IBANs e números de telefone) e bloqueia a interação ou redige os valores correspondentes no local. A detecção é determinística (expressões regulares mais checksums e palavras-chave de contexto, sem modelo avaliador), então adiciona menos de 50 ms para uma conversa de 100 turnos e retorna o mesmo resultado toda vez. Para usá-lo, ative a Visualização Aprimorada do Gateway Unity na página de Prévias do console da conta.

Este lançamento também inclui as seguintes melhorias:

  • Interações bloqueadas agora retornam uma resposta HTTP 200 padrão com o motivo de bloqueio, em vez de um erro 4xx, então agentes de codificação que reenviam histórico não reacionam o mesmo bloco a cada turno.
  • As barreiras embutidas do LLM como juiz agora podem avaliar uma janela de mudanças recentes de conversa, ou todo o histórico de conversa, em vez de apenas a mensagem mais recente.
  • Uma nova visualização de fluxo de execução mostra a ordem em que os guardrails são executados, de ponta a ponta.

Veja Detectar dados sensíveis com uma política de serviço.

Roteamento Inteligente: Reduza custos de IA direcionando cada tarefa para o modelo correto

13 de agosto de 2026

O Smart Routing (Beta) escolhe automaticamente o modelo e o harness de agente corretos para cada tarefa, com base na complexidade, permissões e orçamento. Ele transfere o trabalho rotineiro para modelos de menor custo e reserva os modelos fronteiriços para problemas difíceis, e cada decisão de roteamento é visível e auditável. O Smart Routing funciona com Claude Code e Codex quando você os roda pela CLI do Unity Gateway ou Omnigent, e roteia tanto entre modelos proprietários quanto abertos. Só o Omnigent pode fazer o roteamento entre estruturas de codificação, e não apenas entre modelos. Em benchmarks internos, ele igualou a qualidade do nível de fronteira enquanto reduzia o custo total das tarefas em mais de 30%.

Veja o Roteamento Inteligente para agentes de codificação.

As políticas ABAC GRANT agora abrangem os tipos de recurso do Unity Gateway (Beta)

11 de agosto de 2026

Políticas de controle de acesso baseado em atributos (ABAC) GRANT concedem dinamicamente privilégios do Catálogo Unity a securáveis cujas tags governadas correspondem a uma condição. Agora eles suportam serviços modelo, serviços de provedor modelo, serviços do Protocolo de Contexto Modelo (MCP) e serviços agente, que são os tipos de recursos que o Unity Gateway governa. Isso permite que você conceda acesso aos recursos do gateway por tag, em vez de um de cada vez. Todos os tipos suportados estão em Beta.

Veja as políticas da ABACGRANT.

Conectores MCP gerenciados por Databricks agora estão integrados ao Unity Gateway (Beta)

6 de agosto de 2026

Todos os conectores MCP gerenciados pelo Databricks para Genie One e Genie Code migraram para o Unity Gateway. Isso traz conectores gerenciados pelo Databricks sob o Unity Gateway, permitindo governança centralizada, controles de acesso e visibilidade junto com seus outros servidores e ferramentas MCP.

Os usuários devem reautenticar seus conectores para continuar usando com Genie One e Genie Code. Uma notificação no Genie solicita que os usuários afetados se reconectem.

API do Unity Gateway: Gerencie recursos com SDKs, a CLI e o Terraform

6 de agosto de 2026

Você pode gerenciar os recursos do Unity Gateway programaticamente em vez de clicar pela interface, com suporte completo para criar, ler, atualizar, listar e excluir endpoints, provedores de modelos e servidores MCP. A API está disponível em ferramentas padrão para desenvolvedores do Azure Databricks:

  • Python SDK: databricks-sdk 0.125.0 e versões posteriores
  • Go SDK: databricks-sdk-go v0.170.0 e versões posteriores
  • Java SDK: databricks-sdk-java 0.143.0 e versões posteriores
  • Databricks CLI: v1.11.0 e posteriores
  • Provedor Terraform: 1.124.0 e versões posteriores

Veja a referência da API do Unity Gateway.

O Unity Gateway agora está geralmente disponível

4 de agosto de 2026

O Unity Gateway agora está geralmente disponível. Unity Gateway é a solução de governança do Azure Databricks para IA corporativa, parte do Unity Catalog. Com o Unity Gateway você pode:

  • Controle quais serviços de IA as equipes podem usar.
  • Roteie e gerencie o tráfego de IA entre provedores.
  • Governe servidores MCP para controlar acesso e custos.
  • Monitore uso, custo, acesso e linhagem de um só lugar.

Algumas funcionalidades, incluindo políticas de serviço e serviços de agente, permanecem em Beta.

Veja governança de IA com o Unity Gateway e o guia de governança de IA.

Use o Unity Gateway com sua própria assinatura empresarial Claude

30 de julho de 2026

Roteie o código Claude pelo Unity Gateway usando uma assinatura existente do Claude Pro, Max, Enterprise ou Team, sem custo adicional do modelo, enquanto sua organização mantém a governança centralizada, o rastreamento de uso e o controle de acesso. O Azure Databricks retransmite seu token Anthropic OAuth em cada solicitação; então, nenhuma credencial é armazenada, e as solicitações são cobradas em relação à sua assinatura do Anthropic. O acesso é regido pelos privilégios padrão do Catálogo Unity no provedor de modelo que você registra, e recursos do gateway, como rastreamento de uso, tabelas de inferência, limites de taxa e acompanhamento de gastos, continuam funcionando.

Veja o suporte para Claude Max e Anthropic Enterprise.

Conecte-se e administre qualquer provedor externo de modelos

17 de julho de 2026

Conecte-se e administre qualquer provedor externo de modelos (como OpenAI, Anthropic, Amazon Bedrock e modelos recém-lançados como o Muse Spark 1.1 da Meta) por meio do Unity Gateway. Registre um provedor uma vez como um Unity Catalog governado e seguro, e toda equipe pode consultá-lo pelo Unity Gateway com governança e observabilidade completas.

Com provedores de modelos externos, você obtém:

  • Escolha: Adote qualquer modelo no primeiro dia e alterne entre modelos ou provedores compatíveis com OpenAI sem reintegrar.
  • Controle: Governe o acesso com padrão GRANT e REVOKE (EXECUTE para consultar, MANAGE para atualizar), e anexe limites de taxa e proteções que se aplicam a cada solicitação.
  • Clareza: O rastreamento de uso e gastos está ativado por padrão, com contagem de tokens, latência e atribuição de custos por usuário, equipe ou app. Anexe tabelas de inferência para registrar cargas úteis completas de requisições e respostas a uma tabela Delta governada.

Veja Gerenciar provedores de modelo externos (serviços de provedor de modelo).