Observação
O acesso a essa página exige autorização. Você pode tentar entrar ou alterar diretórios.
O acesso a essa página exige autorização. Você pode tentar alterar os diretórios.
Controle quanto sua equipe gasta em agentes de programação no Unity Gateway. Defina orçamentos, escolha modelos que equilibrem custo e capacidade, e use o Roteamento Inteligente para otimizar a seleção dos modelos.
Definir orçamentos
Crie um orçamento mensal usando o Unity Gateway como tipo de recurso. Escolha limites para sua equipe:
| Limite | O que controla |
|---|---|
| Compartilhado | Gasto total entre usuários dentro do escopo orçamentário. |
| Por usuário | Gasto por usuário. |
| Substituição por usuário | Uma tolerância maior para usuários ou grupos específicos. |
Para cada limite compartilhado ou por usuário, escolha Enviar alerta, Usar Bloqueio ou ambos. Alertas notificam os destinatários configurados. Bloquear impede novas solicitações de gateway até que o orçamento seja resetado ou um administrador aumente o limite.
Se sua equipe usa provedores de modelos externos, ative a prévia de Gastos de Modelos Externos em Orçamentos e selecione Incluir uso de modelos externos. O gasto externo estimado passa a ser contabilizado nos mesmos limiares.
A fiscalização orçamentária utiliza estimativas quase em tempo real. Solicitações já em andamento podem ser concluídas, então o gasto final pode exceder o limite. Estimativas externas também podem diferir da fatura do provedor.
Para detalhes de configuração e cobertura, veja Gerenciar orçamentos para o Unity Gateway.
Defina padrões de modelo e padrões inteligentes
Edite essas configurações na configuração do seu agente de codificação. Misture os campos abaixo na configuração existente e depois salve para publicar suas alterações.
Definir um modelo padrão
Escolha o modelo com o qual cada agente começa para o trabalho diário. Para o Claude Code, adicione o seguinte dentro do objeto config em enabled_agents:
{
"default_models": {
"default_model": "system.ai.claude-sonnet-4-6"
}
}
Isso define o Claude Sonnet 4.6 como padrão do Claude Code. Escolha um modelo suportado pelo agente e garanta que os desenvolvedores tenham acesso a ele.
ug usa este padrão quando nenhuma recomendação de padrão inteligente ou seleção explícita de modelo se aplica.
Para Claude Code, você também pode mapear suas famílias de modelos Opus, Sonnet, Haiku e Fable para modelos específicos:
{
"default_models": {
"default_model": "system.ai.claude-sonnet-4-6",
"default_opus_model": "system.ai.claude-opus-4-8",
"default_sonnet_model": "system.ai.claude-sonnet-4-6",
"default_haiku_model": "system.ai.claude-haiku-4-5",
"default_fable_model": "system.ai.claude-fable-5"
}
}
Especifique apenas os mapeamentos familiares que você quer sobrepor. Se models usar um serviço de provedor de modelo, use os IDs de modelo desse serviço de provedor. Caso contrário, use os nomes completos dos serviços de modelo do Unity Catalog. Com uma lista estática model_services, cada valor padrão também deve aparecer nessa lista.
Ajuste as recomendações conforme os gastos aumentam
Importante
As configurações padrão inteligentes estão em Beta. Um administrador da conta deve ativar a prévia do Enhanced Unity Gateway na página Prévias do console da conta. Consulte Gerenciar visualizações do Azure Databricks.
Para recomendar um agente e modelo diferentes conforme os gastos aumentam, adicione smart_defaults no nível superior da configuração atual do seu agente de codificação:
{
"smart_defaults": {
"budget_id": "<budget-configuration-uuid>",
"tiers": [
{
"spending_percentage": 0.8,
"recommended_agent": "CODING_AGENT_CLAUDE_CODE",
"recommended_model": "system.ai.claude-haiku-4-5"
}
]
}
}
Substitua o ID do orçamento pelo budget_configuration_id do seu orçamento. O valor 0.8 representa 80% do limite orçamentário aplicável. Nesse ponto, este exemplo recomenda Claude Code com Claude Haiku 4.5. Inclua o agente recomendado em enabled_agents e conceda aos desenvolvedores acesso ao modelo. Se esse agente usar uma lista estática model_services , inclua o modelo recomendado na lista. Para múltiplos níveis, o maior limiar atingido determina a recomendação.
Executar ug inicia o agente e o modelo recomendados. Um comando específico de agente mantém o agente escolhido e aplica uma recomendação de modelo apenas se ela for destinada a esse agente. Um valor explícito --model se sobrepõe à recomendação.
As configurações padrão inteligentes afetam novas inicializações; elas não alternam sessões ativas nem restringem o acesso ao modelo. Use bloqueio de orçamento para impedir novas solicitações e permissões do Catálogo Unity para restringir o acesso.
Uso de modelos abertos
O Azure Databricks suporta a execução de modelos código aberto (OSS), como glm-5-2, com agentes de codificação via Unity Gateway. Modelos OSS podem reduzir substancialmente o custo por token para tarefas rotineiras de codificação. Defina um modelo OSS como padrão de um agente na sua configuração, ou peça para os desenvolvedores selecionarem um no lançamento.
Para exemplos de lançamento e configuração manual, veja Select models. Para ver quais agentes suportam modelos abertos, veja Agentes de codificação suportados.
Entenda o Roteamento Inteligente
O Smart Routing seleciona automaticamente o modelo de menor custo capaz de lidar com cada tarefa, então os desenvolvedores não precisam escolher um modelo para cada requisição. Ele funciona com Claude Code e Codex e pode selecionar um modelo diferente com base na recomendação padrão da equipe ou na recomendação padrão inteligente.
Para habilitar o Roteamento Inteligente por padrão, adicione smart_routing dentro do objeto config existente de cada agente suportado:
{
"smart_routing": {
"enabled": true
}
}
Publique a configuração. Quando os desenvolvedores lançam com ug claude ou ug codex, a CLI aplica automaticamente o Roteamento Inteligente. Para deixar de ativar o Smart Routing por padrão, defina enabled como false e publique a atualização.
Para configuração e comportamento do desenvolvedor, veja Selecionar modelos ou usar Roteamento Inteligente.
Limitações do roteamento inteligente
- O Smart Routing suporta apenas uma lista estática
models.model_servicescujas entradas começam comsystem.ai.. Você não pode habilitar o roteamento inteligente com ummodel_provider_service, umunity_catalog_location, um modelo personalizado, um provedor externo ou um serviço de modelo fora desystem.ai. - Administradores de workspace devem conceder aos desenvolvedores acesso a todos os modelos candidatos.
- A CLI do Unity Gateway direciona solicitações entre modelos em um ambiente de teste. O roteamento entre chicotes requer o Omnigent v0.8.0 ou superior.
- Sessões nativas do Claude Code e do Codex que não utilizam a CLI do Unity Gateway não oferecem suporte ao Smart Routing por meio do Unity Gateway.
Revisão dos gastos
Revise o uso e os gastos para ajustar seus orçamentos e escolhas de modelos. Veja Monitorar a atividade do agente codificador.