Controlar el gasto

Controla cuánto gasta tu equipo en agentes de programación en Unity Gateway. Establece presupuestos, elige modelos que equilibren coste y capacidad, y utiliza Smart Routing para optimizar la selección de modelos.

Establecer presupuestos

Crea un presupuesto mensual usando Unity Gateway como tipo de recurso. Elige los umbrales para tu equipo:

Umbral Qué controla
Compartido Gasto total entre usuarios dentro del ámbito presupuestario.
Por usuario Gasto por usuario.
Anulación por usuario Un límite mayor para usuarios o grupos específicos.

Para cada umbral compartido o por usuario, elige Enviar alerta, Bloquear uso o ambos. Las alertas notifican a los destinatarios configurados. El bloqueo impide más solicitudes de gateway hasta que se reinicie el presupuesto o un administrador aumente el umbral.

Si tu equipo utiliza proveedores de modelos externos, activa la vista previa de Gasto de Modelo Externo en Presupuestos y selecciona Incluir uso de modelos externos. El gasto externo estimado también se contabiliza para los mismos umbrales.

La aplicación de límites presupuestarios utiliza estimaciones en tiempo casi real. Las solicitudes ya en curso pueden completarse, por lo que el gasto final puede superar el umbral. Los presupuestos externos también pueden diferir de la factura del proveedor.

Para detalles de configuración y cobertura, consulta Gestionar presupuestos para Unity Gateway.

Establecer valores predeterminados de modelo y valores predeterminados inteligentes

Edita estos ajustes en la configuración de tu agente de codificación. Fusiona los campos de abajo en la configuración existente y luego guarda para publicar tus cambios.

Establecer un modelo por defecto

Elige el modelo con el que cada agente empieza para el trabajo cotidiano. Para Claude Code, añade lo siguiente dentro de su objeto config debajo de enabled_agents:

{
  "default_models": {
    "default_model": "system.ai.claude-sonnet-4-6"
  }
}

Esto establece Claude Sonnet 4.6 como el modelo predeterminado de Claude Code. Elige un modelo soportado por el agente y asegúrate de que los desarrolladores tengan acceso a él. ug utiliza este valor predeterminado cuando no se aplica ninguna recomendación smart-default ni elección explícita de modelo.

Para Claude Code, también puedes mapear sus familias de modelos Opus, Sonnet, Haiku y Fable a modelos específicos:

{
  "default_models": {
    "default_model": "system.ai.claude-sonnet-4-6",
    "default_opus_model": "system.ai.claude-opus-4-8",
    "default_sonnet_model": "system.ai.claude-sonnet-4-6",
    "default_haiku_model": "system.ai.claude-haiku-4-5",
    "default_fable_model": "system.ai.claude-fable-5"
  }
}

Especifica solo los mapeos familiares que quieres sobrescribir. Si models utiliza un servicio de proveedor modelo, utiliza IDs de modelo de ese servicio. De lo contrario, utiliza los nombres completos de los modelos de servicio del Catálogo de Unity. Con una lista estática model_services , todos los valores predeterminados también deben aparecer en esa lista.

Ajusta las recomendaciones a medida que aumenta el gasto

Importante

Los valores por defecto inteligentes están en Beta. Un administrador de cuenta debe habilitar la vista previa mejorada de Unity Gateway desde la página de previsualizaciones de la consola de cuenta. Consulte Administrar versiones preliminares de Azure Databricks.

Para recomendar un agente y modelo diferente a medida que aumenta el gasto, añade smart_defaults en el nivel superior de tu configuración actual de agente codificador:

{
  "smart_defaults": {
    "budget_id": "<budget-configuration-uuid>",
    "tiers": [
      {
        "spending_percentage": 0.8,
        "recommended_agent": "CODING_AGENT_CLAUDE_CODE",
        "recommended_model": "system.ai.claude-haiku-4-5"
      }
    ]
  }
}

Sustituye el identificador del presupuesto por el budget_configuration_id de tu presupuesto. El valor 0.8 supone 80% del umbral presupuestario aplicable. En ese punto, este ejemplo recomienda Claude Code con Claude Haiku 4.5. Incluye el agente recomendado en enabled_agents y concede a los desarrolladores acceso al modelo. Si ese agente utiliza una lista estática model_services , incluye el modelo recomendado en la lista. Para varios niveles, el umbral más alto alcanzado determina la recomendación.

Al ejecutarlo ug , se lanza el agente y modelo recomendados. Un comando específico para un agente mantiene el agente seleccionado y aplica una recomendación de modelo solo si va dirigida a ese agente. Un explícito --model anula la recomendación.

Los ajustes predeterminados inteligentes afectan a los nuevos inicios; no cambian las sesiones activas ni restringen el acceso al modelo. Utiliza el bloqueo de presupuesto para impedir solicitudes adicionales y los permisos de Unity Catalog para restringir el acceso.

Utiliza modelos abiertos

Azure Databricks soporta ejecutar modelos código abierto (OSS), como glm-5-2, con agentes de codificación a través de Unity Gateway. Los modelos OSS pueden reducir considerablemente el coste por token para tareas rutinarias de codificación. Establece un modelo OSS como predeterminado de un agente en tu configuración, o haz que los desarrolladores elijan uno al lanzarlo.

Para ejemplos de lanzamiento y configuración manual, véase Select models. Para ver qué agentes soportan modelos abiertos, véase Agentes de codificación soportados.

Entiende el enrutamiento inteligente

Smart Routing selecciona automáticamente el modelo de menor coste capaz de gestionar cada tarea, por lo que los desarrolladores no necesitan elegir un modelo para cada solicitud. Funciona con Claude Code y Codex y permite seleccionar un modelo distinto al predeterminado del equipo o al recomendado de forma inteligente.

Para habilitar el enrutamiento inteligente por defecto, añade smart_routing dentro de cada objeto existente config de cada agente soportado:

{
  "smart_routing": {
    "enabled": true
  }
}

Publique la configuración. Cuando los desarrolladores lanzan con ug claude o ug codex, la CLI aplica automáticamente el enrutamiento inteligente. Para dejar de habilitar Smart Routing de forma predeterminada, configura enabled en false y publica la actualización.

Para la configuración y comportamiento del desarrollador, consulta Seleccionar modelos o usar Enrutamiento Inteligente.

Limitaciones de enrutamiento inteligente

  • Smart Routing solo soporta una lista estática models.model_services cuyas entradas comienzan con system.ai.. No puedes habilitar el enrutamiento inteligente con un model_provider_service, un unity_catalog_location, un modelo personalizado, un proveedor externo o un servicio de modelos fuera de system.ai.
  • Los administradores de espacios de trabajo deben conceder a los desarrolladores acceso a todos los modelos candidatos.
  • La CLI de Unity Gateway enruta entre modelos dentro de un arnés. El enrutamiento entre harnesses requiere Omnigent v0.8.0 o una versión posterior.
  • Las sesiones nativas de código Claude y códex que no utilizan la CLI de Unity Gateway no soportan enrutamiento inteligente a través de Unity Gateway.

Revisar el gasto

Revisa el consumo y el gasto para ajustar tus presupuestos y opciones de modelos. Consulta Monitorizar la actividad del agente codificador.

Recursos adicionales