Nota:
El acceso a esta página requiere autorización. Puede intentar iniciar sesión o cambiar directorios.
El acceso a esta página requiere autorización. Puede intentar cambiar los directorios.
Grupo de comandos
Importante
Esta característica está en versión preliminar pública.
El air grupo de comandos dentro de la CLI Databricks envía y gestiona las cargas de trabajo de la GPU, como entrenamiento e inferencia, con AI Runtime.
Para los campos de configuración de carga de trabajo, consulte la referencia Workload YAML. Para enviar tu primera carga de trabajo, consulta el inicio rápido de la CLI de Databricks para AI Runtime.
Databricks Air Run
Enviar una carga de trabajo desde una configuración YAML. La salida incluye el ID de ejecución de trabajo y la URL de ejecución de trabajos.
databricks air run --file YAML_PATH [flags]
Arguments
Ninguno
Options
-f, --file string
Ruta hacia la configuración YAML de la carga de trabajo. Esta opción es necesaria.
--watch
Transmite los registros del nodo 0 hasta que la ejecución alcance un estado terminal. Valor predeterminado: false.
--override stringArray
Anular un campo YAML usando FIELD_PATH=VALUE. Repite esta opción para anular varios campos.
--dry-run
Valida la configuración sin enviar una carga de trabajo. Valor predeterminado: false.
--idempotency-key string
Devuelve una ejecución existente cuando la clave ya se usó previamente. Anulaciones idempotency_token en el YAML. Máximo: 64 caracteres.
Examples
El siguiente ejemplo presenta una carga de trabajo de train.yaml:
databricks air run --file train.yaml
Pasar una ruta de configuración como argumento separado para -h mostrar ayuda con la configuración de la carga de trabajo:
databricks air run -h config
databricks air run -h config.compute
databricks air run -h config.compute.accelerator_type
Databricks Air Get
Consigue detalles para una carrera.
databricks air get JOB_RUN_ID [flags]
Arguments
JOB_RUN_ID
Un ID de ejecución de trabajo devuelto por databricks air run.
Options
Lista de emisiones de Databricks
Enumera las ejecuciones. Por defecto, el comando lista las ejecuciones activas enviadas por el usuario actual.
databricks air list [flags]
Arguments
Ninguno
Options
--limit int
Número máximo de carreras para mostrar. Valor predeterminado: 20.
--all-status
Incluye recorridos en estados terminales. Valor predeterminado: false.
--all-users
Incluye las partidas enviadas por otros usuarios. Valor predeterminado: false.
--filter stringArray
El filtro se ejecuta usando KEY=VALUE. Repite esta opción para requerir varias condiciones. Las teclas soportadas son accelerator_type, experiment, num_accelerators, y user.
Registros de emisión de databricks
Transmite o recoge troncos para una partida.
databricks air logs JOB_RUN_ID [flags]
Arguments
JOB_RUN_ID
Un ID de ejecución de trabajo devuelto por databricks air run.
Options
--node int
Selecciona un índice de nodo basado en ceros. Valor predeterminado: 0.
--tail int
Número de líneas de registro existentes por imprimir. Valor predeterminado: 10000.
--minutes int
Recoge los registros de los últimos minutos. No se puede combinar con --tail. Valor predeterminado: 0.
--retry int
Selecciona un intento de reintento.
0 es el intento inicial y -1 es el más reciente. Valor predeterminado: -1.
--download-to string
Descarga los registros completos en un directorio. Descarga todos los nodos a menos que --node esté activado. No se puede combinar con --tail o --minutes.
Cancelación de Aire de Databricks
Cancela una o más ejecuciones por ID de ejecución de trabajo, o cancela todas las ejecuciones activas enviadas por el usuario actual.
databricks air cancel [JOB_RUN_ID...] [flags]
Arguments
JOB_RUN_ID
Uno o más IDs de trabajo. No se puede combinar con --all.
Options
--all
Cancela todas las partidas activas enviadas por el usuario actual. Valor predeterminado: false.
-y, --yes
Salta el prompt de confirmación usado por --all. Valor predeterminado: false.
Lista de piscinas de aire de Databricks
Lista la capacidad de GPU provisionada disponible para el espacio de trabajo actual.
Utiliza el ID de capacidad provisionado en compute.pool_id.
databricks air pools list [flags]
Arguments
Ninguno
Options
Los databricks de los fondos de aire obtienen
Obtén detalles sobre la capacidad de la GPU provisionada.
databricks air pools get [POOL_ID] [flags]
Arguments
POOL_ID
El ID de capacidad provisionado. El argumento es opcional solo cuando el espacio de trabajo tiene exactamente una capacidad provisionada.
Options
Databricks Air Images Push
Envía una imagen contenedor al Registro de Artefactos.
Para los requisitos previos e instrucciones para enviar una imagen, véase Push imágenes con la CLI de Databricks.
databricks air images push [flags]
Arguments
Ninguno
Options
-s, --source string
La imagen contenedor de origen es un nombre con una etiqueta opcional (NAME[:TAG]) o un resumen (NAME@DIGEST). Si se omite en un terminal interactivo, el símbolo del valor aparece en el prompt de comandos.
--catalog string
El catálogo de destino del Catálogo de Unity. Si se omite en un terminal interactivo, el símbolo del valor aparece en el prompt de comandos.
--schema string
El esquema del catálogo de destino de Unity. Si se omite en un terminal interactivo, el símbolo del valor aparece en el prompt de comandos.
--artifact string
El artefacto de destino como ARTIFACT[:TAG]. Por defecto se asigna al nombre y etiqueta de la imagen fuente, o la latest etiqueta cuando la etiqueta fuente no tiene etiqueta.
--pull
Extrae la imagen fuente de su registro antes de hacer push en lugar de reutilizar una imagen local disponible. Valor predeterminado: false.
Databricks Air Convert-to-DABs
Convierte una configuración YAML de carga de trabajo en un paquete de activos Databricks. Este comando local escribe databricks.yml y lanza archivos bajo generated_artifacts/.
Este comando es un puente opcional hacia un flujo de trabajo avanzado de producción. Puedes seguir usando databricks air run sin convertir la configuración.
Para el flujo de trabajo del pack, consulta Planificar cargas de trabajo de GPU y componer tareas.
databricks air convert-to-dabs YAML_PATH [flags]
Arguments
YAML_PATH
El camino hacia la configuración YAML de la carga de trabajo.
Options
--output-dir string
Directorio donde el comando escribe el paquete. La fuente del código debe estar dentro de este directorio. Por defecto: el directorio que contiene el archivo YAML de entrada.
--force
Sobrescribe los archivos de bundle generados que ya existen. Valor predeterminado: false.
Marcas globales
--debug
Indica si se va a habilitar el registro de depuración.
-h o --help
Mostrar ayuda para la CLI de Databricks o el grupo de comandos relacionado o el comando relacionado.
--log-file cadena
Cadena que representa el archivo en el que se van a escribir registros de salida. Si no se especifica esta marca, el valor predeterminado es escribir registros de salida en stderr.
--log-format formato
Tipo de formato de registro: text o json. El valor por defecto es text.
--log-level cadena
El nivel de formato de registro está representado por una cadena. Si no se especifica, el nivel de formato de registro está deshabilitado.
-o, --output tipo
Tipo de salida del comando, text o json. El valor por defecto es text.
-p, --profile cadena
Nombre del perfil en el archivo ~/.databrickscfg que se usará para ejecutar el comando. Si no se especifica esta marca, si existe, se usa el perfil denominado DEFAULT .
--progress-format formato
Formato para mostrar los registros de progreso: default, append, inplaceo json
-t, --target cadena
Si procede, el destino del paquete que se va a usar
Migrar desde la CLI de Python heredada
La CLI de Databricks y la CLI obsoleta basada air en Python usan nombres y flags de comandos diferentes. Actualizar scripts usando los siguientes mapeos:
| CLI de Python | CLI de Databricks |
|---|---|
air run -f train.yaml |
databricks air run -f train.yaml |
air run -f train.yaml --override A=X B=Y |
databricks air run -f train.yaml --override A=X --override B=Y |
air get run <run-id> |
databricks air get <run-id> |
air list runs |
databricks air list --all-status |
air list runs --active |
databricks air list |
air -h config |
databricks air run -h config |
air logs <run-id> |
databricks air logs <run-id> |
air cancel <run-id> |
databricks air cancel <run-id> |