Grupo de comandos air

Importante

Esta característica está en versión preliminar pública.

El air grupo de comandos dentro de la CLI Databricks envía y gestiona las cargas de trabajo de la GPU, como entrenamiento e inferencia, con AI Runtime.

Para los campos de configuración de carga de trabajo, consulte la referencia Workload YAML. Para enviar tu primera carga de trabajo, consulta el inicio rápido de la CLI de Databricks para AI Runtime.

Databricks Air Run

Enviar una carga de trabajo desde una configuración YAML. La salida incluye el ID de ejecución de trabajo y la URL de ejecución de trabajos.

databricks air run --file YAML_PATH [flags]

Arguments

Ninguno

Options

-f, --file string

    Ruta hacia la configuración YAML de la carga de trabajo. Esta opción es necesaria.

--watch

    Transmite los registros del nodo 0 hasta que la ejecución alcance un estado terminal. Valor predeterminado: false.

--override stringArray

    Anular un campo YAML usando FIELD_PATH=VALUE. Repite esta opción para anular varios campos.

--dry-run

    Valida la configuración sin enviar una carga de trabajo. Valor predeterminado: false.

--idempotency-key string

    Devuelve una ejecución existente cuando la clave ya se usó previamente. Anulaciones idempotency_token en el YAML. Máximo: 64 caracteres.

Marcas globales

Examples

El siguiente ejemplo presenta una carga de trabajo de train.yaml:

databricks air run --file train.yaml

Pasar una ruta de configuración como argumento separado para -h mostrar ayuda con la configuración de la carga de trabajo:

databricks air run -h config
databricks air run -h config.compute
databricks air run -h config.compute.accelerator_type

Databricks Air Get

Consigue detalles para una carrera.

databricks air get JOB_RUN_ID [flags]

Arguments

JOB_RUN_ID

    Un ID de ejecución de trabajo devuelto por databricks air run.

Options

Marcas globales

Lista de emisiones de Databricks

Enumera las ejecuciones. Por defecto, el comando lista las ejecuciones activas enviadas por el usuario actual.

databricks air list [flags]

Arguments

Ninguno

Options

--limit int

    Número máximo de carreras para mostrar. Valor predeterminado: 20.

--all-status

    Incluye recorridos en estados terminales. Valor predeterminado: false.

--all-users

    Incluye las partidas enviadas por otros usuarios. Valor predeterminado: false.

--filter stringArray

    El filtro se ejecuta usando KEY=VALUE. Repite esta opción para requerir varias condiciones. Las teclas soportadas son accelerator_type, experiment, num_accelerators, y user.

Marcas globales

Registros de emisión de databricks

Transmite o recoge troncos para una partida.

databricks air logs JOB_RUN_ID [flags]

Arguments

JOB_RUN_ID

    Un ID de ejecución de trabajo devuelto por databricks air run.

Options

--node int

    Selecciona un índice de nodo basado en ceros. Valor predeterminado: 0.

--tail int

    Número de líneas de registro existentes por imprimir. Valor predeterminado: 10000.

--minutes int

    Recoge los registros de los últimos minutos. No se puede combinar con --tail. Valor predeterminado: 0.

--retry int

    Selecciona un intento de reintento. 0 es el intento inicial y -1 es el más reciente. Valor predeterminado: -1.

--download-to string

    Descarga los registros completos en un directorio. Descarga todos los nodos a menos que --node esté activado. No se puede combinar con --tail o --minutes.

Marcas globales

Cancelación de Aire de Databricks

Cancela una o más ejecuciones por ID de ejecución de trabajo, o cancela todas las ejecuciones activas enviadas por el usuario actual.

databricks air cancel [JOB_RUN_ID...] [flags]

Arguments

JOB_RUN_ID

    Uno o más IDs de trabajo. No se puede combinar con --all.

Options

--all

    Cancela todas las partidas activas enviadas por el usuario actual. Valor predeterminado: false.

-y, --yes

    Salta el prompt de confirmación usado por --all. Valor predeterminado: false.

Marcas globales

Lista de piscinas de aire de Databricks

Lista la capacidad de GPU provisionada disponible para el espacio de trabajo actual.

Utiliza el ID de capacidad provisionado en compute.pool_id.

databricks air pools list [flags]

Arguments

Ninguno

Options

Marcas globales

Los databricks de los fondos de aire obtienen

Obtén detalles sobre la capacidad de la GPU provisionada.

databricks air pools get [POOL_ID] [flags]

Arguments

POOL_ID

    El ID de capacidad provisionado. El argumento es opcional solo cuando el espacio de trabajo tiene exactamente una capacidad provisionada.

Options

Marcas globales

Databricks Air Images Push

Envía una imagen contenedor al Registro de Artefactos.

Para los requisitos previos e instrucciones para enviar una imagen, véase Push imágenes con la CLI de Databricks.

databricks air images push [flags]

Arguments

Ninguno

Options

-s, --source string

    La imagen contenedor de origen es un nombre con una etiqueta opcional (NAME[:TAG]) o un resumen (NAME@DIGEST). Si se omite en un terminal interactivo, el símbolo del valor aparece en el prompt de comandos.

--catalog string

    El catálogo de destino del Catálogo de Unity. Si se omite en un terminal interactivo, el símbolo del valor aparece en el prompt de comandos.

--schema string

    El esquema del catálogo de destino de Unity. Si se omite en un terminal interactivo, el símbolo del valor aparece en el prompt de comandos.

--artifact string

    El artefacto de destino como ARTIFACT[:TAG]. Por defecto se asigna al nombre y etiqueta de la imagen fuente, o la latest etiqueta cuando la etiqueta fuente no tiene etiqueta.

--pull

    Extrae la imagen fuente de su registro antes de hacer push en lugar de reutilizar una imagen local disponible. Valor predeterminado: false.

Marcas globales

Databricks Air Convert-to-DABs

Convierte una configuración YAML de carga de trabajo en un paquete de activos Databricks. Este comando local escribe databricks.yml y lanza archivos bajo generated_artifacts/.

Este comando es un puente opcional hacia un flujo de trabajo avanzado de producción. Puedes seguir usando databricks air run sin convertir la configuración.

Para el flujo de trabajo del pack, consulta Planificar cargas de trabajo de GPU y componer tareas.

databricks air convert-to-dabs YAML_PATH [flags]

Arguments

YAML_PATH

    El camino hacia la configuración YAML de la carga de trabajo.

Options

--output-dir string

    Directorio donde el comando escribe el paquete. La fuente del código debe estar dentro de este directorio. Por defecto: el directorio que contiene el archivo YAML de entrada.

--force

    Sobrescribe los archivos de bundle generados que ya existen. Valor predeterminado: false.

Marcas globales

Marcas globales

--debug

  Indica si se va a habilitar el registro de depuración.

-h o --help

    Mostrar ayuda para la CLI de Databricks o el grupo de comandos relacionado o el comando relacionado.

--log-file cadena

    Cadena que representa el archivo en el que se van a escribir registros de salida. Si no se especifica esta marca, el valor predeterminado es escribir registros de salida en stderr.

--log-format formato

    Tipo de formato de registro: text o json. El valor por defecto es text.

--log-level cadena

    El nivel de formato de registro está representado por una cadena. Si no se especifica, el nivel de formato de registro está deshabilitado.

-o, --output tipo

    Tipo de salida del comando, text o json. El valor por defecto es text.

-p, --profile cadena

    Nombre del perfil en el archivo ~/.databrickscfg que se usará para ejecutar el comando. Si no se especifica esta marca, si existe, se usa el perfil denominado DEFAULT .

--progress-format formato

    Formato para mostrar los registros de progreso: default, append, inplaceo json

-t, --target cadena

    Si procede, el destino del paquete que se va a usar

Migrar desde la CLI de Python heredada

La CLI de Databricks y la CLI obsoleta basada air en Python usan nombres y flags de comandos diferentes. Actualizar scripts usando los siguientes mapeos:

CLI de Python CLI de Databricks
air run -f train.yaml databricks air run -f train.yaml
air run -f train.yaml --override A=X B=Y databricks air run -f train.yaml --override A=X --override B=Y
air get run <run-id> databricks air get <run-id>
air list runs databricks air list --all-status
air list runs --active databricks air list
air -h config databricks air run -h config
air logs <run-id> databricks air logs <run-id>
air cancel <run-id> databricks air cancel <run-id>

Recursos adicionales