Nota
L'accesso a questa pagina richiede l'autorizzazione. È possibile provare ad accedere o modificare le directory.
L'accesso a questa pagina richiede l'autorizzazione. È possibile provare a modificare le directory.
Importante
Questa funzionalità è in Anteprima Pubblica.
Il air gruppo di comandi all'interno della CLI Databricks invia e gestisce i carichi di lavoro GPU, come l'addestramento e l'inferenza, con AI Runtime.
Per i campi di configurazione del carico di lavoro, vedi riferimento Workload YAML. Per inviare il tuo primo carico di lavoro, consulta l'avvio rapido della CLI di Databricks per AI Runtime.
Databricks Air Run
Invia un carico di lavoro da una configurazione YAML. L'output include l'ID di esecuzione del lavoro e l'URL di esecuzione del lavoro.
databricks air run --file YAML_PATH [flags]
Arguments
None
Options
-f, --file string
Percorso verso la configurazione YAML del carico di lavoro. Questa opzione è obbligatoria.
--watch
Stream nodo 0 log finché la corsa non raggiunge uno stato terminale. Impostazione predefinita: false.
--override stringArray
Sovrascrivi un campo YAML usando FIELD_PATH=VALUE. Ripeti questa opzione per sovrascrivere più campi.
--dry-run
Valida la configurazione senza inviare un carico di lavoro. Impostazione predefinita: false.
--idempotency-key string
Restituire una run esistente quando la chiave è stata precedentemente utilizzata. Sovrascrizioni idempotency_token nello YAML. Massimo: 64 caratteri.
Examples
Il seguente esempio presenta un carico di lavoro da train.yaml:
databricks air run --file train.yaml
Passa un percorso di configurazione come argomento separato per -h mostrare l'aiuto nella configurazione del carico di lavoro:
databricks air run -h config
databricks air run -h config.compute
databricks air run -h config.compute.accelerator_type
Databricks Air Get
Ottieni i dettagli per una corsa.
databricks air get JOB_RUN_ID [flags]
Arguments
JOB_RUN_ID
Un ID eseguito del lavoro restituito da databricks air run.
Options
Lista di Trasmissione Databricks
Elencare le esecuzioni. Di default, il comando elenca le esecuzioni attive inviate dall'utente corrente.
databricks air list [flags]
Arguments
None
Options
--limit int
Numero massimo di corse da mostrare. Impostazione predefinita: 20.
--all-status
Includere le corse negli stati terminali. Impostazione predefinita: false.
--all-users
Includere le run inviate da altri utenti. Impostazione predefinita: false.
--filter stringArray
Il filtro viene eseguito usando KEY=VALUE. Ripeti questa opzione per richiedere più condizioni. I tasti supportati sono accelerator_type, experiment, num_accelerators, e user.
Data bricks Air Log
Trasmetti o recupera log per una partita.
databricks air logs JOB_RUN_ID [flags]
Arguments
JOB_RUN_ID
Un ID eseguito del lavoro restituito da databricks air run.
Options
--node int
Seleziona un nodo indice basato su zero. Impostazione predefinita: 0.
--tail int
Numero di logline esistenti da stampare. Impostazione predefinita: 10000.
--minutes int
Prendi i tronchi degli ultimi minuti. Non è possibile combinare con --tail. Impostazione predefinita: 0.
--retry int
Seleziona un tentativo di ritento.
0 è il tentativo iniziale ed -1 è l'ultimo. Impostazione predefinita: -1.
--download-to string
Scarica i log completi in una directory. Scarica tutti i nodi a meno che --node non sia impostato. Non può essere combinato con --tail o --minutes.
Databricks Air Cancel
Annulla una o più run tramite l'ID del job, oppure annulla tutte le run attive inviate dall'utente corrente.
databricks air cancel [JOB_RUN_ID...] [flags]
Arguments
JOB_RUN_ID
Uno o più ID eseguiti da lavoro. Non è possibile combinare con --all.
Options
--all
Annulla tutte le run attive inviate dall'utente corrente. Impostazione predefinita: false.
-y, --yes
Salta il prompt di conferma usato da --all. Impostazione predefinita: false.
Elenco dei pool aerei di Databricks
Elenca la capacità GPU fornita disponibile per l'ambiente di lavoro attuale.
Usa l'ID di capacità provisionato in compute.pool_id.
databricks air pools list [flags]
Arguments
None
Options
Databricks i pool di aria ottengono
Ottieni dettagli sulla capacità della GPU provisionata.
databricks air pools get [POOL_ID] [flags]
Arguments
POOL_ID
L'ID capacità provisionato. L'argomento è opzionale solo quando lo spazio di lavoro ha esattamente una capacità provisionata.
Options
Databricks Air Images push
Invia un'immagine contenitore al Registro degli Artefatti.
Per i prerequisiti e le istruzioni per il push di un'immagine, vedi Push immagini con la Cli di Databricks.
databricks air images push [flags]
Arguments
None
Options
-s, --source string
L'immagine del contenitore sorgente come nome con un tag opzionale (NAME[:TAG]) o un digest (NAME@DIGEST). Se omesso in un terminale interattivo, il prompt dei comandi mostra il valore.
--catalog string
Il catalogo di destinazione Unity Catalog. Se omesso in un terminale interattivo, il prompt dei comandi mostra il valore.
--schema string
Lo schema di destinazione del Catalogo Unity. Se omesso in un terminale interattivo, il prompt dei comandi mostra il valore.
--artifact string
L'artefatto di destinazione come ARTIFACT[:TAG]. Predefinito si usa il nome e il tag dell'immagine sorgente, oppure il latest tag quando la sorgente non ha un tag.
--pull
Estrai l'immagine sorgente dal suo registro prima di inviare invece di riutilizzare un'immagine locale disponibile. Impostazione predefinita: false.
Databricks Air Convert-to-DABs
Converti una configurazione YAML del carico di lavoro in un Databricks Asset Bundle. Questo comando locale scrive e avvia databricks.yml file sotto generated_artifacts/.
Questo comando è un ponte opzionale verso un flusso di lavoro di produzione avanzato. Puoi continuare a usarla databricks air run senza convertire la configurazione.
Per il flusso di lavoro bundle, vedi Schedule GPU Workloads e compose tasks.
databricks air convert-to-dabs YAML_PATH [flags]
Arguments
YAML_PATH
Il percorso verso la configurazione YAML del carico di lavoro.
Options
--output-dir string
Directory dove il comando scrive il bundle. La sorgente del codice deve trovarsi all'interno di questa directory. Predefinito: la directory che contiene il file YAML di input.
--force
Sovrascrivi i file bundle generati che già esistono. Impostazione predefinita: false.
Bandiere globali
--debug
Indica se abilitare la registrazione di debug.
-h oppure --help
Mostra la guida per il Databricks CLI, il gruppo di comandi correlato o il comando correlato.
--log-file stringa
Stringa che rappresenta il file in cui scrivere i log di output. Se questo flag non viene specificato, l'impostazione predefinita prevede la scrittura dei log di output su stderr.
--log-format formato
Tipo di formato del log, text o json. Il valore predefinito è text.
--log-level stringa
Stringa che rappresenta il livello di formato del log. Se non specificato, il livello di formato del log è disabilitato.
tipo
Tipo di output del comando, text o json. Il valore predefinito è text.
-p, --profile stringa
Nome del profilo nel ~/.databrickscfg file da usare per eseguire il comando . Se questo flag non viene specificato, se esiste, viene usato il profilo denominato DEFAULT .
--progress-format formato
Formato per visualizzare i log di stato: default, append, inplaceo json
-t, --target stringa
Se applicabile, la destinazione del bundle da utilizzare
Migrazione dalla CLI legacy di Python
La CLI Databricks e la CLI obsoleta basata air su Python usano nomi e flag di comando diversi. Aggiorna gli script utilizzando le seguenti mappature:
| CLI Python | Interfaccia a riga di comando di Databricks |
|---|---|
air run -f train.yaml |
databricks air run -f train.yaml |
air run -f train.yaml --override A=X B=Y |
databricks air run -f train.yaml --override A=X --override B=Y |
air get run <run-id> |
databricks air get <run-id> |
air list runs |
databricks air list --all-status |
air list runs --active |
databricks air list |
air -h config |
databricks air run -h config |
air logs <run-id> |
databricks air logs <run-id> |
air cancel <run-id> |
databricks air cancel <run-id> |