Runtime di intelligenza artificiale

Importante

Questa funzionalità è in Anteprima Pubblica.

AI Runtime è un'offerta di calcolo GPU serverless di Databricks pensata per carichi di lavoro di deep learning . È possibile usare il runtime di intelligenza artificiale per eseguire il training e ottimizzare i modelli personalizzati usando i framework preferiti e ottenere efficienza, prestazioni e qualità all'avanguardia.

Get started

Esegui il tuo primo carico di lavoro in pochi minuti usando le nostre guide quickstart.

Get started Descrizione
🚀 Avvio rapido della CLI Vieni da un cluster Slurm o Kubernetes? Allenati con l'IA Runtime dal tuo terminal in pochi minuti.
📓 Avvio rapido del quaderno Collega il tuo notebook a una GPU in pochi secondi e sviluppa in modo interattivo...
⚡ Ray Provenire da un cluster di raggi? Esegui Ray su AI Runtime con supporto per dashboard.
🧭 Panoramica Scopri le cose chiave sull'AI Runtime in due minuti: GPU disponibili, come funziona e limitazioni.

Funzionalità

AI Runtime è una piattaforma GPU full-stack, con molti modi per connettersi alle GPU, strumenti integrati di osservabilità e debug, e ambienti predefiniti.

Connettiti alle GPU serverless: raggiungi le GPU serverless da dove lavori.

Feature Descrizione
Computer portatili Collega un notebook a una GPU serverless e sviluppa in modo interattivo, senza configurazione di cluster.
IDE tramite SSH Collegati dal tuo IDE o terminale tramite un tunnel SSH per lavorare direttamente su un nodo GPU.
CLI di esecuzione AI Invia e gestisci i lavori di addestramento GPU distribuiti dal tuo laptop usando le configurazioni di job YAML.
Raggio Esegui Ray Core, Ray Data, Ray Train e Ray Tune su risorse di calcolo GPU serverless.

Gestione delle dipendenze: Controlla Python e le librerie di sistema con cui esegue il tuo carico di lavoro.

Feature Descrizione
Ambienti precostruiti Inizia da un ambiente Standard minimale o da un ambiente AI Databricks preinstallato con framework ML.
Supporto Docker Porta la tua immagine container per eseguire carichi di lavoro con uno stack di dipendenze personalizzato.

Caricamento dei dati nelle GPU: Invia dati di addestramento alle tue GPU in modo efficiente.

Feature Descrizione
Caricatori dati efficienti Trasmetti dati da volumi del Catalogo Unity con loader tolleranti ai guasti progettati per un alto utilizzo della GPU.

Debug e Osservabilità: Monitorare gli esperimenti, ispezionare i risultati e diagnosticare i guasti.

Feature Descrizione
MLflow per il deep learning Tieni traccia di esperimenti, metriche ed esecuzioni con MLflow e salva i checkpoint dei modelli nei volumi di Unity Catalog.
Visualizzatore di log Visualizza l'output dell'addestramento e monitora l'uso delle risorse GPU mentre il tuo codice è in esecuzione.
Debug con agenti Usa Genie Code per generare codice di addestramento, risolvere problemi di ambiente e debug dei guasti della GPU.

Programmazione e servizio in tempo reale: Passare dallo sviluppo interattivo a job e endpoint programmati.

Feature Descrizione
Produziona i tuoi lavori Distribuisci codice di addestramento con Declarative Automation Bundles, programma le esecuzioni e crea flussi di lavoro multi-task di GPU e CPU.
Servi i tuoi modelli Distribuisci i tuoi modelli addestrati dietro un endpoint scalabile con Model Serving.

Examples

Clona esempi end-to-end ed eseguili su AI Runtime in pochi minuti, dalla CLI o nei notebook.

Example Descrizione
Esempi di raggi Prendi il tuo progetto Ray esistente ed eseguilo su AI Runtime in pochi minuti.
Addestramento di un modello di raccomandazione tabulare Addestrare modelli di raccomandazione per il deep learning, come le architetture a due torri.
Visione artificiale Carichi di lavoro per il rilevamento degli oggetti e la classificazione delle immagini sulle GPU.
Apprendimento automatico classico XGBoost accelerato tramite GPU, previsione di serie temporali e altri classici compiti ML.
Ottimizzazione di un LLM OSS Ottimizza i grandi modelli di linguaggio open source con LoRA, QLoRA o una completa messa a punto.

Ulteriori informazioni

Trova contenuti utili: gli ultimi aggiornamenti di prodotto e come funziona AI Runtime sotto il cofano.

Resource Descrizione
Aggiornamenti del prodotto Consulta gli ultimi aggiornamenti e annunci sui prodotti AI Runtime.
Come funziona l'AI Runtime sotto il cofano Leggi come Databricks mantiene le GPU affidabili durante l'esecuzione dell'IA.