Nota
L'accesso a questa pagina richiede l'autorizzazione. È possibile provare ad accedere o modificare le directory.
L'accesso a questa pagina richiede l'autorizzazione. È possibile provare a modificare le directory.
Importante
Questa funzionalità è in Anteprima Pubblica.
AI Runtime è un'offerta di calcolo GPU serverless di Databricks pensata per carichi di lavoro di deep learning . È possibile usare il runtime di intelligenza artificiale per eseguire il training e ottimizzare i modelli personalizzati usando i framework preferiti e ottenere efficienza, prestazioni e qualità all'avanguardia.
Get started
Esegui il tuo primo carico di lavoro in pochi minuti usando le nostre guide quickstart.
| Get started | Descrizione |
|---|---|
| 🚀 Avvio rapido della CLI | Vieni da un cluster Slurm o Kubernetes? Allenati con l'IA Runtime dal tuo terminal in pochi minuti. |
| 📓 Avvio rapido del quaderno | Collega il tuo notebook a una GPU in pochi secondi e sviluppa in modo interattivo... |
| ⚡ Ray | Provenire da un cluster di raggi? Esegui Ray su AI Runtime con supporto per dashboard. |
| 🧭 Panoramica | Scopri le cose chiave sull'AI Runtime in due minuti: GPU disponibili, come funziona e limitazioni. |
Funzionalità
AI Runtime è una piattaforma GPU full-stack, con molti modi per connettersi alle GPU, strumenti integrati di osservabilità e debug, e ambienti predefiniti.
Connettiti alle GPU serverless: raggiungi le GPU serverless da dove lavori.
| Feature | Descrizione |
|---|---|
| Computer portatili | Collega un notebook a una GPU serverless e sviluppa in modo interattivo, senza configurazione di cluster. |
| IDE tramite SSH | Collegati dal tuo IDE o terminale tramite un tunnel SSH per lavorare direttamente su un nodo GPU. |
| CLI di esecuzione AI | Invia e gestisci i lavori di addestramento GPU distribuiti dal tuo laptop usando le configurazioni di job YAML. |
| Raggio | Esegui Ray Core, Ray Data, Ray Train e Ray Tune su risorse di calcolo GPU serverless. |
Gestione delle dipendenze: Controlla Python e le librerie di sistema con cui esegue il tuo carico di lavoro.
| Feature | Descrizione |
|---|---|
| Ambienti precostruiti | Inizia da un ambiente Standard minimale o da un ambiente AI Databricks preinstallato con framework ML. |
| Supporto Docker | Porta la tua immagine container per eseguire carichi di lavoro con uno stack di dipendenze personalizzato. |
Caricamento dei dati nelle GPU: Invia dati di addestramento alle tue GPU in modo efficiente.
| Feature | Descrizione |
|---|---|
| Caricatori dati efficienti | Trasmetti dati da volumi del Catalogo Unity con loader tolleranti ai guasti progettati per un alto utilizzo della GPU. |
Debug e Osservabilità: Monitorare gli esperimenti, ispezionare i risultati e diagnosticare i guasti.
| Feature | Descrizione |
|---|---|
| MLflow per il deep learning | Tieni traccia di esperimenti, metriche ed esecuzioni con MLflow e salva i checkpoint dei modelli nei volumi di Unity Catalog. |
| Visualizzatore di log | Visualizza l'output dell'addestramento e monitora l'uso delle risorse GPU mentre il tuo codice è in esecuzione. |
| Debug con agenti | Usa Genie Code per generare codice di addestramento, risolvere problemi di ambiente e debug dei guasti della GPU. |
Programmazione e servizio in tempo reale: Passare dallo sviluppo interattivo a job e endpoint programmati.
| Feature | Descrizione |
|---|---|
| Produziona i tuoi lavori | Distribuisci codice di addestramento con Declarative Automation Bundles, programma le esecuzioni e crea flussi di lavoro multi-task di GPU e CPU. |
| Servi i tuoi modelli | Distribuisci i tuoi modelli addestrati dietro un endpoint scalabile con Model Serving. |
Examples
Clona esempi end-to-end ed eseguili su AI Runtime in pochi minuti, dalla CLI o nei notebook.
| Example | Descrizione |
|---|---|
| Esempi di raggi | Prendi il tuo progetto Ray esistente ed eseguilo su AI Runtime in pochi minuti. |
| Addestramento di un modello di raccomandazione tabulare | Addestrare modelli di raccomandazione per il deep learning, come le architetture a due torri. |
| Visione artificiale | Carichi di lavoro per il rilevamento degli oggetti e la classificazione delle immagini sulle GPU. |
| Apprendimento automatico classico | XGBoost accelerato tramite GPU, previsione di serie temporali e altri classici compiti ML. |
| Ottimizzazione di un LLM OSS | Ottimizza i grandi modelli di linguaggio open source con LoRA, QLoRA o una completa messa a punto. |
Ulteriori informazioni
Trova contenuti utili: gli ultimi aggiornamenti di prodotto e come funziona AI Runtime sotto il cofano.
| Resource | Descrizione |
|---|---|
| Aggiornamenti del prodotto | Consulta gli ultimi aggiornamenti e annunci sui prodotti AI Runtime. |
| Come funziona l'AI Runtime sotto il cofano | Leggi come Databricks mantiene le GPU affidabili durante l'esecuzione dell'IA. |