Inferenza ospitata da Databricks

Usa Unity Gateway per eseguire inferenze su modelli frontier proprietari e open-weight ospitati da Databricks. Scegli un modello e la capacità di servizio che si adattano al tuo carico di lavoro.

Inizia a inviare query ai modelli.

Modelli disponibili tramite Databricks

I seguenti modelli sono ospitati da Databricks. Ogni nome di modello è collegato alle sue specifiche.

I modelli di risorsa in system.ai sono elencati globalmente. Vedere un modello lì non significa che sia disponibile nel tuo spazio di lavoro. La disponibilità dipende dalla regione del tuo spazio di lavoro, dalle impostazioni cross-geo e dalla disponibilità dei modelli. Controlla l'interfaccia del Gateway di Unity per il servizio modello corrispondente e conferma di avere il permesso di consultarlo.

Inserire un modello in elenco non invia dati dei clienti al modello per l'inferenza. Vedi Disponibilità dei modelli per regione per dettagli regionali.

Nota

Su Azure Databricks, i modelli OpenAI e Google Gemini, insieme a Zhipu AI GLM 5.3, GLM 5.3 Flash e GLM 5.2 (legacy), Moonshot AI Kimi K3, Thinking Machine Labs Inkling e DeepSeek V4.1 Flash e V4 Flash, sono disponibili tramite i servizi ADI forniti da Databricks. Per queste descrizioni dei modelli, vedi Elenco dettagliato dei modelli supportati dalle API dei modelli di Databricks Foundation. Per configurazione e accesso, vedi Servizi ADI.

Important

DeepSeek V4 Flash (0731) è deprecato ed è previsto per il ritiro il 5 novembre 2026. Vedere Modelli deprecati e ritirati per il modello di sostituzione consigliato e indicazioni su come eseguire la migrazione durante la deprecazione.

Provider Famiglia di modelli Modelli
Antropico Claude Haiku Claude Haiku 5.5, Claude Haiku 4.5
Antropico Claude Sonnet Sonetto di Claude 5.5, Sonnetto di Claude 5, Sonnetto di Claude 4.6, Sonnetto di Claude 4.5
Antropico Claude Fable Favola di Claude 5.1, Favola di Claude 5
Antropico Claude Opus Claude Opus 5, Claude Opus 4.8, Claude Opus 4.7, Claude Opus 4.6, Claude Opus 4.5, Claude Opus 4.1
OpenAI GPT GPT-6 Astra, GPT-5.6 Sol, GPT-5.6 Terra, GPT-5.6 Luna, GPT-5.5 Pro, GPT-5.5, GPT-5.4, GPT-5.4 mini, GPT-5.4 nano, GPT-5.2, GPT-5.1, GPT-5, GPT-5 mini, GPT-5 nano
OpenAI Codice GPT Codice GPT-5.3
OpenAI GPT OSS GPT OSS 120B, GPT OSS 20B
Google Gemini Flash Gemini 3.6 Flash, Gemini 3.5 Flash, Gemini 3.5 Flash Lite, Gemini 3.1 Flash Lite, Gemini 3 Flash
Google Gemini Pro Anteprima Gemini 3.1 Pro
Google Generazione di immagini Gemini Immagine flash Gemini 3.1, immagine Gemini 3 Pro
Google Gemma Gemma 3 12B
Meta Lama Llama 4 Maverick, Llama 3.3 70B Instruct, Llama 3.1 8B Instruct
Alibaba Cloud Qwen OpenJev (Qwen3.5 4B),Qwen3.5 122B A10B, Qwen3-Embedding-0.6B, Qwen3-Next 80B A3B Instruct
Moonshot Intelligenza Artificiale Kimi Kimi K3
Zhipu AI GLM GLM 5.3, GLM 5.3 Flash, GLM 5.2 (legacy)
DeepSeek DeepSeek V4.1 Flash, V4 Flash (0731)
Laboratori Macchine Pensanti Sospetto Inkling
Alibaba GTE GTE Large (En)

Per modelli obsoleti e sostituti raccomandati, vedi Modelli deprecati e ritirati.

Usa un modello

Attività dell'utente Come utilizzare i modelli
Costruisci un'applicazione o un agente Chiama un modello tramite l'API Unity Gateway. I servizi di modello forniti dal sistema ti system.ai permettono di iniziare senza creare un servizio modello personalizzato. Vedi Query models.
Applica l'IA ai tuoi dati Usa ai_query per inviare prompt a un modello supportato da SQL, notebook o pipeline in batch. Vedi Usa ai_query.
Usare un agente di codifica Collega il tuo agente di codifica ai modelli tramite Unity Gateway. Vedi Agenti di codifica supportati.

I modelli supportati e gli identificatori dei modelli variano a seconda dell'interfaccia. Consulta le guide collegate per requisiti ed esempi.

Servizi modello forniti dal sistema

Azure Databricks fornisce servizi per modelli pronti all'uso, con pagamento per token, in system.ai, come system.ai.claude-opus-5. Nuovi servizi vengono aggiunti man mano che diventano disponibili modelli di fondazione.

  • Un utente di sistema li possiede e non è possibile eliminarli.
  • Per impostazione predefinita, solo gli amministratori del metastore possono modificarli. Un amministratore del metastore può delegare la gestione tramite la concessione del privilegio MANAGE.

Per limitare l'accesso, vedi Scopri e regola l'accesso ai servizi modello.

Scegli la capacità di servizio

Option Consigliati per Come funziona
Pagamento in base al token Carichi di lavoro con uso variabile o intermittente. Paga per i token che usi senza fornire una capacità di servizio dedicata.
Throughput con capacità effettiva on-demand Carichi di lavoro che richiedono capacità dedicata con flessibilità per adattarla in base ai cambiamenti. Paga per la capacità assegnata senza impegno a termine.

I servizi modello Unity Gateway possono instradare verso destinazioni a throughput provisionato. Consulta la documentazione di ciascuna opzione per i modelli idonei e i requisiti di configurazione.

Per l'inferenza batch con ai_query, usa la guida AI Functions per selezionare i modelli supportati e le opzioni di servizio. Il supporto modello e regionale varia a seconda dell'opzione di servizio.

Connettiti con altri fornitori modello

Puoi anche usare Unity Gateway con il tuo account personale presso il provider del modello. Collega il fornitore modello e regola l'accesso utilizzando le credenziali della tua organizzazione.

Vedi Connetti un fornitore di modelli esterno.

Informazioni correlate