Nota
L'accesso a questa pagina richiede l'autorizzazione. È possibile provare ad accedere o modificare le directory.
L'accesso a questa pagina richiede l'autorizzazione. È possibile provare a modificare le directory.
i modelli Claude di Anthropic offrono funzionalità avanzate di intelligenza artificiale conversazionale per Microsoft Foundry, fornendo funzionalità avanzate di comprensione e generazione del linguaggio all'avanguardia per applicazioni intelligenti. I modelli Claude eccelleno in complesse attività di ragionamento, generazione di codice e attività multimodali, tra cui l'analisi delle immagini. Questo articolo descrive i modelli Claude disponibili, il modo in cui sono ospitati e fatturati, API supportate, funzionalità, quote e procedure consigliate.
Per distribuire e chiamare un modello Claude, vedere Distribuire e usare modelli Claude in Microsoft Foundry.
Important
Gli elementi contrassegnati (anteprima) in questo articolo sono attualmente in anteprima pubblica. Questa anteprima viene fornita senza un contratto di servizio e non è consigliabile per i carichi di lavoro di produzione. Alcune funzionalità potrebbero non essere supportate o potrebbero avere funzionalità limitate. Per ulteriori informazioni, vedere Condizioni supplementari per l'uso delle versioni di anteprima di Microsoft Azure.
Modalità di hosting e fatturazione dei modelli Claude
Microsoft Foundry offre modelli Claude in due versioni:
- Versione 1: ospitata nell'infrastruttura Anthropic; questi modelli vengono eseguiti nell'infrastruttura di Anthropic (all'esterno di Azure).
- Versione 2: Ospitata su Azure; questi modelli vengono eseguiti interamente sull’infrastruttura di Azure e sono tutti generalmente disponibili (GA).
Non tutti i modelli sono disponibili in entrambe le versioni. La fase del ciclo di vita di un modello, ad esempio Anteprima o Disponibile a livello generale, può differire tra le due versioni. Per informazioni sulla disponibilità e sullo stato del ciclo di vita per modello, vedere Modelli Claude disponibili.
Per confrontare entrambe le opzioni di hosting in termini di residenza dei dati, SLA, canali di supporto, conformità e processo di acquisto, consulta Confronta i modelli Claude ospitati in Azure e da Anthropic.
Note
È possibile accedere ai modelli Claude in Microsoft Foundry tramite i modelli Foundry di partner e community. I modelli dei partner e della community che Anthropic vendono e operano sono Prodotti non Microsoft in base alle Condizioni del prodotto.
I modelli Claude in Foundry richiedono un abbonamento ad Azure Marketplace e vengono fatturati tramite le unità di consumo Claude (CCU). Assicurarsi di disporre delle autorizzazioni necessarie per sottoscrivere le offerte di modelli prima della distribuzione. Per i dettagli sui prezzi, vedere la fatturazione delle Claude Consumption Units (CCU) in Microsoft Foundry.
Modelli Claude disponibili
La tabella seguente confronta la disponibilità del modello per entrambe le versioni dei modelli Claude in Foundry. Per informazioni dettagliate sulle funzionalità a cui si fa riferimento nella tabella, vedere la sezione Funzionalità e funzionalità avanzate .
Avvertimento
La beta del contesto 1M in Claude Sonnet 4.5 è stata ritirata il 30 aprile 2026.
A partire dal 1° maggio 2026:
- Le richieste superiori a 200.000 token che includono l'intestazione beta
context-1m-2025-08-07in Sonnet 4.5 restituiscono un errore. - Le richieste 200.000 token o meno non subiscono modifiche, anche se l'intestazione è presente.
Per eseguire la migrazione, rimuovere l'intestazione context-1m-2025-08-07 beta dalle richieste. Per i carichi di lavoro che richiedono un contesto 1M, eseguire la migrazione a Claude Sonnet 4.6 (dove il contesto 1M è disponibile a livello generale) o a Claude Opus 4.6 o Claude Opus 4.7 per carichi di lavoro di intelligenza superiore.
| Model | Availability | Finestra di contesto/Output massimo | Funzionalità principali | Migliore per |
|---|---|---|---|---|
claude-mythos-5
1 |
|
1M / 128K |
|
|
claude-fable-5 |
|
1M / 128K |
|
|
claude-mythos-preview
1 |
|
1M / 128K |
|
|
claude-opus-5 |
|
1M / 128K |
|
|
claude-opus-4-8 |
|
1M / 128K |
|
|
claude-opus-4-7 |
|
1M / 128K |
|
|
claude-opus-4-6 |
|
1M / 128K |
|
|
claude-opus-4-5 |
|
200.000 /64.000 |
|
|
claude-sonnet-5 |
|
1M / 128K |
|
|
claude-sonnet-4-6 |
|
1M / 128K |
|
|
claude-sonnet-4-5 |
|
200.000 /64.000 |
|
|
claude-haiku-4-5 |
|
200.000 /64.000 |
|
|
1Claude Mythos 5 e Claude Mythos Preview sono disponibili solo come anteprima di ricerca controllata. L'accesso ai modelli viene concesso esclusivamente a discrezione di Anthropic e con priorità per i casi d'uso della sicurezza informatica difensiva. Per indicazioni sull'uso responsabile, vedere la scheda di sistema Claude Mythos Preview e Claude Mythos 5 .
2Claude Fable 5 applica altri classificatori di input/output che potrebbero rifiutare le richieste i cui trigger di contenuto attivano criteri di protezione a doppio uso. Quando si verifica un rifiuto, la richiesta restituisce una risposta con esito positivo (200) con un indicatore stop_reason: "refusal" di rifiuto anziché un contenuto generato dal modello. Non vengono fatturati i token di input rifiutati.
3 I controlli dello sforzo per turno, la conversazione intermedia e i budget di token sono attualmente in versione beta.
Panoramica delle API
La tabella seguente elenca le API che è possibile usare per interagire con entrambe le versioni dei modelli Claude in Foundry, ospitate in Azure e ospitate nell'infrastruttura Anthropic.
Usare gli SDK Anthropic e le API Claude seguenti:
Tip
La versione dell'infrastruttura Hosted on Anthropic dei modelli Claude in Foundry supporta più API di quelle elencate in questa tabella. Puoi consultarli nella pagina Documentazione dell'API Claude: Panoramica dell'API.
| API | Description |
|---|---|
Messaggi1 (POST /v1/messages) |
API Messaggi di base: inviare un elenco strutturato di messaggi di input con contenuto di testo o immagine, incluse le risposte in streaming. Il modello genera il messaggio successivo nella conversazione. |
Conteggio dei token (POST /v1/messages/count_tokens) |
API per il conteggio dei token: Conta il numero di token in un messaggio prima di inviarlo a Claude. |
1È possibile chiamare l'API Messaggi dal anthropic pacchetto Python, dal @anthropic-ai/foundry-sdk pacchetto JavaScript o direttamente tramite REST. L'endpoint di distribuzione segue la forma https://<resource-name>.services.ai.azure.com/anthropic/v1/messagese i client REST e JavaScript usano l'intestazione anthropic-version: 2023-06-01 .
Funzionalità e funzionalità avanzate
I modelli Claude in Foundry espongono funzionalità di base per l'elaborazione, l'analisi e la generazione di contenuti e strumenti che consentono a Claude di interagire con sistemi esterni, eseguire codice ed eseguire attività automatizzate. La superficie API di Claude è organizzata in cinque aree:
- Funzionalità del modello
- Strumenti
- Infrastruttura degli strumenti
- Gestione del contesto
- File e risorse
Le sezioni e le tabelle seguenti riepilogano le funzionalità disponibili nelle versioni dei modelli Claude in Foundry ospitate in Azure e ospitate nell'infrastruttura Anthropic. Se non specificato, una funzionalità si applica a entrambe le versioni.
Tip
La versione dell'infrastruttura Hosted on Anthropic dei modelli Claude in Foundry supporta più funzionalità di quelle elencate in queste tabelle. È possibile visualizzare l'elenco completo delle funzionalità in Claude Platform Docs: Panoramica delle funzionalità.
Per altre informazioni sulle funzionalità disponibili e sulle funzionalità avanzate per i modelli Claude in Foundry, vedere il blog degli sviluppatori di Microsoft.
Funzionalità del modello
Modi per gestire gli output diretti di Claude e Claude, tra cui formato di risposta, profondità di ragionamento e modalità di input.
| Feature | Description |
|---|---|
| Messaggi in streaming | Quando si crea un Message, impostare "stream": true per trasmettere in streaming la risposta in modo incrementale usando eventi inviati dal server (SSE). |
| Pensiero | Funzionalità avanzate di ragionamento per attività complesse, offrendo trasparenza al processo di pensiero dettagliato di Claude prima di fornire la risposta finale. Consulta Ragionamento e impegno per i valori dei parametri per modello thinking. |
| Pensiero adattivo | Lasciate che Claude decida dinamicamente quando e quanto pensare. Questa funzionalità è l'unica modalità di pensiero nei modelli Claude 4.7 e versioni successive. Utilizzare il effort parametro per controllare la profondità di pensiero. |
| Sforzo | Controllare il numero di token usati da Claude per rispondere, scambiando tra la completezza della risposta e l'efficienza dei token. Consulta Ragionamento e impegno per i valori dei parametri per ciascun effort modello. |
| Citazioni | Basa le risposte di Claude su fonti, inclusi i blocchi di contenuto dei search_result. |
| Immagini e visione | Elaborare e analizzare il contenuto dalle immagini. Le distribuzioni ospitate in Azure accettano solo immagini codificate in Base64 o basate su URL. |
| Supporto PDF | Elaborare e analizzare il testo e il contenuto visivo da documenti PDF. Fornire i PDF in formato Base64 o tramite URL. |
| Finestra di contesto 1M | Fino a 1 milione di token per l'elaborazione di documenti di grandi dimensioni, codebase estese e conversazioni lunghe. L'assistenza dipende dall'idoneità del modello. |
| Risultati strutturati | Vincolare le risposte di Claude per seguire uno schema JSON specifico, usando due funzionalità complementari: output JSON (parametro output_config.format ) per le risposte strutturate e uso rigoroso degli strumenti (strict: true) per gli input degli strumenti convalidati. Per le distribuzioni ospitate in Azure, gli output strutturati supportano anche il parametro legacy per gli output JSON (il parametro output_format). |
Pensiero e sforzo
La funzionalità Thinking consente valori specifici per il thinking tipo di parametro, a seconda del modello, come descritto nella tabella seguente. Il adaptive tipo configura la funzionalità di pensiero adattivo , consentendo al modello di decidere se pensare, in base alla complessità delle query e al livello di lavoro. Ad esempio: thinking={"type": "adaptive"}.
| Model | adaptive |
enabled |
disabled |
|---|---|---|---|
claude-mythos-5 |
Yes | No | No |
claude-fable-5 |
Yes | No | No |
claude-mythos-preview |
Yes | Yes | No |
claude-opus-5 |
Yes | No | Sì1 |
claude-opus-4-8 |
Yes | No | Yes |
claude-opus-4-7 |
Yes | No | Yes |
claude-opus-4-6 |
Yes | Yes | Yes |
claude-sonnet-5 |
Yes | No | Yes |
claude-sonnet-4-6 |
Yes | Yes | Yes |
1 La riflessione può avvenire disabled solo con sforzo high o inferiore
La funzionalità Effort consente livelli specifici effort per ogni modello, come descritto nella tabella seguente. Il xhigh livello produce lo stesso risultato di max.
| Model | low |
medium |
high |
xhigh |
max |
|---|---|---|---|---|---|
claude-mythos-5 |
Yes | Yes | Yes | Yes | No |
claude-fable-5 |
Yes | Yes | Yes | Yes | No |
claude-opus-5 |
Yes | Yes | Yes | Yes | Yes |
claude-opus-4-8 |
Yes | Yes | Yes | Yes | Yes |
claude-opus-4-7 |
Yes | Yes | Yes | Yes | Yes |
claude-opus-4-6 |
Yes | Yes | Yes | No | Yes |
claude-sonnet-5 |
Yes | Yes | Yes | Yes | Yes |
claude-sonnet-4-6 |
Yes | Yes | Yes | No | Yes |
Tools
Consenti a Claude di intraprendere azioni sul Web o nell'ambiente in uso. Questa funzionalità è costituita da strumenti predefiniti richiamati da Claude tramite tool_use. La piattaforma esegue strumenti lato server e si implementano ed eseguono strumenti lato client.
| Feature | Description |
|---|---|
| Uso dello strumento con strumenti eseguiti dal client | Strumenti personalizzati più gli elementi bash, text editor, computer use e memory definiti da Anthropic. Per altre informazioni su questi strumenti, vedere Bash, Editor di testo, Uso computer e Memoria. |
| Ricerca Web | Scopri i dati reali attuali da tutto il Web per aumentare le conoscenze di Claude. Per le distribuzioni ospitate in Azure, è supportata solo la versione dello web_search_20250305 strumento. |
| Recupero dal Web | Recuperare ed eseguire un'analisi approfondita del contenuto completo da pagine Web e documenti PDF specificati, aumentando il contesto di Claude con contenuti Web live. In Foundry, il recupero dal web richiede una distribuzione ospitata sull'infrastruttura Anthropic. Per le distribuzioni ospitate in Azure, è supportata solo la versione dello web_fetch_20250910 strumento. |
Infrastruttura degli strumenti
Scopri, orchestra e amplia l'uso degli strumenti.
| Feature | Description |
|---|---|
| Flusso di strumenti con granularità fine | Trasmetti in streaming i parametri di utilizzo degli strumenti senza buffering né validazione JSON, riducendo la latenza per i parametri di grandi dimensioni. Richiede l'intestazione anthropic-betafine-grained-tool-streaming-2025-05-14. |
| Connettore MCP | Connettersi ai server MCP remoti direttamente dall'API Messaggi senza un client MCP separato. |
| Ricerca degli strumenti | Scalare fino a migliaia di strumenti individuando e caricando in modo dinamico gli strumenti su richiesta usando la ricerca basata su regex e BM25, ottimizzando l'utilizzo del contesto e migliorando l'accuratezza della selezione degli strumenti. Per le distribuzioni ospitate in Azure, sono supportate entrambe le versioni degli tool_search_tool_bm25_20251119 strumenti e tool_search_tool_regex_20251119 . Sono accettati anche gli alias precedenti tool_search_tool_bm25 e tool_search_tool_regex. |
Gestione del contesto
Controlla e ottimizza la finestra contestuale di Claude per sessioni di lunga durata.
| Feature | Description |
|---|---|
| Memorizzazione automatica nella cache dei prompt | Semplifica la cache dei prompt in un unico parametro dell'API. Il sistema mette automaticamente in cache l'ultimo blocco della richiesta che può essere memorizzato nella cache, spostando in avanti il punto della cache man mano che le conversazioni si estendono. |
| Memorizzazione nella cache dei prompt (5m) | Fornire a Claude maggiori conoscenze e output di esempio per ridurre i costi e la latenza. |
| Memorizzazione nella cache dei prompt (1 ora) | Durata estesa della cache di 1 ora per un contesto di accesso meno frequente ma importante, completando la cache standard di 5 minuti. |
| Modifica del contesto | Gestire automaticamente il contesto della conversazione con strategie configurabili, tra cui la cancellazione dei risultati degli strumenti e la gestione dei blocchi di pensiero. Richiede l'intestazione anthropic-beta context-management-2025-06-27. |
| Conteggio dei token | Il conteggio dei token consente di determinare il numero di token in un messaggio prima di inviarlo a Claude, consentendo di prendere decisioni informate sulle richieste e sull'utilizzo. |
File e risorse
Gestire i documenti e i dati forniti a Claude.
| Feature | Description |
|---|---|
| Files API | Attualmente disponibile solo nelle distribuzioni ospitate sull'infrastruttura di Anthropic. Caricare e gestire i file da usare con Claude senza ricaricare il contenuto con ogni richiesta. Supporta file PDF, immagini e file di testo. |
Supporto dell'agente
- Microsoft Agent Framework supporta la creazione di agenti che usano modelli Claude.
- Creare agenti di intelligenza artificiale personalizzati con Claude Agent SDK.
Tipi e aree di distribuzione
I modelli Claude in Foundry sono disponibili per i tipi di distribuzione seguenti in aree Azure specifiche:
- Standard globale: tutti i modelli Claude (ospitati in Azure e ospitati nell'infrastruttura Anthropic).
-
Data Zone Standard (US): ospitato nelle versioni di Azure di
claude-opus-5,claude-opus-4-8eclaude-sonnet-5.
Per le aree Azure esatte in cui sono disponibili i modelli Claude per la distribuzione, vedere Disponibilità dell'area per tipo di distribuzione.
Quote e limiti di flusso in entrata
Questa sezione illustra in che modo le distribuzioni condividono la quota e quali limiti di frequenza si applicano. La gestione a livello di sottoscrizione si occupa della quota di distribuzione. Le risorse e le aree condividono la quota anziché allocarla separatamente per ogni risorsa o area.
- Tutte le distribuzioni Standard globali dello stesso modello e della stessa versione in una sottoscrizione derivano da un pool di quote condiviso in tutte le aree.
- Tutte le distribuzioni Standard della zona dati dello stesso modello e della stessa versione in una sottoscrizione derivano da un pool di quote condivise all'interno di ogni zona dati (ad esempio, Stati Uniti).
Per altre informazioni sulla gestione delle quote per Foundry Models, vedere Quote e limiti di Microsoft Foundry Models.
ITPM consapevole della cache
I modelli Claude in Foundry esprimono i limiti di frequenza in richieste al minuto (RPM), token di input non memorizzati nella cache al minuto (ITPM) e token di output al minuto (OTPM) per ciascun modello.
Per la maggior parte dei modelli Claude, vengono conteggiati solo i token di input non memorizzati nella cache per i limiti di velocità ITPM. Questi token includono:
Token di input — i token nella richiesta dopo l'ultimo punto di interruzione della cache (input non memorizzato in cache).
Token di input per la creazione della cache: token scritti nella cache, che comprendono:
- Scrittura cache 5m TPM: token scritti nella cache dei prompt di 5 minuti.
- Scrittura cache 1h TPM: token scritti nella cache dei prompt di 1 ora.
Tip
Il totale dei token di input è la somma dei token di input, dei token di input per la creazione della cache e dei token di lettura della cache (i token letti dalla cache). Tuttavia, i token di input letti dalla cache non vengono conteggiati per ITPM. Anche OTPM non viene conteggiato ai fini di ITPM.
Per altre informazioni sui limiti di frequenza e sulla cache, vedere La documentazione dell'API Claude: Limiti di frequenza.
Limiti di frequenza per tipo di sottoscrizione
Il tipo di abbonamento di Azure determina i limiti di richieste. Le colonne Versione 2: ospitata in Azure e Versione 1: ospitata nell'infrastruttura Anthropic indicano se la quota è disponibile per quella combinazione di modello e tipo di distribuzione. Sì significa che la quota è disponibile. N/D indica che la combinazione di modello e versione non ha quota per quel tipo di distribuzione.
Nella tabella seguente sono elencati i limiti di frequenza. Per aumentare la quota oltre i limiti predefiniti, inviare una richiesta tramite il modulo di richiesta di aumento della quota.
Pagamento in base al consumo
| Model | Tipo di distribuzione | Versione 2: Ospitata in Azure | Versione 1: Ospitato nell'infrastruttura di Anthropic | RPM | ITPM | OTPM |
|---|---|---|---|---|---|---|
| claude-fable-5 | Standard globale | N/A | Yes | 0 | 0 | 0 |
| claude-opus-5 | Standard globale | Yes | Yes | 40 | 40,000 | 8,000 |
| claude-opus-5 | Zona dati Standard (US) | Yes | N/A | 40 | 40,000 | 8,000 |
| claude-opus-4-8 | Standard globale | Yes | Yes | 40 | 40,000 | 8,000 |
| claude-opus-4-8 | Zona dati Standard (US) | Yes | N/A | 40 | 40,000 | 8,000 |
| claude-opus-4-7 | Standard globale | N/A | Yes | 40 | 40,000 | 8,000 |
| claude-opus-4-6 | Standard globale | N/A | Yes | 40 | 40,000 | 8,000 |
| claude-opus-4-5 | Standard globale | N/A | Yes | 40 | 40,000 | 8,000 |
| claude-sonnet-5 | Standard globale | Yes | Yes | 40 | 40,000 | 8,000 |
| claude-sonnet-5 | Zona dati Standard (US) | Yes | N/A | 40 | 40,000 | 8,000 |
| claude-sonnet-4-6 | Standard globale | N/A | Yes | 80 | 80,000 | 16,000 |
| claude-sonnet-4-5 | Standard globale | N/A | Yes | 80 | 80,000 | 16,000 |
| claude-haiku-4-5 | Standard globale | Yes | Yes | 80 | 80,000 | 16,000 |
Considerazioni sull'IA responsabile
Quando si usano modelli Claude in Foundry, considerare queste procedure di IA responsabili:
Esaminare i dati, la privacy e la sicurezza per i modelli Claude in Microsoft Foundry per comprendere come vengono elaborati e conservati i dati quando si distribuiscono modelli Claude.
Configurare la sicurezza dei contenuti di intelligenza artificiale durante l'inferenza del modello, perché Foundry non fornisce filtri di contenuto predefiniti per i modelli Claude in fase di distribuzione.
Assicurarsi che le applicazioni siano conformi ai criteri di utilizzo accettabili di Anthropic. Inoltre, consulta i dettagli delle valutazioni di sicurezza per Claude Fable 5, Claude Mythos 5, Claude Mythos Preview, Claude Opus 5, Claude Opus 4.8, Claude Opus 4.7, Claude Opus 4.6, Claude Opus 4.5, Claude Sonnet 5, Claude Sonnet 4.6, Claude Sonnet 4.5 e Claude Haiku 4.5.
Procedure consigliate
Seguire queste procedure consigliate quando si lavora con i modelli Claude in Foundry:
Progettazione dei prompt
- Istruzioni chiare: fornire istruzioni specifiche e dettagliate.
- Gestione del contesto: usare la finestra di contesto disponibile in modo efficace.
- Definizioni di ruolo: usare i messaggi di sistema per definire il ruolo e il comportamento dell'assistente.
- Prompt strutturati: usare la formattazione coerente per ottenere risultati migliori.
Ottimizzazione dei costi
Per ottimizzare l'utilizzo ed evitare la limitazione della frequenza:
- Implementare la logica di ripetizione dei tentativi: gestire le risposte 429 con backoff esponenziale.
- Richieste batch: combinare più richieste quando possibile.
- Monitorare l'utilizzo dei token: tenere traccia del consumo di token e dei modelli di richiesta.
- Usare i modelli appropriati: usare il modello più conveniente per il caso d'uso. Vedere Modelli Claude disponibili.
Contenuti correlati
- Distribuire e usare modelli Claude in Microsoft Foundry
- Distribuire i modelli Claude in Microsoft Foundry usando Bicep o Terraform
- Modelli di fonderia provenienti da partner e comunità
- Fatturazione di Claude Consumption Units (CCU) in Microsoft Foundry
- Dati, privacy e sicurezza per i modelli Claude in Microsoft Foundry