Modelli Claude in Microsoft Foundry

i modelli Claude di Anthropic offrono funzionalità avanzate di intelligenza artificiale conversazionale per Microsoft Foundry, fornendo funzionalità avanzate di comprensione e generazione del linguaggio all'avanguardia per applicazioni intelligenti. I modelli Claude eccelleno in complesse attività di ragionamento, generazione di codice e attività multimodali, tra cui l'analisi delle immagini. Questo articolo descrive i modelli Claude disponibili, il modo in cui sono ospitati e fatturati, API supportate, funzionalità, quote e procedure consigliate.

Per distribuire e chiamare un modello Claude, vedere Distribuire e usare modelli Claude in Microsoft Foundry.

Important

Gli elementi contrassegnati (anteprima) in questo articolo sono attualmente in anteprima pubblica. Questa anteprima viene fornita senza un contratto di servizio e non è consigliabile per i carichi di lavoro di produzione. Alcune funzionalità potrebbero non essere supportate o potrebbero avere funzionalità limitate. Per ulteriori informazioni, vedere Condizioni supplementari per l'uso delle versioni di anteprima di Microsoft Azure.

Modalità di hosting e fatturazione dei modelli Claude

Microsoft Foundry offre modelli Claude in due versioni:

  • Versione 1: ospitata nell'infrastruttura Anthropic; questi modelli vengono eseguiti nell'infrastruttura di Anthropic (all'esterno di Azure).
  • Versione 2: Ospitata su Azure; questi modelli vengono eseguiti interamente sull’infrastruttura di Azure e sono tutti generalmente disponibili (GA).

Non tutti i modelli sono disponibili in entrambe le versioni. La fase del ciclo di vita di un modello, ad esempio Anteprima o Disponibile a livello generale, può differire tra le due versioni. Per informazioni sulla disponibilità e sullo stato del ciclo di vita per modello, vedere Modelli Claude disponibili.

Per confrontare entrambe le opzioni di hosting in termini di residenza dei dati, SLA, canali di supporto, conformità e processo di acquisto, consulta Confronta i modelli Claude ospitati in Azure e da Anthropic.

Note

È possibile accedere ai modelli Claude in Microsoft Foundry tramite i modelli Foundry di partner e community. I modelli dei partner e della community che Anthropic vendono e operano sono Prodotti non Microsoft in base alle Condizioni del prodotto.

I modelli Claude in Foundry richiedono un abbonamento ad Azure Marketplace e vengono fatturati tramite le unità di consumo Claude (CCU). Assicurarsi di disporre delle autorizzazioni necessarie per sottoscrivere le offerte di modelli prima della distribuzione. Per i dettagli sui prezzi, vedere la fatturazione delle Claude Consumption Units (CCU) in Microsoft Foundry.

Modelli Claude disponibili

La tabella seguente confronta la disponibilità del modello per entrambe le versioni dei modelli Claude in Foundry. Per informazioni dettagliate sulle funzionalità a cui si fa riferimento nella tabella, vedere la sezione Funzionalità e funzionalità avanzate .

Avvertimento

La beta del contesto 1M in Claude Sonnet 4.5 è stata ritirata il 30 aprile 2026.

A partire dal 1° maggio 2026:

  • Le richieste superiori a 200.000 token che includono l'intestazione beta context-1m-2025-08-07 in Sonnet 4.5 restituiscono un errore.
  • Le richieste 200.000 token o meno non subiscono modifiche, anche se l'intestazione è presente.

Per eseguire la migrazione, rimuovere l'intestazione context-1m-2025-08-07 beta dalle richieste. Per i carichi di lavoro che richiedono un contesto 1M, eseguire la migrazione a Claude Sonnet 4.6 (dove il contesto 1M è disponibile a livello generale) o a Claude Opus 4.6 o Claude Opus 4.7 per carichi di lavoro di intelligenza superiore.

Model Availability Finestra di contesto/Output massimo Funzionalità principali Migliore per
claude-mythos-5 1
  • Ospitato sull'infrastruttura di Anthropic: Anteprima di ricerca ad accesso limitato
1M / 128K
  • Biologia e scienze della vita
  • Cybersecurity (casi d'uso difensivi con priorità): individuazione delle vulnerabilità, controllo della superficie di attacco, red teaming, intelligence sulle minacce
  • Codifica autonoma
  • Agenti di lunga durata
claude-fable-5
  • Ospitato nell'infrastruttura Anthropic: anteprima
1M / 128K
  • Pensiero adattivo
  • Ragionamento su intere basi di codice e contesto di progetto che si estende su più giorni
  • Periodi di lavoro autonomo più lunghi rispetto a qualsiasi precedente modello Claude
  • Verifica automatica
  • Orchestrazione dei subagenti
  • Rifiuto stop_reason delle politiche di salvaguardia a doppio uso2
  • Vedi Introduzione a Claude Fable 5 e Claude Mythos 5
  • Cybersecurity
  • Codifica autonoma
  • Agenti di lunga durata
  • Scrittura di codice e agenti, con un ragionamento più approfondito per i flussi di lavoro aziendali
claude-mythos-preview 1
  • Ospitato sull'infrastruttura di Anthropic: Anteprima di ricerca ad accesso limitato
1M / 128K
  • Sicurezza informatica (con priorità ai casi d'uso difensivi)
  • Codifica autonoma
  • Agenti di lunga durata
claude-opus-5
  • Ospitato su Azure: disponibilità generale
  • Ospitato nell'infrastruttura Anthropic: disponibilità generale
1M / 128K
  • Pensiero adattivo con livelli di impegno xhigh e max
  • Ragionamento su intere basi di codice e contesto di progetto che si estende su più giorni
  • Controlli dello sforzo per turno3
  • A metà conversazione3role:"system"
  • Budget di token3 (task_budget)
  • Scopri novità di Claude Opus 5
  • Intelligenza Near-Fable per lo sviluppo su orizzonti lunghi e la complessa orchestrazione basata su agenti.
  • Agenti di lunga durata
  • Flussi di lavoro aziendali
  • Analisi finanziaria
  • Utilizzo del computer
claude-opus-4-8
  • Ospitato su Azure: disponibilità generale
  • Ospitato nell'infrastruttura Anthropic: disponibilità generale
1M / 128K
  • Ragionamento adattivo con livello di sforzo xhigh
  • Ragionamento su intere basi di codice e contesto di progetto che si estende su più giorni
  • Ingresso immagini ad alta risoluzione (fino a 2576 px / 3,75 MP)
  • Consulta la migrazione a Claude Opus 5
  • Coding
  • Agenti di lunga durata
  • Analisi finanziaria
  • Cybersecurity
  • Utilizzo del computer
claude-opus-4-7
  • Ospitato nell'infrastruttura Anthropic: disponibilità generale
1M / 128K
  • Pensiero adattivo
  • Ragionamento sull'intera base di codice
  • Ingresso immagini ad alta risoluzione (fino a 2576 px / 3,75 MP)
  • Consulta la migrazione a Claude Opus 5
  • Coding
  • Flussi di lavoro aziendali
  • Agenti di lunga durata
  • Ragionamento multifunzionale
  • Analisi finanziaria
  • Cybersecurity
claude-opus-4-6
  • Ospitato nell'infrastruttura Anthropic: disponibilità generale
1M / 128K
  • Pensiero adattivo
  • Input di immagine e testo
  • Utilizzo del computer
  • Uso avanzato degli strumenti (ricerca, chiamata a livello di codice, esempi)
  • Consulta la migrazione a Claude Opus 5
  • Coding
  • Agenti aziendali
claude-opus-4-5
  • Ospitato nell'infrastruttura Anthropic: disponibilità generale
200.000 /64.000
  • Elaborazione estesa
  • Input di immagine e testo
  • Utilizzo del computer
  • Uso avanzato degli strumenti (ricerca, chiamata a livello di codice, esempi)
  • Consulta la migrazione a Claude Opus 5
  • Coding
  • Agenti
  • Utilizzo del computer
  • Flussi di lavoro aziendali
claude-sonnet-5
  • Ospitato su Azure: disponibilità generale
  • Ospitato nell'infrastruttura Anthropic: disponibilità generale
1M / 128K
  • Pensiero adattivo
  • xhigh livello di sforzo
  • Ragionamento su intere basi di codice e contesto di progetto che si estende su più giorni
  • Per impostazione predefinita, l'input dell'immagine ad alta risoluzione (fino a 2576px/ 3,75MP) è attivo
  • A metà conversazione3role:"system"
  • Budget di token3 (task_budget)
  • Consulta le novità di Claude Sonnet 5
  • Coding
  • Agenti di lunga durata
  • Analisi finanziaria
  • Cybersecurity
  • Utilizzo del computer
claude-sonnet-4-6
  • Ospitato nell'infrastruttura Anthropic: disponibilità generale
1M / 128K
  • Pensiero adattivo
  • Input di immagine e testo
  • Utilizzo del computer
  • Uso avanzato degli strumenti (ricerca, chiamata a livello di codice, esempi)
  • Vedere Migrazione a Claude Sonnet 5
  • Coding
  • Agenti
  • Flussi di lavoro aziendali
claude-sonnet-4-5
  • Ospitato nell'infrastruttura Anthropic: disponibilità generale
200.000 /64.000
  • Agenti e attività complesse a lungo termine
  • Carichi di lavoro con volumi elevati
claude-haiku-4-5
  • Ospitato su Azure: disponibilità generale
  • Ospitato nell'infrastruttura Anthropic: disponibilità generale
200.000 /64.000
  • Elaborazione estesa
  • Input di immagine e testo
  • Coding
  • Agenti

1Claude Mythos 5 e Claude Mythos Preview sono disponibili solo come anteprima di ricerca controllata. L'accesso ai modelli viene concesso esclusivamente a discrezione di Anthropic e con priorità per i casi d'uso della sicurezza informatica difensiva. Per indicazioni sull'uso responsabile, vedere la scheda di sistema Claude Mythos Preview e Claude Mythos 5 .

2Claude Fable 5 applica altri classificatori di input/output che potrebbero rifiutare le richieste i cui trigger di contenuto attivano criteri di protezione a doppio uso. Quando si verifica un rifiuto, la richiesta restituisce una risposta con esito positivo (200) con un indicatore stop_reason: "refusal" di rifiuto anziché un contenuto generato dal modello. Non vengono fatturati i token di input rifiutati.

3 I controlli dello sforzo per turno, la conversazione intermedia e i budget di token sono attualmente in versione beta.

Panoramica delle API

La tabella seguente elenca le API che è possibile usare per interagire con entrambe le versioni dei modelli Claude in Foundry, ospitate in Azure e ospitate nell'infrastruttura Anthropic.

Usare gli SDK Anthropic e le API Claude seguenti:

Tip

La versione dell'infrastruttura Hosted on Anthropic dei modelli Claude in Foundry supporta più API di quelle elencate in questa tabella. Puoi consultarli nella pagina Documentazione dell'API Claude: Panoramica dell'API.

API Description
Messaggi1 (POST /v1/messages) API Messaggi di base: inviare un elenco strutturato di messaggi di input con contenuto di testo o immagine, incluse le risposte in streaming. Il modello genera il messaggio successivo nella conversazione.
Conteggio dei token (POST /v1/messages/count_tokens) API per il conteggio dei token: Conta il numero di token in un messaggio prima di inviarlo a Claude.

1È possibile chiamare l'API Messaggi dal anthropic pacchetto Python, dal @anthropic-ai/foundry-sdk pacchetto JavaScript o direttamente tramite REST. L'endpoint di distribuzione segue la forma https://<resource-name>.services.ai.azure.com/anthropic/v1/messagese i client REST e JavaScript usano l'intestazione anthropic-version: 2023-06-01 .

Funzionalità e funzionalità avanzate

I modelli Claude in Foundry espongono funzionalità di base per l'elaborazione, l'analisi e la generazione di contenuti e strumenti che consentono a Claude di interagire con sistemi esterni, eseguire codice ed eseguire attività automatizzate. La superficie API di Claude è organizzata in cinque aree:

Le sezioni e le tabelle seguenti riepilogano le funzionalità disponibili nelle versioni dei modelli Claude in Foundry ospitate in Azure e ospitate nell'infrastruttura Anthropic. Se non specificato, una funzionalità si applica a entrambe le versioni.

Tip

La versione dell'infrastruttura Hosted on Anthropic dei modelli Claude in Foundry supporta più funzionalità di quelle elencate in queste tabelle. È possibile visualizzare l'elenco completo delle funzionalità in Claude Platform Docs: Panoramica delle funzionalità.

Per altre informazioni sulle funzionalità disponibili e sulle funzionalità avanzate per i modelli Claude in Foundry, vedere il blog degli sviluppatori di Microsoft.

Funzionalità del modello

Modi per gestire gli output diretti di Claude e Claude, tra cui formato di risposta, profondità di ragionamento e modalità di input.

Feature Description
Messaggi in streaming Quando si crea un Message, impostare "stream": true per trasmettere in streaming la risposta in modo incrementale usando eventi inviati dal server (SSE).
Pensiero Funzionalità avanzate di ragionamento per attività complesse, offrendo trasparenza al processo di pensiero dettagliato di Claude prima di fornire la risposta finale. Consulta Ragionamento e impegno per i valori dei parametri per modello thinking.
Pensiero adattivo Lasciate che Claude decida dinamicamente quando e quanto pensare. Questa funzionalità è l'unica modalità di pensiero nei modelli Claude 4.7 e versioni successive. Utilizzare il effort parametro per controllare la profondità di pensiero.
Sforzo Controllare il numero di token usati da Claude per rispondere, scambiando tra la completezza della risposta e l'efficienza dei token. Consulta Ragionamento e impegno per i valori dei parametri per ciascun effort modello.
Citazioni Basa le risposte di Claude su fonti, inclusi i blocchi di contenuto dei search_result.
Immagini e visione Elaborare e analizzare il contenuto dalle immagini. Le distribuzioni ospitate in Azure accettano solo immagini codificate in Base64 o basate su URL.
Supporto PDF Elaborare e analizzare il testo e il contenuto visivo da documenti PDF. Fornire i PDF in formato Base64 o tramite URL.
Finestra di contesto 1M Fino a 1 milione di token per l'elaborazione di documenti di grandi dimensioni, codebase estese e conversazioni lunghe. L'assistenza dipende dall'idoneità del modello.
Risultati strutturati Vincolare le risposte di Claude per seguire uno schema JSON specifico, usando due funzionalità complementari: output JSON (parametro output_config.format ) per le risposte strutturate e uso rigoroso degli strumenti (strict: true) per gli input degli strumenti convalidati. Per le distribuzioni ospitate in Azure, gli output strutturati supportano anche il parametro legacy per gli output JSON (il parametro output_format).

Pensiero e sforzo

La funzionalità Thinking consente valori specifici per il thinking tipo di parametro, a seconda del modello, come descritto nella tabella seguente. Il adaptive tipo configura la funzionalità di pensiero adattivo , consentendo al modello di decidere se pensare, in base alla complessità delle query e al livello di lavoro. Ad esempio: thinking={"type": "adaptive"}.

Model adaptive enabled disabled
claude-mythos-5 Yes No No
claude-fable-5 Yes No No
claude-mythos-preview Yes Yes No
claude-opus-5 Yes No 1
claude-opus-4-8 Yes No Yes
claude-opus-4-7 Yes No Yes
claude-opus-4-6 Yes Yes Yes
claude-sonnet-5 Yes No Yes
claude-sonnet-4-6 Yes Yes Yes

1 La riflessione può avvenire disabled solo con sforzo high o inferiore

La funzionalità Effort consente livelli specifici effort per ogni modello, come descritto nella tabella seguente. Il xhigh livello produce lo stesso risultato di max.

Model low medium high xhigh max
claude-mythos-5 Yes Yes Yes Yes No
claude-fable-5 Yes Yes Yes Yes No
claude-opus-5 Yes Yes Yes Yes Yes
claude-opus-4-8 Yes Yes Yes Yes Yes
claude-opus-4-7 Yes Yes Yes Yes Yes
claude-opus-4-6 Yes Yes Yes No Yes
claude-sonnet-5 Yes Yes Yes Yes Yes
claude-sonnet-4-6 Yes Yes Yes No Yes

Tools

Consenti a Claude di intraprendere azioni sul Web o nell'ambiente in uso. Questa funzionalità è costituita da strumenti predefiniti richiamati da Claude tramite tool_use. La piattaforma esegue strumenti lato server e si implementano ed eseguono strumenti lato client.

Feature Description
Uso dello strumento con strumenti eseguiti dal client Strumenti personalizzati più gli elementi bash, text editor, computer use e memory definiti da Anthropic. Per altre informazioni su questi strumenti, vedere Bash, Editor di testo, Uso computer e Memoria.
Ricerca Web Scopri i dati reali attuali da tutto il Web per aumentare le conoscenze di Claude. Per le distribuzioni ospitate in Azure, è supportata solo la versione dello web_search_20250305 strumento.
Recupero dal Web Recuperare ed eseguire un'analisi approfondita del contenuto completo da pagine Web e documenti PDF specificati, aumentando il contesto di Claude con contenuti Web live. In Foundry, il recupero dal web richiede una distribuzione ospitata sull'infrastruttura Anthropic. Per le distribuzioni ospitate in Azure, è supportata solo la versione dello web_fetch_20250910 strumento.

Infrastruttura degli strumenti

Scopri, orchestra e amplia l'uso degli strumenti.

Feature Description
Flusso di strumenti con granularità fine Trasmetti in streaming i parametri di utilizzo degli strumenti senza buffering né validazione JSON, riducendo la latenza per i parametri di grandi dimensioni. Richiede l'intestazione anthropic-betafine-grained-tool-streaming-2025-05-14.
Connettore MCP Connettersi ai server MCP remoti direttamente dall'API Messaggi senza un client MCP separato.
Ricerca degli strumenti Scalare fino a migliaia di strumenti individuando e caricando in modo dinamico gli strumenti su richiesta usando la ricerca basata su regex e BM25, ottimizzando l'utilizzo del contesto e migliorando l'accuratezza della selezione degli strumenti. Per le distribuzioni ospitate in Azure, sono supportate entrambe le versioni degli tool_search_tool_bm25_20251119 strumenti e tool_search_tool_regex_20251119 . Sono accettati anche gli alias precedenti tool_search_tool_bm25 e tool_search_tool_regex.

Gestione del contesto

Controlla e ottimizza la finestra contestuale di Claude per sessioni di lunga durata.

Feature Description
Memorizzazione automatica nella cache dei prompt Semplifica la cache dei prompt in un unico parametro dell'API. Il sistema mette automaticamente in cache l'ultimo blocco della richiesta che può essere memorizzato nella cache, spostando in avanti il punto della cache man mano che le conversazioni si estendono.
Memorizzazione nella cache dei prompt (5m) Fornire a Claude maggiori conoscenze e output di esempio per ridurre i costi e la latenza.
Memorizzazione nella cache dei prompt (1 ora) Durata estesa della cache di 1 ora per un contesto di accesso meno frequente ma importante, completando la cache standard di 5 minuti.
Modifica del contesto Gestire automaticamente il contesto della conversazione con strategie configurabili, tra cui la cancellazione dei risultati degli strumenti e la gestione dei blocchi di pensiero. Richiede l'intestazione anthropic-beta context-management-2025-06-27.
Conteggio dei token Il conteggio dei token consente di determinare il numero di token in un messaggio prima di inviarlo a Claude, consentendo di prendere decisioni informate sulle richieste e sull'utilizzo.

File e risorse

Gestire i documenti e i dati forniti a Claude.

Feature Description
Files API Attualmente disponibile solo nelle distribuzioni ospitate sull'infrastruttura di Anthropic. Caricare e gestire i file da usare con Claude senza ricaricare il contenuto con ogni richiesta. Supporta file PDF, immagini e file di testo.

Supporto dell'agente

Tipi e aree di distribuzione

I modelli Claude in Foundry sono disponibili per i tipi di distribuzione seguenti in aree Azure specifiche:

  • Standard globale: tutti i modelli Claude (ospitati in Azure e ospitati nell'infrastruttura Anthropic).
  • Data Zone Standard (US): ospitato nelle versioni di Azure di claude-opus-5, claude-opus-4-8 e claude-sonnet-5.

Per le aree Azure esatte in cui sono disponibili i modelli Claude per la distribuzione, vedere Disponibilità dell'area per tipo di distribuzione.

Quote e limiti di flusso in entrata

Questa sezione illustra in che modo le distribuzioni condividono la quota e quali limiti di frequenza si applicano. La gestione a livello di sottoscrizione si occupa della quota di distribuzione. Le risorse e le aree condividono la quota anziché allocarla separatamente per ogni risorsa o area.

  • Tutte le distribuzioni Standard globali dello stesso modello e della stessa versione in una sottoscrizione derivano da un pool di quote condiviso in tutte le aree.
  • Tutte le distribuzioni Standard della zona dati dello stesso modello e della stessa versione in una sottoscrizione derivano da un pool di quote condivise all'interno di ogni zona dati (ad esempio, Stati Uniti).

Per altre informazioni sulla gestione delle quote per Foundry Models, vedere Quote e limiti di Microsoft Foundry Models.

ITPM consapevole della cache

I modelli Claude in Foundry esprimono i limiti di frequenza in richieste al minuto (RPM), token di input non memorizzati nella cache al minuto (ITPM) e token di output al minuto (OTPM) per ciascun modello.

Per la maggior parte dei modelli Claude, vengono conteggiati solo i token di input non memorizzati nella cache per i limiti di velocità ITPM. Questi token includono:

  • Token di input — i token nella richiesta dopo l'ultimo punto di interruzione della cache (input non memorizzato in cache).

  • Token di input per la creazione della cache: token scritti nella cache, che comprendono:

    • Scrittura cache 5m TPM: token scritti nella cache dei prompt di 5 minuti.
    • Scrittura cache 1h TPM: token scritti nella cache dei prompt di 1 ora.

Tip

Il totale dei token di input è la somma dei token di input, dei token di input per la creazione della cache e dei token di lettura della cache (i token letti dalla cache). Tuttavia, i token di input letti dalla cache non vengono conteggiati per ITPM. Anche OTPM non viene conteggiato ai fini di ITPM.

Per altre informazioni sui limiti di frequenza e sulla cache, vedere La documentazione dell'API Claude: Limiti di frequenza.

Limiti di frequenza per tipo di sottoscrizione

Il tipo di abbonamento di Azure determina i limiti di richieste. Le colonne Versione 2: ospitata in Azure e Versione 1: ospitata nell'infrastruttura Anthropic indicano se la quota è disponibile per quella combinazione di modello e tipo di distribuzione. significa che la quota è disponibile. N/D indica che la combinazione di modello e versione non ha quota per quel tipo di distribuzione.

Nella tabella seguente sono elencati i limiti di frequenza. Per aumentare la quota oltre i limiti predefiniti, inviare una richiesta tramite il modulo di richiesta di aumento della quota.

Pagamento in base al consumo

Model Tipo di distribuzione Versione 2: Ospitata in Azure Versione 1: Ospitato nell'infrastruttura di Anthropic RPM ITPM OTPM
claude-fable-5 Standard globale N/A Yes 0 0 0
claude-opus-5 Standard globale Yes Yes 40 40,000 8,000
claude-opus-5 Zona dati Standard (US) Yes N/A 40 40,000 8,000
claude-opus-4-8 Standard globale Yes Yes 40 40,000 8,000
claude-opus-4-8 Zona dati Standard (US) Yes N/A 40 40,000 8,000
claude-opus-4-7 Standard globale N/A Yes 40 40,000 8,000
claude-opus-4-6 Standard globale N/A Yes 40 40,000 8,000
claude-opus-4-5 Standard globale N/A Yes 40 40,000 8,000
claude-sonnet-5 Standard globale Yes Yes 40 40,000 8,000
claude-sonnet-5 Zona dati Standard (US) Yes N/A 40 40,000 8,000
claude-sonnet-4-6 Standard globale N/A Yes 80 80,000 16,000
claude-sonnet-4-5 Standard globale N/A Yes 80 80,000 16,000
claude-haiku-4-5 Standard globale Yes Yes 80 80,000 16,000

Considerazioni sull'IA responsabile

Quando si usano modelli Claude in Foundry, considerare queste procedure di IA responsabili:

Procedure consigliate

Seguire queste procedure consigliate quando si lavora con i modelli Claude in Foundry:

Progettazione dei prompt

  • Istruzioni chiare: fornire istruzioni specifiche e dettagliate.
  • Gestione del contesto: usare la finestra di contesto disponibile in modo efficace.
  • Definizioni di ruolo: usare i messaggi di sistema per definire il ruolo e il comportamento dell'assistente.
  • Prompt strutturati: usare la formattazione coerente per ottenere risultati migliori.

Ottimizzazione dei costi

Per ottimizzare l'utilizzo ed evitare la limitazione della frequenza:

  • Implementare la logica di ripetizione dei tentativi: gestire le risposte 429 con backoff esponenziale.
  • Richieste batch: combinare più richieste quando possibile.
  • Monitorare l'utilizzo dei token: tenere traccia del consumo di token e dei modelli di richiesta.
  • Usare i modelli appropriati: usare il modello più conveniente per il caso d'uso. Vedere Modelli Claude disponibili.