Limiti dei servizi in Azure AI Search

Nota

Azure AI Search è disponibile tramite il portale di Azure, le API REST e Azure SDK. È inoltre alla base di Foundry IQ, il livello di conoscenza gestito che trasforma il contenuto aziendale in knowledge base riutilizzabili e con riconoscimento delle autorizzazioni per gli agenti nel portale di Microsoft Foundry.

I limiti massimi per l'archiviazione, i carichi di lavoro e le quantità di indici e altri oggetti dipendono dal modello tariffario del servizio Azure AI Search.

Azure AI Search supporta due modelli tariffari, ognuno con i livelli di servizio associati. Il livello selezionato influisce sui limiti del servizio descritti in queste linee guida.

  • Dedicato: prezzi fissi calcolati in base alle Search Unit (SU). Le opzioni del livello di servizio includono: Basic, Standard (S1-S3, incluso S3 HD), Ottimizzato per l'archiviazione (L1-L2) e un livello gratuito con funzionalità limitate del servizio di ricerca.
  • Serverless (anteprima): prezzi basati sul consumo misurati dalle unità di calcolo all'ora (CU/hr) e per GB/mese per l'archiviazione indicizzata. Il livello di anteprima corrente è: Serverless Developer. I limiti sono definiti da limiti massimi per indice, dal numero di oggetti per servizio e dal meccanismo di throttling di Serverless.

Importante

Il livello serverless per sviluppatori è attualmente in anteprima. Questa anteprima viene fornita senza un contratto di servizio e non è consigliata per i carichi di lavoro di produzione. Alcune funzionalità potrebbero non essere supportate o potrebbero avere funzionalità limitate. Per ulteriori informazioni, vedere Condizioni supplementari per l'uso delle versioni di anteprima di Microsoft Azure.

La fatturazione per il piano Serverless Developer inizia il 13 settembre 2026. Gli addebiti per l'utilizzo in base o dopo tale data vengono visualizzati nella fattura Azure. Non ti verrà addebitato alcun costo per l'utilizzo prima del 13 settembre 2026. Serverless Developer è un livello a pagamento una volta iniziata la fatturazione. Il livello Developer serverless non supporta la migrazione verso o da altri livelli tariffari e alcune funzionalità disponibili in altri livelli non sono disponibili durante l'anteprima pubblica. I limiti del servizio, le funzionalità supportate e i dettagli dei prezzi possono cambiare prima della disponibilità generale.

Durante l'anteprima, il modello di determinazione prezzi serverless è supportato solo in aree specifiche.

Per altre informazioni, vedere Scegliere un modello tariffario e un livello di servizio.

Diagnosticare problemi di quota, capacità o limiti

Gli errori di quota e capacità provengono da controlli separati. Utilizzare l'errore restituito dall'operazione completata per determinare quale dei due casi si applica.

Se un'operazione di creazione, ridimensionamento o aggiornamento è ancora in esecuzione, attendere che lo stato di provisioning diventi Succeeded o Failed. Un'operazione in corso non è un'evidenza di un problema di quota o capacità. Se un'operazione di scalabilità non riesce, vedere Errori durante il ridimensionamento.

Failure Causa possibile Prima azione
Creazione del servizio bloccata in una sottoscrizione e in un'area Quota sottoscrizione Nel servizio Quote, verifica il limite per il tuo livello e la tua regione, quindi richiedi più servizi.
La creazione, il ridimensionamento o l'aggiornamento non riesce anche se la quota è disponibile Vincolo di capacità a livello di area Controllare le note a piè di pagina nel supporto dell'area per i livelli vincolati e quindi scegliere un'altra area.
Replica, partizione, livello o richiesta di oggetto rifiutata Limite di servizi o indici Confrontare la configurazione e i conteggi degli oggetti con i limiti di servizio e gli indici.
Il servizio di ricerca restituisce risposte di limitazione sotto carico Throttling Ridurre la frequenza delle richieste o aggiungere unità di ricerca. Vedere Limiti della limitazione delle richieste.
L'indicizzazione non riesce vicino a un limite di archiviazione o vettore Quota di archiviazione o vettore Confrontare storageSize con l'archiviazione delle partizioni per il disco e vectorIndexSize con i limiti di dimensione dell'indice vettoriale per la memoria.
L'indicizzatore, la skill o il vettorizzatore restituisce un errore 429 da un altro servizio Azure OpenAI o un'altra quota del servizio Seguire le indicazioni sulla quota per il servizio che ha generato l'errore, ad esempio Azure OpenAI.

La quota di sottoscrizione disponibile non garantisce la capacità a livello di area e la richiesta di più quote non risolve un vincolo di capacità. Se l'errore persiste, aprire una richiesta di supporto tecnico di Azure che include la sottoscrizione, l'area, il livello, la configurazione richiesta, il testo completo dell'errore, l'ora UTC e qualsiasi ID di correlazione o operazione.

Limiti delle sottoscrizioni

È possibile creare più servizi di ricerca fatturabili (Basic e superiori), fino al numero massimo di servizi consentiti a ogni livello, per area. Ad esempio, è possibile creare fino a 16 servizi al livello Basic e altri 16 servizi nel livello S1 all'interno della stessa sottoscrizione e area. È quindi possibile creare altri 16 servizi Basic in un'altra area per un totale combinato di 32 servizi Basic nella stessa sottoscrizione. Per altre informazioni sui livelli di servizio, vedere Scegliere un modello tariffario e un livello di servizio.

È possibile aumentare i limiti massimi del servizio in base alla richiesta. Se sono necessari più servizi nell’ambito della stessa sottoscrizione, inviare una richiesta di supporto.

Risorsa Gratuito 1 Basic S1 S2 S3 S3 HD L1 L2 Sviluppatore serverless
Numero massimo di servizi per area 1 16 16 8 6 6 6 6 5
Numero massimo di unità di ricerca (SU)2 N/D 3 unità di archiviazione 36 unità di archiviazione 36 unità di archiviazione 36 unità di archiviazione 36 unità di archiviazione 36 unità di archiviazione 36 unità di archiviazione N/D

1 È possibile avere un servizio di ricerca gratuito per ogni sottoscrizione di Azure. Il livello gratuito si basa sull'infrastruttura condivisa con altri clienti. Poiché l'hardware non è dedicato, la scalabilità orizzontale non è supportata e l'archiviazione è limitata a 50 MB. Un servizio di ricerca gratuito potrebbe essere eliminato dopo lunghi periodi di inattività per liberare spazio per più servizi.

2 Le unità di ricerca (SU) sono unità di fatturazione allocate come replica o partizione. Sono necessari entrambi. Per altre informazioni sulle combinazioni di SU, vedere Stimare e gestire la capacità di un servizio di ricerca.

Limiti del servizio

Nel modello di tariffazione Dedicated, la capacità del piano va calcolata moltiplicando il numero di repliche per quello delle partizioni (unità di ricerca).

Risorsa Gratuito Basic S1 S2 S3 S3 HD L1 L2 Sviluppatore serverless
Partizioni N/D 3 1 12 12 12 3 12 12 N/D
Repliche N/D 3 12 12 12 12 12 12 N/D

1 Il livello Basic supporta tre partizioni e tre repliche, per un totale di nove unità di ricerca (SU) sui nuovi servizi di ricerca creati dopo il 3 aprile 2024. I servizi Basic meno recenti sono limitati a una partizione e tre repliche.

Un servizio di ricerca è soggetto a un limite massimo di archiviazione (dimensioni della partizione moltiplicate per il numero di partizioni) o un limite rigido per il numero massimo di indici o indicizzatori, a seconda del limite raggiunto per primo.

I contratti di servizio (SLA) si applicano ai servizi fatturabili che hanno due o più repliche per carichi di lavoro di query, o tre o più repliche per carichi di lavoro di query e indicizzazione. Il numero di partizioni non è un fattore di cui viene tenuto conto ai fini del contratto di servizio. Per altre informazioni, vedere Affidabilità in Azure AI Search.

I servizi gratuiti non hanno partizioni o repliche fisse e condividono risorse con altri sottoscrittori.

Archiviazione della partizione (GB)

I limiti di archiviazione per servizio variano in base a due fattori: data e area di creazione del servizio. La maggior parte delle aree supportate offre limiti più elevati per i servizi più recenti.

Questa tabella illustra l'avanzamento dell'aumento della quota di archiviazione in GB nel tempo. A partire da aprile 2024, le partizioni con capacità superiore sono online nelle aree elencate nelle note a piè di pagina. Se si dispone di un servizio precedente in un'area supportata, verificare se è possibile aggiornare il servizio per ottenere limiti di archiviazione più elevati.

Data di creazione servizio Basic S1 S2 S3/HD L1 L2 Sviluppatore serverless
Prima del 3 aprile 2024 2 25 100 200 1.024 2.048 N/D
Dal 3 aprile 2024 al 17 maggio 2024 1 15 160 512 1.024 1.024 2.048 N/D
Dopo il 17 maggio 2024 2 15 160 512 1.024 2.048 4.096 N/D
Dopo il 10 febbraio 2025 3 15 160 512 1.024 2.048 4.096 N/D

1 Archiviazione con capacità superiore per Basic, S1, S2 e S3 in queste aree. Americas: Brasile meridionale, Canada centrale, Canada orientale, Stati Uniti orientali, Stati Uniti orientali 2, Stati Uniti centrali, Stati Uniti centro-settentrionali, Stati Uniti centro-meridionali, Stati Uniti occidentali 2, Stati Uniti occidentali 3, Stati Uniti centro-occidentali. Europa: Francia centrale. Italia settentrionale, Europa settentrionale, Norvegia orientale, Polonia centrale, Svizzera settentrionale, Svezia centrale, Regno Unito meridionale, Regno Unito occidentale. Medio Oriente: Emirati Arabi Uniti settentrionali. Africa: Sudafrica settentrionale. Asia Pacifico: Australia orientale, Australia sud-orientale, India centrale, Jio India occidentale, Asia orientale, Asia sud-orientale, Giappone orientale, Giappone occidentale, Corea centrale, Corea meridionale.

2 Maggiore capacità di archiviazione per L1 e L2. Più aree offrono capacità più elevata a ogni livello fatturabile. Americhe: Stati Uniti orientali 2 EUAP. Europa: Germania settentrionale, Germania centro-occidentale, Svizzera occidentale. Azure per enti pubblici: Texas, Arizona, Virginia. Africa: Sudafrica settentrionale. Asia Pacifico: Cina settentrionale 3, Cina orientale 3.

3 L'archiviazione con capacità superiore è disponibile in Europa occidentale.

Importante

Attualmente, i limiti di archiviazione più elevati non sono disponibili nelle aree seguenti, che sono soggetti ai limiti precedenti al 3 aprile.

  • Israele centrale
  • Qatar Centrale
  • Spain Central
  • India meridionale

Limiti per gli indici

Risorsa Gratuito Basic 1 S1 S2 S3 S3 HD L1 L2 Sviluppatore serverless
Numero massimo di indici 3 5 o 15 50 200 200 1000 per partizione o 3000 per servizio 10 10 30
Numero massimo di campi semplici per indice 2 1000 100 1000 1000 1000 1000 1000 1000 1000
Dimensioni massime per campo vettoriale 4096 4096 4096 4096 4096 4096 4096 4096 4096
Numero massimo di raccolte complesse per indice 40 40 40 40 40 40 40 40 40
Numero massimo di elementi in tutte le raccolte complesse per documento3 3000 3000 3000 3000 3000 3000 3000 3000 3000
Profondità massima dei campi complessi 10 10 10 10 10 10 10 10 10
Numero massimo di suggerimenti per indice 1 1 1 1 1 1 1 1 1
Numero massimo di profili di punteggio per indice 100 100 100 100 100 100 100 100 100
Configurazioni semantiche massime per indice 100 100 100 100 100 100 100 100 100
Numero massimo di funzioni per profilo 8 8 8 8 8 8 8 8 8
Dimensioni massime dell’indice 4 N/D N/D N/D 1,88 TB 2,34 TB 100 GB N/D N/D 1 GB

1 I servizi Basic creati prima di dicembre 2017 hanno limiti inferiori (5 anziché 15) per gli indici. Il livello di base è l'unico livello con un limite inferiore di 100 campi per indice.

2Il limite superiore per i campi include sia i campi di primo livello che i sottocampi annidati in una raccolta complessa. Ad esempio, se un indice contiene 15 campi e ha due raccolte complesse con cinque sottocampi ciascuno, il numero dei campi dell'indice è 25. Gli indici con una raccolta di campi molto grandi possono essere lenti. Limitare i campi e gli attributi solo a quelli necessari ed eseguire l'indicizzazione e il test delle query per verificare che le prestazioni siano accettabili.

3 È previsto un limite superiore per gli elementi perché la presenza di un numero elevato di elementi aumenta significativamente lo spazio di archiviazione necessario per l'indice. Un elemento di una raccolta complessa viene considerato un membro di tale raccolta. Si supponga, ad esempio, un documento Hotel con una raccolta complessa Camere. Ogni stanza nella raccolta Rooms è considerata un elemento. Durante l'indicizzazione, nel suo complesso il motore di indicizzazione può elaborare in modo sicuro un massimo di 3.000 elementi nel documento. Questo limite è stato introdotto in api-version=2019-05-06 e si applica solo a raccolte complesse e non a raccolte di stringhe o a campi complessi.

4 Per la maggior parte dei livelli, la dimensione massima dell'indice è l'archiviazione totale disponibile nel servizio di ricerca. Per i servizi S2, S3 e S3 HD con più partizioni e quindi più spazio di archiviazione, le dimensioni massime di un singolo indice vengono fornite nella tabella. Si applica ai servizi di ricerca creati dopo il 3 aprile 2024. Gli indici per i servizi configurati con il modello serverless (anteprima) hanno una dimensione massima impostata nella tabella.

Se il provisioning del servizio viene effettuato in un cluster più potente, è possibile che i limiti massimi risultino diversi. I limiti rappresentano il denominatore comune. Gli indici creati in base alle specifiche precedenti sono portabili tra livelli di servizio equivalenti in qualsiasi area.

Limiti per i documenti

Ogni indice supporta fino al numero di documenti seguente:

  • 24 miliardi su Basic, S1, S2 e S3
  • 2 miliardi su S3 HD
  • 288 miliardi su L1
  • 576 miliardi su L2

Ogni documento può avere dimensioni fino a circa 16 MB. Il limite di dimensioni del documento si applica effettivamente alle dimensioni del payload della richiesta API di indicizzazione, ovvero 16 MB. Tale payload può essere un singolo documento o un batch di documenti. Per un batch con un solo documento, la dimensione massima del documento è di 16 MB di JSON.

Il limite di dimensioni del documento si applica all'indicizzazione in modalità push che carica i documenti in un servizio di ricerca. Se si usa un indicizzatore per l'indicizzazione in modalità pull, i file di origine possono essere di qualsiasi dimensione del file, soggetti ai limiti dell'indicizzatore. Per l'indicizzatore BLOB, i limiti delle dimensioni dei file sono maggiori per i livelli più elevati. Ad esempio, il limite S1 è 128 MB e il limite S2 è 256 MB.

Quando si stimano le dimensioni del documento, ricordarsi di indicizzare solo i campi che aggiungono valore agli scenari di ricerca. Escludere i campi di origine che non hanno alcun scopo nelle query che si intende eseguire.

Limiti delle dimensioni dell'indice vettoriale

Quando si indicizzano documenti con campi vettoriali, Azure AI Search costruisce indici vettoriali interni usando i parametri dell'algoritmo forniti.

Le dimensioni di questi indici vettoriali sono limitate da:

  • La memoria riservata alla ricerca vettoriale per il livello del tuo servizio (o SKU) nel modello tariffario Dedicated.
  • Limiti di archiviazione per indice nel modello di determinazione prezzi serverless.

Per indicazioni sulla gestione e l'ottimizzazione dell'archiviazione vettoriale, vedere Dimensioni dell'indice vettoriale e mantenersi al di sotto dei limiti.

I limiti dei vettori variano in base a:

Esistono limiti di vettori più elevati a partire da aprile 2024 per nuovi servizi di ricerca nelle regioni che forniscono la capacità aggiuntiva, ovvero la maggior parte di esse. Se si dispone di un servizio precedente in un'area supportata, verificare se è possibile aggiornare il servizio ai limiti di vettore più elevati.

Nel modello di determinazione prezzi serverless i limiti vettoriali vengono definiti per indice anziché per partizione.

  • Dimensione massima dell'indice vettoriale per indice (serverless): 300 MB
    • Questa dimensione rappresenta circa 30% di archiviazione totale degli indici, coerente con il rapporto vettore-archiviazione usato nei livelli di servizio dedicati.
    • Questa dimensione è un limite rigido per indice. I tentativi di superare questo limite durante l'indicizzazione hanno esito negativo.

Questa tabella mostra l'avanzamento dell'aumento della quota vettoriale in GB nel corso del tempo. La quota è per partizione, quindi se si ridimensiona un nuovo servizio Standard (S1) a 6 partizioni, la quota del vettore totale è 35 moltiplicata per 6.

Data di creazione servizio Basic S1 S2 S3/HD L1 L2
Prima del 1° luglio 20231 0,5 1 6 12 12 36
Dal 1° luglio 2023 al 3 aprile 20242 1 3 12 36 12 36
Dal 3 aprile 2024 al 17 maggio 20243 5 35 150 300 12 36
Dopo il 17 maggio 20244 5 35 150 300 150 300

1 Limiti iniziali del vettore durante l'anteprima anticipata.

2 Limiti del vettore durante il periodo di anteprima successivo. Tre regioni non hanno i limiti più elevati: Germania centro-occidentale, India occidentale, Qatar centrale.

3 Quota di vettori più elevata in base alle partizioni più grandi per i livelli e le aree supportati.

4 Maggiore quota vettoriale per più livelli e aree in base agli aggiornamenti delle dimensioni della partizione.

Il servizio applica una quota di dimensioni dell'indice vettoriale:

  • Dedicato a: Per partizione nel tuo servizio di ricerca
  • Serverless: Per indice

Questa quota è un limite rigido per garantire che il servizio rimanga integro. Ulteriori tentativi di indicizzazione dopo il superamento del limite comportano un errore. È possibile riprendere l'indicizzazione dopo aver liberato la quota disponibile:

  • Eliminazione di documenti vettoriali
  • Riduzione delle dimensioni del vettore o della dimensionalità
  • (Solo dedicato) Espansione orizzontale delle partizioni

Importante

I limiti dei vettori più elevati sono associati a dimensioni di partizione maggiori. Attualmente, i limiti di vettore più elevati non sono disponibili nelle aree seguenti, che sono soggette ai limiti di luglio-aprile.

  • Israele centrale
  • Qatar Centrale
  • Spagna centrale
  • India meridionale

Limiti dell'indicizzatore

Sono previsti tempi di esecuzione massimi per garantire il bilanciamento e la stabilità del servizio nel complesso, ma i set di dati di maggiori dimensioni potrebbero richiedere più tempo di indicizzazione rispetto al massimo consentito. Se un processo di indicizzazione non può essere completato nel tempo massimo consentito, provare a eseguirlo in modo pianificato. L'utilità di pianificazione tiene traccia dello stato di indicizzazione. Se un processo di indicizzazione pianificato viene interrotto per qualsiasi motivo, alla successiva esecuzione pianificata l'indicizzatore può riprendere dall'ultima interruzione.

Nota

Nel modello di determinazione prezzi serverless il comportamento dell'indicizzatore differisce dai servizi dedicati. La capacità non è definita da repliche o partizioni. Al contrario, i limiti per oggetto per servizio, i limiti di archiviazione per indice e la limitazione a livello di servizio regolano i limiti di indicizzazione. Il tempo massimo di esecuzione per ogni esecuzione di un indicizzatore Serverless Developer è di due ore.

Limiti relativi agli oggetti dell'indicizzatore e al throughput

Risorsa Gratuito 1 Basic 2 S1 S2 S3 S3 HD 3 L1 L2 Sviluppatore serverless
Numero massimo di indicizzatori 3 5 o 15 50 200 200 N/D 10 10 30
Numero massimo di origini dati 3 5 o 15 50 200 200 N/D 10 10 30 per servizio
Numero massimo di set di competenze 4 3 5 o 15 50 200 200 N/D 10 10 30
Carico di indicizzazione massimo per chiamata 10.000 documenti Limitato solo da max docs Limitato solo da max docs Limitato solo da max docs Limitato solo da max docs N/D Nessun limite Nessun limite Limitato solo da max docs
Pianificazione minima 5 minuti 5 minuti 5 minuti 5 minuti 5 minuti 5 minuti 5 minuti 5 minuti 5 minuti
Tempo massimo di esecuzione per ogni esecuzione dell'indicizzatore 5 1-3 o 3-10 min 2 o 24 ore 2 o 24 ore 2 o 24 ore 2 o 24 ore 2 ore 2 o 24 ore 2 o 24 ore 2 ore
Runtime dell'indicizzatore cumulativo per servizio 6 N/D N/D N/D N/D N/D 24 ore N/D N/D 24 ore

1 I servizi del livello Gratuito hanno un tempo massimo di esecuzione degli indicizzatori di 3 minuti per le origini BLOB e di 1 minuto per tutte le altre origini dati. La chiamata dell'indicizzatore viene eseguita una volta ogni 180 secondi. Per l'indicizzazione di intelligenza artificiale che chiama Foundry Tools, i servizi gratuiti sono limitati a 20 transazioni gratuite per indicizzatore al giorno, in cui una transazione viene definita come documento che passa correttamente attraverso la pipeline di arricchimento. Suggerimento: è possibile reimpostare un indicizzatore per reimpostarne il conteggio.

2 I servizi Basic creati prima di dicembre 2017 hanno limiti inferiori (5 anziché 15) per gli indicizzatori, le origini dati e i set di competenze.

3 Il supporto dell'indicizzatore HD S3 è in anteprima e richiede la versione dell'API 2025-11-01-preview REST o successiva. Gli indicizzatori HD S3 vengono eseguiti solo nell'ambiente di esecuzione multi-tenant e non supportano risorse di collegamento privato condiviso. Durante la fase di anteprima, il supporto dell'indexer S3 HD è particolarmente indicato per carichi di lavoro di piccole dimensioni (dimensione dell'indice di circa 1 GB) che non richiedono competenze specifiche o ne richiedono solo di minime. Per indicazioni su comportamento aggregato, monitoraggio e pianificazione, vedere Esecuzione dell'indicizzatore in Serverless e S3 HD.

4 Numero massimo di 30 competenze per set di competenze.

5 Per quanto riguarda la durata massima di 2 o 24 ore degli indicizzatori: un massimo di 2 ore è la durata più comune e quella che dovrebbe essere pianificata. Si riferisce agli indicizzatori eseguiti nell'ambiente pubblico, che scarica processi computazionali intensivi, lasciando più risorse disponibili per le query. Il limite di 24 ore si applica se si configura l'indicizzatore per l'esecuzione in un ambiente privato usando solo l'infrastruttura allocata al servizio di ricerca. Alcuni indicizzatori meno recenti non sono in grado di essere eseguiti nell'ambiente pubblico e tali indicizzatori hanno sempre un intervallo di elaborazione di 24 ore. Se gli indicizzatori non pianificati vengono eseguiti in modo continuo per 24 ore, è possibile presupporre che tali indicizzatori non possano essere migrati all'infrastruttura più recente. Come regola generale, per i processi di indicizzazione che non possono terminare entro due ore, impostare l'indicizzatore su una pianificazione di 5 minuti in modo che l'indicizzatore possa selezionare rapidamente il punto in cui è stato interrotto. Nel livello gratuito, il tempo di esecuzione massimo di 3-10 minuti è per gli indicizzatori con set di competenze.

6 Nei servizi S3 HD e Serverless, tutti gli indicizzatori condividono 24 ore di runtime cumulativo per servizio in ogni finestra UTC di 24 ore. Per informazioni sul comportamento della quota, il monitoraggio e la pianificazione, vedere Esecuzione dell'indicizzatore in Serverless e S3 HD.

Limiti dei file di origine per indicizzatori simili a BLOB

L'elaborazione dei file avviene in fasi e ogni fase presenta limiti specifici:

  1. Un connettore dell'origine dati scarica un elemento di origine, nel rispetto dei limiti del connettore specifici dell'origine.
  2. Azure AI Search estrae il contenuto dell'elemento, soggetto alle dimensioni massime del file di origine e ai limiti dei caratteri estratti nella tabella seguente.
  3. Facoltativamente, un set di competenze invia tale contenuto ai servizi downstream, in cui il limite di input di una singola competenza può essere inferiore a quello estratto dall'indicizzatore.

Le dimensioni massime del file di origine e i limiti dei caratteri estratti nella tabella seguente si applicano agli indicizzatori Archiviazione BLOB di Azure, ADLS Gen2, SharePoint in Microsoft 365, OneLake e File di Azure indicizzatori. Per i limiti per competenza, vedere l'articolo di riferimento per ogni competenza nel set di competenze.

Risorsa Gratuito Basic S1 S2 S3 S3 HD L1 L2 Sviluppatore serverless
Dimensioni massime del file di origine, MB 24 16 16 128 256 256 N/D 256 256 256
Numero massimo di caratteri estratti da un file di origine 134 256.000 512.000 4 mil 8 mil 16 mil N/D 4 mil 4 mil 16 mil

1 Il numero massimo di caratteri è basato su unità di codice Unicode, in particolare UTF-16.

2 Quando si usa la delimitedText modalità di analisi per i file CSV, si applica un limite di dimensioni del buffer di 10 MB per riga di file.

3 Quando si usa la delimitedText modalità di analisi per i file CSV, il limite "dimensioni massime del contenuto estratto" non si applica.

4 Gli indicizzatori simili a BLOB includono l'indicizzatore Archiviazione BLOB di Azure (indicizzatore BLOB), l'indicizzatore ADLS Gen2, SharePoint nell'indicizzatore Microsoft 365, l'indicizzatore OneLake e File di Azure indicizzatore. L'origine dati dei file caricati direttamente non utilizza un indicizzatore e ha limiti distinti.

Gli indicizzatori possono accedere ad altre risorse di Azure tramite endpoint privati gestiti tramite l'API della risorsa del collegamento privato condiviso. Questa sezione descrive i limiti associati a questa funzionalità.

Nota

Il livello Developer del modello tariffario Serverless non supporta collegamenti privati condivisi né un perimetro di sicurezza di rete (NSP) per le origini dati. Sono supportati gli endpoint privati e le regole del firewall IP per una connessione privata a un servizio del livello Serverless Developer.

Risorsa Gratuito Basic S1 S2 S3 S3 HD L1 L2 Sviluppatore serverless
Supporto indicizzatore endpoint privato NO NO NO
Supporto per endpoint privato per gli indicizzatori con competenze 1 NO NO NO NO
Supporto endpoint privato per set di competenze con una competenza di incorporamento 2 NO NO NO
Numero massimo di endpoint privati N/D 10 o 30 100 400 400 N/D 20 20 N/D
Numero massimo di tipi di risorse distinti 3 N/D 4 7 15 15 N/D 4 4 N/D

1 L'arricchimento tramite intelligenza artificiale e l'analisi delle immagini sono attività complesse e usano una quantità estremamente elevata della potenza di elaborazione disponibile. Per questo motivo, le connessioni private vengono disabilitate ai livelli inferiori allo scopo di garantire le prestazioni e la stabilità del servizio di ricerca stesso. Nei servizi Di base, le connessioni private a una risorsa Microsoft Foundry non sono supportate per mantenere la stabilità del servizio. Per il livello S1, assicurarsi che il servizio sia stato creato con limiti più elevati dopo il 3 aprile 2024. Gli indicizzatori con più di 2 competenze Incorporamento Azure OpenAI o Incorporamenti multimodali di Visione di Azure sono limitati nell'esecuzione in un ambiente privato e le connessioni private non sono disponibili.

2 Le connessioni private a un modello di embedding sono supportate nei servizi di ricerca di base e S1 ad alta capacità creati dopo il 3 aprile 2024, con i limiti più elevati per l'archiviazione e l'elaborazione computazionale.

3 Il numero di tipi di risorse distinti viene calcolato come numero di valori univoci groupId usati in tutte le risorse di collegamento privato condiviso per un determinato servizio di ricerca, indipendentemente dallo stato della risorsa.

Limiti per i sinonimi

Il numero massimo di mappe sinonimie varia in base al livello. Ogni regola può avere fino a 20 espansioni, dove un'espansione è un termine equivalente. Ad esempio, data la parola "gatto", l'associazione a "kitty", "felino" e "felis" (il genere dei gatti) equivale a tre espansioni.

Risorsa Gratuito Basic S1 S2 S3 S3 HD L1 L2 Sviluppatore serverless
Numero massimo di mappe di sinonimi 3 3 5 10 20 20 10 10 20 per servizio
Numero massimo di regole per mappa 5000 20000 20000 20000 20000 20000 20000 20000 20000

Limiti degli alias di indice

Il numero massimo di alias di indice varia in base al livello e alla data di creazione del servizio. In tutti i livelli, se il servizio è stato creato dopo ottobre 2022, il numero massimo di alias è doppio del numero massimo di indici consentiti. Se il servizio è stato creato prima di ottobre 2022, il limite è il numero di indici consentiti.

Nota

Il tier Developer del modello Serverless non supporta gli alias di indici.

Data di creazione servizio Gratuito Basic S1 S2 S3 S3 HD L1 L2 Sviluppatore serverless
Prima di ottobre 2022 3 5 o 15 1 50 200 200 1000 per partizione o 3000 per servizio 10 10 N/D
Dopo ottobre 2022 6 30 100 400 400 2000 per partizione o 6000 per servizio 20 20 N/D

1 I servizi Basic creati prima di dicembre 2017 hanno limiti inferiori (5 anziché 15) per gli indici.

Limiti del recupero agentico

Una Knowledge Base specifica una o più origini di informazioni e un'attività di ragionamento di recupero che controlla il livello di elaborazione LLM (Large Language Model) per il recupero agentico. I limiti variano in base al piano tariffario, alla versione dell'API e al livello di ragionamento.

Risorsa Gratuito Basic S1 S2 S3 S3 HD L1 L2 Sviluppatore serverless
Numero massimo di origini di conoscenze per servizio 3 5 o 15 1 50 200 200 0 10 10 30
Numero massimo di knowledge base per servizio 3 5 o 15 1 50 200 200 0 10 10 30
Numero massimo di origini delle informazioni per knowledge base 3 5 o 10 1 10 10 10 0 10 10 10

1 I servizi di base creati prima del 3 aprile 2024 hanno limiti inferiori (5) per le origini delle conoscenze e le knowledge base.

Selezione della fonte di conoscenza durante il recupero

Una base di conoscenza può contenere fino al limite massimo previsto per il livello indicato sopra, indipendentemente dalla versione dell'API o dal livello di impegno di ragionamento per il recupero. La versione dell'API e il livello di sforzo di ragionamento incidono invece su quante fonti di conoscenza è possibile selezionare in fase di recupero.

Versione dell'API Sforzo di ragionamento per il recupero Gratuito Basic S1 S2 S3 S3 HD L1 L2
2026-05-01-preview e versioni successive minimal, low, medium 3 5 o 10 1 10 10 10 0 10 10
2026-04-01, 2025-11-01-preview minimal 2 3 5 o 10 1 10 10 10 0 10 10
2025-11-01-preview low 3 3 3 3 3 0 3 3
2025-11-01-preview medium 3 5 5 5 5 0 5 5

2025-08-01-preview utilizza il contratto legacy dell'agente knowledge e non supporta retrievalReasoningEffort.

2 Lo minimal sforzo di ragionamento usa tutte le origini delle informazioni nella Knowledge Base perché ignora la pianificazione delle query basata su LLM.

Recuperare il runtime di richiesta

Il maxRuntimeInSeconds limite è lo stesso tra i livelli supportati.

Requisiti minimi Default Massimo
10 secondi 90 secondi 600 secondi (10 minuti)

Il valore massimo si applica solo alla richiesta di recupero Azure AI Search. Per esempi di configurazione, vedere Eseguire l'override dello sforzo predefinito di ragionamento e impostare i limiti delle richieste.

Limiti dei dati (arricchimento tramite intelligenza artificiale)

Si applicano limiti ai dati a una pipeline di arricchimento basata sull'IA che richiama Azure Language in Foundry Tools. L'input massimo è di 50.000 caratteri, come misurato da String.Length, per la competenza Riconoscimento entità, la competenza Collegamento di entità, la competenza Estrazione frasi chiave, la competenza rilevamento lingua e la competenza Rilevamento informazioni personali. La competenza Sentiment ha un massimo di 5.000 caratteri.

Usare la competenza Divisione testo quando è necessario dividere testo più grande prima dell'elaborazione downstream.

Questi limiti si applicano a entrambi i modelli tariffari, Dedicated e Serverless.

Limiti della limitazione delle richieste

I limiti di limitazione consentono di garantire la stabilità del servizio controllando la frequenza delle richieste API.

Nel modello di tariffazione Dedicated, la limitazione della larghezza di banda si basa sulle unità di ricerca (repliche × partizioni).

Nel modello di tariffazione Serverless, la limitazione della larghezza di banda non si basa sulle unità di ricerca. Al contrario, i limiti delle operazioni a livello di servizio e il comportamento complessivo del consumo regolano la velocità effettiva. I limiti di utilizzo e servizio gestiscono la capacità, non la configurazione delle repliche e delle partizioni.

Operation Dedicato (per unità di ricerca) Serverless (per servizio o per indice)
Elencare gli indici (GET /indexes) 3 richieste/sec/SU 3 richieste/sec
Ottenere l'indice (GET /indexes/{index}) 10 richieste/sec/SU 10 richieste/sec
Creare un indice (POST /indexes) 12 richieste/min/SU 12 richieste/min
Creare o aggiornare l'indice (PUT /indexes/{index}) 6 richieste/sec/SU 6 richieste/sec
Eliminare l'indice (DELETE /indexes/{index}) 12 richieste/min/SU 12 richieste/min
Statistiche del servizio (GET /servicestats) 4 richieste/sec/SU 4 richieste/sec
Query di ricerca (POST /indexes/{index}/docs/search) Varia in funzione del numero di SU e della complessità delle query 50 query al secondo (limite di lettura aggregata per indice)
Documenti di indice (POST /indexes/{index}/docs/index) Dipende dal numero di SU e dal carico di lavoro di indicizzazione 5 richieste/sec per indice
Suggerimento (POST /indexes/{index}/docs/suggest) Varia in base al numero di SU Non definito in modo esplicito
Completamento automatico (POST /indexes/{index}/docs/completamento automatico) Varia in base al numero di SU Non definito in modo esplicito

Limiti di limitazione delle richieste del classificatore semantico

Il ranker semantico usa un sistema di accodamento per gestire le richieste simultanee. Questo sistema consente ai servizi di ricerca di ottenere il maggior numero possibile di query al secondo. Quando viene raggiunto il limite di richieste simultanee, il sistema inserisce richieste aggiuntive in una coda. Se la coda è piena, il sistema rifiuta ulteriori richieste e queste devono essere riprovate.

Il numero totale di query al secondo del sistema di classificazione semantica varia in base ai seguenti fattori:

  • Livello del servizio di ricerca. Sia la capacità della coda che i limiti delle richieste simultanei variano in base al livello.
  • Numero di unità di ricerca nel servizio di ricerca. Il modo più semplice per aumentare il numero massimo di query di classificazione semantica simultanee consiste nell'aggiungere altre unità di ricerca al servizio di ricerca.
  • La capacità totale del classificatore semantico disponibile nell'area.
  • Quantità di tempo impiegato per gestire una query usando il ranker semantico. Questo tempo varia in base al carico del servizio di ricerca.

La tabella seguente descrive i limiti di limitazione delle richieste del classificatore semantico per livello, a seconda della capacità disponibile nell'area. È possibile contattare il supporto tecnico Microsoft per richiedere un aumento del limite.

Risorsa Basic S1 S2 S3 S3 HD L1 L2 Sviluppatore serverless
Numero massimo di richieste simultanee (per unità di ricerca) 2 3 4 4 4 4 4 4 (per servizio)
Dimensioni massime della coda delle richieste (per unità di ricerca) 4 6 8 8 8 8 8 8 (per servizio)

Limiti delle richieste API

Esistono limiti per le query perché le query non associate possono destabilizzare il servizio di ricerca. In genere, tali query vengono create a livello di codice. Se l'applicazione genera query di ricerca tramite codice, progettala in modo che non generi query di dimensioni illimitate.

I limiti per i payload esistono per motivi simili, garantendo la stabilità del servizio di ricerca. Il limite si applica all'intera richiesta, inclusi tutti i relativi componenti. Ad esempio, se la richiesta esegue il batch di diversi documenti o comandi, l'intera richiesta deve rientrare nel limite supportato.

Se è necessario superare un limite supportato, testare il carico di lavoro in modo da sapere cosa aspettarsi.

Ad eccezione di quanto indicato, le richieste API seguenti si applicano a tutte le interfacce programmabili, inclusi gli SDK di Azure.

Generale:

  • Il limite massimo di payload supportato è di 16 MB per l'indicizzazione e la richiesta di query tramite l'API REST e gli SDK.
  • Lunghezza massima dell'URL di 8 KB (si applica solo alle API REST).

API di indicizzazione:

  • Sono supportati max 1.000 documenti per ogni batch di carichi, unioni o eliminazioni di indice.
  • Ogni richiesta supporta tra 1 e 32.000 azioni di indicizzazione.

API query:

  • Massimo 10 campi in una query vettoriale
  • Massimo 32 campi nella clausola $orderby.
  • Massimo 100.000 caratteri in una clausola di ricerca.
  • Il numero massimo di clausole nella ricerca è 3.000.
  • Limiti massimi per query con caratteri jolly ed espressioni regolari, come applicato da Lucene. Limita il numero di modelli, varianti o corrisponde a 1.000 istanze. Questo limite è previsto per evitare l'overload del motore.

Termini di ricerca:

  • La dimensione massima supportata del termine di ricerca è di 32.766 byte (32 KB meno 2 byte) di testo con codifica UTF-8. Si applica alla ricerca di parole chiave e alla proprietà text della ricerca vettoriale.
  • La dimensione massima supportata dei termini di ricerca è di 1.000 caratteri per la ricerca con prefisso e la ricerca regex.

Limiti delle risposte API

  • Ogni pagina dei risultati della ricerca restituisce fino a 1.000 documenti.
  • Ogni richiesta dell'API Suggerisci restituisce fino a 100 suggerimenti.

Il motore di ricerca restituisce 50 risultati per impostazione predefinita, ma è possibile eseguire l'override di questo parametro fino al limite massimo.

Limiti delle chiavi API

Usare le chiavi API per l'autenticazione del servizio. Esistono due tipi di chiavi API. Le chiavi di amministrazione, specificate nell'intestazione della richiesta, forniscono l'accesso in lettura/scrittura completo al servizio. Le chiavi di query, specificate nell'URL, sono di sola lettura e in genere distribuite alle applicazioni client.

  • Ogni servizio supporta fino a due chiavi di amministrazione.
  • Ogni servizio supporta fino a 50 chiavi di query.