Servicequota en -limieten
Deze inhoud is van toepassing op: v2.1 | Nieuwste versie: v4.0 (preview)
Dit artikel bevat zowel een beknopt overzicht als een gedetailleerde beschrijving van de Quota's en limieten van de Azure AI Document Intelligence-service voor alle prijscategorieën. Het bevat ook enkele aanbevolen procedures om aanvraagbeperking te voorkomen.
Modelgebruik
Ondersteunde documenttypen | Read | Indeling | Vooraf samengestelde modellen | Aangepaste modellen | Mogelijkheden voor invoegtoepassingen |
---|---|---|---|---|---|
✔️ | ✔️ | ✔️ | ✔️ | ✔️ | |
Afbeeldingen: JPEG/JPG , PNG , BMP , , TIFF HEIF |
✔️ | ✔️ | ✔️ | ✔️ | ✔️ |
Microsoft Office: DOCX , PPTX XLS |
✔️ | ✔️ | ✖️ | ✖️ | ✖️ |
✔️ = ondersteund ✖️ = Niet ondersteund
Ondersteunde documenttypen | Read | Indeling | Vooraf samengestelde modellen | Aangepaste modellen |
---|---|---|---|---|
✔️ | ✔️ | ✔️ | ✔️ | |
Afbeeldingen: JPEG/JPG , PNG , BMP , , TIFF HEIF |
✔️ | ✔️ | ✔️ | ✔️ |
Microsoft Office: DOCX , PPTX XLS |
✔️ | ✖️ | ✖️ | ✖️ |
✔️ = ondersteund ✖️ = Niet ondersteund
Billing
Document Intelligence-facturering wordt maandelijks berekend op basis van het modeltype en het aantal geanalyseerde pagina's. U vindt metrische gegevens over gebruik op het dashboard met metrische gegevens in Azure Portal. In het dashboard wordt het aantal pagina's weergegeven dat door Azure AI Document Intelligence wordt verwerkt. U kunt de geschatte kosten voor de resource controleren met behulp van de Azure-prijscalculator. Zie Gebruik controleren en kosten schatten voor gedetailleerde instructies. Hier volgen enkele details:
Wanneer u een document verzendt voor analyse, analyseert de service alle pagina's, tenzij u een paginabereik opgeeft met behulp van de
pages
parameter in uw aanvraag. Wanneer de service Microsoft Excel- en PowerPoint-documenten analyseert via het lees-, OCR- of indelingsmodel, wordt elke Excel-werkblad en PowerPoint-dia als één pagina geteld.Wanneer de service PDF- en TIFF-bestanden analyseert, wordt elke pagina in het PDF-bestand of elke afbeelding in het TIFF-bestand geteld als één pagina zonder maximale tekenlimieten.
Wanneer de service Microsoft Word- en HTML-bestanden analyseert die door de lees- en indelingsmodellen worden ondersteund, worden pagina's in blokken van elk 3000 tekens geteld. Als uw document bijvoorbeeld 7000 tekens bevat, worden de twee pagina's met elk 3000 tekens en één pagina met 1000 tekens opgetellen tot een totaal van drie pagina's.
De lees- en indelingsmodellen bieden geen ondersteuning voor analyse van ingesloten of gekoppelde afbeeldingen in Microsoft Word-, Excel-, PowerPoint- en HTML-bestanden. Daarom telt de service ze niet als toegevoegde installatiekopieën.
Het trainen van een aangepast model is altijd gratis met Document Intelligence. Er worden alleen kosten in rekening gebracht wanneer de service een model gebruikt om een document te analyseren.
Containerprijzen zijn hetzelfde als de prijzen van cloudservices.
Document Intelligence biedt een gratis laag (F0) waar u alle functies van Document Intelligence kunt testen.
Document Intelligence heeft een prijsmodel op basis van toezeggingen voor grote workloads.
Het indelingsmodel is vereist voor het genereren van labels voor uw gegevensset voor aangepaste training. Als de gegevensset die u gebruikt voor aangepaste training geen labelbestanden beschikbaar heeft, genereert de service deze voor u en factureert u voor het gebruik van het indelingsmodel.
Quotum | Gratis (F0)1 | Standard (S0) |
---|---|---|
Limiet voor transacties per seconde | 1 | 15 (standaardwaarde) |
Verstelbaar | Nee | Ja 2 |
Maximale documentgrootte | 4 MB | 500 MB |
Verstelbaar | Nee | Nr. |
Maximum aantal pagina's (analyse) | 2 | 2000 |
Verstelbaar | Nee | Nr. |
Maximale grootte van labelsbestand | 10 MB | 10 MB |
Verstelbaar | Nee | Nr. |
Maximale grootte van OCR json-antwoord | 500 MB | 500 MB |
Verstelbaar | Nee | Nr. |
Maximum aantal sjabloonmodellen | 500 | 5000 |
Verstelbaar | Nee | Nr. |
Maximum aantal neurale modellen | 100 | 500 |
Verstelbaar | Nee | Nr. |
Aangepast modelgebruik
Quotum | Gratis (F0) 1 | Standard (S0) |
---|---|---|
Limiet voor opstellen model | 5 | 500 (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Grootte van trainingsgegevensset * Neurale en Generatieve | 1 GB 3 | 1 GB (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Grootte van trainingsgegevensset * Sjabloon | 50 MB 4 | 50 MB (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Maximum aantal pagina's (training) * sjabloon | 500 | 500 (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Maximum aantal pagina's (training) * Neurale en Generatieve | 50,000 | 50.000 (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Aangepaste neurale model trainen | 10 uur per maand 5 | geen limiet (betalen per uur) |
Verstelbaar | Nee | Ja 3 |
Maximum aantal pagina's (training) * Classificatie | 10,000 | 10.000 (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Maximum aantal documenttypen (klassen) * Classificatie | 500 | 500 (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Grootte van trainingsgegevensset * Classificatie | 1 GB | 2 GB (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Minimum aantal steekproeven per klasse * Classificatie | 5 | 5 (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Aangepast modelgebruik
Quotum | Gratis (F0) 1 | Standard (S0) |
---|---|---|
Limiet voor opstellen model | 5 | 200 (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Grootte van trainingsgegevensset * Neuraal | 1 GB 3 | 1 GB (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Grootte van trainingsgegevensset * Sjabloon | 50 MB 4 | 50 MB (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Maximum aantal pagina's (training) * sjabloon | 500 | 500 (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Maximum aantal pagina's (training) * Neurale | 50,000 | 50.000 (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Aangepaste neurale model trainen | 10 per maand | 20 per maand |
Verstelbaar | Nee | Ja 3 |
Maximum aantal pagina's (training) * Classificatie | 10,000 | 10.000 (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Maximum aantal documenttypen (klassen) * Classificatie | 500 | 500 (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Grootte van trainingsgegevensset * Classificatie | 1 GB | 1 GB (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Minimum aantal steekproeven per klasse * Classificatie | 5 | 5 (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Aangepast modelgebruik
Quotum | Gratis (F0) 1 | Standard (S0) |
---|---|---|
Limiet voor opstellen model | 5 | 200 (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Grootte van trainingsgegevensset * Neuraal | 1 GB 3 | 1 GB (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Grootte van trainingsgegevensset * Sjabloon | 50 MB 4 | 50 MB (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Maximum aantal pagina's (training) * sjabloon | 500 | 500 (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Maximum aantal pagina's (training) * Neurale | 50,000 | 50.000 (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Aangepaste neurale model trainen | 10 per maand | 20 per maand |
Verstelbaar | Nee | Ja 3 |
Maximum aantal pagina's (training) * Classificatie | 10,000 | 10.000 (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Maximum aantal documenttypen (klassen) * Classificatie | 500 | 500 (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Grootte van trainingsgegevensset * Classificatie | 1 GB | 1 GB (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Minimum aantal steekproeven per klasse * Classificatie | 5 | 5 (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Limieten voor aangepaste modellen
Quotum | Gratis (F0) 1 | Standard (S0) |
---|---|---|
Limiet voor opstellen model | 5 | 200 (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Grootte van trainingsgegevensset | 50 MB | 50 MB (standaardwaarde) |
Verstelbaar | Nee | Nr. |
Maximum aantal pagina's (training) | 500 | 500 (standaardwaarde) |
Verstelbaar | Nee | Nr. |
1 Prijscategorie Gratis (F0) zie ook maandelijkse vergoedingen op de pagina met prijzen.
2 Zie best practices en aanpassingsinstructies.
3 Trainingsaantal neurale modellen wordt elke kalendermaand opnieuw ingesteld. Open een ondersteuningsaanvraag om de maandelijkse trainingslimiet te verhogen.
4 Deze limiet geldt voor alle documenten in uw map met trainingsgegevenssets voordat er updates met betrekking tot labels worden bijgewerkt.
5 Deze limiet geldt alleen voor
v 4.0 (2024-07-31)
aangepaste neurale modellen.v 4.0
Vanaf 10 uur ondersteunen we het trainen van grotere documenten voor langere duur (maximaal 10 uur gratis en worden er kosten in rekening gebracht). Raadpleeg de aangepaste nerual modelpagina voor meer informatie.
Gedetailleerde beschrijving, quotaaanpassing en best practices
Voordat u een quotumverhoging aanvraagt (indien van toepassing), moet u controleren of het noodzakelijk is. De Document Intelligence-service maakt gebruik van automatisch schalen om de vereiste rekenbronnen on-demand
te brengen, de klantkosten laag te houden en ongebruikte resources ongedaan te maken door een overmatige hoeveelheid hardwarecapaciteit niet te onderhouden.
Als uw toepassing antwoordcode 429 (te veel aanvragen) retourneert en uw workload binnen de gedefinieerde limieten valt: waarschijnlijk wordt de service omhoog geschaald naar uw vraag, maar moet de vereiste schaal nog worden bereikt. De service beschikt dus niet onmiddellijk over voldoende resources om de aanvraag te verwerken. Deze status is doorgaans tijdelijk en duurt niet lang.
Algemene aanbevolen procedures om beperking tijdens automatisch schalen te beperken
Als u problemen met betrekking tot beperking wilt minimaliseren (antwoordcode 429), raden we u aan de volgende technieken te gebruiken:
- Logica voor opnieuw proberen implementeren in uw toepassing
- Vermijd grote wijzigingen in de workload. De workload geleidelijk verhogen
Voorbeeld. Uw toepassing gebruikt Document Intelligence en uw huidige workload is 10 TPS (transacties per seconde). De volgende seconde verhoogt u de belasting tot 40 TPS (dat is vier keer meer). De service wordt onmiddellijk opgeschaald om aan de nieuwe belasting te voldoen, maar dit kan waarschijnlijk niet binnen een seconde, dus sommige aanvragen krijgen antwoordcode 429.
In de volgende secties worden specifieke gevallen beschreven van het aanpassen van quota. Ga naar Document Intelligence: limiet voor gelijktijdige aanvragen verhogen
Limiet voor transacties per seconde aanvragen verhogen
Standaard is het aantal transacties per seconde beperkt tot 15 transacties per seconde voor een Document Intelligence-resource. Voor de prijscategorie Standard kan dit aantal worden verhoogd. Voordat u de aanvraag indient, moet u ervoor zorgen dat u bekend bent met het materiaal in deze sectie en op de hoogte bent van deze aanbevolen procedures.
Het verhogen van de limiet voor gelijktijdige aanvragen heeft geen directe invloed op uw kosten. Document Intelligence-service maakt gebruik van het model 'Alleen betalen voor wat u gebruikt'. De limiet bepaalt hoe hoog de service kan worden geschaald voordat uw aanvragen worden beperkt.
De bestaande waarde van de parameter Voor gelijktijdige aanvraaglimiet is niet zichtbaar via Azure Portal, opdrachtregelprogramma's of API-aanvragen. Als u de bestaande waarde wilt controleren, dient u een Azure-ondersteuningsaanvraag in.
Als u uw transacties per seconde wilt verhogen, kunt u automatisch schalen inschakelen voor uw resource. Volg dit document om automatisch schalen in te schakelen voor uw resource * automatisch schalen in te schakelen. U kunt ook een verhoogde TPS-ondersteuningsaanvraag indienen.
De vereiste informatie gereed hebben
Resource-id voor documentinformatie
Regio
Basismodelgegevens:
- Meld u aan bij het Azure Portal
- Selecteer de Document Intelligence-resource waarvoor u de transactielimiet wilt verhogen
- Selecteer -Properties- (-Resource Management- groep)
- Kopieer en sla de waarden van de volgende velden op:
- Resource-id
- Locatie (uw eindpuntregio)
Ondersteuningsaanvraag maken en indienen
Initieer de verhoging van de limiet voor transacties per seconde (TPS) voor uw resource door de ondersteuningsaanvraag in te dienen:
- Zorg ervoor dat u over de vereiste informatie beschikt
- Meld u aan bij het Azure Portal
- Selecteer de Document Intelligence-resource waarvoor u de TPS-limiet wilt verhogen
- Selecteer -Nieuwe ondersteuningsaanvraag- (-Ondersteuning en probleemoplossing- groep). Er wordt een nieuw venster weergegeven met automatisch ingevulde informatie over uw Azure-abonnement en Azure-resource
- Voer -Samenvatting in (zoals 'TPS-limiet voor documentinformatie verhogen')
- Selecteer Quotum of gebruiksvalidatie voor het veld probleemtype.
- Selecteer -Volgende: Oplossingen-
- Ga verder met het maken van de aanvraag
- Voer de volgende informatie in het veld -Description- in, onder het tabblad Details:
- een opmerking: de aanvraag gaat over het quotum voor documentinformatie.
- Geef een TPS-verwachting die u wilt schalen om te voldoen.
- Azure-resourcegegevens die u hebt verzameld.
- Voltooi het invoeren van de vereiste gegevens en selecteer de knop -Maken in -Beoordelen en maken- tabblad
- Noteer het nummer van de ondersteuningsaanvraag in Azure Portal-meldingen. Zoek naar ondersteuning om binnenkort contact met u op te nemen voor verdere verwerking.
Voorbeeld van een best practice voor een workloadpatroon
In dit voorbeeld wordt de aanbevolen aanpak te volgen om mogelijke aanvraagbeperking te beperken omdat automatische schaalaanpassing wordt uitgevoerd. Het is geen exact recept, maar slechts een sjabloon die we nodig hebben om te volgen en aan te passen.
Stel dat voor een Document Intelligence-resource de standaardlimiet is ingesteld. Start de workload om uw analyseaanvragen in te dienen. Als u merkt dat u regelmatig beperkingen ondervindt met antwoordcode 429, begint u met het implementeren van een exponentiële back-off op de GET-aanvraag voor het analyseren van reacties. Door een geleidelijk langere wachttijd te gebruiken tussen nieuwe pogingen voor opeenvolgende foutreacties, bijvoorbeeld een 2-5-13-34-patroon van vertragingen tussen aanvragen. Over het algemeen raden we aan om het antwoord voor een analyse meer dan één keer per 2 seconden aan te roepen voor een bijbehorende POST-aanvraag.
Als u merkt dat u wordt beperkt tot het aantal POST-aanvragen voor documenten dat wordt ingediend, kunt u overwegen om een vertraging tussen de aanvragen toe te voegen. Als uw workload een hogere mate van gelijktijdige verwerking vereist, moet u vervolgens een ondersteuningsaanvraag maken om uw servicelimieten voor transacties per seconde te verhogen.
Over het algemeen raden we u aan om de workload en de workloadpatronen te testen voordat u naar productie gaat.