Notitie
Voor toegang tot deze pagina is autorisatie vereist. U kunt proberen u aan te melden of de directory te wijzigen.
Voor toegang tot deze pagina is autorisatie vereist. U kunt proberen de mappen te wijzigen.
Notitie
Azure AI Zoeken is beschikbaar via de Azure-portal, REST API's en Azure-SDK's. Het vormt ook een basis voor Foundry IQ, de beheerde kennislaag die bedrijfsinhoud transformeert in herbruikbare, machtigingsbewuste knowledge bases voor agents in de Microsoft Foundry-portal.
Wanneer u een zoekservice maakt, moet u een prijsmodel en servicelaag kiezen. Azure AI Zoeken biedt twee prijsmodellen, die elk geschikt zijn voor verschillende workloadpatronen, met bijbehorende servicelagen die de capaciteit en functies bepalen:
| Prijsmodel | Ideaal voor | Hoe u gefactureerd wordt |
|---|---|---|
| Dedicated | Stabiele, voorspelbare workloads met hoog gebruik | Vaste capaciteit via zoekeenheden (SU’s); uurtarief op basis van de keuze voor een serviceniveau |
| Serverless (preview) | Sporadische, piekgerichte of sterk variabele werklasten | Op verbruik gebaseerd: gemeten op rekeneenheden (RU's) en geïndexeerde opslag (GB/maand) |
Notitie
Toegewezen modelzoekeenheden (RU's) en serverloze rekeneenheden (CU's) zijn niet hetzelfde en kunnen niet door elkaar worden gebruikt. Gebruik geen prijscalculators of schattingen op basis van SU voor serverloze workloads.
Beide modellen bieden dezelfde kernzoekfuncties (met enkele kleine uitzonderingen voor de serverloze preview die hieronder wordt vermeld). Het belangrijkste verschil is prijs- en schaalgedrag, geen mogelijkheden.
Als u het toegewezen prijsmodel selecteert, moet u uw workloadbehoeften schatten en vervolgens een servicelaag kiezen met de juiste vooraf ingerichte capaciteit.
Als u het serverloze prijsmodel selecteert, hoeft u geen vooraf ingerichte servicelaag te selecteren, maar worden de prijzen op basis van verbruik gebruikt, zodat prestatieoptimalisatie direct van invloed is op de kosten.
Serverless (previewversie)
Important
De serverloze ontwikkelaarslaag is momenteel beschikbaar als preview-versie. Deze preview wordt geleverd zonder service level agreement en wordt niet aanbevolen voor productieworkloads. Bepaalde functies worden mogelijk niet ondersteund of hebben mogelijk beperkte mogelijkheden. Zie Aanvullende gebruiksvoorwaarden voor Microsoft Azure Previews voor meer informatie.
Facturering voor de serverloze ontwikkelaarslaag is nog niet ingeschakeld tijdens de preview. Geschatte kosten voor uw gebruik zijn beschikbaar in de Azure portal en telemetrie, maar dat gebruik wordt niet weergegeven op uw Azure factuur tijdens deze initiële periode. Microsoft ontvangt ten minste 30 dagen kennisgeving voordat de facturering begint. Het uitstel van facturering tijdens deze preview is tijdelijk. Serverless Developer is een betaald abonnement en u bent verantwoordelijk voor eventuele kosten die in rekening worden gebracht zodra de facturering start.
De serverloze ontwikkelaarslaag biedt geen ondersteuning voor migratie naar of van andere prijscategorieën en sommige functies die beschikbaar zijn in andere lagen, worden niet ondersteund tijdens openbare preview. Servicelimieten, ondersteunde functies en prijsgegevens kunnen vóór algemene beschikbaarheid veranderen.
De preview is momenteel alleen beschikbaar in VS - west-centraal, Zwitserland - noord en Japan - oost.
Het serverloze prijsmodel is een aanbieding op basis van verbruik die automatisch rekenkracht en opslag schaalt op basis van uw workload. Hierdoor hoeft u geen capaciteit vooraf in te richten, zodat u alleen betaalt voor de resources die u gebruikt.
Met het serverloze model configureert u geen replica's, partities of zoekeenheden. In plaats daarvan beheert de service de capaciteit dynamisch als reactie op het queryvolume, de indexeringsactiviteit en de complexiteit van de werkbelasting.
Facturering is gebaseerd op twee primaire dimensies:
- Rekengebruik: gemeten in rekeneenheden per uur (CU/h) en wordt in rekening gebracht op basis van het uitgevoerde werk (query's, indexering en andere bewerkingen).
- Geïndexeerde opslag: in rekening gebracht per GB per maand op basis van de grootte van uw indexen.
Dit model is ontworpen voor werklasten met een variabele vraag, waaronder piekverkeer en multitenant-toepassingen. Het biedt ondersteuning voor dezelfde kernzoekfuncties en API's als Toegewezen services, zodat u zoektoepassingen kunt bouwen en uitvoeren zonder code te herschrijven.
De serverloze ontwikkelaarslaag bevindt zich in openbare preview en biedt momenteel geen ondersteuning voor de volgende functies:
- Indexaliassen: niet ondersteund
- Foutopsporingssessies: niet ondersteund
- Privénetwerken voor indexeerfuncties: niet ondersteund
- Kennisbron voor bestanden (Preview): Niet ondersteund
- Gedeelde Private Link-resources: geen geplande ondersteuning voor het serverloze model
- Service level agreement (SLA): Niet beschikbaar tijdens openbare preview
Beschikbare regio's voor het serverloze prijsmodel tijdens de preview zijn onder andere:
- West-Centraal VS
- Switzerland North
- Oost-Japan
Zie Servicelimieten in Azure AI Zoeken voor meer informatie.
Neem contact op met Microsoft via het Azure AI Zoeken aanmeldingsformulier voor serverloze privévoorbeelden voor extra grootschalige serverloze implementatieopties.
Dedicated
Het Dedicated-prijsmodel is een aanbod met vooraf toegewezen capaciteit dat zorgt voor voorspelbare prestaties en kosten door vaste infrastructuur aan uw werkbelasting toe te wijzen. U configureert capaciteit vooraf, zodat de service consistente indexerings- en queryvereisten kan verwerken met gegarandeerde resources.
Met de toegewezen lagen configureert u expliciet replica's, partities en zoekeenheden (SU's). Replica’s bieden querydoorvoer en hoge beschikbaarheid, terwijl partities opslag- en indexcapaciteit bepalen. Samen bepalen ze de totale capaciteits- en prestatiekenmerken van uw zoekservice.
Facturering is gebaseerd op:
- Servicelaag: de vooraf geselecteerde ingerichte capaciteit.
- Zoekeenheden (RU's): de factureringseenheid voor toegewezen services, berekend als replica's × partities. U wordt gefactureerd tegen een vast uurtarief op basis van het aantal zoekeenheden en de geselecteerde servicelaag.
Dit model is ontworpen voor workloads met een stabiele, voorspelbare vraag, waarbij consistente prestaties, lage latentie en gecontroleerde schaalaanpassing belangrijk zijn.
In het dedicated-prijsmodel bepaalt de geselecteerde servicelaag het volgende:
- Maximum aantal indexen en andere objecten dat is toegestaan op de service.
- Grootte en snelheid van partities (fysieke opslag).
- Factureerbare tarieven als vaste maandelijkse kosten, maar ook incrementele kosten als u capaciteit toevoegt.
- Kenmerken van werkbelasting. Sommige lagen zijn geoptimaliseerd voor specifieke workloads.
In sommige gevallen bepaalt de laag ook de beschikbaarheid van Premium-functies.
Beschrijvingen van lagen
De meest gebruikte factureerbare lagen zijn:
Basic ondersteunt productieworkloads en kan voldoen aan SLA-vereisten met maximaal drie replica's.
Standard (S1, S2, S3) is de standaardlaag. Het biedt ondersteuning voor het schalen van partities en replica's, waardoor grotere workloads en verbeterde prestaties mogelijk zijn.
Sommige lagen zijn ontworpen voor bepaalde soorten werk:
Standard 3 High Density (S3 HD) is een hostingmodus voor S3 die is geoptimaliseerd voor multitenancy. S3 HD heeft dezelfde kosten per eenheid als S3, maar ondersteunt een groot aantal kleinere indexen en maakt gebruik van hardware die is geoptimaliseerd voor snelle bestandslees- en high-densityopslagscenario's.
Voor opslag geoptimaliseerde lagen (L1, L2) bieden goedkopere opslag per TB en zijn ontworpen voor grote, minder vaak bijgewerkte indexen. Deze lagen hebben doorgaans een hogere querylatentie.
Er is ook een gratis, beperkte zoekservicelaag:
- Gratis maakt een beperkte zoekservice voor kleine projecten, zoals zelfstudies en ontwikkeling. Resources worden gedeeld tussen tenants en opschalen wordt niet ondersteund. Sommige Premium-functies zijn niet beschikbaar en de service kan worden verwijderd na perioden van inactiviteit. U kunt slechts één gratis zoekservice per Azure-abonnement hebben.
Factureringstarieven worden weergegeven in de Azure-portal wanneer u een nieuwe AI Search-service maakt op de pagina Selecteer prijscategorie.
U kunt de pagina met prijzen voor regionale tarieven bekijken.
Bekijk Plan en beheer kosten voor meer informatie over het dedicated-prijsmodel en hoe het zich verhoudt tot het serverloze model.
Controleer Servicelimieten in Azure AI Zoeken of limieten voor opslag, workloads en objectaantallen per laag.
Een niveau selecteren
In de Azure-portal worden de servicelagen opgegeven op de pagina Selecteer prijscategorie wanneer u de service maakt.
In PowerShell of Azure CLI wordt de laag opgegeven via de -Sku parameter.
Beschikbaarheid per regio per laag
De lijst met regio's bevat de locaties waar Azure AI Zoeken wordt aangeboden. Sommige regio's hebben mogelijk capaciteitsbeperkingen voor bepaalde lagen, waardoor het maken van nieuwe zoekservices op deze lagen wordt voorkomen. In de lijst worden voetnoten gebruikt om beperkte regio's en lagen aan te geven.
Wanneer u een zoekservice maakt in Azure Portal, worden niet-beschikbare combinaties van regiolagen automatisch uitgesloten.
Beschikbaarheid van functies per laag
De meeste functies zijn beschikbaar in alle lagen. In sommige gevallen is de beschikbaarheid van functies afhankelijk van de geselecteerde laag:
| Functie | Overwegingen voor lagen |
|---|---|
| indexeerders | Indexeerfuncties zijn beschikbaar op S3 HD met dagelijks uitvoeringsquotum voor indexeerfuncties en andere overwegingen. Indexeerfuncties hebben meer beperkingen voor de gratis laag. |
configuratieparameter voor indexeerfunctie executionEnvironment |
Voor de mogelijkheid om alle verwerking van indexeerfuncties vast te maken aan alleen de zoekclusters die aan uw zoekservice zijn toegewezen, is S2 en hoger vereist. |
| AI-verrijking | Wordt uitgevoerd op de gratis laag, maar wordt niet aanbevolen voor grote workloads. |
| Beheerde of vertrouwde identiteiten voor uitgaande toegang (indexeerfunctie) | Niet beschikbaar in de gratis laag. |
| Door de klant beheerde versleutelingssleutels | Niet beschikbaar in de gratis laag. |
| IP-firewalltoegang | Niet beschikbaar in de gratis laag. |
| Privé-eindpunt (integratie met Azure Private Link) | Voor binnenkomende verbindingen met een zoekservice, niet beschikbaar in de gratis laag. Voor uitgaande verbindingen door indexers naar andere Azure-resources, niet beschikbaar op gratis of S3 HD. Voor indexeerfuncties die gebruikmaken van vaardighedensets die niet beschikbaar zijn op Free, Basic, S1 of S3 HD. |
| Beschikbaarheidszones | Niet beschikbaar in de gratis laag. |
| Semantische rangschikking | Wordt uitgevoerd op de gratis laag, maar wordt niet aanbevolen voor grote workloads. |
Resource-intensieve functies werken mogelijk niet goed, tenzij u deze voldoende capaciteit geeft. Bijvoorbeeld, AI-verrijking heeft langlopende processen die een time-out hebben op een gratis service, tenzij de gegevensset klein is.
Bovengrens
Lagen bepalen de maximale opslag van de service zelf, plus het maximum aantal indexen, indexeerfuncties, gegevensbronnen, vaardighedensets en synoniemenkaarten die u kunt maken. Zie Servicelimieten in Azure AI Zoeken voor een volledige onderbreking van alle limieten.
Partitiegrootte en snelheid
Prijscategorie omvat details over opslag per partitie die varieert van 15 GB voor Basic, tot 2 TB voor opslag geoptimaliseerde lagen (L2). Andere hardwarekenmerken, zoals de snelheid van bewerkingen, latentie en overdrachtssnelheden, worden niet gepubliceerd, maar lagen die zijn ontworpen voor specifieke oplossingsarchitecturen zijn gebouwd op hardware die de functies bevat om deze scenario's te ondersteunen. Zie Capaciteit en betrouwbaarheid schatten en beheren in Azure AI Zoeken voor meer informatie over partities.
Notitie
Partities met een hogere capaciteit zijn beschikbaar in bepaalde regio's in april 2024. In mei 2024 is een tweede golf van partities met een hogere capaciteit uitgebracht. Als u een oudere zoekservice hebt, kunt u uw service mogelijk upgraden om te profiteren van meer capaciteit tegen hetzelfde factureringstarief.
Factureringstarieven
Lagen hebben verschillende factureringstarieven, met hogere tarieven voor lagen die worden uitgevoerd op duurdere hardware of duurdere functies bieden. Het tarief voor prijsniveaus vindt u op de Azure-prijspagina voor Azure AI Zoeken.
Nadat u een service hebt gemaakt, wordt het factureringstarief zowel een vaste kost voor het uitvoeren van de service 24/7, als een incrementele kost als u ervoor kiest om meer capaciteit toe te voegen.
In het toegewezen model is facturering gebaseerd op zoekeenheden (RU's), die partities (opslag) en replica's (querycapaciteit) combineren.
- Een service begint met één partitie en één replica (één SU)
- Het toevoegen van partities of replica's verhoogt de kosten lineair met het aantal RU's
Als u bijvoorbeeld replica's toevoegt om de beschikbaarheid of doorvoer te verbeteren, worden de maandelijkse kosten proportioneel verhoogd.
Zie Kosten plannen en beheren voor meer informatie.
Voorbeeld van factureringstarief
In het volgende voorbeeld ziet u een afbeelding. Stel dat u een hypothetisch factureringstarief van $ 100 per maand hebt. Als u de zoekservice op de oorspronkelijke capaciteit van één partitie en één replica houdt, kunt u verwachten aan het einde van de maand $100 te betalen. Als u echter nog twee replica's toevoegt om hoge beschikbaarheid te bereiken, wordt de maandelijkse factuur verhoogd tot $ 300 ($ 100 voor het eerste replicapartitiepaar, gevolgd door $ 200 voor de twee replica's).
Niveauwijzigingen
Notitie
Bestaande zoekservices kunnen schakelen tussen de lagen Basic en Standard (S1, S2 en S3). De huidige serviceconfiguratie kan de limieten van de doellaag niet overschrijden en uw regio kan geen capaciteitsbeperkingen hebben voor de doellaag. Zie Uw prijscategorie wijzigen voor meer informatie.
Als u wilt overschakelen naar een andere laag dan de eerder vermelde lagen:
- Maak een zoekservice op de nieuwe laag.
- Implementeer uw zoekinhoud in de nieuwe service. Volg deze controlelijst om ervoor te zorgen dat u alle inhoud hebt.
- Verwijder de oude service wanneer u zeker weet dat deze niet meer nodig is.
Voor grote indexen die u niet helemaal opnieuw wilt bouwen, gebruikt u een van de volgende voorbeelden voor back-up en herstel:
- Voorbeeld van back-up en herstel (C#)
- Voorbeeld van back-up en herstel (Python)
- Voorbeeld van back-up en herstel voor zeer grote indexen (Python)
Volgende stappen
De beste manier om een prijscategorie te kiezen, is om te beginnen met een laag met de laagste kosten en vervolgens ervaring en tests toe te staan om uw beslissing te geven om de service te behouden of over te schakelen naar een hogere laag.
Voor de volgende stappen raden we u aan om een zoekservice te maken op een laag die geschikt is voor het testniveau dat u wilt uitvoeren en bekijk vervolgens de volgende richtlijnen voor het schatten van kosten en capaciteit: