Kommentar
Åtkomst till den här sidan kräver auktorisering. Du kan prova att logga in eller ändra kataloger.
Åtkomst till den här sidan kräver auktorisering. Du kan prova att ändra kataloger.
Vektorlagringsobjekt ger filsökningsverktyget möjlighet att söka i dina filer. Genom att lägga till en fil i ett vektorlager får agentens Foundry-modell kunskap utöver sina träningsdata. Tjänsten parsar, segment, bäddar in och indexerar filen så att verktyget kan köra både nyckelord och semantisk sökning.
Vektorlager kan kopplas till både agenter och konversationer. För närvarande kan du ansluta högst ett vektorlager till en agent och högst ett vektorlager till en konversation. En konceptuell översikt över konversationer finns i Agent-körningskomponenter.
I den aktuella agentutvecklarupplevelsen använder svarsgenerering svar och konversationer. Vissa SDK:er och äldre kodexempel använder termen köra. Om du ser båda termerna behandla kör som svarsgenerering. Information om migrering finns i Så här migrerar du till den nya agenttjänsten.
En lista över gränser för vektorsökning (till exempel maximala tillåtna filstorlekar) finns i artikeln om kvoter och begränsningar .
Förutsättningar
- Ett Microsoft Foundry-projekt.
- En agent eller konversation som använder filsökningsverktyget .
- Om du använder standardkonfigurationen av agenten ansluter du Azure Blob Storage och Azure AI-sökning under installationen så att filerna finns kvar i lagringen. Se Konfiguration av agentmiljö.
- Roller och behörigheter varierar beroende på aktivitet (till exempel att skapa projekt, tilldela roller för standardkonfiguration eller skapa och redigera agenter). Se tabellen med nödvändiga behörigheter i konfigurationen av agentmiljön.
- Funktionstillgängligheten kan variera beroende på region. För information om aktuell täckning, se tillgänglighet av Microsoft Foundry-funktioner i molnregioner.
Nyckelgränser och standardvärden
Vektorlager är ofta den första platsen där hämtning av arbetsflöden misslyckas i produktionen, så det är bra att känna till standardvärden och fasta gränser.
- Filer per vektorarkiv: Varje vektorarkiv kan innehålla upp till 10 000 filer.
- Bifogade filer: Du kan koppla högst ett vektorarkiv till en agent och högst ett vektorlager till en konversation.
-
Standardinställningar för hämtning (filsökning):
- Segmentstorlek: 800 token
- Segment överlappning: 400 token
- Inbäddningsmodell: text-embedding-3-large på 256 dimensioner
- Maximalt antal segment som lagts till i kontexten: 20
Information om filstorlek och tokengränser finns i kvoter och gränser.
Viktiga begrepp
| Benämna | Menande |
|---|---|
| Vektorarkiv | En container för sökbart filinnehåll (segment och inbäddningar) som används av filsökningsverktyget. |
| Intag | Den asynkrona process som parsar, segment, bäddar in och indexerar en fil för sökning. |
| Beredskap | Om inmatningen har slutförts och vektorarkivet är sökbart. |
| Förfalloprincip | En livscykelprincip som upphör att gälla ett vektorlager efter en period av inaktivitet. |
Så här fungerar vektorlager med filsökning
Filsökning tillämpar metodtips för hämtning för att hjälpa din agent att hitta rätt innehåll från dina filer. Beroende på frågan och dina data kan verktyget:
- Skriv om användarfrågor för att förbättra hämtningen.
- Dela upp komplexa frågor i flera sökningar.
- Kör både nyckelords- och semantiska sökningar mellan agent- och konversationsvektorlager.
- Omrangordna resultaten innan du lägger till dem i modellkontexten.
Aktuella standardinställningar för hämtning (segmentstorlek och överlappning, inbäddningsmodell och maximalt antal segment som läggs till i kontexten) finns i Så här fungerar det.
Var dina data finns (grundläggande kontra standardkonfiguration av agent)
Var filer och sökresurser finns beror på agentkonfigurationen:
- < c0>Grundläggande agentinstallation: Filsökning använder Microsoft-hanterade lagrings- och sökresurser.
- Standard agentinstallation: Filsökningen använder de Azure Blob Storage- och Azure AI-sökning resurser som du ansluter under installationen, så att filerna finns kvar i lagringen.
Information om hur du konfigurerar din miljö finns i Konfiguration av agentmiljö. Mer information finns i Beroende av agentkonfiguration.
Kontrollera beredskapen för vektorlagring innan du skapar svar
Se till att alla filer i ett vektorlager bearbetas fullständigt innan du skapar ett svar. Det här steget säkerställer att alla data i vektorlagret är sökbara.
Om du vill kontrollera beredskapen använder du SDK-avsökningshjälparna (till exempel create-and-poll och upload-and-poll) eller avsöker vektorarkivobjektet tills dess status har slutförts. Kodexempel finns i Filsökningsverktyg för agenter.
Under inmatningen kan ett vektorlager ha statusen in_progress . När inmatningen är klar ändras statusen till slutförd.
Som reserv innehåller svarsgenereringen en maximal väntetid på 60 sekunder när konversationens vektorarkiv innehåller filer som fortfarande bearbetas. Den här reservväntningen gäller inte för agentens vektorlager.
Checklista för arbetsflöden från slutpunkt till slutpunkt
Använd den här checklistan för att verifiera ett arbetsflöde för vektorlager från inmatning till livscykelhantering.
- Bestäm om du använder grundläggande agentkonfiguration eller standardkonfiguration av agenten, baserat på var du vill att dina filer och sökresurser ska finnas. Se Var dina data finns (grundläggande kontra standardagentkonfiguration).
- Ladda upp dina filer och skapa ett vektorarkiv. Ett steg för steg-exempel finns i Ladda upp filer och lägg till dem i ett vektorlager.
- Vänta tills inmatningen har slutförts innan du genererar svar. Använd SDK-avsökningshjälpare eller avsök vektorarkivet tills dess status har slutförts och inga filer finns kvar i in_progress. Se Säkerställa beredskap för vektorlager innan du skapar svar.
- Koppla vektorarkivet till agenten eller konversationen som du använder för filsökning. Tänk på begränsningarna för bifogade filer. Se Vektorlager.
- Skapa ett svar som använder filsökning och kontrollera att verktyget hämtar från de förväntade källorna. Se Skapa svar med filsökning och Verifiera resultat.
- Hantera livscykel: ta bort filer som du inte längre behöver och planera för förfalloprinciper (särskilt för vektorlager som skapats av konversationshjälpare). Se Vektorlager och Konversationsvektorlager har standardprinciper för förfallodatum.
Lägga till filer och hantera vektorlager
Att lägga till filer i vektorlager är en asynkron åtgärd. För att säkerställa att inmatningen har slutförts använder du hjälparna för att skapa och söka i de officiella SDK:erna. Om du inte använder ett SDK avsöker du vektorarkivet tills dess status har slutförts och inga filer finns kvar i in_progress.
Filer kan också läggas till i ett vektordatalager efter att det har skapats genom att skapa vektordatalagerfiler. Du kan också lägga till flera filer i ett vektorlager genom att skapa batchar med upp till 500 filer.
När du laddar upp en fil för att skapa en lagringsplats för vektorer, gör systemet automatiskt:
- Delar upp innehållet i hanterbara delar.
- Konverterar varje segment till högdimensionella vektorer med hjälp av inbäddningsmodeller.
- Lagrar dessa vektorer i ett optimerat sökindex.
- Skapar associationer mellan vektorerna och det ursprungliga innehållet.
Ta bort filer från vektorlager
Du kan ta bort filer från ett vektorlager på två olika sätt:
- Ta bort filobjektet för vektorarkivet.
- Ta bort det underliggande filobjektet. Detta tar bort filen från alla konfigurationer av vektorlager i alla agenter och konversationer i din organisation.
Hantera livscykel med förfalloprinciper
Förfalloprinciper hjälper dig att hantera livscykeln för vektorlagring. Du kan ange dessa principer när du skapar eller uppdaterar vektorlagringsobjektet.
Konversationsvektorlager har standard utgångspolicyer
Vektorlager som skapats med hjälp av konversationshjälpare har en standardprincip för förfallotid på sju dagar efter att de senast var aktiva (definieras som den senaste gången vektorarkivet användes under svarsgenereringen).
När ett vektorlager upphör att gälla misslyckas svarsgenereringen för den konversationen. Åtgärda problemet genom att återskapa ett nytt vektorarkiv med samma filer och koppla det till konversationen igen. Mer information finns i Konversationsvektorlager har standardprinciper för förfallodatum.
Filtyper och nyckelgränser som stöds
Listan över filtyper och kodningskrav som stöds finns i Filtyper som stöds.
Viktiga gränser att tänka på:
- Du kan koppla högst ett vektorlager till en agent och högst ett vektorlager till en konversation.
- Filstorlek och tokengränser varierar beroende på funktion. Se Kvoter och gränser.
Felsökning
- Vektorarkivet är inte sökbart än: Vänta tills inmatningen har slutförts. Använd SDK-avsökningshjälpare eller avsök vektorarkivet tills dess status har slutförts.
- Svarsgenereringen misslyckas efter några dagar: Konversationsvektorarkivet kan ha upphört att gälla. Återskapa en ny vektorlagring med samma filer och återanslut den.
- En fil försvann från flera agenter eller konversationer: Du kan ha tagit bort det underliggande filobjektet, vilket tar bort filen från alla konfigurationer för vektorlager i organisationen.
- Uppladdningar eller inmatning misslyckas: Kontrollera filstorlek och tokengränser i Kvoter och gränser.
Nästa steg
- Läs mer om filsökningsverktyget
- Granska metodtips för verktyg för vägledning om tillförlitlighet och säkerhet
- Lär dig mer om agentkörningskomponenter