Co to jest źródło wiedzy?

Uwaga

Wyszukiwanie AI platformy Azure jest dostępna za pośrednictwem portalu Azure, interfejsów API REST i Azure SDKs. Jest także podstawą Foundry IQ — zarządzanej warstwy wiedzy, która przekształca treści przedsiębiorstwa w bazy wiedzy wielokrotnego użytku z uwzględnieniem uprawnień dla agentów w portalu Microsoft Foundry.

Uwaga

Niektóre funkcje wyszukiwania agentowego są ogólnie dostępne w interfejsie API REST 2026-04-01 za pośrednictwem dostępu programistycznego. Portal Azure i Microsoft Foundry nadal zapewniają dostęp wyłącznie do wersji zapoznawczej wszystkich funkcji odzyskiwania agentów. Aby uzyskać wskazówki dotyczące migracji, w tym podział informacji o ogólnie dostępnych funkcjach i tych, które pozostają w wersji zapoznawczej, zobacz Migrowanie kodu agenta do najnowszej wersji.

Jeśli zdecydujesz się użyć interfejsu API REST w wersji zapoznawczej, możesz uzyskać dostęp do funkcji wyszukiwania agentowego, które nie są jeszcze ogólnie dostępne. Funkcje w wersji zapoznawczej są udostępniane bez umowy dotyczącej poziomu usług i nie są zalecane w przypadku obciążeń produkcyjnych. Aby uzyskać więcej informacji, zobacz Warunki dodatkowe korzystania z testowych wersji Microsoft Azure.

Ważna

Te funkcje i możliwości stanowią część interfejsu API REST 2026-05-01-preview. Wersja 2026-05-01-preview jest licencjonowana użytkownikowi w ramach subskrypcji platformy Azure i podlega warunkom mającym zastosowanie do „Previews” w dokumencie Warunki dotyczące produktów firmy Microsoft, Dodatku dotyczącego ochrony danych dla produktów i usług firmy Microsoft („DPA”) oraz Dodatkowych warunkach korzystania z wersji zapoznawczych Microsoft Azure.

Wersja zapoznawcza 2026-05-01-preview obsługuje połączenia z innymi usługami firmy Microsoft oraz usługami innych firm. Korzystanie z tych usług podlega odpowiednim warunkom i może spowodować przetwarzanie lub przechowywanie danych poza granicą zgodności Azure, a także dane przepływające do granicy zgodności Azure.

Do Ciebie należy decydowanie o tym, czy dane będą przepływać poza granice zgodności i granice geograficzne organizacji, oraz o wszelkich związanych z tym konsekwencjach, a także zapewnienie odpowiednich uprawnień, ograniczeń i zatwierdzeń.

Odpowiadasz za staranne przeglądanie i testowanie aplikacji, które tworzysz w kontekście konkretnych przypadków użycia, oraz podejmowanie wszelkich odpowiednich decyzji i dostosowań. Obejmuje to implementowanie własnych odpowiedzialnych środków zaradczych dotyczących sztucznej inteligencji, takich jak metaprompty, filtry zawartości lub inne systemy bezpieczeństwa oraz zapewnienie, że aplikacje spełniają odpowiednią jakość, niezawodność, bezpieczeństwo i standardy wiarygodności. Aby uzyskać więcej informacji, zobacz Wyszukiwanie AI platformy Azure Transparency Note.

Źródło wiedzy jest zasobem najwyższego poziomu w usłudze Wyszukiwanie AI platformy Azure, który określa zawartość używaną w potoku agentowego pozyskiwania. Każde źródło wiedzy jest indeksowane lub zdalne, co określa, jak zawartość jest pozyskiwana, przetwarzana i odpytywane. Źródła wiedzy są wymaganymi składnikami bazy wiedzy.

Możesz odwoływać się do wielu źródeł wiedzy w jednej bazie wiedzy. Agentowy mechanizm wyszukiwania odpytuje je wszystkie w ramach jednego żądania. Dla każdego źródła wiedzy generowane są podzapytania, a w odpowiedzi wyszukiwania zwracane są najtrafniejsze wyniki.

Obsługiwane źródła wiedzy

Wyszukiwanie AI platformy Azure obsługuje następujące źródła wiedzy dla obciążeń związanych z wyszukiwaniem agentowym.

Rodzaj Description Indeksowane lub zdalnie dostępne
Indeks wyszukiwania Opakowuje istniejący indeks. Indeksowane
Obiekt blob platformy Azure Generuje potok indeksatora z kontenera obiektów blob. Indeksowane
Azure SQL (wersja zapoznawcza) Generuje potok indeksatora na podstawie tabeli lub widoku Azure SQL. Indeksowane
Plik (wersja zapoznawcza) Przekazuje pliki bezpośrednio do Wyszukiwanie AI platformy Azure. Indeksowane
OneLake Generuje potok indeksatora z magazynu lakehouse. Indeksowane
Indeksowane SharePoint (wersja zapoznawcza) Generuje potok indeksatora z witryny SharePoint. Indeksowane
Zdalne SharePoint (wersja zapoznawcza) Pobiera zawartość z SharePoint. Zdalny
agent danych Fabric (wersja zapoznawcza) Pobiera odpowiedzi i osadzone zasoby z agenta danych Microsoft Fabric. Zdalny
Fabric Ontology (wersja zapoznawcza) Pobiera odpowiedzi oparte na jednostkach i relacjach z Microsoft Fabric ontologii. Zdalny
Serwer MCP (wersja zapoznawcza) Pobiera wyniki na żywo oparte na narzędziach z zewnętrznego serwera MCP. Zdalny
Praca IQ (wersja zapoznawcza) Pobiera informacje organizacyjne z usługi Work IQ. Zdalny
Internet Pobiera dane kontekstowe w czasie rzeczywistym z usługi Microsoft Bing. Zdalny

Indeksowane źródła wiedzy

Indeksowane źródło wiedzy wskazuje na indeks wyszukiwania, który spełnia kryteria wyszukiwania agentowego. Treść jest wprowadzana do indeksu przed wykonaniem zapytania jedną z trzech ścieżek:

  • Przynieś własny indeks: Użyj źródła wiedzy indeksu wyszukiwania, aby opakować istniejący indeks w usłudze wyszukiwania.

  • Bezpośrednie przekazywanie plików: Użyj źródła wiedzy opartego na plikach, aby przesłać pliki bezpośrednio do usługi Wyszukiwanie AI platformy Azure. Usługa przetwarza pliki i przechowuje wyodrębnioną zawartość w utworzonym indeksie wyszukiwania, bez konieczności używania zewnętrznego magazynu ani potoku indeksowania.

  • Potok indeksatora generowanego automatycznie: W przypadku wszystkich innych indeksowanych źródeł wiedzy Wyszukiwanie AI platformy Azure automatycznie tworzy pełny potok indeksatora z zewnętrznego źródła danych. Obejmuje to źródło danych, zestaw umiejętności, indeksator i indeks , który jest wypełniany i fragmentowany.

Zapytania są uruchamiane lokalnie w usłudze wyszukiwania przy użyciu słowa kluczowego (pełnotekstowego), wektora lub zapytań hybrydowych.

Zdalne źródła wiedzy

Zdalne źródło wiedzy łączy się bezpośrednio z platformą zewnętrzną. Zawartość nigdy nie jest importowana do Wyszukiwanie AI platformy Azure. Zamiast tego jest pobierany w czasie wykonywania zapytań za pośrednictwem natywnych interfejsów API każdej platformy. Agentowy mechanizm wyszukiwania wykonuje wywołanie interfejsu API i zwraca wyniki wraz z wszelkimi indeksowanymi źródłami wiedzy w ramach tej samej odpowiedzi.

W zależności od platformy połączenia zdalne uzyskują dostęp do zawartości albo za pośrednictwem publicznego Internetu (np. Bing), albo w ramach dzierżawy Microsoft (np. SharePoint i Fabric).

Ujednolicony ranking

W przypadku zarówno indeksowanych, jak i zdalnych źródeł wiedzy wszystkie pobrane zasoby przepływa przez ten sam potok klasyfikacji. Wyniki są oceniane pod kątem trafności, łączone z wielu zapytań i ponownie porządkowane przed zwróceniem ich w odpowiedzi wyszukiwania.

Praca ze źródłami wiedzy

Źródła wiedzy to niezależne obiekty tworzone i zarządzane oddzielnie od baz wiedzy. Należy pamiętać o następujących kwestiach:

  • Przed utworzeniem bazy wiedzy utwórz źródło wiedzy. Bazy wiedzy odwołują się do źródeł wiedzy za pomocą identyfikatora, więc źródło wiedzy musi najpierw istnieć.

  • Aby usunąć źródło wiedzy, najpierw zaktualizuj lub usuń wszystkie bazy wiedzy odwołujące się do niego. Następnie możesz usunąć źródło wiedzy.

  • Źródło wiedzy i jego baza wiedzy muszą istnieć w tej samej usłudze wyszukiwania.

Tworzenie źródeł wiedzy

Aby utworzyć źródło wiedzy, musisz mieć uprawnienia Współautor usługi wyszukiwania w usłudze wyszukiwania. Jeśli źródło wiedzy generuje potok indeksatora, musisz również mieć uprawnienia Współautor danych indeksu wyszukiwania , aby załadować indeks. Możesz użyć klucza interfejsu API administratora jako alternatywy dla przypisań ról.

Obsługa tworzenia w portalu Azure, portalu Microsoft Foundry, interfejsu API REST i Azure SDKs różni się w zależności od rodzaju źródła wiedzy. Instrukcje dla każdego typu znajdują się pod łączami w sekcji Obsługiwane źródła wiedzy.

Pozyskiwanie etykiet wrażliwości (wersja zapoznawcza)

W przypadku źródeł wiedzy typu blob, indeksowanego OneLake i indeksowanego SharePoint można pozyskiwać etykiety poufności Microsoft Purview, ustawiając ingestionPermissionOptions tak, aby obejmowało sensitivityLabel. Przed ustawieniem tej wartości postępuj zgodnie ze wszystkimi wymaganiami wstępnymi. Po zsynchronizowaniu z indeksem etykiety są zwracane w odpowiedziach operacji pobierania i używane do egzekwowania dostępu na poziomie dokumentu w czasie wykonywania zapytania. Aby uzyskać więcej informacji, zobacz Wymuszanie uprawnień w czasie zapytania (wersja zapoznawcza).

Jeśli indeksowane źródło wiedzy używa fragmentowanego indeksu, takiego jak zintegrowana wektoryzacja lub niestandardowa umiejętność dzielenia tekstu, musisz również zamapować etykietę poufności na każdy wiersz fragmentu za pośrednictwem projekcji indeksu w zestawie umiejętności. W przeciwnym razie odniesienia na poziomie fragmentów w odpowiedziach operacji pobierania nie będą zwracane, jeśli mają etykiety w dokumencie źródłowym.

Surface obrazów osadzonych w dokumentach (wersja zapoznawcza)

W przypadku źródeł wiedzy typu blob, indeksowanego OneLake i indeksowanego SharePoint można skonfigurować element assetStore w elemencie ingestionParameters źródła wiedzy, aby zachowywać obrazy osadzone w dokumentach źródłowych. Po włączeniu obsługi obrazów w bazie wiedzy akcja pobierania wprowadza te obrazy do monitu syntezy odpowiedzi, aby usługa LLM mogła wnioskować na diagramach, wykresach i wyodrębnionej zawartości obrazu. Aby uzyskać więcej informacji, zobacz Wyświetlanie obrazów osadzonych w dokumentach w wyszukiwaniu agentowym (wersja zapoznawcza).

Korzystanie ze źródeł wiedzy

Po utworzeniu źródła wiedzy zapoznaj się z nim w bazie wiedzy. Baza wiedzy określa źródła wiedzy do wykonywania zapytań. W poniższych sekcjach opisano opcje określające, które źródła są uwzględniane oraz w jaki sposób mechanizm dokonuje spośród nich wyboru.

Zawsze wysyłaj zapytania do źródła wiedzy

Ustaw wartość alwaysQuery na true dla definicji źródła wiedzy, aby uwzględniać to źródło w każdym zapytaniu, niezależnie od poziomu rozumowania używanego podczas wyszukiwania.

Użyj wysiłku wnioskowania podczas wyszukiwania, aby kontrolować użycie LLM (wersja zapoznawcza)

Poziom wnioskowania podczas wyszukiwania określa, ile przetwarzania przez model LLM jest stosowane do każdego zapytania. Nie wszystkie rozwiązania czerpią korzyści z planowania zapytań LLM. Jeśli prostota i szybkość są priorytetem, należy użyć minimal nakładu pracy, aby pominąć przetwarzanie LLM. Przy nakładzie pracy low i medium model LLM planuje i wybiera, które źródła wiedzy przeszukać, a medium dodaje iteracyjny przebieg w celu uzyskania bardziej pogłębionych wyników. Aby uzyskać więcej informacji o poszczególnych poziomach, zobacz Ustaw poziom nakładu pracy rozumowania dla wyszukiwania (wersja zapoznawcza).

Na wybór przy nakładzie pracy low i medium wpływają następujące czynniki:

  • Źródło wiedzy name.

  • Indeks description (dla indeksowanych źródeł wiedzy).

  • Element retrievalInstructions określony w definicji bazy wiedzy lub w akcji pobierania. Instrukcje dotyczące pobierania określają, które źródła wiedzy model LLM wybiera lub pomija. Działają one jak monit: można określić zwięzłość, ton i formatowanie.