Sémantické vyhledávání (SQL Server)

platí pro:SQL Server

Statistické sémantické vyhledávání extrahuje a indexuje statisticky relevantní klíčové fráze z nestrukturovaných dokumentů uložených v databázích SQL Server. Poté používá tyto klíčové fráze k identifikaci dokumentů, které jsou podobné nebo související.

Overview

Sémantické vyhledávání rozšiřuje vyhledávání v plném textu tím, že odpovídá významu dokumentu místo přesných slov. Mezi běžné případy použití patří automatická extrakce tagů, objevování souvisejícího obsahu a hierarchická navigace mezi podobným obsahem. Například můžete zadat dotaz na index klíčových slov a vytvořit taxonomii pro korpus dokumentů, nebo dotazovat na index podobnosti dokumentu, abyste identifikovali životopisy odpovídající popisu práce.

Následující příklady ukazují tři Transact-SQL řádkové funkce, které používáte k dotazování sémantických indexů a získávání výsledků jako strukturovaných dat.

Vyhledání klíčových frází v dokumentu

Následující dotaz získá klíčové fráze, které byly identifikovány v ukázkovém dokumentu. Zobrazí výsledky v sestupném pořadí podle skóre, které řadí statistickou významnost jednotlivých klíčových frází.

Tento dotaz volá sémantickeyphrasetable funkci.

SET @Title = 'Sample Document.docx';

SELECT @DocID = DocumentID
FROM Documents
WHERE DocumentTitle = @Title;

SELECT @Title AS Title,
       keyphrase,
       score
FROM SEMANTICKEYPHRASETABLE (Documents, *, @DocID)
ORDER BY score DESC;

Následující dotaz získá dokumenty, které byly identifikovány jako podobné nebo související s ukázkovým dokumentem. Zobrazí výsledky sestupně podle skóre, které seřadí podobnost dvou dokumentů.

Tento dotaz volá funkci semanticsimilaritytable.

SET @Title = 'Sample Document.docx';

SELECT @DocID = DocumentID
FROM Documents
WHERE DocumentTitle = @Title;

SELECT @Title AS SourceTitle,
       DocumentTitle AS MatchedTitle,
       DocumentID,
       score
FROM SEMANTICSIMILARITYTABLE (Documents, *, @DocID)
     INNER JOIN Documents
         ON DocumentID = matched_document_key
ORDER BY score DESC;

Následující dotaz získá klíčové fráze, které vytvoří dva ukázkové dokumenty podobné nebo vzájemně související. Zobrazí výsledky v sestupném pořadí podle skóre, které seřadí váhu jednotlivých klíčových frází.

Tento dotaz volá funkci semanticsimilaritydetailstable.

SET @SourceTitle = 'first.docx';
SET @MatchedTitle = 'second.docx';

SELECT @SourceDocID = DocumentID
FROM Documents
WHERE DocumentTitle = @SourceTitle;

SELECT @MatchedDocID = DocumentID
FROM Documents
WHERE DocumentTitle = @MatchedTitle;

SELECT @SourceTitle AS SourceTitle,
       @MatchedTitle AS MatchedTitle,
       keyphrase,
       score
FROM SEMANTICSIMILARITYDETAILSTABLE (
    Documents, DocumentContent, @SourceDocID, DocumentContent, @MatchedDocID
)
ORDER BY score DESC;

Ukládání dokumentů na SQL Serveru

Než můžete indexovat dokumenty pomocí sémantického vyhledávání, uložte je do Database Engine.

Funkce FileTable v SQL Server ukládá nestrukturované soubory a dokumenty v databázi, takže je můžete manipulovat společně se strukturovanými daty v Transact-SQL operacích založených na množinách.

Pro více informací o funkci FileTable viz FileTables. Pro informace o funkci FILESTREAM, která je další možností ukládání dokumentů v databázi, viz FILESTREAM.

Článek Description
Instalace a konfigurace sémantického vyhledávání Popisuje požadavky pro statistické sémantické vyhledávání a způsob jejich instalace nebo kontroly.
Povolte sémantické vyhledávání v tabulkách a sloupcích Popisuje, jak povolit nebo zakázat statistické sémantické indexování u vybraných sloupců, které obsahují dokumenty nebo text.
Hledání klíčových frází v dokumentech pomocí sémantického vyhledávání Popisuje, jak najít klíčové fráze v dokumentech nebo textových sloupcích nakonfigurovaných pro statistické sémantické indexování.
Najděte podobné a související dokumenty pomocí sémantického vyhledávání Popisuje, jak najít podobné nebo související dokumenty nebo textové hodnoty a informace o tom, jak jsou podobné nebo související, ve sloupcích nakonfigurovaných pro statistické sémantické indexování.
Správa a monitorování sémantického vyhledávání Popisuje proces sémantického indexování a úloh souvisejících s monitorováním a správou indexů.