Poznámka:
Přístup k této stránce vyžaduje autorizaci. Můžete se zkusit přihlásit nebo změnit adresáře.
Přístup k této stránce vyžaduje autorizaci. Můžete zkusit změnit adresáře.
platí pro:SQL Server
Statistické sémantické vyhledávání extrahuje a indexuje statisticky relevantní klíčové fráze z nestrukturovaných dokumentů uložených v databázích SQL Server. Poté používá tyto klíčové fráze k identifikaci dokumentů, které jsou podobné nebo související.
Overview
Sémantické vyhledávání rozšiřuje vyhledávání v plném textu tím, že odpovídá významu dokumentu místo přesných slov. Mezi běžné případy použití patří automatická extrakce tagů, objevování souvisejícího obsahu a hierarchická navigace mezi podobným obsahem. Například můžete zadat dotaz na index klíčových slov a vytvořit taxonomii pro korpus dokumentů, nebo dotazovat na index podobnosti dokumentu, abyste identifikovali životopisy odpovídající popisu práce.
Následující příklady ukazují tři Transact-SQL řádkové funkce, které používáte k dotazování sémantických indexů a získávání výsledků jako strukturovaných dat.
Vyhledání klíčových frází v dokumentu
Následující dotaz získá klíčové fráze, které byly identifikovány v ukázkovém dokumentu. Zobrazí výsledky v sestupném pořadí podle skóre, které řadí statistickou významnost jednotlivých klíčových frází.
Tento dotaz volá sémantickeyphrasetable funkci.
SET @Title = 'Sample Document.docx';
SELECT @DocID = DocumentID
FROM Documents
WHERE DocumentTitle = @Title;
SELECT @Title AS Title,
keyphrase,
score
FROM SEMANTICKEYPHRASETABLE (Documents, *, @DocID)
ORDER BY score DESC;
Vyhledání podobných nebo souvisejících dokumentů
Následující dotaz získá dokumenty, které byly identifikovány jako podobné nebo související s ukázkovým dokumentem. Zobrazí výsledky sestupně podle skóre, které seřadí podobnost dvou dokumentů.
Tento dotaz volá funkci semanticsimilaritytable.
SET @Title = 'Sample Document.docx';
SELECT @DocID = DocumentID
FROM Documents
WHERE DocumentTitle = @Title;
SELECT @Title AS SourceTitle,
DocumentTitle AS MatchedTitle,
DocumentID,
score
FROM SEMANTICSIMILARITYTABLE (Documents, *, @DocID)
INNER JOIN Documents
ON DocumentID = matched_document_key
ORDER BY score DESC;
Vyhledání klíčových frází, které tvoří podobné dokumenty nebo související
Následující dotaz získá klíčové fráze, které vytvoří dva ukázkové dokumenty podobné nebo vzájemně související. Zobrazí výsledky v sestupném pořadí podle skóre, které seřadí váhu jednotlivých klíčových frází.
Tento dotaz volá funkci semanticsimilaritydetailstable.
SET @SourceTitle = 'first.docx';
SET @MatchedTitle = 'second.docx';
SELECT @SourceDocID = DocumentID
FROM Documents
WHERE DocumentTitle = @SourceTitle;
SELECT @MatchedDocID = DocumentID
FROM Documents
WHERE DocumentTitle = @MatchedTitle;
SELECT @SourceTitle AS SourceTitle,
@MatchedTitle AS MatchedTitle,
keyphrase,
score
FROM SEMANTICSIMILARITYDETAILSTABLE (
Documents, DocumentContent, @SourceDocID, DocumentContent, @MatchedDocID
)
ORDER BY score DESC;
Ukládání dokumentů na SQL Serveru
Než můžete indexovat dokumenty pomocí sémantického vyhledávání, uložte je do Database Engine.
Funkce FileTable v SQL Server ukládá nestrukturované soubory a dokumenty v databázi, takže je můžete manipulovat společně se strukturovanými daty v Transact-SQL operacích založených na množinách.
Pro více informací o funkci FileTable viz FileTables. Pro informace o funkci FILESTREAM, která je další možností ukládání dokumentů v databázi, viz FILESTREAM.
Související úkoly
| Článek | Description |
|---|---|
| Instalace a konfigurace sémantického vyhledávání | Popisuje požadavky pro statistické sémantické vyhledávání a způsob jejich instalace nebo kontroly. |
| Povolte sémantické vyhledávání v tabulkách a sloupcích | Popisuje, jak povolit nebo zakázat statistické sémantické indexování u vybraných sloupců, které obsahují dokumenty nebo text. |
| Hledání klíčových frází v dokumentech pomocí sémantického vyhledávání | Popisuje, jak najít klíčové fráze v dokumentech nebo textových sloupcích nakonfigurovaných pro statistické sémantické indexování. |
| Najděte podobné a související dokumenty pomocí sémantického vyhledávání | Popisuje, jak najít podobné nebo související dokumenty nebo textové hodnoty a informace o tom, jak jsou podobné nebo související, ve sloupcích nakonfigurovaných pro statistické sémantické indexování. |
| Správa a monitorování sémantického vyhledávání | Popisuje proces sémantického indexování a úloh souvisejících s monitorováním a správou indexů. |