Wyszukiwanie semanticzne (SQL Server)

Dotyczy:SQL Server

Statystyczne wyszukiwanie semantyczne wyodrębnia i indeksuje statystycznie istotne frazy kluczowe z nieustrukturyzowanych dokumentów przechowywanych w bazach danych SQL Server. Następnie używa tych kluczowych zwrotów do identyfikacji dokumentów podobnych lub powiązanych.

Overview

Wyszukiwanie semantyczne rozszerza wyszukiwanie w pełnym tekście, dopasowując znaczenie dokumentu zamiast dokładnych słów. Typowe przypadki użycia obejmują automatyczne wyodrębnianie tagów, odkrywanie powiązanych treści oraz hierarchiczną nawigację między podobnymi treściami. Na przykład możesz zapytać indeks kluczowych słów, aby zbudować taksonomię dla korpusu dokumentów, lub zapytać indeks podobieństwa dokumentu, aby znaleźć CV odpowiadające opisowi stanowiska.

Poniższe przykłady przedstawiają trzy funkcje zbiorów wierszy języka Transact-SQL, których używa się do wykonywania zapytań względem indeksów semantycznych i pobierania wyników w postaci danych strukturalnych.

Znajdowanie kluczowych fraz w dokumencie

Poniższe zapytanie pobiera kluczowe frazy, które zostały zidentyfikowane w przykładowym dokumencie. Przedstawia wyniki w kolejności malejącej według wyniku, który klasyfikuje statystyczne znaczenie każdej frazy kluczowej.

To zapytanie wywołuje funkcję semantickeyphrasetable .

SET @Title = 'Sample Document.docx';

SELECT @DocID = DocumentID
FROM Documents
WHERE DocumentTitle = @Title;

SELECT @Title AS Title,
       keyphrase,
       score
FROM SEMANTICKEYPHRASETABLE (Documents, *, @DocID)
ORDER BY score DESC;

Poniższe zapytanie pobiera dokumenty, które zostały zidentyfikowane jako podobne lub powiązane z przykładowym dokumentem. Przedstawia wyniki w kolejności malejącej według wyniku, który plasuje podobieństwo dwóch dokumentów.

To zapytanie wywołuje funkcję semanticsimilaritytable .

SET @Title = 'Sample Document.docx';

SELECT @DocID = DocumentID
FROM Documents
WHERE DocumentTitle = @Title;

SELECT @Title AS SourceTitle,
       DocumentTitle AS MatchedTitle,
       DocumentID,
       score
FROM SEMANTICSIMILARITYTABLE (Documents, *, @DocID)
     INNER JOIN Documents
         ON DocumentID = matched_document_key
ORDER BY score DESC;

Poniższe zapytanie pobiera kluczowe frazy, które sprawiają, że dwa przykładowe dokumenty są podobne lub powiązane ze sobą. Przedstawia wyniki w kolejności malejącej według wyniku, który klasyfikuje wagę każdej frazy kluczowej.

To zapytanie wywołuje funkcję semanticsimilaritydetailstable .

SET @SourceTitle = 'first.docx';
SET @MatchedTitle = 'second.docx';

SELECT @SourceDocID = DocumentID
FROM Documents
WHERE DocumentTitle = @SourceTitle;

SELECT @MatchedDocID = DocumentID
FROM Documents
WHERE DocumentTitle = @MatchedTitle;

SELECT @SourceTitle AS SourceTitle,
       @MatchedTitle AS MatchedTitle,
       keyphrase,
       score
FROM SEMANTICSIMILARITYDETAILSTABLE (
    Documents, DocumentContent, @SourceDocID, DocumentContent, @MatchedDocID
)
ORDER BY score DESC;

Przechowywanie dokumentów w programie SQL Server

Zanim zaczniesz indeksować dokumenty za pomocą wyszukiwania semantycznego, przechowuj je w Database Engine.

Funkcja FileTable w SQL Server przechowuje nieustrukturyzowane pliki i dokumenty w bazie danych, dzięki czemu możesz je manipulować razem z danymi strukturalnymi w Transact-SQL operacjach opartych na zbiorach.

Więcej informacji o funkcji FileTable można znaleźć w sekcji FileTables. Aby uzyskać informacje o funkcji FILESTREAM, która jest kolejną opcją przechowywania dokumentów w bazie danych, zobacz FILESTREAM.

Artykuł Description
Instalowanie i konfigurowanie wyszukiwania semantycznego Opisuje wymagania wstępne dotyczące wyszukiwania statystycznego oraz sposób ich instalowania lub sprawdzania.
Włącz wyszukiwanie semantyczne w tabelach i kolumnach Opisuje sposób włączania lub wyłączania semantycznego indeksowania statystycznego dla wybranych kolumn zawierających dokumenty lub tekst.
Znajdowanie kluczowych fraz w dokumentach za pomocą wyszukiwania semantycznego Opisuje sposób znajdowania kluczowych fraz w dokumentach lub kolumnach tekstowych skonfigurowanych do indeksowania statystycznego.
Znajdź podobne i powiązane dokumenty za pomocą wyszukiwania semantycznego Opisuje sposób znajdowania podobnych lub powiązanych dokumentów lub wartości tekstowych oraz informacji o tym, jak są one podobne lub powiązane, w kolumnach skonfigurowanych do indeksowania semantycznego statystycznego.
Zarządzaj i monitoruj wyszukiwanie semantyczne Opisuje proces indeksowania semantycznego oraz zadania związane z monitorowaniem indeksów i zarządzaniem nimi.