Notatka
Dostęp do tej strony wymaga autoryzacji. Może spróbować zalogować się lub zmienić katalogi.
Dostęp do tej strony wymaga autoryzacji. Możesz spróbować zmienić katalogi.
Dotyczy:SQL Server
Statystyczne wyszukiwanie semantyczne wyodrębnia i indeksuje statystycznie istotne frazy kluczowe z nieustrukturyzowanych dokumentów przechowywanych w bazach danych SQL Server. Następnie używa tych kluczowych zwrotów do identyfikacji dokumentów podobnych lub powiązanych.
Overview
Wyszukiwanie semantyczne rozszerza wyszukiwanie w pełnym tekście, dopasowując znaczenie dokumentu zamiast dokładnych słów. Typowe przypadki użycia obejmują automatyczne wyodrębnianie tagów, odkrywanie powiązanych treści oraz hierarchiczną nawigację między podobnymi treściami. Na przykład możesz zapytać indeks kluczowych słów, aby zbudować taksonomię dla korpusu dokumentów, lub zapytać indeks podobieństwa dokumentu, aby znaleźć CV odpowiadające opisowi stanowiska.
Poniższe przykłady przedstawiają trzy funkcje zbiorów wierszy języka Transact-SQL, których używa się do wykonywania zapytań względem indeksów semantycznych i pobierania wyników w postaci danych strukturalnych.
Znajdowanie kluczowych fraz w dokumencie
Poniższe zapytanie pobiera kluczowe frazy, które zostały zidentyfikowane w przykładowym dokumencie. Przedstawia wyniki w kolejności malejącej według wyniku, który klasyfikuje statystyczne znaczenie każdej frazy kluczowej.
To zapytanie wywołuje funkcję semantickeyphrasetable .
SET @Title = 'Sample Document.docx';
SELECT @DocID = DocumentID
FROM Documents
WHERE DocumentTitle = @Title;
SELECT @Title AS Title,
keyphrase,
score
FROM SEMANTICKEYPHRASETABLE (Documents, *, @DocID)
ORDER BY score DESC;
Znajdowanie podobnych lub powiązanych dokumentów
Poniższe zapytanie pobiera dokumenty, które zostały zidentyfikowane jako podobne lub powiązane z przykładowym dokumentem. Przedstawia wyniki w kolejności malejącej według wyniku, który plasuje podobieństwo dwóch dokumentów.
To zapytanie wywołuje funkcję semanticsimilaritytable .
SET @Title = 'Sample Document.docx';
SELECT @DocID = DocumentID
FROM Documents
WHERE DocumentTitle = @Title;
SELECT @Title AS SourceTitle,
DocumentTitle AS MatchedTitle,
DocumentID,
score
FROM SEMANTICSIMILARITYTABLE (Documents, *, @DocID)
INNER JOIN Documents
ON DocumentID = matched_document_key
ORDER BY score DESC;
Znajdowanie kluczowych fraz, które sprawiają, że dokumenty są podobne lub powiązane
Poniższe zapytanie pobiera kluczowe frazy, które sprawiają, że dwa przykładowe dokumenty są podobne lub powiązane ze sobą. Przedstawia wyniki w kolejności malejącej według wyniku, który klasyfikuje wagę każdej frazy kluczowej.
To zapytanie wywołuje funkcję semanticsimilaritydetailstable .
SET @SourceTitle = 'first.docx';
SET @MatchedTitle = 'second.docx';
SELECT @SourceDocID = DocumentID
FROM Documents
WHERE DocumentTitle = @SourceTitle;
SELECT @MatchedDocID = DocumentID
FROM Documents
WHERE DocumentTitle = @MatchedTitle;
SELECT @SourceTitle AS SourceTitle,
@MatchedTitle AS MatchedTitle,
keyphrase,
score
FROM SEMANTICSIMILARITYDETAILSTABLE (
Documents, DocumentContent, @SourceDocID, DocumentContent, @MatchedDocID
)
ORDER BY score DESC;
Przechowywanie dokumentów w programie SQL Server
Zanim zaczniesz indeksować dokumenty za pomocą wyszukiwania semantycznego, przechowuj je w Database Engine.
Funkcja FileTable w SQL Server przechowuje nieustrukturyzowane pliki i dokumenty w bazie danych, dzięki czemu możesz je manipulować razem z danymi strukturalnymi w Transact-SQL operacjach opartych na zbiorach.
Więcej informacji o funkcji FileTable można znaleźć w sekcji FileTables. Aby uzyskać informacje o funkcji FILESTREAM, która jest kolejną opcją przechowywania dokumentów w bazie danych, zobacz FILESTREAM.
Powiązane zadania
| Artykuł | Description |
|---|---|
| Instalowanie i konfigurowanie wyszukiwania semantycznego | Opisuje wymagania wstępne dotyczące wyszukiwania statystycznego oraz sposób ich instalowania lub sprawdzania. |
| Włącz wyszukiwanie semantyczne w tabelach i kolumnach | Opisuje sposób włączania lub wyłączania semantycznego indeksowania statystycznego dla wybranych kolumn zawierających dokumenty lub tekst. |
| Znajdowanie kluczowych fraz w dokumentach za pomocą wyszukiwania semantycznego | Opisuje sposób znajdowania kluczowych fraz w dokumentach lub kolumnach tekstowych skonfigurowanych do indeksowania statystycznego. |
| Znajdź podobne i powiązane dokumenty za pomocą wyszukiwania semantycznego | Opisuje sposób znajdowania podobnych lub powiązanych dokumentów lub wartości tekstowych oraz informacji o tym, jak są one podobne lub powiązane, w kolumnach skonfigurowanych do indeksowania semantycznego statystycznego. |
| Zarządzaj i monitoruj wyszukiwanie semantyczne | Opisuje proces indeksowania semantycznego oraz zadania związane z monitorowaniem indeksów i zarządzaniem nimi. |