의미 탐색 (SQL Server)

적용 대상:SQL Server

통계적 의미 검색은 SQL Server 데이터베이스에 저장된 비구조화 문서에서 통계적으로 중요한 핵심 구문을 추출하고 색인화합니다. 그 후 이 핵심 구문을 사용하여 유사하거나 관련된 문서를 식별합니다.

Overview

의미 검색은 정확한 단어가 아닌 문서 의미를 일치시켜 전체 텍스트 검색을 확장합니다. 일반적인 사용 사례로는 자동 태그 추출, 관련 콘텐츠 발견, 유사한 콘텐츠 간 계층적 탐색이 있습니다. 예를 들어, 문서 말뭉치의 분류체계를 만들기 위해 키프레이드 인덱스를 조회하거나, 직무 설명과 일치하는 이력서를 찾기 위해 문서 유사성 인덱스를 조회할 수 있습니다.

다음 예시들은 의미 인덱스를 쿼리하고 결과를 구조화된 데이터로 가져오는 데 사용하는 세 가지 Transact-SQL rowset 함수를 보여줍니다.

문서에서 핵심 구문 찾기

다음 쿼리는 예제 문서에서 식별된 키 구를 가져옵니다. 각 키 구의 통계적 중요도 순위를 매기는 점수를 기준으로 결과를 내림차순으로 표시합니다.

이 쿼리는 semantickeyphrasetable 함수를 호출합니다.

SET @Title = 'Sample Document.docx';

SELECT @DocID = DocumentID
FROM Documents
WHERE DocumentTitle = @Title;

SELECT @Title AS Title,
       keyphrase,
       score
FROM SEMANTICKEYPHRASETABLE (Documents, *, @DocID)
ORDER BY score DESC;

다음 쿼리에서는 예제 문서와 유사하거나 관련된 것으로 확인된 문서를 가져옵니다. 쿼리 결과는 두 문서의 유사성 순위를 매기는 점수를 기준으로 내림차순으로 표시됩니다.

이 쿼리는 semanticsimilaritytable 함수를 호출합니다.

SET @Title = 'Sample Document.docx';

SELECT @DocID = DocumentID
FROM Documents
WHERE DocumentTitle = @Title;

SELECT @Title AS SourceTitle,
       DocumentTitle AS MatchedTitle,
       DocumentID,
       score
FROM SEMANTICSIMILARITYTABLE (Documents, *, @DocID)
     INNER JOIN Documents
         ON DocumentID = matched_document_key
ORDER BY score DESC;

다음 쿼리는 두 예제 문서를 유사하거나 서로 관련되게 만드는 키 구를 가져옵니다. 쿼리 결과는 각 키 구의 가중치 순위를 매기는 점수를 기준으로 내림차순으로 표시됩니다.

이 쿼리는 semanticsimilaritydetailstable 함수를 호출합니다.

SET @SourceTitle = 'first.docx';
SET @MatchedTitle = 'second.docx';

SELECT @SourceDocID = DocumentID
FROM Documents
WHERE DocumentTitle = @SourceTitle;

SELECT @MatchedDocID = DocumentID
FROM Documents
WHERE DocumentTitle = @MatchedTitle;

SELECT @SourceTitle AS SourceTitle,
       @MatchedTitle AS MatchedTitle,
       keyphrase,
       score
FROM SEMANTICSIMILARITYDETAILSTABLE (
    Documents, DocumentContent, @SourceDocID, DocumentContent, @MatchedDocID
)
ORDER BY score DESC;

SQL Server에 문서 저장

의미 검색으로 문서를 색인하기 전에 문서를 데이터베이스 엔진에 저장하세요.

SQL Server의 FileTable 기능은 비정형 파일과 문서를 데이터베이스에 저장하여, Transact-SQL 집합 기반 연산으로 구조화된 데이터와 함께 조작할 수 있습니다.

FileTable 기능에 대한 자세한 내용은 FileTables를 참조하세요. 데이터베이스에 문서를 저장하는 또 다른 옵션인 FILESTREAM 기능에 대한 정보는 FILESTREAM을 참조하세요.

조항 Description
의미 체계 검색 설치 및 구성 통계 의미 체계 검색의 필수 구성 요소 및 설치 또는 확인 방법에 대해 설명합니다.
테이블과 컬럼에서 의미 검색 활성화 문서 또는 텍스트가 들어 있는 선택한 열에서 통계 의미 체계 인덱싱을 사용하거나 사용하지 않도록 설정하는 방법에 대해 설명합니다.
의미 체계 검색을 사용하여 문서에서 키 구 찾기 통계 의미 체계 인덱싱을 위해 구성된 문서 또는 텍스트 열에서 키 구를 찾는 방법에 대해 설명합니다.
의미 검색으로 유사 및 관련 문서를 찾아보세요 통계적 의미 체계 인덱싱을 위해 구성된 열에서 유사하거나 관련된 문서 또는 텍스트 값을 찾고 유사하거나 연관된 정도에 관한 정보를 찾는 방법에 대해 설명합니다.
의미 검색 관리 및 모니터링 의미 체계 인덱싱의 프로세스와 인덱스를 모니터링하고 관리하는 데 관련된 작업에 대해 설명합니다.