적용 대상:SQL Server
통계적 의미 검색은 SQL Server 데이터베이스에 저장된 비구조화 문서에서 통계적으로 중요한 핵심 구문을 추출하고 색인화합니다. 그 후 이 핵심 구문을 사용하여 유사하거나 관련된 문서를 식별합니다.
Overview
의미 검색은 정확한 단어가 아닌 문서 의미를 일치시켜 전체 텍스트 검색을 확장합니다. 일반적인 사용 사례로는 자동 태그 추출, 관련 콘텐츠 발견, 유사한 콘텐츠 간 계층적 탐색이 있습니다. 예를 들어, 문서 말뭉치의 분류체계를 만들기 위해 키프레이드 인덱스를 조회하거나, 직무 설명과 일치하는 이력서를 찾기 위해 문서 유사성 인덱스를 조회할 수 있습니다.
다음 예시들은 의미 인덱스를 쿼리하고 결과를 구조화된 데이터로 가져오는 데 사용하는 세 가지 Transact-SQL rowset 함수를 보여줍니다.
문서에서 핵심 구문 찾기
다음 쿼리는 예제 문서에서 식별된 키 구를 가져옵니다. 각 키 구의 통계적 중요도 순위를 매기는 점수를 기준으로 결과를 내림차순으로 표시합니다.
이 쿼리는 semantickeyphrasetable 함수를 호출합니다.
SET @Title = 'Sample Document.docx';
SELECT @DocID = DocumentID
FROM Documents
WHERE DocumentTitle = @Title;
SELECT @Title AS Title,
keyphrase,
score
FROM SEMANTICKEYPHRASETABLE (Documents, *, @DocID)
ORDER BY score DESC;
유사한 또는 관련 문서 찾기
다음 쿼리에서는 예제 문서와 유사하거나 관련된 것으로 확인된 문서를 가져옵니다. 쿼리 결과는 두 문서의 유사성 순위를 매기는 점수를 기준으로 내림차순으로 표시됩니다.
이 쿼리는 semanticsimilaritytable 함수를 호출합니다.
SET @Title = 'Sample Document.docx';
SELECT @DocID = DocumentID
FROM Documents
WHERE DocumentTitle = @Title;
SELECT @Title AS SourceTitle,
DocumentTitle AS MatchedTitle,
DocumentID,
score
FROM SEMANTICSIMILARITYTABLE (Documents, *, @DocID)
INNER JOIN Documents
ON DocumentID = matched_document_key
ORDER BY score DESC;
문서를 유사하거나 관련되게 만드는 키 구 찾기
다음 쿼리는 두 예제 문서를 유사하거나 서로 관련되게 만드는 키 구를 가져옵니다. 쿼리 결과는 각 키 구의 가중치 순위를 매기는 점수를 기준으로 내림차순으로 표시됩니다.
이 쿼리는 semanticsimilaritydetailstable 함수를 호출합니다.
SET @SourceTitle = 'first.docx';
SET @MatchedTitle = 'second.docx';
SELECT @SourceDocID = DocumentID
FROM Documents
WHERE DocumentTitle = @SourceTitle;
SELECT @MatchedDocID = DocumentID
FROM Documents
WHERE DocumentTitle = @MatchedTitle;
SELECT @SourceTitle AS SourceTitle,
@MatchedTitle AS MatchedTitle,
keyphrase,
score
FROM SEMANTICSIMILARITYDETAILSTABLE (
Documents, DocumentContent, @SourceDocID, DocumentContent, @MatchedDocID
)
ORDER BY score DESC;
SQL Server에 문서 저장
의미 검색으로 문서를 색인하기 전에 문서를 데이터베이스 엔진에 저장하세요.
SQL Server의 FileTable 기능은 비정형 파일과 문서를 데이터베이스에 저장하여, Transact-SQL 집합 기반 연산으로 구조화된 데이터와 함께 조작할 수 있습니다.
FileTable 기능에 대한 자세한 내용은 FileTables를 참조하세요. 데이터베이스에 문서를 저장하는 또 다른 옵션인 FILESTREAM 기능에 대한 정보는 FILESTREAM을 참조하세요.
관련 작업
| 조항 | Description |
|---|---|
| 의미 체계 검색 설치 및 구성 | 통계 의미 체계 검색의 필수 구성 요소 및 설치 또는 확인 방법에 대해 설명합니다. |
| 테이블과 컬럼에서 의미 검색 활성화 | 문서 또는 텍스트가 들어 있는 선택한 열에서 통계 의미 체계 인덱싱을 사용하거나 사용하지 않도록 설정하는 방법에 대해 설명합니다. |
| 의미 체계 검색을 사용하여 문서에서 키 구 찾기 | 통계 의미 체계 인덱싱을 위해 구성된 문서 또는 텍스트 열에서 키 구를 찾는 방법에 대해 설명합니다. |
| 의미 검색으로 유사 및 관련 문서를 찾아보세요 | 통계적 의미 체계 인덱싱을 위해 구성된 열에서 유사하거나 관련된 문서 또는 텍스트 값을 찾고 유사하거나 연관된 정도에 관한 정보를 찾는 방법에 대해 설명합니다. |
| 의미 검색 관리 및 모니터링 | 의미 체계 인덱싱의 프로세스와 인덱스를 모니터링하고 관리하는 데 관련된 작업에 대해 설명합니다. |