Catatan
Akses ke halaman ini memerlukan otorisasi. Anda dapat mencoba masuk atau mengubah direktori.
Akses ke halaman ini memerlukan otorisasi. Anda dapat mencoba mengubah direktori.
Berlaku untuk:SQL Server
Pencarian semantik statistik mengekstrak dan mengindeks frasa kunci yang relevan secara statistik dari dokumen tidak terstruktur yang disimpan dalam database SQL Server. Kemudian menggunakan frasa kunci ini untuk mengidentifikasi dokumen yang serupa atau terkait.
Overview
Pencarian semantik memperluas pencarian teks lengkap dengan mencocokkan makna dokumen daripada kata-kata yang tepat. Kasus penggunaan umum termasuk ekstraksi tag otomatis, penemuan konten terkait, dan navigasi hierarkis di seluruh konten serupa. Misalnya, Anda dapat mengkueri indeks frasa kunci untuk membuat taksonomi untuk korpus dokumen, atau mengkueri indeks kesamaan dokumen untuk mengidentifikasi resume yang cocok dengan deskripsi pekerjaan.
Contoh berikut menunjukkan tiga fungsi kumpulan baris Transact-SQL yang Anda gunakan untuk mengkueri indeks semantik dan mengambil hasilnya sebagai data terstruktur.
Menemukan frasa kunci dalam dokumen
Kueri berikut mendapatkan frasa kunci yang diidentifikasi dalam dokumen sampel. Ini menyajikan hasil dalam urutan menurun dengan skor yang memberi peringkat signifikansi statistik dari setiap frasa kunci.
Kueri ini memanggil fungsi semantickeyphrasetable .
SET @Title = 'Sample Document.docx';
SELECT @DocID = DocumentID
FROM Documents
WHERE DocumentTitle = @Title;
SELECT @Title AS Title,
keyphrase,
score
FROM SEMANTICKEYPHRASETABLE (Documents, *, @DocID)
ORDER BY score DESC;
Menemukan dokumen serupa atau terkait
Kueri berikut mendapatkan dokumen yang diidentifikasi serupa atau terkait dengan dokumen sampel. Ini menyajikan hasil dalam urutan turun dengan skor yang memberi peringkat kesamaan dua dokumen.
Kueri ini memanggil fungsi semanticsimilaritytable .
SET @Title = 'Sample Document.docx';
SELECT @DocID = DocumentID
FROM Documents
WHERE DocumentTitle = @Title;
SELECT @Title AS SourceTitle,
DocumentTitle AS MatchedTitle,
DocumentID,
score
FROM SEMANTICSIMILARITYTABLE (Documents, *, @DocID)
INNER JOIN Documents
ON DocumentID = matched_document_key
ORDER BY score DESC;
Temukan frasa kunci yang membuat dokumen serupa atau terkait
Kueri berikut mendapatkan frasa kunci yang membuat dua contoh dokumen serupa atau terkait satu sama lain. Ini menyajikan hasil dalam urutan turun dengan skor yang memberi peringkat berat setiap frasa kunci.
Kueri ini memanggil fungsi semanticsimilaritydetailstable .
SET @SourceTitle = 'first.docx';
SET @MatchedTitle = 'second.docx';
SELECT @SourceDocID = DocumentID
FROM Documents
WHERE DocumentTitle = @SourceTitle;
SELECT @MatchedDocID = DocumentID
FROM Documents
WHERE DocumentTitle = @MatchedTitle;
SELECT @SourceTitle AS SourceTitle,
@MatchedTitle AS MatchedTitle,
keyphrase,
score
FROM SEMANTICSIMILARITYDETAILSTABLE (
Documents, DocumentContent, @SourceDocID, DocumentContent, @MatchedDocID
)
ORDER BY score DESC;
Menyimpan dokumen Anda di SQL Server
Sebelum Anda dapat mengindeks dokumen dengan pencarian semantik, simpan dokumen di Database Engine.
Fitur FileTable di SQL Server menyimpan file dan dokumen yang tidak terstruktur dalam database, sehingga Anda dapat memanipulasinya bersama dengan data terstruktur dalam operasi berbasis set Transact-SQL.
Untuk informasi selengkapnya tentang fitur FileTable, lihat FileTables. Untuk informasi tentang fitur FILESTREAM, yang merupakan opsi lain untuk menyimpan dokumen dalam database, lihat FILESTREAM.
Tugas terkait
| Artikel | Description |
|---|---|
| Menginstal dan Mengonfigurasi Pencarian Semantik | Menjelaskan prasyarat untuk pencarian semantik statistik dan cara menginstal atau memeriksanya. |
| Mengaktifkan pencarian semantik pada tabel dan kolom | Menjelaskan cara mengaktifkan atau menonaktifkan pengindeksan semantik statistik pada kolom terpilih yang berisi dokumen atau teks. |
| Menemukan Frasa Kunci di Dokumen dengan Pencarian Semantik | Menjelaskan cara menemukan frasa kunci dalam dokumen atau kolom teks yang dikonfigurasi untuk pengindeksan semantik statistik. |
| Temukan dokumen serupa dan terkait dengan penelusuran semantik | Menjelaskan cara menemukan dokumen atau nilai teks serupa atau terkait, dan informasi tentang bagaimana dokumen serupa atau terkait, dalam kolom yang dikonfigurasi untuk pengindeksan semantik statistik. |
| Mengelola dan memantau Penelusuran Semantik | Menjelaskan proses pengindeksan semantik dan tugas yang terkait dengan pemantauan dan pengelolaan indeks. |