Semantische Suche (SQL Server)

Gilt für:SQL Server

Die statistische semantische Suche extrahiert und indexiert statistisch relevante Schlüsselphrasen aus unstrukturierten Dokumenten, die in SQL Server-Datenbanken gespeichert sind. Anschließend werden diese Schlüsselbegriffe verwendet, um Dokumente zu identifizieren, die ähnlich oder verwandt sind.

Übersicht

Die semantische Suche erweitert die Volltextsuche, indem sie die Bedeutung des Dokuments statt exakter Wörter abgleicht. Häufige Anwendungsfälle sind die automatische Tag-Extraktion, die Entdeckung verwandter Inhalte und die hierarchische Navigation über ähnliche Inhalte. Zum Beispiel können Sie den Schlüsselbegriffsindex abfragen, um eine Taxonomie für ein Dokumentenkorpus zu erstellen, oder den Dokumentenähnlichkeitsindex absuchen, um Lebensläufe zu identifizieren, die einer Stellenbeschreibung entsprechen.

Die folgenden Beispiele zeigen die drei Transact-SQL Rowset-Funktionen, mit denen Sie die semantischen Indizes abfragen und die Ergebnisse als strukturierte Daten abrufen.

Suchen der Schlüsselausdrücke in einem Dokument

Die folgende Abfrage ruft die Schlüsselausdrücke ab, die im Beispieldokument identifiziert wurden. Sie präsentiert die Ergebnisse in absteigender Reihenfolge nach dem Grad der statistischen Bedeutung der einzelnen Schlüsselausdrücke.

Diese Abfrage ruft die Funktion semantickeyphrasetable auf.

SET @Title = 'Sample Document.docx';

SELECT @DocID = DocumentID
FROM Documents
WHERE DocumentTitle = @Title;

SELECT @Title AS Title,
       keyphrase,
       score
FROM SEMANTICKEYPHRASETABLE (Documents, *, @DocID)
ORDER BY score DESC;

Die folgende Abfrage ruft die Dokumente ab, die als dem Beispieldokument ähnlich oder damit verwandt identifiziert wurden. Sie präsentiert die Ergebnisse in absteigender Reihenfolge nach dem Grad der Ähnlichkeit von zwei Dokumenten.

Diese Abfrage ruft die Funktion semanticsimilaritytable auf.

SET @Title = 'Sample Document.docx';

SELECT @DocID = DocumentID
FROM Documents
WHERE DocumentTitle = @Title;

SELECT @Title AS SourceTitle,
       DocumentTitle AS MatchedTitle,
       DocumentID,
       score
FROM SEMANTICSIMILARITYTABLE (Documents, *, @DocID)
     INNER JOIN Documents
         ON DocumentID = matched_document_key
ORDER BY score DESC;

Die folgende Abfrage ruft die Schlüsselausdrücke ab, die zwei Beispieldokumente ähnlich oder verwandt machen. Sie präsentiert die Ergebnisse in absteigender Reihenfolge nach dem Wert, der die Gewichtung der einzelnen Schlüsselbegriffe bewertet.

Diese Abfrage ruft die Funktion semanticsimilaritydetailstable auf.

SET @SourceTitle = 'first.docx';
SET @MatchedTitle = 'second.docx';

SELECT @SourceDocID = DocumentID
FROM Documents
WHERE DocumentTitle = @SourceTitle;

SELECT @MatchedDocID = DocumentID
FROM Documents
WHERE DocumentTitle = @MatchedTitle;

SELECT @SourceTitle AS SourceTitle,
       @MatchedTitle AS MatchedTitle,
       keyphrase,
       score
FROM SEMANTICSIMILARITYDETAILSTABLE (
    Documents, DocumentContent, @SourceDocID, DocumentContent, @MatchedDocID
)
ORDER BY score DESC;

Speichern von Dokumenten in SQL Server

Bevor Sie Dokumente mit semantischer Suche indexieren können, speichern Sie die Dokumente in der Datenbank-Engine.

Die FileTable-Funktion in SQL Server speichert unstrukturierte Dateien und Dokumente in der Datenbank, sodass Sie sie zusammen mit strukturierten Daten in Transact-SQL setbasierten Operationen bearbeiten können.

Weitere Informationen zur Funktion FileTable finden Sie unter FileTables. Informationen zur FILESTREAM-Funktion, die eine weitere Option zur Speicherung von Dokumenten in der Datenbank ist, finden Sie unter FILESTREAM.

Artikel Description
Installieren und Konfigurieren der semantischen Suche Beschreibt die erforderlichen Komponenten für die statistische semantische Suche und wie diese Komponenten installiert oder überprüft werden.
Semantische Suche in Tabellen und Spalten aktivieren Beschreibt, wie die statistische semantische Indizierung für ausgewählte Spalten, die Dokumente oder Text enthalten, aktiviert bzw. deaktiviert wird.
Suchen von Schlüsselausdrücken in Dokumenten mit der semantischen Suche Beschreibt, wie Schlüsselausdrücke in Dokumenten oder Textspalten gesucht werden, die für die statistische semantische Indizierung konfiguriert sind.
Finden Sie ähnliche und verwandte Dokumente mit semantischer Suche Beschreibt, wie ähnliche oder verwandte Dokumente oder Textwerte sowie Informationen zur Ähnlichkeit oder Verwandtschaft über Spalten gesucht werden, die für die statistische semantische Indizierung konfiguriert sind.
Verwaltung und Überwachung der semantischen Suche Beschreibt den Prozess der semantischen Indizierung sowie die Tasks im Zusammenhang mit der Überwachung und Verwaltung der Indizes.