Kontaktdaten pflegen - Dublettenbereinigung

Übersicht

Mit diesen Werkzeugen sind Sie als Administrator in der Lage, unternehmensweit Kontaktdaten aus dem täglichen Geschäftsablauf konsistent und einheitlich zu halten. Mit der automatischen Dublettenprüfung sorgt PisaSales bereits im Vorfeld für möglichst wenig redundante Datensätze bei der Eingabe bzw. beim Import von Kontaktdaten. Ein Dublettendictionary und mehrstufige Sensibilitätseinstellungen sorgen für größtmögliche Identifizierung. Sollten trotzdem Dubletten auftreten, hilft Ihnen die Kontaktdatenberei­nigung, Dubletten zu finden, zu bereinigen und die Kontaktdaten konsistent zu halten.

Die zentrale Adresspflege unterstützt Sie bei der Einhaltung von Konventionen zur einheitlichen Schreib­weise von Adressen.

Siehe auch: Kapitel Kontakte Konzern- und Regionsstrukturen

Dublettenprüfung

Die PisaSales-Kontaktdatenverwaltung integriert eine Dublettenprüfung, die beim Neuanlegen von Kon­takten automatisch im Hintergrund läuft und doppelte Einträge in der Datenbank registriert.

PisaSales nutzt für die Dublettenprüfung ein Dublettendictionary. Es verwaltet Wörter und Kürzel, die beim Neuanlegen von Kontaktdatensätzen automatisch im Kontext mit dem Gesamteintrag geprüft werden. Beispielsweise werden bei Personen Wörter wie "Herr" oder "Frau" den Suchbegriffen vorange­stellt, bei Unternehmen Wörter wie "GmbH" den Suchbegriffen nachgestellt. Das Dictionary können Sie über das Menü Administration/Dublettenverwaltung/Dubletten Dictionary einsehen und pflegen.

Die automatische Dublettenprüfung wird über die PisaSales-Umgebungsvariablen PSA_SET_DBL_CHK aktiviert.

Die Dublettensuche verwendet zeitgemäße Algorithmen. Während einer Dublettensuche wird jedes Dubletten-Attribut einzeln bewertet. So wird über alle Kontakte iteriert und jedes Feld bewertet. Also entfällt die initiale Suche auf dem Namen, die den Vergleich in früheren PisaSales-Versionen bisher stark eingeschränkt hat. Die Bewertung erfolgt über Tokens, die aus den Daten eines Feldes generiert werden.

Der Vergleich der Tokens unterstützt:

  • Gleichheit (case insensitiv)
  • Levenshtein Distanz
  • Beider-Morse: phonetischer Vergleich

Alle drei Suchalgorithmen werden bei der Suche einer Dublette in PisaSales sequenziell verwendet.

Hinweis: Mit der in dieser Version überarbeiteten Dublettensuche kann es mehr Dubletten-Ergebnisse geben als bisher. Im Gegenzug kann der Datenbestand kontinuierlich qualifiziert werden.

Dokument-Dublettencheck

Der Mechanismus wird in ähnlicher Form für den automatischen Dokumentdublettencheck verwendet. Hier sind keine Einstellungen zu Gewichtung und Genauigkeit erforderlich.