Möglicherweise befinden sich in Ihrer Datenbank mehrere Kontakte, die in Wirklichkeit dieselbe Person sind. Die Kontakt-Deduplizierung hilft Ihnen, Duplikate zu bereinigen und dabei Ihre wertvollen Daten wie Attribute, Verläufe und Interaktionen zu bewahren.
In diesem Artikel wird erklärt, wie die Deduplizierung von Kontakten in Positive User funktioniert, wie der Basiskontakt ausgewählt wird, welche Daten zusammengeführt werden und wie Sie künftig Duplikate vermeiden.
Kontakt-Deduplizierung ist ein Prozess, der doppelte Kontaktdatensätze in Ihrer Datenbank identifiziert und zusammenführt. Duplikate werden durch den Vergleich bestimmter Attribute erkannt, wie z. B. E-Mail-Adresse, user_id und Status. Sobald sie identifiziert wurden, werden mehrere Datensätze zu einem umfassenden Kontaktprofil zusammengeführt.
Der Prozess wird vom Support-Team durchgeführt. Um die Deduplizierung zu starten, müssen Sie den Support über den Chat im Workspace kontaktieren. Sie müssen außerdem angeben, wie häufig der Prozess ausgeführt werden soll.
Die Deduplizierung kann geplant werden:
• Als einmaliger Vorgang
• Alle 1, 7 oder 30 Tage oder in einem benutzerdefinierten Intervall
Der Prozess läuft über Nacht (MEZ). Wenn Sie heute eine Deduplizierung anfordern, sehen Sie die Ergebnisse frühestens am nächsten Tag.
Das System durchsucht alle Kontaktdatensätze und gruppiert diejenigen, die dieselbe E-Mail-Adresse teilen. Aus jeder Gruppe wird ein Datensatz als Basiskontakt ausgewählt. Dieser Basiskontakt behält den ursprünglichen Verlauf und die Automatisierungshistorie.
Die Logik zur Auswahl des „Basiskontakts" im Deduplizierungsprozess wird in der folgenden Grafik veranschaulicht.

Die Logik zur Auswahl des Basiskontakts folgt einer strikten Prioritätsreihenfolge.
Die höchste Priorität erhalten Datensätze mit einem Wert im Attribut „User ID". „User ID" ist eine optionale, aber eindeutige Kennung, die Sie Kontakten zuweisen können.
Das bedeutet:
• Datensätze ohne „User ID" haben eine niedrigere Priorität
• Datensätze mit unterschiedlichen „User ID"s werden niemals zusammengeführt, selbst wenn sie dieselbe E-Mail-Adresse teilen
Das System kann Datensätze mit unterschiedlichen „User ID"s nicht zusammenführen. Sie werden immer als separate Kontakte behandelt.

Wenn die „User ID" allein nicht ausreicht, prüft das System das Attribut „Status".
Das Attribut „Status" hat zwei mögliche Werte:
• Kontakt
• Besucher
Ein Datensatz mit dem Status „Kontakt" hat immer Priorität gegenüber einem „Besucher". Der Status „Kontakt" wird automatisch zugewiesen, wenn eine E-Mail-Adresse über das Website-Tracking erfasst wird, kann aber auch manuell oder per Import aktualisiert werden.

Wenn nach den vorherigen Schritten immer noch mehrere Datensätze in Frage kommen, vergleicht das System das Datum „Aktualisiert am". Der Datensatz mit dem älteren Datum „Aktualisiert am" wird zum Basiskontakt.
In seltenen Grenzfällen können zusätzliche Szenarien zutreffen. Diese werden intern durch die Systemlogik behandelt.

Wenn dem Basiskontakt einige Attributwerte fehlen (z. B. Telefonnummer, Stadt, Betriebssystem oder benutzerdefinierte Attribute), werden diese Werte aus den anderen Datensätzen übernommen.
Wenn mehrere Datensätze unterschiedliche Werte für dasselbe Attribut enthalten:
• Der Status „Kontakt" hat Priorität gegenüber „Besucher"
• Falls erforderlich, wird der Datensatz mit dem älteren Datum „Aktualisiert am" verwendet
Alle Interaktionen bleiben erhalten und werden dem Basiskontakt zugeordnet, darunter:
Chat-Konversationsverläufe
Gesendete Nachrichten
Registrierte Events
Zugewiesene Deals
Tags
usw.
Seitenaufrufe werden aggregiert. Für Felder wie „Zuletzt kontaktiert", „Zuletzt gesehen" oder „Zuletzt gehört am" wird der aktuellste Wert beibehalten.
Automatisierungsprotokolle werden nicht zusammengeführt.
Dies kann sich darauf auswirken, wie sich Automatisierungen nach der Deduplizierung verhalten.
Beispiel 1
Wenn ein Kontakt eine Automatisierung gestartet hat, aber nicht zum Basiskontakt wurde, wird das endgültig zusammengeführte Profil diese Automatisierung nicht fortsetzen.
Beispiel 2
Wenn ein Kontakt eine Automatisierung durch Events wie „Tag hinzugefügt", „Zur Liste hinzugefügt" oder „Attributänderung" ausgelöst hat und nicht zum Basiskontakt wurde, können diese Änderungen die Automatisierung nach der Deduplizierung erneut auslösen.
Um Duplikate zu vermeiden, sollten Sie sorgfältig festlegen, wie Kontakte in Ihrem Setup identifiziert werden.
Sie können dies über das Attribut „User ID" oder die Autorisierung per E-Mail-Adresse tun.
Stellen Sie sicher, dass Ihre Autorisierungs- und Identifizierungslogik konsistent ist, unabhängig davon, ob Sie sich auf die „User ID" oder die E-Mail-Adresse verlassen.
Die Kontakt-Deduplizierung ist ein leistungsstarker Vorgang, der Daten dauerhaft zusammenführt. Überprüfen Sie stets Ihre Identifizierungsstrategie, bevor Sie den Service anfordern, um unerwartetes Automatisierungsverhalten oder Datenkonflikte zu vermeiden.