Maxim Mironjuk
-
Februar 11, 2025
Duplikate entstehen selten absichtlich, sondern schleichend: eine fehlende Unique-Constraint, ein doppelt ausgeführter Import, eine Race Condition bei parallelen Schreibzugriffen oder ein Merge zweier Datenquellen ohne Abgleich. Sind sie erst einmal in der Datenbank, verzerren sie Auswertungen, blähen Joins auf und untergraben das Vertrauen in Reports. Dieser Artikel zeigt systematisch, wie sich exakte und unscharfe Duplikate finden lassen, wie ein Datensatz sicher als zu behaltend ausgewählt wird und wie das Löschen auch dann funktioniert, wenn andere Tabellen per Fremdschlüssel auf die Duplikate verweisen.