Lieblingsorte deiner Lieblingsstadt
Startseite
Als bevorzugte Quelle bei Google hinzufügen

CSV-Duplikate finden

Fügen Sie CSV-Text ein oder öffnen Sie eine Datei. Zeilen mit gleichem Schlüssel und unterschiedlichen Werten bleiben zur Prüfung erhalten.

Ziehen Sie eine CSV-, TSV- oder TXT-Datei hierher. Eine sep=-Zeile gilt als Daten; entfernen Sie sie bei Bedarf selbst.

Dateikodierung

Eingabetrennzeichen

Eine Datei: höchstens 10 MiB Rohdaten, 5 Millionen Texteinheiten, 100 000 Datensätze, 256 Spalten und 2 Millionen Zellen.

Duplikate finden

Der Vergleich ist exakt: Großschreibung, Leerzeichen, Akzente und führende Nullen zählen. Leere Schlüssel oder Schlüssel nur aus gewöhnlichen Leerzeichen bleiben ungeklärt.

Ergebnisse prüfen

Fügen Sie Text ein oder öffnen Sie eine Datei.

So prüfen Sie CSV-Duplikate

  1. Fügen Sie CSV-Text ein oder öffnen Sie eine CSV-, TSV- oder TXT-Datei. Prüfen Sie Trennzeichen und Kopfzeile.
  2. Vergleichen Sie ganze Zeilen oder wählen Sie eine oder mehrere Schlüsselspalten. Prüfen Sie identische, widersprüchliche und schlüssellose Einträge.
  3. Wählen Sie für jede widersprüchliche Gruppe den zu behaltenden Eintrag und laden Sie Ergebnisse und Bericht herunter.

Was die Prüfung zeigt

  • Beim Vergleich ganzer Zeilen bleibt standardmäßig das erste Vorkommen in der Datei erhalten. Für identische Gruppen können Sie das letzte wählen.
  • Beim Vergleich ausgewählter Spalten werden identische Zeilen von Zeilen mit gleichem Schlüssel und abweichenden Werten getrennt.
  • Eine widersprüchliche Gruppe bleibt vollständig erhalten, bis Sie den ersten, letzten, einen bestimmten oder alle Einträge auswählen.
  • Die CSV-Dateien für behaltene, entfernte und ungeklärte Zeilen bewahren Werte und ursprüngliche Reihenfolge. JSON dokumentiert die Entscheidungen.

Typische Anwendungen

  • Prüfen Sie Kontaktlisten vor dem Import auf mehrfach verwendete E-Mail-Adressen.
  • Finden Sie gleiche Artikelnummern mit unterschiedlichen Preisen oder Beschreibungen.
  • Prüfen Sie wiederholte Bestellnummern, ohne sie automatisch derselben Bestellung zuzuordnen.

Ergebnisse richtig einordnen

Der Vergleich ist exakt und unterscheidet Groß- und Kleinschreibung. Eine gleiche ID beweist nicht, dass zwei Einträge dasselbe Objekt meinen. Leere Schlüssel oder Schlüssel nur aus ASCII-Leerzeichen, Tabulatoren oder Zeilenumbrüchen bleiben ungeklärt; andere unsichtbare Zeichen bleiben erhalten.

Jede Datenzeile erscheint genau einmal: unter behaltenen oder entfernten Zeilen. Ungeklärte Zeilen gehören zu den behaltenen. „Alle behalten“ schließt die Entscheidung ab, lässt aber den Schlüssel mehrfach vorkommen.

CSV-Dateien nutzen das gewählte Trennzeichen, LF- oder CRLF-Zeilenenden und optional eine UTF-8-BOM. Anführungszeichen schützen nicht vor Tabellenformeln. Der JSON-Bericht enthält alle Zeilen, Gruppen und Entscheidungen.

Datenschutz und Grenzen

Die Datei wird im Browser verarbeitet. Rohdateien dürfen bis zu 10 MiB groß sein; zusätzlich gelten separate Grenzen von 5 Millionen Texteinheiten, 100 000 Datensätzen, 256 Spalten und 2 Millionen Zellen. Jede Ausgabedatei ist auf 25 MiB begrenzt.

Fragen zu CSV-Duplikaten

Nein. Alle Zellen bleiben exakter Text, einschließlich führender Nullen, Leerzeichen und eingebetteter Zeilenumbrüche.

Ja. Ungeklärte Zeilen bleiben in der Datei der behaltenen Zeilen und stehen zusätzlich in einer eigenen CSV-Datei.

Die ganze Gruppe bleibt ungeklärt, bis Sie einen Eintrag auswählen oder bewusst alle behalten.

CSV-Trennzeichen umwandeln

CSV-Trennzeichen ändern, Spalten prüfen und Importprobleme erkennen. CSV und TSV werden lokal verarbeitet; Zellwerte bleiben erhalten.

Werkzeug öffnen — CSV-Trennzeichen umwandeln

Zwei CSV-Dateien vergleichen

Ordnen Sie Datensätze über eine Schlüsselspalte zu und finden Sie hinzugefügte, entfernte und geänderte Einträge.

Werkzeug öffnen — Zwei CSV-Dateien vergleichen