Любимые места любимого города
Главная
Добавить в предпочтительные источники Google

Найти дубликаты CSV

Вставьте CSV или откройте файл. Совпадения ищутся точно; спорные записи остаются в результате до вашего решения.

Перетащите сюда один файл CSV, TSV или TXT. Строка sep= считается данными; при необходимости удалите её вручную.

Кодировка файла

Разделитель исходного файла

Один файл: до 10 МиБ, 5 млн текстовых единиц, 100 000 записей, 256 столбцов и 2 млн ячеек.

Поиск дубликатов

Сравнение точное: регистр, пробелы, акценты и начальные нули учитываются. Пустые ключи и ключи только из обычных пробелов остаются нерешёнными.

Результаты

Вставьте текст или откройте файл.

Как проверить дубликаты в CSV

  1. Вставьте CSV или откройте файл CSV, TSV либо TXT. Проверьте разделитель и наличие заголовка.
  2. Сравните строки целиком или выберите столбцы ключа. Просмотрите одинаковые, спорные и незаполненные ключи.
  3. Для каждой спорной группы выберите запись, которую нужно оставить, затем скачайте результаты и отчёт.

Что показывает проверка

  • При сравнении строк целиком первое совпадение сохраняется по умолчанию. Для одинаковых групп можно оставить последнее.
  • При сравнении по выбранным столбцам одинаковые строки отделяются от строк с тем же ключом, но другими значениями.
  • Спорная группа сохраняется целиком, пока вы не выберете первую, последнюю, конкретную запись либо все записи.
  • CSV с оставленными, удалёнными и нерешёнными строками сохраняют значения и исходный порядок. Решения записываются в JSON.

Когда это полезно

  • Проверьте экспорт контактов на повторяющиеся адреса перед импортом.
  • Найдите артикулы с разными ценами или описаниями.
  • Проверьте повторные номера заказов, не предполагая, что это один и тот же заказ.

Как понимать результаты

Сравнение точное и учитывает регистр. Одинаковый ID не доказывает, что записи относятся к одному объекту. Пустые ключи и ключи только из обычных пробелов, табуляции или переводов строки остаются нерешёнными. Другие невидимые символы сохраняются.

Каждая строка попадает либо в оставленные, либо в удалённые. Нерешённые строки входят в оставленные. Решение «оставить все» завершает проверку группы, но повторные ключи остаются.

CSV использует выбранный разделитель, окончания строк LF или CRLF и необязательную метку UTF-8 BOM. Кавычки не защищают от формул в таблицах. JSON содержит все строки, группы и решения.

Конфиденциальность и ограничения

Файл обрабатывается в браузере. Размер исходного файла — до 10 МиБ; отдельно действуют ограничения в 5 млн текстовых единиц, 100 000 записей, 256 столбцов и 2 млн ячеек. Каждая выгрузка — до 25 МиБ.

Вопросы о дубликатах CSV

Нет. Все ячейки сохраняются как точный текст, включая начальные нули, пробелы и переводы строк.

Да. Нерешённые строки остаются в основном файле и отдельно перечисляются в CSV для проверки.

Вся группа остаётся нерешённой, пока вы не выберете запись либо намеренно не оставите все.

Конвертер разделителей CSV

Меняйте разделитель CSV, проверяйте столбцы и замечайте проблемы импорта. CSV и TSV обрабатываются локально без изменения значений.

Открыть инструмент — Конвертер разделителей CSV

Сравнение двух CSV-файлов

Сопоставьте записи по ключевому столбцу и найдите добавленные, удалённые и изменённые записи.

Открыть инструмент — Сравнение двух CSV-файлов