Wykrywacz zduplikowanych nazw plików

Eksport folderu pokazuje report.pdf, report (1).pdf i report (2).pdf, a Ty chcesz potwierdzić, co się powtarza, zanim posprzątasz. Wklej listę nazw plików, jedną w każdej linii, a to narzędzie policzy, ile razy występuje każda nazwa. Ścieżki są ignorowane: porównywana jest tylko nazwa pliku na końcu linii, a Ty decydujesz, czy wielkość liter ma znaczenie.

Jak znaleźć zduplikowane nazwy plików

  1. 1

    Wklej listę

    Jedna nazwa pliku w linii. Jeśli linia zawiera pełną ścieżkę, porównywana jest tylko nazwa pliku na jej końcu.

  2. 2

    Wybierz sposób dopasowania

    Zostaw włączone "Ignoruj wielkość liter", aby `IMG_1234.jpg` i `img_1234.JPG` liczyły się jako jedna nazwa, albo wyłącz je, aby dopasowywać dokładnie.

  3. 3

    Wykryj duplikaty

    Kliknij przycisk. Każda nazwa występująca więcej niż raz zostanie pogrupowana z liczbą wystąpień.

  4. 4

    Wykorzystaj wynik

    Wynik to krótka lista CSV: nazwa, liczba. Skopiuj ją do skryptu porządkującego lub arkusza.

Jak działa dopasowanie

Ustawienie Zachowanie Przykład
Ignoruj wielkość liter (domyślne) Wielkość liter nie ma znaczenia IMG_1234.jpg = img_1234.JPG
Dokładne Nazwy muszą być identyczne IMG_1234.jpg pasuje tylko do IMG_1234.jpg
Pełne ścieżki Porównywana jest tylko nazwa pliku na końcu /photos/IMG_1234.jpg = IMG_1234.jpg

Wynik pokazuje każdą powtarzającą się nazwę raz, wraz z liczbą wystąpień. Nazwy występujące tylko raz nie są wypisywane.

Wzorce, które to narzędzie wykrywa

  • Kopie z pobrań przeglądarki. doc.pdf, doc (1).pdf i doc (2).pdf pojawiają się, gdy wielokrotnie zapisujesz ten sam plik.
  • Znaczniki “kopii” z macOS. file.jpg i file copy.jpg, file copy 2.jpg.
  • Przyrostki duplikatów z Windows. name - Copy.docx, name - Copy (2).docx.
  • Importy z folderów aparatu. Ta sama nazwa IMG_1234 trafia do folderów z kilku lat, gdy licznik aparatu się resetuje.

Czego to narzędzie nie robi

  • Nie porównuje zawartości. Dwa różne pliki o nazwie invoice.pdf zostaną uznane za duplikaty. Narzędzie porównuje tylko nazwy, więc przed usunięciem zweryfikuj zawartość.
  • Nie wykrywa podobieństw. report.pdf i reprot.pdf to różne nazwy i nie zostaną połączone.
  • Nie obsługuje rozszerzeń osobno. photo.jpg i photo.png to różne nazwy.
  • Nie usuwa plików. Narzędzie tylko pokazuje nazwy i liczniki; decyzja należy do Ciebie.

Po znalezieniu duplikatów

  1. Nie usuwaj automatycznie. Przejrzyj grupy, zwłaszcza gdy nazwy są popularne (report.pdf, image.jpg).
  2. Sprawdź zawartość przed usunięciem: porównaj rozmiary plików lub skróty treści (SHA-256), aby potwierdzić, że pliki są naprawdę takie same.
  3. Najpierw zrób kopię zapasową, gdy pliki pochodzą z archiwum, którego nie można odtworzyć.

Najczęściej zadawane pytania

Tylko nazwy. Do wykrywania duplikatów na podstawie zawartości potrzebujesz narzędzia haszującego, które czyta faktyczne bajty pliku. Ten wykrywacz działa na zwykłych listach nazw, takich jak te z eksportów katalogów.

Tak. Gdy linia zawiera ścieżkę, porównywana jest tylko nazwa pliku na jej końcu; części folderowe są ignorowane.

Ponieważ opcja “Ignoruj wielkość liter” jest domyślnie włączona. Wyłącz ją, a narzędzie potraktuje obie nazwy jako różne.

Tak. Lista jest wysyłana na nasz serwer, aby wykrywanie mogło działać, a wynik pojawia się na stronie. Lista nie jest później przechowywana.

Powiązane narzędzia

Narzędzie jest dostępne w innych językach