Détecteur de noms de fichiers en double

Un export de dossier affiche report.pdf, report (1).pdf et report (2).pdf, et vous voulez confirmer ce qui est dupliqué avant de faire le ménage. Collez une liste de noms de fichiers, un nom par ligne, et cet outil compte combien de fois chaque nom apparaît. Les chemins sont ignorés : seul le nom de fichier à la fin de chaque ligne est comparé, et vous choisissez si la casse compte.

Comment trouver les noms de fichiers en double

  1. 1

    Collez la liste

    Un nom de fichier par ligne. Si une ligne contient un chemin complet, seul le nom de fichier à la fin est comparé.

  2. 2

    Choisissez l'option de correspondance

    Laissez "Ignorer la casse" activé pour que `IMG_1234.jpg` et `img_1234.JPG` comptent comme un seul nom, ou désactivez-le pour une correspondance exacte.

  3. 3

    Détectez les doublons

    Cliquez sur le bouton. Chaque nom qui apparaît plus d'une fois est regroupé avec son nombre d'occurrences.

  4. 4

    Utilisez le résultat

    Le résultat est une courte liste CSV : nom, nombre. Copiez-la dans votre script de nettoyage ou votre tableur.

Comment fonctionne la correspondance

Réglage Comportement Exemple
Ignorer la casse (par défaut) La casse n’a pas d’importance IMG_1234.jpg = img_1234.JPG
Exact Les noms doivent être identiques IMG_1234.jpg ne correspond qu’à IMG_1234.jpg
Chemins complets Seul le nom de fichier à la fin est comparé /photos/IMG_1234.jpg = IMG_1234.jpg

Le résultat liste chaque nom répété une fois avec son nombre d’occurrences. Les noms qui n’apparaissent qu’une fois ne sont pas listés.

Motifs que cet outil détecte

  • Copies de téléchargements du navigateur. doc.pdf, doc (1).pdf et doc (2).pdf apparaissent quand vous enregistrez le même fichier à plusieurs reprises.
  • Marqueurs “copie” de macOS. file.jpg et file copy.jpg, file copy 2.jpg.
  • Suffixes de doublons de Windows. name - Copy.docx, name - Copy (2).docx.
  • Imports de dossiers d’appareil photo. Le même nom IMG_1234 atterrit dans plusieurs dossiers d’années quand le compteur de l’appareil se réinitialise.

Ce que l’outil ne fait pas

  • Aucune comparaison de contenu. Deux fichiers différents nommés invoice.pdf comptent comme des doublons ici. L’outil ne compare que les noms, alors vérifiez le contenu avant de supprimer.
  • Aucune correspondance approximative. report.pdf et reprot.pdf sont des noms différents et ne sont pas regroupés.
  • Aucun traitement spécial des extensions. photo.jpg et photo.png sont des noms différents.
  • Aucune suppression. L’outil liste seulement les noms et les nombres ; la décision vous appartient.

Après avoir trouvé des doublons

  1. Ne supprimez pas automatiquement. Examinez les groupes, surtout quand les noms sont courants (report.pdf, image.jpg).
  2. Vérifiez le contenu avant de supprimer : comparez les tailles de fichiers ou un hachage du contenu (SHA-256) pour confirmer que les fichiers sont réellement identiques.
  3. Faites d’abord une sauvegarde quand les fichiers proviennent d’une archive irremplaçable.

Questions fréquentes

Seulement les noms. Pour une détection de doublons basée sur le contenu, il faut un outil de hachage qui lit les octets réels du fichier. Ce détecteur fonctionne avec de simples listes de noms, comme celles issues d’exports de répertoires.

Oui. Quand une ligne contient un chemin, seul le nom de fichier à la fin est comparé ; les parties de dossiers sont ignorées.

Parce que “Ignorer la casse” est activé par défaut. Désactivez-le et l’outil traitera les deux noms comme différents.

Oui. La liste est envoyée à notre serveur pour que la détection puisse s’exécuter, et le résultat s’affiche sur la page. La liste n’est pas conservée ensuite.

Outils similaires

Outil disponible dans d’autres langues