Colle une liste, une valeur par ligne, pour retirer les doublons exacts et repérer les quasi-doublons.
Quand s'en servir ? Nettoyer une liste d'emails ou de contacts avant un envoi groupé, fusionner deux listes de noms, ou repérer une faute de frappe qui a créé un doublon caché (ex : « alice@exemple.fr » et « alice@exemple.f »). Les quasi-doublons sont juste signalés, jamais fusionnés automatiquement.
Repérer des quasi-doublons (comme deux adresses email qui ne diffèrent que d'une lettre) s'appuie sur un concept mathématique appelé la « distance de Levenshtein », inventée par un mathématicien soviétique en 1965 : elle mesure le nombre minimal de modifications (ajout, suppression, substitution d'un caractère) nécessaires pour transformer un mot en un autre — plus cette distance est faible, plus les deux mots se ressemblent.
Chaque ligne est comparée aux lignes déjà vues (en ignorant la casse si l'option est cochée) pour repérer les doublons exacts. Pour les quasi-doublons, l'outil calcule la distance de Levenshtein entre chaque paire de lignes restantes : si deux lignes ne diffèrent que d'un ou deux caractères, elles sont signalées comme quasi-doublons potentiels, sans jamais être fusionnées automatiquement.
Non, toute la comparaison et le nettoyage de la liste se font directement dans ton navigateur.
Non, jamais automatiquement : ils sont seulement signalés dans une liste séparée, à vérifier et corriger toi-même pour éviter de fusionner deux entrées qui seraient en réalité différentes.
La déduplication exacte n'a pas de limite pratique, mais la détection de quasi-doublons est volontairement limitée aux 250 premières lignes pour rester rapide sur de grandes listes.
Cet outil fait partie de Quiko, une collection de 81 générateurs gratuits.