Supprimer les doublons et trier une liste de noms ou d'e-mails
Fusionner des listes, supprimer noms et e-mails en double et trier : doublons masqués par les espaces ou la casse, respect de l'ordre d'inscription.
Quand on rassemble des listes de participants à un événement, de répondants à une enquête ou d'abonnés à une newsletter provenant de plusieurs sources, la même personne apparaît forcément deux ou trois fois. Ce guide explique dans quel ordre mettre la liste à un élément par ligne, supprimer les doublons et trier.
Pipeline de base
La recette intégrée suit cet ordre.
- Supprimer les espaces en bordure — efface les espaces en bordure de chaque ligne.
- Supprimer les lignes vides — efface toutes les lignes vides.
- Supprimer les lignes en double — supprime les doublons avec « Ignorer la casse » activé.
- Trier — trie par ordre alphabétique et naturel.
- Supprimer les espaces en bordure
- Supprimer les lignes vides
- Supprimer les lignes en double
- Trier
minsu@example.com jieun@example.com Minsu@Example.com park@example.com jieun@example.com
L'entrée ci-dessus devient la suivante. La suppression des doublons garde la première occurrence : c'est donc minsu@example.com qui reste.
jieun@example.com minsu@example.com park@example.com
Pourquoi des doublons ne sont pas détectés
Si des lignes apparemment identiques ne sont pas supprimées, c'est presque toujours pour l'une de ces trois raisons.
- Espaces en bordure et répétés : la suppression des doublons a « Ignorer les espaces en bordure et répétés » activé par défaut et ignore les écarts d'espacement lors de la comparaison. Mais les espaces de la ligne conservée ne changent pas ; pour un résultat propre, placez la suppression des espaces en bordure avant.
- Casse : « Ignorer la casse » est désactivé par défaut. Les adresses e-mail mélangent facilement des graphies qui ne diffèrent que par la casse : activez l'option. Désactivez-la si vous devez distinguer des noms dans une liste de noms.
- Caractères invisibles : les valeurs copiées depuis le web ou une messagerie peuvent contenir un espace de largeur nulle (U+200B) ou un BOM (U+FEFF). L'option d'ignorer les espaces ne les considère pas comme des espaces : placez Nettoyer caractères invisibles et guillemets en tête du pipeline pour les effacer d'abord.
Quand l'ordre doit être conservé
Si l'ordre d'inscription ou de réception a un sens, désactivez ou supprimez l'étape de tri. La suppression des doublons fonctionne sans tri et garde la première occurrence à sa place d'origine : l'ordre « premier inscrit » est ainsi préservé. Chaque étape du pipeline peut être activée ou désactivée : comparez les résultats avant de décider.
Listes séparées par des virgules
Si la liste se présente sous la forme a@x.com, b@x.com, c@x.com, comme lorsqu'on la copie depuis le champ des destinataires d'un e-mail, il faut la déplier à un élément par ligne pour que les opérations ligne par ligne fonctionnent. Placez Ajouter des sauts de ligne (découper) en tête du pipeline, avec le critère « Caractère séparateur » et le séparateur ,. Après le découpage, les espaces en tête de chaque ligne sont effacés automatiquement. Pour une liste séparée par des points-virgules, utilisez ; comme séparateur.
Quand nom et adresse sont réunis
Dans une liste comme Marie Dubois <marie@example.com>, où nom et adresse sont réunis, une même adresse accompagnée de noms écrits différemment compte comme une ligne différente. Pour dédoublonner uniquement sur l'adresse, ne gardez que celle-ci grâce au mode expression régulière de Rechercher et remplacer : recherchez ^.*<([^>]+)>.*$ et remplacez par $1 pour ne conserver que l'adresse entre chevrons. Les lignes sans chevrons ne changent pas.
Dans quel ordre fusionner plusieurs listes
La suppression des doublons garde la première occurrence : l'ordre dans lequel vous collez les listes détermine donc le résultat. Par exemple, en fusionnant la liste officielle des membres et la liste des inscrits à un événement, si vous placez la liste des membres en haut, les personnes présentes dans les deux gardent la graphie de la liste des membres. Collez en haut la liste dont la graphie est la plus fiable.
Pour ne garder que les adresses d'une entreprise, utilisez le filtre de lignes avec « Garder seulement les lignes contenant » et l'expression régulière, en indiquant le domaine sous la forme @example\.com$. En plaçant la numérotation des lignes en dernier, après le tri, vous obtenez la liste finale avec un numéro de participant.
Choisir le critère de tri
- Alphabétique · naturel : lettres latines par ordre alphabétique et hangul coréen dans l'ordre ganada ;
item2passe avantitem10. - Valeur numérique : quand chaque ligne contient un nombre, comme un matricule ou un score. Les lignes sans nombre vont à la fin.
- Aléatoire : pour un tirage au sort ou un ordre de passage. Le résultat change à chaque exécution.
Limites
- Les homonymes ne peuvent pas être distingués. Dédoublonner une liste ne contenant que des noms peut effacer des personnes différentes ; utilisez si possible une liste avec une valeur unique, comme l'e-mail ou le téléphone.
- Des graphies à l'espacement différent, comme
Marie ClaireetMarieClaire, ne deviennent pas identiques même avec l'option d'ignorer les espaces. - En dépliant une liste sur les virgules, une valeur qui contient une virgule, comme
Dubois, Marie, est coupée en deux lignes. Parcourez le résultat. - Le nombre de lignes supprimées se lit dans la variation du nombre de lignes affichée à l'étape du pipeline.
Revenir à une seule ligne
Pour coller la liste nettoyée dans le champ des destinataires d'un e-mail, ajoutez en fin de pipeline la suppression des sauts de ligne avec le séparateur « Personnalisé » , ou ; . Nettoyer ligne par ligne puis ne joindre en une ligne qu'à la fin est l'ordre qui limite le plus les erreurs.
Check-list
- Les listes à virgules se déplient d'abord en lignes.
- Pour les listes d'e-mails, activez « Ignorer la casse ».
- Si l'ordre compte, désactivez l'étape de tri.
Dernière mise à jour: 2026-09-23