Как удалить повторы из списков имён и адресов почты и отсортировать их
Как удалить повторяющиеся имена и адреса почты после объединения списков и отсортировать их — и почему пробелы или регистр мешают найти дубликаты. С примерами.
Если собрать списки участников мероприятия, респондентов опроса или подписчиков рассылки из нескольких источников, один и тот же человек неизбежно окажется в списке два-три раза. В этом руководстве описано, в каком порядке привести список к виду «одно значение на строку», удалить повторы и отсортировать его.
Базовый конвейер
Встроенный рецепт работает в таком порядке.
- Удаление пробелов по краям — удаляет пробелы по краям каждой строки.
- Удаление пустых строк — убирает все пустые строки.
- Удаление повторяющихся строк — удаляет повторы с включённым параметром «Без учёта регистра».
- Сортировка — сортирует по алфавиту с естественным порядком чисел.
- Удаление пробелов по краям
- Удаление пустых строк
- Удаление повторяющихся строк
- Сортировка
minsu@example.com jieun@example.com Minsu@Example.com park@example.com jieun@example.com
Такой ввод превращается в следующее. Удаление повторов оставляет первое появление, поэтому остаётся minsu@example.com.
jieun@example.com minsu@example.com park@example.com
Почему повторы не находятся
Если значения выглядят одинаково, но не удаляются, причина почти всегда в одном из трёх.
- Пробелы по краям и повторные пробелы: у удаления повторов по умолчанию включено «Игнорировать пробелы по краям и повторные пробелы», так что при сравнении разница в пробелах не учитывается. Но пробелы в оставшихся строках сохраняются, поэтому для аккуратного результата ставьте перед этим шагом удаление пробелов по краям.
- Регистр: «Без учёта регистра» по умолчанию выключено. В адресах почты легко смешиваются написания, отличающиеся только регистром, — включите его. Если в списке имён нужно различать имена в латинском написании, выключите.
- Невидимые символы: в значениях, скопированных с веб-страниц или из мессенджеров, может оказаться пробел нулевой ширины (U+200B) или BOM (U+FEFF). Параметр игнорирования пробелов не считает эти символы пробелами, поэтому поставьте в самое начало конвейера Очистка невидимых символов и кавычек и удалите их заранее.
Если порядок нужно сохранить
Если в списке важен порядок подачи заявок или поступления, выключите или удалите шаг сортировки. Удаление повторов работает и без сортировки и оставляет первое появление на исходном месте, так что порядок «кто записался раньше» сохраняется. Каждый шаг конвейера можно включать и выключать — сравните результаты и решите.
Список через запятую
Если список выглядит как a@x.com, b@x.com, c@x.com, например скопирован из поля получателей письма, его нужно разложить по одному значению на строку, чтобы работали построчные операции. Поставьте в начало конвейера Добавление переносов строк (разбиение), выберите «Разбивать по» — «Разделителю» и укажите разделитель ,. Пробелы в начале каждой строки после разбиения удаляются автоматически. Для списка через точку с запятой укажите разделитель ;.
Если имя и адрес записаны вместе
В списках вида Иван Петров <ivan@example.com> записи с одинаковым адресом считаются разными, если имя написано по-разному. Чтобы удалять повторы только по адресу, оставьте только адрес с помощью режима регулярных выражений в Поиск и замена. Поиск ^.*<([^>]+)>.*$ и замена $1 оставят только адрес внутри угловых скобок. Строки без угловых скобок не изменятся.
Порядок объединения нескольких списков
Удаление повторов оставляет первое появление, поэтому результат зависит от того, в каком порядке вы вставили списки. Например, если объединяете официальный список членов клуба со списком записавшихся на мероприятие и ставите список членов сверху, люди, которые есть в обоих, останутся в написании из списка членов. Вставляйте сверху тот список, где написание точнее.
Если нужно оставить адреса только одной компании, выберите у фильтра строк «Оставить только строки с совпадением», включите регулярное выражение и укажите домен вроде @example\.com$. Если после сортировки поставить в конец нумерацию строк, получится итоговый список с номерами участников.
Выбор критерия сортировки
- Алфавиту (естественный порядок): корейский — в порядке алфавита хангыля, латиница и кириллица — по алфавиту;
item2идёт раньшеitem10. - Числовому значению: когда в каждой строке есть число, например табельный номер или балл. Строки без чисел уходят в конец.
- Случайно: для жеребьёвки или очерёдности выступлений. При каждом запуске результат разный.
Ограничения
- Однофамильцев с одинаковыми именами различить нельзя. Если удалять повторы в списке, где есть только имена, может пропасть другой человек, поэтому по возможности используйте список с уникальными значениями вроде адреса почты или телефона.
- Написания с разной расстановкой пробелов, как
Анна ИвановаиАннаИванова, не станут одинаковыми даже при игнорировании пробелов. - Если при разбиении списка по запятым внутри значения есть запятая, как в
Петров, начальник отдела, одно значение разойдётся на две строки. Просмотрите результат. - Сколько строк удалено, видно по изменению числа строк у шага конвейера.
Обратно в одну строку
Чтобы вставить очищенный список в поле получателей письма, добавьте в конец конвейера удаление переносов строк и укажите свой разделитель , или ; . Очищать построчно и склеивать в одну строку только в самом конце — порядок, при котором ошибок меньше всего.
Чек-лист
- Список через запятую сначала раскладывается по строкам.
- Для списков адресов почты включайте «Без учёта регистра».
- Если важен порядок, выключите шаг сортировки.
Последнее обновление: 2026-09-23