Text/Clean

Как удалить повторы из списков имён и адресов почты и отсортировать их

Как удалить повторяющиеся имена и адреса почты после объединения списков и отсортировать их — и почему пробелы или регистр мешают найти дубликаты. С примерами.

Если собрать списки участников мероприятия, респондентов опроса или подписчиков рассылки из нескольких источников, один и тот же человек неизбежно окажется в списке два-три раза. В этом руководстве описано, в каком порядке привести список к виду «одно значение на строку», удалить повторы и отсортировать его.

Базовый конвейер

Встроенный рецепт работает в таком порядке.

  1. Удаление пробелов по краям — удаляет пробелы по краям каждой строки.
  2. Удаление пустых строк — убирает все пустые строки.
  3. Удаление повторяющихся строк — удаляет повторы с включённым параметром «Без учёта регистра».
  4. Сортировка — сортирует по алфавиту с естественным порядком чисел.
РецептыОчистить список (пробелы, пустые строки, дубликаты, сортировка)
  1. Удаление пробелов по краям
  2. Удаление пустых строк
  3. Удаление повторяющихся строк
  4. Сортировка
Открыть инструмент с этим рецептом
minsu@example.com
 jieun@example.com
Minsu@Example.com

park@example.com
jieun@example.com

Такой ввод превращается в следующее. Удаление повторов оставляет первое появление, поэтому остаётся minsu@example.com.

jieun@example.com
minsu@example.com
park@example.com

Почему повторы не находятся

Если значения выглядят одинаково, но не удаляются, причина почти всегда в одном из трёх.

  • Пробелы по краям и повторные пробелы: у удаления повторов по умолчанию включено «Игнорировать пробелы по краям и повторные пробелы», так что при сравнении разница в пробелах не учитывается. Но пробелы в оставшихся строках сохраняются, поэтому для аккуратного результата ставьте перед этим шагом удаление пробелов по краям.
  • Регистр: «Без учёта регистра» по умолчанию выключено. В адресах почты легко смешиваются написания, отличающиеся только регистром, — включите его. Если в списке имён нужно различать имена в латинском написании, выключите.
  • Невидимые символы: в значениях, скопированных с веб-страниц или из мессенджеров, может оказаться пробел нулевой ширины (U+200B) или BOM (U+FEFF). Параметр игнорирования пробелов не считает эти символы пробелами, поэтому поставьте в самое начало конвейера Очистка невидимых символов и кавычек и удалите их заранее.

Если порядок нужно сохранить

Если в списке важен порядок подачи заявок или поступления, выключите или удалите шаг сортировки. Удаление повторов работает и без сортировки и оставляет первое появление на исходном месте, так что порядок «кто записался раньше» сохраняется. Каждый шаг конвейера можно включать и выключать — сравните результаты и решите.

Список через запятую

Если список выглядит как a@x.com, b@x.com, c@x.com, например скопирован из поля получателей письма, его нужно разложить по одному значению на строку, чтобы работали построчные операции. Поставьте в начало конвейера Добавление переносов строк (разбиение), выберите «Разбивать по» — «Разделителю» и укажите разделитель ,. Пробелы в начале каждой строки после разбиения удаляются автоматически. Для списка через точку с запятой укажите разделитель ;.

Если имя и адрес записаны вместе

В списках вида Иван Петров <ivan@example.com> записи с одинаковым адресом считаются разными, если имя написано по-разному. Чтобы удалять повторы только по адресу, оставьте только адрес с помощью режима регулярных выражений в Поиск и замена. Поиск ^.*<([^>]+)>.*$ и замена $1 оставят только адрес внутри угловых скобок. Строки без угловых скобок не изменятся.

Порядок объединения нескольких списков

Удаление повторов оставляет первое появление, поэтому результат зависит от того, в каком порядке вы вставили списки. Например, если объединяете официальный список членов клуба со списком записавшихся на мероприятие и ставите список членов сверху, люди, которые есть в обоих, останутся в написании из списка членов. Вставляйте сверху тот список, где написание точнее.

Если нужно оставить адреса только одной компании, выберите у фильтра строк «Оставить только строки с совпадением», включите регулярное выражение и укажите домен вроде @example\.com$. Если после сортировки поставить в конец нумерацию строк, получится итоговый список с номерами участников.

Выбор критерия сортировки

  • Алфавиту (естественный порядок): корейский — в порядке алфавита хангыля, латиница и кириллица — по алфавиту; item2 идёт раньше item10.
  • Числовому значению: когда в каждой строке есть число, например табельный номер или балл. Строки без чисел уходят в конец.
  • Случайно: для жеребьёвки или очерёдности выступлений. При каждом запуске результат разный.

Ограничения

  • Однофамильцев с одинаковыми именами различить нельзя. Если удалять повторы в списке, где есть только имена, может пропасть другой человек, поэтому по возможности используйте список с уникальными значениями вроде адреса почты или телефона.
  • Написания с разной расстановкой пробелов, как Анна Иванова и АннаИванова, не станут одинаковыми даже при игнорировании пробелов.
  • Если при разбиении списка по запятым внутри значения есть запятая, как в Петров, начальник отдела, одно значение разойдётся на две строки. Просмотрите результат.
  • Сколько строк удалено, видно по изменению числа строк у шага конвейера.

Обратно в одну строку

Чтобы вставить очищенный список в поле получателей письма, добавьте в конец конвейера удаление переносов строк и укажите свой разделитель , или ; . Очищать построчно и склеивать в одну строку только в самом конце — порядок, при котором ошибок меньше всего.

Чек-лист

  • Список через запятую сначала раскладывается по строкам.
  • Для списков адресов почты включайте «Без учёта регистра».
  • Если важен порядок, выключите шаг сортировки.

Последнее обновление: 2026-09-23