Извлечение email из текста

Вставьте дамп сообщений, столбец CSV, тред форума или кусок HTML, и извлекатель вытащит каждый email-адрес, который сможет распознать. Вывод дедуплицирован и готов для импорта в вашу CRM или инструмент проверки отказов. Сопоставление покрывает реальное подмножество RFC 5322 (плюс-адресация, точки в локальной части, дефисы в домене) без ложных срабатываний, которые дают простые регулярки a@b.

Как извлечь email из текста

  1. 1

    Вставьте источник

    Загрузите свободный текст, логи, HTML-страницу или экспортированный список контактов: все, что содержит шаблоны `local@domain.tld`.

  2. 2

    Запустите извлекатель

    Регулярное выражение сканирует полные адреса, игнорируя окружающую их пунктуацию.

  3. 3

    Просмотрите количество

    Вы получаете число найденных уникальных адресов плюс полный список.

  4. 4

    Скопируйте список

    Скопируйте в буфер обмена как список через перенос строки или вставьте прямо в столбец таблицы.

Что считается корректным email

Извлекатель следует практической форме email, а не полной грамматике RFC 5322, потому что полная грамматика допускает адреса, которые не примет ни один современный MTA (заквоченные локальные части с пробелами, комментарии в скобках). Вот что покрывает матчер:

Элемент шаблона Принимается Отвергается
Локальная часть a-z 0-9 . _ % + - пробелы, заквоченные строки, угловые скобки
Домен a-z 0-9 . - завершающая точка, подчеркивание в метке
TLD 2+ буквы ASCII TLD только из цифр

Типичные «грязные» вводы, которые он обрабатывает

  • Адреса, за которыми следует . или , в предложениях, пунктуация не захватывается.
  • Email внутри mailto:-ссылок, схема убирается автоматически.
  • HTML-сущности вроде @ не декодируются, поэтому адрес вида info@example.com не будет найден.
  • Адреса, обернутые в <угловые скобки> из заголовков писем.

Что делать с выводом

  • Проверка доставляемости. Прогоните список через сервис проверки отказов перед импортом, собранные списки часто содержат ~10% мертвых адресов.
  • Согласие. То, что адрес появляется в документе, не значит, что человек согласился на контакт. Проверьте GDPR или местный закон перед рассылкой.
  • Дедуплицируйте и по локальной части. john@gmail.com и j.ohn@gmail.com ведут в один и тот же ящик в Gmail; нормализуйте точки, если нужны действительно уникальные идентичности.

Часто задаваемые вопросы

Нет. Извлекатель нацелен на реальные, разбираемые адреса. Сначала расшифруйте замаскированные формы или предобработайте текст, заменив [at] на @ и [dot] на ..

Нет. Сопоставление читает только базовые латинские буквы, поэтому müller@straße.de не обнаруживается. Перед запуском извлекателя преобразуйте адрес в ASCII-форму punycode, например user@xn--strae-oqa.de.

Нет, опции сохранить дубликаты нет. Вывод дедуплицирован и сохраняет порядок первого появления. Если нужно посчитать упоминания, считайте их в исходном тексте.

Нет. Текст обрабатывается для вашего запроса, не сохраняется в базе данных, не попадает в логи и не добавляется в ссылку страницы.

Сопутствующие инструменты

Счётчик слов

Подсчитайте слова, символы, предложения и абзацы с учётом времени чтения, времени произнесения вслух, плотности ключевых слов и оценки удобочитаемости по Флешу, для эссе, постов, подписей и meta-описаний.

Символы стрелок для копирования

Копируйте популярные Unicode-стрелки одним щелчком: прямые, двойные, диагональные, крючковые, круговые и треугольные для документов, чатов и дизайна.

Символ «меньше или равно»

Копируйте знак ≤ и связанные математические символы сравнения. Включает Unicode, HTML-сущности и разметку LaTeX для электронных таблиц, научных работ и веб-страниц.

Генератор глитч-текста

Создавайте глитч-текст в стиле Zalgo с помощью комбинируемых знаков Unicode. Выберите интенсивность, посмотрите варианты и скопируйте искаженный текст для профиля, мема или хоррор-поста.

Преобразователь текста для людей с дислексией

Переформатируйте вставленный текст в короткие абзацы и строки примерно по 72 символа для более лёгкого чтения. Скопируйте результат в любой документ, письмо или редактор.

Переводчик в шрифт Брайля

Переводите текст в шрифт Брайля Unicode 1-го уровня и декодируйте Брайль обратно в буквы. Обрабатывает заглавные буквы, цифры и знаки препинания.

Инструмент доступен на других языках