Wyodrębnianie adresów e-mail z tekstu

Wklej zrzut wiadomości, kolumnę pliku CSV, wątek z forum lub fragment kodu HTML, a narzędzie wyodrębni każdy adres e-mail, jaki potrafi rozpoznać. Wynik jest pozbawiony duplikatów i gotowy do zaimportowania do Twojego systemu CRM lub narzędzia sprawdzającego odrzucone wiadomości. Dopasowanie obejmuje praktyczny podzbiór normy RFC 5322 (adresowanie z plusem, kropki w części lokalnej, myślniki w domenie) bez fałszywych trafień, jakie generują proste wyrażenia regularne typu a@b.

Jak wyodrębnić adresy e-mail z tekstu

  1. 1

    Wklej swoje źródło

    Wstaw dowolny tekst, logi, stronę HTML lub wyeksportowaną listę kontaktów, cokolwiek, co zawiera wzorce `local@domain.tld`.

  2. 2

    Uruchom wyodrębnianie

    Wyrażenie regularne wyszukuje kompletne adresy, ignorując otaczające je znaki interpunkcyjne.

  3. 3

    Sprawdź liczbę

    Otrzymasz liczbę znalezionych unikalnych adresów wraz z pełną listą.

  4. 4

    Skopiuj listę

    Skopiuj do schowka jako listę z jednym adresem w każdym wierszu albo wklej bezpośrednio do kolumny arkusza kalkulacyjnego.

Co uznaje się za prawidłowy adres e-mail

Narzędzie opiera się na praktycznej postaci adresu e-mail, a nie na pełnej gramatyce RFC 5322, ponieważ ta pełna gramatyka dopuszcza adresy, których nie zaakceptuje żaden nowoczesny serwer poczty MTA (części lokalne w cudzysłowie ze spacjami, komentarze w nawiasach). Oto, co obejmuje mechanizm dopasowania:

Element wzorca Akceptowane Odrzucane
Część lokalna a-z 0-9 . _ % + - spacje, ciągi w cudzysłowie, nawiasy ostre
Domena a-z 0-9 . - kropka na końcu, podkreślenie w etykiecie
TLD co najmniej 2 litery ASCII wyłącznie cyfrowa TLD

Typowe zanieczyszczone dane wejściowe, które obsługuje

  • Adresy poprzedzające . lub , w zdaniach, znak interpunkcyjny nie jest wychwytywany.
  • Adresy e-mail wewnątrz odnośników mailto:, schemat jest usuwany automatycznie.
  • Encje HTML, takie jak @, nie są dekodowane, więc adres zapisany jako info@example.com nie zostanie wykryty.
  • Adresy ujęte w <nawiasy ostre> pochodzące z nagłówków wiadomości e-mail.

Co zrobić z wynikiem

  • Sprawdzenie dostarczalności. Przed importem przepuść listę przez usługę sprawdzającą odrzucenia, pozyskane masowo listy często zawierają około 10% martwych adresów.
  • Zgoda. To, że adres pojawia się w dokumencie, nie oznacza, że dana osoba wyraziła zgodę na kontakt. Przed rozpoczęciem działań sprawdź RODO lub obowiązujące prawo lokalne.
  • Usuwaj duplikaty także w części lokalnej. john@gmail.com oraz j.ohn@gmail.com trafiają do tej samej skrzynki w Gmailu; znormalizuj kropki, jeśli potrzebujesz naprawdę unikalnych tożsamości.

Najczęściej zadawane pytania

Nie. Narzędzie wyszukuje prawdziwe, możliwe do przetworzenia adresy. Najpierw odkoduj zamaskowane formy albo wstępnie przetwórz tekst, zamieniając [at] na @, a [dot] na ..

Nie. Dopasowanie obejmuje wyłącznie podstawowe litery łacińskie, więc müller@straße.de nie zostanie wykryty. Przed uruchomieniem narzędzia przekształć adres do postaci ASCII punycode, na przykład user@xn--strae-oqa.de.

Nie, nie ma opcji zachowania duplikatów. Wynik jest pozbawiony duplikatów i zachowuje kolejność pierwszego wystąpienia. Jeśli chcesz policzyć wystąpienia, zrób to w tekście źródłowym.

Nie. Tekst jest przetwarzany na potrzeby Twojego żądania i nie jest zapisywany w bazie danych, nie jest logowany ani dodawany do linku strony.

Powiązane narzędzia

Narzędzie jest dostępne w innych językach