Extraire des e-mails à partir de texte
Collez un extrait de messages, une colonne CSV, un fil de discussion ou un morceau de HTML, et l’extracteur extrait chaque adresse e-mail qu’il peut reconnaître. La sortie est dédupliquée et prête à être intégrée dans votre import CRM ou un outil de vérification des rebonds. L’appariement couvre le sous-ensemble réel de la RFC 5322 (adresses avec plus, points dans la partie locale, tirets dans le domaine) sans les faux positifs que produisent les regex simples a@b.
Comment extraire des e-mails à partir de texte
-
1
Collez votre source
Déposez du texte libre, des journaux, une page HTML ou une liste de contacts exportée, tout ce qui contient des motifs `local@domain.tld`.
-
2
Exécutez l'extracteur
Le regex recherche des adresses complètes et ignore la ponctuation qui les entoure.
-
3
Vérifiez le nombre
Vous obtenez le nombre d'adresses uniques trouvées ainsi que la liste complète.
-
4
Copier la liste
Copiez dans le presse-papiers sous forme de liste séparée par des nouvelles lignes, ou collez directement dans une colonne de feuille de calcul.
Qu'est-ce qui compte comme un e-mail valide
L’extracteur suit la forme pratique des e-mails plutôt que la grammaire complète de la RFC 5322, car la grammaire complète permet des adresses qu’aucun MTA moderne n’acceptera (locaux cités avec espaces, commentaires entre parenthèses). Voici ce que couvre le matcher :
| Élément de motif | Accepté | Rejeté |
|---|---|---|
| Partie locale | a-z 0-9 . _ % + - |
espaces, chaînes citées, chevrons |
| Domaine | a-z 0-9 . - |
point final, underscore dans l’étiquette |
| TLD | 2+ lettres ASCII | TLD uniquement numériques |
Entrées sales courantes qu’il gère
- Adresses suivies de
.ou,dans des phrases, la ponctuation n’est pas capturée. - E-mails à l’intérieur des hrefs
mailto:, le schéma est automatiquement supprimé. - Les entités HTML comme
@ne sont pas décodées, donc une adresse écrite sous la formeinfo@example.comn’est pas détectée. - Adresses enveloppées dans
<chevrons>des en-têtes d’e-mail.
Que faire avec la sortie
- Vérification de la délivrabilité. Exécutez la liste à travers un service de vérification des rebonds avant d’importer, les listes récoltées ont souvent ~10% d’adresses mortes.
- Consentement. Ce n’est pas parce qu’une adresse apparaît dans un document que la personne a consenti à être contactée. Vérifiez le RGPD ou la législation locale avant toute prise de contact.
- Déduplication sur la partie locale aussi.
john@gmail.cometj.ohn@gmail.comatteignent la même boîte aux lettres chez Gmail ; normalisez les points si vous avez besoin d’identités vraiment uniques.
Questions fréquentes
Non. L’extracteur cible des adresses réelles et analysables. Déchiffrez d’abord les formes obfusquées, ou pré-traitez le texte pour remplacer [at] par @ et [dot] par ..
Non. La détection ne lit que les lettres latines de base, donc müller@straße.de n’est pas détectée. Convertissez l’adresse en sa forme ASCII punycode, par exemple user@xn--strae-oqa.de, avant de lancer l’extracteur.
Non, il n’y a pas d’option pour conserver les doublons. La sortie est dédupliquée et conserve l’ordre de la première occurrence. Si vous devez compter les mentions, comptez-les dans le texte source.
Non. Le texte est traité pour votre demande, il n’est ni stocké dans une base de données, ni consigné dans les journaux, ni ajouté au lien de la page.
Outils similaires
Compteur de mots
Comptez les mots, caractères, phrases et paragraphes avec le temps de lecture, le temps de parole, la densité des mots-clés et un indice de lisibilité Flesch pour les essais, publications, légendes et meta descriptions.
Générateur de noms de villes
Générez des noms fictifs de villes, bourgs, villages et capitales pour le worldbuilding, les cartes, les jeux, les récits et les données factices, avec de courtes notes pour chaque résultat.
Symboles de flèches à copier
Copiez des flèches Unicode courantes en un clic : droites, doubles, diagonales, à crochet, circulaires et triangulaires pour documents, messageries et designs.
Générateur de texte stylé
Transformez du texte simple en six styles Unicode : cercle, largeur complète, monospace, script, fraktur et double trait, pour bios, légendes et noms d’utilisateur.
Symbole inférieur ou égal
Copiez le signe ≤ et les symboles de comparaison mathématique associés. Inclut Unicode, entités HTML et balisage LaTeX pour les tableurs, articles et pages web.
Résolveur d'anagrammes
Saisissez jusqu'à 10 lettres et voyez chaque arrangement unique, avec les permutations en double supprimées et la liste limitée à 200 résultats.
Outil disponible dans d’autres langues
- Wyodrębnianie adresów e-mail z tekstu [PL]
- Extrahera e-postadresser från text [SV]
- Extrair Emails do Texto [PT]
- Metinden E-posta Çıkarma [TR]
- استخراج الرسائل الإلكترونية من النص [AR]
- 텍스트에서 이메일 추출 [KO]
- テキストからメールアドレスを抽出 [JA]
- E-mails uit tekst halen [NL]
- ดึงอีเมลจากข้อความ [TH]
- Extract Emails from Text [EN]
- 从文本中提取电子邮件 [ZH]
- Extraer correos electrónicos del texto [ES]
- Ekstrak email dari teks [ID]
- Lấy email từ văn bản [VI]
- E-Mails aus Text extrahieren [DE]
- Estrai Email dal Testo [IT]
- Извлечение email из текста [RU]