Extracteur d'adresses e-mail
Extrayez chaque adresse e-mail d'un texte ou d'un code HTML collé — dédupliquées, triées, une par ligne, prêtes à copier ou à télécharger en liste.
1 106 vues
0 adresses uniques
Aucune adresse e-mail trouvée.
Comment ça fonctionne
L'extracteur analyse le texte que vous collez avec une expression régulière qui recherche le motif partie-locale@domaine — une séquence de caractères autorisés, un signe @, puis un domaine comportant au moins un point, correspondant à la façon dont les adresses e-mail sont presque toujours écrites. Collez une page web extraite, une liste de diffusion exportée ou un long fil d'e-mails, et chaque chaîne correspondant à ce motif est extraite, dédupliquée sans distinction de casse, triée par ordre alphabétique et listée une par ligne. Cela gère les entrées désordonnées du monde réel sans nettoyage supplémentaire de votre part : les adresses mêlées à des phrases environnantes, intégrées dans des attributs HTML comme les liens mailto:, ou éparpillées sur des dizaines de paragraphes dans un gros document, sont toutes retrouvées de la même manière.
La regex utilisée ici est une approximation simplifiée et pratique de la RFC 5322 — la véritable spécification technique définissant ce qui constitue une adresse e-mail valide. C'est un choix délibéré, pas un raccourci né de la paresse : écrire une seule expression régulière entièrement conforme à la RFC 5322, capturant chaque adresse techniquement valide sans jamais faire correspondre une adresse invalide, est presque impraticable. Un motif totalement conforme peut atteindre des milliers de caractères et doit gérer des cas limites rares mais légaux — des parties locales entre guillemets comme "john doe"@example.com, ou des domaines écrits sous forme d'adresses IP entre crochets comme user@[192.168.1.1] — qui n'apparaissent pratiquement jamais dans un texte réel. Tout outil d'extraction pratique, celui-ci compris, échange cette dernière fraction de pourcent de couverture théorique contre un motif qui reste rapide, lisible et fiable sur plus de 99 % des adresses réellement écrites par les gens.
Ce qu'il faut savoir
- Il vérifie le format, pas l'existence. Une adresse peut sembler parfaitement valide et pourtant rebondir — l'outil n'a aucun moyen de vérifier si une boîte aux lettres est réelle, active, ou accepte les e-mails.
- Les doublons sont fusionnés sans distinction de casse. [email protected] et [email protected] sont traitées comme la même adresse et listées une seule fois.
- Tout s'exécute localement. La correspondance se fait dans votre navigateur avec JavaScript — aucun texte n'est envoyé ni stocké nulle part.
- Certains cas limites peuvent passer entre les mailles. Les adresses obfusquées (comme « nom [at] domaine [point] com », écrites pour échapper aux robots d'extraction) ne correspondront pas, puisqu'elles ne ressemblent volontairement pas à la syntaxe e-mail standard.
- Il est conçu pour des tâches d'extraction réelles. Extraire des adresses de contact d'une page scrapée, nettoyer une liste de diffusion collée, ou vérifier combien d'adresses uniques se cachent dans un long fil d'e-mails transféré sont des usages typiques.
Questions fréquentes
Pourquoi utiliser un motif « simplifié » plutôt que le motif totalement correct ?
Parce qu'une expression régulière entièrement conforme à la RFC 5322 est d'une complexité impraticable — potentiellement des milliers de caractères — pour couvrir des cas limites comme les parties locales entre guillemets ou les domaines en adresse IP, qui n'apparaissent quasiment jamais dans un texte réel. Un motif simplifié capture plus de 99 % des e-mails réels tout en restant rapide et prévisible, ce qui est le véritable objectif d'un outil d'extraction.
Vérifie-t-il que les adresses extraites fonctionnent réellement ?
Non. Il vérifie uniquement qu'une chaîne a la forme d'une adresse e-mail — des caractères, un signe @, un domaine avec un point. Savoir si la boîte aux lettres existe, si l'orthographe est correcte, ou si elle reçoit encore des e-mails dépasse ce qu'une simple correspondance de motif peut indiquer ; pour vérifier la délivrabilité réelle, il faudrait envoyer un vrai message de test ou utiliser un service de vérification dédié.
Que se passe-t-il avec les adresses en double dans mon texte ?
Toute adresse apparaissant plusieurs fois, quel que soit le mélange de majuscules et de minuscules, est reconnue comme la même adresse et n'est incluse qu'une seule fois dans la liste finale triée.
Détecte-t-il un e-mail écrit sous la forme « nom at domaine dot com » ?
Non — ce format est utilisé volontairement par les personnes qui cherchent à cacher leurs adresses des robots d'extraction automatiques, et il ne correspond pas à la structure standard partie-locale@domaine recherchée par la regex. Seules les adresses écrites dans une syntaxe normale sont extraites.
Mon texte collé est-il envoyé quelque part ?
Non. L'ensemble du processus d'extraction — correspondance, déduplication, tri — s'exécute côté client, directement dans votre navigateur, avec JavaScript. Rien de ce que vous collez n'est transmis à un serveur ni stocké.
Outils similaires
Signaler un problème
Extracteur d'adresses e-mail
Commentaires
Pas encore de commentaires — soyez le premier à en écrire un !