E-mailadres Extractor
Haal elk e-mailadres uit geplakte tekst of HTML — ontdubbeld, gesorteerd, één per regel, klaar om te kopiëren of als lijst te downloaden.
1.104 weergaven
0 unieke adressen
Geen e-mailadressen gevonden.
Hoe het werkt
De extractor scant uw geplakte tekst met een reguliere expressie die zoekt naar de vorm lokaal-deel@domein — een reeks toegestane tekens, een @-teken, gevolgd door een domein met minstens één punt, overeenkomstig hoe e-mailadressen bijna altijd worden geschreven. Plak een gescrapete webpagina, een geëxporteerde mailinglijst of een lange e-maildraad, en elke reeks die dat patroon volgt wordt eruit gehaald, hoofdletterongevoelig ontdubbeld, alfabetisch gesorteerd en één per regel weergegeven. Dit verwerkt rommelige input uit de praktijk zonder dat u zelf extra moet opschonen: adressen die tussen omringende zinnen staan, ingebed in HTML-attributen zoals mailto:-links, of verspreid over tientallen alinea's in een grote documentdump worden allemaal op dezelfde manier gevonden.
De hier gebruikte regex is een vereenvoudigde, praktische benadering van RFC 5322 — de daadwerkelijke technische specificatie voor wat telt als een geldig e-mailadres. Dat is een bewuste keuze, geen kortere weg uit gemakzucht: één enkele reguliere expressie schrijven die volledig RFC 5322-conform is, die elk technisch geldig adres herkent zonder ooit een ongeldig adres te matchen, is vrijwel onpraktisch. Een volledig conform patroon kan oplopen tot duizenden tekens en moet rekening houden met zeldzame maar legale randgevallen — geciteerde lokale delen zoals "john doe"@example.com, of domeinen geschreven als IP-adressen tussen haakjes zoals user@[192.168.1.1] — die in praktijktekst vrijwel nooit voorkomen. Elk praktisch extractiehulpmiddel, deze inbegrepen, ruilt dat laatste fractie procent theoretische dekking in voor een patroon dat snel, leesbaar en betrouwbaar blijft voor de 99%+ van de adressen die mensen daadwerkelijk schrijven.
Wat u moet weten
- Het controleert vorm, niet bestaan. Een adres kan er volkomen geldig uitzien en toch bouncen — het hulpmiddel kan niet controleren of een postvak echt, actief of e-mail accepterend is.
- Duplicaten worden hoofdletterongevoelig samengevoegd. [email protected] en [email protected] worden als hetzelfde adres behandeld en één keer vermeld.
- Alles gebeurt lokaal. Het matchen gebeurt in uw browser met JavaScript — er wordt geen tekst geüpload of opgeslagen.
- Randgevallen kunnen ontsnappen. Verhulde adressen (zoals "naam [at] domein [punt] com", geschreven om scrapers te ontwijken) worden niet herkend, omdat ze bewust niet op standaard e-mailsyntaxis lijken.
- Het is gebouwd voor echte extractietaken. Contactadressen van een gescrapete pagina halen, een geplakte mailinglijst opschonen, of controleren hoeveel unieke adressen verscholen zitten in een lange doorgestuurde e-maildraad zijn allemaal typische toepassingen.
Veelgestelde vragen
Waarom een "vereenvoudigd" patroon gebruiken in plaats van het volledig correcte?
Omdat een volledig RFC 5322-conforme reguliere expressie onpraktisch complex is — mogelijk duizenden tekens — om randgevallen te dekken zoals geciteerde lokale delen of IP-adresdomeinen die in de praktijk vrijwel nooit voorkomen. Een vereenvoudigd patroon vangt meer dan 99% van de e-mails uit de praktijk terwijl het snel en voorspelbaar blijft, wat het eigenlijke doel van een extractiehulpmiddel is.
Controleert het of de geëxtraheerde adressen daadwerkelijk werken?
Nee. Het controleert alleen of een reeks de vorm van een e-mailadres heeft — tekens, een @-teken, een domein met een punt. Of het postvak bestaat, correct gespeld is, of nog steeds e-mail ontvangt, valt buiten wat patroonherkenning u kan vertellen; voor daadwerkelijke afleverbaarheid zou u een echt testbericht moeten versturen of een specifieke verificatiedienst moeten gebruiken.
Wat gebeurt er met dubbele adressen in mijn tekst?
Elk adres dat meer dan eens voorkomt, in welke combinatie van hoofd- en kleine letters dan ook, wordt herkend als hetzelfde adres en slechts één keer opgenomen in de uiteindelijke gesorteerde lijst.
Herkent het een e-mail geschreven als "naam at domein punt com"?
Nee — dat formaat wordt bewust gebruikt door mensen die adressen willen verbergen voor geautomatiseerde scrapers, en het komt niet overeen met de standaard lokaal-deel@domein-structuur waar de regex naar zoekt. Alleen adressen in normale syntaxis geschreven worden geëxtraheerd.
Wordt mijn geplakte tekst ergens naartoe gestuurd?
Nee. Het hele extractieproces — matchen, ontdubbelen, sorteren — verloopt client-side in uw browser met JavaScript. Niets van wat u plakt wordt naar een server verzonden of opgeslagen.
Vergelijkbare tools
Probleem melden
E-mailadres Extractor
Reacties
Nog geen reacties — schrijf de eerste!