Estrattore di Indirizzi Email
Estrai ogni indirizzo email da un testo o codice HTML incollato — deduplicati, ordinati, uno per riga, pronti da copiare o scaricare come elenco.
1.120 visualizzazioni
0 indirizzi univoci
Nessun indirizzo email trovato.
Come Funziona
L'estrattore analizza il testo incollato con un'espressione regolare che cerca la forma parte-locale@dominio — una sequenza di caratteri consentiti, una @ e poi un dominio con almeno un punto, il modo in cui gli indirizzi email vengono quasi sempre scritti. Incolla una pagina web estratta, una mailing list esportata o un lungo thread di email, e ogni stringa che corrisponde a quel pattern viene estratta, deduplicata senza distinzione tra maiuscole e minuscole, ordinata alfabeticamente ed elencata una per riga. Questo gestisce input reali disordinati senza alcuna pulizia extra da parte tua: indirizzi mescolati in mezzo a frasi, incorporati in attributi HTML come i link mailto:, o sparsi in decine di paragrafi in un lungo documento vengono trovati tutti allo stesso modo.
La regex usata qui è un'approssimazione semplificata e pratica dell'RFC 5322 — la vera specifica tecnica di cosa conta come indirizzo email valido. Si tratta di una scelta deliberata, non di una scorciatoia nata dalla pigrizia: scrivere un'unica espressione regolare pienamente conforme all'RFC 5322, che catturi ogni indirizzo tecnicamente valido senza mai far corrispondere un indirizzo non valido, è quasi impraticabile. Un pattern pienamente conforme può arrivare a migliaia di caratteri e deve gestire casi limite rari ma legali — parti locali tra virgolette come "john doe"@example.com, o domini scritti come indirizzi IP tra parentesi quadre come user@[192.168.1.1] — che nella pratica non compaiono quasi mai nel testo reale. Ogni strumento di estrazione pratico, compreso questo, scambia quell'ultima frazione di percentuale di copertura teorica con un pattern che resta veloce, leggibile e affidabile sul 99%+ degli indirizzi che le persone scrivono davvero.
Cosa Sapere
- Verifica il formato, non l'esistenza. Un indirizzo può sembrare perfettamente valido e comunque rimbalzare (bounce) — lo strumento non ha modo di controllare se una casella di posta è reale, attiva o accetta email.
- I duplicati vengono uniti senza distinzione tra maiuscole e minuscole. [email protected] e [email protected] vengono trattati come lo stesso indirizzo ed elencati una sola volta.
- Tutto avviene localmente. L'estrazione avviene nel tuo browser con JavaScript — nessun testo viene caricato o memorizzato da qualche parte.
- Alcuni casi limite possono sfuggire. Gli indirizzi offuscati (come "nome [at] dominio [dot] com", scritti apposta per eludere gli scraper) non corrispondono, dato che deliberatamente non assomigliano alla sintassi email standard.
- È pensato per compiti di estrazione reali. Estrarre indirizzi di contatto da una pagina raccolta con scraping, ripulire una mailing list incollata o verificare quanti indirizzi unici si nascondono in un lungo thread di email inoltrato sono tutti usi tipici.
Domande Frequenti
Perché usare un pattern "semplificato" invece di quello completamente corretto?
Perché un'espressione regolare pienamente conforme all'RFC 5322 è impraticabilmente complessa — potenzialmente migliaia di caratteri — per coprire casi limite come parti locali tra virgolette o domini con indirizzo IP che praticamente non si verificano mai nel testo reale. Un pattern semplificato cattura oltre il 99% delle email reali restando veloce e prevedibile, che è poi l'obiettivo effettivo di uno strumento di estrazione.
Verifica che gli indirizzi estratti funzionino davvero?
No. Controlla solo che una stringa abbia la forma di un indirizzo email — caratteri, una @, un dominio con un punto. Se la casella di posta esiste, è scritta correttamente o riceve ancora email è al di fuori di ciò che il pattern matching può dirti; per la deliverability reale dovresti inviare un messaggio di prova vero e proprio o usare un servizio di verifica dedicato.
Cosa succede con gli indirizzi duplicati nel mio testo?
Qualsiasi indirizzo che appare più di una volta, in qualsiasi combinazione di maiuscole e minuscole, viene riconosciuto come lo stesso indirizzo e incluso una sola volta nell'elenco finale ordinato.
Riconoscerà un'email scritta come "nome at dominio dot com"?
No — questo formato viene usato intenzionalmente da chi cerca di nascondere gli indirizzi dagli scraper automatici, e non corrisponde alla struttura standard parte-locale@dominio che la regex cerca. Vengono estratti solo gli indirizzi scritti in sintassi normale.
Il mio testo incollato viene inviato da qualche parte?
No. L'intero processo di estrazione — corrispondenza, deduplicazione, ordinamento — avviene lato client nel tuo browser tramite JavaScript. Nulla di ciò che incolli viene trasmesso a un server o memorizzato.
Strumenti Simili
Segnala un Problema
Estrattore di Indirizzi Email
Commenti
Ancora nessun commento — scrivi il primo!