Extracteur de liens (href)

Collez le code source HTML et extrayez chaque lien — toutes les URL href, dédupliquées et listées une par ligne, prêtes à copier ou télécharger.

735 vues

Tous les liens du HTML d'une page

Collez le code source HTML (afficher la source, HTML enregistré ou un extrait copié) et chaque valeur href des balises <a> est extraite — les doublons sont supprimés, listés un par ligne. L'analyse utilise le moteur HTML du navigateur plutôt qu'une expression régulière fragile, ce qui permet de traiter correctement un balisage réel et désordonné, y compris les liens relatifs, mailto: et tel:.

Utile pour auditer les liens sortants d'une page, extraire une liste de liens d'une page concurrente enregistrée, ou vérifier vers où pointe réellement un extrait HTML récupéré — le tout sans envoyer le HTML à aucun serveur.

Questions fréquentes

L'outil récupère-t-il la page lui-même, ou dois-je fournir le HTML ?

Vous fournissez le HTML — collez le résultat d'un « afficher la source », le contenu d'un fichier .html enregistré, ou tout extrait HTML. L'outil ne récupère jamais d'URL de lui-même (cela nécessiterait une requête serveur que ce site ne fait pas).

Les liens relatifs sont-ils inclus ?

Oui, exactement tels qu'écrits dans la source (par ex. /a-propos ou ../page.html) — ils ne sont pas résolus en URL absolues, car cela nécessiterait de connaître l'URL de base de la page.

Les liens mailto: et tel: sont-ils inclus ?

Oui — toute valeur href est extraite, quel que soit le schéma.

Outils similaires