Extracteur de liens externes
Collez du HTML brut et obtenez une liste propre et dédupliquée de chaque lien externe qu’il contient. Indiquez éventuellement une URL de base pour que l’extracteur sache quel hôte compte comme interne ; les liens vers tout autre hôte sont signalés. Utile pour auditer un site à la recherche de fuites de liens, de placements de partenaires obsolètes ou pour vérifier que les liens sortants vont bien où votre politique l’exige.
Comment extraire des liens externes
-
1
Fournir la source
Collez le HTML brut de la page. Ajoutez éventuellement une URL de base pour que l'extracteur sache quel hôte compte comme interne ; laissez-la vide pour traiter tous les hôtes comme externes.
-
2
Lancer l'extraction
Chaque `<a href>` est lu et seuls les liens absolus http/https dont l'hôte diffère de l'hôte de base sont conservés. Les doublons sont supprimés.
-
3
Examiner la liste
Vous obtenez une URL externe par ligne, prête à coller dans un tableur ou à vérifier individuellement.
-
4
Utiliser le résultat
Copiez la liste dans le presse-papiers ou laissez la page ouverte pendant que vous vérifiez chaque destination dans un nouvel onglet.
Ce que l'extracteur considère comme externe
Un lien est externe lorsque son hôte diffère de l’URL de base que vous avez fournie (la comparaison ne tient pas compte de la casse). Les sous-domaines comptent comme des hôtes séparés, donc blog.example.com est externe à www.example.com. Pour des audits portant sur tout le sous-domaine, retirez le sous-domaine de votre URL de base. Laissez l’URL de base vide pour lister chaque lien http/https comme externe.
L’extracteur ne renvoie que les URL de destination. Il ne lit ni le texte d’ancre ni les attributs rel ; auditez donc les tokens nofollow, ugc et sponsored directement dans le HTML source.
Ce qu’il ignore
mailto:,tel:,javascript:et les hrefs uniquement fragmentaires#.- Les URL relatives et les URL relatives au protocole comme
//cdn.example.com(transformez-les en URL absolues dans le HTML collé si vous voulez les compter). - Les balises d’ancre sans
href(ce ne sont pas des liens navigables).
Conseils
- Collez le HTML rendu si la page utilise JavaScript. Les liens qu’un framework génère côté client n’apparaissent que lorsque vous collez le DOM rendu (par exemple en copiant outerHTML depuis DevTools).
- Méfiez-vous des wrappers de suivi. Les redirections d’affiliation via
/go/ou/out/peuvent masquer la véritable destination ; l’extracteur renvoie l’URL du wrapper telle quelle, inspectez donc le href brut quand une destination semble suspecte. - Normalisez avant de comparer. Une URL avec un fragment ou un paramètre de suivi différent compte comme un lien distinct ; normalisez les URL avant de comparer deux exécutions de l’extracteur.
- Comparez dans le temps. Exécutez l’extracteur chaque mois et comparez les listes ; de nouveaux liens externes que vous n’avez pas ajoutés sont le premier signe d’un thème ou d’un plugin compromis.
Questions fréquentes
Il extrait le href exactement tel qu’il est écrit dans le HTML. Suivre chaque redirection ralentirait considérablement le rapport et pourrait déclencher des protections anti-bots sur la destination ; résolvez-les séparément si vous avez besoin de l’URL finale.
Non. L’extracteur analyse le HTML tel qu’il est livré. Les liens qu’un framework rend côté client n’apparaîtront que si vous collez le DOM rendu (par exemple en copiant outerHTML depuis DevTools).
Seules les URL absolues http/https sont signalées. Les URL relatives au protocole comme //cdn.example.com, les chemins relatifs et les liens mailto: ou tel: sont ignorés ; transformez-les en URL absolues dans le HTML collé si vous voulez les compter.
Le HTML que vous collez est envoyé à notre serveur uniquement pour exécuter l’extraction dans la requête en cours. Il n’est stocké ni dans une base de données ni dans un journal, et rien n’est conservé après que la réponse parvient à votre navigateur.
Outils similaires
Vérificateur de longueur de méta description
Mesurez une méta description en caractères et en pixels estimés, comparez des repères éditoriaux et examinez des maquettes pour ordinateur et mobile.
Simulateur de SERP Google
Prévisualisez un snippet approximatif de style Google avec des limites de caractères sur mobile et ordinateur. Votre brouillon reste dans cette session du navigateur.
Compteur de fréquence des mots
Repérez les mots les plus répétés dans un texte avec leurs occurrences et leur densité. Utile pour la relecture, le SEO et les audits de contenu.
Vérificateur d'URL canonique
Collez le HTML d'une page et vérifiez sa balise rel=canonical : est-elle présente, est-ce une URL absolue valide, correspond-elle à l'URL de la page ?
Validateur de sitemap XML
Vérifiez dans votre navigateur les erreurs de syntaxe, les URL absentes ou dupliquées et les valeurs courantes d'un sitemap XML.
Vérificateur d’en-têtes de sécurité HTTP
Collez des en-têtes de réponse HTTP et examinez localement HSTS, CSP, le cadrage, MIME, la politique de référent et les règles cross-origin.
Outil disponible dans d’autres langues
- Ekstraktor linków zewnętrznych [PL]
- Extraherare för externa länkar [SV]
- Extrator de Links Externos [PT]
- Dış Bağlantı Çıkarıcı [TR]
- مُستخرج الروابط الخارجية [AR]
- 외부 링크 추출기 [KO]
- 外部リンク抽出ツール [JA]
- Extractor voor externe links [NL]
- เครื่องดึงลิงก์ภายนอก [TH]
- External Links Extractor [EN]
- 外部链接提取器 [ZH]
- Extractor de enlaces externos [ES]
- Ekstraktor Tautan Eksternal [ID]
- Trình trích liên kết bên ngoài [VI]
- Extraktor für externe Links [DE]
- Estrattore di Link Esterni [IT]
- Инструмент для извлечения внешних ссылок [RU]