Extracteur de métadonnées

Entrez une URL et l’extracteur récupère la page, analyse le <head>, et présente tout ce qui compte pour l’apparence de votre lien ailleurs : le titre SEO et la description méta, l’URL canonique, les balises Open Graph utilisées par Facebook et LinkedIn pour les aperçus de lien, les balises Twitter Card, l’icône de site et les icônes d’application, les données structurées JSON-LD (Schema.org, Article, Produit, FAQ). Utile pour les audits SEO, le débogage des aperçus de lien et la vérification de ce qu’une page fraîchement publiée expose réellement aux robots d’exploration.

Comment les métadonnées sont extraites

  1. 1

    Entrez l'URL

    URL complète incluant le protocole. L'outil suit un saut de redirection.

  2. 2

    La page est récupérée côté serveur

    Le HTML brut est analysé ; les pages rendues par JavaScript peuvent ne pas exposer les métadonnées côté client.

  3. 3

    Sections regroupées par standard

    SEO, Open Graph, Twitter, Schema.org, icônes, mobile, PWA.

  4. 4

    Chaque entrée montre la valeur et la longueur

    Les titres et descriptions reçoivent des avertissements de longueur s'ils dépassent les limites de Google ou Twitter.

  5. 5

    Aperçu de la carte de lien

    Rend une maquette de carte de partage Facebook / LinkedIn / Twitter à partir des balises extraites.

Qu’est-ce qui est dans le <head> qui compte

SEO de base

Balise Objectif
<title> Onglet du navigateur, titre du résultat Google
<meta name="description"> Extrait du résultat Google, retour social
<link rel="canonical"> URL canonique, signal de contenu dupliqué
<meta name="robots"> index/noindex, règles follow/nofollow
<meta name="viewport"> Vue mobile

Open Graph (Facebook, LinkedIn, Discord, Slack)

Balise Objectif
og:title Titre de la carte de partage
og:description Description de la carte de partage
og:image Image de la carte de partage (1200×630 recommandé)
og:type website / article / video.other
og:url URL canonique pour le partage
og:site_name Nom du site affiché dans la carte

Twitter Card

Balise Objectif
twitter:card summary / summary_large_image
twitter:title Se rabat sur og:title
twitter:description Se rabat sur og:description
twitter:image Carte avec grande image
twitter:site / twitter:creator Éditeur / auteurs

Schema.org (JSON-LD)

<script type="application/ld+json">
{
  "@context": "https://schema.org",
  "@type": "Article",
  "headline": "...",
  "author": { "@type": "Person", "name": "..." },
  "datePublished": "2026-04-18"
}
</script>

Article, Produit, Recette, FAQ, Événement, Organisation, Fil d’Ariane sont les plus impactants pour les résultats enrichis de recherche.

Signaux d’alerte dans un audit

  • og:image manquant. Vos liens semblent nus lorsqu’ils sont partagés sur Slack ou Discord.
  • Titre de plus de 60 caractères. Tronqué dans les résultats de recherche Google.
  • Description de plus de 160 caractères. Tronquée dans l’extrait de Google.
  • Pas de balise canonique. Risque de confusion de classement de contenu dupliqué entre /page et /page/.
  • og:image et twitter:image manquants. Aucune carte d’aperçu social ne se rend.
  • noindex sur une page qui devrait être classée. Cela arrive tout le temps sur les serveurs de staging qui sont passés en production sans retirer la balise.

Flux de débogage

  1. Extraire d’abord sur l’URL de staging.
  2. Vérifiez l’URL en direct après le déploiement.
  3. Effacez le cache du scraper de Facebook (Sharing Debugger) et le validateur de carte de Twitter après un changement, ils mettent en cache de manière agressive.
  4. Testez dans une fenêtre incognito au cas où un cookie de connexion révélerait un contenu différent.

Questions fréquentes

Partiellement. L’extracteur récupère le HTML rendu côté serveur. Si vos balises méta sont injectées par JavaScript côté client (frameworks SPA sans SSR), elles n’apparaîtront pas, c’est aussi ainsi que Google voit la page sans exécution JavaScript lors du premier crawl.

Causes courantes : l’URL est derrière une connexion, l’image est trop petite (< 200×200), ou Facebook a mis en cache une version antérieure. Effacez le cache dans le Sharing Debugger et réessayez.

Cela aide pour des types de contenu spécifiques (Article, Produit, Recette, FAQ, Fil d’Ariane) car Google l’utilise pour des résultats enrichis. Les pages marketing génériques n’en ont pas besoin. Ajoutez le schéma lorsque le type de contenu a un format de résultat enrichi associé.

<link rel="canonical"> indique aux moteurs de recherche quelle version d’une page indexer. og:url indique aux plateformes sociales quelle URL le partage représente. Ils sont généralement identiques, mais ne sont pas obligés de l’être.

Via un récupérateur côté serveur, votre navigateur ne peut pas récupérer des URL externes arbitraires en raison des restrictions CORS. Le récupérateur utilise un agent utilisateur générique et ne s’authentifie pas.

Outils similaires

Outil disponible dans d’autres langues