Extrayez le contenu d'articles de n'importe quel blog
Récupérez automatiquement les métadonnées structurées de n'importe quel article ou billet de blog : titre, auteur, date de publication, dernière modification, tags, nombre de mots et temps de lecture estimé.
Aucun compte requis pour votre premier scan · Résultats en quelques secondes
Auteur et dates
Extrait le nom de l'auteur, la date de publication et la date de dernière modification depuis JSON-LD, Open Graph, les balises meta et le balisage sémantique HTML.
Tags et catégories
Repère les tags, catégories et mots-clés de l'article, qu'ils soient déclarés dans les données structurées ou visibles sur la page.
Nombre de mots et temps de lecture
Compte les mots du contenu principal et estime le temps de lecture sur la base de 200 mots par minute.
Comment fonctionne l'extracteur d'infos d'article
Saisissez l'URL d'un article ou d'un billet de blog
Collez le lien du billet de blog, de l'article de presse ou de la page de contenu à analyser.
SmartScan extrait les métadonnées de plusieurs sources
Analyse les données structurées JSON-LD, les balises meta Open Graph et les éléments HTML sémantiques pour obtenir les informations les plus fiables sur l'article.
Téléchargez les données d'article structurées en JSON
Récupérez toutes les métadonnées de l'article — titre, auteur, dates, tags, nombre de mots, temps de lecture — dans un fichier JSON propre.
Extraction multi-source
Analyse JSON-LD (Article, NewsArticle, BlogPosting), les balises Open Graph et Twitter Card, ainsi que les éléments HTML sémantiques — et retient la meilleure source.
Informations de publication
Extrait le nom et le logo de l'éditeur s'ils figurent dans les données structurées — pratique pour citer vos sources et auditer vos contenus.
Sortie JSON structurée
Toutes les données de l'article sont enregistrées sous content/article.json — titre, auteur, dates, tags, nombre de mots, temps de lecture, extrait.
Cas d'usage courants
Obtenez en un instant les métadonnées des articles que vous citez, comparez ou archivez.
Auditez les métadonnées des articles de votre site pour repérer les dates, auteurs ou tags manquants.
Vérifiez si les articles de vos concurrents disposent de données structurées correctes (schémas NewsArticle, BlogPosting).
Extrayez des données d'articles à grande échelle pour des bases de recherche, des agrégateurs de contenu ou des jeux de données d'entraînement.
Foire aux questions
- Quels champs sont extraits ?
- Titre, nom de l'auteur, date de publication, date de dernière modification, tags, catégories, nom de l'éditeur, extrait, nombre de mots, temps de lecture estimé et URL canonical.
- Comment trouve-t-il l'auteur et la date ?
- SmartScan consulte plusieurs sources par ordre de priorité : le schéma JSON-LD (Article/NewsArticle/BlogPosting), les balises meta Open Graph, la Twitter Card et les éléments HTML sémantiques comme
<time>ainsi que les signatures d'auteur. - Fonctionne-t-il avec tous les formats d'article ?
- Il donne les meilleurs résultats sur les billets de blog, articles de presse et pages de contenu classiques qui utilisent des données structurées ou des balises meta courantes. Sur un CMS sur mesure, la précision peut être moindre.
- Puis-je extraire les données d'articles de plusieurs pages ?
- Oui — utilisez le mode Crawl du site ou le scan en masse pour extraire les métadonnées de plusieurs billets de blog ou articles de presse en un seul scan.
- Cet outil est-il gratuit ?
- Oui — SmartScan est gratuit. Inscrivez-vous pour 1 000 scans/mois. Aucune carte bancaire requise.
Extraire les métadonnées d'article de n'importe quelle page
Gratuit — 1 000 scans/mois. Aucune carte bancaire requise.