Herramienta gratuita

Extrae metadatos de artículos de cualquier página

Obtén automáticamente metadatos estructurados de cualquier artículo o entrada de blog: título, autor, fecha de publicación, última modificación, etiquetas, número de palabras y tiempo estimado de lectura.

No necesitas cuenta para tu primer escaneo · Resultados en segundos

✍️

Autor y fechas

Extrae el nombre del autor, la fecha de publicación y la de última modificación desde JSON-LD, Open Graph, metaetiquetas y marcado semántico HTML.

🏷️

Etiquetas y categorías

Encuentra las etiquetas, categorías y palabras clave del artículo, ya estén en los datos estructurados o visibles en la página.

📊

Número de palabras y tiempo de lectura

Cuenta las palabras del contenido principal y estima el tiempo de lectura a 200 palabras por minuto.

Cómo funciona el extractor de datos de artículos

1

Introduce la URL de un artículo o entrada de blog

Pega el enlace de la entrada de blog, noticia o página de contenido que quieras analizar.

2

SmartScan extrae metadatos de varias fuentes

Revisa los datos estructurados JSON-LD, las metaetiquetas Open Graph y los elementos semánticos HTML para dar con la información más precisa del artículo.

3

Descarga los datos estructurados del artículo en JSON

Recibe todos los metadatos del artículo (título, autor, fechas, etiquetas, número de palabras, tiempo de lectura) en un archivo JSON limpio.

🎯

Extracción multifuente

Revisa JSON-LD (Article, NewsArticle, BlogPosting), metaetiquetas Open Graph y Twitter Card y elementos semánticos HTML: se queda con los mejores datos.

🌐

Datos de publicación

Extrae el nombre y el logo del editor si están en los datos estructurados: útil para citar fuentes y auditar contenidos.

📋

Salida JSON estructurada

Todos los datos del artículo se guardan como content/article.json: título, autor, fechas, etiquetas, número de palabras, tiempo de lectura y extracto.

Casos de uso habituales

Investigación de contenidos
Consigue en segundos los metadatos de los artículos que citas, comparas o archivas.
Auditoría editorial
Audita los metadatos de los artículos de tu sitio y detecta fechas, autores o etiquetas que falten.
Análisis SEO
Comprueba si los artículos de la competencia tienen datos estructurados correctos (esquemas NewsArticle y BlogPosting).
Recopilación de datos
Extrae datos de artículos a gran escala para bases de datos de investigación, agregadores de contenido o conjuntos de entrenamiento.

Preguntas frecuentes

¿Qué campos extrae?
Título, nombre del autor, fecha de publicación, fecha de última modificación, etiquetas, categorías, nombre del editor, extracto, número de palabras, tiempo estimado de lectura y la URL canonical.
¿Cómo encuentra el autor y la fecha?
SmartScan revisa varias fuentes por orden de prioridad: el esquema JSON-LD (Article/NewsArticle/BlogPosting), las metaetiquetas Open Graph, Twitter Card y elementos HTML semánticos como <time> y los patrones de firma del autor.
¿Funciona con todos los formatos de artículo?
Funciona mejor en entradas de blog, noticias y páginas de contenido estándar que usan datos estructurados o metaetiquetas habituales. En CMS a medida la precisión puede ser menor.
¿Puedo extraer datos de artículos de varias páginas?
Sí: usa el modo de rastreo del sitio o el escaneo masivo para extraer los metadatos de varias entradas de blog o noticias en un solo escaneo.
¿Esta herramienta es gratuita?
Sí: SmartScan es gratis. Regístrate y obtén 1000 escaneos al mes. Sin tarjeta de crédito.

Extrae los metadatos de artículos de cualquier página

Gratis: 1000 escaneos al mes. Sin tarjeta de crédito.

Crear cuenta gratis → Probar sin cuenta