Extrae metadatos de artículos de cualquier página
Obtén automáticamente metadatos estructurados de cualquier artículo o entrada de blog: título, autor, fecha de publicación, última modificación, etiquetas, número de palabras y tiempo estimado de lectura.
No necesitas cuenta para tu primer escaneo · Resultados en segundos
Autor y fechas
Extrae el nombre del autor, la fecha de publicación y la de última modificación desde JSON-LD, Open Graph, metaetiquetas y marcado semántico HTML.
Etiquetas y categorías
Encuentra las etiquetas, categorías y palabras clave del artículo, ya estén en los datos estructurados o visibles en la página.
Número de palabras y tiempo de lectura
Cuenta las palabras del contenido principal y estima el tiempo de lectura a 200 palabras por minuto.
Cómo funciona el extractor de datos de artículos
Introduce la URL de un artículo o entrada de blog
Pega el enlace de la entrada de blog, noticia o página de contenido que quieras analizar.
SmartScan extrae metadatos de varias fuentes
Revisa los datos estructurados JSON-LD, las metaetiquetas Open Graph y los elementos semánticos HTML para dar con la información más precisa del artículo.
Descarga los datos estructurados del artículo en JSON
Recibe todos los metadatos del artículo (título, autor, fechas, etiquetas, número de palabras, tiempo de lectura) en un archivo JSON limpio.
Extracción multifuente
Revisa JSON-LD (Article, NewsArticle, BlogPosting), metaetiquetas Open Graph y Twitter Card y elementos semánticos HTML: se queda con los mejores datos.
Datos de publicación
Extrae el nombre y el logo del editor si están en los datos estructurados: útil para citar fuentes y auditar contenidos.
Salida JSON estructurada
Todos los datos del artículo se guardan como content/article.json: título, autor, fechas, etiquetas, número de palabras, tiempo de lectura y extracto.
Casos de uso habituales
Consigue en segundos los metadatos de los artículos que citas, comparas o archivas.
Audita los metadatos de los artículos de tu sitio y detecta fechas, autores o etiquetas que falten.
Comprueba si los artículos de la competencia tienen datos estructurados correctos (esquemas NewsArticle y BlogPosting).
Extrae datos de artículos a gran escala para bases de datos de investigación, agregadores de contenido o conjuntos de entrenamiento.
Preguntas frecuentes
- ¿Qué campos extrae?
- Título, nombre del autor, fecha de publicación, fecha de última modificación, etiquetas, categorías, nombre del editor, extracto, número de palabras, tiempo estimado de lectura y la URL canonical.
- ¿Cómo encuentra el autor y la fecha?
- SmartScan revisa varias fuentes por orden de prioridad: el esquema JSON-LD (Article/NewsArticle/BlogPosting), las metaetiquetas Open Graph, Twitter Card y elementos HTML semánticos como
<time>y los patrones de firma del autor. - ¿Funciona con todos los formatos de artículo?
- Funciona mejor en entradas de blog, noticias y páginas de contenido estándar que usan datos estructurados o metaetiquetas habituales. En CMS a medida la precisión puede ser menor.
- ¿Puedo extraer datos de artículos de varias páginas?
- Sí: usa el modo de rastreo del sitio o el escaneo masivo para extraer los metadatos de varias entradas de blog o noticias en un solo escaneo.
- ¿Esta herramienta es gratuita?
- Sí: SmartScan es gratis. Regístrate y obtén 1000 escaneos al mes. Sin tarjeta de crédito.
Extrae los metadatos de artículos de cualquier página
Gratis: 1000 escaneos al mes. Sin tarjeta de crédito.