Extraia conteúdo de artigos de qualquer post de blog
Colete automaticamente metadados estruturados de qualquer artigo ou post de blog: título, autor, data de publicação, última modificação, tags, contagem de palavras e tempo estimado de leitura.
Sem conta para o primeiro scan · Resultados em segundos
Autor e datas
Extrai o nome do autor, a data de publicação e a de última modificação de JSON-LD, Open Graph, meta tags e marcação semântica HTML.
Tags e categorias
Encontra tags, categorias e palavras-chave do artigo, seja nos dados estruturados ou visíveis na página.
Contagem de palavras e tempo de leitura
Conta as palavras do conteúdo principal e estima o tempo de leitura a 200 palavras por minuto.
Como funciona o extrator de dados de artigos
Informe a URL de um artigo ou post de blog
Cole o link do post de blog, da notícia ou da página de conteúdo que você quer analisar.
O SmartScan extrai metadados de várias fontes
Verifica dados estruturados JSON-LD, meta tags Open Graph e elementos semânticos HTML para achar a informação mais precisa do artigo.
Baixe os dados estruturados do artigo em JSON
Receba todos os metadados do artigo — título, autor, datas, tags, contagem de palavras, tempo de leitura — em um arquivo JSON limpo.
Extração de múltiplas fontes
Verifica JSON-LD (Article, NewsArticle, BlogPosting), meta Open Graph, meta Twitter Card e elementos semânticos HTML — o que tiver os melhores dados.
Dados de publicação
Extrai o nome e o logo do publisher quando estão nos dados estruturados — útil para citar fontes e auditar conteúdo.
Saída JSON estruturada
Todos os dados do artigo são salvos como content/article.json — título, autor, datas, tags, número de palavras, tempo de leitura e resumo.
Casos de uso comuns
Pegue rapidamente os metadados dos artigos que você cita, compara ou arquiva.
Audite os metadados dos artigos do seu site e encontre datas, autores ou tags faltando.
Veja se os artigos dos concorrentes têm dados estruturados corretos (schema NewsArticle, BlogPosting).
Extraia dados de artigos em escala para bancos de dados de pesquisa, agregadores de conteúdo ou datasets de treinamento.
Perguntas frequentes
- Quais campos ele extrai?
- Título, nome do autor, data de publicação, data da última modificação, tags do artigo, categorias, nome do publisher, resumo, contagem de palavras, tempo estimado de leitura e URL canonical.
- Como ele encontra o autor e a data?
- O SmartScan verifica várias fontes por ordem de prioridade: o esquema JSON-LD (Article/NewsArticle/BlogPosting), as meta tags Open Graph, o Twitter Card e elementos HTML semânticos como
<time>e os padrões de assinatura do autor. - Funciona com todos os formatos de artigo?
- Funciona melhor em posts de blog, notícias e páginas de conteúdo padrão que usam dados estruturados ou meta tags comuns. Em CMS personalizados a precisão pode ser menor.
- Posso extrair dados de artigos de várias páginas?
- Sim — use o Crawl do site ou o scan em massa para extrair metadados de vários posts de blog ou notícias em um único job.
- Esta ferramenta é gratuita?
- Sim — o SmartScan é gratuito. Cadastre-se e tenha 1.000 scans/mês. Sem cartão de crédito.
Extraia os metadados de artigos de qualquer página
Grátis — 1.000 scans/mês. Sem cartão de crédito.