Ferramenta gratuita

Extraia conteúdo de artigos de qualquer post de blog

Colete automaticamente metadados estruturados de qualquer artigo ou post de blog: título, autor, data de publicação, última modificação, tags, contagem de palavras e tempo estimado de leitura.

Sem conta para o primeiro scan · Resultados em segundos

✍️

Autor e datas

Extrai o nome do autor, a data de publicação e a de última modificação de JSON-LD, Open Graph, meta tags e marcação semântica HTML.

🏷️

Tags e categorias

Encontra tags, categorias e palavras-chave do artigo, seja nos dados estruturados ou visíveis na página.

📊

Contagem de palavras e tempo de leitura

Conta as palavras do conteúdo principal e estima o tempo de leitura a 200 palavras por minuto.

Como funciona o extrator de dados de artigos

1

Informe a URL de um artigo ou post de blog

Cole o link do post de blog, da notícia ou da página de conteúdo que você quer analisar.

2

O SmartScan extrai metadados de várias fontes

Verifica dados estruturados JSON-LD, meta tags Open Graph e elementos semânticos HTML para achar a informação mais precisa do artigo.

3

Baixe os dados estruturados do artigo em JSON

Receba todos os metadados do artigo — título, autor, datas, tags, contagem de palavras, tempo de leitura — em um arquivo JSON limpo.

🎯

Extração de múltiplas fontes

Verifica JSON-LD (Article, NewsArticle, BlogPosting), meta Open Graph, meta Twitter Card e elementos semânticos HTML — o que tiver os melhores dados.

🌐

Dados de publicação

Extrai o nome e o logo do publisher quando estão nos dados estruturados — útil para citar fontes e auditar conteúdo.

📋

Saída JSON estruturada

Todos os dados do artigo são salvos como content/article.json — título, autor, datas, tags, número de palavras, tempo de leitura e resumo.

Casos de uso comuns

Pesquisa de conteúdo
Pegue rapidamente os metadados dos artigos que você cita, compara ou arquiva.
Auditoria editorial
Audite os metadados dos artigos do seu site e encontre datas, autores ou tags faltando.
Análise de SEO
Veja se os artigos dos concorrentes têm dados estruturados corretos (schema NewsArticle, BlogPosting).
Coleta de dados
Extraia dados de artigos em escala para bancos de dados de pesquisa, agregadores de conteúdo ou datasets de treinamento.

Perguntas frequentes

Quais campos ele extrai?
Título, nome do autor, data de publicação, data da última modificação, tags do artigo, categorias, nome do publisher, resumo, contagem de palavras, tempo estimado de leitura e URL canonical.
Como ele encontra o autor e a data?
O SmartScan verifica várias fontes por ordem de prioridade: o esquema JSON-LD (Article/NewsArticle/BlogPosting), as meta tags Open Graph, o Twitter Card e elementos HTML semânticos como <time> e os padrões de assinatura do autor.
Funciona com todos os formatos de artigo?
Funciona melhor em posts de blog, notícias e páginas de conteúdo padrão que usam dados estruturados ou meta tags comuns. Em CMS personalizados a precisão pode ser menor.
Posso extrair dados de artigos de várias páginas?
Sim — use o Crawl do site ou o scan em massa para extrair metadados de vários posts de blog ou notícias em um único job.
Esta ferramenta é gratuita?
Sim — o SmartScan é gratuito. Cadastre-se e tenha 1.000 scans/mês. Sem cartão de crédito.

Extraia os metadados de artigos de qualquer página

Grátis — 1.000 scans/mês. Sem cartão de crédito.

Criar conta grátis → Testar sem conta