Бесплатный инструмент

Извлекайте метаданные статей с любой страницы

Автоматически собирайте структурированные метаданные любой статьи или поста в блоге — заголовок, автор, дата публикации, дата изменения, теги, количество слов и примерное время чтения.

Для первого скана аккаунт не нужен · Результат за секунды

✍️

Автор и даты

Извлекает имя автора, дату публикации и дату последнего изменения из JSON-LD, Open Graph, метатегов и семантической HTML-разметки.

🏷️

Теги и категории

Находит теги, категории и ключевые слова статьи — из структурированных данных или прямо со страницы.

📊

Количество слов и время чтения

Считает количество слов в основном тексте и оценивает время чтения из расчёта 200 слов в минуту.

Как работает экстрактор данных статьи

1

Укажите URL статьи или поста в блоге

Вставьте ссылку на пост в блоге, новостную статью или контентную страницу, которую нужно разобрать.

2

SmartScan извлекает метаданные из нескольких источников

Проверяет структурированные данные JSON-LD, метатеги Open Graph и семантические HTML-элементы, чтобы собрать самую точную информацию о статье.

3

Скачайте структурированные данные статьи в JSON

Получите все метаданные статьи — заголовок, автор, даты, теги, количество слов, время чтения — в аккуратном JSON-файле.

🎯

Извлечение из нескольких источников

Проверяет JSON-LD (Article, NewsArticle, BlogPosting), метатеги Open Graph и Twitter Card, а также семантические HTML-элементы — и берёт источник с лучшими данными.

🌐

Информация о публикации

Извлекает название и логотип издателя, если они есть в структурированных данных, — удобно для ссылок на источник и контент-аудита.

📋

Структурированный JSON-вывод

Все данные статьи сохраняются как content/article.json — заголовок, автор, даты, теги, количество слов, время чтения, фрагмент.

Популярные случаи использования

Контент-исследования
Быстро получайте метаданные статей, которые вы цитируете, сравниваете или архивируете.
Редакционный аудит
Проверьте метаданные статей своего сайта и найдите пропущенные даты, авторов и теги.
SEO-анализ
Проверьте, есть ли у статей конкурентов корректные структурированные данные (схемы NewsArticle, BlogPosting).
Сбор данных
Извлекайте данные статей в больших объёмах для исследовательских баз, контент-агрегаторов или обучающих датасетов.

Часто задаваемые вопросы

Какие поля извлекаются?
Заголовок, имя автора, дата публикации, дата последнего изменения, теги, категории, название издателя, отрывок, количество слов, примерное время чтения и canonical URL.
Как он находит автора и дату?
SmartScan проверяет несколько источников по приоритету: схему JSON-LD (Article/NewsArticle/BlogPosting), метатеги Open Graph, Twitter Card, а также семантические HTML-элементы вроде <time> и типичную подпись автора.
Работает ли на всех форматах статей?
Лучше всего он работает со стандартными постами в блогах, новостными статьями и контентными страницами, где есть структурированные данные или типовые метатеги. На самописных CMS точность может быть ниже.
Могу ли я извлекать данные статей с нескольких страниц?
Да — включите обход сайта или пакетный скан, чтобы собрать метаданные сразу с нескольких постов или новостных статей за одну задачу.
Этот инструмент бесплатный?
Да — SmartScan полностью бесплатен. Зарегистрируйтесь и получите 1 000 сканов в месяц. Банковская карта не нужна.

Извлечь метаданные статьи с любой страницы

Бесплатно — 1 000 сканов в месяц. Банковская карта не нужна.

Создать бесплатный аккаунт → Попробовать без аккаунта