Извлекайте метаданные статей с любой страницы
Автоматически собирайте структурированные метаданные любой статьи или поста в блоге — заголовок, автор, дата публикации, дата изменения, теги, количество слов и примерное время чтения.
Для первого скана аккаунт не нужен · Результат за секунды
Автор и даты
Извлекает имя автора, дату публикации и дату последнего изменения из JSON-LD, Open Graph, метатегов и семантической HTML-разметки.
Теги и категории
Находит теги, категории и ключевые слова статьи — из структурированных данных или прямо со страницы.
Количество слов и время чтения
Считает количество слов в основном тексте и оценивает время чтения из расчёта 200 слов в минуту.
Как работает экстрактор данных статьи
Укажите URL статьи или поста в блоге
Вставьте ссылку на пост в блоге, новостную статью или контентную страницу, которую нужно разобрать.
SmartScan извлекает метаданные из нескольких источников
Проверяет структурированные данные JSON-LD, метатеги Open Graph и семантические HTML-элементы, чтобы собрать самую точную информацию о статье.
Скачайте структурированные данные статьи в JSON
Получите все метаданные статьи — заголовок, автор, даты, теги, количество слов, время чтения — в аккуратном JSON-файле.
Извлечение из нескольких источников
Проверяет JSON-LD (Article, NewsArticle, BlogPosting), метатеги Open Graph и Twitter Card, а также семантические HTML-элементы — и берёт источник с лучшими данными.
Информация о публикации
Извлекает название и логотип издателя, если они есть в структурированных данных, — удобно для ссылок на источник и контент-аудита.
Структурированный JSON-вывод
Все данные статьи сохраняются как content/article.json — заголовок, автор, даты, теги, количество слов, время чтения, фрагмент.
Популярные случаи использования
Быстро получайте метаданные статей, которые вы цитируете, сравниваете или архивируете.
Проверьте метаданные статей своего сайта и найдите пропущенные даты, авторов и теги.
Проверьте, есть ли у статей конкурентов корректные структурированные данные (схемы NewsArticle, BlogPosting).
Извлекайте данные статей в больших объёмах для исследовательских баз, контент-агрегаторов или обучающих датасетов.
Часто задаваемые вопросы
- Какие поля извлекаются?
- Заголовок, имя автора, дата публикации, дата последнего изменения, теги, категории, название издателя, отрывок, количество слов, примерное время чтения и canonical URL.
- Как он находит автора и дату?
- SmartScan проверяет несколько источников по приоритету: схему JSON-LD (Article/NewsArticle/BlogPosting), метатеги Open Graph, Twitter Card, а также семантические HTML-элементы вроде
<time>и типичную подпись автора. - Работает ли на всех форматах статей?
- Лучше всего он работает со стандартными постами в блогах, новостными статьями и контентными страницами, где есть структурированные данные или типовые метатеги. На самописных CMS точность может быть ниже.
- Могу ли я извлекать данные статей с нескольких страниц?
- Да — включите обход сайта или пакетный скан, чтобы собрать метаданные сразу с нескольких постов или новостных статей за одну задачу.
- Этот инструмент бесплатный?
- Да — SmartScan полностью бесплатен. Зарегистрируйтесь и получите 1 000 сканов в месяц. Банковская карта не нужна.
Извлечь метаданные статьи с любой страницы
Бесплатно — 1 000 сканов в месяц. Банковская карта не нужна.