~/utility/schema-markup-scraper

Schema Markup Scraper & SEO Auditor

Извлекайте JSON-LD, Microdata, RDFa, Open Graph и Twitter Cards с любого URL с комплексной системой SEO-аудита и скорингом.

SEO TypeScriptCrawlee Глобально
proooxy/schema-markup-scraper — характеристики
категорияutility / SEO
языкTypeScript
стекTypeScript, Crawlee
рынкиГлобально
выводчистый JSON, готовый к RAG

ключевые возможности

Извлечение структурированных данных — JSON-LD, Microdata и RDFa

Социальные мета-теги — Open Graph, Twitter Cards, Dublin Core

SEO-анализ со скорингом от 0 до 100

Валидация канонического URL и hreflang

Извлечение автора для сигналов EEAT

Определение LocalBusiness с 80+ подтипами

Аудит alt-текста изображений

Валидация схемы хлебных крошек (Breadcrumb)

Извлечение гео-тегов и данных NAP

сценарии использования

  • Технический SEO-аудит в промышленном масштабе
  • Валидация структурированных данных сайтов
  • Конкурентный SEO-анализ — сравнение schema-разметки конкурентов
  • Оценка сигналов EEAT для контентных сайтов
  • Аудит локального SEO для бизнеса
  • Проверка SEO-чеклиста перед запуском

входные параметры

ПараметрТипОбязательныйОписание
startUrlsarrayобязательноURL для анализа
proxyobjectопциональноКонфигурация прокси
maxRequestsPerCrawlnumberопциональноОграничение общего числа URL для аудита
maxConcurrencynumberопциональноПараллельные запросы
extractMetaTagsbooleanопциональноИзвлекать мета-теги (по умолчанию: true)
extractSeoAnalysisbooleanопциональноВыполнять SEO-анализ (по умолчанию: true)
computeSeoScorebooleanопциональноРассчитывать SEO-скор от 0 до 100 (по умолчанию: true)
extractGeoDatabooleanопциональноИзвлекать гео-теги и данные NAP

Пример вывода

 1{
 2  "url": "https://developers.google.com/search/docs/appearance/structured-data/product",
 3  "title": "Intro to Product Structured Data on Google | Google Search Central",
 4  "linkedData": [
 5    {
 6      "@context": "https://schema.org",
 7      "@type": "BreadcrumbList",
 8      "itemListElement": [
 9        { "@type": "ListItem", "position": 1, "name": "Search Central", "item": "https://developers.google.com/search" }
10      ]
11    }
12  ],
13  "openGraph": {
14    "site_name": "Google for Developers",
15    "type": "website"
16  },
17  "twitterCard": {
18    "card": "summary_large_image",
19    "has_large_image": "true"
20  },
21  "seoAudit": {
22    "score": 95,
23    "issues": [
24      { "severity": "warning", "code": "TITLE_TOO_LONG", "message": "Title is 122 chars (recommended: max 60)" }
25    ]
26  },
27  "headings": {
28    "headings": [
29      { "level": 1, "text": "Introduction to Product structured data" },
30      { "level": 2, "text": "Deciding which markup to use" }
31    ],
32    "h1Count": 1,
33    "issues": []
34  }
35}

частые вопросы

Какие форматы структурированных данных поддерживаются?
JSON-LD, Microdata и RDFa. Парсер также извлекает метаданные Open Graph, Twitter Cards и Dublin Core.
Как рассчитывается SEO-скор?
Скор от 0 до 100 оценивает теги title, meta-описания, иерархию заголовков, alt-текст изображений, канонические URL, мобильный viewport, наличие структурированных данных и другие факторы.
Можно ли аудировать несколько страниц одновременно?
Да, передайте несколько URL в startUrls. Парсер обрабатывает их параллельно для быстрого массового аудита.

похожие в ~/utility

Запустите Schema Markup Scraper & SEO Auditor или закажите разработку под задачу

Начните извлекать данные на Apify за считаные минуты или закажите у меня разработку парсера на заказ и RAG-конвейера под ваш источник и схему.

запустить на Apify заказать данные