~/utility/schema-markup-scraper
Schema Markup Scraper & SEO Auditor
Извлекайте JSON-LD, Microdata, RDFa, Open Graph и Twitter Cards с любого URL с комплексной системой SEO-аудита и скорингом.
SEO
TypeScriptCrawlee
Глобально
категорияutility / SEO
языкTypeScript
стекTypeScript, Crawlee
рынкиГлобально
выводчистый JSON, готовый к RAG
ключевые возможности
Извлечение структурированных данных — JSON-LD, Microdata и RDFa
Социальные мета-теги — Open Graph, Twitter Cards, Dublin Core
SEO-анализ со скорингом от 0 до 100
Валидация канонического URL и hreflang
Извлечение автора для сигналов EEAT
Определение LocalBusiness с 80+ подтипами
Аудит alt-текста изображений
Валидация схемы хлебных крошек (Breadcrumb)
Извлечение гео-тегов и данных NAP
сценарии использования
- Технический SEO-аудит в промышленном масштабе
- Валидация структурированных данных сайтов
- Конкурентный SEO-анализ — сравнение schema-разметки конкурентов
- Оценка сигналов EEAT для контентных сайтов
- Аудит локального SEO для бизнеса
- Проверка SEO-чеклиста перед запуском
входные параметры
| Параметр | Тип | Обязательный | Описание |
|---|---|---|---|
startUrls | array | обязательно | URL для анализа |
proxy | object | опционально | Конфигурация прокси |
maxRequestsPerCrawl | number | опционально | Ограничение общего числа URL для аудита |
maxConcurrency | number | опционально | Параллельные запросы |
extractMetaTags | boolean | опционально | Извлекать мета-теги (по умолчанию: true) |
extractSeoAnalysis | boolean | опционально | Выполнять SEO-анализ (по умолчанию: true) |
computeSeoScore | boolean | опционально | Рассчитывать SEO-скор от 0 до 100 (по умолчанию: true) |
extractGeoData | boolean | опционально | Извлекать гео-теги и данные NAP |
Пример вывода
1{
2 "url": "https://developers.google.com/search/docs/appearance/structured-data/product",
3 "title": "Intro to Product Structured Data on Google | Google Search Central",
4 "linkedData": [
5 {
6 "@context": "https://schema.org",
7 "@type": "BreadcrumbList",
8 "itemListElement": [
9 { "@type": "ListItem", "position": 1, "name": "Search Central", "item": "https://developers.google.com/search" }
10 ]
11 }
12 ],
13 "openGraph": {
14 "site_name": "Google for Developers",
15 "type": "website"
16 },
17 "twitterCard": {
18 "card": "summary_large_image",
19 "has_large_image": "true"
20 },
21 "seoAudit": {
22 "score": 95,
23 "issues": [
24 { "severity": "warning", "code": "TITLE_TOO_LONG", "message": "Title is 122 chars (recommended: max 60)" }
25 ]
26 },
27 "headings": {
28 "headings": [
29 { "level": 1, "text": "Introduction to Product structured data" },
30 { "level": 2, "text": "Deciding which markup to use" }
31 ],
32 "h1Count": 1,
33 "issues": []
34 }
35}
частые вопросы
Какие форматы структурированных данных поддерживаются?
JSON-LD, Microdata и RDFa. Парсер также извлекает метаданные Open Graph, Twitter Cards и Dublin Core.
Как рассчитывается SEO-скор?
Скор от 0 до 100 оценивает теги title, meta-описания, иерархию заголовков, alt-текст изображений, канонические URL, мобильный viewport, наличие структурированных данных и другие факторы.
Можно ли аудировать несколько страниц одновременно?
Да, передайте несколько URL в startUrls. Парсер обрабатывает их параллельно для быстрого массового аудита.
похожие в ~/utility
медиа
Universal Web Printer — URL и HTML в PDF и изображения
Конвертация URL и HTML в PDF, PNG, JPEG или WebP.
открыть