~/utility/schema-markup-scraper

Schema Markup Scraper & SEO-Auditor

JSON-LD, Microdata, RDFa, Open Graph und Twitter Cards von jeder URL extrahieren — mit einem umfassenden SEO-Audit-Scoring-System.

SEO TypeScriptCrawlee Weltweit
proooxy/schema-markup-scraper — Steckbrief
Kategorieutility / SEO
SpracheTypeScript
StackTypeScript, Crawlee
MärkteWeltweit
Outputsauberes, RAG-fertiges JSON

Hauptfunktionen

Extraktion strukturierter Daten — JSON-LD, Microdata und RDFa

Social-Meta-Tags — Open Graph, Twitter Cards, Dublin Core

SEO-Analyse mit Scoring von 0–100

Validierung von kanonischer URL und hreflang

Autoren-Extraktion für EEAT-Signale

LocalBusiness-Erkennung mit über 80 Subtypen

Audit von Bild-Alt-Texten

Validierung von Breadcrumb-Schema

Extraktion von Geo-Tags und NAP-Daten

Anwendungsfälle

  • Technisches SEO-Auditing im großen Maßstab
  • Validierung strukturierter Daten für Websites
  • Wettbewerbs-SEO-Analyse — Schema Markup über Wettbewerber hinweg vergleichen
  • Bewertung von EEAT-Signalen für Content-Websites
  • Local-SEO-Auditing für Unternehmen
  • SEO-Checklisten-Validierung vor dem Launch

Eingabeparameter

ParameterTypErforderlichBeschreibung
startUrlsarrayerforderlichZu analysierende URLs
proxyobjectoptionalProxy-Konfiguration
maxRequestsPerCrawlnumberoptionalLimit für die Gesamtzahl zu auditierender URLs
maxConcurrencynumberoptionalParallele Anfragen
extractMetaTagsbooleanoptionalMeta-Tags extrahieren (Standard: true)
extractSeoAnalysisbooleanoptionalSEO-Analyse durchführen (Standard: true)
computeSeoScorebooleanoptionalSEO-Score von 0–100 berechnen (Standard: true)
extractGeoDatabooleanoptionalGeo-Tags und NAP-Daten extrahieren

Beispiel-Output

 1{
 2  "url": "https://developers.google.com/search/docs/appearance/structured-data/product",
 3  "title": "Intro to Product Structured Data on Google | Google Search Central",
 4  "linkedData": [
 5    {
 6      "@context": "https://schema.org",
 7      "@type": "BreadcrumbList",
 8      "itemListElement": [
 9        { "@type": "ListItem", "position": 1, "name": "Search Central", "item": "https://developers.google.com/search" }
10      ]
11    }
12  ],
13  "openGraph": {
14    "site_name": "Google for Developers",
15    "type": "website"
16  },
17  "twitterCard": {
18    "card": "summary_large_image",
19    "has_large_image": "true"
20  },
21  "seoAudit": {
22    "score": 95,
23    "issues": [
24      { "severity": "warning", "code": "TITLE_TOO_LONG", "message": "Title is 122 chars (recommended: max 60)" }
25    ]
26  },
27  "headings": {
28    "headings": [
29      { "level": 1, "text": "Introduction to Product structured data" },
30      { "level": 2, "text": "Deciding which markup to use" }
31    ],
32    "h1Count": 1,
33    "issues": []
34  }
35}

FAQ

Welche Formate für strukturierte Daten werden unterstützt?
JSON-LD, Microdata und RDFa. Der Scraper extrahiert außerdem Open-Graph-, Twitter-Cards- und Dublin-Core-Metadaten.
Wie wird der SEO-Score berechnet?
Der Score von 0–100 bewertet Title-Tags, Meta-Descriptions, Überschriftenhierarchie, Bild-Alt-Texte, kanonische URLs, Mobile-Viewport, das Vorhandensein strukturierter Daten und mehr.
Kann ich mehrere Seiten gleichzeitig auditieren?
Ja, mehrere URLs in startUrls angeben. Der Scraper verarbeitet sie parallel für schnelles Bulk-Auditing.

verwandt in ~/utility

Schema Markup Scraper & SEO-Auditor ausführen oder ein individuelles Projekt anfragen

In wenigen Minuten mit der Extraktion auf Apify starten, oder mich für einen maßgeschneiderten Scraper und eine RAG-Pipeline exakt nach Quelle und Schema beauftragen.

auf Apify ausführen individuelle Daten anfragen