~/utility/schema-markup-scraper

Schema Markup Scraper — 構造化データ抽出とSEO監査

あらゆるURLからJSON-LD、Microdata、RDFa、Open Graph、Twitter Cardsを抽出し、総合的なSEO監査スコアリングを行います。

SEO TypeScriptCrawlee グローバル
proooxy/schema-markup-scraper — スペック
カテゴリutility / SEO
言語TypeScript
スタックTypeScript, Crawlee
マーケットグローバル
出力クリーンでRAG対応のJSON

主な機能

構造化データ抽出 — JSON-LD、Microdata、RDFa

ソーシャルメタタグ — Open Graph、Twitter Cards、Dublin Core

0〜100点のスコアリングによるSEO分析

正規URLとhreflangの検証

EEATシグナルのための著者情報抽出

80種類以上のサブタイプに対応したLocalBusiness検出

画像alt属性の監査

パンくずリストのスキーマ検証

ジオタグとNAP(店舗名・住所・電話番号)の抽出

活用例

  • 大規模なテクニカルSEO監査
  • Webサイトの構造化データ検証
  • 競合SEO分析 — 競合サイト間のスキーママークアップ比較
  • コンテンツサイト向けEEATシグナル評価
  • 企業向けローカルSEO監査
  • 公開前のSEOチェックリスト検証

入力パラメータ

パラメータ型必須説明
startUrlsarray必須分析対象のURL
proxyobject任意プロキシ設定
maxRequestsPerCrawlnumber任意監査するURLの総数上限
maxConcurrencynumber任意並列リクエスト数
extractMetaTagsboolean任意メタタグを抽出(デフォルト:true)
extractSeoAnalysisboolean任意SEO分析を実行(デフォルト:true)
computeSeoScoreboolean任意0〜100点のSEOスコアを算出(デフォルト:true)
extractGeoDataboolean任意ジオタグとNAPデータを抽出

Output Example

 1{
 2  "url": "https://developers.google.com/search/docs/appearance/structured-data/product",
 3  "title": "Intro to Product Structured Data on Google | Google Search Central",
 4  "linkedData": [
 5    {
 6      "@context": "https://schema.org",
 7      "@type": "BreadcrumbList",
 8      "itemListElement": [
 9        { "@type": "ListItem", "position": 1, "name": "Search Central", "item": "https://developers.google.com/search" }
10      ]
11    }
12  ],
13  "openGraph": {
14    "site_name": "Google for Developers",
15    "type": "website"
16  },
17  "twitterCard": {
18    "card": "summary_large_image",
19    "has_large_image": "true"
20  },
21  "seoAudit": {
22    "score": 95,
23    "issues": [
24      { "severity": "warning", "code": "TITLE_TOO_LONG", "message": "Title is 122 chars (recommended: max 60)" }
25    ]
26  },
27  "headings": {
28    "headings": [
29      { "level": 1, "text": "Introduction to Product structured data" },
30      { "level": 2, "text": "Deciding which markup to use" }
31    ],
32    "h1Count": 1,
33    "issues": []
34  }
35}

よくある質問

対応している構造化データ形式は?
JSON-LD、Microdata、RDFaです。加えて、Open Graph、Twitter Cards、Dublin Coreのメタデータも抽出します。
SEOスコアはどのように算出されますか?
0〜100点のスコアは、titleタグ、メタディスクリプション、見出し階層、画像alt属性、正規URL、モバイルビューポート、構造化データの有無などを評価して算出されます。
複数ページを一度に監査できますか?
はい、startUrlsに複数のURLを指定してください。並列処理により高速な一括監査が可能です。

~/utility の関連ツール

Schema Markup Scraper — 構造化データ抽出とSEO監査を実行、またはカスタム開発を依頼

数分でApify上での抽出を開始できます。または、あなたの取得元とスキーマに合わせたオーダーメイドのスクレイパーとRAGパイプラインの構築を依頼できます。

Apifyで実行 カスタムデータを依頼