~/utility/schema-markup-scraper
Schema Markup Scraper — 構造化データ抽出とSEO監査
あらゆるURLからJSON-LD、Microdata、RDFa、Open Graph、Twitter Cardsを抽出し、総合的なSEO監査スコアリングを行います。
SEO
TypeScriptCrawlee
グローバル
カテゴリutility / SEO
言語TypeScript
スタックTypeScript, Crawlee
マーケットグローバル
出力クリーンでRAG対応のJSON
主な機能
構造化データ抽出 — JSON-LD、Microdata、RDFa
ソーシャルメタタグ — Open Graph、Twitter Cards、Dublin Core
0〜100点のスコアリングによるSEO分析
正規URLとhreflangの検証
EEATシグナルのための著者情報抽出
80種類以上のサブタイプに対応したLocalBusiness検出
画像alt属性の監査
パンくずリストのスキーマ検証
ジオタグとNAP(店舗名・住所・電話番号)の抽出
活用例
- 大規模なテクニカルSEO監査
- Webサイトの構造化データ検証
- 競合SEO分析 — 競合サイト間のスキーママークアップ比較
- コンテンツサイト向けEEATシグナル評価
- 企業向けローカルSEO監査
- 公開前のSEOチェックリスト検証
入力パラメータ
| パラメータ | 型 | 必須 | 説明 |
|---|---|---|---|
startUrls | array | 必須 | 分析対象のURL |
proxy | object | 任意 | プロキシ設定 |
maxRequestsPerCrawl | number | 任意 | 監査するURLの総数上限 |
maxConcurrency | number | 任意 | 並列リクエスト数 |
extractMetaTags | boolean | 任意 | メタタグを抽出(デフォルト:true) |
extractSeoAnalysis | boolean | 任意 | SEO分析を実行(デフォルト:true) |
computeSeoScore | boolean | 任意 | 0〜100点のSEOスコアを算出(デフォルト:true) |
extractGeoData | boolean | 任意 | ジオタグとNAPデータを抽出 |
Output Example
1{
2 "url": "https://developers.google.com/search/docs/appearance/structured-data/product",
3 "title": "Intro to Product Structured Data on Google | Google Search Central",
4 "linkedData": [
5 {
6 "@context": "https://schema.org",
7 "@type": "BreadcrumbList",
8 "itemListElement": [
9 { "@type": "ListItem", "position": 1, "name": "Search Central", "item": "https://developers.google.com/search" }
10 ]
11 }
12 ],
13 "openGraph": {
14 "site_name": "Google for Developers",
15 "type": "website"
16 },
17 "twitterCard": {
18 "card": "summary_large_image",
19 "has_large_image": "true"
20 },
21 "seoAudit": {
22 "score": 95,
23 "issues": [
24 { "severity": "warning", "code": "TITLE_TOO_LONG", "message": "Title is 122 chars (recommended: max 60)" }
25 ]
26 },
27 "headings": {
28 "headings": [
29 { "level": 1, "text": "Introduction to Product structured data" },
30 { "level": 2, "text": "Deciding which markup to use" }
31 ],
32 "h1Count": 1,
33 "issues": []
34 }
35}
よくある質問
対応している構造化データ形式は?
JSON-LD、Microdata、RDFaです。加えて、Open Graph、Twitter Cards、Dublin Coreのメタデータも抽出します。
SEOスコアはどのように算出されますか?
0〜100点のスコアは、titleタグ、メタディスクリプション、見出し階層、画像alt属性、正規URL、モバイルビューポート、構造化データの有無などを評価して算出されます。
複数ページを一度に監査できますか?
はい、startUrlsに複数のURLを指定してください。並列処理により高速な一括監査が可能です。