~/utility/schema-markup-scraper

Schema Markup Scraper और SEO ऑडिटर

किसी भी URL से JSON-LD, Microdata, RDFa, Open Graph, और Twitter Cards एक व्यापक SEO ऑडिट स्कोरिंग सिस्टम के साथ एक्सट्रैक्ट करें।

SEO TypeScriptCrawlee वैश्विक
proooxy/schema-markup-scraper — स्पेक
कैटेगरीutility / SEO
भाषाTypeScript
स्टैकTypeScript, Crawlee
मार्केट्सवैश्विक
आउटपुटसाफ, RAG-तैयार JSON

मुख्य विशेषताएं

संरचित डेटा एक्सट्रैक्शन — JSON-LD, Microdata, और RDFa

सोशल meta tags — Open Graph, Twitter Cards, Dublin Core

0-100 स्कोरिंग के साथ SEO एनालिसिस

Canonical URL और hreflang वैलिडेशन

EEAT सिग्नल के लिए Author एक्सट्रैक्शन

80+ सबटाइप के साथ LocalBusiness डिटेक्शन

Image alt text ऑडिट

Breadcrumb schema वैलिडेशन

Geo tags और NAP एक्सट्रैक्शन

यूज़ केस

  • बड़े स्केल पर टेक्निकल SEO ऑडिटिंग
  • वेबसाइटों के लिए संरचित डेटा वैलिडेशन
  • प्रतिस्पर्धी SEO एनालिसिस — कॉम्पिटिटर्स में schema markup कंपेयर करें
  • कंटेंट साइट्स के लिए EEAT सिग्नल असेसमेंट
  • बिज़नेस के लिए Local SEO ऑडिटिंग
  • प्री-लॉन्च SEO चेकलिस्ट वैलिडेशन

इनपुट पैरामीटर

पैरामीटरटाइपआवश्यकविवरण
startUrlsarrayआवश्यकएनालाइज़ करने के लिए URL
proxyobjectवैकल्पिकप्रॉक्सी कॉन्फ़िगरेशन
maxRequestsPerCrawlnumberवैकल्पिकऑडिट करने के लिए कुल URL सीमित करें
maxConcurrencynumberवैकल्पिकपैरेलल रिक्वेस्ट
extractMetaTagsbooleanवैकल्पिकmeta tags एक्सट्रैक्ट करें (डिफ़ॉल्ट: true)
extractSeoAnalysisbooleanवैकल्पिकSEO एनालिसिस चलाएं (डिफ़ॉल्ट: true)
computeSeoScorebooleanवैकल्पिक0-100 SEO स्कोर कैलकुलेट करें (डिफ़ॉल्ट: true)
extractGeoDatabooleanवैकल्पिकgeo tags और NAP डेटा एक्सट्रैक्ट करें

आउटपुट का उदाहरण

 1{
 2  "url": "https://developers.google.com/search/docs/appearance/structured-data/product",
 3  "title": "Intro to Product Structured Data on Google | Google Search Central",
 4  "linkedData": [
 5    {
 6      "@context": "https://schema.org",
 7      "@type": "BreadcrumbList",
 8      "itemListElement": [
 9        { "@type": "ListItem", "position": 1, "name": "Search Central", "item": "https://developers.google.com/search" }
10      ]
11    }
12  ],
13  "openGraph": {
14    "site_name": "Google for Developers",
15    "type": "website"
16  },
17  "twitterCard": {
18    "card": "summary_large_image",
19    "has_large_image": "true"
20  },
21  "seoAudit": {
22    "score": 95,
23    "issues": [
24      { "severity": "warning", "code": "TITLE_TOO_LONG", "message": "Title is 122 chars (recommended: max 60)" }
25    ]
26  },
27  "headings": {
28    "headings": [
29      { "level": 1, "text": "Introduction to Product structured data" },
30      { "level": 2, "text": "Deciding which markup to use" }
31    ],
32    "h1Count": 1,
33    "issues": []
34  }
35}

सामान्य प्रश्न

कौन-कौन से संरचित डेटा फ़ॉर्मेट सपोर्टेड हैं?
JSON-LD, Microdata, और RDFa। स्क्रैपर Open Graph, Twitter Cards, और Dublin Core मेटाडेटा भी एक्सट्रैक्ट करता है।
SEO स्कोर कैसे कैलकुलेट होता है?
0-100 स्कोर title tags, meta descriptions, heading hierarchy, image alt text, canonical URLs, mobile viewport, संरचित डेटा की मौजूदगी, और भी बहुत कुछ evaluate करता है।
क्या मैं एक साथ कई पेज ऑडिट कर सकता हूं?
हां, startUrls में कई URL दें। स्क्रैपर तेज़ bulk ऑडिटिंग के लिए इन्हें पैरेलल में प्रोसेस करता है।

~/utility में संबंधित

Schema Markup Scraper और SEO ऑडिटर रन करें, या कस्टम बिल्ड पाएं

मिनटों में Apify पर एक्सट्रैक्शन शुरू करें, या अपने सोर्स और स्कीमा के लिए कस्टम स्क्रैपर और RAG पाइपलाइन बनवाने के लिए मुझे हायर करें।

Apify पर रन करें कस्टम डेटा पाएं