~/utility/schema-markup-scraper

Schema Markup Scraper & SEO Auditor

Extrayez JSON-LD, Microdata, RDFa, Open Graph et Twitter Cards de n’importe quelle URL, avec un système complet de scoring d’audit SEO.

SEO >99% de réussite TypeScriptCrawlee Mondial
proooxy/schema-markup-scraper — specs
catégorieutility / SEO
langageTypeScript
stackTypeScript, Crawlee
marchésMondial
réussite>99%
sortieJSON propre, prêt pour le RAG

fonctionnalités clés

Extraction de données structurées — JSON-LD, Microdata et RDFa

Balises meta sociales — Open Graph, Twitter Cards, Dublin Core

Analyse SEO avec scoring de 0 à 100

Validation des URL canoniques et des hreflang

Extraction de l’auteur pour les signaux EEAT

Détection LocalBusiness avec plus de 80 sous-types

Audit des textes alternatifs d’image

Validation du schema breadcrumb

Extraction des balises géo et des données NAP

cas d’usage

  • Audit SEO technique à grande échelle
  • Validation des données structurées pour les sites web
  • Analyse SEO concurrentielle — comparez le schema markup entre concurrents
  • Évaluation des signaux EEAT pour les sites de contenu
  • Audit SEO local pour les entreprises
  • Validation de checklist SEO avant lancement

paramètres d’entrée

ParamètreTypeRequisDescription
startUrlsarrayrequisURLs à analyser
proxyobjectoptionnelConfiguration du proxy
maxRequestsPerCrawlnumberoptionnelLimite le nombre total d’URLs à auditer
maxConcurrencynumberoptionnelRequêtes en parallèle
extractMetaTagsbooleanoptionnelExtrait les balises meta (par défaut : true)
extractSeoAnalysisbooleanoptionnelExécute l’analyse SEO (par défaut : true)
computeSeoScorebooleanoptionnelCalcule le score SEO de 0 à 100 (par défaut : true)
extractGeoDatabooleanoptionnelExtrait les balises géo et les données NAP

Exemple de sortie

 1{
 2  "url": "https://example.com/product/...",
 3  "title": "Example Product Page",
 4  "linkedData": [
 5    { "@type": "Product", "name": "..." }
 6  ],
 7  "openGraph": {
 8    "og:title": "Example Product",
 9    "og:type": "product"
10  },
11  "twitterCard": {
12    "card": "summary_large_image"
13  },
14  "seoAudit": {
15    "score": 78,
16    "issues": [
17      "Missing alt text on 3 images",
18      "No hreflang tags detected"
19    ]
20  },
21  "headings": {
22    "h1": ["Example Product"],
23    "h2": ["Description", "Reviews"]
24  }
25}

faq

Quels formats de données structurées sont supportés ?
JSON-LD, Microdata et RDFa. Le scraper extrait également les métadonnées Open Graph, Twitter Cards et Dublin Core.
Comment le score SEO est-il calculé ?
Le score de 0 à 100 évalue les balises title, les meta descriptions, la hiérarchie des titres, les textes alternatifs d’image, les URL canoniques, le viewport mobile, la présence de données structurées, et plus encore.
Puis-je auditer plusieurs pages à la fois ?
Oui, fournissez plusieurs URLs dans startUrls. Le scraper les traite en parallèle pour un audit en masse rapide.

similaires dans ~/utility

Exécutez Schema Markup Scraper & SEO Auditor, ou obtenez un projet sur mesure

Commencez à extraire sur Apify en quelques minutes, ou engagez-moi pour construire un scraper sur mesure et un pipeline RAG adaptés exactement à votre source et à votre schéma.

exécuter sur Apify obtenir des données sur mesure