~/utility/schema-markup-scraper
Schema Markup Scraper & SEO Auditor
Extrayez JSON-LD, Microdata, RDFa, Open Graph et Twitter Cards de n’importe quelle URL, avec un système complet de scoring d’audit SEO.
SEO
>99% de réussite
TypeScriptCrawlee
Mondial
catégorieutility / SEO
langageTypeScript
stackTypeScript, Crawlee
marchésMondial
réussite>99%
sortieJSON propre, prêt pour le RAG
fonctionnalités clés
Extraction de données structurées — JSON-LD, Microdata et RDFa
Balises meta sociales — Open Graph, Twitter Cards, Dublin Core
Analyse SEO avec scoring de 0 à 100
Validation des URL canoniques et des hreflang
Extraction de l’auteur pour les signaux EEAT
Détection LocalBusiness avec plus de 80 sous-types
Audit des textes alternatifs d’image
Validation du schema breadcrumb
Extraction des balises géo et des données NAP
cas d’usage
- Audit SEO technique à grande échelle
- Validation des données structurées pour les sites web
- Analyse SEO concurrentielle — comparez le schema markup entre concurrents
- Évaluation des signaux EEAT pour les sites de contenu
- Audit SEO local pour les entreprises
- Validation de checklist SEO avant lancement
paramètres d’entrée
| Paramètre | Type | Requis | Description |
|---|---|---|---|
startUrls | array | requis | URLs à analyser |
proxy | object | optionnel | Configuration du proxy |
maxRequestsPerCrawl | number | optionnel | Limite le nombre total d’URLs à auditer |
maxConcurrency | number | optionnel | Requêtes en parallèle |
extractMetaTags | boolean | optionnel | Extrait les balises meta (par défaut : true) |
extractSeoAnalysis | boolean | optionnel | Exécute l’analyse SEO (par défaut : true) |
computeSeoScore | boolean | optionnel | Calcule le score SEO de 0 à 100 (par défaut : true) |
extractGeoData | boolean | optionnel | Extrait les balises géo et les données NAP |
Exemple de sortie
1{
2 "url": "https://example.com/product/...",
3 "title": "Example Product Page",
4 "linkedData": [
5 { "@type": "Product", "name": "..." }
6 ],
7 "openGraph": {
8 "og:title": "Example Product",
9 "og:type": "product"
10 },
11 "twitterCard": {
12 "card": "summary_large_image"
13 },
14 "seoAudit": {
15 "score": 78,
16 "issues": [
17 "Missing alt text on 3 images",
18 "No hreflang tags detected"
19 ]
20 },
21 "headings": {
22 "h1": ["Example Product"],
23 "h2": ["Description", "Reviews"]
24 }
25}
faq
Quels formats de données structurées sont supportés ?
JSON-LD, Microdata et RDFa. Le scraper extrait également les métadonnées Open Graph, Twitter Cards et Dublin Core.
Comment le score SEO est-il calculé ?
Le score de 0 à 100 évalue les balises title, les meta descriptions, la hiérarchie des titres, les textes alternatifs d’image, les URL canoniques, le viewport mobile, la présence de données structurées, et plus encore.
Puis-je auditer plusieurs pages à la fois ?
Oui, fournissez plusieurs URLs dans startUrls. Le scraper les traite en parallèle pour un audit en masse rapide.
similaires dans ~/utility
tests
Global API Load Tester — Test de charge 10K+ RPS
Simulez 10K+ RPS avec des tests de charge géodistribués.
ouvrirmédias
Universal Web Printer — URL et HTML vers PDF, image
Convertissez URLs et HTML en PDF, PNG, JPEG ou WebP.
ouvrir