~/utility/schema-markup-scraper
Schema Markup Scraper & SEO-Auditor
JSON-LD, Microdata, RDFa, Open Graph und Twitter Cards von jeder URL extrahieren — mit einem umfassenden SEO-Audit-Scoring-System.
SEO
TypeScriptCrawlee
Weltweit
Kategorieutility / SEO
SpracheTypeScript
StackTypeScript, Crawlee
MärkteWeltweit
Outputsauberes, RAG-fertiges JSON
Hauptfunktionen
Extraktion strukturierter Daten — JSON-LD, Microdata und RDFa
Social-Meta-Tags — Open Graph, Twitter Cards, Dublin Core
SEO-Analyse mit Scoring von 0–100
Validierung von kanonischer URL und hreflang
Autoren-Extraktion für EEAT-Signale
LocalBusiness-Erkennung mit über 80 Subtypen
Audit von Bild-Alt-Texten
Validierung von Breadcrumb-Schema
Extraktion von Geo-Tags und NAP-Daten
Anwendungsfälle
- Technisches SEO-Auditing im großen Maßstab
- Validierung strukturierter Daten für Websites
- Wettbewerbs-SEO-Analyse — Schema Markup über Wettbewerber hinweg vergleichen
- Bewertung von EEAT-Signalen für Content-Websites
- Local-SEO-Auditing für Unternehmen
- SEO-Checklisten-Validierung vor dem Launch
Eingabeparameter
| Parameter | Typ | Erforderlich | Beschreibung |
|---|---|---|---|
startUrls | array | erforderlich | Zu analysierende URLs |
proxy | object | optional | Proxy-Konfiguration |
maxRequestsPerCrawl | number | optional | Limit für die Gesamtzahl zu auditierender URLs |
maxConcurrency | number | optional | Parallele Anfragen |
extractMetaTags | boolean | optional | Meta-Tags extrahieren (Standard: true) |
extractSeoAnalysis | boolean | optional | SEO-Analyse durchführen (Standard: true) |
computeSeoScore | boolean | optional | SEO-Score von 0–100 berechnen (Standard: true) |
extractGeoData | boolean | optional | Geo-Tags und NAP-Daten extrahieren |
Beispiel-Output
1{
2 "url": "https://developers.google.com/search/docs/appearance/structured-data/product",
3 "title": "Intro to Product Structured Data on Google | Google Search Central",
4 "linkedData": [
5 {
6 "@context": "https://schema.org",
7 "@type": "BreadcrumbList",
8 "itemListElement": [
9 { "@type": "ListItem", "position": 1, "name": "Search Central", "item": "https://developers.google.com/search" }
10 ]
11 }
12 ],
13 "openGraph": {
14 "site_name": "Google for Developers",
15 "type": "website"
16 },
17 "twitterCard": {
18 "card": "summary_large_image",
19 "has_large_image": "true"
20 },
21 "seoAudit": {
22 "score": 95,
23 "issues": [
24 { "severity": "warning", "code": "TITLE_TOO_LONG", "message": "Title is 122 chars (recommended: max 60)" }
25 ]
26 },
27 "headings": {
28 "headings": [
29 { "level": 1, "text": "Introduction to Product structured data" },
30 { "level": 2, "text": "Deciding which markup to use" }
31 ],
32 "h1Count": 1,
33 "issues": []
34 }
35}
FAQ
Welche Formate für strukturierte Daten werden unterstützt?
JSON-LD, Microdata und RDFa. Der Scraper extrahiert außerdem Open-Graph-, Twitter-Cards- und Dublin-Core-Metadaten.
Wie wird der SEO-Score berechnet?
Der Score von 0–100 bewertet Title-Tags, Meta-Descriptions, Überschriftenhierarchie, Bild-Alt-Texte, kanonische URLs, Mobile-Viewport, das Vorhandensein strukturierter Daten und mehr.
Kann ich mehrere Seiten gleichzeitig auditieren?
Ja, mehrere URLs in startUrls angeben. Der Scraper verarbeitet sie parallel für schnelles Bulk-Auditing.
verwandt in ~/utility
Medien
Universal Web Printer — URL & HTML zu PDF, Bild
URLs und HTML in PDF, PNG, JPEG oder WebP umwandeln.
öffnen