~/utility/schema-markup-scraper
Scraper de Schema Markup y auditor SEO
Extrae JSON-LD, Microdata, RDFa, Open Graph y Twitter Cards de cualquier URL, con un sistema de puntuación de auditoría SEO integral.
SEO
>99% de éxito
TypeScriptCrawlee
Global
categoríautility / SEO
lenguajeTypeScript
stackTypeScript, Crawlee
mercadosGlobal
éxito>99%
salidaJSON limpio y listo para RAG
características clave
Extracción de datos estructurados — JSON-LD, Microdata y RDFa
Metaetiquetas sociales — Open Graph, Twitter Cards, Dublin Core
Análisis SEO con puntuación de 0 a 100
Validación de URL canónica y hreflang
Extracción de autor para señales EEAT
Detección de LocalBusiness con más de 80 subtipos
Auditoría de texto alternativo de imágenes
Validación de schema de breadcrumbs
Extracción de etiquetas geo y NAP
casos de uso
- Auditoría técnica de SEO a gran escala
- Validación de datos estructurados para sitios web
- Análisis SEO competitivo — compara el schema markup entre competidores
- Evaluación de señales EEAT para sitios de contenido
- Auditoría de SEO local para negocios
- Validación de checklist SEO previo al lanzamiento
parámetros de entrada
| Parámetro | Tipo | Obligatorio | Descripción |
|---|---|---|---|
startUrls | array | obligatorio | URLs a analizar |
proxy | object | opcional | Configuración de proxy |
maxRequestsPerCrawl | number | opcional | Limita el total de URLs a auditar |
maxConcurrency | number | opcional | Solicitudes en paralelo |
extractMetaTags | boolean | opcional | Extrae metaetiquetas (por defecto: true) |
extractSeoAnalysis | boolean | opcional | Ejecuta el análisis SEO (por defecto: true) |
computeSeoScore | boolean | opcional | Calcula la puntuación SEO de 0 a 100 (por defecto: true) |
extractGeoData | boolean | opcional | Extrae etiquetas geo y datos NAP |
Ejemplo de salida
1{
2 "url": "https://example.com/product/...",
3 "title": "Example Product Page",
4 "linkedData": [
5 { "@type": "Product", "name": "..." }
6 ],
7 "openGraph": {
8 "og:title": "Example Product",
9 "og:type": "product"
10 },
11 "twitterCard": {
12 "card": "summary_large_image"
13 },
14 "seoAudit": {
15 "score": 78,
16 "issues": [
17 "Missing alt text on 3 images",
18 "No hreflang tags detected"
19 ]
20 },
21 "headings": {
22 "h1": ["Example Product"],
23 "h2": ["Description", "Reviews"]
24 }
25}
faq
¿Qué formatos de datos estructurados son compatibles?
JSON-LD, Microdata y RDFa. El scraper también extrae metadatos de Open Graph, Twitter Cards y Dublin Core.
¿Cómo se calcula la puntuación SEO?
La puntuación de 0 a 100 evalúa las etiquetas title, las meta descriptions, la jerarquía de encabezados, el texto alternativo de imágenes, las URLs canónicas, el viewport móvil, la presencia de datos estructurados y más.
¿Puedo auditar varias páginas a la vez?
Sí, proporciona varias URLs en startUrls. El scraper las procesa en paralelo para una auditoría masiva rápida.
relacionado en ~/utility
pruebas
Global API Load Tester — Prueba de estrés de 10K+ RPS
Simula más de 10K RPS con pruebas de carga geodistribuidas.
abrirmedios
Universal Web Printer — URL y HTML a PDF, imagen
Convierte URLs y HTML a PDF, PNG, JPEG o WebP.
abrir