~/utility/schema-markup-scraper

Scraper de Schema Markup y auditor SEO

Extrae JSON-LD, Microdata, RDFa, Open Graph y Twitter Cards de cualquier URL, con un sistema de puntuación de auditoría SEO integral.

SEO >99% de éxito TypeScriptCrawlee Global
proooxy/schema-markup-scraper — spec
categoríautility / SEO
lenguajeTypeScript
stackTypeScript, Crawlee
mercadosGlobal
éxito>99%
salidaJSON limpio y listo para RAG

características clave

Extracción de datos estructurados — JSON-LD, Microdata y RDFa

Metaetiquetas sociales — Open Graph, Twitter Cards, Dublin Core

Análisis SEO con puntuación de 0 a 100

Validación de URL canónica y hreflang

Extracción de autor para señales EEAT

Detección de LocalBusiness con más de 80 subtipos

Auditoría de texto alternativo de imágenes

Validación de schema de breadcrumbs

Extracción de etiquetas geo y NAP

casos de uso

  • Auditoría técnica de SEO a gran escala
  • Validación de datos estructurados para sitios web
  • Análisis SEO competitivo — compara el schema markup entre competidores
  • Evaluación de señales EEAT para sitios de contenido
  • Auditoría de SEO local para negocios
  • Validación de checklist SEO previo al lanzamiento

parámetros de entrada

ParámetroTipoObligatorioDescripción
startUrlsarrayobligatorioURLs a analizar
proxyobjectopcionalConfiguración de proxy
maxRequestsPerCrawlnumberopcionalLimita el total de URLs a auditar
maxConcurrencynumberopcionalSolicitudes en paralelo
extractMetaTagsbooleanopcionalExtrae metaetiquetas (por defecto: true)
extractSeoAnalysisbooleanopcionalEjecuta el análisis SEO (por defecto: true)
computeSeoScorebooleanopcionalCalcula la puntuación SEO de 0 a 100 (por defecto: true)
extractGeoDatabooleanopcionalExtrae etiquetas geo y datos NAP

Ejemplo de salida

 1{
 2  "url": "https://example.com/product/...",
 3  "title": "Example Product Page",
 4  "linkedData": [
 5    { "@type": "Product", "name": "..." }
 6  ],
 7  "openGraph": {
 8    "og:title": "Example Product",
 9    "og:type": "product"
10  },
11  "twitterCard": {
12    "card": "summary_large_image"
13  },
14  "seoAudit": {
15    "score": 78,
16    "issues": [
17      "Missing alt text on 3 images",
18      "No hreflang tags detected"
19    ]
20  },
21  "headings": {
22    "h1": ["Example Product"],
23    "h2": ["Description", "Reviews"]
24  }
25}

faq

¿Qué formatos de datos estructurados son compatibles?
JSON-LD, Microdata y RDFa. El scraper también extrae metadatos de Open Graph, Twitter Cards y Dublin Core.
¿Cómo se calcula la puntuación SEO?
La puntuación de 0 a 100 evalúa las etiquetas title, las meta descriptions, la jerarquía de encabezados, el texto alternativo de imágenes, las URLs canónicas, el viewport móvil, la presencia de datos estructurados y más.
¿Puedo auditar varias páginas a la vez?
Sí, proporciona varias URLs en startUrls. El scraper las procesa en paralelo para una auditoría masiva rápida.

relacionado en ~/utility

Ejecuta Scraper de Schema Markup y auditor SEO, o consigue un desarrollo a medida

Empieza a extraer datos en Apify en minutos, o contrátame para construir un scraper a medida y un pipeline de datos RAG para tu fuente y esquema exactos.

ejecutar en Apify obtener datos a medida