~/utility/schema-markup-scraper

Schema Markup Scraper e Auditor de SEO

Extraia JSON-LD, Microdata, RDFa, Open Graph e Twitter Cards de qualquer URL, com um sistema abrangente de pontuação de auditoria de SEO.

seo >99% de sucesso TypeScriptCrawlee Global
proooxy/schema-markup-scraper — especificações
categoriautility / seo
linguagemTypeScript
stackTypeScript, Crawlee
mercadosGlobal
sucesso>99%
saídaJSON limpo e pronto para RAG

principais recursos

Extração de dados estruturados — JSON-LD, Microdata e RDFa

Meta tags sociais — Open Graph, Twitter Cards, Dublin Core

Análise de SEO com pontuação de 0 a 100

Validação de URL canônica e hreflang

Extração de autor para sinais de EEAT

Detecção de LocalBusiness com mais de 80 subtipos

Auditoria de texto alternativo (alt text) de imagens

Validação de schema de breadcrumb

Extração de geo tags e NAP

casos de uso

  • Auditoria técnica de SEO em escala
  • Validação de dados estruturados para sites
  • Análise competitiva de SEO — comparar schema markup entre concorrentes
  • Avaliação de sinais de EEAT para sites de conteúdo
  • Auditoria de SEO local para empresas
  • Validação de checklist de SEO pré-lançamento

parâmetros de entrada

ParâmetroTipoObrigatórioDescrição
startUrlsarrayobrigatórioURLs a analisar
proxyobjectopcionalConfiguração de proxy
maxRequestsPerCrawlnumberopcionalLimita o total de URLs a auditar
maxConcurrencynumberopcionalRequisições paralelas
extractMetaTagsbooleanopcionalExtrai meta tags (padrão: true)
extractSeoAnalysisbooleanopcionalExecuta análise de SEO (padrão: true)
computeSeoScorebooleanopcionalCalcula pontuação de SEO de 0 a 100 (padrão: true)
extractGeoDatabooleanopcionalExtrai geo tags e dados NAP

Exemplo de Saída

 1{
 2  "url": "https://example.com/product/...",
 3  "title": "Example Product Page",
 4  "linkedData": [
 5    { "@type": "Product", "name": "..." }
 6  ],
 7  "openGraph": {
 8    "og:title": "Example Product",
 9    "og:type": "product"
10  },
11  "twitterCard": {
12    "card": "summary_large_image"
13  },
14  "seoAudit": {
15    "score": 78,
16    "issues": [
17      "Missing alt text on 3 images",
18      "No hreflang tags detected"
19    ]
20  },
21  "headings": {
22    "h1": ["Example Product"],
23    "h2": ["Description", "Reviews"]
24  }
25}

faq

Quais formatos de dados estruturados são suportados?
JSON-LD, Microdata e RDFa. O scraper também extrai metadados de Open Graph, Twitter Cards e Dublin Core.
Como a pontuação de SEO é calculada?
A pontuação de 0 a 100 avalia title tags, meta descriptions, hierarquia de headings, alt text de imagens, URLs canônicas, viewport mobile, presença de dados estruturados e mais.
Posso auditar várias páginas de uma vez?
Sim, forneça várias URLs em startUrls. O scraper as processa em paralelo para uma auditoria em massa rápida.

relacionados em ~/utility

Execute Schema Markup Scraper e Auditor de SEO ou solicite um projeto personalizado

Comece a extrair dados no Apify em minutos, ou me contrate para desenvolver um scraper sob medida e um pipeline de RAG para sua fonte e esquema exatos.

executar no Apify obter dados personalizados