~/utility/schema-markup-scraper
Schema Markup Scraper e Auditor de SEO
Extraia JSON-LD, Microdata, RDFa, Open Graph e Twitter Cards de qualquer URL, com um sistema abrangente de pontuação de auditoria de SEO.
seo
TypeScriptCrawlee
Global
categoriautility / seo
linguagemTypeScript
stackTypeScript, Crawlee
mercadosGlobal
saídaJSON limpo e pronto para RAG
principais recursos
Extração de dados estruturados — JSON-LD, Microdata e RDFa
Meta tags sociais — Open Graph, Twitter Cards, Dublin Core
Análise de SEO com pontuação de 0 a 100
Validação de URL canônica e hreflang
Extração de autor para sinais de EEAT
Detecção de LocalBusiness com mais de 80 subtipos
Auditoria de texto alternativo (alt text) de imagens
Validação de schema de breadcrumb
Extração de geo tags e NAP
casos de uso
- Auditoria técnica de SEO em escala
- Validação de dados estruturados para sites
- Análise competitiva de SEO — comparar schema markup entre concorrentes
- Avaliação de sinais de EEAT para sites de conteúdo
- Auditoria de SEO local para empresas
- Validação de checklist de SEO pré-lançamento
parâmetros de entrada
| Parâmetro | Tipo | Obrigatório | Descrição |
|---|---|---|---|
startUrls | array | obrigatório | URLs a analisar |
proxy | object | opcional | Configuração de proxy |
maxRequestsPerCrawl | number | opcional | Limita o total de URLs a auditar |
maxConcurrency | number | opcional | Requisições paralelas |
extractMetaTags | boolean | opcional | Extrai meta tags (padrão: true) |
extractSeoAnalysis | boolean | opcional | Executa análise de SEO (padrão: true) |
computeSeoScore | boolean | opcional | Calcula pontuação de SEO de 0 a 100 (padrão: true) |
extractGeoData | boolean | opcional | Extrai geo tags e dados NAP |
Exemplo de Saída
1{
2 "url": "https://developers.google.com/search/docs/appearance/structured-data/product",
3 "title": "Intro to Product Structured Data on Google | Google Search Central",
4 "linkedData": [
5 {
6 "@context": "https://schema.org",
7 "@type": "BreadcrumbList",
8 "itemListElement": [
9 { "@type": "ListItem", "position": 1, "name": "Search Central", "item": "https://developers.google.com/search" }
10 ]
11 }
12 ],
13 "openGraph": {
14 "site_name": "Google for Developers",
15 "type": "website"
16 },
17 "twitterCard": {
18 "card": "summary_large_image",
19 "has_large_image": "true"
20 },
21 "seoAudit": {
22 "score": 95,
23 "issues": [
24 { "severity": "warning", "code": "TITLE_TOO_LONG", "message": "Title is 122 chars (recommended: max 60)" }
25 ]
26 },
27 "headings": {
28 "headings": [
29 { "level": 1, "text": "Introduction to Product structured data" },
30 { "level": 2, "text": "Deciding which markup to use" }
31 ],
32 "h1Count": 1,
33 "issues": []
34 }
35}
faq
Quais formatos de dados estruturados são suportados?
JSON-LD, Microdata e RDFa. O scraper também extrai metadados de Open Graph, Twitter Cards e Dublin Core.
Como a pontuação de SEO é calculada?
A pontuação de 0 a 100 avalia title tags, meta descriptions, hierarquia de headings, alt text de imagens, URLs canônicas, viewport mobile, presença de dados estruturados e mais.
Posso auditar várias páginas de uma vez?
Sim, forneça várias URLs em startUrls. O scraper as processa em paralelo para uma auditoria em massa rápida.
relacionados em ~/utility
mídia
Universal Web Printer — URL e HTML para PDF, Imagem
Converta URLs e HTML em PDF, PNG, JPEG ou WebP.
abrir