~/utility/schema-markup-scraper

Schema Markup Scraper & SEO Auditor

Извлекайте JSON-LD, Microdata, RDFa, Open Graph и Twitter Cards с любого URL с комплексной системой SEO-аудита и скорингом.

SEO >99% успешность TypeScriptCrawlee Глобально
proooxy/schema-markup-scraper — характеристики
категорияutility / SEO
языкTypeScript
стекTypeScript, Crawlee
рынкиГлобально
успешность>99%
выводчистый JSON, готовый к RAG

ключевые возможности

Извлечение структурированных данных — JSON-LD, Microdata и RDFa

Социальные мета-теги — Open Graph, Twitter Cards, Dublin Core

SEO-анализ со скорингом от 0 до 100

Валидация канонического URL и hreflang

Извлечение автора для сигналов EEAT

Определение LocalBusiness с 80+ подтипами

Аудит alt-текста изображений

Валидация схемы хлебных крошек (Breadcrumb)

Извлечение гео-тегов и данных NAP

сценарии использования

  • Технический SEO-аудит в промышленном масштабе
  • Валидация структурированных данных сайтов
  • Конкурентный SEO-анализ — сравнение schema-разметки конкурентов
  • Оценка сигналов EEAT для контентных сайтов
  • Аудит локального SEO для бизнеса
  • Проверка SEO-чеклиста перед запуском

входные параметры

ПараметрТипОбязательныйОписание
startUrlsarrayобязательноURL для анализа
proxyobjectопциональноКонфигурация прокси
maxRequestsPerCrawlnumberопциональноОграничение общего числа URL для аудита
maxConcurrencynumberопциональноПараллельные запросы
extractMetaTagsbooleanопциональноИзвлекать мета-теги (по умолчанию: true)
extractSeoAnalysisbooleanопциональноВыполнять SEO-анализ (по умолчанию: true)
computeSeoScorebooleanопциональноРассчитывать SEO-скор от 0 до 100 (по умолчанию: true)
extractGeoDatabooleanопциональноИзвлекать гео-теги и данные NAP

Пример вывода

 1{
 2  "url": "https://example.com/product/...",
 3  "title": "Example Product Page",
 4  "linkedData": [
 5    { "@type": "Product", "name": "..." }
 6  ],
 7  "openGraph": {
 8    "og:title": "Example Product",
 9    "og:type": "product"
10  },
11  "twitterCard": {
12    "card": "summary_large_image"
13  },
14  "seoAudit": {
15    "score": 78,
16    "issues": [
17      "Missing alt text on 3 images",
18      "No hreflang tags detected"
19    ]
20  },
21  "headings": {
22    "h1": ["Example Product"],
23    "h2": ["Description", "Reviews"]
24  }
25}

частые вопросы

Какие форматы структурированных данных поддерживаются?
JSON-LD, Microdata и RDFa. Парсер также извлекает метаданные Open Graph, Twitter Cards и Dublin Core.
Как рассчитывается SEO-скор?
Скор от 0 до 100 оценивает теги title, meta-описания, иерархию заголовков, alt-текст изображений, канонические URL, мобильный viewport, наличие структурированных данных и другие факторы.
Можно ли аудировать несколько страниц одновременно?
Да, передайте несколько URL в startUrls. Парсер обрабатывает их параллельно для быстрого массового аудита.

похожие в ~/utility

Запустите Schema Markup Scraper & SEO Auditor или закажите разработку под задачу

Начните извлекать данные на Apify за считаные минуты или закажите у меня разработку парсера на заказ и RAG-конвейера под ваш источник и схему.

запустить на Apify заказать данные