~/utility/web-printer

Universal Web Printer — URL и HTML в PDF и изображения

Конвертируйте любой URL или HTML в PDF, PNG, JPEG или WebP с умной склейкой скролла, извлечением элементов, шифрованием PDF и водяными знаками.

медиа >99% успешность TypeScriptPlaywrightPDF-libSharp Глобально
proooxy/web-printer — характеристики
категорияutility / медиа
языкTypeScript
стекTypeScript, Playwright, PDF-lib, Sharp
рынкиГлобально
успешность>99%
выводчистый JSON, готовый к RAG

ключевые возможности

Вывод в нескольких форматах — PDF, PNG, JPEG, WebP

Несколько режимов просмотра — viewport, full-page, CSS-селектор, readability

Умная склейка скролла для точных full-page снимков

Извлечение на уровне элементов через CSS-селекторы

Манипуляции со страницей — удаление элементов, клики по кнопкам, инъекция CSS, скрытие фиксированных шапок

Шифрование PDF (RC4 128-бит) и водяные знаки

Объединение PDF для многостраничных документов

Настраиваемый viewport и коэффициент масштабирования

сценарии использования

  • Автоматическая генерация отчетов из веб-дашбордов
  • Архивирование и документирование сайтов
  • Снимки для визуального регрессионного тестирования
  • Скриншоты страниц товаров e-commerce для каталогов
  • Юридический комплаенс — фиксация веб-контента в качестве доказательств
  • Генерация PDF из веб-приложений

входные параметры

ПараметрТипОбязательныйОписание
startUrlsarrayопциональноURL для рендеринга
htmlContentstringопциональноСырой HTML для рендеринга
outputFormatstringопциональноpdf, png, jpeg или webp (по умолчанию: pdf)
viewModestringопциональноviewport, fullPage, selector или readability
targetSelectorstringопциональноCSS-селектор для захвата на уровне элемента
viewportWidthnumberопциональноШирина viewport браузера (по умолчанию: 1280)
viewportHeightnumberопциональноВысота viewport браузера (по умолчанию: 720)
removeSelectorsarrayопциональноCSS-селекторы элементов для удаления перед захватом
pdfPasswordstringопциональноШифровать PDF с использованием RC4 128-бит

Пример вывода

Инструмент генерирует файлы в выбранном вами формате (PDF, PNG, JPEG или WebP) и сохраняет их в датасете Apify. Каждый результат включает метаданные:

1{
2  "url": "https://example.com",
3  "format": "pdf",
4  "fileName": "example-com.pdf",
5  "fileSize": 245832,
6  "viewMode": "fullPage",
7  "viewport": { "width": 1280, "height": 720 },
8  "encrypted": false
9}

частые вопросы

Можно ли захватить только конкретный элемент на странице?
Да, используйте параметр targetSelector с CSS-селектором, чтобы захватить только конкретный элемент. Например, используйте '#main-content', чтобы захватить только основную область контента.
Как работает умная склейка скролла?
Для full-page захватов инструмент прокручивает страницу по шагам, снимая каждый срез viewport, а затем склеивает их вместе. Это гарантирует корректный захват контента с ленивой загрузкой и анимаций.
Можно ли убрать баннеры cookie или рекламу перед захватом?
Да, используйте removeSelectors, чтобы указать CSS-селекторы элементов для удаления. Также можно использовать hideFixedElements, чтобы скрыть липкие шапки и плавающие элементы.

похожие в ~/utility

Запустите Universal Web Printer — URL и HTML в PDF и изображения или закажите разработку под задачу

Начните извлекать данные на Apify за считаные минуты или закажите у меня разработку парсера на заказ и RAG-конвейера под ваш источник и схему.

запустить на Apify заказать данные