~/utility/web-printer

Universal Web Printer — URL e HTML para PDF, Imagem

Converta qualquer URL ou HTML em PDF, PNG, JPEG ou WebP, com scroll-stitch inteligente, extração de elementos, criptografia de PDF e marca d'água.

mídia >99% de sucesso TypeScriptPlaywrightPDF-libSharp Global
proooxy/web-printer — especificações
categoriautility / mídia
linguagemTypeScript
stackTypeScript, Playwright, PDF-lib, Sharp
mercadosGlobal
sucesso>99%
saídaJSON limpo e pronto para RAG

principais recursos

Saída multi-formato — PDF, PNG, JPEG, WebP

Múltiplos modos de visualização — viewport, página inteira, seletor CSS, readability

Scroll-stitch inteligente para capturas precisas de página inteira

Extração em nível de elemento via seletores CSS

Manipulação de página — remover elementos, clicar em botões, injetar CSS, ocultar cabeçalhos fixos

Criptografia de PDF (RC4 128-bit) e marca d'água

Mesclagem de PDF para documentos multi-página

Configuração personalizada de viewport e fator de escala

casos de uso

  • Geração automatizada de relatórios a partir de dashboards web
  • Arquivamento e documentação de sites
  • Snapshots para testes de regressão visual
  • Screenshots de páginas de produto de e-commerce para catálogos
  • Conformidade legal — capturar conteúdo web como evidência
  • Geração de PDFs a partir de aplicações web

parâmetros de entrada

ParâmetroTipoObrigatórioDescrição
startUrlsarrayopcionalURLs a renderizar
htmlContentstringopcionalHTML bruto a renderizar
outputFormatstringopcionalpdf, png, jpeg ou webp (padrão: pdf)
viewModestringopcionalviewport, fullPage, selector ou readability
targetSelectorstringopcionalSeletor CSS para captura em nível de elemento
viewportWidthnumberopcionalLargura do viewport do navegador (padrão: 1280)
viewportHeightnumberopcionalAltura do viewport do navegador (padrão: 720)
removeSelectorsarrayopcionalSeletores CSS de elementos a remover antes da captura
pdfPasswordstringopcionalCriptografa o PDF com criptografia RC4 128-bit

Exemplo de Saída

A ferramenta gera arquivos no formato escolhido (PDF, PNG, JPEG ou WebP) e os armazena no dataset do Apify. Cada saída inclui metadados:

1{
2  "url": "https://example.com",
3  "format": "pdf",
4  "fileName": "example-com.pdf",
5  "fileSize": 245832,
6  "viewMode": "fullPage",
7  "viewport": { "width": 1280, "height": 720 },
8  "encrypted": false
9}

faq

Posso capturar só um elemento específico da página?
Sim, use o parâmetro targetSelector com um seletor CSS para capturar apenas um elemento específico. Por exemplo, use '#main-content' para capturar somente a área de conteúdo principal.
Como funciona o scroll-stitch inteligente?
Para capturas de página inteira, a ferramenta rola a página em incrementos, capturando cada fatia do viewport, e depois as costura (stitch) juntas. Isso garante que conteúdo com lazy-loading e animações sejam capturados corretamente.
Posso remover banners de cookies ou anúncios antes da captura?
Sim, use removeSelectors para especificar seletores CSS de elementos a remover. Você também pode usar hideFixedElements para ocultar cabeçalhos fixos (sticky) e elementos flutuantes.

relacionados em ~/utility

Execute Universal Web Printer — URL e HTML para PDF, Imagem ou solicite um projeto personalizado

Comece a extrair dados no Apify em minutos, ou me contrate para desenvolver um scraper sob medida e um pipeline de RAG para sua fonte e esquema exatos.

executar no Apify obter dados personalizados