~/utility/web-printer

Universal Web Printer — URL & HTML zu PDF, Bild

Jede URL oder jedes HTML in PDF, PNG, JPEG oder WebP umwandeln — mit intelligentem Scroll-Stitching, Element-Extraktion, PDF-Verschlüsselung und Wasserzeichen.

Medien >99% Erfolgsquote TypeScriptPlaywrightPDF-libSharp Weltweit
proooxy/web-printer — Steckbrief
Kategorieutility / Medien
SpracheTypeScript
StackTypeScript, Playwright, PDF-lib, Sharp
MärkteWeltweit
Erfolgsquote>99%
Outputsauberes, RAG-fertiges JSON

Hauptfunktionen

Multi-Format-Output — PDF, PNG, JPEG, WebP

Mehrere Ansichtsmodi — Viewport, Full-Page, CSS-Selektor, Readability

Intelligentes Scroll-Stitching für präzise Full-Page-Aufnahmen

Extraktion auf Element-Ebene über CSS-Selektoren

Seitenmanipulation — Elemente entfernen, Buttons klicken, CSS injizieren, fixierte Header ausblenden

PDF-Verschlüsselung (RC4 128-Bit) und Wasserzeichen

PDF-Merging für mehrseitige Dokumente

Konfigurierbarer Viewport und Skalierungsfaktor

Anwendungsfälle

  • Automatisierte Report-Generierung aus Web-Dashboards
  • Website-Archivierung und -Dokumentation
  • Snapshots für visuelle Regressionstests
  • Screenshots von E-Commerce-Produktseiten für Kataloge
  • Rechtliche Compliance — Web-Inhalte als Beweismittel festhalten
  • Generierung von PDFs aus Webanwendungen

Eingabeparameter

ParameterTypErforderlichBeschreibung
startUrlsarrayoptionalZu rendernde URLs
htmlContentstringoptionalRohes HTML zum Rendern
outputFormatstringoptionalpdf, png, jpeg oder webp (Standard: pdf)
viewModestringoptionalviewport, fullPage, selector oder readability
targetSelectorstringoptionalCSS-Selektor für die Aufnahme auf Element-Ebene
viewportWidthnumberoptionalViewport-Breite des Browsers (Standard: 1280)
viewportHeightnumberoptionalViewport-Höhe des Browsers (Standard: 720)
removeSelectorsarrayoptionalCSS-Selektoren von Elementen, die vor der Aufnahme entfernt werden
pdfPasswordstringoptionalPDF mit RC4-128-Bit-Verschlüsselung verschlüsseln

Beispiel-Output

Das Tool erzeugt Dateien im gewählten Format (PDF, PNG, JPEG oder WebP) und speichert sie im Apify-Dataset. Jeder Output enthält Metadaten:

1{
2  "url": "https://example.com",
3  "format": "pdf",
4  "fileName": "example-com.pdf",
5  "fileSize": 245832,
6  "viewMode": "fullPage",
7  "viewport": { "width": 1280, "height": 720 },
8  "encrypted": false
9}

FAQ

Kann ich nur ein bestimmtes Element der Seite erfassen?
Ja, den Parameter targetSelector mit einem CSS-Selektor nutzen, um nur ein bestimmtes Element zu erfassen. Zum Beispiel „#main-content” verwenden, um nur den Hauptinhaltsbereich zu erfassen.
Wie funktioniert intelligentes Scroll-Stitching?
Bei Full-Page-Aufnahmen scrollt das Tool die Seite in Schritten, erfasst jede Viewport-Scheibe und fügt sie anschließend zusammen. So werden lazy-geladene Inhalte und Animationen korrekt erfasst.
Kann ich Cookie-Banner oder Werbung vor der Aufnahme entfernen?
Ja, removeSelectors nutzen, um CSS-Selektoren der zu entfernenden Elemente anzugeben. Zusätzlich lässt sich hideFixedElements nutzen, um sticky Header und schwebende Elemente auszublenden.

verwandt in ~/utility

Universal Web Printer — URL & HTML zu PDF, Bild ausführen oder ein individuelles Projekt anfragen

In wenigen Minuten mit der Extraktion auf Apify starten, oder mich für einen maßgeschneiderten Scraper und eine RAG-Pipeline exakt nach Quelle und Schema beauftragen.

auf Apify ausführen individuelle Daten anfragen