~/about

Über mich

Richard Feng — Web-Scraping-Engineer mit über 12 Jahren Erfahrung. Ich verwandle geschützte Websites in saubere, RAG-fertige strukturierte Daten für KI-Agenten, Retrieval-Pipelines und LLMs.

Wer ich bin

Ich bin Richard Feng, freiberuflicher Web-Automatisierungs-Engineer mit über 12 Jahren Programmiererfahrung. Meine Spezialgebiete sind Web-Scraping, Datenextraktion und API-Reverse-Engineering — die Umwandlung komplexer, geschützter Websites in saubere, strukturierte Daten, die KI-Systeme tatsächlich nutzen können.

Mein Werkzeugkasten umfasst Node.js (TypeScript), Python, Go und Java, mit tiefgehender Expertise in Crawlee, Playwright und Cheerio. Ich habe produktionsreife Systeme gebaut, die Millionen von Anfragen bei >99% Erfolgsquote verarbeiten.

Was ich mache

Ich entwickle und betreue 16 produktionsreife Apify-Actors, die über 3.100 Nutzer bei konstant >99% Run-Erfolgsquote bedienen. Jeder Actor liefert sauberes, RAG-fertiges JSON — schemakonsistent, dedupliziert und bereit für den Einsatz in einer Vektordatenbank, Retrieval-Pipeline oder als Trainingsdatensatz. Die meisten Actors für öffentliche Daten benötigen keinen API-Key. Meine Arbeit erstreckt sich über vier Bereiche:

E-Commerce & Einzelhandelsdaten

Scraper für führende Beauty- und Fashion-Plattformen, darunter Sephora (21 globale Storefronts), Ulta Beauty, Farfetch, Lululemon, Boohoo, Macy’s sowie ein universeller Shopify Scraper, der mit jedem Shopify-Shop funktioniert.

Öffentliche, Finanz- und Rechtsdaten

Offizielle US-Datensätze als sauberes, RAG-fertiges JSON — SEC-EDGAR-Filings & XBRL-Finanzdaten, USAspending.gov-Bundesvergaben, CourtListener-Gerichtsentscheidungen und ClinicalTrials.gov-Studien.

Social-Media-Intelligence

Bluesky-Beiträge, -Profile und -Interaktionen über das AT Protocol, dazu ein YouTube-Untertitel- & Transkript-Scraper, der JSON, SRT, VTT oder LLM-fertigen Text in über 100 Sprachen ausgibt.

Entwickler-Tools

Tools jenseits des Scrapings — SEO-Audits & strukturierte Daten, Web-to-PDF/Bild-Rendering und Hochleistungs-Lasttests.

Spezialgebiete

  • Reverse Engineering privater APIs — die Umwandlung undokumentierter Mobile-/Web-Endpunkte in zuverlässige Datenquellen
  • Anti-Bot-Bypass — Cloudflare, DataDome, Akamai WAF und individuelle Schutzmechanismen
  • RAG-fertiger Output — normalisiertes, schemakonsistentes JSON für Retrieval und Grounding
  • Multi-Region-Scraping — Locales, Währungen und Compliance inklusive
  • Hochzuverlässige Systeme — Extraktoren, die auch im großen Maßstab >99% Erfolgsquote halten

Tech-Stack

KategorieTechnologien
SprachenTypeScript, Python, Go, Java
ScrapingCrawlee, Playwright, Cheerio, Parsel, got-scraping
Anti-BotFingerprint generators, TLS fingerprinting, session rotation
InfrastrukturApify Platform, Docker, GitHub Actions
TestingVegeta, custom load-testing frameworks

Zusammenarbeit

Ich biete maßgeschneiderte Scraping-Lösungen, RAG-Datenpipeline-Engineering und laufende Datenextraktions-Services. Wenn eine KI das echte Web als saubere Daten braucht — jetzt Kontakt aufnehmen.