~/about

Tentang Saya

Richard Feng — web scraping engineer dengan pengalaman 12+ tahun. Saya mengubah situs web yang terproteksi menjadi data terstruktur yang bersih dan siap-RAG untuk agen AI, pipeline retrieval, dan LLM.

Siapa saya

Saya Richard Feng, seorang freelance web-automation engineer dengan pengalaman coding 12+ tahun. Saya berspesialisasi dalam web scraping, ekstraksi data, dan reverse engineering API — mengubah situs web yang kompleks dan terproteksi menjadi data terstruktur yang benar-benar bisa digunakan oleh sistem AI.

Toolkit saya mencakup Node.js (TypeScript), Python, Go, dan Java, dengan keahlian mendalam di Crawlee, Playwright, dan Cheerio. Saya telah membangun sistem produksi yang menangani jutaan request dengan tingkat keberhasilan >99%.

Apa yang saya kerjakan

Saya membangun dan memelihara 16 Apify Actor kelas produksi yang melayani lebih dari 3,100 pengguna dengan tingkat keberhasilan run >99% secara konsisten. Setiap actor menghasilkan JSON siap-RAG yang bersih — konsisten skemanya, terdeduplikasi, dan siap langsung dipakai di vector store, pipeline retrieval, atau training set. Sebagian besar actor data publik tidak memerlukan API key. Pekerjaan saya mencakup empat bidang:

Data e-commerce & ritel

Scraper untuk platform kecantikan dan fashion besar, termasuk Sephora (21 storefront global), Ulta Beauty, Farfetch, Lululemon, Boohoo, Macy’s, dan Shopify scraper universal yang bisa dipakai di toko Shopify mana pun.

Data publik, keuangan & hukum

Dataset resmi Amerika Serikat sebagai JSON bersih dan siap-RAG — laporan SEC EDGAR & data keuangan XBRL, dana federal dari USAspending.gov, putusan pengadilan dari CourtListener, dan studi dari ClinicalTrials.gov.

Intelijen sosial & media

Postingan, profil, dan interaksi Bluesky via AT Protocol, ditambah YouTube subtitle & transcript scraper yang menghasilkan output JSON, SRT, VTT, atau teks siap-LLM dalam 100+ bahasa.

Utilitas developer

Tools di luar scraping — audit SEO & structured data, rendering web-ke-PDF/gambar, dan load testing berperforma tinggi.

Spesialisasi

  • Reverse engineering private API — mengubah endpoint mobile/web yang tidak terdokumentasi menjadi sumber data yang andal
  • Bypass anti-bot — Cloudflare, DataDome, Akamai WAF, dan proteksi custom
  • Output siap-RAG — JSON yang dinormalisasi dan konsisten skemanya, dibangun untuk retrieval dan grounding
  • Scraping multi-region — locale, mata uang, dan kepatuhan (compliance) sudah ditangani
  • Sistem dengan reliabilitas tinggi — extractor yang mempertahankan tingkat keberhasilan >99% dalam skala besar

Tech stack

KategoriTeknologi
BahasaTypeScript, Python, Go, Java
ScrapingCrawlee, Playwright, Cheerio, Parsel, got-scraping
Anti-botFingerprint generator, TLS fingerprinting, rotasi sesi
InfrastrukturApify Platform, Docker, GitHub Actions
TestingVegeta, framework load-testing custom

Bekerja sama dengan saya

Saya menawarkan solusi scraping custom, rekayasa pipeline data RAG, dan layanan ekstraksi data berkelanjutan. Jika AI Anda membutuhkan web asli sebagai data yang bersih — mari bicara.