Tentang Saya
Richard Feng — web scraping engineer dengan pengalaman 12+ tahun. Saya mengubah situs web yang terproteksi menjadi data terstruktur yang bersih dan siap-RAG untuk agen AI, pipeline retrieval, dan LLM.
Siapa saya
Saya Richard Feng, seorang freelance web-automation engineer dengan pengalaman coding 12+ tahun. Saya berspesialisasi dalam web scraping, ekstraksi data, dan reverse engineering API — mengubah situs web yang kompleks dan terproteksi menjadi data terstruktur yang benar-benar bisa digunakan oleh sistem AI.
Toolkit saya mencakup Node.js (TypeScript), Python, Go, dan Java, dengan keahlian mendalam di Crawlee, Playwright, dan Cheerio. Saya telah membangun sistem produksi yang menangani jutaan request dengan tingkat keberhasilan >99%.
Apa yang saya kerjakan
Saya membangun dan memelihara 16 Apify Actor kelas produksi yang melayani lebih dari 3,100 pengguna dengan tingkat keberhasilan run >99% secara konsisten. Setiap actor menghasilkan JSON siap-RAG yang bersih — konsisten skemanya, terdeduplikasi, dan siap langsung dipakai di vector store, pipeline retrieval, atau training set. Sebagian besar actor data publik tidak memerlukan API key. Pekerjaan saya mencakup empat bidang:
Data e-commerce & ritel
Scraper untuk platform kecantikan dan fashion besar, termasuk Sephora (21 storefront global), Ulta Beauty, Farfetch, Lululemon, Boohoo, Macy’s, dan Shopify scraper universal yang bisa dipakai di toko Shopify mana pun.
Data publik, keuangan & hukum
Dataset resmi Amerika Serikat sebagai JSON bersih dan siap-RAG — laporan SEC EDGAR & data keuangan XBRL, dana federal dari USAspending.gov, putusan pengadilan dari CourtListener, dan studi dari ClinicalTrials.gov.
Intelijen sosial & media
Postingan, profil, dan interaksi Bluesky via AT Protocol, ditambah YouTube subtitle & transcript scraper yang menghasilkan output JSON, SRT, VTT, atau teks siap-LLM dalam 100+ bahasa.
Utilitas developer
Tools di luar scraping — audit SEO & structured data, rendering web-ke-PDF/gambar, dan load testing berperforma tinggi.
Spesialisasi
- Reverse engineering private API — mengubah endpoint mobile/web yang tidak terdokumentasi menjadi sumber data yang andal
- Bypass anti-bot — Cloudflare, DataDome, Akamai WAF, dan proteksi custom
- Output siap-RAG — JSON yang dinormalisasi dan konsisten skemanya, dibangun untuk retrieval dan grounding
- Scraping multi-region — locale, mata uang, dan kepatuhan (compliance) sudah ditangani
- Sistem dengan reliabilitas tinggi — extractor yang mempertahankan tingkat keberhasilan >99% dalam skala besar
Tech stack
| Kategori | Teknologi |
|---|---|
| Bahasa | TypeScript, Python, Go, Java |
| Scraping | Crawlee, Playwright, Cheerio, Parsel, got-scraping |
| Anti-bot | Fingerprint generator, TLS fingerprinting, rotasi sesi |
| Infrastruktur | Apify Platform, Docker, GitHub Actions |
| Testing | Vegeta, framework load-testing custom |
Bekerja sama dengan saya
Saya menawarkan solusi scraping custom, rekayasa pipeline data RAG, dan layanan ekstraksi data berkelanjutan. Jika AI Anda membutuhkan web asli sebagai data yang bersih — mari bicara.