~/ecommerce/sephora-eu-scraper

Sephora EU Scraper——覆盖 9 个欧洲市场

抓取 Sephora 欧洲站点在 9 个欧盟市场的完整商品数据,支持多变体提取、Akamai WAF 绕过与智能令牌管理。

美妆 成功率 >99% TypeScriptCrawleeAkamai Bypass 法国意大利德国西班牙波兰捷克希腊罗马尼亚葡萄牙
proooxy/sephora-eu-scraper — 规格
分类ecommerce / 美妆
语言TypeScript
技术栈TypeScript, Crawlee, Akamai Bypass
市场法国, 意大利, 德国, 西班牙, 波兰, 捷克, 希腊, 罗马尼亚, 葡萄牙
成功率>99%
输出干净、RAG 就绪的 JSON

核心特性

支持 9 个欧盟市场——FR、IT、DE、ES、PL、CZ、GR、RO、PT

多变体提取,各自独立的价格与库存状态

每件商品的高分辨率图库

通过分类 ID 浏览分类,实现批量提取

浏览器级 TLS 指纹伪装,绕过 Akamai WAF

访客令牌管理,支持自动刷新与指数退避

应用场景

  • 泛欧洲美妆市场比价
  • 跨市场商品可购性监控
  • 美妆品牌拓展欧盟市场的调研
  • 覆盖欧洲各市场的竞争情报
  • 区域定价策略分析

输入参数

参数类型必填说明
startUrlsarray可选待抓取的 Sephora EU 商品 URL
categoryIdsarray可选用于批量商品提取的分类 ID
localestring可选目标市场语言区域(例如 fr-FR、it-IT)
maxProductsnumber可选最多提取的商品数量
maxConcurrencynumber可选并行请求数上限
proxyConfigurationobject可选代理设置——推荐使用住宅代理

输出示例

 1{
 2  "source": "https://www.sephora.fr/p/...",
 3  "brand": "Rare Beauty",
 4  "title": "Soft Pinch Liquid Blush",
 5  "description": "Un blush liquide longue tenue...",
 6  "shortDescription": "Blush liquide",
 7  "categories": ["Maquillage", "Teint", "Blush"],
 8  "options": [
 9    { "name": "Shade", "values": ["Joy", "Hope", "Grace"] }
10  ],
11  "variants": [
12    {
13      "sku": "EU-RB-001",
14      "name": "Joy",
15      "price": 2800,
16      "currency": "EUR",
17      "inStock": true
18    }
19  ],
20  "medias": [
21    { "type": "image", "url": "https://..." }
22  ],
23  "stats": { "rating": 4.7, "reviewCount": 3421 }
24}

常见问题

支持哪些欧洲 Sephora 市场?
法国(fr-FR)、意大利(it-IT)、德国(de-DE)、西班牙(es-ES)、波兰(pl-PL)、捷克(cs-CZ)、希腊(el-GR)、罗马尼亚(ro-RO)与葡萄牙(pt-PT)。
爬虫是如何绕过 Akamai WAF 的?
它使用浏览器级 TLS 指纹伪装来模拟真实的浏览器连接,使请求与真实用户流量难以区分。
可以抓取整个分类吗?
可以,提供分类 ID 即可提取该分类下的所有商品,这是批量提取效率最高的方式。

~/ecommerce 下的相关工具

运行 Sephora EU Scraper——覆盖 9 个欧洲市场,或定制专属方案

几分钟内即可在 Apify 上开始提取数据,或聘请我为你的目标源和 schema 定制专属爬虫与 RAG 管道。

在 Apify 上运行 获取定制数据