~/ecommerce/macys-scraper

Macy's Scraper — Produkte, Preise, SKUs & News

Macy's-Produktdaten extrahieren — Preise, Varianten, SKU-/UPC-Barcodes, Bilder, Bewertungen & Rezensionen — plus Macy's-Inc.-News, aus Such-, Kategorie-, Trending- und Produkt-URLs. Ohne Browser, Akamai-sicher.

Kaufhaus TypeScriptCrawleeCheerio USA
proooxy/macys-scraper — Steckbrief
Kategorieecommerce / Kaufhaus
SpracheTypeScript
StackTypeScript, Crawlee, Cheerio
MärkteUSA
Outputsauberes, RAG-fertiges JSON

Hauptfunktionen

Vier Datenquellen in einem Actor — Produktsuche, Kategorie, Trending und Macy's-Inc.-News

Umgeht Akamai Bot Manager ohne Browser, durch Nutzung von Macy's eigenen Mobile- & Website-JSON-APIs

UPC-Barcodes pro SKU mit Farbe, Größe, Verfügbarkeit und Preis für jede kaufbare Variante

Preise als Integer-Cent plus lokalisierte, formatierte Strings — keine Floating-Point-Rundungsfehler

Vollständige Rezensions-Intelligence — Sterne-Histogramm, Weiterempfehlungs-Zahlen und sekundäre Passform-/Größen-Bewertungen

Alle Farbtöne und Größen unter einem Produktdatensatz gruppiert, nicht eine Zeile pro Variante

Ausschließlich saubere kanonische URLs — interne API-Endpunkte und Client-Keys tauchen nie im Output auf

Ein normalisiertes Schema über Search-, Category-, Trending- und Produktdetail-Ergebnisse hinweg

Anwendungsfälle

  • Kaufhaus-Preis- und Promotion-Monitoring auf SKU-Ebene
  • Wettbewerbsanalyse — Macy's vs. Nordstrom, Ulta oder Marken-DTC-Preise
  • Katalogabgleich zwischen Händlern über UPC-Barcodes je Variante
  • Rezensions- und Bewertungs-Intelligence für bei Macy's verkaufte Marken
  • Retail-News-Monitoring — Pressemitteilungen und Quartalszahlen von Macy's Inc.

Eingabeparameter

ParameterTypErforderlichBeschreibung
scrapeTypestringerforderlichZu scrapende Quelle: search, category, trending, news oder all (Standard: search).
querystringoptionalKeyword für die Produktsuche, z. B. women shoes.
startUrlsarrayoptionalMacy's-Produkt-/Kategorie-URLs oder Macy's-Inc.-News-URLs.
categoryIdsarrayoptionalMacy's-Kategorie-IDs (z. B. 5449). Kategorie-URLs werden bevorzugt, wenn bekannt.
trendingUrlsarrayoptionalTrending-, Bestseller- oder kuratierte Listing-URLs.
newsUrlsarrayoptionalMacy's-Inc.-News-Listing- oder Artikel-URLs.
includeProductDetailsbooleanoptionalListing-Einträge um vollständige Produktdetails anreichern — Varianten, SKUs, Galerien (Standard: true).
maxPagesnumberoptionalMaximale Paginierungstiefe pro Listing-/News-Quelle.
maxResultsnumberoptionalObergrenze für Output-Datensätze. 0 = keine Obergrenze.
proxyobjecterforderlichApify Proxy oder eigene Proxy-URLs. Residential, Land USA empfohlen.

Beispiel-Output

 1{
 2  "type": "product",
 3  "source": {
 4    "id": "12345678",
 5    "canonicalUrl": "https://www.macys.com/shop/product/calvin-klein-womens-sheath-dress?ID=12345678",
 6    "retailer": "macys",
 7    "currency": "USD"
 8  },
 9  "title": "Women's Sleeveless Sheath Dress",
10  "brand": "Calvin Klein",
11  "categories": ["Women", "Dresses", "Work Dresses"],
12  "price": {
13    "sale": 5999,
14    "list": 9800,
15    "currentFormatted": "$59.99",
16    "stockStatus": "InStock"
17  },
18  "stats": { "rating": 4.6, "reviewCount": 9, "ratingPercentage": 92 },
19  "options": [
20    { "type": "Color", "values": [{ "id": "1", "name": "Black" }] },
21    { "type": "Size", "values": [{ "id": "10", "name": "M" }, { "id": "12", "name": "L" }] }
22  ],
23  "variants": [
24    {
25      "id": "987654",
26      "sku": "192837465012",
27      "options": ["Black", "M"],
28      "price": { "stockStatus": "InStock" },
29      "extraInfo": { "upc": "192837465012" }
30    }
31  ],
32  "medias": [{ "type": "Image", "url": "https://slimages.macysassets.com/is/image/MCY/products/.../main.jpg" }]
33}

Preise

Pay-per-Event — abgerechnet wird nur für tatsächlich gespeicherte Items:

EventPreisWas abgedeckt ist
Produkt gescraped$0.006Ein Produkt mit vollständigem Detail — Varianten, SKUs/UPCs, Preise, Bilder, Bewertungen
Artikel gescraped$0.002Ein Macy’s-Inc.-News-Artikel — Titel, Autor, Datum, Text, Bilder

Mengenrabatte gelten automatisch bei höheren Apify-Plänen (bis zu $0.0045 pro Produkt). Ein Crawl von 1.000 Produkten kostet zum Listenpreis ~$6.00.

Tipps

  • Residential US-Proxys verwenden. Der Produktdetail-Endpunkt ist zeitweise rate-limitiert; Residential-Session-Rotation kommt sauber durch, während Rechenzentrums-IPs mehr 403er sehen.
  • Concurrency moderat halten. maxConcurrency von 2–3 ist der Sweet Spot — höhere Werte erhöhen Rate-Limit-Treffer, ohne den Durchsatz zu verbessern.
  • Kategorie-URLs gegenüber reinen IDs bevorzugen. Die URL enthält den Kategoriepfad, den die API erwartet; eine reine ID kann zu einem breiteren oder leeren Ergebnis führen.
  • includeProductDetails deaktivieren für einen schnellen Durchlauf auf Listing-Ebene (Name, Marke, Listenpreis, Bild, Bewertung), wenn Varianten oder Beschreibungen nicht gebraucht werden.

FAQ

Wie kommt es ohne Browser an Akamai vorbei?
Es tritt gar nicht erst gegen die JS-Challenge an. Listings stammen aus Macy's Mobile-App-API, Produktdetails aus der JSON-API der Website — beide laufen auf separater Infrastruktur, die anonyme Leseanfragen beantwortet. Kein Login, keine Cookies, kein API-Key.
Sind die Preise in Dollar oder Cent angegeben?
In Integer-Cent (5999 = $59.99), um Floating-Point-Rundungsfehler zu vermeiden, zusätzlich mit lokalisierten, formatierten Strings ($59.99).
Wie werden Varianten und UPCs gehandhabt?
Alle Farben und Größen werden unter einem einzigen Produktdatensatz mit einem variants[]-Array gruppiert. Jede Variante trägt ihren eigenen UPC-Barcode, Farbe, Größe, Verfügbarkeit und Preis — gewonnen aus Macy's SKU-Beziehungsdaten, nicht von einem Swatch-Widget gescraped.
Kann ich Produkte und News in einem Run zusammen scrapen?
Ja. scrapeType auf all setzen und eine beliebige Kombination aus query, startUrls, categoryIds, trendingUrls und newsUrls angeben.

verwandt in ~/ecommerce

Macy's Scraper — Produkte, Preise, SKUs & News ausführen oder ein individuelles Projekt anfragen

In wenigen Minuten mit der Extraktion auf Apify starten, oder mich für einen maßgeschneiderten Scraper und eine RAG-Pipeline exakt nach Quelle und Schema beauftragen.

auf Apify ausführen individuelle Daten anfragen