~/public-data/courtlistener-scraper

CourtListener Scraper — Gerichtsentscheidungen, Dockets & Volltext

CourtListener durchsuchen nach US-Gerichtsentscheidungen, RECAP-Dockets, mündlichen Verhandlungen, Richtern und Zitaten — mit vollständigem Urteilstext und RAG-fertigen Chunks. Filterbar nach Gericht, Datum oder Stichwort.

Recht TypeScriptCheerio USA
proooxy/courtlistener-scraper — Steckbrief
Kategoriepublic-data / Recht
SpracheTypeScript
StackTypeScript, Cheerio
MärkteUSA
Outputsauberes, RAG-fertiges JSON

Hauptfunktionen

Sechs Suchtypen in einem Actor — Gerichtsentscheidungen, Dockets (RECAP), RECAP-Dokumente, mündliche Verhandlungen, Richter und Zitat-Abfrage

Vollständiger Urteilstext — folgt Suchtreffern in die Datenbank für komplette Entscheidungen, nicht nur 300-Zeichen-Schnipsel

RAG-fertiges Chunking — ~2000-Zeichen-Absatz-Chunks, jeweils mit Reihenfolge-Index

Zitat-Auflösung — bis zu 250 Zitat-Strings (z. B. 576 U.S. 644) zu passenden Fällen auflösen

Boolesche Volltextsuche plus Filter für Gerichts-ID, Einreichungsdatum-Bereich und Sortierreihenfolge

Rate-Limit-bewusstes Timing mit präzisem 429-Backoff über alle Antwortformate von CourtListener hinweg

Cursor-Paginierungs-Streaming bis zur konfigurierten Item-Obergrenze

Eigenes Token mitbringen oder den eingebauten rotierenden Token-Pool nutzen

Anwendungsfälle

  • Rechtsrecherche — Volltext-Rechtsprechung nach Gericht, Zeitraum oder Stichwort abrufen
  • Litigation Intelligence — Docket-Aktivität eines Gerichts nach Thema und Datum verfolgen
  • Rechts-KI / RAG — einen gechunkten, embedding-fertigen Rechtsprechungs-Korpus aufbauen
  • Zitat-Analyse — Zitate aus einem Schriftsatz zu verlinkten Fallakten und Zitierzahlen auflösen
  • Empirische Rechtsforschung — Richter, Metadaten zu mündlichen Verhandlungen und Trends bei Gerichtsentscheidungen
  • Rechtsjournalismus — neu eingereichte Entscheidungen oder Dockets bei bestimmten Gerichten überwachen

Eingabeparameter

ParameterTypErforderlichBeschreibung
searchTypestringoptionalWas abgerufen werden soll: opinions, dockets, recap_docs, oral_arguments, judges oder citation (Standard: opinions).
querystringoptionalVolltext-Query mit booleschen Operatoren — erforderlich, außer bei Nutzung eines Gerichtsfilters oder einer Zitat-Abfrage.
citationsarrayoptionalAufzulösende Zitat-Strings (bis zu 250) — erforderlich im Modus citation.
courtstringoptionalCourtListener-Gerichts-ID, z. B. scotus, ca9, nyed.
dateFromstringoptionalEinreichungsdatum ab (YYYY-MM-DD).
includeFullTextbooleanoptionalVollständigen Urteilstext und RAG-Chunks für opinions abrufen (Standard: false).
apiTokenstringoptionalDas eigene CourtListener-API-Token; ohne Angabe wird auf den eingebauten rotierenden Pool zurückgegriffen.
maxItemsnumberoptionalMaximal gespeicherte Items; jedes ist ein abgerechnetes Event (Standard: 5).

Beispiel-Output

 1{
 2  "itemType": "legal",
 3  "searchType": "opinions",
 4  "id": "10380001",
 5  "title": "Climate United Fund v. Citibank, N.A.",
 6  "court": "Court of Appeals for the D.C. Circuit",
 7  "date": "2025-04-16",
 8  "url": "https://www.courtlistener.com/opinion/10380001/...",
 9  "citations": [],
10  "citeCount": 0,
11  "docketNumber": "23-5138",
12  "fullText": "...",
13  "chunks": [{ "text": "...", "order": 0 }],
14  "meta": { "courtId": "cadc", "clusterId": 10380001 }
15}

Preise

Pay-per-Event — abgerechnet wird nur für gespeicherte Items:

EventPreisWas abgedeckt ist
Gerichtsentscheidung mit Volltext$0.005Eine gespeicherte Entscheidung mit vollständigem Text + RAG-Chunks
Metadaten-Item$0.002Ein Docket, eine mündliche Verhandlung, ein Richter, ein Zitat oder ein reiner Metadaten-Datensatz

Ein Volltext-Korpus mit 1.000 Entscheidungen kostet ~$5.00; maxItems begrenzt sowohl Menge als auch Kosten.

Tipps

  • includeFullText nur für Entscheidungen aktivieren, die tatsächlich embedded werden. Es kostet zusätzliche Anfragen pro Entscheidung und ist standardmäßig deaktiviert — zuerst eng nach Gericht und Datum filtern.
  • Den Modus citation nutzen, um einen Schriftsatz anzureichern. Zitat-Strings einfügen und in einem Run verlinkte Fallakten sowie Zitierzahlen zurückbekommen.
  • Ein eigenes CourtListener-Token mitbringen für größere Jobs — das niedrige Rate-Limit der kostenlosen Stufe ist der Haupt-Flaschenhals beim Durchsatz.

FAQ

Brauche ich ein CourtListener-API-Token?
Ja, CourtListener verlangt eines. Entweder ein eigenes kostenloses Token über apiToken angeben oder sich auf den eingebauten rotierenden Fallback-Pool des Actors verlassen. Ein eigenes Token erlaubt höheren Durchsatz auf einer bezahlten Mitgliedschaftsstufe.
Ist der vollständige Urteilstext bei jedem Suchtyp verfügbar?
Nein. Volltext plus Chunking (includeFullText) gilt nur für opinions und ist standardmäßig deaktiviert, damit Runs schnell bleiben. Dockets, RECAP-Dokumente, mündliche Verhandlungen, Richter und Zitat-Ergebnisse liefern nur Metadaten.
Welche Gerichte werden abgedeckt?
Alles, was CourtListener indexiert — US-Bundesgerichte (SCOTUS, Courts of Appeals und District Courts über RECAP) sowie viele Gerichte der Bundesstaaten, adressiert über CourtListeners eigene Gerichts-IDs wie scotus, ca9 oder nyed.
Wie schnell kann es laufen?
Der Durchsatz ist durch das Rate-Limit des Tokens begrenzt (CourtListeners kostenlose Stufe erlaubt wenige Anfragen pro Minute) mit automatischem 429-Backoff; ein Mitgliedschafts-Token hebt die Obergrenze an.

verwandt in ~/public-data

CourtListener Scraper — Gerichtsentscheidungen, Dockets & Volltext ausführen oder ein individuelles Projekt anfragen

In wenigen Minuten mit der Extraktion auf Apify starten, oder mich für einen maßgeschneiderten Scraper und eine RAG-Pipeline exakt nach Quelle und Schema beauftragen.

auf Apify ausführen individuelle Daten anfragen