~/public-data/courtlistener-scraper

CourtListener Scraper — 판례, 도켓 및 전문

CourtListener에서 미국 판례, RECAP 도켓, 구두변론, 판사, 인용정보를 조회합니다 — 판례 전문과 RAG-레디 청크까지 포함합니다. 법원, 날짜, 키워드로 필터링할 수 있습니다.

법률 TypeScriptCheerio 미국
proooxy/courtlistener-scraper — 사양
카테고리public-data / 법률
언어TypeScript
스택TypeScript, Cheerio
마켓미국
출력클린한 RAG-레디 JSON

주요 기능

하나의 액터에 6가지 검색 유형 — 판례, 도켓(RECAP), RECAP 문서, 구두변론, 판사, 인용 조회

판례 전문 — 300자짜리 스니펫이 아니라 검색 결과를 따라 데이터베이스에서 완전한 판결문을 가져옴

RAG-레디 청킹 — 약 2000자 단위 문단 청크마다 순서 인덱스 부여

인용 해석 — 최대 250개의 인용 문자열(예: 576 U.S. 644)을 일치하는 판례로 매칭

불리언 전문 검색과 법원 ID, 제출일 범위, 정렬 순서 필터

CourtListener의 응답 형식 전반에 걸쳐 레이트 리밋을 인식하고 429에 정밀하게 백오프하는 페이싱

설정한 아이템 상한까지 커서 페이지네이션으로 스트리밍

직접 토큰을 가져오거나 내장된 로테이팅 토큰 풀 사용 가능

활용 사례

  • 법률 리서치 — 법원, 기간, 키워드별로 판례 전문 수집
  • 소송 인텔리전스 — 주제와 날짜별로 법원의 도켓 활동 추적
  • 리걸 AI/RAG — 청킹되어 임베딩 준비가 된 판례 코퍼스 구축
  • 인용 분석 — 준비서면의 인용을 연결된 판례 기록 및 피인용 횟수로 해석
  • 실증 법학 연구 — 판사, 구두변론 메타데이터, 판례 트렌드
  • 법률 저널리즘 — 특정 법원에 새로 제출된 판례나 도켓 모니터링

입력 파라미터

파라미터타입필수설명
searchTypestring선택조회할 대상: opinions, dockets, recap_docs, oral_arguments, judges, citation 중 선택(기본값: opinions).
querystring선택불리언 연산자를 포함한 전문 검색 쿼리 — 법원 필터나 인용 조회를 사용하지 않는 한 필수.
citationsarray선택해석할 인용 문자열(최대 250개) — citation 모드에서 필수.
courtstring선택CourtListener 법원 ID, 예: scotus, ca9, nyed.
dateFromstring선택이 날짜 이후 제출된 판례(YYYY-MM-DD).
includeFullTextboolean선택판례의 전문과 RAG 청크를 가져옴(기본값: false).
apiTokenstring선택본인의 CourtListener API 토큰. 생략 시 내장된 로테이팅 풀로 대체됩니다.
maxItemsnumber선택저장할 최대 항목 수. 각 항목이 하나의 과금 이벤트입니다(기본값: 5).

출력 예시

 1{
 2  "itemType": "legal",
 3  "searchType": "opinions",
 4  "id": "10380001",
 5  "title": "Climate United Fund v. Citibank, N.A.",
 6  "court": "Court of Appeals for the D.C. Circuit",
 7  "date": "2025-04-16",
 8  "url": "https://www.courtlistener.com/opinion/10380001/...",
 9  "citations": [],
10  "citeCount": 0,
11  "docketNumber": "23-5138",
12  "fullText": "...",
13  "chunks": [{ "text": "...", "order": 0 }],
14  "meta": { "courtId": "cadc", "clusterId": 10380001 }
15}

요금

이벤트당 과금 — 저장된 항목에 대해서만 비용이 청구됩니다:

이벤트가격포함 내용
전문이 포함된 판례$0.005전문 + RAG 청크가 포함된 판례 1건 저장
메타데이터 항목$0.002도켓, 구두변론, 판사, 인용, 또는 메타데이터 전용 레코드 1건

1,000건의 판례 전문 코퍼스는 약 $5.00이며, maxItems로 처리량과 비용을 모두 제한할 수 있습니다.

  • 실제로 임베딩할 판례에만 includeFullText를 켜세요. 판례마다 추가 요청 비용이 발생하며 기본값은 꺼져 있습니다 — 먼저 법원과 날짜로 좁게 필터링하세요.
  • 준비서면을 보강하려면 citation 모드를 사용하세요. 인용 문자열을 붙여넣으면 한 번의 실행으로 연결된 판례 기록과 피인용 횟수를 받을 수 있습니다.
  • 대규모 작업에는 본인의 CourtListener 토큰을 사용하세요 — 무료 등급의 낮은 레이트 리밋이 주된 처리량 병목입니다.

자주 묻는 질문

CourtListener API 토큰이 필요한가요?
CourtListener는 토큰을 요구합니다. apiToken으로 본인의 무료 토큰을 제공하거나, 액터에 내장된 로테이팅 폴백 풀을 이용할 수 있습니다. 직접 토큰을 사용하면 유료/멤버십 등급에서 처리량을 높일 수 있습니다.
모든 검색 유형에서 판례 전문을 받을 수 있나요?
아니요. 전문 및 청킹(includeFullText)은 opinions에만 적용되며, 실행 속도를 위해 기본값은 꺼져 있습니다. dockets, RECAP 문서, 구두변론, 판사, 인용 결과는 메타데이터만 반환합니다.
어떤 법원이 커버되나요?
CourtListener가 색인하는 모든 법원입니다 — 미국 연방법원(SCOTUS, 항소법원, RECAP을 통한 지방법원)과 다수의 주법원이 포함되며, scotus, ca9, nyed 같은 CourtListener 고유의 법원 ID로 지정합니다.
얼마나 빠르게 실행할 수 있나요?
처리량은 토큰의 레이트 리밋에 좌우되며(CourtListener 무료 등급은 분당 몇 건 수준), 429 발생 시 자동으로 백오프합니다. 멤버십 토큰을 사용하면 상한이 올라갑니다.

~/public-data 관련 도구

CourtListener Scraper — 판례, 도켓 및 전문 실행하기, 또는 맞춤 제작 요청

몇 분 안에 Apify에서 추출을 시작하거나, 원하는 소스와 스키마에 딱 맞는 맞춤 스크래퍼와 RAG 파이프라인 제작을 의뢰하세요.

Apify에서 실행 맞춤 데이터 요청