CourtListener Scraper — судебные решения, дела и полный текст
Запрашивайте в CourtListener судебные решения США, дела RECAP, устные слушания, судей и цитаты — с полным текстом решений и чанками, готовыми к RAG. Фильтрация по суду, дате или ключевому слову.
ключевые возможности
Шесть типов поиска в одном акторе — opinions, dockets (RECAP), RECAP documents, oral arguments, judges и citation lookup
Полный текст решений — переходит от результатов поиска к базе данных за полными текстами, а не фрагментами по 300 символов
Чанкинг, готовый к RAG, — абзацы по ~2000 символов, каждый с порядковым индексом
Разрешение цитат — сопоставляет до 250 строк цитат (например, 576 U.S. 644) с найденными делами
Булев полнотекстовый поиск плюс фильтры по ID суда, диапазону дат подачи и порядку сортировки
Темп запросов с учетом лимитов и точной задержкой при 429 по всем форматам ответов CourtListener
Потоковая курсорная пагинация до заданного лимита элементов
Используйте свой токен или встроенный ротируемый пул токенов
сценарии использования
- Юридические исследования — выгрузка полнотекстовой судебной практики по суду, диапазону дат или ключевому слову
- Аналитика судебных процессов — отслеживание активности по делам суда по теме и дате
- Юридический ИИ / RAG — построение корпуса судебной практики, разбитого на чанки и готового для эмбеддингов
- Анализ цитирования — сопоставление цитат из процессуального документа со связанными делами и числом цитирований
- Эмпирические юридические исследования — судьи, метаданные устных слушаний и тренды в решениях
- Юридическая журналистика — мониторинг новых решений или дел в конкретных судах
входные параметры
| Параметр | Тип | Обязательный | Описание |
|---|---|---|---|
searchType | string | опционально | Что получить: opinions, dockets, recap_docs, oral_arguments, judges или citation (по умолчанию: opinions). |
query | string | опционально | Полнотекстовый запрос с булевыми операторами — обязателен, если не используется фильтр по суду или поиск по цитате. |
citations | array | опционально | Строки цитат для разрешения (до 250) — обязательно для режима citation. |
court | string | опционально | ID суда CourtListener, например scotus, ca9, nyed. |
dateFrom | string | опционально | Дата подачи не ранее (YYYY-MM-DD). |
includeFullText | boolean | опционально | Получать полный текст решений и чанки для RAG (по умолчанию: false). |
apiToken | string | опционально | Ваш API-токен CourtListener; если не указан, используется встроенный ротируемый пул. |
maxItems | number | опционально | Максимум сохраняемых элементов; каждый — одно тарифицируемое событие (по умолчанию: 5). |
Пример вывода
1{
2 "itemType": "legal",
3 "searchType": "opinions",
4 "id": "10380001",
5 "title": "Climate United Fund v. Citibank, N.A.",
6 "court": "Court of Appeals for the D.C. Circuit",
7 "date": "2025-04-16",
8 "url": "https://www.courtlistener.com/opinion/10380001/...",
9 "citations": [],
10 "citeCount": 0,
11 "docketNumber": "23-5138",
12 "fullText": "...",
13 "chunks": [{ "text": "...", "order": 0 }],
14 "meta": { "courtId": "cadc", "clusterId": 10380001 }
15}
Цена
Оплата за событие — вы платите только за сохраненные элементы:
| Событие | Цена | Что включено |
|---|---|---|
| Решение с полным текстом | $0.005 | Одно сохраненное решение с полным текстом + чанки для RAG |
| Элемент метаданных | $0.002 | Дело, устное слушание, судья, цитата или запись только с метаданными |
Корпус из 1000 решений с полным текстом — это ~$5.00; maxItems ограничивает и объем, и стоимость.
Советы
- Включайте
includeFullTextтолько для решений, которые реально пойдут в эмбеддинги. Это требует дополнительных запросов на каждое решение и отключено по умолчанию — сначала точно отфильтруйте по суду и дате. - Используйте режим
citation, чтобы обогатить процессуальный документ. Вставьте строки цитат и получите связанные записи дел и число цитирований за один запуск. - Используйте собственный токен CourtListener для крупных задач — низкий лимит частоты запросов бесплатного тарифа является главным узким местом по пропускной способности.
частые вопросы
Нужен ли мне API-токен CourtListener?
Доступен ли полный текст решения для всех типов поиска?
Какие суды охвачены?
Насколько быстро он может работать?
похожие в ~/public-data
ClinicalTrials.gov Scraper — исследования, критерии участия и результаты
Поиск исследований, критериев участия и результатов ClinicalTrials.gov.
открытьSEC EDGAR Scraper — отчетность, полнотекстовый поиск и финансовые данные XBRL
Отчетность SEC, текст 10-K/10-Q и финансовые данные XBRL — готово к RAG.
открытьUSAspending.gov Scraper — федеральные контракты, получатели и агрегированные данные
Федеральные контракты, получатели и агрегированные расходы из USAspending.gov.
открыть