~/public-data/clinical-trials-scraper

ClinicalTrials.gov Scraper — स्टडीज़, एलिजिबिलिटी और रिज़ल्ट

आधिकारिक ClinicalTrials.gov v2 API को condition, intervention, sponsor, location, status, या NCT ID के आधार पर सर्च करें। एलिजिबिलिटी, रिज़ल्ट मेटाडेटा, और इंक्रीमेंटल अपडेट के साथ normalized स्टडी रिकॉर्ड एक्सपोर्ट करें — कोई API key नहीं।

स्वास्थ्य सेवा TypeScriptREST API वैश्विक
proooxy/clinical-trials-scraper — स्पेक
कैटेगरीpublic-data / स्वास्थ्य सेवा
भाषाTypeScript
स्टैकTypeScript, REST API
मार्केट्सवैश्विक
आउटपुटसाफ, RAG-तैयार JSON

मुख्य विशेषताएं

आधिकारिक ClinicalTrials.gov v2 API — किसी API key की ज़रूरत नहीं

मल्टी-फ़ील्ड सर्च — condition, intervention, sponsor, location, और फ्री-टेक्स्ट क्वेरी

recruitment status (9 वैल्यू, OR-कॉम्बाइंड) और phase (Early Phase 1 → Phase 4) के हिसाब से फ़िल्टर करें

एक या कई खास स्टडीज़ के लिए सीधा NCT-ID लुकअप

updatedSince के ज़रिए इंक्रीमेंटल मॉनिटरिंग — किसी तारीख को/के बाद बदली गई स्टडीज़ ही रिटर्न करता है

Summary या full आउटपुट — full में raw protocol, derived, और results सेक्शन जुड़ जाते हैं

titles, summaries, eligibility, और outcomes से RAG-तैयार paragraph chunking

Results सिग्नल — hasResults के साथ participant-flow, outcome-measures, और adverse-events फ़्लैग

डिराइव्ड MeSH टर्म और normalized sponsor, collaborator, और location डेटा

यूज़ केस

  • sponsor या condition के हिसाब से फार्मा/बायोटेक पाइपलाइन मॉनिटरिंग
  • CRO और साइट-फ़िज़िबिलिटी रिसर्च — location, phase, और condition के हिसाब से recruiting ट्रायल
  • नई पोस्ट हुई या नई अपडेट हुई स्टडीज़ पर प्रतिस्पर्धी इंटेलिजेंस
  • एक्टिवली recruiting ट्रायल में पेशेंट-रिक्रूटमेंट रिसर्च
  • सिस्टमैटिक रिव्यू — बड़े स्केल पर eligibility criteria, outcomes, और results मेटाडेटा
  • chunked ट्रायल टेक्स्ट से बने मेडिकल AI / RAG नॉलेज बेस

इनपुट पैरामीटर

पैरामीटरटाइपआवश्यकविवरण
conditionstringवैकल्पिकसर्च करने के लिए condition या बीमारी, जैसे diabetes।
statusarrayवैकल्पिकRecruitment status फ़िल्टर, OR-कॉम्बाइंड, जैसे RECRUITING, COMPLETED।
phasearrayवैकल्पिकस्टडी phases — Not Applicable, Early Phase 1, Phase 1–4।
nctIdsarrayवैकल्पिकClinicalTrials.gov NCT ID से खास स्टडीज़ फ़ेच करें।
updatedSincestringवैकल्पिकYYYY-MM-DD — इस तारीख को/के बाद LastUpdatePostDate वाली स्टडीज़ रिटर्न करता है।
outputFieldsstringवैकल्पिकsummary (डिफ़ॉल्ट, normalized) या full (raw protocol/derived/results सेक्शन जोड़ता है)।
chunkingstringवैकल्पिकRAG टेक्स्ट chunking: paragraph (डिफ़ॉल्ट) या none।
maxItemsnumberवैकल्पिकसेव की जाने वाली अधिकतम स्टडीज़; हर एक एक बिल किया जाने वाला इवेंट है (डिफ़ॉल्ट: 10)।

आउटपुट का उदाहरण

 1{
 2  "itemType": "study",
 3  "nctId": "NCT01884792",
 4  "title": "Example Diabetes Study",
 5  "officialTitle": "A Study of Example Diabetes Study",
 6  "status": "COMPLETED",
 7  "phase": ["PHASE2"],
 8  "studyType": "INTERVENTIONAL",
 9  "conditions": ["Diabetes Mellitus"],
10  "sponsors": { "lead": "Example Sponsor Inc.", "collaborators": [] },
11  "locations": [
12    { "facility": "Example Medical Center", "city": "Boston", "state": "MA", "country": "United States", "status": "COMPLETED" }
13  ],
14  "hasResults": true,
15  "resultsSummary": { "hasParticipantFlow": true, "hasOutcomeMeasures": true, "hasAdverseEvents": true },
16  "lastUpdate": "2026-06-01",
17  "url": "https://clinicaltrials.gov/study/NCT01884792"
18}

प्राइसिंग

Pay-per-event: summary हो या full आउटपुट मोड, सेव की गई हर study पर $0.002। 1,000-study एक्सपोर्ट की कीमत ~$2.00 होती है, और maxItems वॉल्यूम व कॉस्ट दोनों पर कैप लगाता है।

टिप्स

  • चेंज मॉनिटरिंग के लिए updatedSince इस्तेमाल करें। कल की तारीख के साथ एक डेली रन शेड्यूल करें ताकि सिर्फ़ पोस्ट या अमेंड हुए ट्रायल कैप्चर हों — किसी कॉम्पिटिटर की पाइपलाइन ट्रैक करने का सबसे सस्ता तरीका।
  • पूरी रजिस्ट्री खींचे बिना एक टारगेटेड फ़िज़िबिलिटी लिस्ट बनाने के लिए condition + status: [RECRUITING] + phase को कॉम्बाइन करें।
  • outputFields: full सेट करें सिर्फ़ तब जब आपको raw सेक्शन चाहिए हों — normalized summary में पहले से ही eligibility, sponsors, locations, और results फ़्लैग शामिल हैं।

सामान्य प्रश्न

क्या मुझे API key चाहिए?
नहीं। ClinicalTrials.gov का v2 API पूरी तरह पब्लिक है — एक्टर सिर्फ़ एक descriptive User-Agent भेजता है, बिना किसी ऑथेंटिकेशन के।
क्या मुझे सिर्फ़ normalized फ़ील्ड नहीं, raw स्टडी डेटा भी मिल सकता है?
हां। normalized summary फ़ील्ड के साथ raw protocolSection, derivedSection, और resultsSection शामिल करने के लिए outputFields को 'full' सेट करें।
हाल ही में बदली गई स्टडीज़ को मैं कैसे मॉनिटर करूं?
updatedSince को एक YYYY-MM-DD तारीख पर सेट करें। एक्टर ClinicalTrials.gov के LastUpdatePostDate पर फ़िल्टर करता है और उस दिन को/के बाद अपडेट हुई स्टडीज़ ही रिटर्न करता है — डेली पाइपलाइन मॉनिटरिंग के लिए आदर्श।
कवरेज ग्लोबल है या सिर्फ़ US तक?
ग्लोबल। ClinicalTrials.gov दुनिया भर के ट्रायल रजिस्टर करता है, और हर स्टडी के locations array में उपलब्ध होने पर country, state, city, और facility शामिल होता है।

~/public-data में संबंधित

ClinicalTrials.gov Scraper — स्टडीज़, एलिजिबिलिटी और रिज़ल्ट रन करें, या कस्टम बिल्ड पाएं

मिनटों में Apify पर एक्सट्रैक्शन शुरू करें, या अपने सोर्स और स्कीमा के लिए कस्टम स्क्रैपर और RAG पाइपलाइन बनवाने के लिए मुझे हायर करें।

Apify पर रन करें कस्टम डेटा पाएं