TikTok 자막·스크립트 스크레이퍼 — JSON, SRT, VTT, LLM
영상 URL, 단축 링크, @프로필 전체에서 TikTok 자막과 스크립트를 추출해 JSON, SRT, VTT, 일반 텍스트, LLM용 텍스트로 제공합니다. 네이티브 자막을 그대로 가져오므로 Whisper도 API 키도 필요 없고, 영상당 약 2초입니다.
주요 기능
음성을 다시 인식하지 않고 TikTok 자체 자막을 읽어 영상당 약 2초 — Whisper 방식은 보통 10~30초
화면에 보이는 문장 그대로라 잘못 듣거나 없는 말을 만들어내지 않습니다
다섯 가지 출력 형식 — 타임스탬프 JSON, SRT, VTT, 일반 텍스트, [Music]과 화자 라벨을 제거한 LLM용 텍스트
입력 한 칸에 영상 URL, vm./vt. 단축 링크, @사용자명, 원시 영상 ID를 섞어 넣을 수 있습니다
프로필을 넣으면 해당 크리에이터의 영상을 나열하며, maxVideos가 실행 전체의 예산이 됩니다
영상별 참여 지표 — 재생, 좋아요, 댓글, 공유, 길이, 단어 수, 구간 수
자막 언어 우선순위 목록과 접두어 매칭(eng가 eng-US에 매칭), 자동 생성 자막 사용 여부 설정
추출 실패, 단축 링크 해석, 프로필 나열에는 요금이 부과되지 않습니다
활용 사례
- 숏폼 영상으로 RAG·파인튜닝용 코퍼스 구축
- 말로 전달된 내용을 블로그, 뉴스레터, SNS 카피로 재활용
- 특정 분야 크리에이터 전반의 콘텐츠 경쟁 분석
- 재게시와 현지화를 위한 SRT/VTT 자막 파일 생성
- 후킹 연구 — 상위 영상의 도입부 몇 초를 한꺼번에 읽기
- 협찬 게시물의 브랜드 안전성과 표기 점검을 대규모로 수행
입력 파라미터
| 파라미터 | 타입 | 필수 | 설명 |
|---|---|---|---|
urls | array | 필수 | TikTok 영상 URL, 단축 링크, @사용자명 또는 원시 영상 ID |
outputFormat | string | 선택 | json, srt, vtt, text, llm |
languages | array | 선택 | 선호 자막 언어를 우선순위로 지정. 접두어 매칭을 지원해 eng가 eng-US에 매칭됩니다 |
includeAutoGenerated | boolean | 선택 | 수동 자막이 없을 때 TikTok 자동 생성 자막을 포함할지 여부 |
maxVideos | integer | 선택 | 실행 전체에서 처리할 영상 수 상한. 0은 무제한 |
maxConcurrency | integer | 선택 | 동시 처리 수 1~10. 낮을수록 속도 제한에 안전합니다 |
proxyConfiguration | object | 선택 | 주거용 프록시를 강력히 권장 — TikTok은 데이터센터 IP를 적극적으로 차단합니다 |
출력 예시
1{
2 "videoId": "7627209981670001950",
3 "url": "https://www.tiktok.com/@tiktok/video/7627209981670001950",
4 "title": "your TikTok grandpa @writers cramp is proud of you",
5 "authorName": "TikTok",
6 "authorId": "tiktok",
7 "createTime": "2026-04-10T19:10:35.000Z",
8 "playCount": 54600,
9 "likeCount": 3656,
10 "commentCount": 837,
11 "shareCount": 291,
12 "availableLanguages": ["eng-US"],
13 "language": "eng-US",
14 "isAutoGenerated": true,
15 "segments": [
16 { "text": "I'm 81 years old and I'm known as the TikTok Grandpa", "start": 0.04, "end": 3.64 },
17 { "text": "my name is Ian Smith", "start": 3.641, "end": 4.721 }
18 ],
19 "text": "I'm 81 years old and I'm known as the TikTok Grandpa my name is Ian Smith...",
20 "duration": 77,
21 "wordCount": 243,
22 "segmentCount": 29,
23 "extractedAt": "2026-04-12T02:45:36.000Z",
24 "error": null
25}
팁
영상 하나로 시작하세요. URL 하나면 프로필 실행 전에 스키마와 반환되는 자막 언어를 확인할 수 있습니다. 프로필 실행에는 maxVideos를 설정하세요. 프로필별이 아니라 실행 전체 예산이라 혼합 입력에서도 초과하지 않습니다. 동시 처리 수는 3으로 두세요. TikTok의 속도 제한이 엄격해 값을 올리면 안정성만 잃습니다. AI 파이프라인에는 llm 형식. [Music], 화자 라벨, 주석을 제거해 임베딩 노이즈를 줄입니다.
자주 묻는 질문
Whisper나 음성 인식을 사용하나요?
자막이 없는 영상은 어떻게 되나요?
계정 전체를 수집할 수 있나요?
~/social 관련 도구
YouTube Subtitle & Transcript Scraper — JSON, SRT, VTT, LLM
YouTube 스크립트를 JSON, SRT, VTT, 또는 LLM-레디 텍스트로 제공합니다.
열기