~/social/tiktok-transcript-scraper

TikTok 字幕・文字起こしスクレイパー — JSON, SRT, VTT, LLM

動画URL・短縮リンク・@プロフィール全体から TikTok の字幕と文字起こしを取得し、JSON / SRT / VTT / プレーンテキスト / LLM 向けテキストで出力します。ネイティブ字幕を直接取得するため、Whisper も API キーも不要、1本あたり約2秒。

メディア TypeScript グローバル
proooxy/tiktok-transcript-scraper — スペック
カテゴリsocial / メディア
言語TypeScript
スタックTypeScript
マーケットグローバル
出力クリーンでRAG対応のJSON

主な機能

音声を再認識せず TikTok 自身の字幕を読み取るため、1本あたり約2秒(Whisper 系は10〜30秒)

画面に表示されるテキストそのままなので、聞き間違いも創作もありません

5つの出力形式 — タイムスタンプ付き JSON、SRT、VTT、プレーンテキスト、[Music] や話者ラベルを除去した LLM 向けテキスト

1つの入力欄で動画URL、vm./vt. 短縮リンク、@ユーザー名、生の動画IDを混在指定可能

プロフィールを渡すと投稿動画を列挙。maxVideos は実行全体の上限として機能します

動画ごとのエンゲージメント情報 — 再生数・いいね・コメント・シェア・長さ・語数・セグメント数

字幕言語を優先順で指定でき、前方一致(eng は eng-US に一致)と自動生成字幕の切り替えに対応

抽出失敗・短縮リンク解決・プロフィール列挙は課金されません

活用例

  • ショート動画から RAG やファインチューニング用コーパスを構築
  • 話し言葉のコンテンツをブログ・ニュースレター・SNS 投稿へ再利用
  • 特定ジャンルの全クリエイターを対象にしたコンテンツ競合分析
  • 再投稿やローカライズ用の SRT/VTT 字幕ファイル作成
  • 冒頭フックの研究 — 上位動画の最初の数秒を一括で読む
  • タイアップ投稿のブランドセーフティ・表示確認を大規模に実施

入力パラメータ

パラメータ型必須説明
urlsarray必須TikTok の動画URL、短縮リンク、@ユーザー名、または生の動画ID
outputFormatstring任意json / srt / vtt / text / llm
languagesarray任意字幕言語を優先順で指定。前方一致に対応し、eng は eng-US に一致します
includeAutoGeneratedboolean任意手動字幕がない場合に TikTok の自動生成字幕を含めるかどうか
maxVideosinteger任意実行全体で処理する動画数の上限。0 は無制限
maxConcurrencyinteger任意並列数 1〜10。小さいほどレート制限に強くなります
proxyConfigurationobject任意住宅用プロキシを強く推奨 — TikTok はデータセンターIPを厳しく遮断します

出力例

 1{
 2  "videoId": "7627209981670001950",
 3  "url": "https://www.tiktok.com/@tiktok/video/7627209981670001950",
 4  "title": "your TikTok grandpa @writers cramp is proud of you",
 5  "authorName": "TikTok",
 6  "authorId": "tiktok",
 7  "createTime": "2026-04-10T19:10:35.000Z",
 8  "playCount": 54600,
 9  "likeCount": 3656,
10  "commentCount": 837,
11  "shareCount": 291,
12  "availableLanguages": ["eng-US"],
13  "language": "eng-US",
14  "isAutoGenerated": true,
15  "segments": [
16    { "text": "I'm 81 years old and I'm known as the TikTok Grandpa", "start": 0.04, "end": 3.64 },
17    { "text": "my name is Ian Smith", "start": 3.641, "end": 4.721 }
18  ],
19  "text": "I'm 81 years old and I'm known as the TikTok Grandpa my name is Ian Smith...",
20  "duration": 77,
21  "wordCount": 243,
22  "segmentCount": 29,
23  "extractedAt": "2026-04-12T02:45:36.000Z",
24  "error": null
25}

ヒント

まず1本で試す。 URL を1つ入れるだけで、スキーマと返ってくる字幕言語をプロフィール実行前に確認できます。 プロフィール実行では maxVideos を設定。 プロフィール単位ではなく実行全体の予算なので、混在入力でも超過しません。 並列数は3のまま。 TikTok のレート制限は厳しく、上げても安定性と引き換えの微増にしかなりません。 AI 用途なら llm 形式。 [Music]、話者ラベル、注釈が除去され、埋め込み時のノイズになりません。

よくある質問

Whisper や音声認識を使っていますか?
いいえ。TikTok 自身が生成し CDN から配信している字幕ファイルを取得します。そのため視聴者が見るテキストと完全に一致し、1本あたり数十秒ではなく約2秒で完了します。
字幕のない動画はどうなりますか?
error フィールド付きのレコードが返り、課金は発生しません。課金は送信したURL数ではなく、抽出に成功した文字起こし件数に対して行われます。
アカウント全体を取得できますか?
できます。プロフィールURLまたは @ユーザー名 を渡すと投稿動画を列挙します。maxVideos で上限を設定してください。明示した動画が優先され、残りの枠をプロフィールが埋めます。

~/social の関連ツール

TikTok 字幕・文字起こしスクレイパー — JSON, SRT, VTT, LLMを実行、またはカスタム開発を依頼

数分でApify上での抽出を開始できます。または、あなたの取得元とスキーマに合わせたオーダーメイドのスクレイパーとRAGパイプラインの構築を依頼できます。

Apifyで実行 カスタムデータを依頼