~/social/youtube-transcript-scraper

YouTube-Untertitel- & Transkript-Scraper — JSON, SRT, VTT, LLM

YouTube-Untertitel und -Transkripte aus Videos, Shorts, Playlists und Kanälen extrahieren — als JSON, SRT, VTT, Klartext oder sauberen LLM-fertigen Text. Über 100 Sprachen, umfangreiche Metadaten, kein API-Key — und fehlgeschlagene Extraktionen sind kostenlos.

Medien TypeScriptInnerTube Weltweit
proooxy/youtube-transcript-scraper — Steckbrief
Kategoriesocial / Medien
SpracheTypeScript
StackTypeScript, InnerTube
MärkteWeltweit
Outputsauberes, RAG-fertiges JSON

Hauptfunktionen

Ein Input deckt Videos, Shorts, youtu.be-Links, Playlists und Kanäle ab — gemischt in einem einzigen Run

Fünf Output-Formate — JSON (mit Zeitstempeln), SRT, VTT, Klartext und LLM-fertig (entfernt [Music], [Applause] und Sprecher-Labels)

100+ Sprachen mit priorisierter Sprachliste und umschaltbarem Fallback auf Auto-Untertitel

Umfangreiche Metadaten — Titel, Kanal, Beschreibung, Veröffentlichungsdatum, Aufrufzahl, Thumbnail, Dauer und verfügbare Sprachen

Ganze Playlists und Kanäle im Batch verarbeiten, mit maxVideos-Obergrenze und 1–10 Concurrency

Unterstützung für Residential Proxys plus optionale Cookies zur Reduzierung von Bot-Check-Blockaden

Mehrschichtige Extraktion — bis zu neun Fallbacks über InnerTube-Clients hinweg, mit yt-dlp-PO-Token als letztem Ausweg

Circuit Breaker und Fehlerbehandlung pro Item halten große Batches am Laufen

Anwendungsfälle

  • KI-/ML-Teams, die RAG- oder Fine-Tuning-Datensätze aus gesprochenem Video aufbauen (LLM-fertiger Text-Output)
  • Content-Teams, die Transkripte zu Blogbeiträgen, Show-Notes und Social-Captions weiterverarbeiten
  • SEO-Marketer, die durchsuchbaren Videotext für Indexierung und Keyword-Recherche extrahieren
  • Redakteure und Verlage, die Standard-SRT/VTT-Untertiteldateien brauchen
  • Forschende, die Transkripte im Batch über einen ganzen Kanal oder eine Playlist sammeln
  • Entwickler, die strukturierte, zeitgestempelte Untertitel ohne YouTube-API-Key brauchen

Eingabeparameter

ParameterTypErforderlichBeschreibung
urlsarrayoptionalYouTube-URLs oder reine IDs — Videos, Shorts, youtu.be-Links, Playlists oder Kanäle. Zur Laufzeit erforderlich.
outputFormatstringoptionalTranskript-Format: json, srt, vtt, text oder llm (Standard: json).
languagesarrayoptionalBevorzugte Untertitelsprachen in Prioritätsreihenfolge, ISO-639-1-Codes (Standard: en).
includeAutoGeneratedbooleanoptionalRückfall auf automatisch generierte Untertitel, wenn manuelle fehlen (Standard: true).
maxVideosnumberoptionalObergrenze für verarbeitete Videos pro Run, z. B. bei Playlists/Kanälen (Standard: 0 = unbegrenzt).
maxConcurrencynumberoptionalParallel verarbeitete Videos, 1–10 (Standard: 3).
proxyConfigurationobjectoptionalProxy-Einstellungen; Standard ist Apify Residential, festgelegt auf die USA.
youtubeCookiesstringoptionalOptionale YouTube-Cookies (Cookie-Header oder cookies.txt) zur Reduzierung von Bot-Check-Blockaden.

Beispiel-Output

 1{
 2  "videoId": "dQw4w9WgXcQ",
 3  "url": "https://www.youtube.com/watch?v=dQw4w9WgXcQ",
 4  "title": "Rick Astley - Never Gonna Give You Up (Official Video)",
 5  "channelName": "Rick Astley",
 6  "channelId": "UCuAXFkgsw1L7xaCfnd5JJOw",
 7  "publishDate": "2009-10-25",
 8  "viewCount": 1761003712,
 9  "availableLanguages": ["en", "de-DE", "ja", "pt-BR", "es-419"],
10  "language": "en",
11  "isAutoGenerated": false,
12  "duration": 213,
13  "wordCount": 487,
14  "segmentCount": 61,
15  "text": "We're no strangers to love, you know the rules and so do I...",
16  "segments": [{ "text": "We're no strangers to love", "start": 18.64, "end": 21.88 }],
17  "error": null
18}

Preise

Pay-per-Event: abgerechnet einmal pro erfolgreich extrahiertem Transkript — fehlgeschlagene Videos werden nie berechnet. Einen ganzen Kanal oder eine Playlist einspeisen und nur für die tatsächlich erhaltenen Untertitel bezahlen.

Tipps

  • outputFormat: llm nutzen für RAG und Fine-Tuning — entfernt Nicht-Sprache-Annotationen, sodass Embeddings sauberen Fließtext sehen.
  • Residential Proxy aktiviert lassen. YouTube blockiert Rechenzentrums-IPs aggressiv; der Actor nutzt nicht ohne Grund standardmäßig US-Residential.
  • maxConcurrency bei großen Jobs mit 1–3 starten und schrittweise erhöhen — hohe Concurrency erhöht das Rate-Limit-Risiko bei großen Kanal-Scrapes.

FAQ

Brauche ich einen YouTube-API-Key oder einen Login?
Nein. Der Actor extrahiert Untertitel direkt — kein YouTube-Data-API-Key und kein Login. Optional lässt sich ein Cookies-Input angeben, um „Sign in to confirm you're not a bot”-Blockaden bei manchen Videos zu reduzieren.
Welche Sprachen und Untertitel-Typen werden unterstützt?
Über 100 Sprachen. Eine priorisierte Liste von ISO-639-1-Codes angeben (Standard: en); der Actor bevorzugt manuell erstellte Untertitel und fällt auf automatisch generierte zurück, sofern includeAutoGenerated nicht deaktiviert wird.
Werde ich für Videos berechnet, deren Extraktion fehlschlägt?
Nein. Die Abrechnung erfolgt Pay-per-Event auf ein einzelnes „Transkript extrahiert”-Event, berechnet erst, nachdem ein Transkript erfolgreich gespeichert wurde. Fehlgeschlagene Videos erscheinen im Output mit einem error-Feld und werden nicht berechnet.
Kann ich sauberen, LLM-fertigen Text für RAG bekommen?
Ja. outputFormat auf „llm” setzen, um [Music]/[Applause]-Annotationen und Sprecher-Labels zu entfernen — das Ergebnis ist sauberer Fließtext, ideal für Embeddings und Fine-Tuning.

verwandt in ~/social

YouTube-Untertitel- & Transkript-Scraper — JSON, SRT, VTT, LLM ausführen oder ein individuelles Projekt anfragen

In wenigen Minuten mit der Extraktion auf Apify starten, oder mich für einen maßgeschneiderten Scraper und eine RAG-Pipeline exakt nach Quelle und Schema beauftragen.

auf Apify ausführen individuelle Daten anfragen