YouTube-Untertitel- & Transkript-Scraper — JSON, SRT, VTT, LLM
YouTube-Untertitel und -Transkripte aus Videos, Shorts, Playlists und Kanälen extrahieren — als JSON, SRT, VTT, Klartext oder sauberen LLM-fertigen Text. Über 100 Sprachen, umfangreiche Metadaten, kein API-Key — und fehlgeschlagene Extraktionen sind kostenlos.
Hauptfunktionen
Ein Input deckt Videos, Shorts, youtu.be-Links, Playlists und Kanäle ab — gemischt in einem einzigen Run
Fünf Output-Formate — JSON (mit Zeitstempeln), SRT, VTT, Klartext und LLM-fertig (entfernt [Music], [Applause] und Sprecher-Labels)
100+ Sprachen mit priorisierter Sprachliste und umschaltbarem Fallback auf Auto-Untertitel
Umfangreiche Metadaten — Titel, Kanal, Beschreibung, Veröffentlichungsdatum, Aufrufzahl, Thumbnail, Dauer und verfügbare Sprachen
Ganze Playlists und Kanäle im Batch verarbeiten, mit maxVideos-Obergrenze und 1–10 Concurrency
Unterstützung für Residential Proxys plus optionale Cookies zur Reduzierung von Bot-Check-Blockaden
Mehrschichtige Extraktion — bis zu neun Fallbacks über InnerTube-Clients hinweg, mit yt-dlp-PO-Token als letztem Ausweg
Circuit Breaker und Fehlerbehandlung pro Item halten große Batches am Laufen
Anwendungsfälle
- KI-/ML-Teams, die RAG- oder Fine-Tuning-Datensätze aus gesprochenem Video aufbauen (LLM-fertiger Text-Output)
- Content-Teams, die Transkripte zu Blogbeiträgen, Show-Notes und Social-Captions weiterverarbeiten
- SEO-Marketer, die durchsuchbaren Videotext für Indexierung und Keyword-Recherche extrahieren
- Redakteure und Verlage, die Standard-SRT/VTT-Untertiteldateien brauchen
- Forschende, die Transkripte im Batch über einen ganzen Kanal oder eine Playlist sammeln
- Entwickler, die strukturierte, zeitgestempelte Untertitel ohne YouTube-API-Key brauchen
Eingabeparameter
| Parameter | Typ | Erforderlich | Beschreibung |
|---|---|---|---|
urls | array | optional | YouTube-URLs oder reine IDs — Videos, Shorts, youtu.be-Links, Playlists oder Kanäle. Zur Laufzeit erforderlich. |
outputFormat | string | optional | Transkript-Format: json, srt, vtt, text oder llm (Standard: json). |
languages | array | optional | Bevorzugte Untertitelsprachen in Prioritätsreihenfolge, ISO-639-1-Codes (Standard: en). |
includeAutoGenerated | boolean | optional | Rückfall auf automatisch generierte Untertitel, wenn manuelle fehlen (Standard: true). |
maxVideos | number | optional | Obergrenze für verarbeitete Videos pro Run, z. B. bei Playlists/Kanälen (Standard: 0 = unbegrenzt). |
maxConcurrency | number | optional | Parallel verarbeitete Videos, 1–10 (Standard: 3). |
proxyConfiguration | object | optional | Proxy-Einstellungen; Standard ist Apify Residential, festgelegt auf die USA. |
youtubeCookies | string | optional | Optionale YouTube-Cookies (Cookie-Header oder cookies.txt) zur Reduzierung von Bot-Check-Blockaden. |
Beispiel-Output
1{
2 "videoId": "dQw4w9WgXcQ",
3 "url": "https://www.youtube.com/watch?v=dQw4w9WgXcQ",
4 "title": "Rick Astley - Never Gonna Give You Up (Official Video)",
5 "channelName": "Rick Astley",
6 "channelId": "UCuAXFkgsw1L7xaCfnd5JJOw",
7 "publishDate": "2009-10-25",
8 "viewCount": 1761003712,
9 "availableLanguages": ["en", "de-DE", "ja", "pt-BR", "es-419"],
10 "language": "en",
11 "isAutoGenerated": false,
12 "duration": 213,
13 "wordCount": 487,
14 "segmentCount": 61,
15 "text": "We're no strangers to love, you know the rules and so do I...",
16 "segments": [{ "text": "We're no strangers to love", "start": 18.64, "end": 21.88 }],
17 "error": null
18}
Preise
Pay-per-Event: abgerechnet einmal pro erfolgreich extrahiertem Transkript — fehlgeschlagene Videos werden nie berechnet. Einen ganzen Kanal oder eine Playlist einspeisen und nur für die tatsächlich erhaltenen Untertitel bezahlen.
Tipps
outputFormat: llmnutzen für RAG und Fine-Tuning — entfernt Nicht-Sprache-Annotationen, sodass Embeddings sauberen Fließtext sehen.- Residential Proxy aktiviert lassen. YouTube blockiert Rechenzentrums-IPs aggressiv; der Actor nutzt nicht ohne Grund standardmäßig US-Residential.
maxConcurrencybei großen Jobs mit 1–3 starten und schrittweise erhöhen — hohe Concurrency erhöht das Rate-Limit-Risiko bei großen Kanal-Scrapes.
FAQ
Brauche ich einen YouTube-API-Key oder einen Login?
Welche Sprachen und Untertitel-Typen werden unterstützt?
Werde ich für Videos berechnet, deren Extraktion fehlschlägt?
Kann ich sauberen, LLM-fertigen Text für RAG bekommen?
verwandt in ~/social
Bluesky Scraper — Beiträge, Profile, Feeds & Interaktionen
Bluesky-Beiträge, -Profile, -Feeds und -Interaktionen scrapen.
öffnen