BYGGGUIDE · APPUTVECKLARE

Så bygger du ett flerspråkigt undertextflöde för YouTube-videor

De flesta som tittar på en populär video talar inte dess originalspråk. Ett undertextflöde som översätter transkript och exporterar tidssatta undertextfiler hjälper kreatörer och kursplattformar att nå dem utan att anlita översättare för varje uppladdning.

Vem det är för
Lokaliseringsverktyg, internationella kreatörer, e-lärandeplattformar
Byggtid
En helg
API-endpoints
/transcripts/{video_id}/languages/transcripts/{video_id}/translate

Problemet det löser

Professionell översättning av undertexter är långsam och prissätts per minut, så de flesta kreatörer publicerar bara på ett språk. YouTubes automatiska översättning är ojämn och kan inte exporteras eller redigeras. Team behöver redigerbara, tidssatta undertextfiler på flera språk som de kan granska och ladda upp själva.

Vad den första versionen bör innehålla

  • Identifiering av undertextspråk som redan finns
  • Översättning till många målspråk samtidigt
  • Export till SRT och VTT med originaltiderna bevarade
  • En editor sida vid sida för att granska översättningar
  • En ordlista för varumärkesnamn och facktermer

Så bygger du det, steg för steg

  1. 01

    Kontrollera befintliga språk

    Anropa /transcripts/{video_id}/languages för att se vilka undertextspår som redan finns, så att du inte betalar för att översätta det som redan är tillgängligt.

  2. 02

    Hämta källtranskriptet

    Anropa /transcribe med format.timestamp för att få segment med start- och sluttider.

  3. 03

    Översätt

    Anropa /transcripts/{video_id}/translate för varje målspråk. Segmentens tider förblir synkade med originalet.

  4. 04

    Exportera undertextfiler

    Skriv ut varje segment som ett numrerat SRT-block eller en VTT-cue med dess start- och sluttider, och låt sedan användarna ladda ner dem eller ladda upp dem till YouTube.

Startkod

Den här idén bygger på mönstret "Recept 1: En video in, strukturerat resultat ut". Byt till dina egna kanaler, promptar och lagring.

import requests

API = "https://www.youtubetranscript.dev/api/v2"
HEADERS = {"Authorization": "Bearer yt_sk_live_YOUR_KEY"}

res = requests.post(f"{API}/transcribe", headers=HEADERS, json={
    "video": "https://www.youtube.com/watch?v=VIDEO_ID",
    "format": {"timestamp": True, "paragraphs": True},
}).json()

transcript = res["data"]["transcript"]
print(transcript["text"][:500])        # plain text for your LLM prompt
for seg in transcript["segments"][:3]:  # timestamps for deep links
    print(seg["start"], seg["text"])

Därför är det värt att bygga

Prissätt per videominut och språk, eller med månatliga prenumerationsnivåer. E-lärandeplattformar och byråer som lokaliserar i stor skala är de bästa kunderna eftersom värdet växer med varje språk som läggs till.

Misstag att undvika

  • Att översätta rad för rad utan sammanhang, vilket bryter meningar som sträcker sig över flera undertextrader.
  • Att ignorera läshastigheten: översatt text kan bli längre än originalet, så kontrollera antalet tecken per sekund.
  • Att betala för att översätta till språk som redan har mänskligt skapade undertexter.

Frågor om den här idén

Kan jag ladda ner översatta YouTube-undertexter som SRT?

Ja. Översätt transkriptet via API:et och skriv sedan ut varje tidssatt segment i SRT- eller VTT-format.

Vad kostar det att översätta ett transkript?

Översättning kostar ungefär 1 kredit per 2 500 tecken transkripttext. Att hämta inbyggda undertexter kostar 1 kredit per video.

Kan det användas för dubbning?

Ja. Det översatta, tidssatta manuset är just den indata som de flesta AI-röst- och dubbningsverktyg behöver.

Börja bygga i dag

10 gratis krediter varje månad. Inget kreditkort behövs.

Bygg en översättare för YouTube-undertexter (SRT och VTT) | YouTubeTranscript.dev