बिल्ड गाइड · ऐप डेवलपर्स

YouTube वीडियो के लिए बहुभाषी सबटाइटल पाइपलाइन कैसे बनाएं

किसी लोकप्रिय वीडियो के ज़्यादातर दर्शक उसकी मूल भाषा नहीं बोलते। ट्रांसक्रिप्ट का अनुवाद करके टाइम वाली सबटाइटल फ़ाइलें एक्सपोर्ट करने वाली पाइपलाइन क्रिएटर्स और कोर्स प्लेटफ़ॉर्म को हर अपलोड के लिए अनुवादक रखे बिना उन तक पहुंचने में मदद करती है।

किसके लिए
लोकलाइज़ेशन टूल, इंटरनेशनल क्रिएटर्स, ई-लर्निंग प्लेटफ़ॉर्म
बनाने में समय
एक वीकेंड
API एंडपॉइंट
/transcripts/{video_id}/languages/transcripts/{video_id}/translate

यह कौन सी समस्या हल करता है

प्रोफ़ेशनल सबटाइटल अनुवाद धीमा है और प्रति मिनट के हिसाब से महंगा पड़ता है, इसलिए ज़्यादातर क्रिएटर्स सिर्फ़ एक भाषा में पब्लिश करते हैं। YouTube का ऑटो-ट्रांसलेट एक जैसा नहीं होता और उसे न एक्सपोर्ट किया जा सकता है, न एडिट। टीमों को कई भाषाओं में एडिट करने लायक, टाइम वाली सबटाइटल फ़ाइलें चाहिए जिन्हें वे खुद रिव्यू करके अपलोड कर सकें।

पहले वर्ज़न में क्या शामिल करें

  • पहले से मौजूद कैप्शन भाषाओं की पहचान
  • एक साथ कई टारगेट भाषाओं में अनुवाद
  • मूल टाइमिंग बरकरार रखते हुए SRT और VTT एक्सपोर्ट
  • अनुवाद रिव्यू करने के लिए साइड-बाय-साइड एडिटर
  • ब्रांड नामों और तकनीकी शब्दों के लिए ग्लॉसरी

इसे कैसे बनाएं, स्टेप बाय स्टेप

  1. 01

    मौजूदा भाषाएं जांचें

    /transcripts/{video_id}/languages कॉल करें और देखें कि कौन से कैप्शन ट्रैक पहले से मौजूद हैं, ताकि जो उपलब्ध है उसके अनुवाद पर पैसे खर्च न हों।

  2. 02

    सोर्स ट्रांसक्रिप्ट लाएं

    स्टार्ट और एंड टाइम वाले सेगमेंट पाने के लिए format.timestamp के साथ /transcribe कॉल करें।

  3. 03

    अनुवाद करें

    हर टारगेट भाषा के लिए /transcripts/{video_id}/translate कॉल करें। सेगमेंट की टाइमिंग मूल के साथ मेल खाती रहती है।

  4. 04

    सबटाइटल फ़ाइलें एक्सपोर्ट करें

    हर सेगमेंट को उसके स्टार्ट और एंड टाइम के साथ नंबर वाले SRT ब्लॉक या VTT क्यू के रूप में लिखें, फिर यूज़र्स को उन्हें डाउनलोड करने या YouTube पर अपलोड करने दें।

स्टार्टर कोड

यह आइडिया "रेसिपी 1: एक वीडियो डालें, स्ट्रक्चर्ड आउटपुट पाएं" पैटर्न पर बना है। अपने चैनल, प्रॉम्प्ट और स्टोरेज लगाएं।

import requests

API = "https://www.youtubetranscript.dev/api/v2"
HEADERS = {"Authorization": "Bearer yt_sk_live_YOUR_KEY"}

res = requests.post(f"{API}/transcribe", headers=HEADERS, json={
    "video": "https://www.youtube.com/watch?v=VIDEO_ID",
    "format": {"timestamp": True, "paragraphs": True},
}).json()

transcript = res["data"]["transcript"]
print(transcript["text"][:500])        # plain text for your LLM prompt
for seg in transcript["segments"][:3]:  # timestamps for deep links
    print(seg["start"], seg["text"])

इसे बनाना क्यों फायदेमंद है

प्रति वीडियो मिनट प्रति भाषा के हिसाब से कीमत रखें, या मासिक सब्सक्रिप्शन टियर बनाएं। बड़े पैमाने पर लोकलाइज़ करने वाले ई-लर्निंग प्लेटफ़ॉर्म और एजेंसियां सबसे अच्छे ग्राहक हैं, क्योंकि हर नई भाषा के साथ वैल्यू बढ़ती है।

इन गलतियों से बचें

  • बिना कॉन्टेक्स्ट के लाइन-दर-लाइन अनुवाद करना, जिससे कई सबटाइटल क्यू में फैले वाक्य टूट जाते हैं।
  • पढ़ने की स्पीड को नज़रअंदाज़ करना: अनुवादित टेक्स्ट मूल से लंबा हो सकता है, इसलिए प्रति सेकंड कैरेक्टर चेक करें।
  • उन भाषाओं के अनुवाद पर पैसे खर्च करना जिनमें पहले से इंसानों के बनाए कैप्शन हैं।

इस आइडिया से जुड़े सवाल

क्या मैं अनुवादित YouTube सबटाइटल SRT में डाउनलोड कर सकता हूं?

हां। API से ट्रांसक्रिप्ट का अनुवाद करें, फिर हर टाइम वाले सेगमेंट को SRT या VTT फ़ॉर्मेट में लिखें।

ट्रांसक्रिप्ट अनुवाद की लागत कितनी है?

अनुवाद की लागत ट्रांसक्रिप्ट टेक्स्ट के हर 2,500 कैरेक्टर पर लगभग 1 क्रेडिट है। नेटिव कैप्शन लाने की लागत प्रति वीडियो 1 क्रेडिट है।

क्या इसे डबिंग के लिए इस्तेमाल किया जा सकता है?

हां। अनुवादित, टाइम वाली स्क्रिप्ट ही वह इनपुट है जो ज़्यादातर AI वॉइस और डबिंग टूल को चाहिए।

आज ही बनाना शुरू करें

हर महीने 10 मुफ़्त क्रेडिट। क्रेडिट कार्ड की ज़रूरत नहीं।

YouTube सबटाइटल ट्रांसलेटर कैसे बनाएं (SRT और VTT) | YouTubeTranscript.dev