यह कौन सी समस्या हल करता है
स्कूलों और कोर्स क्रिएटर्स के पास अक्सर सैकड़ों वीडियो होते हैं जिनके ट्रांसक्रिप्ट नहीं होते, या सिर्फ़ ऑटोमैटिक कैप्शन होते हैं जिन्हें डॉक्यूमेंट की तरह पढ़ा नहीं जा सकता। एक्सेसिबिलिटी ऑफ़िस को सुविधा के अनुरोध एक-एक करके मिलते हैं। हर चीज़ के लिए पढ़ने लायक ट्रांसक्रिप्ट पब्लिश करने से बैकलॉग खत्म होता है और हर छात्र को फ़ायदा होता है।
पहले वर्ज़न में क्या शामिल करें
- किसी कोर्स या चैनल के हर वीडियो के ट्रांसक्रिप्ट
- बिना कैप्शन वाले वीडियो के लिए AI स्पीच रिकग्निशन
- पढ़ने में आसानी के लिए पैराग्राफ़ और स्पीकर लेबल
- स्क्रीन रीडर से आसानी से नेविगेट होने वाले HTML ट्रांसक्रिप्ट पेज
- डाउनलोड करने लायक टेक्स्ट और सबटाइटल फ़ाइलें
इसे कैसे बनाएं, स्टेप बाय स्टेप
- 01
वीडियो की सूची बनाएं
हर कोर्स प्लेलिस्ट या चैनल resolve करें ताकि उन सभी वीडियो की लिस्ट बने जिन्हें ट्रांसक्रिप्ट चाहिए।
- 02
बल्क में ट्रांसक्राइब करें
ID को format.paragraphs के साथ /batch पर भेजें। वेबहुक के साथ allow_asr चालू करें ताकि बिना कैप्शन वाले वीडियो AI स्पीच रिकग्निशन से ट्रांसक्राइब हों।
- 03
पढ़ने में आसान बनाएं
कई स्पीकर वाले लेक्चर के लिए ASR स्पीकर लेबल इस्तेमाल करें। पैराग्राफ़ ब्रेक और हेडिंग रखें ताकि ट्रांसक्रिप्ट डॉक्यूमेंट की तरह पढ़े जाएं।
- 04
पब्लिश करें
हर ट्रांसक्रिप्ट को वीडियो के नीचे HTML पेज या खुलने-बंद होने वाले सेक्शन के रूप में, डाउनलोड लिंक के साथ दिखाएं।
स्टार्टर कोड
यह आइडिया "रेसिपी 3: पूरी प्लेलिस्ट को नॉलेज बेस में लोड करें" पैटर्न पर बना है। अपने चैनल, प्रॉम्प्ट और स्टोरेज लगाएं।
import requests
API = "https://www.youtubetranscript.dev/api/v2"
HEADERS = {"Authorization": "Bearer yt_sk_live_YOUR_KEY"}
playlist = requests.post(f"{API}/playlists/resolve", headers=HEADERS,
json={"playlist_url": "https://www.youtube.com/playlist?list=PLAYLIST_ID",
"limit": 100}).json()
ids = [v["video_id"] for v in playlist["items"]]
batch = requests.post(f"{API}/batch", headers=HEADERS, json={
"video_ids": ids,
"format": {"timestamp": True, "paragraphs": True},
}).json()
# Large batches run async: poll GET /batch/{batch_id} until status is "completed"
for r in batch.get("results", []):
if r["status"] == "completed":
for p in r["data"]["transcript"].get("paragraphs") or []:
store(video_id=r["video_id"], start=p["start"], text=p["text"]) # your vector DBइसे बनाना क्यों फायदेमंद है
संस्थानों के लिए फ़ायदा है एक्सेसिबिलिटी की ज़िम्मेदारियां तेज़ी से पूरी करना और कोर्स कंटेंट को ज़्यादा उपयोगी और खोजने लायक बनाना। एजेंसियां और प्लेटफ़ॉर्म स्कूलों को ट्रांसक्रिप्ट पब्लिशिंग सर्विस के रूप में बेच सकते हैं।
इन गलतियों से बचें
- ऑटोमैटिक कैप्शन को टेक्स्ट के एक लंबे ब्लॉक की तरह पब्लिश करना: पैराग्राफ़ और स्पीकर के साथ फ़ॉर्मेट करें।
- ट्रांसक्रिप्ट को सिर्फ़ डाउनलोड के पीछे छिपाना: टेक्स्ट पेज पर रखें ताकि वह पढ़ा और इंडेक्स किया जा सके।
- AI आउटपुट को परफ़ेक्ट मान लेना: किसी से तकनीकी शब्द और नाम जांचवाएं, खासकर ज़रूरी सुविधाओं के लिए।
इस आइडिया से जुड़े सवाल
क्या ट्रांसक्रिप्ट वीडियो एक्सेसिबिलिटी में मदद करते हैं?
हां। ट्रांसक्रिप्ट बधिर और कम सुनने वाले यूज़र्स और स्क्रीन रीडर यूज़र्स को बोले गए कंटेंट तक पूरी पहुंच देते हैं, और आम एक्सेसिबिलिटी गाइडलाइंस इन्हें कैप्शन के साथ रखने की सलाह देती हैं।
क्या ट्रांसक्रिप्ट SEO में मदद करते हैं?
पेज पर टेक्स्ट के रूप में पब्लिश ट्रांसक्रिप्ट सर्च इंजन को सिर्फ़ वीडियो एम्बेड के मुकाबले इंडेक्स करने के लिए ज़्यादा प्रासंगिक कंटेंट देते हैं।
अगर किसी वीडियो में कैप्शन न हों तो?
AI स्पीच रिकग्निशन चालू करें और API 99 में से किसी भी भाषा में ऑडियो ट्रांसक्राइब कर देता है।