यह कौन सी समस्या हल करता है
स्थानीय पत्रकार और नागरिक जानना चाहते हैं कि अधिकारियों ने किसी ज़ोनिंग बदलाव, बजट मद या स्कूल नीति के बारे में क्या कहा। इसे ढूंढने के लिए कई बैठकों के घंटों के वीडियो खंगालने पड़ते हैं। एजेंडा और मिनट्स में पूरी चर्चा शायद ही दर्ज होती है, और कई स्थानीय न्यूज़रूम के पास अब हर बैठक में भेजने को रिपोर्टर नहीं हैं।
पहले वर्ज़न में क्या शामिल करें
- संस्था के चैनल से हर बैठक का ऑटोमैटिक इम्पोर्ट
- स्पीकर लेबल ताकि आप अधिकारी के हिसाब से सर्च कर सकें
- सालों की बैठकों में विषय और कीवर्ड सर्च
- किसी विषय या पते पर चर्चा होने पर अलर्ट
- रिकॉर्डिंग के सटीक पल के शेयर करने लायक लिंक
इसे कैसे बनाएं, स्टेप बाय स्टेप
- 01
बैठकों के वीडियो इकट्ठा करें
परिषद का चैनल या मीटिंग प्लेलिस्ट resolve करें और नए अपलोड चेक करते रहें।
- 02
स्पीकर के साथ ट्रांसक्राइब करें
speakerLabels चालू करके ASR इस्तेमाल करें, और जाने-पहचाने नामों के साथ speakerId, ताकि हर हिस्सा किसी स्पीकर से जुड़े। बैठकें लंबी होती हैं, इसलिए लागत देखने के लिए estimate एंडपॉइंट इस्तेमाल करें।
- 03
बैठक और स्पीकर के हिसाब से इंडेक्स करें
पैराग्राफ़ को बैठक की तारीख, स्पीकर और टाइमस्टैम्प के साथ स्टोर करें, और फ़ुल-टेक्स्ट और सिमेंटिक सर्च जोड़ें।
- 04
अलर्ट जोड़ें
यूज़र्स को किसी सड़क के नाम या नीति विषय जैसे सर्च सेव करने दें और नई बैठक में वह आने पर उन्हें ईमेल करें।
स्टार्टर कोड
यह आइडिया "रेसिपी 3: पूरी प्लेलिस्ट को नॉलेज बेस में लोड करें" पैटर्न पर बना है। अपने चैनल, प्रॉम्प्ट और स्टोरेज लगाएं।
import requests
API = "https://www.youtubetranscript.dev/api/v2"
HEADERS = {"Authorization": "Bearer yt_sk_live_YOUR_KEY"}
playlist = requests.post(f"{API}/playlists/resolve", headers=HEADERS,
json={"playlist_url": "https://www.youtube.com/playlist?list=PLAYLIST_ID",
"limit": 100}).json()
ids = [v["video_id"] for v in playlist["items"]]
batch = requests.post(f"{API}/batch", headers=HEADERS, json={
"video_ids": ids,
"format": {"timestamp": True, "paragraphs": True},
}).json()
# Large batches run async: poll GET /batch/{batch_id} until status is "completed"
for r in batch.get("results", []):
if r["status"] == "completed":
for p in r["data"]["transcript"].get("paragraphs") or []:
store(video_id=r["video_id"], start=p["start"], text=p["text"]) # your vector DBइसे बनाना क्यों फायदेमंद है
स्थानीय न्यूज़ आउटलेट, एडवोकेसी ग्रुप और रियल एस्टेट या पॉलिसी फ़र्में अलर्ट और रिसर्च टूल के लिए पैसे देंगी। सिविक प्रोजेक्ट अक्सर ग्रांट पर चलते हैं या पेड अलर्ट के साथ मुफ़्त सार्वजनिक आर्काइव देते हैं।
इन गलतियों से बचें
- कई स्पीकर वाली लंबी बैठकों के लिए ऑटोमैटिक कैप्शन पर निर्भर रहना: स्पीकर लेबल आर्काइव को कहीं ज़्यादा उपयोगी बनाते हैं।
- लंबाई को कम आंकना: बैठकें घंटों चलती हैं, इसलिए पुरानी बैठकों का ढेर ट्रांसक्राइब करने से पहले ASR क्रेडिट का अनुमान लगाएं।
- बिना कॉन्टेक्स्ट के पब्लिश करना: हर कोट को रिकॉर्डिंग से लिंक करें ताकि पाठक खुद सुन सकें।
इस आइडिया से जुड़े सवाल
क्या मैं YouTube से नगर परिषद की बैठकें ट्रांसक्राइब कर सकता हूं?
हां। कैप्शन हों तो उन्हें इस्तेमाल करें, या लंबी बैठकों के ज़्यादा पढ़ने लायक ट्रांसक्रिप्ट के लिए स्पीकर लेबल के साथ AI स्पीच रिकग्निशन।
कौन बोल रहा है, यह कैसे पहचानूं?
स्पीकर अलग करने के लिए स्पीकर लेबल चालू करें, और उन्हें नाम देने के लिए जाने-पहचाने नामों या भूमिकाओं की लिस्ट के साथ स्पीकर आइडेंटिफ़िकेशन।
तीन घंटे की बैठक ट्रांसक्राइब करने में कितना खर्च आता है?
AI स्पीच रिकग्निशन की लागत ऐड-ऑन से पहले लगभग 40 क्रेडिट प्रति घंटा है। शुरू करने से पहले सटीक लागत देखने के लिए estimate एंडपॉइंट इस्तेमाल करें।