यह कौन सी समस्या हल करता है
इन्फ्लुएंसर टीमें कुछ हालिया वीडियो देखकर क्रिएटर्स की जांच करती हैं। उनसे छह महीने पुरानी कॉम्पिटिटर स्पॉन्सरशिप, कोई विवादित टिप्पणी, या कैमरे पर स्पॉन्सर्स का मज़ाक उड़ाने की आदत छूट जाती है। कैंपेन लॉन्च होने के बाद यह पता चलना महंगा पड़ता है। सैकड़ों घंटे हाथ से रिव्यू करना नामुमकिन है।
पहले वर्ज़न में क्या शामिल करें
- क्रिएटर के हालिया वीडियो का बल्क एनालिसिस
- पिछले स्पॉन्सर्स और कॉम्पिटिटर ब्रांड की पहचान
- गाली-गलौज, संवेदनशील विषयों और विवादों के लिए कंटेंट-सेफ़्टी फ़्लैग
- स्पॉन्सर्स और प्रोडक्ट कैटेगरी के प्रति सेंटिमेंट
- कोट और टाइमस्टैम्प वाले सबूतों के साथ शेयर करने लायक रिपोर्ट
इसे कैसे बनाएं, स्टेप बाय स्टेप
- 01
पुराने वीडियो लाएं
हालिया वीडियो ID पाने के लिए क्रिएटर के हैंडल और 100 से 500 की लिमिट के साथ /channels/resolve कॉल करें।
- 02
एक बैच में ट्रांसक्राइब करें
ID को /batch पर भेजें। बिना कैप्शन वाले वीडियो के लिए, कंटेंट मॉडरेशन और सेंटिमेंट एनालिसिस जैसे ASR विकल्प स्ट्रक्चर्ड सेफ़्टी सिग्नल जोड़ते हैं।
- 03
स्पॉन्सर और जोखिम निकालें
हर ट्रांसक्रिप्ट पर LLM चलाएं ताकि बताए गए स्पॉन्सर, कॉम्पिटिटर ब्रांड और ब्रांड की जोखिम कैटेगरी से मेल खाने वाले बयान लिस्ट हों।
- 04
स्कोर और रिपोर्ट
नतीजों को हर कैटेगरी के स्कोर में जोड़ें और ऐसी रिपोर्ट बनाएं जिसमें हर फ़्लैग कोट और टाइमस्टैम्प से लिंक हो।
स्टार्टर कोड
यह आइडिया "रेसिपी 3: पूरी प्लेलिस्ट को नॉलेज बेस में लोड करें" पैटर्न पर बना है। अपने चैनल, प्रॉम्प्ट और स्टोरेज लगाएं।
import requests
API = "https://www.youtubetranscript.dev/api/v2"
HEADERS = {"Authorization": "Bearer yt_sk_live_YOUR_KEY"}
playlist = requests.post(f"{API}/playlists/resolve", headers=HEADERS,
json={"playlist_url": "https://www.youtube.com/playlist?list=PLAYLIST_ID",
"limit": 100}).json()
ids = [v["video_id"] for v in playlist["items"]]
batch = requests.post(f"{API}/batch", headers=HEADERS, json={
"video_ids": ids,
"format": {"timestamp": True, "paragraphs": True},
}).json()
# Large batches run async: poll GET /batch/{batch_id} until status is "completed"
for r in batch.get("results", []):
if r["status"] == "completed":
for p in r["data"]["transcript"].get("paragraphs") or []:
store(video_id=r["video_id"], start=p["start"], text=p["text"]) # your vector DBकमाई कैसे होती है
कभी-कभार जांच करने वाले ब्रांड से प्रति रिपोर्ट चार्ज करें, और हर हफ़्ते जांच करने वाली एजेंसियों और क्रिएटर मार्केटप्लेस को सीट-आधारित प्लान बेचें। एक नाकाम स्पॉन्सरशिप की लागत के सामने कीमत को सही ठहराना आसान है।
इन गलतियों से बचें
- बिना सबूत के फ़्लैग करना: हर जोखिम के साथ कोट और टाइमस्टैम्प होना चाहिए ताकि इंसान कॉन्टेक्स्ट परख सके।
- हर तरह की गाली को बराबर जोखिम मानना: हर ब्रांड को अपनी सीमाएं तय करने दें।
- सिर्फ़ हालिया वीडियो एनालाइज़ करना: कॉम्पिटिटर डील अक्सर और पीछे मिलती हैं।
इस आइडिया से जुड़े सवाल
ब्रांड YouTube इन्फ्लुएंसर्स की जांच कैसे करते हैं?
ज़्यादातर कुछ वीडियो हाथ से देखते हैं। ट्रांसक्रिप्ट एनालिसिस से आप मिनटों में क्रिएटर के पूरे हालिया कैटलॉग में स्पॉन्सर, संवेदनशील विषय और टोन रिव्यू कर सकते हैं।
क्या मैं पता लगा सकता हूं कि किसी YouTuber ने किन स्पॉन्सर्स के साथ काम किया है?
हां। स्पॉन्सरशिप रीड बोले जाते हैं, इसलिए LLM ट्रांसक्रिप्ट से ब्रांड नाम और ऐड सेगमेंट निकाल सकता है।
एक वेटिंग रिपोर्ट में कितने वीडियो होने चाहिए?
एक अच्छा डिफ़ॉल्ट पिछले 100 वीडियो या 12 महीने हैं, जो भी ज़्यादा हो। Business प्लान पर बैच रिक्वेस्ट में 3,000 वीडियो तक शामिल हो सकते हैं।