یہ کون سا مسئلہ حل کرتا ہے
کوچز اور معلمین ہر روز کمنٹس اور DMs میں ایک ہی سوالات کے جواب دیتے ہیں، حالانکہ وہ ان پر ویڈیوز بنا چکے ہیں۔ ان کے ناظرین صحیح ویڈیو نہیں ڈھونڈ پاتے، اور کریئیٹر ذاتی جوابات کو بڑھا نہیں سکتا۔ چینل چیٹ بوٹ کریئیٹر کے انداز میں جواب دیتا ہے اور ناظرین کو اصل مواد کی طرف واپس لاتا ہے۔
پہلے ورژن میں کیا شامل کریں
- جوابات صرف کریئیٹر کی اپنی ویڈیوز سے
- عین ویڈیو اور ٹائم اسٹیمپ سے لنک ہونے والے حوالے
- نئی ویڈیوز شائع ہونے پر خودکار اپڈیٹس
- سوالات کی حد کے ساتھ مفت درجہ اور ممبرز کے لیے ادا شدہ درجہ
- کریئیٹر کی ویب سائٹ یا کمیونٹی کے لیے ایمبیڈ کیا جا سکنے والا ویجٹ
اسے مرحلہ وار کیسے بنائیں
- 01
چینل شامل کریں
چینل یا منتخب پلے لسٹ کو resolve کریں اور تمام ویڈیو IDs کو format.paragraphs اور format.timestamp کے ساتھ /batch پر بھیجیں۔
- 02
ٹکڑے بنائیں اور ایمبیڈ کریں
ہر پیراگراف کو اس کی ویڈیو کے عنوان، URL اور آغاز کے وقت کے ساتھ محفوظ کریں، اور ویکٹر ڈیٹا بیس میں ایمبیڈنگز بنائیں۔
- 03
حاصل کریں اور جواب دیں
ہر سوال کے لیے سب سے متعلقہ پیراگراف حاصل کریں اور LLM سے صرف انہی کی بنیاد پر، ویڈیو اور ٹائم اسٹیمپ کے حوالے کے ساتھ، جواب دینے کو کہیں۔
- 04
تازہ رہیں
شیڈول کے مطابق چینل پر نئی اپلوڈز چیک کریں اور صرف نئے ٹرانسکرپٹس انڈیکس میں شامل کریں۔
اسٹارٹر کوڈ
یہ آئیڈیا "ترکیب 3: پلے لسٹ کو بڑی تعداد میں نالج بیس میں لوڈ کریں" پیٹرن پر بنا ہے۔ اپنے چینلز، پرامپٹس اور اسٹوریج شامل کریں۔
import requests
API = "https://www.youtubetranscript.dev/api/v2"
HEADERS = {"Authorization": "Bearer yt_sk_live_YOUR_KEY"}
playlist = requests.post(f"{API}/playlists/resolve", headers=HEADERS,
json={"playlist_url": "https://www.youtube.com/playlist?list=PLAYLIST_ID",
"limit": 100}).json()
ids = [v["video_id"] for v in playlist["items"]]
batch = requests.post(f"{API}/batch", headers=HEADERS, json={
"video_ids": ids,
"format": {"timestamp": True, "paragraphs": True},
}).json()
# Large batches run async: poll GET /batch/{batch_id} until status is "completed"
for r in batch.get("results", []):
if r["status"] == "completed":
for p in r["data"]["transcript"].get("paragraphs") or []:
store(video_id=r["video_id"], start=p["start"], text=p["text"]) # your vector DBیہ پیسے کیسے کماتا ہے
ہوسٹ کیے گئے چیٹ بوٹ کے لیے کریئیٹر سے ماہانہ فیس لیں، یا اس ادا شدہ درجے کی آمدنی میں حصہ لیں جو وہ اپنے ناظرین کو بیچیں۔ ممبرشپ کمیونٹیز اور کورس بیچنے والے اسے پریمیم سہولت کے طور پر شامل کر سکتے ہیں۔
ان غلطیوں سے بچیں
- ماڈل کو عمومی معلومات سے جواب دینے دینا: اسے حاصل کردہ ٹرانسکرپٹ اقتباسات تک محدود رکھیں تاکہ وہ کریئیٹر جیسا لگے۔
- مقررہ سائز کے ٹکڑے استعمال کرنا جو جملوں کو آدھا کاٹ دیں: پیراگراف گروپنگ سیاق و سباق برقرار رکھتی ہے۔
- کریئیٹر کی منظوری کے بغیر لانچ کرنا: کریئیٹر کے ساتھ مل کر بنائیں، کیونکہ آواز اور مواد ان کا ہے۔
اس آئیڈیا کے بارے میں سوالات
کیا میں YouTube چینل پر چیٹ بوٹ تربیت دے سکتا ہوں؟
جی ہاں۔ ماڈل کو تربیت دینے کے بجائے آپ متعلقہ ٹرانسکرپٹ اقتباسات حاصل کرتے ہیں اور LLM ان سے جواب دیتا ہے۔ اسے retrieval-augmented generation کہتے ہیں۔
چیٹ بوٹ سے ماخذ کا حوالہ کیسے دلواؤں؟
ہر ٹرانسکرپٹ ٹکڑے کے ساتھ ویڈیو URL اور آغاز کا وقت محفوظ کریں اور ماڈل کو ہدایت دیں کہ ہر جواب میں انہیں شامل کرے۔
پورے چینل کو انڈیکس کرنے پر کتنی لاگت آتی ہے؟
اصل کیپشنز والی ویڈیوز پر فی ویڈیو 1 کریڈٹ لگتا ہے۔ 300 ویڈیوز والے چینل کو ایک بار انڈیکس کرنے پر تقریباً 300 کریڈٹس لگتے ہیں، اور اس کے بعد صرف نئی اپلوڈز پر۔