বিল্ড গাইড · গবেষক

YouTube-এর জন্য দাবি ও ভুল তথ্য ট্র্যাকার কীভাবে বানাবেন

মিথ্যা ও বিভ্রান্তিকর দাবি প্রায়ই লেখায় আসার আগে মৌখিক ভিডিওর মাধ্যমে ছড়ায়। একটি দাবি ট্র্যাকার অনেক চ্যানেলের ট্রান্সক্রিপ্ট সার্চ করে দেখায় কে কী বলেছে, প্রথম কখন দেখা দিয়েছে আর শব্দচয়ন কীভাবে বদলেছে, প্রতিটি উদ্ধৃতি যাচাইয়ের লিংকসহ।

কাদের জন্য
ফ্যাক্ট-চেকার, সাংবাদিকতা স্কুল, ট্রাস্ট অ্যান্ড সেফটি গবেষক
বানাতে সময়
1–2 সপ্তাহ
API এন্ডপয়েন্ট
/batch/transcripts/{video_id}

যে সমস্যার সমাধান করে

ফ্যাক্ট-চেকাররা টেক্সট প্ল্যাটফর্ম সার্চ করতে পারেন, কিন্তু ভিডিও প্রায় অস্বচ্ছ। দাবিগুলো কয়েক ডজন চ্যানেলে সামান্য ভিন্ন শব্দে বারবার বলা হয়, আর সেগুলোর বিস্তার নথিভুক্ত করতে ঘণ্টার পর ঘণ্টা ফুটেজ দেখতে হয়। গবেষকদের দরকার সার্চযোগ্য ট্রান্সক্রিপ্ট, ভাবার্থ মেলানোর সিমান্টিক ম্যাচিং এবং প্রতিটি ঘটনার যাচাইযোগ্য রেকর্ড।

প্রথম ভার্সনে কী কী রাখবেন

  • নির্ধারিত চ্যানেলগুলোর মনিটরিং
  • হুবহু শব্দ নয়, দাবির ভাবার্থের জন্যও সিমান্টিক সার্চ
  • প্রথম উপস্থিতি ও বিস্তার দেখানো একটি টাইমলাইন
  • যাচাইয়ের জন্য টাইমস্ট্যাম্প লিংকসহ উদ্ধৃতি
  • রিপোর্ট ও প্রকাশনার জন্য এক্সপোর্টযোগ্য প্রমাণ

ধাপে ধাপে কীভাবে বানাবেন

  1. 01

    ট্রান্সক্রিপ্ট সংগ্রহ করুন

    পরিধির মধ্যে থাকা চ্যানেলগুলো রিজলভ করুন এবং আপনার সময়সীমার ভিডিওগুলো ব্যাচে আনুন। গবেষণা চলমান থাকলে নতুন আপলোড মনিটর করতে থাকুন।

  2. 02

    সেগমেন্ট এমবেড করুন

    প্রতিটি ট্রান্সক্রিপ্ট অনুচ্ছেদের জন্য এমবেডিং তৈরি করুন, যাতে একই অর্থের বক্তব্য খুঁজে পাওয়া যায়।

  3. 03

    দাবিটি সার্চ করুন

    দাবিটির কয়েকটি ভিন্ন রূপ এমবেড করুন, মিল আছে এমন অংশ আনুন, এবং একজন রিভিউয়ার বা LLM দিয়ে নিশ্চিত করুন কোনগুলো আসলে দাবিটি করছে।

  4. 04

    টাইমলাইন তৈরি করুন

    নিশ্চিত মিলগুলো প্রকাশের তারিখ অনুযায়ী সাজান এবং চ্যানেল, উদ্ধৃতি ও টাইমস্ট্যাম্প লিংকসহ এক্সপোর্ট করুন।

স্টার্টার কোড

এই আইডিয়াটি "রেসিপি 2: চ্যানেলে নজর রাখুন ও নতুন আপলোডে অ্যালার্ট দিন" প্যাটার্নের ওপর তৈরি। নিজের চ্যানেল, প্রম্পট ও স্টোরেজ বসিয়ে নিন।

import requests

API = "https://www.youtubetranscript.dev/api/v2"
HEADERS = {"Authorization": "Bearer yt_sk_live_YOUR_KEY"}

WATCHLIST = ["@somechannel", "@anotherchannel"]
KEYWORDS = ["your brand", "competitor"]
seen = set()  # persist this in a database in production

for handle in WATCHLIST:
    latest = requests.post(f"{API}/channels/resolve", headers=HEADERS,
                           json={"handle": handle, "limit": 10}).json()
    for video in latest["items"]:
        if video["video_id"] in seen:
            continue
        seen.add(video["video_id"])
        t = requests.post(f"{API}/transcribe", headers=HEADERS,
                          json={"video": video["video_id"]}).json()
        text = t.get("data", {}).get("transcript", {}).get("text", "").lower()
        hits = [k for k in KEYWORDS if k in text]
        if hits:
            print(f"ALERT {video['title']}: {hits}")

কেন বানানো মূল্যবান

ফ্যাক্ট-চেকিং প্রতিষ্ঠান ও গবেষণা দলগুলো গতি ও যাচাইযোগ্য প্রমাণ পায়। ট্রাস্ট অ্যান্ড সেফটি টিম ও মিডিয়া মনিটরিং কোম্পানিগুলো ভিডিও কভার করে এমন টুলের জন্য টাকা দেবে।

যে ভুলগুলো এড়াবেন

  • স্বয়ংক্রিয় মিলকে সিদ্ধান্ত হিসেবে ধরা: প্রকাশের আগে সবসময় একজন মানুষ দিয়ে নিশ্চিত করুন।
  • শুধু হুবহু বাক্যাংশ সার্চ করা: দাবি রূপ বদলায়, তাই কয়েকটি রূপ দিয়ে সিমান্টিক সার্চ ব্যবহার করুন।
  • উৎসের তথ্য হারানো: প্রতিটি উদ্ধৃতির জন্য ভিডিও ID, টাইমস্ট্যাম্প ও সংগ্রহের তারিখ রাখুন।

এই আইডিয়া নিয়ে প্রশ্ন

ফ্যাক্ট-চেকাররা YouTube ভিডিও কীভাবে সার্চ করেন?

ভিডিও ট্রান্সক্রাইব করে টেক্সট সার্চ করে। সিমান্টিক সার্চ এমন ভাবার্থও খুঁজে পায় যা কিওয়ার্ড সার্চে বাদ পড়ে যেত।

YouTube-এ কোনো দাবি প্রথম কখন করা হয়েছে তা কি প্রমাণ করা যায়?

আপনি যে চ্যানেলগুলো মনিটর করেন তার মধ্যে প্রথম উপস্থিতি প্রকাশের তারিখ ও টাইমস্ট্যাম্পসহ নথিভুক্ত করতে পারেন। চিত্রটি কতটা সম্পূর্ণ তা কভারেজের ওপর নির্ভর করে।

ক্যাপশন নেই এমন ভিডিওর কী হবে?

AI স্পিচ রিকগনিশন চালু করুন, তাহলে ক্যাপশন ছাড়া ভিডিওও ট্রান্সক্রাইব ও সার্চযোগ্য হবে।

আজই বানানো শুরু করুন

প্রতি মাসে 10টি ফ্রি ক্রেডিট। কোনো ক্রেডিট কার্ড লাগবে না।

YouTube দাবি ও ভুল তথ্য ট্র্যাকার বানানোর উপায় | YouTubeTranscript.dev