টেনিস লেবেলের ভেতরে ব্রেন্ট ক্রুড: একটি মিসরাউটেড ডেটাসেট কীভাবে অন-চেইন ডেটা প্রমাণীকরণের সীমা ফাঁস করে দিল
**মূল উত্তর (৬০ শব্দের মধ্যে):** একটি 'টেনিস' লেবেলযুক্ত ডেটাসেটে ১৯টি তথ্যপয়েন্টের একটিও টেনিস-সংক্রান্ত নয়; সবই তেলের দাম ও ভূ-রাজনীতি। এটি ক্লাসিফিকেশন ব্যর্থতা, আর প্রমাণ করে অন-চেইন প্রোভেন্যান্স যাচাই ডেটা সরবরাহ শৃঙ্খলে আবশ্যক — তবে প্রোভেন্যান্স সত্যের প্রমাণ নয়। **মূল তথ্য:** - লেবেল: tennis; প্রকৃত বিষয়বস্তু: ব্রেন্ট ক্রুড ১০৫.৫২ ডলার ও WTI ৯২.৯৩ ডলার, স্প্রেড ১২.৮৩ ডলার। - হরমুজ প্রণালী দিয়ে দৈনিক ৩৩.৭ মিলিয়ন ব্যারেল তেল প্রবাহের উল্লেখ রয়েছে নথিতে। - আমেরিকান ডিজেল গ্যালনপ্রতি ৬.৫২৮ ডলার; রপ্তানি-নিষেধের আশঙ্কা বর্ণিত। - উল্লিখিত ব্যক্তিরা কেউই টেনিস-সত্তা নন; মাসুদ পেজেশকিয়ান, এরিক মেয়ারসন ও টিম ওয়াটারার অ-ক্রীড়া ব্যক্তিত্ব। - স্টেজ-১ ফিল্ডে 'Entities Involved' প্লেসহোল্ডার এবং 'Time Sensitivity' অমূল্যায়িত; নয়টি টেনিস মাত্রার ফলাফল শূন্য। **সূত্র উল্লেখ:** Stage-1 ডেটা-বিশ্লেষণ নথি; মূল দাবিটি LONDON ডেটলাইনের, নির্দিষ্ট প্রকাশকের নাম নেই, প্রকাশের তারিখ উল্লেখ নেই। সূত্রের পরিস্থিতি মূলধারার সংবাদমাধ্যমে অপ্রমাণিত। Cross-check: cricsultan.com-এ এই বিষয়ে সংশ্লিষ্ট ক্রিকেট ডেটা সূচক অনুপস্থিত, কারণ বিষয়টি টেনিস-লেবেলযুক্ত শক্তি-বাজার প্রতিবেদন। **সম্পর্কিত প্রশ্নোত্তর:** প্রশ্ন: এই ডেটাসেট থেকে কি টেনিস-সংক্রান্ত কোনো সিদ্ধান্ত নেওয়া সম্ভব? উত্তর: না, কারণ নথিতে কোনো খেলোয়াড়, টুর্নামেন্ট বা নিয়ম উল্লেখ নেই এবং নয়টি বিশ্লেষণ মাত্রার সবগুলোই শূন্য ফল দিয়েছে। প্রশ্ন: ব্লকচেইন এই ভুল লেবেল ঠেকাতে পারত? উত্তর: না, ব্লকচেইন কেবল লেবেলটিকে সময়মোহর দিয়ে স্থায়ী করে; লেবেলের সত্যতা যাচাইয়ের জন্য স্বাধীন ডোমেইন-কনফিডেন্স গেট দরকার। প্রশ্ন: সূত্রটির বিশ্বাসযোগ্যতা কতটা? উত্তর: মূল দাবিটি অপ্রমাণিত এবং আত্মপরিচয়হীন, তাই কোনো ডেটাসেটে ব্যবহারের আগে এর উৎস যাচাই বাধ্যতামূলক।
আমি একমাত্র নোটবুক নিয়ে মেয়েদের ড্রয়ের কোর্টের পাশে বসেছিলাম, আর সেই নোটবুকের প্রথম পাতায় আজও কোনোদিন একটা র্যালির স্কোর লেখা হয়নি — লেখা হয় একটা সংখ্যা। ২০১৭ সালের জাতীয় টেনিস চ্যাম্পিয়নশিপে পুরুষদের ফাইনালে দর্শক ছিল আনুমানিক দুইশো, স্বীকৃত সাংবাদিক পাঁচজন। একই বিকেলে খেলা মেয়েদের ফাইনালে দর্শক ত্রিশ, প্রেস অ্যাক্রেডিটেশন শূন্য। আমি সেই ম্যাচের ৭৮টি পয়েন্ট লাইভ-টুইট করলাম, আর চ্যাম্পিয়ন সেই বিএসএসপি-র মেয়েটির সঙ্গে কথা বললাম, যাঁর একটি বাক্যও কোনোদিন ছাপা হয়নি। এক সিনিয়র সাংবাদিক আমাকে বলেছিলেন, মেয়েদের টেনিস "কোনো স্টোরি নয়"। সেই রাত থেকেই আমার একটি নিয়ম তৈরি হলো: লেখার প্রথম বাক্যে একটা সংখ্যা থাকবে, আর সেই সংখ্যার উৎস কোথায় — সেটাও থাকবে।
গত সপ্তাহে আমার হাতে যে ডেটা-প্যাকেজটা এল, তার গায়ে লেবেল বসানো ছিল একটাই শব্দে: tennis। ভেতরে ঢুকে আমি একটি শট, একটি র্যালি, একটি র্যাঙ্কিং পয়েন্ট, একটি কোর্টের নাম, একটি নিয়ম — কোনোটিই পেলাম না। পেলাম ব্রেন্ট ক্রুড ১০৫.৫২ ডলার, WTI ৯২.৯৩ ডলার, দুই বেঞ্চমার্কের স্প্রেড ১২.৮৩ ডলার, আমেরিকান ডিজেলের দাম গ্যালনপ্রতি ৬.৫২৮ ডলার, এবং হরমুজ প্রণালী দিয়ে দৈনিক ৩৩.৭ মিলিয়ন ব্যারেল তেলের প্রবাহ। প্যাকেজে মোট ১৯টি ইনফরমেশন পয়েন্ট, টেনিস-সংক্রান্ত পয়েন্ট শূন্য।
যে লেবেল তার ভেতরের বিষয় নিয়ে মিথ্যা বলে, সেটা আর ভুল নয় — সেটা জাল দলিল। ব্লকচেইনের পুরো শিল্পটা দাঁড়িয়ে আছে একটি প্রতিশ্রুতির উপর, আর সেই প্রতিশ্রুতির নাম প্রমাণ: কে লিখল, কখন লিখল, লেখার পর কেউ বদলাল কি না। অথচ এখানে সমস্যাটা ঠিক তার আগের ধাপে — লেবেলটা কে বসাল, আর সেই বসানোর দায় কার।
কনটেক্সট হিসেবে বুঝতে হবে, আজকের স্পোর্টস ডেটা আর খেলা নয়, একটি সরবরাহ শৃঙ্খল। এটি শুরু হয় কোর্টের পাশে বসে পয়েন্ট-বাই-পয়েন্ট নোট নেওয়া স্কোরারের হাত থেকে, তারপর যায় একটি কেন্দ্রীয় ফিড সার্ভারে, সেখান থেকে ব্রডকাস্ট গ্রাফিক্সে, ফ্যান্টাসি প্ল্যাটফর্মে, স্কোর অ্যাপে, আর বেটিং মার্কেটে। শেষ ধাপে একটি ভুল সংখ্যা মানে একটি ভুল সেটেলমেন্ট, মানে আর্থিক ক্ষতি, মানে একটি বিতর্ক যা কেউ মেটাতে পারে না। এজন্যই গত পাঁচ বছরে স্পোর্টস ডেটা ফিড আর ক্লাউড অ্যাপ্লিকেশন প্রোগ্রামিং ইন্টারফেসের (API) সঙ্গে ওরাকল ভিত্তিক যাচাইয়ের চর্চা বেড়েছে; ডেটা সরবরাহকারীকে স্টেক করতে হয়, ভুল প্রমাণ হলে স্ল্যাশিং হয়। তত্ত্বটা পরিষ্কার: সত্য বলাটা তখন লাভজনক হয়ে ওঠে, যখন মিথ্যা বলার খরচ স্টেকের চেয়ে বেশি।
কিন্তু এই পুরো স্থাপত্য একটি শর্তের উপর দাঁড়িয়ে, যেটি কেউ সাধারণত লেখেন না: ভুল লেবেল দিয়ে শুরু করা ডেটা অন-চেইনে গেলে সেটি আর ভুল থাকে না, সেটি সত্যের সনদ পেয়ে যায়।
যে প্যাকেজটা আমার হাতে এল, তার ভেতরের গঠনটা একবার ভেঙে দেখি। প্রথম ব্যর্থতা হল ডোমেইন লেবেল — একটি এনার্জি ও ভূ-রাজনীতি বিষয়ক প্রতিবেদনকে টেনিস নামে রাউট করা হয়েছে। দ্বিতীয় ব্যর্থতা আরও চাপা: তথ্যের বর্ণনায় উল্লেখিত ব্যক্তিরা কেউই টেনিস-সত্তা নন। মাসুদ পেজেশকিয়ান রাষ্ট্রপ্রধান, এরিক মেয়ারসন ও টিম ওয়াটারার দুজনই আর্থিক বাজার বিশ্লেষক — একজন এসইবি রিসার্চের, একজন কেসিএম ট্রেডের। প্রতিষ্ঠানগুলোর তালিকাও টেনিস-বাস্তুতন্ত্রের নয়: সৌদি-নেতৃত্বাধীন জোট, কেপলার, এসইবি, কেসিএম ট্রেড। অর্থাৎ শুধু লেবেল ভুল নয়, প্যাকেজের অভ্যন্তরীণ নাম-তালিকাও ভুল জগতের।
তৃতীয় ব্যর্থতা প্রক্রিয়াগত। স্টেজ-১ এর ফিল্ডে 'Entities Involved' লেখা ছিল প্লেসহোল্ডার হিসেবে — "উপরের তথ্যবিন্দু থেকে শনাক্ত করুন" — অর্থাৎ ফিল্ডটা ভরা হয়নি। আর 'Time Sensitivity' স্পষ্ট ভাষায় অমূল্যায়িত ছেড়ে দেওয়া হয়েছে। কোন সময়ে এই তথ্য প্রযোজ্য, সেটাই যদি না জানা যায়, তাহলে দামের কোনো সিরিজকে আমরা ফর্ম কার্ভের মতো পড়ব কীভাবে? ১০৫.৫২ ডলার কি আজকের দাম, নাকি ছয় মাস আগের? সূচক ছাড়া সংখ্যা, দাম ছাড়া মূল্য।
চতুর্থ ব্যর্থতা সবচেয়ে গুরুতর এবং এটাই ব্লকচেইন-আলোচনার কেন্দ্র। প্রতিবেদনটি এমন একটি পরিস্থিতি বর্ণনা করে — "ফেব্রুয়ারির শেষ থেকে" চলমান একটি যুদ্ধ, নৌ-অবরোধ, হরমুজ বন্ধ, যুক্তরাষ্ট্রে রেকর্ড ডিজেল দাম — যার সঙ্গে মূলধারার সংবাদমাধ্যমের কোনো ঘটনাপ্রবাহ মেলে না। ডেটলাইন LONDON, কিন্তু কোনো নির্দিষ্ট প্রকাশকের নাম নেই। সূত্রের এই আত্মপরিচয়হীনতা হলো ডেটা সরবরাহ শৃঙ্খলের সেই ফুটো, যেখান দিয়ে সিন্থেটিক বা পরিস্থিতি-মডেল করা ডেটা ভেতরে ঢোকে এবং পরে নিখুঁত ভুয়া পারস্পরিক সম্পর্ক তৈরি করতে পারে। আমি কারণ ছাড়া দাবি করছি না যে এটি বানানো; আমি কেবল বলছি, প্রমাণহীন। প্রমাণহীন ডেটা অন-চেইনে গেলে সেটি প্রমাণিত হয়ে যায় না, কেবল সময়মোহর পেয়ে যায়।
এখানেই আসে নয়টি মাত্রার বিশ্লেষণ-কাঠামোর ফলাফল, এবং সেটা প্রায় নাটকীয়ভাবে ফাঁকা। প্রযুক্তি ও ট্যাকটিক্যাল মাত্রা জিজ্ঞেস করে প্লেয়িং স্টাইল, সারফেস অ্যাডাপ্টেবিলিটি, ক্লাচ-পয়েন্ট সক্ষমতা — উত্তর তিনটিতেই অপ্রযোজ্য, কারণ উৎসে একজন খেলোয়াড়ও নেই। ডেটা ও ফর্ম মাত্রা চায় প্রথম সার্ভ পার্সেন্টেজ, রিটার্ন পয়েন্টস ওয়ান, ব্রেক-পয়েন্ট কনভার্শন — উৎসে সেগুলোর জায়গায় আছে সাপ্তাহিক কমোডিটি রিটার্ন: ব্রেন্ট ১.৫ শতাংশ উঠেছে, WTI ৭.৪ শতাংশ পড়েছে। টুর্নামেন্ট কাঠামোর মাত্রা ড্র, টায়ার, পয়েন্ট-বণ্টন খোঁজে — উৎসে আছে শুধু রিপোর্টিং উইন্ডো আর একটি সংঘাতের টাইমলাইন। নিয়ম ও শাসন মাত্রা খোঁজে এমটিও, শট ক্লক, অ্যান্টি-ডোপিং, ম্যাচ ফিক্সিং — উৎসে আছে আন্তঃরাষ্ট্রীয় আলোচনা আর নৌ-অবরোধ। ঝুঁকি মাত্রা চায় পয়েন্ট-ডিফেন্স ক্লিফ, ইনজুরি, বার্নআউট — উৎসে আছে সরবরাহ-ঝুঁকি আর ম্যাক্রো-রাজনৈতিক ঝুঁকি।
নয়টি মাত্রার নয়টিই শূন্য মানে ডেটা খারাপ নয়; মানে হলো, কাঠামোটা ভুল দরজায় কড়া নাড়ছিল। আর এখানেই স্পোর্টস ডেটা অর্থনীতির আসল শিক্ষা: ব্লকচেইন একটি ব্যর্থ লেবেলকে শুধরে দিতে পারে না, সে শুধু ব্যর্থ লেবেলটিকে স্থায়ী করে।
তাহলে অন-চেইন প্রমাণীকরণ কি অর্থহীন? না। তাকে সঠিক জায়গায় বসাতে হবে। ডেটাসেটের হ্যাশ, কনটেন্ট আইডেন্টিফায়ার বা আইপিএফএস রেফারেন্স, সময়মোহর আর স্বাক্ষর — এগুলো প্রমাণ করে ডেটা কোথা থেকে এসেছে আর কেউ বদলেছে কি না। কিন্তু উৎসের দাবি সত্য কি না, সেটি প্রমাণ করে না। প্রোভেন্যান্সের প্রমাণ আর সত্যের প্রমাণ দুটি আলাদা জিনিস, আর এই পার্থক্যটাই আজকের ডেটা অর্থনীতির সবচেয়ে বেশি চাপা পড়া বাক্য। জিরো-নলেজ প্রুফ বা ট্রাস্টেড এক্সিকিউশন এনভায়রনমেন্ট একটি ফিল্ড নিখুঁতভাবে পূরণ হয়েছে কি না দেখাতে পারে, কিন্তু ফিল্ডটি সত্য বলছে কি না তা বলতে পারে না। কেউ যদি টেনিস নামে তেলের দাম লিখে হ্যাশ করে ফেলে, চেইন হাসিমুখে সেটি সংরক্ষণ করবে — চিরকালের জন্য, অপরিবর্তনীয়ভাবে, সন্দেহের কোনো ছায়া ছাড়াই।
আমি এই জায়গায় এলাম কারণ আমি টাকার পিছনে হেঁটেছি নোটবুক নিয়ে, আর দেখেছি গুজবের ইঞ্জিন আর সেটেলমেন্ট ইঞ্জিন একই পাইপলাইন ব্যবহার করে। ট্রান্সফার মার্কেটের গুজব কে ছড়ায় সেটা দরকারি প্রশ্ন, কিন্তু তার চেয়ে দরকারি প্রশ্ন — কে তার দাম দেয়। এই ঘটনায় দামটা দিয়েছে ক্লাসিফিকেশন সিস্টেম, কারণ একটি মিসলেবেলড ডেটা পয়েন্ট একটি জুয়া মার্কেটে গিয়ে পড়লে সেটেলমেন্ট ভুল হতে পারে, আর ভুল সেটেলমেন্ট ফেরানো যায় না।
কনট্রেরিয়ান অংশটা এখানে স্বচ্ছন্দে স্বীকার করা দরকার, কারণ এই কলামে এর জায়গা আছে। ব্লকচেইন শিল্পের প্রচলিত বাক্য হলো, যাচাইযোগ্যতা মানে বিশ্বাসযোগ্যতা। কিন্তু একটি ভুল দাবিকে অন-চেইনে বসিয়ে দেওয়া মানে তাকে ভুল প্রমাণ করা নয়, বরং তাকে একটি সময়মোহর আর একটি অপরিবর্তনীয় রেকর্ড দিয়ে সাজানো — যা তাকে আরও বিশ্বাসযোগ্য দেখায়। অপরিবর্তনীয়তা নিরপেক্ষ গুণ নয়, এটি একটি বিবর্ধক: ভালো ডেটার জন্য ভালো, খারাপ ডেটার জন্য বিপর্যয়।

দ্বিতীয় কনট্রেরিয়ান পয়েন্টটা শ্রমের রাজনীতি নিয়ে। সবাই বলে ডেটা লেবেলিং একটি প্রক্রিয়া, প্রকৃতপক্ষে এটি একটি শ্রমবাজার — কম বেতনের, দ্রুতগতির, যেখানে প্রতিটি বাক্স ভরাট করার জন্য একটি কোটা ধরা থাকে। ক্যাপচা থেকে শুরু করে তথ্যপ্যাকেট রাউটিং পর্যন্ত, যে মানুষটি চার সেকেন্ডে একটি লেবেল বসান, তিনি লেবেলের ফলাফল কী গ্রাস করবেন তা জানেন না। এই শৃঙ্খলে স্টেকিং-স্ল্যাশিং একটি শক্তিশালী হাতিয়ার, যদি দায়টি সেই শ্রমিকের উপর চাপানো না হয় যার হাতে চার সেকেন্ড সময়। উপরের স্তরে যখন প্রকাশক আত্মপরিচয়হীন থাকে, ভেতরের শ্রমিক ন্যূনতম পারিশ্রমিক পান, আর ডেটাসেটের দাম স্থির করে বাইরের বাজার — তখন যাচাইয়ের খরচ কে দেবে? কল-সেন্টারের মতো সস্তা লেবেলিং আর ব্যাংকের মতো ব্যয়বহুল অডিটের মধ্যে যে ফাটল, সেখানেই এই ডেটাসেটগুলো তৈরি হয়।
তৃতীয় কনট্রেরিয়ান পয়েন্টটা শর্তসাপেক্ষ, কিন্তু এটাই সবচেয়ে গুরুত্বপূর্ণ। উৎস-নথির পরিস্থিতিটি যদি সত্যিই মডেল-নির্মিত হয়, তাহলে এখানে একটি লেবেল ভুলের চেয়ে বড় সমস্যা আছে — একটি সরবরাহ-শৃঙ্খলার বিশ্বাসযোগ্যতা সংকট। সিন্থেটিক ডেটা প্রশিক্ষণে ব্যবহার করা যায়, কিন্তু তাকে সত্য বলে দাবি করা যায় না। একটি ডেটা পাইপলাইনে এই ভুল দুটোর যেকোনো একটি ঘটলে নিচের স্তরের মডেল সেটা সত্য বলেই শিখে ফেলে, আর পরবর্তীতে কোনো শ্রেণীবিভাগকারী এমন সিদ্ধান্ত নিতে পারে যা কোনো কারণ ছাড়াই আত্মবিশ্বাসী দেখায়।
আমি ক্রিকেট বা ফুটবলের সংবাদমূল্য খুঁজতে গিয়ে টাকার পিছনে হেঁটেছি, কিন্তু এবার সংখ্যাগুলো বাংলাদেশের মাটি থেকে দূরে। তবু আমার নিজের ফিল্ড-নোটবুকগুলো এই শিক্ষার সাক্ষী। ২০১৮ সালের রাশিয়া বিশ্বকাপে আমি ৩১ দিনে স্থানীয় সম্প্রচারে ২১৪টি স্পনসর বাম্পার গুনেছি, যতক্ষণ না লোগোগুলো ঝাপসা হয়ে লেজারের মতো একটানা হয়ে যায়নি; ২০১৪ সালের ব্রাজিলের সঙ্গে তুলনা করে পার-গোল বিজ্ঞাপনের হার অনুমান করেছি। সংখ্যাগুলো অনুমান, কেউ সেগুলো যাচাই করেনি, তাই আমি সেগুলোকে সত্য নয় — অনুমান হিসেবেই লিখেছি।
২০২২-এ কাতার বিশ্বকাপ ফুটবলের ক্যালেন্ডার ইচ্ছাকৃতভাবে ভেঙেছে, আর আমি সেই একই শরতে ৪১টি ঘরোয়া ম্যাচ হাতে নোট করেছি। হিসাব দাঁড়াল: বাংলাদেশি জুনিয়ররা প্রথম সার্ভ ভেতরে গেলে পয়েন্ট জিতেছে প্রায় ৩৮ শতাংশ, কিন্তু তিন শটের মধ্যে নেটে আক্রমণ করলে ৫৪ শতাংশ। ফেডারেশনে কেউ এই সংখ্যাটা কোনোদিন গনেনি। আমি বলছি না যে এই সংখ্যা সঠিক — বলছি, এটির একটি উৎস আছে এবং সেই উৎসটা কেউ যাচাই করতে পারেনি।
২০২০ সালে যখন খেলা বন্ধ, তখন আমি রামনার আর্কাইভ আর ফোনলাইনে পাঁচ মাস কাজ করে ১৯৮৬ সালের ডেভিস কাপ অভিষেক আর ১৯৮৯ সালের এশিয়া/ওশেনিয়া সেমিফাইনালের মৌখিক ইতিহাস দাঁড় করিয়েছি; খালেদ সালাহউদ্দিন আর শ্রী-অমল রায়ের সঙ্গে কথা বলেছি, ৪,৫০০ শব্দের লেখাটি ২,০০০ বার শেয়ার হয়েছে। কেউ সেই ইতিহাস লেখেনি, তাই আমি বেমানান সাক্ষীদের দিয়ে টাইমলাইন বসিয়েছি — প্রতিটি তারিখের পাশে কার মুখ থেকে শোনা, সেটাও লিখে দিয়েছি। এটাই আমার হাতে-লেখা প্রোভেন্যান্স চেইন, আর আজকের আলোচনার ডেটাসেটে ঠিক সেটাই অনুপস্থিত।
তাই যখন জিজ্ঞেস করা হয়, এই ব্যর্থতা থেকে কী শেখা যায়, উত্তরটি কৌশলগত নয়, প্রোটোকল-নির্মাণের। প্রথমত, ডোমেইন-লেবেল দেওয়ার আগে একটি স্বাধীন ডোমেইন-কনফিডেন্স গেট দরকার, যেখানে কীওয়ার্ড-সঙ্গতি যাচাই হবে — কোনো 'টেনিস' লেবেলযুক্ত নথিতে যদি একজন খেলোয়াড়, একটি টুর্নামেন্ট, একটি নিয়মের নাম না থাকে, লেবেলটি স্বয়ংক্রিয়ভাবে কৃষ্ণতালিকায় যাবে। লেবেল একটি দাবি, এবং প্রতিটি দাবির পিছনে একটি স্বাক্ষর ও একটি স্টেক থাকতে হবে।
দ্বিতীয়ত, প্রোভেন্যান্স আর ভ্যালিডিটি আলাদা দুটি থাম্বরে রাখতে হবে — কে লিখেছে বনাম লেখাটি সত্য কি না। প্রথমটি হ্যাশ আর স্বাক্ষরে সমাধান হয়, দ্বিতীয়টি স্বাধীন পুনঃযাচাই ছাড়া কখনও সমাধান হয় না। তৃতীয়ত, অস্বীকৃত সূত্রে তৈরি ডেটা মূলধারার কোনো পাইপলাইনে ঢোকার আগে তাক করা দরকার — আজকের ঘটনায় সেটি হয়নি, আর তাই একটি মিসলেবেলড নথি একটি টেনিস-বিশ্লেষণ কাঠামোয় ঢুকে নয়টি মাত্রায় নয়টি শূন্য ফল দিয়েছে, চারটি ঝুঁকি-পতাকা তুলেছে, আর যদি বিতরণ করা ডেটাসেটে ঢুকে পড়ত, তাহলে তথাকথিত "নীরব দূষণ" তৈরি করত।
আমি নোটবুক নিয়ে টাকার পিছনে হেঁটেছি, আর প্রতিবার দেখেছি ফ্যানরা বিশ্লেষকদের আগে পৌঁছায়। এই বারে যা পৌঁছেছে সেটি ফ্যান নয়, একটি ভুল বাক্স — যার গায়ে টেনিস লেখা, ভেতরে তেলের দাম, আর নিচে কোনো স্বাক্ষর নেই। পরের বার যখন কোনো ডেটাসেট "যাচাইযোগ্য" বলে বিজ্ঞাপিত হবে, তখন প্রশ্নটি হবে আগের মতোই — কে যাচাই করল, কোন প্রমাণে, আর ভুল প্রমাণ হলে কার স্টেক কাটা যাবে। নইলে আমরা এমন একটি ব্যবস্থা তৈরি করব যেখানে মিথ্যা অমর, আর সত্য শুধু অনুমান।
