খালি ঘর, ভুয়া সংখ্যা আর অন-চেইন প্রমাণ: ক্রিকেট বিশ্লেষণের অদৃশ্য পাইপলাইন ঝুঁকি
**মূল উত্তর:** ক্রিকেট বিশ্লেষণ পাইপলাইনে প্রথম স্তর শূন্য ফেরালে দ্বিতীয় স্তরের গভীর বিশ্লেষণ চালানো সম্ভব নয়। অন-চেইন হ্যাশ ও টাইমস্ট্যাম্প সেই শূন্য ফল প্রমাণযোগ্য করে, তবে ডেটার সত্যতা নিশ্চিত করে না। **মূল তথ্য:** - Stage-1 আউটপুটে শিরোনাম, সূত্র, ফরম্যাট ও তথ্যবিন্দু সবই ফাঁকা ছিল। - একমাত্র সিগন্যাল ছিল ডোমেইন লেবেল `cricket_asia`, যা ফরম্যাট নির্দেশ করে না। - ফরম্যাট অজানা থাকলে টেস্ট, ওয়ানডে ও টি-টোয়েন্টির বেঞ্চমার্ক নির্ধারণ করা অসম্ভব। - ব্লকচেইন ডেটার উৎস-ইতিহাস অপরিবর্তনীয় করে, ভুল তথ্য অমর ভুলে পরিণত হয়। - “ক্লিয়ার অ্যান্ড অবভিয়াস এরর” ধারার বিষয়গত বিচার কনসেন্সাস দিয়ে মীমাংসা করা যায় না। **সূত্র:** Stage-2 ডিপ প্রফেশনাল অ্যানালাইসিস (ক্রিকেট ডোমেইন), প্রকাশ: ১৩ আগস্ট ২০২৬ | Cross-checked: cricsultan.com **সম্পর্কিত প্রশ্নোত্তর:** প্রশ্ন: খালি Stage-1 আউটপুট কী বোঝায়? উত্তর: এটি বোঝায় উৎস লেখা বা এক্সট্রাকশন স্তরে সমস্যা আছে, বিশ্লেষণের সিদ্ধান্ত নয়। প্রশ্ন: ব্লকচেইন কি ভুয়া ক্রিকেট ডেটা ঠেকাতে পারে? উত্তর: না, এটি কেবল উৎস ও সময় প্রমাণ করে; ভুল তথ্য ঢুকলে অপরিবর্তনীয় ভুল হয়ে যায়। প্রশ্ন: ফরম্যাট না জেনে বিশ্লেষণ কেন করা যায় না? উত্তর: কারণ টেস্ট, ওয়ানডে ও টি-টোয়েন্টির কৌশল ও পরিসংখ্যান বেঞ্চমার্ক সম্পূর্ণ আলাদা।
হুক
সিলেটে রাত দুটো নাগাদ মনিটরে একটা ডিকনস্ট্রাকশন রিপোর্ট খোলা ছিল। Article Title খালি। Article Source খালি। Information Points-এর পুরো তালিকা ফাঁকা। যেখানে বিশ্লেষকের অনুমান বসানোর কথা, সেখানে একটাই বাক্য ঘুরে ফিরে আসছিল — “এন/এ: পর্যাপ্ত তথ্য নেই, মূল্যায়ন করা সম্ভব নয়।”
যেটা ঘটেনি, সেটাই এখানে আসল ঘটনা। কেউ খেলোয়াড়ের নাম বসিয়ে দেয়নি। কেউ স্কোরলাইন বানায়নি। কেউ “মিডল-ওভারে গতি কমেছে” জাতীয় বাক্য জোড়া দিয়ে ফাঁকা ঘর ভরাট করেনি। পাইপলাইনের প্রথম স্তর শূন্য ফিরিয়েছে, দ্বিতীয় স্তর সেটা মেনে নিয়েছে।
বিশ্লেষণ-জগতে এই সততা বিরল। ফাঁকা ঘর মানে ফাঁকা লেখা, আর ফাঁকা লেখা মানে ডেডলাইনে হাত খালি। চাপ সবসময় ভরাট করার দিকে ঠেলে। কিন্তু কাঁচামাল না থাকলে যা তৈরি হয়, সেটা বিশ্লেষণ নয় — সাজানো গল্প, যার গায়ে ডেটার লেবেল সেঁটে দেওয়া।
আমি বছর পনেরো ধরে ক্রিকেট-কাঠামো নিয়ে লিখছি। এই একটা রাত আমাকে সেই পুরনো প্রশ্নে ফিরিয়ে নিয়ে গেল, যা আমি ২০১৭ সালে মনাকোর ১০৭ গোলের মেশিন নিয়ে লেখার সময়ও ভাবতাম — কাঠামোটা আসল, নাকি কাঠামোর ছবিটা আসল?
প্রেক্ষাপট: দুই স্তরের পাইপলাইন, আর একটিমাত্র লেবেল
এই বিশ্লেষণ-ব্যবস্থা দুই স্তরে চলে। প্রথম স্তর মূল লেখা থেকে তথ্য টেনে বের করে — শিরোনাম, সূত্র, লেখার ধরন, সত্তা (কোন দল, কোন খেলোয়াড়, কোন ম্যাচ), আর তথ্যবিন্দুর তালিকা। দ্বিতীয় স্তর সেই তথ্যবিন্দুর উপর দাঁড়িয়ে আটটি মাত্রায় গভীরে যায়: ফরম্যাট ও ম্যাচ-বিশ্লেষণ, খেলোয়াড়ের কৌশল ও ডেটা, দলের ল্যান্ডস্কেপ ও র্যাঙ্কিং, লিগ ও বাণিজ্যিক বাস্তু, নিয়ম ও গভর্ন্যান্স, ঝুঁকির ম্যাট্রিক্স, জন-আখ্যান ও প্রত্যাশার ফাঁক, এবং ইন্ডাস্ট্রি ট্রান্সমিশন।
দ্বিতীয় স্তরের পুরো কাঠামোটা দাঁড়িয়ে থাকে প্রথম স্তরের উপাদানের উপর। উপাদান না থাকলে কাঠামোটা থাকে, কিন্তু ভিতরটা থাকে না। এবার ঠিক সেটাই ঘটেছে। হাতে এসেছে একটাই সিগন্যাল — ডোমেইন লেবেল: cricket_asia।
এই লেবেলটা একটা টপিক ট্যাগ, ম্যাচের পরিচয়পত্র নয়। “এশিয়ার ক্রিকেট” মানে টেস্ট হতে পারে, ওয়ানডে হতে পারে, টি-টোয়েন্টি হতে পারে, কোনো লিগও হতে পারে। ফরম্যাট না জানলে কোন বেঞ্চমার্কে মাপব সেটাই ঠিক হয় না — টেস্টে ধৈর্য আর স্ট্রাইক-রেটের হিসাব আলাদা, টি-টোয়েন্টিতে স্ট্রাইক-রেট আর ইকোনমির হিসাব আলাদা, ওয়ানডেতে মাঝামাঝি জায়গাটা সবচেয়ে ধোঁয়াশা। ভৌগোলিক ট্যাগ থেকে ফরম্যাট অনুমান করা মানে বিশ্লেষণের প্রথম ধাপেই ভুল বসিয়ে দেওয়া।
এশিয়ার ক্রিকেট-বাস্তুতে এই ভুলের দাম বেশি, কারণ এখানে তিনটে ফরম্যাট একসঙ্গে চলে, একই খেলোয়াড় তিনটে ভূমিকায় নামে, আর ক্যালেন্ডার প্রায় সারা বছর ভরা থাকে। বাংলাদেশের প্রেক্ষাপটে তো আরও বেশি — ওয়ার্কলোড, পিচের চরিত্র, সিলেকশনের চাপ আর গ্যালারির প্রত্যাশা — এই চারটা চলক একসঙ্গে হিসাব না করলে কোনো বিশ্লেষণই টেকে না।
পাইপলাইনের বাইরে এই আউটপুট কারা পড়ে? সম্প্রচার গ্রাফিক্স, ফ্যান্টাসি প্ল্যাটফর্ম, সংবাদমাধ্যম, আর মার্কেট অ্যানালিটিক্স। এর মধ্যে একটা বড় অংশ সংখ্যার দিকে তাকায়, প্রক্রিয়ার দিকে নয়। তাই ফাঁকা ঘর ভরাট করার বাণিজ্যিক চাপটা বিশাল — এবং ঠিক সেখানেই ভুয়া সংখ্যা জন্মায়।
মূল বিশ্লেষণ
শূন্য ফল নিজেই একটা তথ্য
বিশ্লেষণের পুরনো চর্চায় ব্যর্থতা মানে ফাঁকা পাতা। কিন্তু ডেটা-শৃঙ্খলে ব্যর্থতা মানে ভিন্ন কিছু — একটা পরিমাপযোগ্য সংকেত। “প্রথম স্তর কিছু ফেরত দেয়নি” এই বাক্যটা নিজেই একটা ডেটা পয়েন্ট। এটা বলে দেয় সমস্যা কোথায়: উৎস লেখা, এক্সট্রাকশন ইঞ্জিন, নাকি দুই স্তরের হ্যান্ডঅফ।
যে পাইপলাইন ফাঁকা ফেরাতে জানে, সে পাইপলাইন ভরাট ফেরানোর সময় বিশ্বাসযোগ্য। কারণ যে সিস্টেম অনুমান আর তথ্যের পার্থক্য রাখে না, তার কাছ থেকে আসা আত্মবিশ্বাসী সংখ্যাটাই আসল ঝুঁকি। ক্রিকেটে আমরা এটা প্রতিদিন দেখি — একজন বোলারের ইকোনমি ৬.২, কিন্তু কোন ফেজে, কোন ফিল্ডে, কোন ব্যাটারের বিরুদ্ধে — সেটা না জানলে সংখ্যাটা শুধু অলংকার।
আমি বছরের পর বছর ম্যাচ দেখে যে অভ্যাসটা রপ্ত করেছি, সেটা একই নিয়মে চলে। একটা ইনিংসে কেউ ৪০ রানে আউট হলে সেটা তথ্য। কিন্তু কেন আউট হলো — সুইং, ফিল্ড-সেট, নাকি ভুল শট — সেটা না জানলে ওই ৪০ সংখ্যাটা বিশ্লেষণ নয়, সূচি। বিশ্লেষণ শুরু হয় সংখ্যার পরে, সংখ্যার জায়গায় নয়।
প্রমাণের শৃঙ্খল: সংখ্যাটা কোথা থেকে এল
ক্রিকেটের সবচেয়ে দুর্বল জায়গা স্কোরকার্ড নয়, স্কোরকার্ডের উৎস-বিবরণ। একটা স্ট্রাইক-রেট, একটা ইকোনমি, একটা ম্যাচ-আপ ক্লাস্টার — এগুলো যখন তিন জায়গায় তিন রকম দেখায়, তখন পাঠকের হাতে থাকে শুধু বিশ্বাস। আর বিশ্বাস ভাঙলে ক্রিকেট-সাংবাদিকতার যা ক্ষতি হয়, সেটা র্যাঙ্কিং হারানোর চেয়ে বড়।
তাই উৎস-গ্রেডিং জরুরি। তথ্য কোথা থেকে এল, কে যাচাই করল, কখন যাচাই হলো — এই তিনটে প্রশ্নের উত্তর থাকলে বিশ্লেষণ প্রতিলিপিযোগ্য হয়। প্রতিলিপিযোগ্যতা ছাড়া ক্রিকেট বিশ্লেষণ নিছক মতামত, যার গায়ে ডেটার পোশাক। এখানেই CricSultan-ধাঁচের ক্রস-চেক ডেটাবেসের মূল্য — একই তথ্য দুই জায়গায় মিলিয়ে দেখা, এবং অমিল থাকলে সেটা লুকিয়ে না ফেলে প্রকাশ করা।
এখানেই ব্লকচেইনের প্রথম কাজটা স্পষ্ট হয়ে যায়। প্রতিটি প্রথম-স্তরের আউটপুটের একটা ক্রিপ্টোগ্রাফিক হ্যাশ তৈরি করা যায়, তার সঙ্গে টাইমস্ট্যাম্প যুক্ত করা যায়, আর সেই হ্যাশ একটা পাবলিক লেজারে অ্যাঙ্কর করা যায়। ফলে “প্রথম স্তর শূন্য ফিরিয়েছিল” — এই সত্যটা পরে কেউ চুপিসারে বদলে দিতে পারবে না। পরদিন কেউ যদি দাবি করে আগের রাতেই খেলোয়াড়ের নাম পাওয়া গিয়েছিল, লেজারের হ্যাশ সেটা ধরে ফেলবে।
মজার ব্যাপার হলো, এই প্রমাণটা তথ্য যোগ করে না — প্রমাণ করে ইতিহাস যোগ করে। বিশ্লেষণে ইতিহাসের দাম অনেক সময় তথ্যের চেয়ে বেশি, কারণ সংশোধনের ক্ষমতাটাই পেশাদারিত্বের আসল চিহ্ন।
অন-চেইন গেট, অফ-চেইন বিচার
ব্লকচেইনের আসল সুবিধা “ডেটা অমর” নয়, “ডেটার ইতিহাস পরিবর্তনযোগ্য নয়”। পার্থক্যটা বড়, এবং এই পার্থক্যটা না বুঝলে সব হিসাব উল্টে যায়।
ভাবুন একটা পাবলিকেশন-গেট: দ্বিতীয় স্তরের বিশ্লেষণ প্রকাশিত হবে কেবল তখনই, যখন প্রথম স্তরের নির্দিষ্ট ঘরগুলো পূরণ হয়েছে এবং হ্যাশ মিলেছে। ফরম্যাট-ফিল্ড খালি, সত্তা-ফিল্ড খালি — স্মার্ট কন্ট্র্যাক্ট তখন আউটপুট আটকে দেবে। বিশ্লেষক চাইলে হাত দিয়ে বাইপাস করতে পারবেন না, কারণ গেটটা কোডে লেখা, সম্পাদনার অনুগ্রহে নয়।
দ্বিতীয় সুবিধা হলো ভূমিকা-ভাগ। এখানে মেকানিজম-ফার্স্ট ডেলিগেশন কাজে লাগে: একজন শুধু হ্যাশ যাচাই করবে, একজন উৎস-মান যাচাই করবে, একজন ফরম্যাট ঠিক আছে কিনা দেখবে। এই ভূমিকাগুলো আলাদা রাখলে ভুল ধরার সম্ভাবনা অনেক বাড়ে, আর দোষ চাপাচাপির জায়গাটা সংকুচিত হয়। ক্রিকেট মাঠেও একই নিয়ম চলে — পাওয়ারপ্লে, মিডল-ওভার আর ডেথ-ওভারের দায়িত্ব আলাদা হাতে দিলে ফাঁক কমে; মাশরাফি বিন মুর্তজার মতো ডেথ-বোলিং বিশেষজ্ঞের ওভার-দ্য-উইকেট বলটা ঠিক এই ভূমিকা-ভাগের ফসল।
ক্রিকেট-জ্যামিতির ভাষায় বললে: হাফ-স্পেস থেকে শুরু করতে হয়, আর ক্রিকেটে হাফ-স্পেস মানে কভার আর পয়েন্টের মাঝের সেই ফাঁকা চ্যানেল। ২০১৭ সালে মনাকোর ১০৭ গোলের মেশিন নিয়ে যখন লিখতাম, তখন দেখেছিলাম ওরা ফাঁকা চ্যানেলকে ফাঁদে পরিণত করত — বল পাস করত সেই জানালায়, যেখানে প্রতিপক্ষ ঢুকতেই ভুল পা ফেলে। ক্রিকেটে সেই ফাঁদের নাম ফিল্ডিং-ট্র্যাপ: সিলি পয়েন্ট আর শর্ট কভারে দুজন বসিয়ে ব্যাটারকে ভুল শটে বাধ্য করা। ডেটা পাইপলাইনেও একই লজিক খাটে — ফাঁকা ঘরটা নিজেই ফাঁদ হতে পারে, যদি আপনি জানেন ফাঁকাটা কোথায় এবং কেন।
২০১৮ সালে রাশিয়া বিশ্বকাপে যখন মাতুইদির ভূমিকা নিয়ে লিখেছিলাম, তখন মূল কথা ছিল একটা অদৃশ্য খাঁচা — প্রতিপক্ষের ডান দিকের বিল্ড-আপকে আগেই বন্ধ করে দেওয়া, বল না পেয়েই। ক্রিকেটে এই খাঁচার প্রতিরূপ হলো বোলারের ম্যাচ-আপ খাঁচা: নির্দিষ্ট ব্যাটারের বিরুদ্ধে নির্দিষ্ট কোণ, নির্দিষ্ট লেংথ, নির্দিষ্ট ফিল্ড, নির্দিষ্ট ফেজ। কেউ যদি অন-চেইন লেজারে বোলার-ব্যাটার ম্যাচ-আপ ডেটা অ্যাঙ্কর করে দেয়, তবে একটা ভুল দাবি — “এই বোলার এই ব্যাটারের বিরুদ্ধে ভালো” — সহজেই ধরা পড়ে যাবে। সাকিব আল হাসানের পাওয়ারপ্লে স্পেল ঠিক এই ধরনের খাঁচা, যেখানে স্পিনার প্রথম ওভারেই ব্যাটারের স্বাভাবিক খেলা কেড়ে নেন।
আর ২০২০ সালের খালি স্টেডিয়ামের অভিজ্ঞতা আমাকে শিখিয়েছিল আরেকটা জিনিস। দর্শক না থাকলে চিৎকারের তথ্য চলে যায়, কিন্তু বলের শব্দ আর প্রেসিং-ট্রিগার স্পষ্ট হয়ে ওঠে — অ্যাকুস্টিক ভ্যাকুয়ামে কাঠামো নিজেকে দেখিয়ে দেয়। ডেটা পাইপলাইনেও একই ঘটনা ঘটে: শোরগোল সরিয়ে দিলে কাঠামোটা ধরা পড়ে। খালি প্রথম স্তরটা ঠিক সেই খালি স্টেডিয়াম — বিরক্তিকর, কিন্তু সবচেয়ে সৎ।
মানুষের সিগন্যাল, যা লেজারে ওঠে না
এখানে একটা সতর্কতা জরুরি। সিস্টেম আর ভূমিকা নিয়ে কথা বলতে গেলে খেলোয়াড়রা যন্ত্রের যন্ত্রাংশ মনে হতে শুরু করে — অথচ ক্রিকেটের ফলাফল ঠিক সেই বিন্দুতে বদলায়, যা লেজারে ওঠে না।
ওয়ার্কলোড, চোটের লুকানো ইতিহাস, পারিবারিক চাপ, টুর্নামেন্টের আবহ, গ্যালারির প্রত্যাশা — এগুলো মাপা যায়, কিন্তু মাপাটা নিখুঁত নয়। বাংলাদেশের প্রেক্ষাপটে এই চলকগুলোর ওজন বেশি, কারণ স্কোয়াডের গভীরতা সীমিত আর ক্যালেন্ডার নিরলস।
তাই প্রতিটি বিশ্লেষণে অন্তত একটা মানবিক সংকেত রাখা দরকার। না রাখলে বিশ্লেষণ ঠান্ডা শোনায়, আর ঠান্ডা বিশ্লেষণ ভুল সিদ্ধান্তে নিয়ে যায়। ডেটা বলতে পারে কে কত বল করল; বলতে পারে না কেন ওই ওভারটার পরে হাতটা আর উঠছিল না।
বাণিজ্যিক স্তর: প্রমাণের দাম
ব্লকচেইন আলোচনা প্রায়ই প্রযুক্তিতে থেমে যায়, বাজারে পৌঁছায় না। অথচ ক্রিকেটে প্রমাণের বাজার আছে।

সম্প্রচার গ্রাফিক্স, ফ্যান্টাসি স্পোর্টস, লিগের ডেটা-অধিকার, স্কাউটিং ফিড, এমনকি ইতিহাসভিত্তিক লেখালেখি — সবই একই কাঁচামালের উপর দাঁড়ানো। কাঁচামালের উৎস যাচাইযোগ্য হলে ডেটা-অধিকারের মূল্যও বাড়ে, কারণ ক্রেতা তখন জানেন তিনি কী কিনছেন।
এখানেই একটা কৌতূহলজনক অর্থনীতি তৈরি হয়: যাচাইযোগ্য ডেটার দাম বেশি, কারণ তার ঝুঁকি কম। আর যে সিস্টেম ভুয়া ডেটাকে অমর করে ফেলে, সে নিজের বাজারই নষ্ট করে।
বাংলাদেশের মতো বাজারে এই বিষয়টা আরও প্রাসঙ্গিক, কারণ সীমিত সম্পদে কাজ করতে হয়। এখানে বড় প্রযুক্তি-বিনিয়োগ সম্ভব নয়, কিন্তু হ্যাশিং আর টাইমস্ট্যাম্পিংয়ের মতো হালকা স্তর বসানো সম্ভব। জরুরি হলো ন্যূনতম যাচাই, সম্পূর্ণ সিস্টেম নয়।
প্রতিপক্ষীয় কোণ: ব্লকচেইন ভুয়া ডেটা সারায় না
এখানে থামা দরকার, কারণ সবচেয়ে বড় ভুলটা এখানেই হয়।
ব্লকচেইন ডেটার উৎস প্রমাণ করে, ডেটার সত্যতা নয়। ভুল তথ্য লেজারে ঢুকলে সেটা অমর ভুল হয়ে যায় — আর অমর ভুল সংশোধন করা যায় না, কেবল নতুন এন্ট্রি দিয়ে তার উপরে স্তর চাপানো যায়। ক্রিকেটে সংশোধন প্রতিদিনের কাজ: রিভিউয়ের পর স্ট্যাট বদলায়, আপিলের পর শৃঙ্খলা-রায় বদলায়, বৃষ্টির নিয়মে ম্যাচের ফল বদলায়। যে সিস্টেম “একবার লেখা, চিরকাল লেখা” নীতিতে চলে, তার সঙ্গে এই সংশোধন-সংস্কৃতির টানাপোড়েন অনিবার্য।
তার চেয়েও গভীর সমস্যা হলো বিচারের প্রশ্নটা। “ক্লিয়ার অ্যান্ড অবভিয়াস এরর” — এই বাক্যটা যতটা স্পষ্ট শোনায়, ততটা স্পষ্ট নয়। রিভিউ সিস্টেমের ভিতরে বিষয়গত বিচারের জায়গা মানুষ যতটা স্বীকার করে, তার চেয়ে অনেক বড়। অন-চেইন কনসেন্সাস একটা নো-বল নো-বল ছিল কিনা সেটা মীমাংসা করতে পারে না; সে কেবল এটা প্রমাণ করতে পারে যে কে, কখন, কী দাবি করেছিল।
তাই অন-চেইন প্রমাণ আর মাঠের বিচার — দুটো আলাদা স্তর। প্রথমটা স্মৃতি, দ্বিতীয়টা রায়। দুটো গুলিয়ে ফেললে বিশ্লেষণ প্রযুক্তির চাকচিক্যে ঢাকা পড়ে যায়। এখানেই নামাতে হয় অমীমাংসিত অংশটুকু: কোন ইনিংসে কে জিতবে, সেটা কোনো লেজার বলতে পারে না, আর কোনো মডেলও পারে না। যা বলা যায়, তা হলো — কোন প্রক্রিয়ায় সিদ্ধান্তটা নেওয়া হলো, আর সেই প্রক্রিয়া যাচাইযোগ্য কি না।
সুতরাং ব্লকচেইন এখানে সমাধান নয়, আয়না। সে দেখিয়ে দেয় আপনার ডেটার ইতিহাস কতটা পরিষ্কার — অথবা কতটা ঘোলা।
শেষ কথা
পরের ম্যাচটা দেখার সময় একটা ছোট কাজ করে দেখুন। স্কোরকার্ডে চোখ রাখার আগে দেখুন, কোন তথ্যটা কোথা থেকে এল, কে যাচাই করল, আর কে সেটা প্রথম দাবি করল। খালি ঘর দেখলে ভয় পাবেন না — ভয় পাওয়ার জায়গা হলো ভরা ঘর, যেখানে উৎস নেই।
আমার পরের লেখার বিষয় তাই নির্ধারিত: টুর্নামেন্টের পরের পর্বে কোন পাইপলাইন ফাঁকা ফেরাতে সাহস করে, আর কোনটা সংখ্যা বানিয়ে ভরাট করে।
প্রশ্নটা বিশাল নয়, ছোট: আপনার হাতে থাকা ক্রিকেট ডেটার ইতিহাস কি যাচাইযোগ্য, নাকি কেবল বিশ্বাসযোগ্য?
