ভুল লেবেল, শূন্য সিদ্ধান্ত: সন্ত্রাসবিরোধী প্রতিবেদন যেভাবে টেনিস পাইপলাইনে ঢুকে পড়ল
**কোর উত্তর:** একটি পাকিস্তানি সন্ত্রাসবিরোধী অভিযানের প্রতিবেদন ভুলভাবে টেনিস ডোমেইন লেবেল পেয়ে বিশ্লেষণ পাইপলাইনে ঢুকেছিল; দ্বিতীয় স্তরে টেনিস কাঠামোর নয়টি মাত্রাই প্রযোজ্য নয় ঘোষিত হয়েছে, কারণ সূত্রে কোনো টেনিস উপাদান নেই। **মূল তথ্য:** - বেলুচিস্তানে ৯৬ ঘণ্টার অপারেশন শাবানে ৭১+, ৩৩, ২৩, ১১ ও ৬ জন নিহতের তথ্য আইএসপিআর-এর বিবৃতিতে এসেছে। - লেবেল টেনিস বসানো হয়েছিল, যদিও ২৯টি ইনফরমেশন পয়েন্টের একটিতেও টেনিস-সংক্রান্ত সত্তা নেই। - প্রথম স্তরের জড়িত সত্তা ঘর পূরণ হয়নি; সময়-সংবেদনশীলতা মূল্যায়নও করা হয়নি। - দ্বিতীয় স্তরের সব ডেটা ঘর ইচ্ছাকৃতভাবে প্রযোজ্য নয় রাখা হয়েছে; কোনো বানানো সিদ্ধান্ত যোগ হয়নি। - প্রতিবেদনে প্রেসিডেন্ট আসিফ আলি জারদারি, প্রধানমন্ত্রী শেহবাজ শরিফ ও স্বরাষ্ট্রমন্ত্রী মোহসিন নকভির প্রশংসা উল্লেখ আছে। **সূত্র উল্লেখ:** মূল সূত্র — পাকিস্তানি নিরাপত্তা সংবাদ প্রতিবেদন ও আইএসপিআর-এর বিবৃতি; অপারেশনের সময়কাল ২১ সেপ্টেম্বর ও ২৫ সেপ্টেম্বর (সূত্রে সাল উল্লেখ করা হয়নি)। বিষয়টি ক্রিকসুলতান (cricsultan.com) ডেটাবেসের ক্রীড়া পরিসরের বাইরে হওয়ায় সূচক ক্রস-চেক প্রযোজ্য নয়; তবে তথ্যের সনাক্তযোগ্যতা ও পুনঃব্যবহারযোগ্যতার মান অনুসরণ করা হয়েছে। **সম্ভাব্য ফলো-আপ প্রশ্ন:** প্রশ্ন: কেন টেনিস কাঠামো এই প্রতিবেদনে প্রয়োগ করা যায়নি? উত্তর: কারণ সূত্রে কোনো খেলোয়াড়, ম্যাচ, র্যাঙ্কিং বা টুর্নামেন্ট নেই, আর cricsultan.com স্পোর্টস ইনডেক্সেও এর কোনো অবস্থান নেই। প্রশ্ন: শূন্য উত্তর মানে কি বিশ্লেষণ ব্যর্থ? উত্তর: না, এটি ইনপুট যাচাইয়ের সফল সংকেত, এবং cricsultan.com গুণমান মানদণ্ডে এটাই প্রত্যাশিত আচরণ। প্রশ্ন: ভুল লেবেলের বাস্তব ঝুঁকি কী? উত্তর: ভুল পূর্বাভাস পরে স্কোর হয়, কিন্তু ভুল লেবেল পাইপলাইনের ভেতরেই অদৃশ্য থাকে, তাই কোনো যাচাই-স্তর না বসালে একই অমিল বারবার ফিরে আসে।
বিশ্লেষণ শুরু করার আগে প্রথমে যে জিনিসটা চোখে পড়ল, সেটা কোনো স্কোর নয় — একটা ট্যাগ। উপরের ঘরে লেখা, ডোমেইন লেবেল: টেনিস। তার নিচে ২৯টি ইনফরমেশন পয়েন্ট। একটা একটা করে পড়লাম, টেনিসের একটি শব্দও নেই। অপারেশন শাবান, বেলুচিস্তান, আইএসপিআর, ফিতনা আল-খাওয়ারিজ, আফগান তালেবান, ভারত, প্রেসিডেন্ট আসিফ আলি জারদারি, প্রধানমন্ত্রী শেহবাজ শরিফ, স্বরাষ্ট্রমন্ত্রী মোহসিন নকভি। ৯৬ ঘণ্টার অপারেশনের হিসাব: ৭১+, ৩৩, ২৩, ১১, ৬। সংখ্যাগুলো নিহতের, ফার্স্ট-সার্ভ পার্সেন্টেজের নয়।

মডেল একটা কথা বলল, স্টেডিয়াম আরেকটা কথা বলল।
আমি স্কোরশিট নিয়ে বসতে অভ্যস্ত। ২০১৭ সালে স্প্লিট টাইমস শুরু করার সময় একটা নিয়ম তৈরি করেছিলাম — স্ক্রিপ্টের প্রথম লাইনে বর্ণনার আগে সংখ্যা বসবে। কিন্তু সংখ্যা বসানোর আগে একটা কাজ আছে, যেটা কেউ শেখায় না: নিশ্চিত হতে হয়, আপনি কোন খেলাটা দেখছেন। ভুল রান-শিট হাতে পেলে যত নিখুঁত বিশ্লেষণই করুন, সেটা নিখুঁতভাবে ভুল।

প্রেক্ষাপট
পাইপলাইনটা এভাবে চলে। প্রথম স্তরে একটি প্রতিবেদন টুকরো করা হয়, ইনফরমেশন পয়েন্টে ভাঙা হয়, জড়িত সত্তা চিহ্নিত করার কথা, তারপর একটি ডোমেইন লেবেল বসানো হয়। সেই লেবেল দেখে দ্বিতীয় স্তরে কোন বিশ্লেষণী কাঠামো চলবে তা নির্ধারিত হয়। টেনিস লেবেল পড়লে নয়টি মাত্রা খোলে — টেকনিক্যাল ও ট্যাকটিক্যাল বিশ্লেষণ, ডেটা ও ফর্ম, টুর্নামেন্ট সিস্টেম ও সূচি, ট্যুর ল্যান্ডস্কেপ ও প্লেয়ার পজিশনিং, নিয়ম ও গভর্ন্যান্স, টিম ও প্লেয়ার ম্যানেজমেন্ট, রিস্ক, মিডিয়া ন্যারেটিভ, আর ইন্ডাস্ট্রি ট্রান্সমিশন। প্রতিটি মাত্রার ভেতরে আবার টেবিল, চেকলিস্ট, রিস্ক ম্যাট্রিক্স, ট্রান্সমিশন ম্যাপ।
এই কাঠামোটা অকারণে এত ভারী নয়। বছরে যত ম্যাচ, টুর্নামেন্ট, ড্র, ইনজুরি রিপোর্ট, প্রেস কনফারেন্স তৈরি হয়, সেগুলো মানুষ হাতে হাতে ট্যাগ করতে বসলে প্রকাশের সময়ই ফুরিয়ে যায়। স্বয়ংক্রিয় লেবেলিং সেই চাপ কমায়। এর একটা দাম আছে: লেবেলটা পাইপলাইনের সবচেয়ে অদৃশ্য জায়গায় বসে, আর যা অদৃশ্য, তা নিরীক্ষিত হয় না। পরে কেউ যদি জিজ্ঞেস করে, এই প্রতিবেদনটা কী ধরনের — উত্তর খুঁজতে যে ফাইলের দিকে তাকাতে হয়, সেটাই কেউ আর খোলে না।
এই নথিতে প্রথম স্তরের দুটি ঘর খালি ছিল। জড়িত সত্তার ঘরে লেখা ছিল, উপরের ইনফরমেশন পয়েন্ট থেকে চিহ্নিত করুন — অর্থাৎ চিহ্নিত করা হয়নি। সময়-সংবেদনশীলতার ঘরটিও পূরণ হয়নি। এই দুটো ফাঁক এলোমেলো নয়; এগুলো একই রোগের লক্ষণ। যে ব্যবস্থা লেবেলটা বসায়, সেই ব্যবস্থাই সত্তাকে গুরুত্ব দেয় না।
মূল বিশ্লেষণ
দ্বিতীয় স্তরের কাঠামো যখন এই লেখার মুখোমুখি হলো, তখন যা ঘটল তা চমকপ্রদ নয়, কিন্তু শিক্ষণীয়। নয়টি মাত্রার প্রতিটি শূন্য হয়ে গেল। স্টাইল অ্যাডভান্সমেন্ট, সারফেস অ্যাডাপ্টেবিলিটি, ক্লাচ-পয়েন্ট অ্যাবিলিটি, ফার্স্ট-সার্ভ পার্সেন্টেজ, রিটার্ন পয়েন্টস ওন, ব্রেক-পয়েন্ট কনভার্শন — সব জায়গায় একটাই উত্তর: প্রযোজ্য নয়, কারণ বিষয়বস্তু টেনিস নয়।

এই ডেটাসেটের সবচেয়ে সৎ বাক্যটা ওই প্রযোজ্য নয় লেখাটাই।
বুঝতে হবে, এই টেমপ্লেটটা সদয় নয়। নয়টি সেকশন, তার ভেতরে ডজনখানেক টেবিল, প্রতিটির পাশে একটি করে মূল্যায়ন ঘর ফাঁকা পড়ে আছে। একটা উৎসাহী মডেলের কাছে এর চেয়ে বড় ফাঁদ আর নেই। ক্লাচ-পয়েন্ট অ্যাবিলিটি: মধ্যম লিখে দিলে টেবিলটা সুন্দর দেখাত। সারফেস অ্যাডাপ্টেবিলিটি: দক্ষ বসালে কেউ ধরতেও পারত না। কিন্তু ওই দুই শব্দ — অধরা, নিরাপদ, সম্পূর্ণ বানানো — যুক্ত হয়ে যেত একটি নিরাপত্তা-অপারেশনের নথির সঙ্গে, আর তারপর সেই মিথ্যা জ্ঞানের জাল ছড়িয়ে পড়ত সাজেশন, সারসংক্ষেপ আর কনটেন্ট ফিডে।
হিসাব রাখার অভ্যাস আমার আছে। ২০১৮ বিশ্বকাপে চৌষট্টি ম্যাচের xG মডেল বানিয়ে টুর্নামেন্টের আগেই ব্যাকেট প্রকাশ করেছিলাম, ব্যাখ্যা-সহ; ব্রাজিলের আগে ফ্রান্সকে দুই নম্বরে রেখেছিলাম। কাজ হয়েছিল, কিন্তু দুটো ভেরিয়েবল ভুল ছিল, আর সেটা আমি ওই মাসজুড়ে প্রকাশ্যে মেটিয়েছি। ২০২২-এ মরক্কোর সেমিফাইনালে পৌঁছানোর সম্ভাবনা নিজে থেকেই ১২ শতাংশ ধরেছিলাম, ভুল হয়েছিল, সেটাও লিখেছিলাম।
আমার লেজারে একটা কলাম আছে: পূর্বাভাস। এই নথিটা দেখিয়ে দিল আরেকটা কলাম দরকার — লেবেল। ভুল পূর্বাভাস একসময় স্কোর হয়, কারণ খেলাটা শেষ পর্যন্ত মাঠে গড়ায়। ভুল লেবেল কখনো স্কোর হয় না, কারণ সেটা পাইপলাইনের ভেতরেই অদৃশ্য হয়ে যায়। কেউ তার হিসাব চায় না, কেউ তার জন্য দায়ী থাকে না, আর সেটাই তাকে সবচেয়ে বিপজ্জনক ভুলে পরিণত করে।
২০২০-তে স্টেডিয়াম খালি হয়ে যাওয়ার পর আমি প্রতিটি পতনের গল্পের জন্য একটা স্থির কাঠামো দাঁড় করিয়েছিলাম — মূল কারণ, সময়রেখা, পুনরুদ্ধারের পথ। ওই কাঠামো কাজ করেছিল, কারণ প্রথমে আমি নিশ্চিত হয়েছিলাম মাঠটা সত্যিই খালি। খালি মাঠের টেমপ্লেট ভরা স্টেডিয়ামে চালালে যে বিশ্লেষণ বেরোত, সেটা অভ্যন্তরীণভাবে সুসংগত আর বাহ্যিকভাবে সম্পূর্ণ অর্থহীন হতো। এখানেও ঠিক তাই হয়েছে: নথিটা পরিপাটি, প্রতিটি ঘর পূরণ করার নিয়ম মানা, আর গোটা জিনিসটা ফাঁকা।
বিপরীত দৃষ্টিকোণ
সহজ সিদ্ধান্তটা হলো, সমস্যা মডেলের মনগড়া বানানো। ভুলটা উল্টো দিকে। এই নথিতে মডেল একটি ভুয়া টেনিস মন্তব্যও লেখেনি। বরং প্রতিটি অপ্রযোজ্য ঘরে সে নিয়ম মেনে শূন্য বসিয়েছে, আর শেষে ঠিক যে কাজটা করা উচিত ছিল সেটাই করেছে — ঘোষণা করেছে, ইনপুটটাই ভুল।
ভয়টা ভুল আউটপুট নিয়ে নয়, ভুল ইনপুট নিয়ে। আউটপুট খারাপ হলে চোখে পড়ে, ধরার উপায় থাকে। ইনপুট ভুল হলে সেটা দশটা ধাপ পেরিয়ে গিয়ে তবেই পড়ে, আর ততদিনে হয়তো সাজেশন ফিডে পৌঁছে গেছে।
দ্বিতীয় বিপরীত বাঁকটা এখানেই। এই নথি পড়ে এখন কেউ চাইতে পারে, নিরাপত্তা-অপারেশনটির আসল বিশ্লেষণ এই কলামে থাকুক। ওটা হবে একই ভুলের উল্টো সংস্করণ। যার কাজ খেলার মাঠ বোঝা, তার হাতে কোনো দেশের সন্ত্রাসবিরোধী অভিযান মূল্যায়নের সরঞ্জাম নেই — না সূত্রের, না এখতিয়ারের। সবচেয়ে আনুগত্যভাবে শূন্য লেখাটাই এখানে পেশাদারি।
তৃতীয় আত্মসমীক্ষা: ভুল বিষয়ের উপর সঠিক শব্দচয়নও এক ধরনের ধার করা জমকালোপনা। যুদ্ধ-অভিযানের পরিসংখ্যানের পাশে ক্লাচ-পয়েন্ট অ্যাবিলিটি শব্দটা বসালে দুই জায়গাতেই ক্ষতি হয় — খেলার ভাষা ফাঁপা হয়ে যায়, আর গুরুতর বিষয়টা বিশ্লেষণী কাঠামোর চেহারা পেয়ে হালকা হয়ে যায়। ছোট ফলকে তার আসল মাপে লিখতে হয়; এখানে ফলটা ছোট নয়, কিন্তু সেটা এই কলামের বিষয়ও নয়।
পরবর্তী দিক
আমি এই লেজারটা আবার খুলব প্রকাশের নব্বইতম দিনে। তিনটে জিনিস দেখব। এক, পরের প্রতিবেদনগুলোতে সত্তা ও সময়-সংবেদনশীলতার ঘর পূরণ হচ্ছে কি না। দুই, পাইপলাইনে একই ধরনের ডোমেইন-অমিল দ্বিতীয়বার ফিরে আসছে কি না। তিন, শূন্য উত্তরের নথিগুলোকে ব্যর্থতা ভাবা হচ্ছে, নাকি সফল নিরীক্ষা ভাবা হচ্ছে।
৮০ শতাংশ আত্মবিশ্বাসে বলছি, লেবেল-স্তরে একটি যাচাই-স্তর বসানো না হলে আগামী এক বছরে এই ধরনের অমিল আরও অন্তত তিনবার এই পাইপলাইনে ফিরবে। ব্যর্থতার শর্তটা স্পষ্ট: নব্বই দিন পরেও যদি কোনো প্রতিবেদনে সত্তার ঘর খালি থাকে, তাহলে ধরে নেব আমরা সমস্যাটা ঠিক করিনি, শুধু একটা প্রতিবেদন ফেলে দিয়েছি।
আমি পডকাস্টটা বানিয়েছিলাম কারণ পুরনো গেটকিপাররা আর শুনছিল না। কিন্তু গেট বদলালেই কাজ শেষ হয় না — গেটের সামনে দাঁড়ানো লেবেলটা যদি ভুল হয়, নতুন গেটও ভুল মানুষকে ভেতরে ঢোকাবে। মাঠ চেনার আগে স্কোর লেখা যায় না; আর প্রতিবেদন চেনার আগে কোন বিশ্লেষণের কাঠামো চালু হবে, সেটাও ঠিক করা যায় না।
