جوڑی وار درجہ بندی کے بارے میں
بہتر فیصلوں کی سائنس۔
جوڑی وار موازنہ کوئی نیا خیال نہیں۔ نفسیات، معاشیات اور فیصلہ سازی کی سائنس میں تقریباً ایک صدی کی تحقیق کے دوران اس کا مطالعہ، تجربہ اور تصدیق کی جا چکی ہے۔
نفسیاتی طبیعیات سے بورڈ رومز تک
ایک طریقہ جسے 1927 میں باقاعدہ شکل دی گئی — اور تب سے بار بار دہرایا گیا۔

جوڑی وار موازنے کی فکری تاریخ ایک عملی مسئلے سے شروع ہوتی ہے: ان چیزوں کی پیمائش کیسے کی جائے جن کی کوئی قدرتی اکائی نہیں؟
University of Chicago کے ماہرِ نفسیات لوئس لیون تھرسٹن کا تجویز کردہ جواب یہ تھا کہ چیزوں کا براہِ راست، جوڑیوں میں موازنہ کیا جائے۔ ان کے 1927 کے مقالے A Law of Comparative Judgment نے اس بصیرت کو ایک درست ریاضیاتی ماڈل کی شکل دی۔
تھرسٹن کی بصیرت ایک تجرباتی مشاہدے پر مبنی تھی: لوگ ”ان دونوں میں سے کون سی آواز زیادہ اونچی ہے؟“ کا جواب ”ایک سے دس کے پیمانے پر یہ آواز کتنی اونچی ہے؟“ کے مقابلے میں کہیں بہتر دیتے ہیں۔
جوڑیاں اسکیلز سے بہتر کیوں کام کرتی ہیں
ریٹنگ کا ذہنی بوجھ جتنا نظر آتا ہے اس سے زیادہ ہے۔
جب آپ کسی سے کہتے ہیں کہ کسی اسٹریٹجک ترجیح کی اہمیت کو ایک سے دس کے پیمانے پر درجہ دے، تو آپ اس سے بیک وقت کئی ذہنی عمل انجام دینے کو کہہ رہے ہوتے ہیں۔ یہ عمل ہر مرحلے پر منظم غلطی پیدا کرتا ہے۔
ان غلطیوں میں سب سے نقصان دہ اینکرنگ تعصب ہے۔ پہلا درجہ دیا گیا آئٹم بعد کی تمام ریٹنگز پر اثر انداز ہوتا ہے؛ Tversky اور Kahneman (1974) کی تحقیق نے ثابت کیا کہ اینکرنگ کے اثرات بڑے بھی ہوتے ہیں اور ان کی اصلاح بھی نہایت مشکل ہوتی ہے۔
غلطی کا دوسرا ذریعہ اسکیل کا سکڑاؤ ہے۔ عملاً زیادہ تر جواب دہندگان پیمانے کے انتہائی سروں سے گریز کرتے ہیں اور جوابات درمیان میں جمع کر دیتے ہیں — یہی وجہ ہے کہ بارہ ترجیحات کا سروے اکثر بارہ ایسی چیزیں لوٹاتا ہے جو سب ”بہت اہم“ ہوتی ہیں۔
پورا عمل یہی ہے، بار بار دہرایا جاتا ہے یہاں تک کہ ہر آئٹم کا ہر دوسرے آئٹم سے موازنہ ہو جائے۔
کسی سے انہیں دس میں سے نمبر دینے کو کہیں تو دونوں کو نو ملتے ہیں۔ انتخاب کرنے کو کہیں تو وہ ایک سیکنڈ میں جواب دیتے ہیں — اور دل سے دیتے ہیں۔
ترجیحات درجہ بندی کیسے بنتی ہیں
یکجا کرنے کا طریقہ سادہ، شفاف اور ریاضیاتی بنیاد رکھتا ہے۔
درجہ بندی کے لیے n آئٹمز دیے جائیں تو ہر آئٹم کا ہر دوسرے آئٹم سے ٹھیک ایک بار موازنہ ہوتا ہے۔ درکار موازنوں کی کل تعداد n(n−1)/2 ہے۔
انفرادی جوابات کو یکجا کرنا
ہر آئٹم کا اسکور اس کی جیت کی شرح ہے: اس کے موازنوں میں سے جیتے گئے حصے کا تناسب، جس میں برابری یا چھوڑنا آدھا شمار ہوتا ہے۔ جیت کی بنیاد پر آئٹمز کو ترتیب دینا سادہ اور شفاف ہے، اور تحقیق سے پتا چلتا ہے کہ یہ زیادہ پیچیدہ شماریاتی ماڈلز کے مقابلے میں اچھی کارکردگی دکھاتا ہے (Shah & Wainwright, 2018)۔
گروپ کے جوابات کو یکجا کرنا
گروپ سیشنز میں حتمی درجہ بندی کا حساب لگانے سے پہلے ہر شریک کے موازنے یکجا کیے جاتے ہیں۔ کسی بھی موازنے کے لیے گروپ کی کل جیتیں تمام شرکاء کے انفرادی ووٹوں کا مجموعہ ہوتی ہیں۔
سب سے اہم بات یہ کہ یکجا نتیجہ اختلاف کی شکل بھی ظاہر کرتا ہے۔ گروپ کو تقسیم کرنے والے آئٹمز ڈیٹا میں نظر آتے ہیں — اور یہ اکثر گروپ سیشن کا سب سے قیمتی حاصل ہوتا ہے۔
گروپ سیشن بطور تشخیصی ٹول
درجہ بند فہرست واحد حاصل نہیں۔ اختلاف کی شکل بھی اتنی ہی اہم ہے۔
گروہی فیصلہ سازی کے روایتی طریقوں میں ایک بنیادی خامی مشترک ہے: وہ اس ترتیب سے متاثر ہوتے ہیں جس میں آراء کا اظہار کیا جاتا ہے۔ جو شخص پہلے بولتا ہے وہ گروپ کی سمت طے کر دیتا ہے۔
گروپ عموماً اُن باتوں پر بات کرتے ہیں جو سب پہلے سے جانتے ہیں، اور اُس معلومات سے کم فائدہ اٹھاتے ہیں جو صرف ایک رکن جانتا ہے۔ یہی پوشیدہ پروفائل کا مسئلہ ہے (Stasser & Titus, 1985)۔ کسی بھی بحث سے پہلے ہر فرد کے انتخاب نجی طور پر جمع کرنے سے ہر نقطۂ نظر سامنے آ جاتا ہے۔
یہ کہاں استعمال ہوتا ہے
نفسیاتی صوتیات سے AI کی تربیت تک — یہ طریقہ ہر پیمانے پر کام کرتا ہے۔
اسٹریٹجک منصوبہ بندی اور انتظام
Analytic Hierarchy Process دفاع، انفراسٹرکچر، صحت اور حکومت میں بڑے داؤ والے اسٹریٹجک فیصلوں میں استعمال ہوتا رہا ہے۔ 2008 کے ایک جائزے میں 19 مختلف شعبوں میں 900 سے زائد شائع شدہ اطلاقات کی نشاندہی کی گئی۔
مشین لرننگ اور AI
انسانی فیڈبیک سے ری انفورسمنٹ لرننگ (RLHF)، جو جدید بڑے لسانی ماڈلز کی تربیت کی تکنیک ہے، مکمل طور پر جوڑی وار موازنے پر انحصار کرتی ہے۔ انسانی جائزہ کاروں کو ماڈل کے دو جوابات دکھا کر بہتر کا انتخاب کرنے کو کہا جاتا ہے۔
کھیل اور مسابقتی درجہ بندی
شطرنج، فٹ بال اور درجنوں دیگر مسابقتی شعبوں میں استعمال ہونے والا ایلو ریٹنگ سسٹم، بریڈلی–ٹیری جوڑی وار ماڈل سے گہرا تعلق رکھتا ہے۔
مزید مطالعہ
بنیادی ماخذ اور اہم تحریریں۔
A Law of Comparative Judgment. Psychological Review, 34(4), 273–286.
Rank analysis of incomplete block designs. Biometrika, 39(3/4), 324–345.
A Scaling Method for Priorities in Hierarchical Structures. Journal of Mathematical Psychology, 15(3), 234–281.
Judgment under Uncertainty: Heuristics and Biases. Science, 185(4157), 1124–1131.
Pooling of Unshared Information in Group Discussion. Journal of Personality and Social Psychology, 48(6), 1467–1478.
Deep Reinforcement Learning from Human Preferences. NeurIPS 2017.
Simple, Robust and Optimal Ranking from Pairwise Comparisons. Journal of Machine Learning Research.
دو منٹ سے کم میں انفرادی یا گروپ سیشن ترتیب دیں۔ شروع کرنے کے لیے اکاؤنٹ ضروری نہیں۔