O párovém pořadí

Věda o lepších rozhodnutích.

Párové porovnávání není nový nápad. Bylo zkoumáno, testováno a ověřováno téměř celé století výzkumu v psychologii, ekonomii a vědě o rozhodování.

1927 Thurstone formalizuje metodu
900+ publikovaných aplikací v 19 oborech
14 nezávislých studií, podle nichž páry překonávají škály
Psací stroj, poznámkový blok a tužka

Od psychofyziky po zasedačky

Metoda formalizovaná v roce 1927 — a od té doby stále znovu ověřovaná.

Thurstone, A Law of Comparative Judgment, Chicagská univerzita, 1927.

Intelektuální dějiny párového porovnávání začínají praktickým problémem: jak měřit věci, které nemají přirozenou jednotku?

Odpověď, kterou navrhl psycholog Louis Leon Thurstone z Chicagské univerzity, zněla porovnávat věci přímo, po dvojicích. Jeho článek z roku 1927, A Law of Comparative Judgment, převedl tuto myšlenku do přesného matematického modelu.

„Metoda párových porovnání dává škálu psychologických hodnot, která je spolehlivější než jakákoli jiná metoda škálování.“

Louis Leon Thurstone · Psychological Review · 1927

Thurstonova myšlenka vycházela z empirického pozorování: lidé mnohem lépe odpovídají na otázku „která z těchto dvou věcí je hlasitější?“ než „jak hlasitá je tato věc na škále od jedné do deseti?“

Proč páry fungují lépe než škály

Kognitivní zátěž hodnocení je vyšší, než se zdá.

Když někoho požádáte, aby na škále od jedné do deseti ohodnotil důležitost strategické priority, žádáte ho o několik kognitivních operací současně. Tento proces vnáší systematickou chybu do každého kroku.

Nejškodlivější z těchto chyb je efekt ukotvení. První hodnocená položka má sklon ovlivnit všechna další hodnocení; výzkum Tverského a Kahnemana (1974) ukázal, že efekty ukotvení jsou velké a pozoruhodně odolné vůči korekci.

Druhým zdrojem chyby je stlačení škály. V praxi se většina respondentů vyhýbá krajním hodnotám a odpovědi soustřeďuje doprostřed — proto dotazník s dvanácti prioritami tak často vrátí dvanáct věcí, které jsou všechny „velmi důležité“.

Celá interakce, opakovaná stále dokola, dokud není každá položka porovnána s každou další.

Zvýšení platu
NEBO
Týden volna navíc
Nižší cena
NEBO
Rychlejší dodání
Jeden senior
NEBO
Dva junioři

Požádejte kohokoli, aby je ohodnotil z deseti, a obě dostanou devítku. Požádejte ho, aby si vybral, a odpoví za vteřinu — a myslí to vážně.

Poznámka k výzkumu
Převaha párového porovnávání nad hodnoticími škálami byla opakovaně prokázána ve čtrnácti nezávislých studiích (Dillon, Frederick & Tangpanichdee, 1985).

Jak se z preferencí stane pořadí

Metoda agregace je jednoduchá, transparentní a matematicky podložená.

Máte-li seřadit n položek, každá se porovná s každou další právě jednou. Celkový počet potřebných porovnání je n(n−1)/2.

Agregace jednotlivých odpovědí

U individuálních relací se výsledek odvozuje přímo z počtu výher: každá položka dostane jeden bod za každé vyhrané porovnání. Výsledný seznam řadí položky od nejvíce výher po nejméně.

Agregace odpovědí skupiny

U skupinových relací se porovnání každého účastníka sečtou dříve, než se vypočítá konečné pořadí. Celkový počet výher skupiny v kterémkoli porovnání je součtem jednotlivých hlasů všech účastníků.

Podstatné je, že agregovaný výsledek ukazuje i tvar neshody. Položky, které skupinu rozdělují, jsou v datech vidět — a to bývá nejcennějším výstupem skupinové relace.

O netranzitivitě
Ve vzácných případech může párové porovnávání dát netranzitivní výsledky — A poráží B, B poráží C, ale C poráží A. Tomu se říká Condorcetův paradox.

Skupinová relace jako diagnostický nástroj

Seřazený seznam není jediným výstupem. Tvar neshody je stejně důležitý.

Běžné metody skupinového rozhodování mají společnou zásadní vadu: jsou citlivé na pořadí, v jakém zazní názory. První, kdo promluví, skupinu ukotví.

Nejde o selhání jednotlivců — je to předvídatelný důsledek skupinové dynamiky. Výzkum opakovaně zjistil, že skupinové diskuse vedou k méně přesným společným úsudkům než agregace nezávislých soukromých úsudků. Tento jev se někdy nazývá problém skrytého profilu.

„Skupiny soustavně nesdílejí informace, které má jen některý člen, a toto selhání je systematické, nikoli náhodné.“

Stasser & Titus · Journal of Personality and Social Psychology · 1985
Poznámka pro moderátora
Skupinovou relaci nejlépe využijete, když výsledek ukážete před začátkem diskuse, ne až po ní. Ukázat skupině, co si společně myslí — dřív, než kdokoli promluví — mění kvalitu následného rozhovoru.

Kde se používá

Od psychoakustiky po trénování AI — metoda škáluje.

Strategické plánování a řízení

Analytický hierarchický proces (AHP) se používá při strategických rozhodnutích s vysokými sázkami v obraně, infrastruktuře, zdravotnictví a státní správě. Přehledová studie z roku 2008 identifikovala přes 900 publikovaných aplikací v 19 různých oborech.

Strojové učení a AI

Posilované učení ze zpětné vazby lidí (RLHF), technika používaná k trénování dnešních velkých jazykových modelů, stojí výhradně na párovém porovnávání. Lidští hodnotitelé vidí dva výstupy modelu a vybírají ten lepší.

Sport a soutěžní žebříčky

Systém Elo, používaný v šachu, fotbale a desítkách dalších soutěžních oborů, je přímou aplikací párového modelu Bradleyho–Terryho.

Další četba

Primární zdroje a klíčové texty.

01
Thurstone, L. L. (1927)
A Law of Comparative Judgment. Psychological Review, 34(4), 273–286.
02
Bradley, R. A. & Terry, M. E. (1952)
Rank analysis of incomplete block designs. Biometrika, 39(3/4), 324–345.
03
Saaty, T. L. (1977)
A Scaling Method for Priorities in Hierarchical Structures. Journal of Mathematical Psychology, 15(3), 234–281.
04
Tversky, A. & Kahneman, D. (1974)
Judgment under Uncertainty: Heuristics and Biases. Science, 185(4157), 1124–1131.
05
Stasser, G. & Titus, W. (1985)
Pooling of Unshared Information in Group Discussion. Journal of Personality and Social Psychology, 48(6), 1467–1478.
06
Christiano, P. et al. (2017)
Deep Reinforcement Learning from Human Preferences. NeurIPS 2017.
Chcete metodu vyzkoušet?

Nastavte individuální nebo skupinovou relaci za méně než dvě minuty. Pro začátek nepotřebujete účet.

Vytvořit nové pořadí →