Лінейная (аг | рэг) рэсія

Знайдзі расіста з дапамогай статыстыкі і філасофіі навукі

#statistics

Даследаванне пра расавую дыскрымінацыю ў амерыканскай судовай сістэме. Дадзеныя пра 1116 суддзяў і 380000 прысудаў. Замяраецца тое, колькі год у сярэднім атрымліваюць чорныя, белыя, лацінасы і іншыя. Аналіз кантралюецца на тып злачынства, крымінальную гісторыю падсудных і іншыя фактары, якія могуць уплываць на прысуд.

Праз гэты аналіз знайшлі самых расісцкіх суддзяў - тых, хто выносіць больш жорсткія прысуды чорным ці лацінасам, але не белым. Напрыклад, у цябе было 100 чорных, 40 з іх ты апраўдаў. А са 100 белых, якія ў цябе былі, ты апраўдаў 60. Выбарка вялікая, вынік падазроны, вынік кансістэнтны з дэфініцыяй расізму. А значыць ты расіст. Гучыць лагічна.

Цяпер сачыце за рукамі. Дакладней, рукамі падлічваць мне лянота, таму я проста напісаў сімуляцыю: 1116 суддзяў, у кожнага па 380000/1116 спраў, палова падсудных - чорныя, палова - белыя. Шанец вынесці апраўдальны прысуд заўсёды 50%. Максімальная роўнасць. Таксама прыкруціў ім рандомны генератар імёнаў (інакш неяк непрыгожа).

Атрымаў наступных таварышаў:

Abeyta, Jazmin: 35.3% апраўдальных прысудаў чорным супраць 54% белым
al-Soliman, Mawdood: 38.2% супраць 55.8%
Houge, Charrdonnay: 40.1% супраць 57%

І г.д.

Што гэта значыць? Гэта значыць, што інтэрпрэтацыя дадзеных крытычна залежыць ад гіпотэзы, якую мы правяраем, ад пытання, якое мы задаём.

Калі правяраць гіпотэзу “сярод нас ёсць суддзі-расісты, хто яны?” (“сярод 1116 манет ёсць падкручаная манета, якая з іх?”), натуральна, што Jazmin, Mawdood і Charrdonnay - першыя кандыдаты на тое, каб быць названымі расістамі.

Калі правяраць гіпотэзу “ці ёсць сярод нас суддзі-расісты?” (“ці ёсць сярод 1116 манет падкручаная?”), дадзеныя абсалютна кансістэнтныя з тым, што ў кожнай манеты 50% шанец выпасці на любы бок. Проста калі падкінуць 1116 манет па 340 разоў кожную, рана ці позна мы пабачым анамальныя вынікі.

Паперу яны па выніку перапісалі, адзін з аўтараў нават выдаліў твітэр.

957 views10:48