Bias kognitif adalah kesilapan sistematik dan boleh diramal dalam pertimbangan yang dihasilkan oleh jalan pintas mental yang digunakan orang untuk membuat keputusan dalam keadaan ketidakpastian. Program penyelidikan moden bermula dengan kertas kerja Amos Tversky dan Daniel Kahneman pada tahun 1974 dalam Science, yang menerangkan tiga heuristik — kebolehan mewakili, ketersediaan, dan penyesuaian dari satu titik rujukan — dan menyimpulkan bahawa heuristik ini sangat ekonomik dan biasanya berkesan, tetapi ia membawa kepada kesilapan sistematik dan boleh diramal. Kahneman menerima Hadiah Sveriges Riksbank dalam Sains Ekonomi 2002 kerana mengintegrasikan penyelidikan psikologi ke dalam sains ekonomi; Tversky telah meninggal dunia pada tahun 1996 dan hadiah tersebut tidak diberikan secara anumerta. Tiga istilah sering dikelirukan. Heuristik adalah jalan pintas itu sendiri, dan biasanya bersifat adaptif. Bias kognitif adalah kesilapan sistematik yang dihasilkan oleh jalan pintas tersebut. Kesilapan logik adalah kecacatan dalam struktur hujah dan bukannya dalam pertimbangan. Dan bunyi, subjek buku Kahneman, Sibony dan Sunstein pada tahun 2021, adalah variabiliti yang tidak diingini dalam pertimbangan masalah yang sama — penyebaran dan bukannya kesilapan arah — yang mana kajian insurans mereka mendapati menghasilkan premium median untuk pelanggan fiksyen yang sama berbeza sebanyak 55 peratus. Bias yang paling penting untuk keputusan organisasi adalah bias pengesahan, penetapan, ketersediaan, keyakinan berlebihan dan ketepatan berlebihan, kesilapan perancangan, bias status quo, pembingkaian, bias pandangan belakang, bias korespondensi atau kesilapan atribusi asas, kos terbenam, pengabaian kadar asas, dan corak Dunning-Kruger. Bukti untuk ini berbeza secara substansial dalam kekuatan, dan perlakuan yang jujur adalah penting: penetapan secara kebetulan dari nombor rawak gagal untuk direplikasi dalam Many Labs 2, demonstrasi frekuensi huruf bagi ketersediaan telah dipatahkan oleh Sedlmeier, Hertwig dan Gigerenzer pada tahun 1998, pengabaian kadar asas sangat bergantung kepada format, dan kesan Dunning-Kruger sebahagian besarnya adalah artefak statistik dari regresi kepada purata dan bukannya defisit metakognitif. Pengurangan ego, maklum balas wajah melalui paradigma pen dalam mulut, pengaktifan sosial dan pose kuasa semuanya gagal dalam replikasi besar. Di pihak penyelesaian, kesedaran sahaja tidak berfungsi: Pronin, Lin dan Ross mendapati peserta bertegas bahawa penilaian diri mereka adalah tepat selepas membaca penerangan tentang bias yang mempengaruhi mereka. Apa yang berfungsi adalah struktur — pengagregatan mekanikal pertimbangan mengatasi pertimbangan klinikal dalam meta-analisis Grove dan rakan-rakan terhadap 136 kajian, latihan mengurangkan bias dengan amalan dan maklum balas berterusan selama berbulan-bulan dan dipindahkan ke dalam persekitaran profesional, mempertimbangkan yang bertentangan mengurangkan penetapan walaupun di kalangan pakar, dan ramalan kelas rujukan menentang kesilapan perancangan dengan cukup baik sehingga HM Treasury memerlukan penyesuaian bias optimisme yang jelas. Argumentree menangani ini secara struktural dan bukannya melalui seruan: penyerahan bebas sebelum perbincangan menghapuskan penetapan dan penonton, setiap hujah membawa buktinya dan boleh dinilai berdasarkan merit dan bukannya berdasarkan pengarangnya, dan rekod keputusan bertanda waktu membolehkan keputusan dinilai kemudian berdasarkan apa yang diketahui pada masa itu.

Bias kognitif adalah kesilapan dalam pertimbangan yang sistematik dan boleh diramalkan — bukan kecuaian yang rawak, tetapi kesilapan yang condong ke arah yang sama setiap kali. Kebolehramalan itu adalah berita baik: kesilapan yang boleh anda jangkakan adalah kesilapan yang boleh anda reka bentuk di sekelilingnya.
Dikemas kini terakhir: 2026-08-25
Bias datang dari heuristik — jalan pintas yang diterangkan oleh Tversky dan Kahneman sebagai "sangat ekonomik dan biasanya berkesan" tepat kerana ia berfungsi kebanyakan masa. Di bawah adalah dua belas yang paling penting untuk keputusan organisasi, masing-masing dengan kajian kanoniknya, contoh perniagaan, dan Status replikasi yang jujur — kerana beberapa penemuan terkenal tidak bertahan dalam dekad terakhir, dan halaman rujukan yang menyembunyikannya bukanlah halaman rujukan. Penyelesaian yang berkesan adalah struktur, bukan motivasi: memberitahu orang tentang bias adalah intervensi terlemah dalam literatur.
Ini digunakan secara bergantian dan mereka tidak boleh dipertukarkan. Memisahkan mereka adalah nilai praktikal yang paling penting di halaman ini.
Program penyelidikan bermula dengan kertas kerja Amos Tversky dan Daniel Kahneman pada tahun 1974 dalam Science, yang menamakan tiga heuristik — kebolehan mewakili, ketersediaan, dan penyesuaian dari satu jangkar — dan menarik kesimpulan yang masih membingkai bidang ini: "Heuristik ini sangat ekonomik dan biasanya berkesan, tetapi ia membawa kepada kesilapan yang sistematik dan boleh diramalkan." Kahneman menerima Hadiah Nobel Memorial dalam Sains Ekonomi 2002 untuk kerja ini; Tversky telah meninggal dunia pada tahun 1996, dan hadiah tersebut tidak diberikan secara anumerta.
Setiap entri: apa ia, keputusan di mana ia memberi kesan, apa yang sebenarnya disokong oleh bukti, dan apa yang berubah apabila alasan disusun. Status replikasi dinyatakan dengan jelas — beberapa daripada ini lebih lemah daripada reputasi mereka, dan dua penemuan yang paling terkenal dalam psikologi bersebelahan gagal secara terang-terangan.
Mencari dan menilai bukti yang menyokong apa yang sudah anda fikirkan. Di mana ia menggigit: senarai vendor yang disusun selepas seseorang telah memutuskan secara peribadi, di mana setiap panggilan rujukan mengesahkan dan bukannya menguji.
Bukti: Tugas penemuan peraturan Wason 1960 adalah asalnya, walaupun kesimpulan beliau sendiri terpakai kepada subkumpulan yang bertahan selepas dua atau lebih kesilapan. Klayman dan Ha (1987) mengubahnya menjadi strategi ujian positif yang secara normatif adalah wajar dalam kebanyakan persekitaran — anda tidak tidak rasional kerana mencari di tempat yang anda jangkakan untuk menemui sesuatu. Meta-analisis Hart dan rakan-rakan 2009 dalam Psychological Bulletin meletakkan bias kesesuaian pada d = 0.36, dan ia terbalik apabila maklumat yang menafikan adalah benar-benar berguna.
Dalam Argumentree: cabang con tidak pilihan. Tuntutan tanpa kes lawan yang direkodkan adalah jelas tidak lengkap dan bukannya tidak dicabar secara senyap, dan rantai soalan mengaitkan cabaran kepada tuntutan tepat yang dipertikaikannya.
Nombor pertama yang disebut menetapkan julat yang diperdebatkan oleh semua orang. Di mana ia memberi kesan: sesiapa yang menyebut angka bajet, penilaian atau tarikh penghantaran terlebih dahulu telah mengubah setiap anggaran seterusnya.
Bukti: Demonstrasi Tversky dan Kahneman pada tahun 1974 mempunyai anggaran median 25 berbanding 45 untuk kuantiti yang sama selepas penetapan 10 dan 65. Banyak Labs 1 mengulangi penetapan dengan kukuh — tetapi menggunakan penetapan yang diberikan. Penetapan kebetulan dari nombor rawak gagal dalam Banyak Labs 2 (d = 0.04, p = .09, N = 6,826). Jadi: penetapan yang disengajakan menggerakkan orang; nombor sewenang-wenangnya dalam persekitaran kebanyakannya tidak.
Dalam Argumentree: kedudukan dihantar secara bebas sebelum perbincangan, jadi tiada nombor pertama untuk dijadikan penetapan. Penetapan memerlukan penonton, dan input tidak segerak menghilangkannya.
Menilai betapa mungkin sesuatu berdasarkan betapa mudahnya contoh muncul dalam fikiran. Di mana ia menggigit: gangguan suku terakhir mendominasi daftar risiko sementara risiko yang lebih besar dan perlahan yang tiada cerita tentangnya tidak disenaraikan.
Bukti: terbahagi, dan penting untuk mengetahui separuh mana. Demonstrasi frekuensi huruf yang terkenal telah dikurangkan — Sedlmeier, Hertwig dan Gigerenzer (1998) mendapati penilaian secara amnya mengikuti proporsi sebenar. Mekanisme kemudahan-pengambilan masih ada: meta-analisis Weingarten dan Hutchinson pada tahun 2018 merentasi 263 kajian mendapati kesan sederhana, walaupun bias penerbitan mengurangkannya sehingga satu pertiga.
Dalam Argumentree: hujah membawa bukti mereka, jadi anekdot yang jelas dan kadar asas duduk berdampingan dan dinilai secara berasingan — dan garis masa menunjukkan bila setiap satu memasuki perbincangan.
Kertas kerja Moore dan Healy pada tahun 2008 dalam Psychological Review membahagikannya kepada tiga: melebih-lebihkan skor anda, meletakkan diri anda terlalu tinggi berbanding orang lain, dan overprecision — terlalu yakin bahawa anggaran anda adalah betul. Di mana ia memberi kesan: julat penghantaran yang terlalu sempit, jadi setiap pelan di bawahnya mewarisi ketepatan yang salah.
Bukti: overprecision adalah yang paling kukuh. Soll dan Klayman mendapati selang keyakinan "kadang-kadang hanya 40% sebesar yang diperlukan untuk dikalibrasi dengan baik." Melebih-lebihkan dan meletakkan diri terlalu tinggi bertukar dengan kesukaran tugas — tugas yang sukar menghasilkan melebih-lebihkan tetapi underplacement — dan kesan sukar-mudah itu sendiri adalah sebahagian daripada artefak regresi (Juslin et al. 2000).
Dalam Argumentree: penilaian adalah pada hujah, bukan pada pernyataan, jadi tuntutan yang yakin dengan bukti yang tipis mendapat skor seperti bukti yang tipis.
Meremehkan masa penyelesaian sendiri sambil menilai masa penyelesaian orang lain secara realistik. Di mana ia memberi kesan: setiap migrasi, integrasi dan tarikh pelancaran yang pernah anda tetapkan.
Bukti: kuat dalam bidang ini. Flyvbjerg dan rakan-rakan (2002) mengkaji 258 projek pengangkutan bernilai kira-kira US$90bn dan mendapati kos direndahkan dalam kira-kira sembilan daripada sepuluh — kereta api +45%, pautan tetap +34%, jalan raya +20%. Buehler, Griffin dan Ross (1994) adalah asal makmal, dan yang penting, bias tersebut telah dihapuskan apabila peserta dipaksa untuk menghubungkan anggaran dengan pengalaman lalu. Amaran yang perlu diingat: tinjauan Halkjelsvik dan Jørgensen pada 2012 mendapati meremehkan dominan dalam literatur kejuruteraan dan pengurusan tetapi tidak dalam literatur psikologi.
Dalam Argumentree: anggaran menjadi satu tuntutan dengan bukti yang dilampirkan — termasuk kelas rujukan — bukannya nombor yang dinyatakan dalam mesyuarat perancangan.
Menyukai pengaturan semasa, dan menganggap "tidak melakukan apa-apa" sebagai neutral dan bukannya sebagai pilihan dengan akibat. Di mana ia memberi kesan: vendor yang sedia ada diperbaharui kerana beralih memerlukan justifikasi dan kekal tidak.
Bukti: antara yang terkuat di sini. Samuelson dan Zeckhauser (1988) menjalankan kajian ke atas 486 subjek dan mendapati bahawa hanya 28% peserta TIAA-CREF yang pernah mengubah pengagihan mereka. Meta-analisis Jachimowicz dan rakan-rakan pada tahun 2019 mengenai kesan lalai merentasi 58 set data (n = 73,675) melaporkan d = 0.68 [0.53, 0.83], dan Madrian dan Shea mendapati penyertaan 401(k) bergerak dari 37% kepada 86% hanya dengan perubahan lalai.
Dalam Argumentree: "mengekalkan apa yang kita ada" dimasukkan sebagai pilihan dengan kebaikan dan keburukannya sendiri, jadi ia bersaing berdasarkan bukti dan bukannya menang dengan tidak berada dalam agenda.
Fakta yang sama yang diterangkan sebagai keuntungan atau kerugian menghasilkan pilihan yang berbeza. Di mana ia menggigit: "90% kadar kejayaan" dan "10% kadar kegagalan" adalah nombor yang sama dan tidak memberi kesan yang sama.
Bukti: kukuh dalam arah, lebih kurang separuh daripada magnitud asal. Banyak Labs 1 mengulangi item penyakit Asia Tversky dan Kahneman: asal d = 1.13 → pengulangan d = 0.62 (N = 6,271). Banyak Labs 2 mengulangi item berbeza dari kertas yang sama pada tahun 1981 — asal OR 4.96 → OR 2.06 (N = 7,228). Kedua-duanya sering dikelirukan; mereka adalah kajian yang berbeza. Meta-analisis Kühberger terhadap 136 kertas menyatakan bahawa pembingkaian adalah boleh dipercayai dan bersaiz kecil hingga sederhana.
Dalam Argumentree: kriteria keputusan ditulis sebelum pilihan dibingkai, dan satu tuntutan boleh dinyatakan sekali dan dicabar dalam kedua-dua bingkai daripada bertahan berdasarkan penyampaian.
Setelah anda mengetahui hasilnya, anda percaya bahawa anda sudah mengetahuinya sejak awal. Di mana ia menggigit: post-mortem yang menjadi pencarian siapa yang sepatutnya melihatnya, yang mengajar semua orang untuk lebih diam pada masa akan datang.
Bukti: kukuh, magnitud dipertikaikan. Fischhoff (1975) menunjukkan pengetahuan hasil meningkatkan kemungkinan yang dinilai dan bahawa orang ramai sebahagian besarnya tidak menyedari pergeseran tersebut. Meta-analisis tidak bersetuju tentang saiz: Christensen-Szalanski dan Willham (122 kajian) melaporkan r = .17; Guilbault dan rakan-rakan (95 kajian) melaporkan median sekitar .39 — dan mendapati manipulasi pengurangan bias sebahagian besarnya tidak berkesan.
Dalam Argumentree: rekod keputusan dicatatkan dengan cap waktu, jadi semakan boleh menilai keputusan berdasarkan bukti yang wujud pada masa itu dan bukannya berdasarkan hasil yang tiba kemudian.
Menjelaskan tingkah laku berdasarkan karakter sambil mengabaikan situasi. Di mana ia menggigit: projek itu gagal kerana pemimpin itu lemah — bukannya kerana proses memberikan mereka tarikh akhir yang ditetapkan oleh penetapan dan pelan yang diluluskan melalui konsensus.
Bukti: kukuh dalam paradigma. Jones dan Harris (1967) mendapati atribusi sikap berterusan walaupun posisi esei ditugaskan dan bukannya dipilih. Banyak Labs 2 berjaya mengulangi kajian bias korespondensi — asal d = 1.75, pengulangan d = 1.82, salah satu hasil yang lebih kukuh dalam set tersebut. Secara lintas budaya, ia melemahkan dan bukannya hilang.
Dalam Argumentree: hujah dinilai, orang tidak. Itulah keseluruhan prinsip reka bentuk, dan ia adalah jawapan struktur langsung kepada bias ini.
Mengira perbelanjaan masa lalu yang tidak dapat dipulihkan dalam keputusan masa kini. Di mana ia memberi kesan: projek yang dipertahankan kerana apa yang telah dimakan.
Bukti: nyata tetapi sederhana, dan langkah-langkahnya dipertikaikan. Arkes dan Blumer (1985) mendapati 85% memilih untuk menyelesaikan pesawat yang sudah diketahui inferior. Meta-analisis Sleesman dan rakan-rakan meletakkan kos tenggelam pada ρ = .243 — setanding dengan, tidak lebih besar daripada, tanggungjawab peribadi. Analisis 2025 mendapati vignette kos tenggelam klasik mempunyai konsistensi dalaman yang lemah (ω = 0.14–0.57), jadi perlakukan penemuan vignette tunggal dengan berhati-hati. Perhatikan juga bahawa dalam kajian teater Arkes dan Blumer sendiri, kesan itu hadir pada separuh pertama musim dan pada dasarnya hilang pada separuh kedua.
Dalam Argumentree: kriteria keluar boleh direkodkan apabila projek diluluskan, jadi semakan membaca dokumen daripada mengulangi penilaian rakan sekerja — lihat peningkatan komitmen.
Menilai berdasarkan seberapa baik sesuatu kes sepadan dengan stereotaip sambil mengabaikan seberapa umum perkara itu sebenarnya. Di mana ia menggigit: "perjanjian ini terasa seperti yang kita menangi" — tanpa kadar kemenangan.
Bukti: kukuh sebagai demonstrasi, dan sangat bergantung kepada format, yang merupakan bahagian yang boleh dilaksanakan. Casscells dan rakan-rakan (1978) mendapati hanya 18% daripada kakitangan perubatan memberikan jawapan yang betul sementara 45% tersasar hampir lima puluh kali; Manrai dan rakan-rakan mengulanginya 36 tahun kemudian dengan hasil yang hampir sama (23% betul, 44% memberikan jawapan salah yang sama). Tetapi Gigerenzer dan Hoffrage menunjukkan jawapan yang betul meningkat dari sekitar 16% kepada 46–50% apabila masalah yang sama diajukan dalam frekuensi semula jadi dan bukannya kebarangkalian.
Dalam Argumentree: bukti dilampirkan kepada tuntutan yang disokongnya, jadi kadar asas hadir sebagai hujah dan bukannya diingati — atau tidak — oleh sesiapa yang kebetulan mengetahuinya.
Tuntutan bahawa yang paling tidak kompeten adalah yang paling yakin. Di mana ia menggigit: kepastian yang paling kuat di dalam bilik dimiliki oleh orang yang mempunyai asas paling sedikit untuknya.
Bukti — dan ini memerlukan perhatian. Corak deskriptif diulang: prestasi rendah memang menganggarkan diri mereka terlalu tinggi. Penjelasan sebahagian besarnya tidak. Nuhfer dan rakan-rakan menghasilkan semula bentuk graf klasik daripada nombor rawak; Gignac dan Zajenkowski (2020, N = 929) mendapati hubungan itu secara asasnya linear dan kesannya jauh lebih kecil daripada yang dilaporkan; McIntosh dan rakan-rakan mendapati bahawa apabila kesukaran tugas disamakan, corak itu dihapuskan — tahap prestasi, bukan defisit metakognitif, adalah pendorongnya. Secara adil, Pennycook dan Jansen serta rakan-rakan mendapati prestasi rendah kurang mampu menilai jawapan mereka sendiri.
Ringkasan jujur: orang menganggarkan diri mereka terlalu tinggi, tetapi kebanyakan graf terkenal adalah regresi kepada purata ditambah lebih baik daripada purata. Jangan petik ia sebagai undang-undang.
Dalam Argumentree: keyakinan bukan input penilaian. Penilaian dilampirkan kepada bukti hujah, jadi kepastian tidak membawa sebarang berat yang tidak diperolehnya.
Di sinilah kebanyakan kerja bias korporat menjadi salah, kerana intervensi intuitif adalah yang paling lemah dalam literatur. Bukti terbahagi dengan jelas.
Intervensi yang paling banyak dibeli mempunyai sokongan yang paling sedikit. Pronin, Lin dan Ross (2002) mendapati peserta "bertegas bahawa penilaian diri mereka adalah tepat dan objektif walaupun selepas membaca penerangan tentang bagaimana mereka mungkin terjejas oleh bias yang berkaitan." Orang melihat bias pada orang lain jauh lebih mudah daripada pada diri mereka sendiri — itulah titik buta bias, dan latihan kesedaran terus berhadapan dengannya.
Nemeth dan rakan-rakan (2001) mendapati bahawa peranan sebagai pembela syaitan yang ditugaskan mendorong pemikiran "terutamanya bertujuan untuk memperkuat kognitif pandangan awal," dan bahawa minoriti yang tulen adalah lebih baik daripada ketiga-tiga variasi yang dimainkan. Ketidaksetujuan yang sebenar tidak boleh diklon oleh penugasan seseorang untuk melakukannya — walaupun memberikan perlindungan kepada mereka yang benar-benar tidak setuju adalah langkah yang berbeza dan lebih baik.
Kumpulkan posisi secara bertulis, secara berasingan, sebelum sesiapa mendengar sesiapa yang lain. Ini adalah pembetulan struktur yang paling murah di halaman, dan ia mengurangkan pengaruh penetapan, bukti sosial dan penghormatan kepada autoriti dalam satu langkah — masing-masing memerlukan penonton dan urutan bercakap untuk berfungsi.
Item yang paling terbukti di sini. Meta-analisis oleh Grove dan rakan-rakan terhadap 136 kajian mendapati ramalan mekanikal adalah kira-kira 10% lebih tepat berbanding penilaian klinikal secara purata, dan keunggulan itu konsisten "tanpa mengira tugas penilaian, jenis hakim, jumlah pengalaman hakim, atau jenis data yang digabungkan." Menggabungkan penilaian terstruktur mengatasi perbincangan yang berakhir dengan perasaan.
Secara aktif membantah pihak yang satu lagi lebih berkesan daripada menyeru orang untuk bersikap adil — Lord, Lepper dan Preston (1984) mendapati ia mengatasi arahan untuk bersikap seobjektif mungkin, dan Mussweiler serta rakan-rakannya mengurangkan pengikatan dalam situasi dunia nyata bersama pakar dengan menyenaraikan hujah-hujah menentang pengikat. Secara struktur, itulah yang dimaksudkan dengan cabang con.
Tidak seperti kesedaran semata-mata, latihan sebenar mempunyai kesan. Morewedge dan rakan-rakan (2015) mendapati intervensi sesi tunggal menghasilkan peningkatan yang berterusan selama dua bulan, dan Sellier, Scopelliti dan Morewedge (2019) menunjukkan pemindahan ke dalam persekitaran profesional sebenar — peserta yang dilatih adalah 19% kurang mungkin untuk memilih pilihan yang mengesahkan tetapi inferior.
Melawan kesilapan perancangan, asaskan ramalan pada projek yang telah diselesaikan yang sebanding dan bukannya pada pelan projek ini. Panduan Buku Hijau HM Treasury memerlukannya secara jelas: penilai "cenderung untuk terlalu optimis," jadi penyesuaian "seharusnya berdasarkan data dari projek yang lalu atau serupa."
Jika dua penilai anda memberikan skor yang berbeza untuk cadangan yang sama, tiada jumlah pengurangan bias yang akan membantu — itu adalah bunyi, dan ia memerlukan skala yang sama dan penilaian yang bebas dan bukannya niat yang lebih baik. Ia juga tidak dapat dilihat sehingga seseorang menjalankan kes yang sama kepada dua orang dengan sengaja.
Perhatikan bentuk senarai kerja: tiada satu pun yang meminta sesiapa untuk lebih objektif. Setiap item yang berkesan mengubah urutan di mana perkara berlaku, apa yang dicatat, atau apa yang digabungkan — yang merupakan apa yang dimaksudkan dengan pokok hujah yang terstruktur. Sumbangan Argumentree bukanlah seminar pengurangan bias; ia adalah bahawa penyerahan bebas, bukti yang dilampirkan kepada tuntutan, penilaian hujah dan bukannya penggubal hujah, serta rekod bertanda waktu adalah empat intervensi struktur yang sebenarnya disokong oleh bukti, berjalan secara lalai dan bukannya mengikut disiplin.
Apa bentuk bias ini apabila sekumpulan orang sedang berbincang — kesilapan yang sama dengan nama berbentuk mesyuarat dan tanda amaran yang boleh anda sebut secara langsung.
Rawatan jangka panjang: dua belas bias pada skala organisasi, hujah balas, dan penyelesaian proses.
Lapisan ketiga — apa yang berlaku apabila seseorang menggunakan mekanisme ini dengan sengaja.
Disiplin lima elemen yang mengoperasikan pembetulan struktur pada halaman ini.
Standard yang menilai keputusan berdasarkan prosesnya pada waktu keputusan dibuat dan bukannya berdasarkan hasilnya.
Bentuk organisasi kos tenggelam, dan mengapa pengarang kegagalan meramalkan penggandaan terhadapnya.
Satu kesilapan dalam pertimbangan yang sistematik dan boleh diramal yang dihasilkan oleh jalan pintas mental yang digunakan orang di bawah ketidakpastian. Ciri yang menentukan adalah ia condong secara konsisten ke satu arah dan bukannya tersebar secara rawak, yang menjadikannya mungkin untuk merancang proses yang mengimbangi kesilapan tersebut. Kertas kerja Tversky dan Kahneman pada tahun 1974 dalam Science menetapkan rangka kerja: heuristik adalah sangat ekonomik dan biasanya berkesan, tetapi ia membawa kepada kesilapan yang sistematik dan boleh diramal.
Heuristik adalah jalan pintas mental itu sendiri dan biasanya bersifat adaptif. Bias kognitif adalah kesilapan sistematik yang dihasilkan oleh jalan pintas tersebut. Falasi logik adalah kecacatan dalam struktur hujah dan bukannya dalam penilaian — dikotomi palsu adalah falasi, sementara pengikatan adalah bias. Istilah keempat, bunyi, adalah variabiliti dan bukannya kesilapan: ketidakkonsistenan yang tidak diingini antara penilaian masalah yang sama.
Bias adalah kesilapan arah — tembakan anda mendarat secara konsisten di sebelah kiri sasaran. Noise adalah penyebaran — mereka mendarat di mana-mana. Buku Kahneman, Sibony dan Sunstein 2021 berpendapat bahawa organisasi membelanjakan banyak untuk bias sambil mengabaikan noise, yang seringkali lebih besar dan lebih mudah untuk diperbaiki. Dalam kajian insurans mereka, premium median yang ditetapkan secara bebas untuk lima pelanggan fiksyen yang sama berbeza sebanyak 55%, kira-kira lima kali ganda daripada apa yang dijangkakan oleh penulis dan eksekutif.
Dua belas yang ada di halaman ini: bias pengesahan, pengikatan, ketersediaan, keyakinan berlebihan dan ketepatan berlebihan, kesilapan perancangan, bias status quo, pembingkaian, bias pandangan belakang, bias korespondensi, kos terbenam, pengabaian kadar asas, dan corak Dunning-Kruger. Mereka memperoleh tempat mereka kerana setiap satu menggambarkan kegagalan organisasi yang berulang — senarai pendek yang hanya mengesahkan, nombor pertama yang menetapkan julat, pembaharuan yang tidak dibenarkan oleh sesiapa, post-mortem yang mencari pelaku.
Corak itu adalah nyata; penjelasan yang popular tidak. Pelaku rendah memang melebih-lebihkan diri mereka, tetapi banyak daripada carta terkenal itu dihasilkan oleh regresi kepada purata dan kesan lebih baik daripada purata — Nuhfer dan rakan-rakan menghasilkan bentuk graf yang sama daripada nombor rawak, Gignac dan Zajenkowski mendapati hubungan itu secara asasnya linear dengan kesan yang jauh lebih kecil, dan McIntosh serta rakan-rakan menghapuskan corak itu dengan menyamakan kesukaran tugas. Anggaplah ia sebagai kecenderungan deskriptif, bukan sebagai undang-undang metakognitif.
Ya, dan mana-mana halaman rujukan yang jujur seharusnya menyatakannya. Pengurangan ego gagal dalam replikasi berdaftar (d = 0.04 merentasi 23 makmal). Paradigma maklum balas wajah dengan pen di mulut gagal dalam replikasi 17 makmal. Pemanasan sosial dan postur kuasa kedua-duanya gagal. Penetapan kebetulan dari nombor rawak gagal dalam Many Labs 2, dan demonstrasi frekuensi huruf ketersediaan telah dipotong pada tahun 1998. Secara lebih luas, Kerjasama Sains Terbuka mereplikasi 36% daripada 100 kajian psikologi, dan Many Labs 2 mereplikasi 15 daripada 28 dengan saiz kesan median jatuh dari 0.60 kepada 0.15.
Hampir, secara sendirian — dan ini adalah penemuan praktikal yang paling penting di sini. Pronin, Lin dan Ross mendapati peserta bertegas bahawa penilaian diri mereka adalah tepat walaupun selepas membaca penerangan tentang bias yang tepat mempengaruhi mereka. Latihan yang merangkumi amalan dan maklum balas adalah berbeza: ia berterusan selama berbulan-bulan dan dipindahkan ke dalam situasi profesional yang sebenar. Tetapi satu dek slaid yang menyenaraikan bias adalah hampir kepada intervensi yang paling lemah yang ada.
Perubahan struktur dan bukannya motivasi. Kumpulkan penilaian secara bebas sebelum perbincangan, supaya penetapan dan bukti sosial tidak mempunyai penonton. Gabungkan penilaian terstruktur secara mekanikal — meta-analisis Grove terhadap 136 kajian mendapati ramalan mekanikal kira-kira 10% lebih tepat daripada penilaian klinikal. Memerlukan kes bertentangan untuk dibahaskan secara eksplisit. Gunakan kelas rujukan daripada optimisme baru untuk ramalan. Dan simpan rekod bertarikh supaya keputusan dinilai berdasarkan apa yang diketahui pada masa itu.
Dengan menjalankan empat intervensi struktur yang disokong bukti secara lalai. Hujah boleh dikemukakan secara bebas sebelum perbincangan, yang menghapuskan pengikat dan penonton. Setiap tuntutan membawa buktinya, jadi kadar asas dan anekdot yang jelas dapat dilihat berdampingan. Penilaian dilampirkan kepada hujah dan bukannya kepada orang, jadi keyakinan dan senioriti tidak mempunyai berat yang tidak mereka peroleh. Dan rekod keputusan dicatatkan dengan cap waktu, jadi semakan kemudian boleh menilai proses berdasarkan maklumat yang tersedia pada masa itu dan bukannya berdasarkan hasil.
Tversky, A., & Kahneman, D. (1974). Penilaian di Bawah Ketidakpastian: Heuristik dan Bias. Sains, 185(4157), 1124–1131.
Kertas asas: perwakilan, ketersediaan, dan penyesuaian dari satu penanda.
View source →Kahneman, D., & Tversky, A. (1979). Teori Prospek: Analisis Keputusan di Bawah Risiko. Econometrica, 47(2), 263–291.
Nilai yang diberikan kepada keuntungan dan kerugian daripada aset akhir; kebarangkalian digantikan oleh berat keputusan.
View source →Kahneman, D., Sibony, O., & Sunstein, C. R. (2021). Bunyi: Satu Kecacatan dalam Penilaian Manusia.
Bunyi sebagai variabiliti yang tidak diingini dalam penilaian masalah yang sama — perbezaan yang paling banyak kerja bias abaikan.
Moore, D. A., & Healy, P. J. (2008). Masalah dengan keyakinan berlebihan. Ulasan Psikologi, 115(2), 502–517.
Pembahagian tiga hala: anggaran berlebihan, penempatan berlebihan, ketepatan berlebihan.
View source →Flyvbjerg, B., Holm, M. S., & Buhl, S. (2002). Menganggarkan Kos yang Rendah dalam Projek Kerja Awam. Jurnal Persatuan Perancangan Amerika.
258 projek, kira-kira US$90bn: kos dianggarkan lebih rendah dalam sekitar sembilan daripada sepuluh.
Jachimowicz, J. M., Duncan, S., Weber, E. U., & Johnson, E. J. (2019). Bila dan mengapa pilihan lalai mempengaruhi keputusan: analisis meta tentang kesan pilihan lalai. Dasar Awam Tingkah Laku.
d = 0.68 [0.53, 0.83] merentasi 58 set data, n = 73,675.
Klein, R. A., et al. (2014). Menyelidik Variasi dalam Kebolehreplikan: Projek Replikasi 'Many Labs'. Psikologi Sosial.
Mengulangi item pembingkaian penyakit Asia: asal d = 1.13 → replikasi d = 0.62 (N = 6,271).
View source →Klein, R. A., et al. (2018). Banyak Makmal 2. Kemajuan dalam Kaedah dan Amalan dalam Sains Psikologi, 1(4), 443–490.
15 daripada 28 penemuan yang diulang; median d jatuh dari 0.60 kepada 0.15. Penetapan tidak sengaja gagal (d = 0.04).
View source →Open Science Collaboration (2015). Menganggarkan kebolehulangan sains psikologi. Science, 349(6251).
36% daripada 100 replikasi mencapai kepentingan berbanding 97% daripada asal.
View source →Hagger, M. S., et al. (2016). Replikasi Preregistered Multilab bagi Kesan Pengurangan Ego. Perspektif dalam Sains Psikologi.
d = 0.04, 95% CI [−0.07, 0.15] merentasi 23 makmal.
Gignac, G. E., & Zajenkowski, M. (2020). Kesan Dunning-Kruger adalah (kebanyakannya) artefak statistik. Kecerdasan, 80, 101449.
Hubungan asasnya linear; kesan jauh lebih kecil daripada yang dilaporkan.
View source →Pronin, E., Lin, D. Y., & Ross, L. (2002). Titik Buta Bias. Buletin Psikologi Peribadi dan Sosial, 28(3), 369–381.
Penilaian diri dipertahankan walaupun selepas membaca penerangan tentang bias yang berkaitan.
View source →Grove, W. M., Zald, D. H., Lebow, B. S., Snitz, B. E., & Nelson, C. (2000). Ramalan klinikal versus mekanikal: satu meta-analisis. Penilaian Psikologi, 12(1), 19–30.
136 kajian; ramalan mekanikal kira-kira 10% lebih tepat, secara konsisten merentasi jenis tugas dan penilai.
View source →Sellier, A.-L., Scopelliti, I., & Morewedge, C. K. (2019). Latihan Menghapuskan Bias Meningkatkan Pengambilan Keputusan di Lapangan. Sains Psikologi.
Peserta yang terlatih 19% kurang cenderung untuk memilih pilihan yang mengesahkan tetapi inferior.
View source →Nemeth, C., Brown, K., & Rogers, J. (2001). Penasihat syaitan versus pembangkangan yang tulen. Jurnal Eropah Psikologi Sosial.
Tugasan advokasi syaitan mengukuhkan pandangan awal; perbezaan yang tulen mengatasi ketiga-tiga varian.
View source →HM Treasury. Panduan tambahan Buku Hijau: bias optimisme.
Memerlukan penyesuaian eksplisit berdasarkan data dari projek lepas atau yang serupa.
View source →Penghantaran bebas sebelum perbincangan, bukti dilampirkan pada setiap tuntutan, penilaian terhadap hujah dan bukannya pengarang, serta rekod bertanda waktu — empat intervensi struktur yang disokong oleh bukti, berjalan secara lalai.
Mula Percuma — Tiada Kad Kredit