上官がつけた137人の航空隊候補生の評価表を調べると、体格の評価は知性の評価と0.31、統率力とは0.39で連動していました。1920年、ソーンダイクがこの現象に付けた論文タイトルは「心理学的評定における恒常誤差」。後光の話ではなく、測定が壊れているという報告でした。
「ハロー効果」という言葉が世に出た論文の題は、『A Constant Error in Psychological Ratings』といいます。心理学的評定における恒常誤差。書いたエドワード・ソーンダイクは、人の見る目の不思議さに感心していたのではなく、評価表という道具が使いものになっていないことに困っていました。
手元にあったのは、上官が部下につけた評価の記録です。体格、知性、統率力、人柄——項目ごとに別々の点をつける形式で、当然それぞれ別のことを測っているつもりで作られています。ソーンダイクが確かめたのは、その「つもり」が成立しているかどうかでした。
引っかかったのは、大きさより揃いかたのほう
1920年に発表された分析の対象は、航空隊の候補生137人。項目の組み合わせごとの相関は、たとえばこうなっていました。
- 体格と人柄 …… 0.28
- 体格と知性 …… 0.31
- 体格と統率力 …… 0.39
0.3前後という数字は、それ単体を見れば強い関係ではありません。ソーンダイクが問題にしたのは大きさではなく、どの組み合わせを取っても似たような値が並ぶことでした。論文の言い方を借りれば「高すぎるうえに、揃いすぎている」。
体格と知性を独立に見ているなら、組み合わせによって関係の強さはばらつくはずです。それがしない。評価者は目の前の人物を別々の資質の集まりとして見ておらず、「良い候補生」「いまひとつな候補生」という一つの印象を、項目の数だけ書き写していた。専門の訓練を受けた評価者でもそうなる、というのがこの短い論文の主張でした。後光がさすという比喩は、そこにあとから付いた説明です。
同じ映像、同じ訛り、評価だけが裏返る
印象が先に立つことを実験で切り分けたのは、1977年のリチャード・ニスベットとティモシー・ウィルソンです。ミシガン大学の学生118人に、ある心理学講師のインタビュー映像を見せました。講師はベルギー出身で、はっきりした訛りのある英語を話します。
映像は2種類。同じ人物が、温かく親しみやすい態度で答える版と、冷たくよそよそしい態度で答える版です。学生は視聴後、講師の「見た目」「しぐさ」「訛り」を、すごく感じがいいからすごく耳障りまでの尺度で評価しました。
この3つは、どちらの映像でも物理的にまったく同じものです。それでも、温かい版を見た学生は見た目も訛りも好意的に採点し、冷たい版を見た学生は同じ見た目と同じ訛りを不快なものとして採点しました。
論文の主眼はその先にあります。学生たちは、全体の印象が個々の項目の採点を動かしたことを認めませんでした。自覚がないまま起きている、というのがニスベットとウィルソンの結論です。
「知っていれば防げる」は成り立たなかった
では、あらかじめ教えておけばいいのでは——と考えるのは自然です。1981年、ウェッツェル、ウィルソン、コートの3人が同じ温かい版・冷たい版の設計でそれを試しました。参加者にハロー効果とは何かを説明し、さらに「示すように」あるいは「示さないように」という動機づけまで与えています。
論文の題が結果を言い切っています。『The halo effect revisited: Forewarned is not forearmed』——警告されていることは、備えができていることではない。効果は消えませんでした。意識的な制御が届く場所で起きていないらしい、というのが当時の見立てです。
実務に翻訳するとやや厳しい話です。面接や人事評価で「先入観に気をつけよう」と唱えるのは、対策としてほとんど効かない見込みが高い。効きそうなのは手続きの側で、一人ずつ全項目を埋めるかわりに項目ごとに全員を横に見る、書類選考では名前や写真を伏せる、質問と採点基準を先に決めておく。評価者の心がけではなく、印象が一つにまとまる前に情報を分けてしまう発想です。
それは本当に「誤差」なのか
ソーンダイクは連動しすぎることを誤差と呼びました。ただしこの呼び方自体が、長く議論の的になってきました。
観測された連動は、「本物の重なり」と「錯覚の分」の合計です。まめな人は時間も守りやすい、といった資質どうしの実際の重なりは確かにあります。人事評価の研究では前者を真のハロー、後者を錯覚のハローと呼び分けますが、実データからこの2つをきれいに切り分ける方法は確立していません。1993年、マーフィーらは『Journal of Applied Psychology』で、従来のハロー誤差の捉え方は主要な点がいずれも誤っているか問題含みだとして、ハロー指標を研究の従属変数として使うのを一度やめてはどうか、とまで書いています。
もっと新しい説明もあります。2024年、ウェストベリーとキングは『Cognitive Science』で、どの資質とどの資質が一緒に来ると人が感じるかは、その2語が言語の中でどれだけ近い位置にあるかでかなり予測できると報告しました。単語のベクトル距離だけで交差検証済みの決定係数が0.19、語の頻度と感情価を加えたモデルでは分散の44.7%を説明したといいます。頭の中の偏見というより、言葉の使われ方の癖を映している面がある——ただしこれは出たばかりの説で、定着した見方ではありません。
100年前にソーンダイクが書いたのは、人を見る目が曇っているという告発ではなく、評価表という様式への苦情でした。欄が5つあっても、頭の中の印象は1つしかない。増やすべきは欄の数ではなく、誰がいつ何を見るかの分けかたのほうだ、という話です。
参考にした資料
- Thorndike, E. L. (1920)「A Constant Error in Psychological Ratings」Journal of Applied Psychology 4(1), 25–29
- Nisbett, R. E., & Wilson, T. D. (1977)「The halo effect: Evidence for unconscious alteration of judgments」Journal of Personality and Social Psychology 35(4), 250–256
- Wetzel, C. G., Wilson, T. D., & Kort, J. (1981)「The halo effect revisited: Forewarned is not forearmed」Journal of Experimental Social Psychology 17(4)
- Murphy, K. R., Jako, R. A., & Anhalt, R. L. (1993)「Nature and Consequences of Halo Error: A Critical Analysis」Journal of Applied Psychology 78(2), 218–225
- Westbury, C., & King, J. (2024)「A Constant Error, Revisited: A New Explanation of the Halo Effect」Cognitive Science 48(12), e70022(ソーンダイクの対象人数と原文の引用もこの論文による)
- Simply Psychology「Halo Effect Bias In Psychology」(相関値の一覧について)