❖ HR Dictionary

評価エラー

Reading ヒョウカエラーEnglish Rater

評価エラー(Rater Error)とは、人事評価において、評価者の認知特性や心理的な傾向が原因で、評価対象者の実際の業績・行動と異なる評価結果が生じる現象を総称する概念です。「評価誤差」「評価バイアス」と関連深く、両者を含む広い概念として用いられる場合もあります。代表的な評価エラーには、ハロー効果(一つの目立つ特徴が全体評価に影響する)、寛大化傾向(全員を高めに評価する)、厳格化傾向(全員を低めに評価する)、中心化傾向(中央付近に集中させる)、対比誤差(直前の評価対象との比較で判断が歪む)、論理誤差(無関連の評価項目を関連付ける)、近接誤差(直近の出来事の印象に引きずられる)、期末誤差(評価期間末の出来事に過度に影響される)、ステレオタイプ(属性に基づく固定観念)、自己投影(自身の特性に近い対象を高く評価する)などがあります。これらは評価者個人の悪意とは独立に、認知の自然な働きとして発生しうるものであり、評価制度の信頼性を損なう要因として、人事制度設計の重要論点として位置づけられています。

⌖ Detail

評価エラーとは?意味・使い方・実務での活かし方を解説

最終更新日: 2026-05-22 / カテゴリ: 評価・等級 / 英語表記: Rater Error

---

はじめに

「人事評価の結果を確認すると、評価者ごとに分布が大きく異なる」「同じような業績の社員でも、上司によって評価が分かれてしまう」――こうした課題は、多くの企業で繰り返し議論されているテーマです。本記事では、その背景にある評価エラーの意味、活用シーン、実務上の留意点を、人事担当者の視点で整理します。

評価エラーとは?

評価エラー(Rater Error)とは、人事評価において、評価者の認知特性や心理的な傾向が原因で、評価対象者の実際の業績・行動と異なる評価結果が生じる現象を総称する概念です。「評価誤差」「評価バイアス」と関連深く、両者を含む広い概念として用いられる場合もあります。代表的な評価エラーには、ハロー効果(一つの目立つ特徴が全体評価に影響する)、寛大化傾向(全員を高めに評価する)、厳格化傾向(全員を低めに評価する)、中心化傾向(中央付近に集中させる)、対比誤差(直前の評価対象との比較で判断が歪む)、論理誤差(無関連の評価項目を関連付ける)、近接誤差(直近の出来事の印象に引きずられる)、期末誤差(評価期間末の出来事に過度に影響される)、ステレオタイプ(属性に基づく固定観念)、自己投影(自身の特性に近い対象を高く評価する)などがあります。これらは評価者個人の悪意とは独立に、認知の自然な働きとして発生しうるものであり、評価制度の信頼性を損なう要因として、人事制度設計の重要論点として位置づけられています。

評価エラーがよく使われるシーン

評価エラーは、評価制度の設計と運用、評価者教育の文脈で参照されます。

評価者研修*: 評価者の認知特性を可視化し、エラーの発生を抑える研修プログラムで重視されます。

評価会議のキャリブレーション*: 評価分布の調整、評価者間の判断基準のすり合わせを行う場面で参照されます。

評価制度の設計*: 評価項目の構造、評価尺度、評価プロセスを設計する際の検討論点として用いられます。

評価結果の分析*: 評価分布、評価者別傾向、組織別傾向を分析し、エラーの兆候を検出する場面で活用されます。

昇進・登用判断*: 評価結果を昇進判断に用いる際、エラーの影響を補正する仕組みの議論で参照されます。

評価エラーを理解することの重要性

評価エラーを正しく理解することは、評価制度の信頼性と組織の納得感にとって重要な意味を持ちます。

評価結果の信頼性*: エラーを構造的に抑える設計は、評価結果が人材の実態を反映する精度を高めます。

被評価者の納得感*: 公平な評価は、社員のエンゲージメントと組織への信頼に直結します。

登用判断の品質*: 評価結果を昇進・配置判断に用いる場合、エラーの抑制は意思決定の質を支えます。

評価制度の継続性*: 評価への不信が広がると、制度全体の運用が形骸化するリスクがあります。

実務で活かすためのチェックポイント

評価エラーを抑制する取り組みを自社の現場で進める際には、次のような観点で確認すると、運用の精度が高まります。

  1. 評価者向けの研修で、代表的なエラーの種類とメカニズムを伝え、自身のエラー傾向を内省する機会を継続的に提供する
  2. 評価会議でキャリブレーションを実施し、評価者間の判断基準をすり合わせるとともに、評価分布の偏りを構造的に補正する
  3. 評価項目を行動レベルまで具体化し、抽象的な印象評価ではなく観察可能な事実に基づく判断を促す構造を設計する
  4. 評価期間中の事実記録(日報・週報・1on1メモ等)を蓄積し、評価時点で近接誤差・期末誤差が生じにくい運用を整える
  5. 評価分布・評価者別傾向・組織別傾向を定期的に分析し、エラーの兆候が見られる箇所に対して継続的に改善サイクルを回す

よくある質問(FAQ)

Q. 評価エラーは、どの程度まで抑えることができるのでしょうか?

A. 評価エラーをゼロにすることは、現実的には極めて困難です。評価エラーは認知の自然な働きとして生じる側面があり、評価者が自覚的に注意しても完全な排除は難しいことが知られています。一方、構造的に抑える取り組みによって、その影響を一定範囲に収めることは十分可能です。具体的には、評価項目の行動レベルへの具体化、複数評価者による多面評価、評価会議によるキャリブレーション、事実記録に基づく評価、評価者研修の継続実施などを組み合わせることで、評価結果の信頼性を高められます。重要なのは、エラーをゼロにすることではなく、エラーの影響が制度の信頼性を損なわない水準に留めることです。完璧を求めて評価制度を停滞させるのではなく、エラーの存在を前提に継続的な改善を回す姿勢が、現場で機能しやすい設計です。

Q. キャリブレーションを丁寧に行うと、評価者の権限が形骸化する懸念はないでしょうか?

A. これは評価運用の設計で慎重に扱うべき重要な論点です。キャリブレーションは「上位者が一次評価を覆す場」ではなく「評価者間で判断基準をすり合わせ、組織全体での整合性を高める場」として位置づけることが大切です。具体的には、評価結果そのものを多数決で書き換えるのではなく、評価の根拠となる事実と判断基準について議論し、評価者自身が修正の必要性を納得した上で更新する運用が推奨されます。また、評価分布の調整を機械的に行うのではなく、対象社員の業績と行動についての議論を通じて、評価者間の認識共有を深める場として運営することで、評価者の主体性を保ちつつ、評価精度を高めることができます。キャリブレーションを「強制的な調整」ではなく「対話を通じた合意形成」として設計する姿勢が、評価者の納得感と運用の継続性を支えます。

まとめ

評価エラーとは、評価者の認知特性や心理的傾向が原因で、評価対象者の実際の業績・行動と異なる評価結果が生じる現象を総称する概念です。ハロー効果、寛大化、厳格化、中心化、近接誤差、ステレオタイプなど多様な類型があり、評価者個人の悪意とは独立に発生しうる構造を持ちます。評価者研修、評価会議のキャリブレーション、評価項目の具体化、事実記録の蓄積、評価分析の継続実施という観点で、自社に合った抑制策を組み合わせていくことが望まれます。エラーをゼロにすることではなく、影響を一定水準に収める継続的な改善が、現場で機能しやすい設計となります。

---

自社の人材育成・組織課題に関するご相談はこちら

人事用語を理解したうえで、「自社では実際にどう活用すればよいか」「制度や育成のしくみをどう設計すればよいか」というお悩みは、業種・規模を問わず多くの企業に共通します。

WONDERFUL GROWTHでは、人事領域の制度設計・人材育成・組織開発のご相談を、企業ごとの状況に合わせて承っております。評価エラーを抑制する評価制度設計、評価者研修、キャリブレーション運用、評価結果の分析支援など、評価の信頼性を高める取り組みを進めたい方は、お気軽にお問い合わせください。

[ご相談・お問い合わせはこちら](https://wonderful-growth.com/contact)

> 課題整理の壁打ちから、施策設計の伴走、運用支援まで、人事の現場に寄り添うご支援が可能です。まずは現状をお聞かせください。

---

関連情報

  • カテゴリ: 評価・等級
  • 用語スラッグ: rater_error
  • 想定URLパス: /rater-error

本記事は、人事担当者・経営者・現場マネージャーの皆さまが、ご自身の課題解決のヒントとして活用いただくことを目的に作成しています。実際の制度設計や法令対応にあたっては、専門家への確認をおすすめします。

✺ Editor’s Memo

現場での運用は、業界・規模・組織文化によって大きく変わります。記事内のインタビュー事例も併せて参考にしてください。

— SHARE with カイシャの育成論 編集部