評価のバラつきをなくしたい——キャリブレーション(評価調整会議)の進め方
評価・等級制度

評価のバラつきをなくしたい——キャリブレーション(評価調整会議)の進め方

#エンゲージメント#評価#組織開発#制度設計#マネジメント

評価のバラつきをなくしたい——キャリブレーション(評価調整会議)の進め方

「うちの部長は甘い」「あの課長は厳しい」——こんな声が社員から出ていたとしたら、評価制度への信頼は少しずつ失われています。

評価のバラつきは、多くの企業で起きています。同じ成果・同じ行動でも、評価者によって評価が異なる。これは「評価者が悪い」のではなく、評価の基準や視点を共有する仕組みがないことから生まれることがほとんどです。

キャリブレーション(評価調整会議)は、複数の評価者が集まって評価結果を比較・調整し、組織全体の評価の整合性を高めるプロセスです。この記事では、キャリブレーションの目的・進め方・落とし穴を整理します。


なぜ評価にバラつきが生まれるのか

評価のバラつきには、いくつかの主要な原因があります。

原因1:評価基準の解釈が人によって異なる

「期待を大きく上回る」という評価基準があったとして、「どのくらいが大きく上回るのか」の解釈は評価者によって異なります。Aさんにとっての「S評価」がBさんにとっては「A評価」ということが起きます。

原因2:評価者自身の経験・価値観の違い

元営業部長の評価者は、営業成果を重視しがちです。技術系のバックグラウンドを持つ評価者は、専門性を重視するかもしれない。評価者の経験・価値観が、評価の偏りを生みます。

原因3:評価対象者との距離感の違い

直属の上司は日々の行動を見ているが、部門を超えた評価者はプロジェクトの成果しか見えない——という情報格差が評価のバラつきを生みます。

原因4:評価者訓練の不足

ハロー効果(一つの印象が全体の評価に影響する)、寛大化傾向(全体的に高評価になる)、中心化傾向(極端な評価を避ける)——これらの評価バイアスは、トレーニングなしに自然に起きます。


キャリブレーションの目的

キャリブレーションを実施する目的は、主に3つです。

1. 評価の公平性の確保

同じ成果・行動が、異なる部署でも公平に評価されることを担保します。「頑張った人が報われる」という信頼が組織に広がると、エンゲージメントと努力意欲が高まります。

2. 評価基準の共有・レベル合わせ

複数の評価者が顔を合わせて評価について議論することで、「うちの部門ではこういう行動をS評価と呼んでいる」という解釈が共有されます。これは評価者訓練の場にもなります。

3. 人材の全体像の把握

キャリブレーションで複数の評価者が情報を持ち寄ることで、「この人はどの部署でも評価されている」「この部署だけで活躍している」という人材の全体像が見えてきます。これはタレントマネジメントや後継者計画にも活用できます。


キャリブレーションの基本的な進め方

ステップ1:事前準備

評価者全員が、担当する被評価者の評価結果(一次評価)を事前に確定させておきます。「まだ評価が固まっていない」という状態でキャリブレーションに臨むと、議論の軸がブレます。

また、評価分布の集計も事前に行います。「A評価が○%、B評価が○%、C評価が○%」という全体分布を把握しておくことで、特定の評価者の傾向(寛大化・厳格化)が見えやすくなります。

ステップ2:全体分布の確認

キャリブレーション会議の冒頭で、全体の評価分布を共有します。「想定した分布と比べてバラつきがある」「○部門の評価が全体的に高い」という事実を共有することが、議論の出発点になります。

ステップ3:ハイライト・ボーダーの事例を議論する

全員分を1人ずつ議論すると時間がかかります。まず「S評価候補」と「C評価候補」「ボーダー(AかBか判断が難しい)事例」に絞って議論します。

議論の際に大切なのは、「評価の結論」ではなく「評価の根拠(どんな行動・成果が根拠か)」を共有することです。

ステップ4:調整と合意

議論を経て、個別の評価を調整します。「全体的に甘かった部門の評価を下げる」という机上の調整ではなく、「○○さんの評価はB相当の根拠があるので、Aから修正する」という根拠ベースの調整が重要です。


よくある失敗パターン

失敗①:「叩き台」の評価が変わらない

評価者が「自分の評価を下げられた」と感じることへの抵抗から、議論しても誰も評価を変えない——というキャリブレーションは機能不全です。

「調整することが目的ではなく、根拠を共有することが目的」というマインドセットと、「調整は評価者を責めることではない」という心理的安全性の確保が重要です。

失敗②:「人気投票」になる

「あの人は人当たりがいいから」「あの部門のマネジャーの影響力が強くて」という非公式な力関係が評価に影響する——これは起きがちです。

議論の際に「行動・成果の根拠を示す」ことを徹底することで、属人的な評価を防ぎます。

失敗③:時間がかかりすぎる

「全員分を詳細に議論する」というキャリブレーションは、時間がかかりすぎて形骸化します。

「S/C評価とボーダーに集中する」「時間を事前に決める(例:全体2時間、1人5分以内)」という設計が実用的です。


小さく始めるキャリブレーション

「本格的なキャリブレーションはハードルが高い」という場合、まずは以下の小さなステップから始めることができます。

マネジャー同士で「S評価事例を1つ共有する」会議を設ける:「今回のS評価は誰で、なぜそう評価したか」を3〜4名のマネジャーで共有するだけでも、評価基準の共有が始まります。

評価分布を人事が集計・フィードバックする:「○部門の評価は全体平均と比べて高め」という情報を各評価者にフィードバックするだけでも、自己調整が起きます。


法務・倫理面での注意

キャリブレーションで共有される評価情報は、個人情報を含みます。会議の参加者の範囲・情報の取り扱いについて、事前にルールを設けておくことが重要です。

また、性別・年齢・育児状況などの属性が評価に影響しないよう、「属性に関する議論はしない」というルールの明示も有効です。


おわりに

評価のバラつきを完全にゼロにすることはできません。でも、「バラつきがある」という現実を認識し、キャリブレーションで少しずつ整合性を高めていくプロセスが、公平な評価文化を作ります。

まず「S評価事例を共有する会議を1回やってみる」——そこから始められると思います。

評価制度の設計・運用の実践をもっと深く学びたい方は、人事のプロ実践講座でご一緒しましょう。

人事のプロ実践講座はこちら

吉

吉田洋介

人事図書館 代表 / 著書『「人事のプロ」はこう動く』

リクルートマネジメントソリューションズで14年間・500社以上の組織人事コンサルティングに従事。 上海駐在を経て2021年に独立。2024年に人事図書館を設立(会員740名超)。 「すべての組織に人事のプロを」を理念に、経営と現場をつなぐ人事の実践知を発信している。

著者の実践講座を見る →
0

経営視点で考える人事の実践力を磨きませんか?

書籍『「人事のプロ」はこう動く』著者による実践講座。現場で使える経営視点の人事力を身につけます。