ソリューション

誰が面接しても、同じ基準で評価する

面接の評価は、面接官によって変わります。質問項目と評価軸を先に決め、全候補者に同じ条件を適用します。

課題

評価がばらつく理由は、面接官の能力ではない

評価基準が曖昧なままだと、面接官によって見るところが変わります。面接官の力量の差というより、面接そのものが揃っていないために起きることです。

  • 面接ごとに質問が違えば、集まる情報が違う
  • 同じ回答でも、面接官の経験によって重みづけが変わる
  • 直前に会った候補者との比較で、基準が動く

01

評価軸を設計

何を聞き、何で測るかを先に決める

02

全候補者に適用

面接ごとの条件差がなくなる

03

AI面談

事前設定の質問をもとに質疑応答

04

スコアと根拠

評価軸ごとに自動生成

05

最終判断

採用担当者

網掛けの3工程を全候補者に同じ基準で回し、最後の合否は人が判断します。

打ち手

評価軸を先に決めてから、面接する

何で測るかを、面接の前に決めます。評価は評価軸ごとにスコアと根拠が生成され、記録として残ります。

  • 全候補者が同じ質問を受ける
  • 評価軸ごとにスコアと根拠が残る
  • AIの評価と人の評価を並べて記録できる
評価軸ごとのカード。AIと管理者のスコアが1〜5で並び、AIが付けた点数の根拠が書かれている

検証

偏りがないかを、あとから確認できる

評価軸ごとにスコアの分布を見ると、AIが同じ点ばかり付けている軸が見つかります。基準の書き方が曖昧なのか、その軸を測れる質問が足りないのかを切り分けたうえで、設計を直せます。

  • 評価軸ごとのスコア分布を確認
  • ばらつきの小さい軸を特定
  • 質問と評価軸の設計に反映
評価軸ごとのスコア分布営業職 一次面接・n=175・株式会社サンプル
数値の表を見る
評価軸1点2点3点4点5点標準偏差最頻値の占有率
定着への意欲1263683020.8839%
コミュニケーション力4196464240.9437%
変化への適応力7366749160.9938%
論理的思考力9337937170.9945%
主体性13296248231.1035%
専門知識19445436221.1831%

バー上の数字は、最も多い点数が占める割合です。標準偏差の小さい順に並べています。

関連ページ

論点別に、さらに詳しく

評価軸をそろえても、読み方や数の決め方で点数は分かれます。そこを掘り下げたコラムです。

解釈

評価軸の解釈が分かれると、同じ回答でも面接官によって点数が分かれる →

人とAIの評価のズレから、解釈が分かれる箇所を見つけて直す。

採点

AI面接は、採点の仕組みを説明できるかで選ぶ →

何を読み、何を基準に点を付けるかを、4つの問いで確かめる。

分布

評価軸の数は、判断材料の数ではない →

点数が一部に集まる理由を、国家公務員の人事評価の公開データで確かめる。

拠点

多拠点採用 →

拠点が増えても、採用基準を一つに保つ。

よくある質問

評価に使っている情報は何ですか

評価は、候補者が答えた内容だけに付きます。表情や声色、話す速さなどの非言語の情報は使っていません。EUのAI法やニューヨーク市の条例など、感情推定や非言語評価を制限する流れに沿った設計です。

AIが採否を決めるのですか

AIが決めることはありません。合格の目安ならAIも出せますが、落とすかどうかを決めるのは人で、スコアはその判断の材料にすぎません。

候補者から評価理由を聞かれたら答えられますか

評価軸ごとのスコアと、その根拠が文章で残ります。面談の録画と文字起こしもあわせて保存されるため、後から遡って確認できます。

面接官による評価と比べられますか

AIの採点と、人のレビュアーがつけた採点を並べて記録できます。総合スコアと軸ごとの差が出るので、どこで判断が分かれたのかを確認でき、校正にも活用できます。

評価軸の設計から、ご相談ください

いまの評価基準を、どう質問と評価軸に落とすかをご説明します。無料・約30分。