「面接は意味がない」と言われる理由は、面接という場そのものにあるのではありません。質問も評価尺度も決めないまま行う面接に、入社後の活躍を予測する力がほとんど認められないためです。逆に、質問と採点基準を事前に固定した構造化面接は、選考手法のなかで最も高い予測力を示したと報告されています。
つまり問題は「面接をやるかどうか」ではなく、「どちらの面接をやっているか」です。本記事では、この2つを分ける境目を示したうえで、自社の面接がどちらに当たるかを点検する材料と、構造化へ移すときに実際に崩れる箇所を扱います。
「意味がない面接」と「予測力のある面接」を分けるもの
構造化面接は最も予測力が高いと報告されている
産業・組織心理学会(SIOP)の解説記事は、Sackett らが2022年に発表した選考手法のメタ分析の再検討について、構造化面接の平均的な操作的妥当性が .42 で最も高く、認知能力テストは .31 だったと報告しています。長く「認知能力テストが最良の予測因子」とされてきた通説に対する修正であり、構造化面接がそれを上回ったという点がこの再分析の要点です。
人事コンサルティング会社 master-hr の解説(2023年)も、同じ再分析について構造化面接の平均妥当性を .42 とし、80%信用区間が .18〜.66 であると紹介しています。幅が広いということは、「構造化面接」と名のつくものの中に、効いているものと効いていないものが混在しているという意味です。看板ではなく中身が問われます。
設計しない面接の予測力は、ほぼ観測されていない
ビジネスリサーチラボの解説記事(2025年)は、Janz(1982)の研究として、行動記述面接の妥当性係数が 0.54 であったのに対し、非構造化面接は 0.07 で統計的に有意ではなかったと紹介しています。
0.07 という値が示すのは、「精度が低い」ではなく「入社後の成果とほぼ関係が見いだせなかった」ということです。面接官の力量の差の話ではありません。同じ質問をしていないデータは、そもそも比較できないという構造の話です。
ここまでを整理すると、次のようになります。
| 設計していない面接 | 構造化面接 | |
|---|---|---|
| 質問 | 面接官がその場で決める | 全候補者に同一の質問を行う |
| 聞く対象 | 意欲・人柄・将来の抱負 | 過去に実際に取った行動と結果 |
| 採点 | 面接後の総合的な印象 | 質問ごとに、事前に決めた尺度で採点 |
| 比較 | 面接官の記憶の中で行う | 同じ項目の点数どうしで行う |
| 報告されている予測力 | ほぼ観測されない水準 | 選考手法のなかで最も高い |
自社の面接がどちらかを点検する
「うちは質問リストがある」という段階では、まだ構造化されていないことがあります。次の5項目のうち、1つでも「いいえ」があれば、その面接の結果は候補者どうしで比較できません。
| 点検項目 | 判定の仕方 |
|---|---|
| 同じ職種の候補者に、同じ質問を同じ順で聞いているか | 直近5名分の面接記録を並べ、質問文が一致しているかを見る |
| 質問ごとに、何点をつけるかの基準文が用意されているか | 「5点=〜の状況で〜を実行し〜を達成した」という水準の記述があるか |
| 採点が面接中または直後に、質問ごとに記録されているか | 総合評価だけが残っていないか |
| 不合格の理由が、どの質問の何点かで説明できるか | 「合わない」「印象が弱い」で処理されていないか |
| 同じ候補者を複数の面接官が採点したとき、点数のずれを確認しているか | ずれの大きい項目が特定できているか |
最後の項目が残っていることが多くあります。評価のずれは、測って初めて減らせます。 面接官どうしの点数を突き合わせ、記録として残す運用は、面接評価シートの形骸化を防ぐ基準の構造化とデータ運用で扱っています。
なお、点検の前提として、そもそも何を測るのかが決まっていなければ尺度は作れません。求める要件が曖昧なまま面接だけを整えても精度は上がらないため、要件定義から見直す場合は採用ミスマッチの原因は要件の曖昧さを先に参照してください。
構造化へ移す4つの段階
| 段階 | やること | 完了の基準 |
|---|---|---|
| 1 | 自社で成果を出している人の行動を、職種ごとに3〜5個の要件に分解する | 「〜できる」ではなく「〜の状況で〜をした」という記述になっている |
| 2 | 要件ごとに、過去の行動を聞く質問と追質問を1セット作る | 状況・課題・自分の行動・結果の4点を必ず引き出せる |
| 3 | 質問ごとに5段階の採点基準文を書く | 各点数に、該当する行動の例が1つ以上書かれている |
| 4 | 同じ録画・同じ回答で複数の面接官が採点し、ずれを突き合わせる | ずれが2点以上出た項目の基準文を書き直した |
段階3が要です。「コミュニケーション能力 5点満点」という項目は、基準文が無ければ非構造の面接と変わりません。 5点と3点の違いが行動の記述で書き分けられて初めて、面接官が違っても同じ点数に近づきます。
段階4は省かれがちですが、ここを飛ばすと基準文の解釈が面接官ごとに分かれたまま運用が始まります。1回あたり1時間程度で済み、効果が最も大きい段階です。
なお、質問の設計と並行して、聞いてはいけない事項の確認も必要です。厚生労働省の「公正な採用選考の基本」は、採用選考を「応募者の基本的人権を尊重すること」と「応募者の適性・能力に基づいた基準により行うこと」の2点を基本とすると示しています。本籍・出生地、家族、住宅状況、生活環境・家庭環境、宗教、支持政党、思想、尊敬する人物、購読新聞・愛読書などは、就職差別につながるおそれのある事項として挙げられています。構造化は、この基本と同じ方向を向いた作業です。 要件に紐づかない質問は、そもそも採点できないため自然に落ちます。
運用で崩れる4か所
- 質問リストだけが配られる。 採点基準文が無ければ、質問が揃っても評価は揃いません。配るなら基準文とセットにしてください。
- 面接の最後に総合評価だけを書かせる。 質問ごとの点数が残らないと、不合格の理由を説明できず、次の改善もできません。採点は質問ごとに、面接中か直後に記録します。
- 「人柄も見たい」で自由質問枠が肥大する。 自由に聞く時間を設けること自体は構いませんが、採点に使うのは固定した質問の点数だけと決めてください。曖昧な適合感が採否に混じる経路はカルチャーフィットの勘違いを防ぎ、多様性を保つ正しい採用基準で扱っています。
- 候補者の体験を考えない。 前掲のビジネスリサーチラボの記事は、構造化面接が硬直的・機械的と受け取られる可能性と、候補者に目的を説明することの必要性を指摘しています。冒頭で「全員に同じ質問をしている」と伝え、終盤に自社の説明と質疑の時間を確保してください。
面接官個人に残るバイアスへの対処は、面接官のバイアスを排除し採用精度を高める評価設計を参照してください。
まとめ
- 「面接は意味がない」と感じる原因は、面接という場ではなく、質問と評価尺度を決めていないことにあります。
- SIOP の解説記事によれば、Sackett らの2022年の再分析で構造化面接の操作的妥当性は .42 と最も高く、認知能力テストの .31 を上回りました。
- ビジネスリサーチラボの記事が紹介する Janz(1982)では、行動記述面接 0.54 に対し非構造化面接は 0.07 で有意ではなかったと報告されています。
- 自社の面接は、質問の同一性・基準文の有無・質問ごとの採点記録・不合格理由の説明可能性・面接官間のずれの5点で点検できます。
- 移行で最も効くのは、5段階それぞれに行動の例を書いた採点基準文と、同じ回答を複数人で採点してずれを突き合わせる段階です。
- 構造化は、厚生労働省が示す「適性・能力に基づいた基準により行う」という採用選考の基本と同じ方向を向いた作業です。
出典
- Society for Industrial and Organizational Psychology, “Is Cognitive Ability the Best Predictor of Job Performance? New Research Says It’s Time to Think Again”(Sackett et al., 2022 の再分析の解説)
- master-hr, “Insights from Sackett et al. (2022, 2023): Towards a Fuller Understanding of the Validity of Selection tools”(2023年)
- ビジネスリサーチラボ「人材採用の精度を高める:構造化面接の効果」(2025年6月19日)/同記事が紹介する Janz (1982)
- 厚生労働省「公正な採用選考の基本」「採用選考時に配慮すべき事項」(公正な採用選考特設サイト)



