コンサルティング心理学大全Consulting Psychology Compendium
用語心理学用語大全エビデンス:限定的

アセスメントセンター

Assessment Center

アセスメントセンターとは、複数の演習を訓練された複数の評価者が観察して評価する手法です。2022年の妥当性再分析で選抜手法の値は軒並み下方修正されており、本サイトで確認できた固有の数値はなく、費用対効果の比較が要点になります。

公開 2026-08-25 / 更新 2026-08-25

定義

アセスメントセンターとは、グループ討議やインバスケットなど複数の演習を組み合わせ、訓練された複数の評価者が行動を観察して評価する手法です。管理職の選抜・登用や能力開発に用いられます。

定義

アセスメントセンターとは、複数の演習と複数の評価者を組み合わせて、候補者の行動を観察・評価する手法です。グループ討議、インバスケット(未処理案件の処理)、面談ロールプレイ、プレゼンテーションといった演習を通じて、実際の職務に近い場面での行動を見ます。「センター」という語は施設ではなく、方法論を指します。日本では管理職の登用審査や、次世代リーダーの選抜・育成に用いられることが多い手法です。

どこから来た概念か

第二次世界大戦期の軍における将校選抜が起源とされ、戦後に企業の管理職選抜へ応用されました。背景にあるのは、「将来の職務で必要になる行動は、その職務に近い場面を作って観察するのが最も確からしい」という発想です。ペーパーテストや面接だけでは見えない、対人的な影響力や意思決定の質を捉えようとする点が特徴になります。運用のコストが高いため、対象は限定的になりがちです。

研究では何がわかっているか

正直に書きます。本サイトが検証済みとしている文献の範囲では、アセスメントセンター固有の予測妥当性の数値は確認できていません。 したがって、ここに具体的な数値を書くことはしません。

代わりに、この領域全体で何が起きたかを押さえてください。長年、選抜手法の妥当性は Schmidt & Hunter (1998) の推定が標準として引用されてきました。しかし2022年、その推定には範囲制限への系統的な過剰補正が含まれていたことが指摘され、包括的な再分析が行われます。結果として妥当性は軒並み下方修正され、順位も入れ替わりました。構造化面接 r ≈ .42(最強)/職務知識テスト .40/経験的キー方式バイオデータ .38/ワークサンプル .33/一般的認知能力 .31(首位から陥落)です(Sackett et al., 2022)。

この修正は、アセスメントセンターの評価にも間接的に関わります。第一に、過去に流通した高い妥当性の数値は、全体として割り引いて読む必要があるということ。第二に、職務に近い課題を課すという意味で近縁のワークサンプルが .33 であり、演習型の手法が突出して高いわけではないことです。実務含意を論じた続報では、選抜システム全体をこの新しい推定にもとづいて再設計することが提案されています(Sackett et al., Industrial and Organizational Psychology)。開発目的で使う場合には、多面フィードバックの知見が参考になります。改善は概して小さく、フィードバック後のプロセスが効果を左右すると報告されています(Smither et al., 2005)。

実務でどう使うか

第一に、費用対効果を明示的に比較することです。実施コストが高い手法である以上、構造化面接の設計に同じ資源を投じた場合と比較する必要があります。第二に、評価者の訓練と基準の統一です。複数評価者という構造は、基準が揃って初めて機能します。第三に、選抜と開発の目的を分けることです。第四に、結果の返し方を設計することです。レポートを渡して終わりでは、開発効果はほとんど期待できません。

よくある誤解

「実際の場面に近いから当たる」とは限りません。 近縁のワークサンプルでも .33 と報告されており、演習型が自動的に高精度になるわけではありません。

「多面的に見るから客観的」でもありません。 評価者の基準が揃わなければ、視点が増えるほどノイズも増えます。

古い妥当性の数値を根拠にしないでください。 2022年の再分析以降、選抜手法の妥当性は全体として下方修正されています。

よくある質問

アセスメントセンターの予測妥当性はどれくらいですか?

本サイトが検証済みとしている文献の範囲では、アセスメントセンター固有の数値は確認できていません。2022年の再分析で示されたのは、構造化面接 r ≈ .42、職務知識テスト .40、経験的キー方式バイオデータ .38、ワークサンプル .33、一般的認知能力 .31 です(Sackett et al., 2022)。この一覧にない手法の数値を推測で書くことはしません。

なぜ古い数値を引用してはいけないのですか?

長年標準とされてきた Schmidt & Hunter (1998) の推定には、範囲制限への系統的な過剰補正が含まれていたことが指摘され、2022年の再分析で妥当性が軒並み下方修正され順位も入れ替わりました(Sackett et al., 2022)。過去の高い数値をそのまま提示すると、実際より高い精度を約束することになります。

選抜と能力開発のどちらに使うべきですか?

目的を混在させないことが要点です。処遇に直結すると受検者の行動が防衛的になり、開発目的で得たい情報が取りにくくなります。多面フィードバックでも、改善は概して小さく、事後のプロセスが効果を左右すると報告されています(Smither et al., 2005)。

参考文献

  1. Sackett, P. R., Zhang, C., Berry, C. M., & Lievens, F. (2022). Revisiting Meta-Analytic Estimates of Validity in Personnel Selection: Addressing Systematic Overcorrection for Restriction of Range. Journal of Applied Psychology, 107, 2040-2068.
  2. Schmidt, F. L., & Hunter, J. E. (1998). The Validity and Utility of Selection Methods in Personnel Psychology. Psychological Bulletin, 124(2), 262-274.
  3. Sackett, P. R., et al. Revisiting the Design of Selection Systems in Light of New Findings Regarding the Validity of Widely Used Predictors. Industrial and Organizational Psychology.
  4. Smither, J. W., London, M., & Reilly, R. R. (2005). Does Performance Improve Following Multisource Feedback? A Theoretical Model, Meta-Analysis, and Review of Empirical Findings. Personnel Psychology.

本ページは上記の文献等をもとに編集部が作成しています。数値や結論の詳細は必ず原典をご確認ください。

ランダムに読む押すたびに変わります

目的がはっきりしていないときは、偶然にまかせてみてください。サイト内の443ページから3つ選んで表示します。

キーワードから探す

キーワードから探す押すたびに変わります

用語・技法・領域・課題をあわせた512個のキーワードから、毎回ちがう組み合わせで表示します。気になった言葉から入ってみてください。

キーワード一覧を見る