HN 日本語サマリー

← 一覧へ戻る
キャリア

採用面接でSATスコアを尋ねられた件

Job application asked for my SAT scores (mrmarket.lol)

101 pointsby seltzerboys249 コメント

要約

筆者は、テクノロジー企業が学歴要件を撤廃する傾向にある中で、ある企業からSATスコアを求められたことに驚きました。記事では、SATのような古いテストスコアの有効性に疑問を投げかけ、採用における認知能力テストの限界や、構造化面接やワークサンプルテストといったより効果的な採用手法の歴史と現状を掘り下げています。過去の奇妙な選考方法から現代のベストプラクティスまで、採用評価の多様性を考察しています。

全文翻訳

採用面接でSATスコアを尋ねられた件 2026年6月20日 昨日、私はYCジョブを見て、もし私の地域で興味深い小さなスタートアップが採用活動をしているかを確認していました(現在の完全リモートの仕事は気に入っているものの、ハイブリッドを探しています)。「GTM」と名付けられた求人を見つけました。特定の業務範囲がなく、製品を買い手にとって魅力的にする方法を何でもできる人材を求めている、というのがクールだと思いました。製品は良さそうでした(ETLタイプのツールです)。 すべて予想通りでしたが、最後の募集要項でSATスコアを尋ねられたときまでは、そうでした。これには2つの理由で興味を惹かれました。 2023年頃から、ますます多くのテック企業や急成長中のスタートアップが、学士号の要件を撤廃していることに気づいていました。代わりに、多くはサイドプロジェクトや個人のウェブサイトへのリンク、最も誇りに思うことについての記述などを尋ねます。基本的には、情熱があり「セルフスターター」であることの指標です。なぜ、自己申告で、検証不能な、この時点では数十年前のものであってもおかしくないテストスコアを尋ねるのでしょうか?もし認知能力を測る目的であれば、それよりも優れた現在の認知能力の予測因子があるはずです。そうでなければ、これは無意味な指示への従順さを試す引っかけ問題のように思えます。 理想的な条件下では、SATスコアは、新入社員がビジネスの成功に貢献するかどうかを予測するための良い指標かもしれません。認知能力は、驚くべきことではありませんが、専門職での成功と正の相関があります。とはいえ、古いSATスコアを何十年も前の知能のリトマス試験として使用することには、明確な問題があります。 あなたは、その人が17歳の頃の姿に基づいて部分的に判断を下していることになります。各応募者は、未知の条件下でテストを受けました。それが初回なのか5回目なのか、全く準備せずに臨んだのか、何ヶ月も家庭教師と勉強したのか、完璧に安定した家庭生活を送っていたのか、それとも前夜に犬が死んだり、両親が離婚したり、家賃を払うためにスーパーで夜勤をしていたりしたのか、あなたは知りません。もしかしたら、若い頃は依存症や反抗に苦しんでいたかもしれません。認知能力が同等である2人の候補者が異なるスコアを出したり、10年前に受けたテストが候補者の現在の能力を反映していないかもしれない理由はたくさんあるでしょう。 彼らが従順さを試していたのか、認知能力を試していたのかに関わらず、この異例の要求は私を採用慣行の深掘りへと導きました。ゴールドスタンダードとされる長年の方法から、未来を見たり他人の魂を知ろうとする奇妙でほとんど神秘的な試みまで、です。 採用評価のごくごく短い歴史 歴史家たちは、現代の採用評価の「科学」を確立したのは軍事であると考えています。1917年、第一次世界大戦の困難な状況に直面し、陸軍は150万人の新兵を、最も適した部隊に迅速に振り分ける必要がありました。時間的な制約から、従来の面接では対応できませんでした。ロバート・ヤーキスとその委員会は、この解決策として陸軍アルファテストと陸軍ベータテストを開発しました。前者は読み書きができる新兵向け、後者は読み書きができない新兵や英語を話さない新兵向けです。これらは基本的に同じで、陸軍ベータはコミュニケーションの障壁を回避するために非言語的でした。これらが集団実施型の認知テストの基礎となりました。 もう一つの創設の系譜は、もともとスパイ選抜に使われていたアセスメントセンターです。人格理論家のヘンリー・マレーは、田舎にひっそりと佇む田園風の邸宅で、シミュレーションと複数の評価者による3日間のプログラムを実施しました。1950年代半ば、AT&Tは、これらのアセスメントセンターの評価が有効かどうかを確認するための縦断研究を開始し、成功の予測因子として十分に機能することを発見しました。 最も効果的と思われる方法 もちろん、完璧な採用方法はありませんが、いくつかの方法を組み合わせることで、将来の専門職での成功を予測するのに最も効果的であるという証拠があります。1998年時点では、認知テスト(SATもその一つです)が最高の予測因子とされていました。その後、2022年にサケットらが、職務遂行能力の最も強力な予測因子は認知評価ではなく、構造化面接であると説得力を持って主張しました。このブログの執筆時点では、ナレッジワークにおける職務での成功を予測するための最良の証拠がある方法は以下の通りです。 構造化面接:これらの面接は、一貫した質問、採点基準、そして訓練された面接官がいる場合に機能します。これらはサケットの「最高の採用評価」リストのトップでしたが、それでも非常に一貫しているわけではありませんでした(結果には80%の信頼区間がありました)。要するに、この方法の有効性は、面接官の訓練度や採点基準の適切さと一貫性に大きく左右されるということです。 ワークサンプルテストと職務知識テスト:持ち帰りプロジェクトや何らかの試用期間です。これは圧倒的に最も直感的に理解できます。候補者に仕事の代表的な一部を実際にやってもらうことで、彼らがその仕事にどれだけ適しているかについて確実なアイデアが得られます。これを構造化面接と組み合わせることは(AI登場以前は)ゴールドスタンダードと考えられていました。話すことでその人の人柄や働き方を把握し、面接プロセスが構造化され一貫しているため、他の候補者とかなり客観的に比較する方法があり、さらにワークエクササイズを通じてその人の特性が仕事に実際にどのように適用されるかを把握できました。 認知能力テスト:依然として強力な予測因子ですが、最強ではありません。手厚い研修や学習が求められる仕事には最も有用で、候補者のこれまでの経験と要求が密接に一致する仕事にはあまり有用ではありません。 アセスメントセンター(スパイ関連):管理職としての適性を予測するのに優れていますが、当然ながら非常に費用がかかり、時間もかかります。 機能しない方法 一目見ただけで機能しないと推測できるようなものもいくつか見つけました(例:MBTIと筆跡鑑定)。最も効果の低い予測因子の一つは、非構造化面接、つまり「おしゃべり」でした。これは興味深い点です。なぜなら、私が最も頻繁に遭遇する評価方法だからです。私自身もこれをやってしまうことがあります。これらは簡単なので一般的ですが、印象操作、一貫性のない質問、ハロー効果、同類親近性バイアス(私に似ているから好き!)といった多くの誤謬に対して脆弱です。数万件の面接を対象としたGoogleの社内調査では、面接官のスコアと最終的な職務遂行能力との間にほとんど相関がないか、全く相関がないことが報告されています。 また、明るく冒険的な思想家たちが、人柄や能力を知るためのあらゆる障壁を力ずくで突破しようと、極端な外部評価を試みた事例もたくさん見つけました。一つ面白かったのは、人々がクレイジーでそれが素晴らしいと思うからです。1921年、最新の大学卒業生たちの厳格さの欠如に失望したエジソンは、163問の雑学試験を考案しました。彼が答えを知っているランダムな質問がたくさん含まれていました(一つは「灯油の樽は何の木でできているか」で、答えは「誰が気にする?」ではありませんでした)。エジソンは候補者に「塩のテスト」も課しました。彼は候補者にスープを出し、もし味見をする前に塩を振ったら、不合格にしたとされています。彼の理論は、これが彼らが思い込みに基づいて行動することを証明するというものでした。 異端な採用評価は、遠い過去にだけ限定されるものではありません。多くのテック企業もこれらを使用してきました。例:マイクロソフトやGoogleによって広まった馬鹿げた頭の体操を聞いたことがあるでしょう。彼らは候補者に「マンホールの蓋はなぜ丸いのですか?」のような質問をしました。Googleの人事責任者であったラズロー・ボックは、彼の著書でこれらの頭の体操を「全く時間の無駄」であり「何も予測しない」、そして「面接官を賢い気分にさせるだけ」だと述べています。 そして、Zapposの創業者であるトニー・シェイ(賢く、クールに見える人物、悲劇的な話)がいました。彼には空港での選考(空港スクリーニング)と「オファー」がありました。空港での選考では、Zapposが採用候補者を飛行機で呼び寄せました。到着後、会社のシャトルで迎えに行きます。一日の終わりに、採用担当者は運転手に、候補者がどのように扱われたかを尋ねます。もし悪く扱われていた場合、その候補者は採用されませんでした。