テクノロジー · July 18, 2026 · 約5分
AI Sandbox アセスメントとは何か?
テストで AI を禁止することは、候補者が日常的に使うツールなしで作業できるかどうかを測っているにすぎません。AI Sandbox は、2026 年に本当に問われるスキル、すなわち AI をうまく活用して作業する力を測定します。
本記事は、AI 生成の採用アセスメントに関するガイドの一部です。2023 年以降、採用における最大のスキルシフトは AI ツールを活用して作業することであり、それにもかかわらず、ほとんどのアセスメントは今なおそうしたツールが存在しないかのように振る舞っています。
AI を禁止すると測るべきものを誤る
候補者を監視下の閉じた環境に閉じ込めることは、彼らが実際の業務で毎日使うツールなしに作業できるかどうかを測っているにすぎません。それはノスタルジーであって、シグナルではありません。
AI Sandbox が測定するもの
- プロンプトの技量 — モデルから有用な結果を効率よく引き出せるか。
- 検証の勘 — AI が誤っている箇所を見抜けるか。
- 判断力 — 出力を信頼すべきときと、そうでないときを見極められるか。
私たちは候補者に、欠陥のある成果物 — 不完全なプロンプトや AI が生成した出力の一部 — を渡し、可視化されたテストケースに対してライブで実行しながら、それを修正するよう求めます。AI を使うことこそが課題であり、不正行為ではありません。
採点の仕組み
スコアは「動いたかどうか」ではありません。安価で決定論的なシグナル — 修正が本当に問題を解決しているか、どれだけ効率的に反復したか、計算リソースを無駄に浪費しなかったか — を、判定によるシグナルと組み合わせます。その要となるのが検証行動です。すなわち、候補者は AI の出力を信頼する前にきちんと確認したか、という点です。プロンプトの技量とドメインへの根ざしがこれを補完します。一度も検証せずに偶然正解にたどり着いた人は、微妙な欠陥を見抜いて修正した人よりも低いスコアになります。なぜなら、実際の業務で求められるのは後者のような人材だからです。
AI Sandbox は AI Fluency とは異なります。fluency は候補者が責任ある AI の活用を理解しているかを問うのに対し、Sandbox は候補者が実際にそれを行う様子を観察します。詳しくは 採用シグナルとしての AI fluency をご覧ください。
執筆者
Jakir Patel · Founder, Hanzomon
Building H-Evaluate — AI-native, quality-gated hiring assessments. Writes about assessment engineering, hiring integrity and compliance-first AI.