記事一覧

採用 · July 20, 2026 · 約9分

採用における言語習熟度:信頼ではなく測定を

採用における言語習熟度は職務スキルであり、履歴書上の主張ではありません。「流暢」という一言に本物の言語ゲートが必要な理由と、市場を越えた公正な評価方法を解説します。

Jakir Patel 著 · Founder, Hanzomon

共有

「採用の5つのピラー:アセスメントが測定するもの」の一部

採用
目次

5言語対応のサポートデスク、お客様の言語でクロージングするインマーケットの営業担当者、バンガロールやクラクフで大量採用するグローバル・ケイパビリティ・センター——こうしたグローバル対応が求められる職種において、言語は求人票上の「あれば望ましい」条件ではありません。それが業務そのものです。それなのに、ほとんどの企業は今なお同じように根拠のない方法で評価しています。履歴書に「日本語:流暢」と書いてあれば、それを事実として受け取ってしまうのです。この一行の未検証な記載こそ、最もコストのかかる採用ミスが始まる場所です。なぜなら、そのコストは顧客の目の前で顕在化するからです。採用における言語習熟度を、役割が実際に必要とする水準でゲートを設けた測定可能な職務スキルとして扱うことが、憶測をなくす唯一の方法です。

「流暢」は主張であり、証拠ではない

履歴書に記載された言語能力は自己申告であり、まったく基準が統一されていません。ある候補者にとって「流暢」とは2年間のスペイン語学習を意味し、別の候補者にとっては法的契約書の起草を意味します。誰も確認しません。サポートエージェントは英語を完璧に読めても、顧客が辟易するような返信を書くことがあります。SDRのアウトリーチは文法的に完璧でも、商談を静かに壊してしまうようなトーンのずれがあることがあります。主張と実態は大きく乖離し得るのに、履歴書にはそれを区別する手段がありません。自己申告の問題は候補者にとっても不利に働きます。本物の実務習熟度を持つ人が、「流暢」と書くのは言い過ぎだと心配して実力より低く書くことがある一方、はるかに乏しいスキルしか持たない自信家は何の躊躇もなく「流暢」と書きます。直接評価はこの両方の誤りを同時に正します。能力を決して自己申告しないような控えめで有能な候補者が実力を証明する場を提供し、自信過剰な申告者が一言で先に進むことを防ぎます。

面接でも救われません。共通の第二言語での15分の通話は日常会話を試すものであり、顧客メールに求められる書面上の能力は試せません。そのうえ、面接官がアクセントの印象で証拠に代えてしまう——これがまさにバイアスが忍び込む経路です。言語が求人票に明記するほど重要なら、他のコアスキルと同様に直接測定するほど重要なはずです。それ以外はすべて、意思決定に見せかけた代用品です。

実際に何が壊れるかを考えてみてください。候補者は流暢に会話できても、ライティングで敬語のレベルを誤り、その文化では失礼または馴れ馴れしく受け取られるメッセージを顧客に送ってしまうことがあります。読解はまた別のスキルです。エージェントは許容範囲の返信を書けても、詳細なポリシー文書を流し読みして答えを変えるような例外事項を見落とすことがあります。リスニングはさらに別物であり、電話とビデオサポートが密かに失敗する場所です。「流暢」という一言が4つの異なるスキルを一語に圧縮してしまいますが、言語に依存する職種がすべてのスキルを同じ水準で必要とすることはほとんどありません。どのスキルが足を引っ張るかを知るには、個別に測定するしかありません。

言語は職務スキル——だからスキルとして評価する

グローバル職種の多くにおいて、言語は「あれば望ましい」要件ではありません。それが業務そのものです。だからこそ、他のコアコンピテンシーと同じ扱いが求められます。役割が実際に必要とする水準に対して直接測定する——語彙だけでなく、実際の業務全体を見渡す評価です。読解、リスニング、ライティング、そしてその文脈が求めるレジスターやトーンも含めて。丁寧なサポート返信、説得力のある営業メール、簡潔な社内アップデートはそれぞれ異なる能力を必要とし、本物の評価はそれを反映します。言語をスペルチェックに還元することはありません。

本物の言語ゲートは漠然としたスコアを出すのではなく、「この人はこのレベルでこの言語で業務を遂行できるか」というYes/Noの問いに答えます。役割の要求に合わせて調整された定義済みの習熟度バンド(CEFR B2、JLPT N2など)でパス/フェイルを判定し、汎用的な指標ではありません。

これはワークサンプルテストの背後にある論理と同じです。評価が実際の業務に近いほど、パフォーマンスの予測精度が高まります。言語ゲートは言語そのもののワークサンプルです。また、これはより広いシステムの一部でもあります——言語は優れた候補者評価が考慮する複数のシグナルの一つであり、単独の判定ではありません。ドメイン・認知・行動の証拠と並行して機能し、それらに取って代わるものではありません。

AI Sandboxのワークサンプルセッション——実際の業務タスクに「主張ではなく証拠」のアプローチを適用したものです。

ネイティブで生成——英語の翻訳ではなく

英語の設問を翻訳したものと、対象言語でネイティブに作成したものとでは、大きな違いがあります。機械翻訳された設問は慣用表現を失い、レジスターを誤り、本物の習熟度が宿る文化的文脈を平板にしてしまいます——日本語の敬語、アラビア語の敬意の水準、ネイティブがすぐに感じ取れる丁寧な返信と素っ気ない返信のギャップ。翻訳された選択式問題は、ある単語を認識できるかどうかを試すことはできても、実際の状況下で正しい単語を選べるかどうかは試せません。

H-Evaluateは全6言語でAI生成の評価をネイティブで作成するため、日本語の評価は日本語話者向けに書かれたように読めます——実際にそうだからです。このネイティブ生成は、翻訳された選択式問題ではアクセスできないモダリティも解放します。例えば、候補者が音声による指示を理解できるかどうか——単なるテキストの解読ではなく——を測定するリアルオーディオ付きのリスニング問題です。サンプル評価で試すことができます。本物のリスニング能力と書面上の認識を区別するために作られた日本語の音声問題です。

レジスターの問題は表面的なものではありません。日本語では、敬語のレベルを誤ると親切な返信が侮辱になることがあります。アラビア語では、フォーマルとくだけた表現の差に本物の職業的な重みがあります。フランス語では、tuとvousの選択が敬意の有無を示します。翻訳エンジンはこのすべてを平板にします。意味を最適化するのであって、ネイティブが無意識に行う社会的調整を最適化するのではないからです。候補者がそうした判断を正しく行えるかどうかを測定する評価こそ、顧客が気づく点を正確に測定しており——そして履歴書の「流暢」が隠す点を正確に測定しています。

現在対応している言語

H-Evaluateは現在、6言語をネイティブで評価しています。それぞれ職種ごと——さらには招待ごとに設定できる確立した習熟度フレームワークに紐づいており、複数の市場に展開する一つの求人が各掲載で異なる言語と水準を持つことができます。

  • 英語 — CEFR(A1〜C2)。顧客対応職種のほとんどはB2でゲートを設定。
  • スペイン語 — CEFR(A1〜C2)。
  • フランス語 — CEFR(A1〜C2)またはDELF。
  • アラビア語 — CEFR準拠(A1〜C2)。
  • 日本語 — JLPT(N5〜N1)。
  • 韓国語 — TOPIK。
6
ネイティブで評価される言語数
CEFR · JLPT
実際の習熟度フレームワーク
Read · Listen · Write
測定対象——語彙だけではない

すべてのゲートは語彙だけでなく読解・リスニング・ライティングを測定し、必須の前提条件として機能します。水準を下回る候補者はドメイン設問に進めないため、その人が実際に業務を遂行できないにもかかわらず、レビュアーが採点に時間を費やすことはありません。水準は設定可能なので、役割が実際に必要とするものに合わせてバーを設定できます——ドキュメント中心のバックオフィス職と、ライブチャットサポート職は同じ職種名を共有しつつも、それぞれ異なる言語要件を持てます。

言語ピラーが真価を発揮する場面

すべての職種に言語ゲートが必要なわけではありません。言語が重要な役割を担う場所——ミスマッチが顧客体験や商談結果に直接現れる場所——でこそ、その価値が発揮されます。

  • グローバル対応職種を大量採用するグローバル・ケイパビリティ・センター(GCC)。言語のミスマッチは数百席にわたって急速に拡大します。
  • 顧客の言語でサービスを提供するカスタマーサポートおよびBPOチーム。トーンと正確さが製品そのものであり、その包み紙ではありません。
  • 担当者のライティングと言い回しがコンバージョンに直結するインマーケット営業職。営業開発担当者の採用方法も参照してください。
  • 分散チームにおける多言語対応の製品・オペレーション・コンテンツ職。
  • 現地のプロキシ——学校・地域・共通ネットワーク——を言語能力の代わりに使えない、リモート・ボーダーレスな採用のすべて。

顧客対応の採用が最も明確なケースです。サポート職は顧客の言語で書かれた明確さで成否が決まります。だからこそカスタマーサポート担当者の採用は、製品知識に踏み込む前に言語ゲートから始めるべきです。順序を間違えると、職務が求めるバーを決して超えられない候補者への面接サイクルに時間を費やすことになります。

招待ごとの設定は大量採用時に最も効果を発揮します。GCCは「カスタマーサポートスペシャリスト」の職種を一つ掲載し、半ダースの市場にスタッフを配置するかもしれません——あるキューは英語B2、別のキューは日本語N2、さらに別はスペイン語B1。設定可能なゲートがなければ、それは6つの別々の求人掲載と6つの手動スクリーニングプロセスになります。一つのゲートがあれば、招待ごとに言語と水準を設定した単一の職種で対応できます。バーは候補者が実際に担当するキューに合わせて設定され、弱い候補者を通過させるか、優秀な候補者を弾くかのどちらかになる最小公倍数の基準ではありません。

言語習熟度は単独の判定ではなく、より広い候補者評価における一つのシグナルです。言語ゲートを通過した候補者は、依然として職種が求めるドメイン・判断力・行動スキルを示す必要があります。ゲートはただ、必要な言語で実際に業務を遂行できる人を対象に評価していることを確保するものです。

i18nは前提条件;習熟度評価が差別化要因

よく似て聞こえる二つのことを区別することが重要です。国際化(i18n)とは、候補者が自分の言語でプロダクトと採用フローを体験できるようにローカライズすること——摩擦を下げ、敬意を示す良い、当然の基準です。言語ピラーはその逆方向に機能します。対象言語における候補者の習熟度を測定します。H-Evaluateは両方を提供しています——プラットフォームと評価は6言語で利用でき、職種が必要とする言語における候補者の習熟度を評価します。体験のローカライズは礼儀であり、習熟度の検証が採用シグナルです。そして後者だけが、その人が業務を遂行できるかどうかを教えてくれます。

候補者体験をローカライズすることと、習熟度を評価することは別物として扱ってください——磨き上げられた翻訳済みのフローに安心してゲートを省略しないでください。候補者の言語による素晴らしい体験は、その人があなたの顧客が話す言語で業務を遂行できるかどうかについては何も語りません。

公平性は双方向に機能する

言語ゲートは業務に関連するものでなければ公平ではありません。職種が実際に必要としない言語——またはレベル——で候補者をゲートすることは、アドバースインパクトを作り出し、正当な理由なく優秀な人材を排除することになります。大切なのは、バーを職務の実際の要件に合わせて設定し、すべての候補者に同一に適用することです。そうすることで、標準化された習熟度ゲートは採用担当者が電話でのアクセントに対して抱く直感的な反応よりも公正なシグナルになります——印象を、一貫した説明可能な測定に置き換えるのです。

その一貫性が構造化評価の本質です。全員に同じ方法で適用されるゲートは、バイアスが隠れる個人的で無意識の判断を取り除きます——採用におけるバイアス削減が善意ではなくプロセスの問題だというのと同じ原則です。適切に使えば、言語ピラーはグローバル採用をより正確かつ公平なものにします。

もう一つの微妙な公平性の落とし穴を避ける必要があります。言語能力と、候補者がたまたま話すアクセントや方言を混同することです。書面での習熟度、読解力、適切なレジスターが業務関連のシグナルです。通話での地方のアクセントは通常そうではなく、それを不利に扱うことは不公平であり法的なリスクも伴います。よく設計された習熟度ゲートは、業務が求めること——この人は職種が求める水準で読み、理解し、書けるか——に焦点を当て、偏った耳には習熟度のように聞こえるが実際にはそうでないものについては意図的に沈黙を守ります。スキルでゲートし、出自でゲートしないことが原則です。

言語要件を国籍や民族のプロキシにしてはなりません。職種が実際に必要とする読解・リスニング・ライティングで厳密にゲートを設け——実際のレベルで、全員に同一に適用し——アクセント・方言・出自を判断から完全に排除してください。

業務がある言語で行われるなら、履歴書の言葉を信頼して採用しないでください。職種が依存するどのスキルでも試すように、その言語を試してください。
Hiring pillarsLanguage proficiencyMultilingual hiringGlobal teamsCandidate evaluation
J

執筆者

Jakir Patel · Founder, Hanzomon

Building H-Evaluate — AI-native, quality-gated hiring assessments. Writes about assessment engineering, hiring integrity and compliance-first AI.

実践に移す

いま読んだ内容を採用の意思決定に変えるための、評価・職務別ガイド・計算ツール。

よくある質問

採用における言語習熟度テストとは何ですか?

CEFR B2やJLPT N2といった定義された水準で、候補者が実際にその言語で職務を遂行できるかどうか——読解、リスニング、ライティング、適切なレジスター——を測定するものです。履歴書上の「流暢」という自己申告を鵜呑みにするのではなく、主張を実証に変えます。言語が業務の一部となる職種において、これは採用判断の根拠として機能します。

なぜ履歴書の「流暢」を信頼してはいけないのですか?

「流暢」は自己申告であり、一切検証されません。そのため「学校で少し学んだ」レベルから実際の業務習熟度まで、意味する内容は人によってまったく異なります。言語が業務そのものとなるサポート・営業・オペレーション職では、この未検証の一行がコストのかかる採用ミスの入口になります。その乖離を発見するのは、候補者がすでに顧客の前に立った後——最悪のタイミングです。

H-Evaluateが評価できる言語は何ですか?

英語、日本語、スペイン語、フランス語、アラビア語、韓国語の6言語で、いずれも英語からの機械翻訳ではなくネイティブで生成されています。各ゲートはCEFRやJLPTなどの確立した習熟度フレームワークに準拠し、語彙だけでなく読解・リスニング・ライティングを測定します。水準は職種ごと、さらには招待ごとに設定できるため、複数の市場に展開する一つの求人が、それぞれ異なる言語と水準を持つことができます。

職種に求める言語習熟度の水準はどのように設定すればよいですか?

一律の基準ではなく、実際の業務が求める水準に合わせて設定してください。顧客対応のライティングを伴う職種はCEFR B2以上が必要なことが多く、主にドキュメントを読む社内業務はB1が適切な場合もあります。実際の要件を超える水準でゲートを設けると、有能な人材を排除しアドバースインパクトを生み出すことになります。職種の要件に水準を紐づけ、その職種のすべての候補者に一貫して適用してください。

言語評価と採用フローのローカライズはどう違いますか?

フローのローカライズ(i18n)とは、候補者が自分の言語でプロダクトや評価を体験できるようにすること——礼儀であり、当然の基準です。言語評価は逆方向に機能します。職務が必要とする対象言語における候補者の習熟度を測定するものです。プラットフォームが両方を提供することはできますが、採用シグナルを生むのは習熟度評価のみです。ローカライズだけでは、その人が実際に業務を遂行できるかどうかは分かりません。

関連記事

あなたの求人票で試す

アーリーアクセスのウェイトリストに登録し、実際の求人でH-Evaluateがアセスメントを生成する様子をご覧ください。

あなたの求人票で試す