用語辞典へ

テストの妥当性

テストの妥当性(validity of a test)とは、テストが測定対象として想定された特定の側面や特性を、どの程度適切に測定し評価できているかを示す尺度です。言い換えると、テストの妥当性は、そのテストが測定しようとしているものを、どの程度正確かつ適切に測定しているかを示します。

テストの妥当性は、テスト結果が、測定しようとする実際の特性や性質にどの程度対応しているかを評価します。妥当性が高いテストは、測定対象として定められたものを実際に測定できていることを意味します。

テストの妥当性には、次のようないくつかの種類があります。

  1. 内容的妥当性(content validity):テストの内容が、対象とする特性をどの程度反映しているかを評価します。例えば、内容的妥当性のある数学テストには、数学的能力のさまざまな側面を反映する問題が含まれている必要があります。

  2. 基準関連妥当性(criterion validity):テスト結果が、同じ特性を測定する他の基準とどの程度関連しているかを評価します。この妥当性は、次の2種類に分けられます。

    • 予測的妥当性(predictive validity):テスト結果が、将来の行動や結果をどの程度予測できるかを評価します。
    • 併存的妥当性(concurrent validity):テスト結果が、同じ時点における同様の基準とどの程度関連しているかを評価します。例えば、新しいテストの結果を、すでに確立された標準テストの結果と比較します。
  3. 構成概念妥当性(construct validity):テストが、測定対象として想定された抽象的な構成概念や心理学的概念をどの程度測定しているかを評価します。例えば、構成概念妥当性は、外向性や不安傾向などの抽象的な心理学的概念を測定する性格診断テストにとって重要です。