そのサーベイは何を測っているのか? ―見えない心を測る「尺度構成法」―(研究員:安本 真帆人さん)


【著者プロフィール】
安本真帆人(筑波大学大学院 博士後期課程)
専門領域:臨床心理学、産業・組織心理学

画像
※AIによるサマリー

1.はじめに
「社員の本音が知りたい」「エンゲージメントを高めたい」。
こうした目的でサーベイ(調査)を導入する企業は増えています。しかし、その質問がどのような根拠で設計されているかまで意識されることは多くありません。

心理学では、目に見えない心の状態を測定するために、尺度構成法という手法を用います。これは、見えない心理状態を測定可能な形に変換するための、いわば『心のものさし』を作る設計手法です。

本記事では、この尺度構成法の基本的な考え方と、実務でサーベイ結果を扱う際のポイントを、できるだけ平易に解説します。
ここでは、「サーベイ」を調査全体、「尺度」をその中で用いられる測定ツールとして区別して用います。

2.尺度構成法(scaling method)の基本的枠組み
2-1. 「見えないもの」を測るための4ステップ

身長や体重は、秤で見れば数値がわかります。しかし、当然ながら、「エンゲージメント」や「満足感」のような心理状態は直接観測することができません。これらを測るためには、何らかの「ものさし」、つまり、尺度(scale)を作成する必要があります。
心理学では、このように「直接は見えないが、存在すると仮定されるもの」を「構成概念」と呼びます。

尺度構成法では、構成概念を測るため、主に次の4つのプロセスを経ます。

画像

特に、④のプロセスは非常に重要であり、実務では見えにくい部分でもあります。
以下では、このプロセスで鍵となる「信頼性と妥当性」について詳述します。
 
2-2. 信頼性と妥当性
 ◾️信頼性(reliability):ブレがないか?
同じ対象を何度測っても、安定した結果が得られるかを示します。
たとえば、同じ重さの荷物を載せているのに、ある時は「1kg」、次は「3kg」と数値がバラつく秤(はかり)があったら、その秤の「信頼性は低い」といえます。
代表的な指標としてはCronbachのα係数があり、項目同士の一貫性を評価します。一般に値が高いほど「一貫性が高い」とされますが、項目数が多いほど高くなる傾向があり、解釈には注意が必要です。※1
 
※1 近年では、より高度な統計手法(ω係数や構造方程式モデリングなど)を用いて、さらに厳密に検証されることも増えています。
 
◾️妥当性:的を射ているか?
「測りたい概念を正しく表しているか」の程度を表します。
例えば「働きがい」を測定するとしながら、「給料に満足していますか?」「福利厚生に満足していますか」 といった質問のみで構成されている場合、実際には、働きがいというよりも「報酬に対する満足度」を測定している可能性があります。
一見妥当であるように見えても、測定対象となる構成概念との対応が不十分な場合には妥当性は損なわれます。
 
妥当性は単一の指標で判断されるものではなく、以下のような複数の観点から検証されます。
 
 ⇒内容的妥当性:尺度項目が構成概念の内容領域を十分に代表している
 ⇒構成概念妥当性:理論的に想定された因子構造や関連性がデータに
  よって支持されるか
 ⇒基準関連妥当性:外部基準(例:離職意図やパフォーマンス)との
  関連が理論的予測と一致するか
 
◾️信頼性と妥当性の関係
信頼性と妥当性は完全に独立した概念ではなく、信頼性が低い場合には妥当性も成立しにくい関係にあります。
この関係は「ダーツの的」に例えられます。
下図に示した的の中心は「真の値」を、オレンジ色の点(矢)は「得られた測定データ」を表します。

画像

矢が一箇所にまとまっていれば信頼性が高く、矢が中心に当たっていれば妥当性が高い状態です。
つまり、「同じところに当たる(信頼性)」だけでなく、「正しい場所に当たる(妥当性)」ことが不可欠なのです。
 
心理尺度の項目は、こうした観点から統計的に精査されて作成されます。
このプロセスを経ることで、「単なる項目の羅列」が、統計的に裏付けられた「科学的なものさし」として機能するようになります。
 
ただし、実務では、こうした検証を十分に経ていないサーベイが用いられている場合も少なくありません。
そのため、サーベイ結果を扱う際には、設問がどのような前提で作られているのかを確認することが重要です。
 
3.ワーク・エンゲイジメントの測定
尺度構成法に基づき、ワーク・エンゲイジメント(以下、WE)の測定を目的として開発された代表的な尺度に、ユトレヒト・ワーク・エンゲイジメント尺度(Utrecht Work Engagement Scale;以下、UWES)があります。9項目の短縮版(Shimazu et al., 2008)では、以下の項目が設定されています。

画像

回答者は、「全くない」〜「毎日」などの選択肢から質問に回答します。※2

Schaufeliら(2006)の研究では、UWES9項目尺度のα係数は0.85〜0.92と報告されており、良好な内的一貫性(信頼性)が示されています。
つまり、これらの項目は「なんとなく作られている」のではなく、統計的な裏付けをもって選ばれているということです。
そして、この回答から、背後にある状態(WE)を推定していきます。
 
また、この尺度には、活力(vigor)、熱意(dedication)、没頭(absorption)という下位尺度が存在します。これらは、WEという大きな概念を支える3つの柱として定義されています。

画像

具体的には、項目1・2・5が活力を、項目3・4・7が熱意を、項目6・8・9が没頭を推定する項目として設定されています。
 
このように、尺度構成法によって、抽象的な心理状態を定量的に把握することが可能となり、得られたスコアは、個人差の把握や群間比較、さらには他の変数との関連分析に活用されます。
 
※2 このような多段階評価の形式はリッカート尺度と呼ばれます。
 
4.サーベイ結果の解釈における留意点
ここまでで、心のものさしがどのように作られているか、イメージできたでしょうか?
尺度構成法の視点を持つことで、サーベイの見え方は大きく変わります。
 
・数値の捉え方の変化
サーベイで得られるスコアは、尺度に基づき、複数の質問への回答から推定された値です。
そのため、サーベイの1問ごとの結果に一喜一憂するのではなく、「尺度全体」や「下位尺度(活力・熱意など)」の単位で構造的に捉えることが重要です。
 
・比較の落とし穴
部署間でスコアを比較する際には、「同じ質問を、同じ意味で解釈し、同じ基準で回答されている」という前提(測定不変性)が必要です。この前提が崩れている場合、スコアの差は「組織状態の差」ではなく、「解釈や基準のズレ」を反映している可能性があります。※3
 
◾️比較を歪める要因の例
・解釈のズレ(概念的等価性)
例えば「上司の支援」という言葉に対し、若手は「手厚い指導」を、管理職は「権限委譲」を連想しているかもしれません。解釈が異なれば、同じスコアでも意味合いは変わります。
 
・基準のズレ(準拠集団効果)
評価の基準が高い部署ではスコアが低く出やすく、逆に支援が得られないことが日常的であるような基準の低い部署では、上司の僅かな助けでスコアが高く出ることがあります。
 
これらが十分に検討されないまま、数値の大小だけで「あの部署は問題だ」「この施策は成功だ」と断じることは、解釈を誤るリスクがあります。
そのため、「なぜこの差が出ているのか」をインタビューなどの定性情報と併せて解釈することが重要です。
 
・サーベイ設計の理解
サーベイのスコアを扱う上では、そのサーベイが「尺度に基づくもの」なのか、「指標の合成によるもの」なのかを区別することも重要です。
 
◾️尺度(Scale)
ここまで説明してきた「心のものさし」を指します。
背後にある概念(例:WE)が先に存在し、その状態が各項目への回答として現れると考えます。つまり、項目は内面状態の“反映”です。
 
◾️指標(Index)
「報酬+労働時間+福利厚生」を合算して「働きやすさ」と定義するようなケースです。
各項目は独立しており、必ずしも相関する必要はありません。ここでは、統計的検証よりも「必要な要素を網羅しているか」が重視されます。
 
これらは一見似ていますが、前提となる考え方が大きく異なります。
実務上、この区別が曖昧なまま平均値を算出してしまうと、スコアの解釈を見誤るリスクがあります。
自社のサーベイが「概念を測定しようとしているのか(尺度)」、あるいは「要素を合成しているのか(指標)」を意識するだけでも、サーベイ結果の読み解きは大きく変わります。
 
※3 測定不変性は段階的な概念であり、どの水準が満たされているかによって比較の解釈可能性は異なります。
 
5.まとめ
尺度構成法とは、見えない心理状態を、統計的に検証された「測定可能な形」に変換するためのプロセスです。
UWESをはじめとする心理尺度は、単なるアンケートではなく、構成概念を推定するための測定モデルです。その背後には、信頼性・妥当性の検証や、測定不変性といった多くの学術的前提があります。
だからこそ、提示されたスコアを単に数値として受け取るのではなく、「その数値がどのような前提で成り立っているのか」を理解し、批判的に吟味するリテラシーを持つことが、これからの人事・マネジメント層には不可欠です。
サーベイは「答え」ではなく、「問いを深めるための手がかり」です。
 
引用文献
Schaufeli, W. B., Bakker, A. B., & Salanova, M. (2006). The measurement of work engagement with a short questionnaire: A cross-national study. Educational and Psychological Measurement, 66(4), 701–716.

Shimazu, A., Schaufeli, W. B., Kosugi, S., Suzuki, A., Nashiwa, H., Kato, A., Sakamoto, M., Irimajiri, H., Amano, S., Hirohata, K., & Goto, R. (2008). Work engagement in Japan: Validation of the Japanese version of the Utrecht Work Engagement Scale. Applied Psychology: An International Review, 57, 510–523.

島津明人(2010)職業性ストレスとワーク・エンゲイジメント.ストレス科学研究, 25, 1-6.
 


資料請求・面談希望・お問い合わせは、お問合せフォームからお送りください。

ご希望に応じて、サービス内容や研究成果の資料提供、個別相談に対応いたします。

企業・研究者の皆さまからのご連絡をお待ちしております。

資料請求・面談希望・お問い合わせは、お問合せフォームからお送りください。

ご希望に応じて、サービス内容や研究成果の資料提供、個別相談に対応いたします。

企業・研究者の皆さまからのご連絡をお待ちしております。