強制選択とリッカート尺度
AかBかを選ばせるのか、一つの文を五段階で評定させるのか。回答の形式が、その検査に出せる答えの種類を先に決めています。そして片方は、後から知見として報告される分類を自分で作っています。
測定のしかた
同じことを聞く二つのやり方があります。
パーティーで、あなたは (a) 知らない人を含めて大勢と話す (b) 知っている少数の人と話す
「知らない人にも自分から話しかける」 まったく違う — 違う — どちらともいえない — そう思う — とてもそう思う
前者が強制選択、後者がリッカート尺度です。後者は1932年にレンシス・リッカートが提案しました。文体の好みの違いに見えます。違います。質問が一問も書かれる前に、形式がその検査に出せる結果の種類を決めています。
短く言うと、強制選択は程度を捨て、程度を捨てた仕組みは側しか報告できません。 タイプ診断がタイプを出し、特性検査がパーセンテージを出す理由は、ほとんどこれで説明がつきます。分類はデータの中で発見されたのではありません。回答用紙に組み込まれていました。
それぞれの形式が残すもの
リッカートは距離を残します。 「とてもそう思う」と答えた人と「そう思う」と答えた人は、違うことを言っています。採点はその違いを保ちます。二十項目を合計すれば取りうる値の多い得点になり、比較集団に当てられます —— パーセンタイルと規範の仕掛けです。そして真ん中を言えるようにします。 本当に中くらいの回答者にとって「どちらともいえない」は正確な答えです。
強制選択は方向を残します。 あなたは a を選んだ。検査は a を記録します。51パーセントで選んだのか99パーセントで選んだのかは記録されません。聞かれていないからです。 二十項目なら二十点満点の集計になり、全員が10のどちらか側に着地します。
これには本物の利点が一つあって、だからこの形式は生き残っています。強制選択は方向をそろえて歪めるのが難しい。 二つの選択肢はたいてい同じくらい魅力的に作られているからです。雇い主によく見せようとして答えるとき、五段階なら好ましい文すべてに強く同意できます。望ましい二文からの二者択一ではそれができません。選抜のような高い利害の場面ではこれが効くので、よく設計された職業用の器具はいまもこの形式を使います。
代償は、本当に好みの無い人が、好みを一つ作らされることです。作られた好みが二十個で、一つの型ができます。
日本語圏では、同じ名前の下に二つの形式が並んでいます
ここが日本語で読む人にとっていちばん具体的な節です。「MBTI」という一つの名前の下に、回答形式の違う二つの器具が並んでいます。
日本MBTI協会が扱う MBTI® の質問紙は、二者択一の項目でできています。どちらがより自分らしいかを選ぶ。出力は四文字の型で、パーセンテージではありません。そして結果は確定値として渡されず、認定ユーザーとの対面フィードバックを通じて本人がベストフィットタイプを定める手続きに載ります。
一方、日本語圏でほぼ全員が受けている 16Personalities は、一つの文にどれくらい同意するかを段階で答えさせ、四つの次元をパーセンテージで返します。協会はこれについて、質問も結果の出し方も MBTI とは別のものだと公に述べていて、理論的にも特性論の側に立つと説明しています。
つまり日本語の「MBTI診断を受けた」という一文は、どちらの形式で答えたのかを含んでいません。 そして形式が違えば、上の二節のとおり、出せる答えの種類が違います。
- 二択で答えたのなら、程度は記録されていません。出てきた四文字は、境目からの距離を持っていません。
- 段階で答えたのなら、程度は記録されています。ところが出力は四文字で、程度はパーセンテージとして横に置かれています。捨てられてはいないが、主役でもない。
この二つ目のほうが、実はやっかいです。程度を集めておきながら、最後に線を引いて側を報告する。 情報は一度取られて、一度捨てられている。捨てられた場所が境目の問題で、捨てられたことの帰結が再検査信頼性です。
どちらを受けたかを確かめる方法は簡単です。結果画面にパーセンテージがあれば段階式、四文字だけなら二択式です。 二つの器具の来歴の違いは無料の性格診断を比べるにまとめました。
自比式(ipsative)という副作用
強制選択には、二つめの、より見えにくい帰結があります。1944年にキャッテルが名づけ、ヒックスが詳細に展開しました。
各項目が二つの特性のあいだで選ばせるとき、特性たちは固定された予算を奪い合っています。 一つで高く出れば、必然的に別の一つが低く出ます。同じ一回の回答が両方の仕事をしたからです。これが自比式(ipsative)の採点で、結果が記述しているのはあなたの中での特性の並び順であって、他の人の中でのあなたの位置ではありません。
帰結は素っ気なく、そして日常的に無視されます。自比式の得点は人と人のあいだで比べられません。 「私は主導性が高くてあなたは低い」は、データが支持していない文です。二人とも同じ固定予算を使ったからです。主導性が自分の中で最も高いとは言えます。他人のそれより高いとは言えません。
日本語圏でこれがいちばん実害を出しているのは企業研修の場で、そこの話はDiSC(ディスク)が —— 日本語版の販売経路と、人事がその四文字で何をしてよいのかを含めて —— すでに書いています。ここでは繰り返さずに渡します。
ブラウンとマイデュ-オリバレスは、この問題が技術的には解けることを示しました。項目反応モデルを使えば強制選択のデータから規範的な得点を復元できます。ただし専用の設計と較正標本が必要で、インターネットで無料で受けられるもののほとんどは、そのどちらも持っていません。
リッカートが失敗するところ
情報を多く残す形式は、雑音も多く集めます。明らかに優れた選択というわけではありません。
真ん中が隠れ場所になります。 「どちらともいえない」は、本当に中くらいの人にも、分からない人にも、場合によると思っている人にも、言いたくない人にも、ちゃんと読んでいない人にも使われます。五つの異なる状態が一つの応答に潰れる。だから中点を外して必ずどちらかに寄らせる器具があるのですが、それは強制選択の問題を小さく持ち込むことでもあります。
日本語ではこの選択肢が、英語の neutral より穏当に響きます。「どちらともいえない」は、答えを保留する丁寧な言い方として日常語の中にあります。選びやすい選択肢が真ん中に置かれているということで、これは設計上の判断です。回答者の側の中間回答傾向そのもの —— そしてそれが日本語話者の標本で繰り返し観察されていること —— は回答のくせが扱うので、そちらへ渡します。
くせが中身を汚します。 尺度の両端を避ける人と、両端に住む人がいます。この傾向は個人の中で安定していて、すべての特性の得点を同時に動かします。
基準は自分の参照集団です。 「自分はよく話すほうだ」に同意するとき、誰と比べてよく話すのか。人は周りの人と比べて答えるので、同じ行動が環境によって違う評定を生みます。生の平均値を文化間で比べるとよく間違うのはこのためです。
項目の文言が見た目以上に働きます。 「知らない人に話しかける」と「知らない人に話しかけるのは苦にならない」は別のものを測っています。一方は行動、他方は主観的な難しさで、二つに違う答えを返す人はかなりいます。
形式が分かったあとの読み方
結果を見る前に回答形式を見てください。画面一つぶんの手間で、その出力に何が言えるかが分かります。
A か B だったなら、出力は形と方向です。量として読まないこと。自分のプロフィールを他人のそれと、共通の物差しに載っているかのように比べないこと。そしてラベルが不安定であることを見込んでおくこと —— 51パーセントの好みが側として記録された状況は、まさに再検査信頼性が失敗する場面です。
段階だったなら、出力は得点であり、比較集団に対してのみ意味を持ちます。その集団が何だったかを聞いてください。たまたまそのサイトで受けた人全員に対するパーセンタイルは、層化標本に対するパーセンタイルとは別の物体です。
出力が分類で、形式が段階だったなら、誰かが線を引いています。そして線は、あなたが告げられたことのうち最も信頼できない部分です。ページに元の数字が出ているなら、そちらを探してください。
私たちの検査は両方の形式を使っていて、対応は偶然ではありません。ビッグファイブはリッカートでパーセンテージを返します。DiSCは自比式に近く、形を返します。MBTI風タイプ診断は四文字の横にパーセンテージを置いていて、捨てられた程度がどこかに見えているようにというのがそのままの理由です。私たちの結果のうち、ラベルだけあって数字が無いものについては、ラベルがその下の形式に支えきれない重さを負っています。そのページで最も弱い主張として読んでください。
出典
- · Likert, R. (1932). A technique for the measurement of attitudes. Archives of Psychology, 140, 1–55.
- · Cattell, R. B. (1944). Psychological measurement: normative, ipsative, interactive. Psychological Review, 51(5), 292–303.
- · Hicks, L. E. (1970). Some properties of ipsative, normative, and forced-choice normative measures. Psychological Bulletin, 74(3), 167–184.
- · Brown, A., Maydeu-Olivares, A. (2013). How IRT can solve problems of ipsative data in forced-choice questionnaires. Psychological Methods, 18(1), 36–52.