「標準の物差しで品質は測れる」——だがその物差しは、二十年ぶんの論争の的だった
標準の尺度を使えば、サービスの品質は客観的に測れる、と教わる。皮肉なことに、その代表格である期待と知覚の引き算の物差しは、提案の直後から二十年以上、妥当性を批判され続けてきた。次元は業種で揺れ、引き算の片方の期待がぐらつき、実績だけで測る対案まで現れた。由緒ある尺度ほど、批判もまた分厚く積み上がる。
標準の物差しで、サービスの品質は測れるか
前の単位では、一つひとつの対応の質を、評点でそろえられるかを扱った。ここでは、対応の一つひとつではなく、サービス全体の品質を、標準の物差しで測れるのかを扱う。回復の科学の段は、この「測れるか」という問いで締めくくる。
この棚が繰り返す見方は、ここが本丸である。「標準の尺度を使えば、サービス品質は客観的に測れる」という語り草の流通と、その尺度が本当に品質を測れているかの証明は、別物である。 サービス品質を測る道具として、長く使われてきた尺度がある。その道具の妥当性そのものが、長い論争の的だった——この単位で、その論争を追う。
「標準の物差し」とは何か——SERVQUAL
サービス品質を測る尺度として、もっとも広く知られてきたのがSERVQUALである。1988年に提案された、この尺度の考え方は明快だ。顧客が事前に抱く期待と、実際に受けたときの知覚(受け取った印象)の差を、22項目・5つの次元(信頼性、反応の速さ、確実さ、共感、目に見える設備など)で測る。期待を下回れば品質は低い、上回れば高い——期待と知覚の引き算で、品質を数値にするという発想である。この尺度は、サービス研究の土台として長く参照されてきた。ここでは、その由緒に一度触れるにとどめる。
問題は、その先にある。この「引き算で測る」という物差しが、本当に品質を安定して測れているのか。 提案の直後から、この問いをめぐって実証的な批判が積み重なった。以下は、その論争の中身である。
批判その一——次元は、業種で揺れる
最初の批判は、5つの次元は、いつでも5つに分かれるのかという点だった。1992年、Babakus と Boller は *Journal of Business Research* 誌 24(3):253-268 で、SERVQUAL 尺度を実証的に検討し、想定された5次元の構造が、データによっては安定して現れないことを示した。業種や状況が変わると、次元の数も中身も揺れる。
1996年、Buttle は *European Journal of Marketing* 誌 30(1):8-32 で、それまでの SERVQUAL 研究を総ざらいするレビューと批判を発表し、次元の不安定さを含む複数の理論的・実務的な問題を整理した。「どんなサービスにも当てはまる、決まった5次元」という前提は、実証の前で揺らいだ。標準の物差しの目盛りが、測る対象によって伸び縮みする——これが一つ目の論点である。
批判その二——「期待」を別に測ることの、危うさ
二つ目は、より根っこにある。そもそも、期待を別に測って、知覚から引く必要があるのか。 期待を測るという操作自体に、妥当性の疑いが向けられた。
興味深いことに、この再検討は、SERVQUAL を提案した当人たちからも出た。1994年、Parasuraman・Zeithaml・Berry は *Journal of Marketing* 誌 58(1):111-124 で、期待を比較の基準として測ることを、あらためて検討し直す論文を発表した。期待は測るタイミングで変わり、後から思い出して答える期待は、知覚に引きずられる。同じころ、期待の測り方そのものへの批判も別の論者から提起されていた(1993年)。期待という「引き算の片方」が不安定なら、その差で出した数値も不安定になる。引き算の道具は、引く数がぐらつけば、答えもぐらつく。
批判その三——差分か、実績か
三つ目は、対抗する測り方の提案だった。期待との差を取るのをやめて、実際に受けたときの知覚(実績)だけで測ったほうが、むしろよく品質を捉えられるのではないか、という主張である。この実績ベースの測り方は SERVPERF と呼ばれた。
1994年、Cronin と Taylor は *Journal of Marketing* 誌 58(1):125-131 で、実績ベース(知覚のみ)と差分ベース(期待マイナス知覚)の測り方を照合し直し、両者の関係を整理した。差を取ることが、測定の精度を上げるとはかぎらない——むしろ実績だけのほうが素直に品質と結びつく、という向きの議論である。「標準の引き算」に対して、「引き算をやめる」という対案が、同じ土俵の上で戦わされた。 どちらが唯一の正解というより、測り方の選択そのものが、まだ決着していないことを、この対抗は示している。
批判その四——他分野へ、そのまま持ち込めない
四つ目は、転用への警告である。SERVQUAL は評判を得るほど、もとの想定を離れた分野へ広がった。1997年、Van Dyke・Kappelman・Prybutok は *MIS Quarterly* 誌 21(2):195-208 で、情報システムのサービス品質を SERVQUAL で測ることへの、具体的な懸念を示した。差分スコアの信頼性や、次元の当てはまりが、分野を移せばさらに怪しくなる。
こうした二十年ぶんの論争を、2009年、Ladhari は *International Journal of Quality and Service Sciences* 誌 1(2):172-198 で、SERVQUAL 研究の二十年を振り返るレビューとして総括した。結論を一言でいえば——この尺度は有用だが万能ではなく、次元は文脈で揺れ、業種に合わせた調整が要る、ということである。つまり、単一の標準尺度で、あらゆるサービスの品質を確定することはできない。
時間・変化:由緒ある尺度が、論争の的であり続けた
順に置く。1988年、期待と知覚の差で測る SERVQUAL が提案される(由緒の起点)。1992年、Babakus と Boller が、5次元の構造が安定して現れないことを示し、同じころ、差で測ることへの再検討も提起される。1993年、期待の測り方そのものへの批判が出る。1994年、SERVQUAL の提案者たち自身が期待の測り方を検討し直し(Parasuraman・Zeithaml・Berry)、Cronin と Taylor が実績ベースと差分ベースを照合し直す。1996年、Buttle がレビューと批判を整理し、1997年、Van Dyke らが他分野への転用に警告し、2009年、Ladhari が二十年を総括する。
この間に確からしくなったのは、「標準の物差しで品質は測れる」という約束ではない。 確からしくなったのは、次元は文脈で揺れ、期待を別に測る妥当性に難があり、単一の尺度で品質は確定できない、という向きのほうである。由緒ある尺度ほど、批判もまた、長く分厚く積み上がってきた。
妨げるもの、助けるもの、最初の一歩
妨げるものの筆頭は、「有名で、長く使われている尺度だから、正しく測れているはずだ」という思い込みである。由緒があること(尺度が古くから使われてきた)と、その尺度が妥当であること(本当に品質を測れていると確かめられた)は、別の話である。SERVQUAL は、まさにその由緒の分だけ、批判も浴び続けてきた。
もう一つの妨げは、測り方の選択を、決着済みだと思うことである。期待との差で測るのか、実績だけで測るのか、次元をいくつに置くのか——どれも、業種や場面で答えが変わる、開いた問いである。
助けになるのは、自分が使っている品質の数字が、どう測られているのかを、まず確かめるという一手である。それは期待との差なのか、実績だけなのか。項目や次元は、自分の仕事に合っているのか。期待を別に聞いているとしたら、それはいつ聞いたのか。測り方が見えれば、その数値が何を意味しているのかも見えてくる。
最初の一歩は10分。自分が受け取っている、あるいは使っている「サービスの良し悪しを測る数字やアンケート」を一つ選ぶ。設問や指標を見て、左に「これは何をどう測っているか——期待との差か、実績だけか、どんな項目・次元か、期待を別に聞いているか」を、思い出せる範囲で書き写す。右に「その測り方は、自分の仕事や客に合っていそうか、それとも他分野の型をそのまま借りていそうか」を書く。どちらが正しいかを結論づける必要はない。合っていなさそうな項目に、印を付けるだけである。 顧客に新しく聞いたり、反応を試したりする必要はない。自分の手元の資料だけで完結させる。
次の単位は 409「顧客の声を製品に届けるには?」——ここから、測ったあとの声を、製品や仕組みの改善へどうつなぐのか、そのループの実際を扱う。
- この単位は、サービス全体の品質を標準の物差しで測れるのかを扱い、回復の科学の段を締めくくる。「標準の尺度を使えば品質は客観的に測れる」という語り草の流通と、その尺度が本当に品質を測れているかの証明は別物である。長く使われてきた尺度SERVQUALの妥当性そのものが、提案の直後から長い論争の的だった
- SERVQUALは1988年に提案された、顧客の期待と実際の知覚の差を22項目・5次元(信頼性・反応の速さ・確実さ・共感・目に見える設備など)で測る尺度で、期待と知覚の引き算で品質を数値にする発想である。サービス研究の土台として長く参照されてきたが、その由緒に一度触れるにとどめ、この尺度自体は本文の物差しの説明に使う
- 批判その一は次元の不安定性である。1992年のBabakus・BollerのJournal of Business Research 24(3):253-268は、想定された5次元の構造がデータによっては安定して現れないことを示した。1996年のButtleのEuropean Journal of Marketing 30(1):8-32は、SERVQUAL研究を総ざらいし次元の不安定さを含む問題を整理した。決まった5次元という前提は業種や状況で揺れる
- 批判その二は期待を別に測ることの危うさである。1994年のParasuraman・Zeithaml・BerryのJournal of Marketing 58(1):111-124は、期待を比較の基準として測ることを提案者たち自身が検討し直した。期待は測るタイミングで変わり、後から思い出す期待は知覚に引きずられる。引き算の片方が不安定なら差で出した数値も不安定になる
- 批判その三は差分か実績かという対抗である。1994年のCronin・TaylorのJournal of Marketing 58(1):125-131は、実績ベース(知覚のみ、SERVPERFと呼ばれる)と差分ベース(期待マイナス知覚)を照合し直し、差を取ることが精度を上げるとはかぎらないことを示した。測り方の選択そのものがまだ決着していない
- 批判その四は他分野への転用の警告である。1997年のVan Dyke・Kappelman・PrybutokのMIS Quarterly 21(2):195-208は、情報システムのサービス品質をSERVQUALで測ることへの懸念を示した。2009年のLadhariのIJQSS 1(2):172-198は二十年のレビューとして、この尺度は有用だが万能でなく次元は文脈で揺れ業種に合わせた調整が要ると総括した
- 確からしくなったのは標準の物差しで品質は測れるという約束ではなく、次元は文脈で揺れ、期待を別に測る妥当性に難があり、単一の尺度で品質は確定できないという向きである。由緒があること(尺度が古くから使われる)と妥当であること(本当に品質を測れると確かめられた)は別で、測り方の選択(期待との差か実績だけか、次元をいくつに置くか)は業種や場面で答えが変わる開いた問いである
| よくある誤解 | 実際のところ |
|---|---|
| SERVQUALのような標準の尺度を使えば、サービス品質は客観的に、業種を問わず測れる | 尺度の妥当性そのものが長い論争の的だった。1992年のBabakus・Boller(Journal of Business Research 24(3):253-268)は想定の5次元が安定して現れないことを示し、1996年のButtle(European Journal of Marketing 30(1):8-32)は次元の不安定さを含む問題を整理した。2009年のLadhari(IJQSS 1(2):172-198)の二十年レビューは、有用だが万能でなく次元は文脈で揺れ業種に合わせた調整が要ると総括した。単一の尺度で品質は確定できない |
| サービス品質は、事前の期待と実際の知覚の差(引き算)で測るのが正しいやり方だ | 期待を別に測ることの妥当性に疑いが向けられた。1994年のParasuraman・Zeithaml・Berry(Journal of Marketing 58(1):111-124)は、提案者たち自身が期待を比較基準として測ることを検討し直した。期待は測るタイミングで変わり知覚に引きずられる。1994年のCronin・Taylor(Journal of Marketing 58(1):125-131)は、期待との差をやめて実績(知覚のみ)で測るほうが素直に品質と結びつく面があることを示した。差分か実績か、測り方の選択は決着していない |
| 評判が高く長く使われてきた尺度なら、どんな分野に持ち込んでもそのまま使える | 1997年のVan Dyke・Kappelman・Prybutok(MIS Quarterly 21(2):195-208)は、情報システムのサービス品質をSERVQUALで測ることへの懸念を示した。差分スコアの信頼性や次元の当てはまりは、分野を移せばさらに怪しくなる。由緒があること(尺度が古くから使われる)と妥当であること(本当に品質を測れると確かめられた)は別で、有名な尺度ほど批判も長く積み上がってきた |
皮肉なのは、いちばん標準に見える物差しほど、目盛りの根拠を問われ続けてきたことである。期待から知覚を引く、という一見きれいな引き算は、引く数の期待が測るたびに動き、割り当てた五つの次元が業種ごとに崩れ、そもそも引き算をやめたほうがよいという対案にさらされてきた。それでもこの尺度は、有名だという理由で、いまも研修資料の巻末にそのまま貼られている。数字が並ぶと、品質は測れた気がする。だが、その気持ちよさの正体は、しばしば、目盛りの根拠を誰も確かめずに、きれいな引き算だけを信じていることかもしれない。
Q1. SERVQUALは、顧客の事前の ____ と、実際に受けたときの ____ の ____ を、22項目・5次元で測る尺度である。引き算で品質を数値にする発想だが、その妥当性が論争の的になった。穴埋め
Q2. SERVQUALの「5次元」に向けられた批判として、この単位が示したものはどれか。選択
Q3. SERVQUALの「期待を別に測って知覚から引く」という測り方に、なぜ妥当性の疑いが向けられたのか。1994年の再検討に触れて述べよ。一問一答
Q4. 「差分ベース」と「実績ベース」の測り方の対抗について、1994年のCronin・Taylorの照合が示したことを述べ、二十年の総括(2009年)の結論にも触れよ。一問一答
Q5. この単位が扱った出来事を、年の早い順に並べよ。(ア)Van Dykeらが他分野への転用に警告する(イ)SERVQUALが提案される(ウ)Ladhariが二十年を総括する(エ)Babakus・Bollerが5次元が安定しないと示す並べ替え
紙かメモアプリに今日の日付を書く。次に、自分が受け取っている、あるいは使っている『サービスの良し悪しを測る数字やアンケート』を一つ選ぶ(顧客アンケート、レビューの点、満足度の指標、自分で作った振り返りシートなど、何でもよい)。設問や指標を見て、ページを左右に分ける。左に『これは何をどう測っているか』——期待との差で測っているか実績(受けた印象)だけか、どんな項目・次元があるか、期待を別に聞いているとしたらいつ聞いたか——を、書き写す。右に『その測り方は自分の仕事や客に合っていそうか、それとも他分野の型をそのまま借りていそうか』を書く。どちらが正しいかを結論づける必要はない。合っていなさそうな項目にだけ印を付け、最後にその数を1つの数字で書き添える。顧客に新しく聞いたり反応を試したりする必要はない。自分の手元の資料だけで完結させる。
——とはいえ、その“正しい用法・用量”は、まだ誰も知らない。ここまでの研究に、あなたのデータは1件も入っていないからだ。平均は地図にすぎない。自分の“いい具合”は、試して探すしかない。
あなたの実験(N=1)を始める → プロジェクトに追加(記録機能は準備中)
- Babakus E., Boller G.W. (1992) ‘An empirical assessment of the SERVQUAL scale’, Journal of Business Research 24(3):253-268 — doi.org
- Buttle F. (1996) ‘SERVQUAL: review, critique, research agenda’, European Journal of Marketing 30(1):8-32 — doi.org
- Parasuraman A., Zeithaml V.A., Berry L.L. (1994) ‘Reassessment of Expectations as a Comparison Standard in Measuring Service Quality: Implications for Further Research’, Journal of Marketing 58(1):111-124 — doi.org
- Cronin J.J. Jr., Taylor S.A. (1994) ‘SERVPERF Versus SERVQUAL: Reconciling Performance-Based and Perceptions-Minus-Expectations Measurement of Service Quality’, Journal of Marketing 58(1):125-131 — doi.org
- Van Dyke T.P., Kappelman L.A., Prybutok V.R. (1997) ‘Measuring Information Systems Service Quality: Concerns on the Use of the SERVQUAL Questionnaire’, MIS Quarterly 21(2):195-208 — doi.org
- Ladhari R. (2009) ‘A review of twenty years of SERVQUAL research’, International Journal of Quality and Service Sciences 1(2):172-198 — doi.org