「成長を予測できる唯一の数字」を六つの指標と並べて比べたら、予測価値がほとんど無かった
0から10で勧めるかを尋ね、上の二段から下の七段を引く。一つの数になる。成長を予測できる数字はこれひとつだ、と実務誌が2003年に書いた。皮肉なことに、実務でよく使われる六つの顧客の声の指標を並べて将来の業績への予測力を比べた研究では、推奨の意向にも推奨の行動にも、ほとんど、あるいはまったく予測価値が無かった。
前の単位では、続いている相手にもう一段売るという話を扱った。ここでは、その相手が離れないことを何と呼び、どう測ってきたのかを扱う。
この段には、看板がある。 成長を予測できる数字は、ひとつだけである。 0から10までの尺度で「勧めますか」と尋ね、9と10を推奨者、7と8を中立、0から6を批判者とし、推奨者の割合から批判者の割合を引く。一つの数になる。 ここでは、その主張がどう追試されたかを見る。
主張の出どころは、実務誌である
原典は2003年12月の実務誌の記事で、査読誌ではない。 掲載は81巻46-55頁である。当方が確認できたのは、書誌と、二次が伝える主張の骨子までである。原典本文は購読の壁の内側にある。
だから、この単位では原典からの逐語は引かない。 0から10を三つの群に潰す切り方の根拠がどう書かれているかも、当方は原典本文で確認していない。 「切り方に根拠が無い」とは書かない。書けるのは、その根拠を当方は確認できていない、までである。
確認できるのは、追試のほうである。
追試は、優越の主張を再現できなかった
**2007年に *Journal of Marketing* 71巻3号へ出た論文**が、その追試である。抄録の書き出しが、まず状況を正確に描いている。
管理者たちはこの指標を広く受け入れ、使ってきた。著名なロイヤルティの助言者が、顧客満足や維持といった他のロイヤルティ指標と比べて、企業成長のもっとも信頼できる唯一の指標として提唱しているものである。(原文は提唱者の氏名を挙げて書かれているため、ここでは日本語に移して引く。)
何をしたか。
> “employs longitudinal data from 21 firms and 15,500-plus interviews from the Norwegian Customer Satisfaction Barometer to replicate the analyses used in Net Promoter research”(21社からの縦断データと、ノルウェーの顧客満足の指標による15,500件超の聞き取りを用いて、この指標の研究で使われた分析を追試する)
そして、比較の相手として、米国の顧客満足の指標も置いた。 結果である。
> “…the research fails to replicate his assertions regarding the ‘clear superiority’ of Net Promoter compared with other measures in those industries.”(……この研究は、それらの業種において他の測度に比べたこの指標の明白な優越性についての主張を、追試できなかった)
先頭で省いたのは、「提唱者自身がこの指標の模範例として挙げている業種を用いて」という条件節である。つまり——提唱者に有利な土俵で追試して、再現できなかった。
ここは正確に読む必要がある。 論文が再現できなかったのは、「明白な優越性」という主張である。「この指標には予測力がゼロだ」とは書いていない。 言われているのは、他の測度より優れているとは言えなかったということである。
六つの指標を並べて、予測力を比べた研究がある
**2006年に *Marketing Science* 25巻5号へ出た論文は、さらに直接的である。実務でよく使われる六つの顧客の声の指標を並べて、将来の業績をどれだけ予測するか**を比べた。
データは、米国の顧客満足の指標と、1994年から2000年までの財務・株式の公開データベースである。結果はこうである。
> “Our results indicate that average satisfaction scores have the greatest value in predicting future business performance and that Top 2 Box satisfaction scores also have good predictive value.”(結果が示すのは、平均の満足度がもっとも将来の業績を予測する価値を持ち、上位二段の満足度もよい予測価値を持つということである)
そして、この単位の核心。
> “metrics based on recommendation intentions (net promoters) and behavior (average number of recommendations) have little or no predictive value.”(推奨の意向に基づく指標と、推奨の行動に基づく指標は、ほとんど、あるいはまったく予測価値を持たない)
論文の結びは、はっきりしている。
> “Our results clearly indicate that recent prescriptions to focus customer feedback systems and metrics solely on customers’ recommendation intentions and behaviors are misguided.”(結果は、顧客の声の仕組みと指標を、推奨の意向と行動だけに絞れという近年の処方が誤りであることを、明確に示している)
予測力があったのは、平均の満足度のほうだった。
六つのうち残りの二つ——再購買の見込みと、苦情を述べた顧客の割合——は、業績のどの側面を見るかによって予測価値を持ったり持たなかったりした。 つまり六つのあいだに、はっきりした順位が出ている。 上から、平均の満足度、上位二段の満足度、条件つきの二つ、そして推奨系の二つ、である。
この順位は、実務での使われ方の順位と、ほぼ逆である。 会議で読み上げられるのは推奨系の数字で、平均の満足度は「参考」の欄に落ちていることが多い。予測価値の順位と、注目の順位が、逆を向いている。
時間・変化:満足のほうには、株価との関係まで出ている
**同じ2006年に *Journal of Marketing* 70巻1号へ出た論文は、顧客満足への投資が超過収益をもたらすか、それが市場の危険の高さと結びついているかを調べた。答えは、前者は「はい」、後者は「いいえ」**である。
論文は、米国の顧客満足の指標が株式の市場価値と有意に関連する一方で、その指標の結果についての報道が株価を動かさないことを示している。この食い違いが出発点になって、超過収益が生じうるかを検討し、二つの株式の組み合わせ——一つは遡って検証した紙の上のもの、一つは実際の事例——を提示した。低い体系的な危険のもとで、どちらも市場を相当な差で上回った。
**そして2013年に *International Journal of Research in Marketing* 30巻3号314-318頁へ出た論文は、表題からして「追試」である——満足を将来の業績の予測子として扱う議論の、追試。**
その二年前、2015年には同誌32巻2号195-206頁で、顧客の声についての複数の指標が顧客の維持をどれだけ予測できるかが、あらためて比較されている。(掲載年は2015年で、先の追試より後になる。)単一の指標に絞るのではなく、複数を並べて比べるという問いの立て方が、二〇一〇年代にも続いている。
この分野の順番を並べると、こうなる。 2003年に実務誌が「ひとつの数字」を提唱し、2006年に六つの指標の予測力が比較されて推奨系の指標に予測価値が無いと出て、同じ2006年に満足と株価の関係が示され、2007年に追試が優越の主張を再現できず、2013年に追試がもう一本出た。
二十年たっても、この指標は実務で広く使われている。
「ひとつの数字」に潰すこと自体の効用
公平を期しておく。 この指標が広まったのには、予測力とは別の理由がある。一つの数になっていて、部門をまたいで持ち回れる。 比べられて、並べられて、目標にできる。満足度の平均も一つの数だが、こちらは「何点満点で何点」という形なので、上がったか下がったかしか言えない。 推奨者から批判者を引く形は、符号を持つ。 マイナスになる。マイナスは、会議で強い。
この棚の通奏低音の一つ目が、ここで顔を出す——顧客について流通している数字は、たいてい、その数字を売っている人が作った。 この指標を提唱したのは、ロイヤルティを主題にする助言業の人である。それが悪いのではない。 悪くなるのは、その数字が、査読された予測力と同じ顔で目標欄に置かれるときである。
妨げるもの、助けるもの、最初の一歩
妨げるものの筆頭は、この一つの数を、成長の予測として扱うことである。六つの指標を並べて比べた研究では、推奨の意向にも推奨の行動にも、ほとんど予測価値が無かった。 予測力があったのは、平均の満足度である。
もう一つ。追試の結果を、追試の不在と取り違えること。 「まだ確かめられていない」のではない。確かめられて、優越の主張が再現できなかった。 この二つは、まったく違う。
この単位では、顧客に調査を送る課題は作らない。 相手に点数を尋ねる、という形の課題は書かない。書けるのは、自分の手元にある数字がどう作られているかを確かめることまでである。
助けるのは、自分がいま見ている顧客の指標が、平均なのか、割合の引き算なのかを確かめるという一手である。引き算の形をした指標は、分布のかなりの部分——この場合は中立の群——を計算から落としている。
落としていること自体は、欠陥ではない。 落とすと決めた式なのだから、そう動く。問題になるのは、数字が動いたときに、その理由を読もうとする場面である。 推奨者が減ったのか、批判者が増えたのか、それとも中立の群が両側へ散っただけなのか。一つの数からは、どれも同じに見える。
もう一つ。この指標を目標欄に置いている組織で、それを「やめよう」と言うのは、読者の権限の外にあることが多い。 この単位が渡せるのは、その数字が動いたときに、隣に平均の満足度も置いて見るという、権限のいらない一手である。
標本の偏りを断っておく。追試はノルウェーの指標と米国の指標を使っている。 六つの指標の比較も、米国の企業を1994年から2000年まで追ったものである。日本の商いで同じ順位になるかは、ここでは確かめられていない。 また、解約や離反を「裏切り」として描かないこと。 相手が離れるのは、相手の事情が変わったからでもある。
最初の一歩は5分。自分が見ている顧客についての指標を一つ選び、その計算式を一行で書き写す。 平均なのか、割合の引き算なのか、割合そのものなのか。そして、その式のどこかで、回答の一部が計算から落ちていないかを確かめる。 落ちていれば、落ちている範囲を一言書く。
次の単位は 255「紹介・リファラルループ設計力」——人が人を連れてくるという話。紹介で来た客は本当に価値が高いのか、そしてその差は続くのかを見る。
- この指標を提唱した原典は2003年12月の実務誌の記事で、査読誌ではない。掲載は81巻46-55頁である。当方が確認できたのは書誌と二次が伝える主張の骨子までで、原典本文は購読の壁の内側にあり、逐語は引いていない。
- 2007年のJournal of Marketing 71巻3号は、21社の縦断データと、ある国の顧客満足の指標による15,500件超の聞き取りを用いて、この指標の研究で使われた分析を追試し、別の国の顧客満足の指標とも比較した。
- その追試は、提唱者自身がこの指標の模範例として挙げている業種を用いても、他の測度に比べたこの指標の明白な優越性についての主張を再現できなかった。ただし予測力がゼロだとは書かれていない。
- 2006年のMarketing Science 25巻5号は、実務でよく使われる六つの顧客の声の指標を並べ、1994年から2000年の米国企業の財務・株式データで将来の業績への予測価値を比較した。もっとも予測価値が大きかったのは平均の満足度で、上位二段の満足度もよい予測価値を持った。
- 同じ研究で、推奨の意向に基づく指標と、推奨の行動に基づく指標は、ほとんど、あるいはまったく予測価値を持たなかった。論文は、顧客の声の仕組みと指標をこれらだけに絞れという近年の処方は誤りだと明確に述べている。
- 2006年のJournal of Marketing 70巻1号は、米国の顧客満足の指標が株式の市場価値と有意に関連する一方、その指標の結果についての報道が株価を動かさないことを示し、二つの株式の組み合わせが低い体系的な危険のもとで市場を相当な差で上回ったと報告した。
- 2013年のInternational Journal of Research in Marketing 30巻3号314-318頁は、満足を将来の業績の予測子として扱う議論の追試である。この主題では、二〇〇〇年代半ば以降、追試が繰り返されている。
| よくある誤解 | 実際のところ |
|---|---|
| 推奨してくれる人の割合から批判する人の割合を引いた数字は、企業成長のもっとも信頼できる唯一の指標である | 2007年のJournal of Marketing 71巻3号は、21社の縦断データとある国の顧客満足の指標による15,500件超の聞き取りを用い、提唱者自身が模範例として挙げている業種で追試したが、他の測度に比べた明白な優越性についての主張を再現できなかった。ただしこの論文は、予測力がゼロだとは書いていない。書かれているのは、他の測度より優れているとは言えなかった、である。 |
| 顧客の声の仕組みは、推奨の意向と行動に絞ればよい | 2006年のMarketing Science 25巻5号は、六つの顧客の声の指標を並べて将来の業績への予測価値を比べた。もっとも大きかったのは平均の満足度で、上位二段の満足度もよい予測価値を持った。一方、推奨の意向に基づく指標と推奨の行動に基づく指標は、ほとんど、あるいはまったく予測価値を持たなかった。論文は、顧客の声の仕組みと指標をこれらだけに絞れという近年の処方は誤りだと明確に述べている。 |
| 顧客満足という古い指標は、経済的な成果とはつながっていない | 2006年のJournal of Marketing 70巻1号は、米国の顧客満足の指標が株式の市場価値と有意に関連する一方で、その指標の結果についての報道が株価を動かさないことを示した。この食い違いを出発点に、遡って検証した紙の上の組み合わせと実際の事例という二つの株式の組み合わせを提示し、低い体系的な危険のもとで、どちらも市場を相当な差で上回ったと報告している。 |
一つの数字が二十年もったのは、当たっていたからではなく、持ち回れるからである。部門をまたぎ、資料に載り、符号を持つ。マイナスになれば会議が動く。査読の側が同じ二十年で確かめたのは、その数字が動くより前に、平均の満足度のほうが先に動いていた、ということだった。
Q1. 2007年の追試が「再現できなかった」と述べているのは、正確には何についての主張か。1文で書け。一問一答
Q2. 六つの顧客の声の指標を並べて将来の業績への予測価値を比べた2006年の研究で、もっとも予測価値が大きかったのはどれか。選択
Q3. 2007年の追試は、____ 社からの縦断データと、ある国の顧客満足の指標による ____ 件超の聞き取りを用い、比較の相手として別の国の顧客満足の指標を置いた。原典の記事は ____ 誌のもので、査読誌では ____ 。穴埋め
Q4. 0から10の尺度で、____ と ____ を推奨者、____ と ____ を中立、0から6を批判者とし、推奨者の割合から批判者の割合を引く。この式に入らないのは ____ の群である。穴埋め
Q5. 2006年に顧客満足と株価の関係を調べた研究が示した、一見食い違う二つの事実の組み合わせはどれか。選択
紙かメモアプリを開く。自分がふだん見ている顧客についての指標を一つ選ぶ(満足度、評点、推奨の指標、継続率、来店の頻度、どれでもよい)。その指標の計算式を、一行でそのまま書き写す。式が分からなければ、どこを見れば分かるかを一行書き、分からなければ「分からない」と書く。次に、その式が平均なのか、割合なのか、割合の引き算なのかを一言で書く。最後に、その式のどこかで回答や記録の一部が計算から落ちていないかを確かめ、落ちていればその範囲を一言書く。誰にも尋ねない。新たに調査を送らない。いま組織に属していない場合は、自分がよく目にする評点や満足度の指標で行えばよい。
——とはいえ、その“正しい用法・用量”は、まだ誰も知らない。ここまでの研究に、あなたのデータは1件も入っていないからだ。平均は地図にすぎない。自分の“いい具合”は、試して探すしかない。
あなたの実験(N=1)を始める → プロジェクトに追加(記録機能は準備中)
- Keiningham T.L., Cooil B., Andreassen T.W., Aksoy L. (2007) 'A Longitudinal Examination of Net Promoter and Firm Revenue Growth', Journal of Marketing 71(3):39-51 — doi.org
- Reichheld F.F. (2003) 'The One Number You Need to Grow', Harvard Business Review 81(12):46-55(実務誌。査読誌ではない。書誌は2026年8月に確認。原典本文には未到達) — hbr.org
- Morgan N.A., Rego L.L. (2006) 'The Value of Different Customer Satisfaction and Loyalty Metrics in Predicting Business Performance', Marketing Science 25(5):426-439 — doi.org
- Fornell C., Mithas S., Morgeson F.V., Krishnan M.S. (2006) 'Customer Satisfaction and Stock Prices: High Returns, Low Risk', Journal of Marketing 70(1):3-14 — doi.org
- van Doorn J., Leeflang P.S.H., Tijs M. (2013) 'Satisfaction as a predictor of future performance: A replication', International Journal of Research in Marketing 30(3):314-318 — doi.org
- de Haan E., Verhoef P.C., Wiesel T. (2015) 'The predictive ability of different customer feedback metrics for retention', International Journal of Research in Marketing 32(2):195-206 — doi.org