先に答えを立てると速くなる。速くなったぶん、確かめる手順が痩せる
仮説を先に立てろ、と言われる。たしかに速くなるのだが、速くなるのは、確かめる作業のほうが縮むからでもある。1960年の課題では、参加者の多くが、自分の答えに合う例だけを何度も試して、合わない例を一度も試さないまま、自信をもって間違った規則を宣言した。
先に答えを立てる、という操作
仮説思考は、材料を集めきる前に答えの候補を1つ置き、その候補が正しいとしたら何が観察されるはずかを決めてから、確かめにいく道具である。速くなるのは本当だ。調べる範囲が絞られるからである。
ただし、絞られた範囲がどう絞られているかは、あまり見られない。この単位が扱うのはそこだ——速さの代金を、どの手順が払っているか。
先に持ち場を狭めておく。自分の予想がどれだけ当たっているかを点検する話と、期待値の計算は、開運の棚がすでに扱った。ここではそれを主役にしない。扱うのは、仮説を立てたあとに人が実際に何を試すか、という一点である。
2-4-6
1960年に Quarterly Journal of Experimental Psychology へ出た課題が、この一点をきれいに切り出している。
英国・ロンドン大学の心理学の学部生29人に、3つの数の並びを1組見せる。2、4、6。この並びが従っている規則を当てるのが課題である。参加者は自分で3つの数の並びを作って提出でき、そのたびに「規則に合っている/合っていない」だけが返ってくる。十分に確信できたら、規則を宣言する。
正解は「3つの数が増えていく順に並んでいること」——ただそれだけである。
結果はこうだった。最初の宣言で正解に届いたのは29人中6人。13人は一度誤って宣言してから正解に届き、9人は二つ以上の誤った宣言を重ね、1人は最後まで結論に至らなかった。
外し方には型がある。たとえば「2ずつ増える」という仮説を立てた人は、8・10・12 を試す。合っている、と返る。20・22・24 を試す。合っている。100・102・104。合っている。ここで宣言する。
試した並びは、どれも自分の仮説に合う並びだった。合わない並びを一つも試していない。1・2・3 を試していれば、その一手で仮説は壊れていた。
これは「間違った試し方」ではない。自分の仮説に合う事例を試す方略は、日常のたいていの場面では効率がよい。1987年に Psychological Review へ出た論文が、この方略に名前を与えている——調べたい性質を持っていそうな事例のほうを試す、という一般的なやり方であり、確かめたい気持ちの産物というより、探し方の既定値である。効率がいいかどうかは、課題の作りしだいで変わる。2-4-6 の課題は、正解の規則が仮説より広いという作りになっている。そういう作りのとき、この方略は最後まで反証に出会わない。
枠を変えると、率が動く
1980年に同じ Quarterly Journal of Experimental Psychology へ出た研究が、そこを試している。課題の中身は同じで、枠だけを変えた。規則に「合う/合わない」ではなく、二つの名前の付いた分類のどちらに入るかを返す形にしたのである。参加者の仕事は、規則を当てることではなく、二つの分類を埋めることになる。
最初の宣言での成功率は、およそ2割から6割へ上がった。
注意深く読む値打ちがある。参加者の思考力は変わっていない。変わったのは、何を集めることが仕事だと言われたかである。片方の分類しか埋めなくてよいと思っているあいだ、人はもう片方を集めない。両方を埋めるのが仕事になった瞬間、合わない例が自然に集まりはじめる。
実務に持ち帰るときの形は、これで決まる。「仮説を反証せよ」と自分に言い聞かせるのではなく、表の空欄を2列作る。合う事例の列と、合わない事例の列。空欄が並んでいれば、埋めにいく。
外れたことに、気づけない
もう一つ、この道具には固有の危険がある。外れたときに、外れたと気づけないことだ。
1975年に Journal of Experimental Psychology: Human Perception and Performance へ出た実験が、それを測っている。イスラエルの二つの大学で、六つの下位実験に合わせておよそ367人が参加した。参加者は、19世紀初めのある出来事の経過を書いた短い文章を読み、起こりうる四つの結末それぞれについて、起こる確率を%で答える。
片方の群には、結末を伝えない。もう片方の群には「実際にはこの結末になった」と伝えたうえで、同じように四つの結末それぞれの確率を答えさせる。伝えられた結末を除いて答えよ、とは言わない。
結果はこうだった。ある結末について、知らされなかった群の平均は33.8%。同じ結末を「実際に起きた」と伝えられた群の平均は57.2%である。23.4ポイントの移動だ。別の結末でも同じ向きに動いた。さらに、同じ論文の後続の実験では、結末を知ったうえで「知らなかったつもりで答えてください」と明示的に指示したが、答えは知る前の水準まで戻らなかった。
この棚が16回くり返している手つきの二つめが、ここに出る。人は、自分がさっきまで何を考えていたかを、自分では見られない。だから外れた仮説は、外れた記録としてではなく、「そもそも自分はそう思っていなかった」という記憶として保存される。外れの回数は、こうして減っていく。
2012年に Perspectives on Psychological Science へ出た総説によれば、専門家だからこの動きが小さいという関係は、より多くの研究を集めた2004年のメタ分析では見つからなかった。いっぽう、実際に起きた結末とは別の結末が起きていた理由を書き出させる操作は、この動きを小さくした——消しはしないが、小さくした。
探しにいった一つ
仮説思考は、実務では「まず仮説を置き、それを検証する作業に資源を集中する」という手順として売られている。出どころは大手のコンサルティング会社の実務書と、その系譜の指南書である。
この手順を使った場合と使わなかった場合を比べた査読された検証を探した。心理学・意思決定研究の主要誌、経営学の主要誌、学術検索を、手法名・会社名・問題解決という主題の組み合わせで当たった。たどり着けなかった。
出てきたのは、実務書と、実務出身者による解説記事と、2019年に経営教育の査読誌へ出た一本である。ただしその一本は、この手順を6段階に整理して学生の演習に使う方法を書いた教育用の記事であって、手順の効果を測ったものではない。著者自身が、標準化された手順は学生が問題を定義する力と提案への自信を高める、と述べているが、それを比較で確かめた記述は無い。
存在しないとは断定しない。だが、確かめようとした側がたどり着けない場所にある主張は、根拠としては使えない。この手順を否定する必要もない——否定するための証拠も、同じように見当たらないからである。
時間・変化:仮説は早く固まり、あとから正しくなる
仮説の一生には、決まった形がある。
第一に、固まるのが早い。2-4-6 の課題で、多くの参加者は最初の1組の並びを見た時点で仮説を持っていた。以降の試行は、仮説を作る作業ではなく、仮説を確かめる作業だった。
第二に、集めた事例は片側に偏る。片側だけ集めても、返ってくる答えはすべて「合っている」なので、確信だけが厚くなる。確信の高さは、集めた事例の量とは対応するが、その事例の向きとは対応しない。
第三に、外れが記録に残らない。結末を知ったあとの記憶は、知る前の予想を上書きする。だから「自分の仮説はだいたい当たる」という感覚は、当たった回数からではなく、外れが消えた記録から作られる。
妨げるもの、助けるもの、最初の一歩
妨げるものの筆頭は、仮説を口頭で持つことである。頭の中の仮説は、結果が出たあとに静かに書き換わる。書き換わったことは、書き換えた本人にも見えない。
第二の妨げは、確かめる作業を「合う事例を集めること」と定義してしまうことだ。1980年の研究が示したのは、集める対象が二つになった瞬間に率が動く、ということである。定義が変われば、行動は勝手に変わる。
標本の偏りも断っておく。ここで引いた証拠は、英国とイスラエルと北米の大学生を対象にした、数十分で終わる課題である。実験室で数分の課題として測られたものが、締切のある本物の判断にそのまま当てはまるとは限らない。1975年の実験の結果については、その後の再現の試みで、うまくいったものといかなかったものの両方が報告されている。日本語での追試もほとんど見当たらない。正解に届いた人のデータは残り、途中で投げ出した人のデータは残らない。
助けるのは、実行の前に一行書くことだ。「こうなると思う」を、結果が出る前に、消せない形で残す。それだけで、あとから書き換わる余地が減る。
最初の一歩は3分。今日する判断を1件選び、実行の前に予想を一行書き、実行したあとに結果と照らして○か×を付ける。
次の単位は 192「メタ認知」——仮説思考が、一つの問いに答えを当てにいく道具なら、こちらは、いま自分がどの道具を使っているかを見張る道具である。引き出しは隣にあり、どちらから開けてもかまわない。
- Wason 1960(Quarterly Journal of Experimental Psychology 12(3):129-140)の課題では、英国・ロンドン大学の心理学の学部生29人のうち、最初の宣言で正しい規則に届いたのは6人だった。13人は一度誤ってから正解に届き、9人は二つ以上の誤った宣言を重ね、1人は最後まで結論に至らなかった
- 正解の規則は「3つの数が増えていく順に並んでいること」だけである。外した人は自分の仮説に合う並びばかりを試し、合わない並びを一つも試さなかった。1・2・3 を一度試していれば、その一手で仮説は壊れていた
- Klayman & Ha 1987(Psychological Review 94(2):211-228)は、これを一般的な方略——調べたい性質を持っていそうな事例のほうを試すやり方——として整理した。確かめたい気持ちの産物というより探し方の既定値であり、効率がいいかどうかは課題の作りしだいで変わる
- Tweney ら 1980(Quarterly Journal of Experimental Psychology 32(1):109-123)は、課題の中身を変えずに枠だけを変えた。規則に合う・合わないではなく、二つの名前の付いた分類のどちらに入るかを返す形にしたところ、最初の宣言での成功率がおよそ2割から6割へ上がった
- Fischhoff 1975(Journal of Experimental Psychology: Human Perception and Performance 1(3):288-299)では、イスラエルの二つの大学で六つの下位実験に合わせておよそ367人が参加した。ある結末について、結末を知らされなかった群の平均は33.8%、その結末を実際に起きたと伝えられた群の平均は57.2%で、23.4ポイント動いた
- 同じ論文の後続の実験では、結末を知ったうえで「知らなかったつもりで答えてください」と明示的に指示したが、答えは知る前の水準まで戻らなかった。外れた仮説は、外れた記録ではなく、そもそもそう思っていなかったという記憶として保存される
- 大手コンサルティング会社に由来する仮説駆動型の問題解決手順について、使った場合と使わなかった場合を比べた査読された検証を探したが、たどり着けなかった。出てきたのは実務書と解説記事、そして Chia 2019(Management Teaching Review 4(4):355-370)——手順を6段階に整理して学生の演習に使う方法を書いた教育用の記事で、効果を測ったものではない
| よくある誤解 | 実際のところ |
|---|---|
| 仮説駆動型の問題解決は、効果が検証済みの手法である | 使った場合と使わなかった場合を比べた査読された検証を、心理学・意思決定研究の主要誌、経営学の主要誌、学術検索で探したが、たどり着けなかった。出てきたのは実務書と解説記事、そして Chia 2019(Management Teaching Review)——手順を6段階に整理して学生の演習に使う方法を書いた教育用の記事である。存在しないとは断定しないが、根拠としては使えない。同時に、この手順を否定する証拠も見当たらない |
| 自分の仮説に合う事例ばかり試してしまうのは、確かめたい気持ちのせいだ | Klayman & Ha 1987 は、これを調べたい性質を持っていそうな事例のほうを試すという一般的な方略として整理した。探し方の既定値であり、日常のたいていの場面では効率がよい。外れるのは、確かめたい規則が自分の仮説より広い、という作りの課題のときである。Tweney ら 1980 が課題の枠を二つの分類を埋める形に変えただけで、最初の宣言での成功率がおよそ2割から6割へ上がったのは、気持ちではなく仕事の定義が変わったからだ |
| 外した仮説は、外したこととして記憶に残る | Fischhoff 1975 では、ある結末について、結末を知らされなかった群の平均が33.8%、その結末を実際に起きたと伝えられた群の平均が57.2%で、23.4ポイント動いた。後続の実験で「知らなかったつもりで答えてください」と明示的に指示しても、答えは知る前の水準まで戻らなかった。専門家ならこの動きが小さいという関係も、2004年のメタ分析では見つかっていない。外れの回数は、こうして記録から静かに減っていく |
仮説思考のいちばん都合のよいところは、うまくいったときに手柄が残り、外れたときに記録が残らないことである。外れた仮説は「そもそも自分はそう思っていなかった」という形で保管され、次の会議では「だから言ったでしょう」に姿を変える。皮肉なことに、この道具を正しく使うために必要なのは、鋭い仮説でも速い検証でもなく、実行の前に書いた一行を、あとから消さずに置いておく胆力のほうである。
Q1. Wason 1960 の課題の結果を数字で答えよ。参加者は何人で、そのうち何人が先行する誤りなしに最初の宣言で正解に届いたか。正解の規則は何か。一問一答
Q2. Tweney ら 1980 は課題の何を変え、成功率はどう動いたか。本文はそこから実務に持ち帰る形として何を挙げているか。一問一答
Q3. Fischhoff 1975 の実験で、ある結末について、結末を知らされなかった群と、実際に起きたと伝えられた群は、それぞれ平均で何%と答えたか。また後続の実験で「知らなかったつもりで答えてください」と指示したときはどうなったか。一問一答
Q4. 自分の仮説に合う事例ばかり試す振る舞いについて、Klayman & Ha 1987 の整理として本文の記述に合うものはどれか。選択
Q5. 仮説駆動型の問題解決手順について、本文が「探して確かめたこと」として書いているのはどれか。選択
今日これからする判断を1件だけ選ぶ。何時に家を出るか、どの店に行くか、どの作業から手を付けるか、返信を今日出すか明日にするか——結果が今日か明日には分かるものにする。実行する前に、手元のメモに一行だけ書く。「こうなると思う」を、できるだけ具体的に。たとえば「20分で着く」「在庫は無い」「返事は明日になる」のように、あとで○か×が付けられる形にする。書いたら日付と時刻を添える。ここまでを実行の前に済ませるのが要点で、あとから書いたものはこの課題では使わない。実行したあと、その一行を読み返して、結果と照らして○か×を付ける。×が付いても、書き換えない。他人の予想は扱わず、誰かの判断を評価もしない——この課題は自分のメモの中だけで完結する。
——とはいえ、その“正しい用法・用量”は、まだ誰も知らない。ここまでの研究に、あなたのデータは1件も入っていないからだ。平均は地図にすぎない。自分の“いい具合”は、試して探すしかない。
あなたの実験(N=1)を始める → プロジェクトに追加(記録機能は準備中)
- Wason P.C. (1960) 'On the Failure to Eliminate Hypotheses in a Conceptual Task', Quarterly Journal of Experimental Psychology 12(3):129-140 — bear.warrington.ufl.edu
- Klayman J., Ha Y.-W. (1987) 'Confirmation, Disconfirmation, and Information in Hypothesis Testing', Psychological Review 94(2):211-228 — eric.ed.gov
- Tweney R.D., Doherty M.E., Worner W.J., Pliske D.B., Mynatt C.R., Gross K.A., Arkkelin D.L. (1980) 'Strategies of Rule Discovery in an Inference Task', Quarterly Journal of Experimental Psychology 32(1):109-123 — journals.sagepub.com
- Fischhoff B. (1975) 'Hindsight ≠ Foresight: The Effect of Outcome Knowledge on Judgment Under Uncertainty', Journal of Experimental Psychology: Human Perception and Performance 1(3):288-299 — web.mit.edu
- Roese N.J., Vohs K.D. (2012) 'Hindsight Bias', Perspectives on Psychological Science 7(5):411-426 — journals.sagepub.com
- Chia A. (2019) 'Distilling the Essence of the McKinsey Way: The Problem-Solving Cycle', Management Teaching Review 4(4):355-370 — journals.sagepub.com