同じ形の推論なのに、中身を入れ替えると正答率が4%から75%に動いた
演繹は、思考の道具のなかでいちばん安全ということになっている。中身に関係なく、形だけで結論が保証されるからだ。ところが、その形だけの道具を人間が握ると、成績は中身によって20倍近く動く。
演繹という道具は、何をする道具か
演繹は、すでに手元にある前提から、情報を1つも足さずに結論へ降りていく道具である。すべてのAはBである、これはAである、ゆえにこれはBである——結論に書かれていることは、前提のなかにあらかじめ含まれている。だから演繹には、前提が正しければ結論も正しい、という保証がつく。推論の道具のうち、この保証を持つのはこれだけだ。
保証の中身を正確に言うと、こうなる。演繹が守るのは、前提から結論への移り方であって、前提そのものではない。妥当な推論と正しい結論は別物である。前提が間違っていれば、完璧に妥当な推論から、完璧に間違った結論が出てくる。しかも出てきたほうは、形が整っているぶんだけ正しく見える。
この道具には裏口がある。対偶だ。AならばBが正しいなら、BでないならAでない、も必ず正しい。ここが実務で効く。ある条件が満たされていれば必ずこうなるはずだ、と言えるなら、そうなっていない場面を1件見つけるだけで、条件のほうが崩れる。演繹の使いどころは、証明するより、崩すことにある。
そして、この棚のどの道具にも共通する断りが、演繹にも付く。実験室と研修室で効いた道具は、部屋を出たとたんに効かなくなることが繰り返し確かめられている。演繹も例外ではない。
形だけで動くはずの道具が、中身で動く
1968年、英国の心理学者ウェイソンが小さな課題を作った。4枚のカードがあり、片面には文字、もう片面には数字が書いてある。見えているのは D、K、3、7。規則は「片面が D なら、もう片面は 3 である」。この規則が破られていないかを確かめるには、どのカードをめくればよいか。
正解は D と 7 の2枚である。D をめくるのは当然として、7 の裏が D なら規則は破れる。3 をめくっても何も分からない。裏が D でも K でも規則は生きているからだ。
ウェイソンの2つの実験は、参加者34人と26人で行われた。両方を合わせて、7 にあたるカード——規則が破れているかもしれない側——を選んだ人は16.7%だった。多くの人は D だけ、または D と 3 を選ぶ。
この課題はその後、半世紀ぶん積み上がった。228の実験を集めた2017年の集計では、抽象的な記号で出された104の実験で、正解の2枚をそろえて選んだ割合は19%。いっぽう、規則を「守らなければならない決まり」として出した80の実験では64%だった。
個別の実験ではもっと極端になる。米国・1982年、フロリダの大学生を対象にした実験では、同じ論理構造の課題を、飲酒年齢の規則——ビールを飲んでいるなら19歳以上でなければならない——として最初に出したとき、48人中36人(75%)が正解した。記号の課題を最初に出したときは、48人中2人(4%)だった。3つの実験を通じて、飲酒年齢版を最初に出したときの正答を合わせると、96人中81人(84%)になる。
形は同じである。動いたのは中身だけだ。
それは「具体的だから解ける」という話ではない
ここで話を止めると、抽象は難しく具体は易しい、という当たり前の結論になる。ところが同じ年に出た別の論文が、その結論を先に潰している。
1982年に British Journal of Psychology へ出た研究は、それまで報告されていた主題化の効果——具体的な題材にすると成績が上がるという現象——を、2つの実験で再現できなかった。有名だった郵便料金の規則の版は、その規則を経験していない米国の学生では効かなかったのである。成績が上がったのは、その規則が参加者自身の過去の経験の一部になっている場合だけだった。論文が出した説明は、具体性ではなく記憶の手がかりである。
逆向きの証拠もある。1985年に発表された研究は、内容を抽象的なままにしても、規則を「許可」の形——ある行為をしてよいのは条件を満たしたときだけ、という形——で示すと成績が上がることを報告した。抽象でも上がる。具体でも上がらないことがある。
つまり効いているのは、題材が身近かどうかではない。その規則を、違反がないか点検する側に回った経験があるかどうかである。演繹の形を扱う力そのものが上がったわけではない。呼び出せる手続きが記憶の側にあるかどうかで、同じ形の課題の見え方が変わる。
信じられる結論が出ると、形の点検が止まる
もう一つ、内容が形を上書きする場面がある。三段論法の妥当性を判定させる課題だ。
1983年、英国の研究チームが三段論法を4つの型に分けた。結論が妥当で信じられる/妥当だが信じられない/妥当でないが信じられる/妥当でも信じられるでもない。参加者には「前提から必然的に導かれるかどうかだけを判定せよ」と教示してある。
実験1の24人の結果はこうだった。結論が信じられる内容のとき、妥当な三段論法の受容率は92%、妥当でない三段論法の受容率も92%である。区別が消えている。結論が信じられない内容になると、妥当なものの受容率は46%まで落ち、妥当でないものは8%になる。実験2(64人)は86%・66%・62%・13%、実験3(32人)は91%・67%・53%・6%と、同じ形が繰り返された。
結論に納得できるとき、人は前提と結論のつながりを点検しない。納得できないときだけ点検する。これを欠陥と呼ぶのは正確ではない。日常の会話で流れてくる主張は、たいてい前提が省略されている。だから結論のもっともらしさを手がかりにするのは、多くの場面で効率のよい方略である。外れるのは、形だけを見なければならない場面に持ち込まれたときだ。
時間・変化:前提は、置かれた日から古くなる
演繹の弱点は、推論そのものではなく、前提の側の時間にある。
第一に、前提は書かれた日にいちばん正確で、その翌日から古くなる。「この機能を使うのは上位の顧客だけだ」という前提は、書かれた時点では観察に基づいていたかもしれない。半年後、それはもう観察ではなく引用である。
第二に、結論だけが独り歩きする。会議で導かれた結論は議事録に残り、そのもとになった前提は残らない。半年後に結論を引き継いだ人は、前提を疑う手がかりを持っていない。妥当な推論から出た結論ほど、この形で長生きする。
第三に、前提が更新されても、そこから出ていた結論は自動では取り下げられない。演繹は前提から結論へ降りる仕組みしか持たず、前提が変わったときに下流の結論へ知らせる仕組みを持たない。だから実務では、結論のほうを台帳にして、どの前提から出たかを1行だけ添えておく必要がある。
妨げるもの、助けるもの、最初の一歩
妨げるものの筆頭は、論理を訓練すれば判断がよくなるという言い方である。この棚のもとになった設計資料には「演繹の訓練で論理的矛盾検出能力が向上」という一文があり、複数の教育心理学研究が根拠として挙げられていた。心理学の学術データベースと学術検索で、その語と主題の組み合わせで探したが、この主張を報告した査読論文にたどり着けなかった。存在しないとは断定しない。ただ、確かめようとした人がたどり着けない数字は、根拠としては使えない。
第二の妨げは、形の整った結論ほど点検されないことだ。三段論法の実験が示したのは、まさにその逆——納得できる結論のとき、人は点検をやめる——だった。
ここで、この棚として毎回断ることがある。ここまでの数字は、ほぼすべて英語圏の大学生を対象にした実験室課題から採られている。課題は数分で終わり、締切もなければ、間違えても失うものがない。実験室で数分の課題として測られたものが、締切のある本物の判断にそのまま当てはまるとは限らない。日本語での追試もほとんど無い。数字は方向だけ持ち帰るのが誠実である。
助けるのは、前提を文の外に出すことだ。頭のなかにあるあいだ、前提は前提として見えない。1行書き出した瞬間に、それは点検できる対象になる。
最初の一歩は5分。直近の判断を1件選び、「前提:〜」「結論:〜」の2行に書き直す。それから、前提のほうが偽だったとして、結論が崩れるかどうかに○か×を付ける。×が付いたなら、その結論はその前提から出ていない。別のところから来ている。
次の単位は 178「帰納」——演繹が前提から降りていく道具なら、こちらは事例から昇っていく道具である。矢印の向きが逆で、保証の有無も逆になる。道具箱の隣の引き出しに、それは別々に入っている。
- 演繹は情報を足さずに前提から結論へ降りる道具で、前提が正しければ結論も正しいという保証を持つ。ただし守られるのは移り方だけで、前提そのものではない。妥当な推論から、前提が偽なら偽の結論が出る。裏口は対偶——そうなっていない場面を1件見つけると条件のほうが崩れる
- Wason 1968(Quarterly Journal of Experimental Psychology 20(3):273-281)の4枚カード課題では、英国の参加者34人と26人を合わせて、規則が破れているかもしれない側のカードを選んだのは16.7%だった。多くの人は規則に書かれたカードだけを選ぶ
- Ragni, Kola & Johnson-Laird 2017(Proceedings of the 39th Annual Conference of the Cognitive Science Society)が228の実験を集計したところ、抽象的な記号で出された104の実験で正解の2枚をそろえて選んだ割合は19%、守らなければならない決まりとして出された80の実験では64%だった
- Cox & Griggs 1982(Memory & Cognition 10(5):496-502)の実験1では、米国の大学生に飲酒年齢の規則として出したとき48人中36人(75%)が正解し、記号の課題として出したときは48人中2人(4%)だった。3つの実験を通じて、飲酒年齢版を最初に出したときの正答を合わせると96人中81人(84%)になる
- Griggs & Cox 1982(British Journal of Psychology 73(3):407-420)は2つの実験で主題化の効果を再現できず、成績が上がったのは規則が参加者自身の過去の経験の一部になっている場合だけだと報告した。Cheng & Holyoak 1985(Cognitive Psychology 17(4):391-416)は逆に、内容が抽象的でも許可の形にすると成績が上がることを示した。効いているのは具体性ではなく、違反を点検した経験のほうである
- Evans, Barston & Pollard 1983(Memory & Cognition 11(3):295-306)の実験1(英国・24人)では、結論が信じられる内容のとき、妥当な三段論法の受容率92%に対し、妥当でない三段論法の受容率も92%だった。信じられない内容では妥当なもの46%、妥当でないもの8%。実験2(64人)は86・66・62・13%、実験3(32人)は91・67・53・6%
- 設計資料にあった「演繹の訓練で論理的矛盾検出能力が向上」という主張は、心理学の学術データベースと学術検索で探したが、これを報告した査読論文にたどり着けなかった。存在しないとは断定しないが、根拠としては使えない
| よくある誤解 | 実際のところ |
|---|---|
| 論理は中身から独立しているのだから、演繹の課題の成績は題材によって変わらない | Cox & Griggs 1982 の実験1では、同じ論理構造の4枚カード課題が、記号だと48人中2人(4%)、飲酒年齢の規則だと48人中36人(75%)だった。228の実験を集めた2017年の集計でも、抽象の19%に対し、守らなければならない決まりの形では64%である。論理の形は同じで、動いたのは中身だけだった |
| 抽象的だと解けないのだから、身近で具体的な例に置き換えれば解けるようになる | Griggs & Cox 1982 は2つの実験で主題化の効果を再現できなかった。有名だった郵便料金の規則の版は、その規則を経験していない米国の学生では効いていない。逆に Cheng & Holyoak 1985 は、内容が抽象的でも許可の形にすると成績が上がることを示した。効いているのは具体性ではなく、その規則を違反がないか点検する側に回った経験である |
| 論理の訓練を積めば、結論の内容に引きずられなくなる | Evans, Barston & Pollard 1983 の実験1では、前提から必然的に導かれるかだけを判定せよという教示のもとで、結論が信じられる内容のとき妥当な三段論法も妥当でない三段論法も同じ92%の割合で受け入れられた。加えて、設計資料にあった「演繹の訓練で論理的矛盾検出能力が向上」という主張は、探しても査読論文にたどり着けなかった |
演繹には、道具として実にありがたい性質がある。結論が形式的に整うので、書いた本人にも読む人にも、正しく見えるのだ。会議で使えば場が静かになるし、資料に書けば反論されにくい。皮肉なのは、その静けさが、前提の点検が済んだ証拠ではなく、前提の点検が始まらなかった証拠だということである。1983年の実験の参加者たちは、結論に納得したとき、妥当なものと妥当でないものを同じ割合で受け入れた。彼らは前提を見ていない。見る必要がなかったからだ。
Q1. 米国・1982年の実験では、同じ論理構造の4枚カード課題を飲酒年齢の規則として最初に出したとき48人中 ____ 人が正解し、記号の課題として最初に出したときは48人中 ____ 人だった。228の実験を集めた2017年の集計でも、抽象的な記号の104の実験では ____%、守らなければならない決まりの形の80の実験では64%である。穴埋め
Q2. Evans, Barston & Pollard が1983年に発表した実験1(英国・24人)では、結論が信じられる内容のとき、妥当な三段論法の受容率は92%、妥当でない三段論法の受容率は ____% だった。結論が信じられない内容になると、妥当なものは ____%、妥当でないものは8%まで落ちた。穴埋め
Q3. 「抽象的だと解けないのだから、身近で具体的な例に置き換えれば解ける」——本文はこの言い方をどの2つの研究で退けているか。それぞれが示したことを1文ずつ書け。一問一答
Q4. Wason が1968年に発表した4枚カード課題について、本文の内容に合うものはどれか。選択
Q5. 設計資料にあった「演繹の訓練で論理的矛盾検出能力が向上」という主張を、本文はどう扱っているか。選択
紙でもメモアプリでもよい。最近1週間で自分が下した判断を1件だけ選ぶ。買った・買わなかった、引き受けた・断った、先にやった・後回しにした——小さいもので構わない。それを2行に書き直す。1行目は「前提:」で始め、その判断のもとにある事実だと自分が思っていることを1つだけ書く。2行目は「結論:」で始め、実際に下した判断を書く。書けたら、1行目の前提が偽だったと仮定して、2行目の結論も崩れるかどうかに○か×を付ける。○なら、その結論はその前提に支えられている。×なら、その結論は別のどこかから来ているので、その別のどこかを一言だけ足す。他人に見せる必要はなく、誰かに何かを尋ねる必要もない。
——とはいえ、その“正しい用法・用量”は、まだ誰も知らない。ここまでの研究に、あなたのデータは1件も入っていないからだ。平均は地図にすぎない。自分の“いい具合”は、試して探すしかない。
あなたの実験(N=1)を始める → プロジェクトに追加(記録機能は準備中)
- Wason P.C. (1968) 'Reasoning about a rule', Quarterly Journal of Experimental Psychology 20(3):273-281 — journals.sagepub.com
- Ragni M., Kola I., Johnson-Laird P.N. (2017) 'The Wason Selection Task: A Meta-Analysis', Proceedings of the 39th Annual Conference of the Cognitive Science Society — escholarship.org
- Cox J.R., Griggs R.A. (1982) 'The effects of experience on performance in Wason's selection task', Memory & Cognition 10(5):496-502 — link.springer.com
- Griggs R.A., Cox J.R. (1982) 'The elusive thematic-materials effect in Wason's selection task', British Journal of Psychology 73(3):407-420 — eric.ed.gov
- Cheng P.W., Holyoak K.J. (1985) 'Pragmatic reasoning schemas', Cognitive Psychology 17(4):391-416 — www.sciencedirect.com
- Evans J.St.B.T., Barston J.L., Pollard P. (1983) 'On the conflict between logic and belief in syllogistic reasoning', Memory & Cognition 11(3):295-306 — link.springer.com