動詞を1つ差し替えただけで、目撃者の答えた速度が時速9マイル動いた
同じ事故の映像を見た人たちに、車の速度を尋ねる。質問文のうち、動詞だけを差し替える。それだけで、返ってくる数字が動く。動いたのは記憶ではない。記憶を測るのに使った物差しのほうである。
言葉を決めることは、判断を決めること
意味という道具は、ある語がどこからどこまでを指しているかを、判断の前に書き留めるためのものである。よくある説明では、これは議論の前準備ということになっている。用語をそろえてから中身に入りましょう、というあれである。
この単位は、その位置づけを取らない。言葉は、意味を運ぶ器ではない。判断を作る道具である。だから定義は、相手と合意するために書くのではなく、自分が何を測っているかを固定するために書く。
根拠は、言葉を1語だけ差し替えて、判断がどれだけ動くかを測った実験の積み重ねにある。
「激突した」と「接触した」
米国で1974年に Journal of Verbal Learning and Verbal Behavior へ出た実験は、この分野でいちばん有名な1本である。45人の学生に、5秒から30秒の交通事故の映像を7本見せる。見終わったあと、事故の様子を書かせ、質問に答えさせる。全員に同じ質問をするが、1語だけ違う。「車どうしが◯◯したとき、どれくらいの速さで走っていましたか」の◯◯に、激突した・衝突した・ぶつかった・当たった・接触したのいずれかが入る。動詞ごとに9人ずつである。
返ってきた平均速度は、動詞の順に 40.5、39.3、38.1、34.0、31.8 マイル毎時だった。上と下で8.7マイル毎時ひらいている。映像は同じである。実際の衝突は時速20、30、40、40マイルで撮られていた。
同じ論文の2つめの実験は、もう一歩進む。150人の学生を3群に分け、1つめには激突したという語で速度を尋ね、2つめには当たったという語で尋ね、3つめには尋ねない。1週間後、全員に「割れたガラスを見ましたか」と聞く。映像に割れたガラスは映っていない。見たと答えたのは、激突した群で50人中16人、当たった群で50人中7人、尋ねなかった群で50人中6人だった。
1語の違いが、1週間後の記憶の中身を変えている。ここで起きているのは、語が判断を運んだのではなく、語が判断を作ったということだ。
見なかったものを、見たと答える
同じ研究者が1975年に Cognitive Psychology へ出した論文には、もっと露骨な形が載っている。150人に自動車事故の映像を見せ、片方の群にだけ「白いスポーツカーが田舎道を走って納屋を通り過ぎたとき、どれくらいの速さでしたか」と尋ねる。映像に納屋は無い。1週間後に「納屋を見ましたか」と聞くと、この群では17.3%が見たと答えた。尋ねなかった群では2.7%である。
同じ年に Bulletin of the Psychonomic Society へ出た短い報告は、さらに細かい。日本語には現れないが、英語には存在を前提にした冠詞の選択がある。前提を含む言い方で尋ねると、分からないという答えが減り、実際には無かったものを見たという答えが増えた。冠詞1つである。
日本語にも同じ仕掛けはある。「例の件、どうなりましたか」と「例の件、まだ止まっていますか」は、同じことを聞いていない。後者は止まっていることを前提にしている。前提は、質問の中に隠れて運ばれる。
値切り:定義を先に決めれば議論が進む、を探しにいく
実務でよく言われるのは、議論がすれ違うのは言葉の定義が曖昧だからで、先に定義をそろえれば議論は進む、という主張である。この主張は、ある一般書に帰属した形で流通している。
そこで、これを検証した一次情報を探した。心理学・言語学・コミュニケーション研究の学術データベース、および学術検索で、定義の事前の合意、用語の統一、議論や交渉の成否といった語を組み合わせて当たった。結果変数を、合意までの時間、結論の質、参加者の満足のどれに置いても探した。たどり着けなかった。
存在しないと断定はしない。ただ、定義をそろえると議論が進む、という効果を測った査読された検証には行き当たらなかった。行き当たったのは、その逆に近いものである——語を1つ変えるだけで判断が動く、という実験が山のようにある。つまり測られているのは「定義をそろえると合意する」ではなく「語を変えると答えが変わる」のほうだ。
この違いは小さくない。前者が正しければ定義は会議の冒頭でやる作業になり、後者が正しければ自分の手元でやる作業になる。この単位は後者を採る。
意味の幅は、勝手に動く
もう一つ、定義を合意で固定しようとする構えを崩す結果がある。米国で2018年に Science へ出た研究は、ある語が指す範囲が、その語に当てはまるものの多さによって勝手に動くことを示した。
最初の実験はごく単純だ。参加者21人に、紫から青まで連続的に変化する点を1,000個、1つずつ見せて、青か青でないかを答えさせる。途中から、青い点の出現率を半分から6%まで下げる。すると参加者は、それまで青でないと答えていた紫寄りの点を、青と答えるようになった。青の定義は誰にも変えられていない。青が減ったから、青の範囲が広がったのである。
同じ形は、点よりずっと意味の重い判断でも出た。48人に顔を見せて脅威を感じるかを判定させる課題でも、84人に研究計画の書類を見せて倫理的に問題があるかを判定させる課題でも、該当するものが減ると判定の基準のほうが広がった。統計はそれぞれ b=4.84、z=5.61 と b=5.10、z=4.98、いずれも p<.001 である。
これは、定義を会議で決めても長持ちしない理由になる。合意した瞬間の意味の幅は、その語に当てはまる事例が減っただけで広がる。品質の基準も、遅れという語も、同じことをする。
定義は、数を作る
定義が判断を動かすことの、いちばん分かりやすい実例は公的な統計にある。日本の労働力調査では、完全失業者は3つの条件をすべて満たす人と決められている。仕事がなくて調査週間中に少しも仕事をしなかったこと。仕事があればすぐ就くことができること。そして、調査週間中に仕事を探す活動や事業を始める準備をしていたこと。総務省統計局の用語の解説にそう書いてある。
三つめの条件があるので、働きたいが探すのをやめている人は失業者に数えられない。数えられない人は非労働力人口に入る。数字が嘘だという話ではない。定義がその数字を作っている、という話である。
目盛りの置き方でも同じことが起きる。1985年に Public Opinion Quarterly へ出た調査実験は、1日にテレビを見る時間を尋ねるとき、選択肢の目盛りを低い側に寄せた場合と高い側に寄せた場合とで回答が変わることを示した。同じ人の同じ行動が、器の目盛りに合わせて申告される。
だから「この語を、この判断の中でどう数えるか」を先に書いておくことには、合意とは別の値打ちがある。書いておくと、あとで自分がどこを測っていたかが分かる。
二人が、同じ語で別の帯を指している
すれ違いの多くは、二人が同じ語を使いながら、その語の帯の別の場所を指していることから生まれる。「早めに」は、片方には今日中を意味し、もう片方には今週中を意味する。「ほぼ完成」は、片方には残り1割を、もう片方には見せられる状態を意味する。
大事なのは、この道具の使い方が相手の定義を正すことではない点である。会話のすれ違いの扱いは友達の棚と恋愛と結婚の棚の持ち場で、ここは踏み込まない。やるのは、自分の帯を書き出し、相手の帯を推定して並べることだけだ。並べた時点で、その語を使い続けるか数で言い換えるかを自分で選べる。
時間・変化:語は、いつずれるか
語のずれは、最初からあるとは限らない。三つの時点で生まれる。
第一に、使い始めた直後。新しい語が持ち込まれた時期は、誰もが自分の経験に引き寄せて解釈する。このずれがいちばん大きく、そしていちばん指摘されない。
第二に、該当する事例が減ったとき。2018年の研究が測ったのはここである。不具合が減ると、不具合と呼ぶ範囲が広がる。範囲が広がったことは、広げた本人には見えない。
第三に、人が入れ替わったとき。語は引き継がれるが、その語が何を排除するために作られたかは引き継がれない。残るのは語だけで、境界は消える。
だから定義は、書いた日にいちばん正確で、翌日から薄くなる。薄くなるのを止める方法は無い。あるのは気づく方法だけで、それは、数で言い換えられるかを時々試すことである。
妨げるもの、助けるもの、最初の一歩
妨げるものの筆頭は、定義を会議の議題にすることだ。言葉の定義から始めましょう、という提案は、たいてい中身の議論を先送りする効果しか持たない。しかも先送りしているあいだに、語の帯はまた動く。
第二の妨げは、辞書の意味を持ち出すことである。辞書は、その語が世間でどう使われてきたかの記録であって、いま自分が何を測ろうとしているかは書いていない。
標本の偏りも断っておく。ここまでの証拠は、米国とドイツの大学生や、オンラインで集められた成人を対象にした実験室課題で採られている。実験室で数分の課題として測られたものが、締切のある本物の判断にそのまま当てはまるとは限らない。1974年の実験は、事故を目撃したのではなく事故の映像を見た人たちの結果である。日本語での追試もほとんど見当たらない。数字は方向だけ持ち帰るのが誠実である。
助けるのは、語を数に言い換えてみることだ。早めに、を、今日の18時まで、と書き換えられるかを試す。書き換えられない語は、まだ判断に使える形になっていない。
最初の一歩は5分。直近の会話で使った抽象的な語を1つ選ぶ。自分がその語で指していた範囲を1行で書く。相手が指していそうな範囲を1行で書く。並べるだけでよい。相手に確かめに行く必要はない。
次の単位は 183「証拠」——意味が、使っている語がどこまでを指すかを固定する道具なら、こちらは、手元にある材料が互いに独立しているかを見る道具である。引き出しは隣にあり、どちらから開けてもよい。
- Loftus & Palmer 1974(Journal of Verbal Learning and Verbal Behavior 13(5):585-589)の第1実験は、45人の学生に同じ交通事故の映像7本を見せ、動詞だけを差し替えて速度を尋ねた。平均推定速度は激突した40.5、衝突した39.3、ぶつかった38.1、当たった34.0、接触した31.8マイル毎時。動詞ごとに9人ずつで、上下の差は8.7マイル毎時である
- 同じ論文の第2実験では、150人を3群に分け、1週間後に「割れたガラスを見ましたか」と尋ねた。映像に割れたガラスは無い。見たと答えたのは、激突したという語で尋ねた群で50人中16人、当たったという語の群で50人中7人、速度を尋ねなかった群で50人中6人だった
- Loftus 1975(Cognitive Psychology 7(4):560-572)の第3実験では、150人のうち、存在しない納屋を前提に含む質問を受けた群の17.3%が1週間後に納屋を見たと答えた。前提を含まない群では2.7%だった。Loftus & Zanni 1975(Bulletin of the Psychonomic Society 5(1):86-88)は、存在を前提にした冠詞で尋ねると、分からないという答えが減り、無かったものを見たという答えが増えることを示した
- 「定義を先に決めれば議論が進む」という主張を検証した一次情報を、心理学・言語学・コミュニケーション研究の学術データベースおよび学術検索で、定義の事前合意・用語の統一・議論や交渉の成否を、合意までの時間・結論の質・満足のいずれの結果変数と組み合わせても探したが、たどり着けなかった。行き当たるのは逆向きの結果——語を1つ変えると判断が動く、という実験のほうである
- Levari et al. 2018(Science 360(6396):1465-1467)は、参加者21人に紫から青までの点を1,000個判定させ、青い点の出現率を半分から6%へ下げると、それまで青でないと答えていた点を青と答えるようになることを示した。脅威を感じる顔の判定(48人、b=4.84、z=5.61)でも、倫理的に問題のある研究計画の判定(84人、b=5.10、z=4.98)でも同じ形が出た。いずれも p<.001
- 日本の労働力調査では、完全失業者は3条件をすべて満たす人と決められている——仕事がなくて調査週間中に少しも仕事をしなかった/仕事があればすぐ就くことができる/調査週間中に仕事を探す活動や事業を始める準備をしていた(総務省統計局「労働力調査 用語の解説」)。三つめの条件があるため、働きたいが探すのをやめている人は失業者に数えられない。定義が数字を作っている
- Schwarz, Hippler, Deutsch & Strack 1985(Public Opinion Quarterly 49(3):388-395)は、1日にテレビを見る時間を尋ねるとき、選択肢の目盛りを低い側に寄せるか高い側に寄せるかで回答が変わることを示した。同じ人の同じ行動が、器の目盛りに合わせて申告される
| よくある誤解 | 実際のところ |
|---|---|
| 議論がすれ違うのは定義が曖昧だからで、先に定義をそろえれば議論は進む | この主張を検証した一次情報を、心理学・言語学・コミュニケーション研究の学術データベースと学術検索で、結果変数を変えながら探したが、たどり着けなかった。行き当たるのは逆向きの結果である——語を1つ変えるだけで判断が動く実験は山のようにある。測られているのは「定義をそろえると合意する」ではなく「語を変えると答えが変わる」のほうだ。だから定義は、会議の冒頭ではなく自分の手元でやる作業になる |
| 一度みんなで決めた定義は、その先しばらく共有され続ける | Levari et al. 2018 は、語が指す範囲が、その語に当てはまるものの多さによって勝手に動くことを示した。青い点の出現率を半分から6%へ下げると、それまで青でないと答えていた点が青になる。顔の脅威の判定でも、研究計画の倫理の判定でも同じ形が出た。合意した瞬間の意味の幅は、該当する事例が減っただけで広がる。広がったことは、広げた本人には見えない |
| 言葉づかいを変えても、事実の記憶そのものは変わらない | Loftus & Palmer 1974 の第2実験では、激突したという語で速度を尋ねられた群の50人中16人が、1週間後に、映像に無かった割れたガラスを見たと答えた。当たったという語の群では50人中7人、尋ねなかった群では50人中6人である。Loftus 1975 では、存在しない納屋を前提に含む質問を受けた群の17.3%が納屋を見たと答えた(前提のない群は2.7%) |
定義から始めましょう、という提案には、たいへん都合のよい性質がある。誰も反対できず、時間を使え、しかも中身の議論を先送りできる。皮肉なのは、その会議が終わるころには、決めた語の帯がもう少し動いていることだ。品質という語は、不具合が減った週にだけ厳しくなる。早めに、という語は、忙しい人の口の中でだけ短くなる。定義は、合意しても保たない。手元に書いておくと、保たなかったことだけは分かる。
Q1. Loftus & Palmer 1974 の第1実験では、45人の学生に同じ事故の映像を見せ、動詞だけを差し替えて速度を尋ねた。平均推定速度は、激突した ____ マイル毎時、接触した ____ マイル毎時で、その差は ____ マイル毎時だった。穴埋め
Q2. Loftus & Palmer 1974 の第2実験では、150人を3群に分け、1週間後に映像に無かった割れたガラスを見たかを尋ねた。見たと答えたのは、激突したという語で尋ねた群で50人中 ____ 人、当たったという語の群で50人中 ____ 人、速度を尋ねなかった群で50人中 ____ 人だった。穴埋め
Q3. Levari et al. 2018 は、参加者21人に紫から青までの点を1,000個判定させ、途中で青い点の出現率を半分から ____ % まで下げた。すると参加者は、それまで青でないと答えていた点を ____ と答えるようになった。同じ形は、脅威を感じる顔の判定(48人)と、____ に問題のある研究計画の判定(84人)でも出た。穴埋め
Q4. 「定義を先に決めれば議論が進む」という主張について、本文はどこをどう探して何が分かったと書いているか。あわせて、代わりに何が測られていると書いているかを答えよ。一問一答
Q5. 日本の労働力調査における完全失業者の定義について、本文の内容に合うものはどれか。選択
直近1週間の会話やメッセージのやりとりから、抽象的な語を1つ選ぶ(早めに、ちゃんと、だいたい、優先度が高い、品質、忙しい、ほぼ完成、前向きに検討、など)。紙かメモアプリに2行書く。1行目は、自分がその語で指していた範囲を、できれば数か日付で(たとえば、早めに=今日の18時まで)。2行目は、相手が指していそうな範囲を、同じく数か日付で(たとえば、早めに=今週中)。数で書けなければ、書けないと書いてよい。書けないと分かること自体が結果である。相手に確かめに行く必要はないし、相手の使い方を正す必要もない。誰にも見せない。組織に所属していない場合は、店・窓口・家族とのやりとり、あるいは自分が自分に言った語(そろそろ、ちゃんと、など)を選んで同じ2行を書く。
——とはいえ、その“正しい用法・用量”は、まだ誰も知らない。ここまでの研究に、あなたのデータは1件も入っていないからだ。平均は地図にすぎない。自分の“いい具合”は、試して探すしかない。
あなたの実験(N=1)を始める → プロジェクトに追加(記録機能は準備中)
- Loftus E.F., Palmer J.C. (1974) 'Reconstruction of Automobile Destruction: An Example of the Interaction Between Language and Memory', Journal of Verbal Learning and Verbal Behavior 13(5):585-589 — www.demenzemedicinagenerale.net
- Loftus E.F. (1975) 'Leading questions and the eyewitness report', Cognitive Psychology 7(4):560-572 — app.nova.edu
- Loftus E.F., Zanni G. (1975) 'Eyewitness testimony: The influence of the wording of a question', Bulletin of the Psychonomic Society 5(1):86-88 — link.springer.com
- Levari D.E., Gilbert D.T., Wilson T.D., Sievers B., Amodio D.M., Wheatley T. (2018) 'Prevalence-induced concept change in human judgment', Science 360(6396):1465-1467 — dtg.sites.fas.harvard.edu
- Schwarz N., Hippler H.-J., Deutsch B., Strack F. (1985) 'Response Scales: Effects of Category Range on Reported Behavior and Comparative Judgments', Public Opinion Quarterly 49(3):388-395 — academic.oup.com
- 総務省統計局「労働力調査 用語の解説」(発行年の記載なし。2026年8月に本文を確認) — www.stat.go.jp