「現場に任せれば自ら律する」——だが自己評価は系統的に甘い。自己点検は外部照合とセットで回す
現場に近い人が、自分たちで守れているかを自分でチェックする——手が届いて、負担も軽い。任せられるなら、それがいちばんだ。だが実証が示すのは、人の自己評価が系統的に甘くなるということ。だから自己点検は、出発点にはなるが、外からの照合とセットにしてはじめて回る。これは現場を信用するなという話ではない。誰にでもある自己評価の癖を、仕組みで補う話だ。この単位は、任せつつ任せきりにしない見方を渡す。
前の単位から、この単位へ
前の単位では、規程を「効くもの」に絞ることを扱った。ここでは、そのルールの運用を、現場自身の自己点検にどこまで委ねられるかを扱う。現場に近い人が、自分たちで守れているかを自分でチェックする——手が届いて、負担も軽く、現場の実情にも合う。任せられるなら、それがいちばんだ。だが、任せきれるだろうか。自分で自分を採点するとき、見落としの落とし穴はないだろうか。
現場の自己点検には、名前がある。CSA(統制自己評価)——現場が、自分たちの統制(ルールや手続きがきちんと働いているか)を、自分で評価する手法のことだ。上から監査が来るのでなく、現場が自分でチェックシートを埋める、あの形だ。現場をいちばんよく知るのは現場なのだから、理にかなって見える。だから「現場に任せれば、自ら律する」——そう考えたくなる。だが、この単位が立てる見方はこうだ——自己評価は、系統的に甘くなる。だから、自己点検は出発点にはなるが、外からの照合とセットにして、はじめて回る。 これは、現場を信用するなという話ではない。人の自己評価には誰にでも共通の癖があり、その癖を仕組みで補う、という話だ。ここでほどく言葉を置く。自己点検とは、自分(や自部門)のことを自分で確かめること。外部照合とは、その確かめを、別の目(内部監査や第三者)が突き合わせることだ。
「自ら律する」——だが、自己評価は甘くなる
まず、人の自己評価がどれくらい当てになるかを見る。Dunning と Heath と Suls が2004年に、健康・教育・職場にわたって、人が自分をどう評価するかの研究を広く総覧した。見えたのは、人の自己評価は、しばしば実際より過大に偏るという一貫した傾向だった。自分の出来を、平均より上だと感じる人が、実際の分布よりずっと多い。しかもこの過大評価は、いちばん苦手な人ほど大きくなりやすい。苦手なことは、自分が苦手だと気づく力さえ、まだ育っていないからだ。
Sheldon と Dunning と Ames が2014年には、能力の低い側ほど自己評価が過大になるだけでなく、それを正すフィードバックへの関心まで低いことを示している。苦手なうえに、直す手がかりにも興味が向きにくい。Ackerman と Beier と Bowen も2002年に、人が自分の能力や知識について抱く評価と、客観的な測定との食い違いを実証した。これは、性格の問題ではない。誰の中にもある、自己評価の構造的な癖である。まじめであるほど「ちゃんとやっている」という自己像を持ちやすく、その像が点検の目を曇らせる。だから、「うちの現場はちゃんとしているから大丈夫」という自己申告は、その真偽以前に、過大な側へ傾きやすい前提で受け取る必要がある。自己点検の結果が「問題なし」だったとき、本当に問題がないのか、それとも問題に気づけていないのか——この二つは、自己申告だけでは区別がつかない。見えていないものは、見えていないと気づけない——それが、自己点検のいちばんの弱点だ。
自己評価の正しさは、条件でばらつく
とはいえ、自己評価がいつも当てにならない、というわけでもない。Falchikov と Boud が1989年に、学生が自分の学習成果を自己評価した多数の研究を束ねて分析し、自己評価が実際とどれくらい合うかは、条件によって大きくばらつくことを示した。うまく設計された場面では、自己評価はそれなりに正確になる。逆に、基準が曖昧だったり利害が絡むと、ずれは大きくなる。
Panadero と Brown と Strijbos も2016年に、自己評価研究の全体を見渡し、条件を整えれば自己評価は学びの道具として改善しうると総括している(教育研究の知見である点は断っておく)。この「条件しだい」は、CSAの設計にそのまま効いてくる。自己点検を、ただ「できていますか」と問うだけなら、答えは甘い側に流れる。だが、何をもって「できている」とするかの基準を、あらかじめ具体的に決めておけば、自己点検の精度は上がる。「記録が残っているか」など、事実で答えられる問いにすれば、印象で答える余地が減る。つまり、自己評価の甘さは、宿命ではなく、設計で減らせる部分がある。丸投げの「ちゃんとできていますか」は甘くなり、基準を与えた「この事実はあるか」は、いくらか締まる。同じ自己点検でも、問い方一つで、返ってくる正直さが変わる。
CSAの効果を測った実証は、薄い
そもそも Sitzmann たちが2010年に、自己評価は「どれだけ身についたか」の測定としては妥当性が低く、むしろ本人の満足や感情に近いものを測っていると、多くの研究を束ねて示している。自己点検の「できている」が、実力でなく安心を映すなら、なおさら外の目が要る。では、CSAという手法そのものは、どれくらい効くのか。ここで、正直に言っておくべきことがある。CSA(統制自己評価)が実際にどれだけ有効かを、きちんと測った研究は、驚くほど乏しい。 内部監査の実務では広く使われる手法だが、「導入したら統制がこれだけ良くなった」という確かな実証の蓄積は、薄いのが現状だ。
薄い、というのは、効かないという意味ではない。ただ、効くと確かめられてもいない、ということだ。だからこそ、CSAは「やれば安心」の道具としてではなく、あくまで自己評価の甘さという既知の癖を抱えた出発点として、慎重に扱う。導入したこと自体を成果と取り違えると、点検している「つもり」だけが積み上がる。手法の名前がついていることと、その手法が効くと証明されていることは、別である——この棚が16回くり返してきた見方が、ここにも当てはまる。
だから、自己点検+外部の照合で回す
自己評価は甘く、CSAの実証は薄い。ならば自己点検は無駄かというと、そうではない。自己点検は、いちばん現場を知る人が、いちばん早く異変に気づける仕組みでもある。捨てるにはもったいない。要は、甘さを承知で、外からの照合と組み合わせることだ。自己点検が「問題なし」と言った箇所を、時々、内部監査や別部門の人が突き合わせる。ずれが見つかれば、そこに自己評価の癖が出ている。
大事なのは、これを「現場を疑う」監視にしないことだ。狙いは、犯人を探すことではなく、誰にでもある自己評価の甘さを、仕組みで補うことにある。もし照合が粗探しになれば、現場は正直に書かなくなり、甘さはむしろ厚くなる。だから照合は、罰でなく学びのために回す。自己点検で見えなかったものが外の目で見えたなら、それは現場の落ち度でなく、自己点検の設計に足すべき一項目が見つかった、ということだ。外の目は、社外の専門家でなくていい。別部門の人に持ち回りで見てもらうだけでも、身内で当たり前になって見えなくなったものが浮かび上がる。前の単位で見た「常態化」も、外の目には引っかかりやすい。自分で見て、他人にも見てもらう。 その二重の目が、現場に任せつつ、任せきりにしない統治になる。
時間・変化:1989年から今へ
順に置く。1989年、Falchikov と Boud が、学生の自己評価の正確さが条件で大きくばらつくことを、多数の研究を束ねて示す。2004年、Dunning と Heath と Suls が、健康・教育・職場にわたって、人の自己評価がしばしば過大に偏ることを総覧する。そして現在、内部監査の実務でCSAが広く使われる一方で、その効果を直接に測った実証は、依然として薄いままである。
この間に確からしくなったのは、「現場に任せれば自ら律する」という因果ではない。確からしくなったのは、自己評価は系統的に甘くなり、その正確さは条件でばらつき、CSAの効果の実証は薄い——だから自己点検は外部照合とセットで回す、という慎重な見方のほうである。研究の舞台は学生や職場の評価が多いが、自分で自分を評価すると甘くなるという癖は、統制の自己点検にもそのまま持ち込まれる。人が自分を見る構造は、場面が変わっても、そう変わらない。
妨げるもの、助けるもの、最初の一歩
妨げるものの筆頭は、自己点検の「問題なし」を、そのまま「問題がない」と受け取ることである。甘い側へ傾きやすい自己申告を、額面どおりに信じると、気づけていない問題を、気づけないまま抱え込む。しかも「自分たちで点検している」という事実が、かえって安心を生む。点検しているのに気づけない、というのが、いちばん危うい状態だ。もう一つの妨げは、逆に自己点検を疑って、外部の監視でがんじがらめにすること。それでは現場は、点検を「やらされる粗探し」と感じ、正直に書かなくなる。監視を強めるほど本音は隠れる。甘さを補う照合が甘さを増やすのでは、本末転倒だ。
助けになるのは、自分(や自部門)の自己点検を一つ取り、「他の人が見ても、同じ評価になるか」を確かめる設計を、書き足してみることだ。最初の一歩は10分。自分が「できている」と思っている統制や手続きを一つ選ぶ。そして、その「できている」を、誰か別の人がどう確かめられるか——どんな記録や事実があれば第三者にも「できている」と分かるか——を書き出す。証拠を挙げられないなら、それは「できている」ではなく「できているつもり」かもしれない。つもりを一つ見つけるたび、自己点検は本物に近づく。自分で見て、他人にも見てもらえる形にする。 それが、甘さを設計で補う最初の一歩になる。
次の単位は 556「グループ会社を統治するには?」——一つの組織の中の自己点検から、複数の会社にまたがるグループ全体の統治へと、視野を広げる話へ進む。
- この単位はSTEP3(橙・運用と検証)で、ルールの運用を現場自身の自己点検にどこまで委ねられるかを扱う。CSA(統制自己評価)は現場が自分たちの統制を自分で評価する手法。中心命題は自己評価は系統的に甘くなるので自己点検は出発点にはなるが外からの照合とセットにしてはじめて回ること。現場を信用するなでなく、人の自己評価には誰にでも共通の癖があり、その癖を仕組みで補うという話
- 自己評価は甘くなる。Dunning・Heath・Suls 2004は健康・教育・職場にわたって人が自分の能力や成績をどう評価するかを総覧し、自己評価がしばしば実際より過大に偏る一貫した傾向を示した。過大評価はいちばん苦手な人ほど大きく、苦手なことは自分が苦手だと気づく力さえ育っていない。Sheldon-Dunning-Ames 2014は能力の低い側ほど自己評価が過大でフィードバックへの関心も低いと示し、Ackerman-Beier-Bowen 2002は自己評価と客観測定の食い違いを実証した。これは性格でなく誰の中にもある構造的な癖
- 問題なしの自己申告は、本当に問題がないのか気づけていないのか、自己申告だけでは区別がつかない。うちの現場はちゃんとしているという自己申告は、真偽以前に過大な側へ傾きやすい前提で受け取る。額面どおり信じると、気づけていない問題を気づけないまま抱え込む
- 自己評価の正しさは条件でばらつく。Falchikov & Boud 1989は学生が自分の学習成果を自己評価した多数の研究を束ね、自己評価が実際とどれくらい合うかは条件で大きくばらつくと示した。うまく設計された場面ではそれなりに正確になり、基準が曖昧だったり利害が絡むとずれが大きくなる。何をもってできているとするかの基準をあらかじめ具体的に決めておけば精度は上がり、甘さは宿命でなく設計で減らせる部分がある
- CSAの効果を測った実証は薄い。CSAが実際にどれだけ有効かをきちんと測った研究は乏しく、内部監査の実務で広く使われる手法だが導入で統制がこれだけ良くなったという確かな実証の蓄積は薄い。薄いは効かないでなく効くと確かめられてもいないという意味で、CSAはやれば安心の道具でなく自己評価の甘さという既知の癖を抱えた出発点として慎重に扱う。手法の名がつくことと効くと証明されることは別
- だから自己点検+外部の照合で回す。自己点検はいちばん現場を知る人がいちばん早く異変に気づける仕組みで捨てるにはもったいない。甘さを承知のうえで外からの照合(内部監査・持ち回りの別部門・第三者)と組み合わせ、問題なしと言った箇所を時々突き合わせる。これを現場を疑う監視にせず、罰のためでなく学びのために回す。自己点検で見えなかったものが外の目で見えたら、それは現場の落ち度でなく自己点検の設計に足すべき一項目が見つかったということ
- 確からしくなったのは現場に任せれば自ら律するという因果でなく、自己評価は系統的に甘くなりその正確さは条件でばらつきCSAの効果の実証は薄いという事実。だからこの単位でやるのは、自分ができていると思う統制を一つ選び、そのできているを誰か別の人がどうやって確かめられるか(どんな記録や事実があれば第三者にも分かるか)を書き出すことである
| よくある誤解 | 実際のところ |
|---|---|
| 現場に任せて自己点検させれば、自分たちのことは自分たちがいちばん分かっているので律せる | 人の自己評価は系統的に甘くなる。Dunning・Heath・Suls 2004は健康・教育・職場にわたって、自己評価がしばしば実際より過大に偏り、とくに苦手な人ほど過大評価が大きいことを総覧した。苦手なことは自分が苦手だと気づく力さえ育っていない。だから『うちの現場はちゃんとしている』という自己申告は、その真偽以前に過大な側へ傾きやすい前提で受け取る。自己点検の『問題なし』が、本当に問題がないのか気づけていないのかは、自己申告だけでは区別がつかない |
| 自己評価はどうせ当てにならないのだから、現場の自己点検には意味がない | Falchikov & Boud 1989は、自己評価が実際と合う度合いが条件で大きくばらつき、基準が具体的なら正確になり、曖昧だったり利害が絡むとずれることを示した。つまり甘さは宿命でなく、何をもってできているとするかの基準をあらかじめ決めれば精度は上がる。自己点検はいちばん現場を知る人がいちばん早く異変に気づける仕組みで捨てるにはもったいない。要は甘さを承知で外部照合と組み合わせ、丸投げの自己点検は甘く基準を与えた自己点検はいくらか締まる |
| CSA(統制自己評価)を導入しさえすれば、統制はきちんと働くようになる | CSAが実際にどれだけ有効かをきちんと測った研究は乏しい。内部監査の実務で広く使われる手法だが、導入で統制がこれだけ良くなったという確かな実証の蓄積は薄い。薄いは効かないでなく効くと確かめられてもいないという意味で、CSAはやれば安心の道具でなく、自己評価の甘さという既知の癖を抱えた出発点として扱う。手法の名がつくことと効くと証明されることは別で、自己点検の問題なしは外の目(内部監査・持ち回りの別部門)で時々突き合わせ、監視でなく学びのために回す |
皮肉なのは、自己点検が『問題なし』と告げたときほど、安心してしまうことである。だが、その安心が危うい。人の自己評価は、誰の中にもある構造的な癖として、過大な側へ傾く。とくに苦手なことほど、苦手だと気づく力さえ育っていないから、見落としは見落としのまま残る。しかも、CSAという手法が実際に統制を良くすると直接に測った実証は、驚くほど薄い。手法の名がついていることは、それが効く証明ではない。だからといって、現場の自己点検を捨てるのはもったいない——いちばん現場を知る人が、いちばん早く異変に気づけるのだから。要は、その甘さを承知のうえで、外からの照合とセットで回すことだ。ただし、それを現場を疑う監視にしてはいけない。監視を強めるほど、本音は隠れ、正直な点検はできなくなる。自己点検が『大丈夫』と約束しているように見えるとき、たいていそれは、まだ誰も、その『できている』を、自分以外の目で確かめていないだけかもしれない。この単位は、現場を疑う単位ではない——自分で見て、他人にも見てもらう、その二重の目で、任せつつ任せきりにしない統治を持つための単位である。次の単位は 556「グループ会社を統治するには?」——一つの組織の中の自己点検から、複数の会社にまたがるグループ全体の統治へと、視野を広げる話へ進む。
Q1. この単位の中心命題——自己評価は系統的に ____ なる。だから自己点検は出発点にはなるが、外からの ____ とセットにしてはじめて回る。狙いは監視でなく、自己評価の癖を ____ で補うことだ。穴埋め
Q2. Dunning・Heath・Suls 2004 が総覧して示した、人の自己評価の傾向として正しいものはどれか。選択
Q3. 『CSA(統制自己評価)を導入しているのだから統制は大丈夫だ』という考えに対し、この単位が示す注意を、実証の状況を含めて述べよ。一問一答
Q4. Falchikov & Boud 1989 の『条件でばらつく』という知見は、CSAの設計にどんな含みを持つか。自己点検と外部照合の関係とともに述べよ。一問一答
Q5. 現場の自己点検を『甘さを補う設計』にするための手順を、この単位に沿って早い順に並べよ。(ア)自己点検が『できている』とした箇所を外の目が突き合わせる(イ)何をもって『できている』とするかの基準を具体的に決める(ウ)ずれた箇所を自己点検の設計に足す一項目として学びに回す(エ)現場が基準に沿って自分で点検する並べ替え
紙かメモアプリに今日の日付を書く。次に、自分(や自部門)が『できている』と思っている統制・手続き・ルールを一つ選ぶ(決裁の確認、記録の付け方、安全の点検など、自分が関わるものでよい)。それについて、三つを書く——(1) 何をもって『できている』とするか、その基準を具体的に一文で書く、(2) その『できている』を、自分以外の誰かがどうやって確かめられるか(どんな記録を見れば、どんな事実があれば第三者にも分かるか)、(3) いま、その確かめに使える証拠はあるか、ないか。証拠を挙げられないなら、それは『できている』ではなく『できているつもり』かもしれない、と書き添える。最後に、外の目(別部門の人、内部監査など)に見てもらうとしたら、何を見せるかを一言書く。これは粗探しや監視のためではなく、自分の自己評価の甘さを設計で補うために行う。他人を評価・監視する材料には使わない。
——とはいえ、その“正しい用法・用量”は、まだ誰も知らない。ここまでの研究に、あなたのデータは1件も入っていないからだ。平均は地図にすぎない。自分の“いい具合”は、試して探すしかない。
あなたの実験(N=1)を始める → プロジェクトに追加(記録機能は準備中)
- Dunning D., Heath C., Suls J.M. (2004) ‘Flawed Self-Assessment: Implications for Health, Education, and the Workplace’, Psychological Science in the Public Interest 5(3):69-106 — doi.org
- Falchikov N., Boud D. (1989) ‘Student Self-Assessment in Higher Education: A Meta-Analysis’, Review of Educational Research 59(4):395-430 — doi.org
- Sitzmann T., Ely K., Brown K.G., Bauer K.N. (2010) ‘Self-Assessment of Knowledge: A Cognitive Learning or Affective Measure?’, Academy of Management Learning & Education 9(2):169-191 — doi.org
- Sheldon O.J., Dunning D., Ames D.R. (2014) ‘Emotionally unskilled, unaware, and uninterested in learning more: Reactions to feedback about deficits in emotional intelligence’, Journal of Applied Psychology 99(1):125-137 — doi.org
- Panadero E., Brown G.T.L., Strijbos J.-W. (2016) ‘The Future of Student Self-Assessment: a Review of Known Unknowns and Potential Directions’, Educational Psychology Review 28(4):803-830 — doi.org
- Ackerman P.L., Beier M.E., Bowen K.R. (2002) ‘What we really know about our abilities and our knowledge’, Personality and Individual Differences 33(4):587-605 — doi.org