PAPER-DIGEST · 2026-10-03

Engel ら: 迷路の正解が入れ替わったとき、人を早く切り替えさせたのは「他人の足跡」だった — Fukai が読む

意思決定研究 — 習慣になったルールと、ルール変更への適応

まず要点(TL;DR)

迷路を50面、同じ「近道のルール」に従って解かせる。51面目から、こっそり正解の道を反対側に入れ替える。人はどれくらいで乗り換えるのか。ドイツのマックス・プランク研究所のチームが、288人でこれを確かめた。

結果ははっきりしている。他の人の通った跡を見せると、切り替えは速くなった。お金を払えばルールを教える「ヒントボタン」は、統計的に意味のある差を生まなかった。ボタンを一度でも押した人は、使える人の55.21%にとどまった。もう一つ、得をするのが自分のときは、寄付先が得をするときより早く切り替わった。Baba Is You のゲーム画面『Baba Is You』(Hempuli Oy, 2019)のゲーム画面。言葉のブロックを押して、ルールそのものを書き換えるパズルだ。「さっきまでの正解」を捨てる力が、そのまま問われる。画像: Steam ストアページ

はじめに — 「慣れた正解」が正解でなくなる瞬間

今日読むのは、Christoph Engel、Thomas Holzhausen、Dorothee Mischkowski の3人による論文だ。題は「Trapped in the past? Routinized rule compliance and the speed of adaptation after rule change」。訳せば「過去に閉じ込められて? 習慣になったルール順守と、ルール変更後の切り替えの速さ」となる。

3人ともボンのマックス・プランク共有財研究所に所属する。Holzhausen はカールスルーエ工科大学、Mischkowski はオランダのライデン大学にも籍がある。掲載誌は査読付きの Judgment and Decision Making(判断と意思決定の専門誌)。2026年9月21日にオンライン公開された。CC-BY 4.0 の誰でも読める論文である。

実験は事前登録(preregistration。何を、どう分析するかを実験前に公開しておく手続き)されている。データと材料も OSF(研究データの公開サイト)に置かれている。ただし公開から2週間ほどで、追試もまだない。この点は先に断っておく。

私がこの論文を選んだのは、実験の道具が「迷路」だったからだ。ルールが途中で裏返る。パズルを作る人なら毎日のように向き合う場面である。それを、きちんと統制された実験で測っている。

背景 — 習慣は便利だが、変化に弱い

合理的選択の見方(人は毎回、損得を計算して行動を選ぶという考え方)に立てば、ルールが変わっても問題はない。新しいルールに合わせて計算し直せばよいからだ。

しかし現実の人は、毎回は考えない。著者たちはこう書く。ルールは経験や他人の観察から身につき、似た場面になると自動的に呼び出される。これが「習慣になったルール順守」だ。みんなが同じ動きをするので、協調には役立つ。

問題はその裏側にある。著者たちの言葉を借りれば、かつて役に立った習慣は、ルールが更新されても残り続けることがある。では、どんな学び方をすれば早く抜け出せるのか。誰の得になるルールなら早く乗り換えるのか。この2点を同時に測った実験は、これまで多くなかった。The Witness のゲーム画面『The Witness』(Thekla, Inc., 2016)のゲーム画面。島のパネルを解き進めるうちに、プレイヤーは線の引き方の「決まり」を体で覚えていく。画像: Steam ストアページ

アプローチ — 見えない落とし穴と、50面で入れ替わる近道

参加者は画面上の格子の迷路で、矢印キーを使ってボールを1マスずつ動かす。ゴールまでの歩数が少ないほど得をする。迷路には、ほぼ同じ長さの道が左と右に2本ある。

違いを生むのは「落とし穴」のマスだ。踏むまで見えず、1歩ではなく5歩として数えられる。穴の数は面ごとに1〜8個と変わるが、どちらか一方の道は必ず穴が少ない。そして画面には「まず上に4歩、次に右に1歩」のようなルールが示される。著者たちの説明では、このルールに従うと穴の少ない道に行ける。ただしルールは強制されない。従うかどうかは自由だ。

参加者は50面、同じルールのもとで迷路を解く。ここで「この道」という習慣ができる。51面目から100面目まで、穴の少ない道は反対側に入れ替わる。参加者には最初に「ルールは途中で変わることがある」とだけ伝えた。いつ変わるかは知らせていない。

条件は2つの軸を掛け合わせた6通りで、各48人が割り当てられた。一つ目の軸は学び方だ。(1) 歩数と穴の数だけが見える基本条件。(2) 各面のあと、同じ迷路を解いた別の人の最初の7歩を見られる「観察」条件。(3) 25ECU(実験内通貨。€0.125)を払うと今のルールを教えてくれる「情報検索」条件。観察で見える人の動きは、85%の確率で今のルールに従っている。わざと完璧にはしていない。

二つ目の軸は、誰が得をするかだ。「自分」条件では、1面100ECUから歩数ぶんが自分の取り分から引かれる。「寄付」条件では、自分の取り分は1面30ECUで固定される。歩数で減るのは、自分で選んだ寄付先(気候、赤十字、小児がん支援)に送られる額だ。参加者は大学の実験室で約1.5時間を過ごし、平均 €18.85 を受け取った。

発見 — 足跡は効き、ヒントボタンは押されなかった

まず「切り替えた」の定義だ。新しい道を4回続けて選び、その後に古い道へ4回続けて戻らないこと。この条件を満たした4回目の面を「切り替えの面」とする。最も早くて54面目になる。著者たちはこの定義を事前登録より厳しくしたと明記している。288人中222人が100面目までに切り替えた。66人は切り替えなかった。うち48人は一度も4回続けられず、18人は一度切り替えてから古い道に戻った。

切り替えた222人では、切り替えの面は平均 67.91(標準偏差 11.91)だった(Table 1)。50面の習慣づけの間、参加者はルールどおりの道を平均 42.11 回選んでいる。変更後の50面では、新ルールどおりの道は平均 30.06 回にとどまった。

学び方の効果は、Cox 比例ハザードモデル(「その面で切り替わる起こりやすさ」を条件ごとに比べる統計手法)で調べている(Table 2)。基本条件と比べ、観察条件ではハザード比が 1.510、つまり切り替わりやすさが 51.0% 高かった(95%信頼区間 1.090〜2.091、p = .013)。情報検索条件は 1.335(33.5%高い)だったが、信頼区間が 0.962〜1.852 と1をまたぎ、p = .084 で有意ではなかった。

理由の一端は利用率にある。検索ボタンを使えた96人のうち、一度でも押したのは53人(55.21%)、押された回数は全部で160回だった。誰が得をするかでも差が出た。「自分」条件は「寄付」条件よりハザード比 1.440 で切り替わりやすく、統計的に有意だった(95%信頼区間 1.104〜1.877)。学び方と受益者の組み合わせ効果(交互作用)は見られなかった。2つの効果は、それぞれ独立に足し合わさる形だった。DARK SOULS III のゲーム画面『DARK SOULS III』(FromSoftware, 2016)のゲーム画面。このシリーズでは、他のプレイヤーが残したメッセージや血痕(倒れる直前の動きの再生)が、道の危うさを知らせてくれる。画像: Steam ストアページ

使いどころ — ルールを裏返すパズルを作る人へ

ここからは、論文の結果を作り手の場面に置き換えた私の提案である。論文自体はゲームについて何も主張していない。そのことを前提に読んでほしい。

一つ目。もし自分が Baba Is You のように「途中でルールを裏返す」パズルを作っているなら、ヒントボタンだけに頼らない方がよい。この実験では、ボタンがあっても半分近くの人は押さなかった。代わりに、裏返した直後の面で「別の誰か」の動きを短く見せる。ゴーストの再生、他プレイヤーの軌跡、作者の手本の数歩などだ。そうすれば、切り替えのきっかけを渡せる可能性がある。手本は完璧でなくてもよい。この実験の足跡も、85%しか正しくなかった。

二つ目。デイリーパズルやライブ運営で、スコアの付け方や得点の高い手筋を変えるとき。告知文だけでなく、「昨日、他の人はこう解いた」という分布や代表的な解き筋を見せる。そうすれば、古い勝ち筋にしがみつく期間を縮められるかもしれない。観察の効果がはっきり出た今回の結果は、こうした設計を試す理由になる。

三つ目。協力型のゲームで、ルールに従うと「仲間」が得をする仕組みの場合。この実験では、得をするのが自分でないとき、切り替えが遅れた。チームのためのルールを変えるなら、本人にも分かる小さな得を添える。あるいは、変更を見せる回数を増やす。こうした手当てを最初から計画しておく価値がある。

四つ目。チュートリアルで一つの解き方を何十回も繰り返させると、後でそれを壊す面が難しくなる。今回の習慣づけは50面だった。習慣づけの長さを変えた実験ではないので、長さの効き目は分からない。それでも、裏返しを仕掛ける面の前には、同じ解き方の反復をほどほどにしておく。こう考えておくのは筋がよいと思う。

限界 — 学生、実験室、そして見えない落とし穴

著者自身が認めている点から。今回の参加者は学生で、場所は実験室だ。著者たちは、この結果がそれ以外に当てはまるかは今後の課題だと書いている。欧米以外の参加者での追試が、結論の頑健さを強めるとも述べる。また情報検索条件では、半数近くが検索を使わなかった。著者たちもこの点に触れている。検索の効果が有意にならなかったのは、「検索が効かない」からではなく「使われなかった」からかもしれない。その切り分けは、この実験では十分にできない。

Fukai がここで指摘したいのは3点だ。一つ目に、この迷路の「ルール」は道の指示にすぎない。Baba Is You のように、ルール自体を理解し直すパズルとは種類が違う。二つ目に、落とし穴は踏むまで見えない。正解の変化に気づく手がかりは、ゲームより乏しい。ゲームでは画面上の変化が見えることが多く、切り替えはもっと速いかもしれない。三つ目に、参加者は最初に「ルールは変わりうる」と聞いている。予告なしに裏返すゲームとは条件が違う。

加えて、これは1本の実験で、各条件48人だ。事前登録とデータ公開は信頼性を高めるが、追試はまだない。「人は他人を見ると切り替えが速い」と一般化するのは早い。正確には、「この迷路課題と報酬の条件のもとで、そう観察された」と読むべきだ。

Fukai の読み — 「アンラーニング」を設計する研究

ここだけは私の意見である。私はこの研究を、パズル設計で言う「アンラーニング(一度覚えたことを捨てさせる)」の測定として読みたい。良いパズルはしばしば、プレイヤーが自信を持った解き方を裏切ることで驚きを生む。その裏切りが「理不尽」に感じられるか「気持ちよい発見」に変わるかは、捨てるための手がかりの渡し方で決まる。この論文は、その手がかりとして「説明を取りに行かせる」より「誰かの足跡をちらりと見せる」方が効くことを、一つの統制された場面で示した。設計批評の語彙で言えば、これは「手本による再学習」をどこに置くかという問題の、小さな物差しになる。

おわりに — 「思い込み」の研究をたどる

慣れた解き方が新しい問題の邪魔をする現象は、心理学では古くから調べられてきた。有名なのは Luchins(1942)の「水がめ問題」で、いわゆる「構え(Einstellung)効果」の古典だ。今回の論文は、その流れを「ルールの変更」と「学び方の違い」という形で現代の実験経済学の道具立てに乗せたものと整理できる。

次に読むなら、まずこの論文の OSF にある事前登録とデータを眺めるのがよい。どの予測が当たり、どれが外れたかが、自分の目で確かめられる。本サイトで以前取り上げた、ヒントを買う量を調べた McCaughey らの研究と並べて読むと、「人はいつ情報を取りに行き、いつ行かないのか」の地図が少し広がるはずだ。

参考文献

本記事で参照した論文と関連資料:

・Trapped in the past? Routinized rule compliance and the speed of adaptation after rule change (Christoph Engel, Thomas Holzhausen, Dorothee Mischkowski, 2026, Judgment and Decision Making, Vol. 21, e25)

・DOI: 10.1017/jdm.2026.10050

・事前登録(OSF) / データ・実験材料(OSF)

・関連記事: McCaughey ら: 情報探索のコストへの適応(Fukai が読む)

・関連研究: Abraham S. Luchins (1942). Mechanization in problem solving: The effect of Einstellung. Psychological Monographs, 54(6).

リアクション(ログイン不要)

匿名で残せます • 同じリアクションは1日1回まで

関連シリーズ

論文ダイジェスト第100回 / 全101回

次に読む

編集部からのおすすめ