PAPER-DIGEST · 2026-08-17

Lu et al.: フローを生むのは「難しさ」か「注ぎ込んだ努力」か — Fukai が読む

フロー体験 / 心的努力 / 難易度設計(心理学)

一段落要約

難易度をプレイヤーの技能に合わせるとフロー(時間を忘れて没入している状態)に入る——ゲーム設計で最もよく引かれる定説の一つだ。今日読んだ論文は、その定説に一本の切れ目を入れようとしている。フローを動かしているのは課題の難しさそのものなのか、それとも、そこでプレイヤーが実際に注ぎ込んだ努力の量なのか。両者はこれまで束ねて扱われてきた。

著者らは視覚弁別課題(2枚の格子画像が同じか、1マスずれているかを答える課題)を使い、格子の細かさで「難しさ」を、「違いがある試行は全体の何%か」という事前告知で「努力を注ぐ動機」を、別々に動かした。同時に脳波の P300 も測っている。査読誌 Psychological Research(Springer, 2025)掲載の研究である。

結果は、単純な図式には収まらなかった。難しさの操作は強烈に効いた(効果量 ηp²=0.64)一方、期待の操作は個人単位では効かず、試行単位でだけ弱く効いた(難しい条件で d=0.04)。フローは難易度に対して逆U字の形を見せたが p=0.053 と境界で、P300 はフローと何の関係も示さなかった(b=-0.003, p=0.97)。持ち帰るべきは結論ではなく、「難易度」という一語が少なくとも三つのつまみに分かれる、という地図のほうだ。

はじめに

論文のタイトルは Disentangling the effects of task difficulty and effort on flow experience。著者は Hairong Lu、Dimitri Van der Linden、Arnold B. Bakker の三名で、所属はヨハネスブルグ大学の産業心理学・人材マネジメント学科である。掲載は Psychological Research(Springer)第89巻第4号、論文番号113、オンライン公開は2025年6月26日、DOI は 10.1007/s00426-025-02128-x。arXiv のプレプリントではなく、査読を通った論文だ。

私がこれを選んだのは、パズルを毎日出す側にとって難易度をどこに置くかが最大の設計変数であり、その根拠として引かれる心理学の定説を、そのまま信じたくないからである。定説を使うなら、その定説自体を検証しにいった研究を読んでおきたい。この論文はまさに、フロー研究の中心にある「挑戦と技能の一致」という説明に、別の説明変数を差し込んで見せる。

ただし最初に留保を置く。心理学の単発実験であり、参加者は37名、著者ら自身が探索的な位置づけだと書いている。事前登録(preregistration。仮説と分析手順を実験前に公開しておき、結果を見てから解釈を付け替えることを防ぐ手続き)についての記載もない。この記事では、確かめられたことと、まだ確かめられていないことを分けて書く。

背景

フロー研究の定説はこうだ。課題の挑戦度とプレイヤーの技能が釣り合ったときに没入が生まれ、易しすぎれば退屈、難しすぎれば不安になる。つまりフローは難易度に対して逆U字(真ん中が高く、両端が低い形)を描く。ゲーム設計の教科書がだいたい引くのはこの形である。

ところが、これとほとんど同じ形を描く別系統の研究がある。心的努力(mental effort。課題に注ぎ込む頭の力の量)の研究だ。動機づけ強度理論(motivational intensity theory。課題が難しくても達成可能だと思えるうちは努力が増え続け、不可能だと判断した瞬間に一気に落ちる、という枠組み)によれば、努力もまた難易度に対して逆U字を描く。しかも両者は瞳孔の拡大のような生理指標まで共有している。

ここに問題が生じる。フローと努力が、同じ難易度の位置で同じ形の山を作るなら、私たちが「挑戦と技能が一致したからフローに入った」と説明してきたものは、実は「そこが最も努力を注ぎやすい点だったから」かもしれない。著者らの問いは、この二つを実験的に切り離せるか、である。難易度を変えずに努力だけを動かせれば、切り分けは可能になる。

アプローチ / 方法

実験は被験者内計画(within-subjects。同じ参加者が全ての条件を体験する設計)で、3(難易度)×2(期待)の6条件。課題は視覚弁別で、白と薄灰色のマスからなる格子画像を2枚同時に提示し、同一か、それとも1マスの位置がずれているかを答える。難しさは格子の細かさで操作した——2×2(易)、8×8(中)、14×14(難)。細かいほど、ずれ1マスを見つけるのは難しくなる。

努力のほうは、課題そのものを変えずに動かす必要がある。そこで著者らは EPDD(expected probability of detecting differences。違いを見つけられる見込みとして事前に伝える確率)を使った。「このブロックでは違いのある試行が全体の50%です」と伝える統制条件と、「80%です」と伝える高期待条件。期待値制御の考え方(成功の見込みが高いほど、努力を注ぐ価値があると判断される)に基づく操作である。

測定は四つ。フローは1項目10点尺度(「どの程度フロー状態にあったと思うか」。事前の面談でフローの意味を参加者に理解させたうえで使用)、主観的難しさは -3 から +3 の7段階(技能と釣り合っているか)、努力の代理指標は反応時間と正答率、生理指標は脳波の P300(刺激からおよそ300ミリ秒後に現れる脳波の山。注意資源の配分と関係するとされる)を Pz 電極の 300〜400ミリ秒の窓で取っている。

参加者は学部生37名(女性29名、平均年齢19.87歳、SD 1.78)。EEG データ欠損1名とフローの意味を取り違えた1名を除外した後の人数である。5分のブロックを6つ、順序をランダムにして実施した。解析は混合効果モデル(参加者ごとの個人差を乱雑要因として吸収しながら全体の傾向を推定する手法)で、事後比較は多重比較の補正を掛けている。

発見

まず、操作は狙い通りに分離できた。主観的難しさは格子の細かさで大きく動き、F(180,2)=162.80, p<0.001, 効果量 ηp²=0.64。易しい条件は中程度より d=1.24、難しい条件より d=2.30 だけ易しく感じられた。一方、期待の操作は主観的難しさを動かさなかった(F(180,1)=0.85, p=0.36)。難しさと期待は別々のつまみとして機能した、と言える。付け加えると、中程度×高期待の条件は「技能と挑戦が釣り合う」点にほぼ着地している(平均 -0.11、ゼロと有意差なし)。

努力はどうか。個人単位で見ると、反応時間は難易度で劇的に動き(F(180,2)=1202.45, p<0.001, ηp²=0.93)、正答率も同様(F(180,2)=533.53, p<0.001, ηp²=0.86)だが、期待の主効果は出なかった(反応時間で F(180,1)=1.69, p=0.195)。ところが試行単位(8,785試行)まで粒度を上げると、期待の効果が現れる: F(1,8743.1)=11.93, p<0.001。ただし内訳を見ると、易しい条件では差がなく(p=0.436, d=0.01)、中程度(p=0.005, d=0.05)と難しい条件(p=0.003, d=0.04)でのみ高期待が反応時間を押し上げた。効果量は極めて小さい。

肝心のフローは、全体平均 6.14(SD 1.977、10点満点)。統制期待の条件では難易度に対する逆U字の形が見えたが、境界的である(二次の係数 b=-0.66, p=0.053)。高期待の条件では逆U字は消えた(b=-0.35, p=0.292)。難易度の主効果も有意には届かず(F(2,180)=2.63, p=0.074)、難しい条件で高期待と統制を比べても t(36)=1.69, p=0.099, d=0.28 で有意ではない。著者らは「フローの動きは努力の動きをなぞるように見えた」と書きつつ、交互作用が有意でないことを明記している。

生理指標のほうは、はっきりした空振りだった。P300 は統制でも高期待でも難易度に対する逆U字を示さず(p=0.706 / p=0.140)、フローとの関係も見られなかった(b=-0.003, p=0.97)。著者らはこれを、先行研究の一部でも同様の null が報告されている点に触れつつ、「フローの神経相関についての前提に疑問を投げる」結果として位置づけている。

使いどころ

一つ目、難易度表示との付き合い方。「今日の正答率68%」のような表示は、盤面を一切変えずに「解けそうか」という見込みだけを動かす道具である。この研究で示唆されたのは、その手の期待操作がブロック単位ではほとんど効かず、試行単位でだけ弱く効いたことだ。だとすれば、開始前のバナー一発よりも、解いている最中に更新される手応え——確定マスが増える、候補が減る、残り手数が見える——のほうが期待を動かしやすい、と読める。

二つ目、ヒントの設計。もし私が Sokoban ライクを作っているなら、作業を肩代わりするヒント(「この箱をここへ」)より先に、方針を肯定するヒント(「この箱は最後に動かす」)を置きたい。前者は努力そのものを減らすが、後者は努力量を保ったまま成功の見込みだけを上げる。本研究の枠組みで言えば、後者が EPDD を上げる介入に対応する。効果量が小さかった点は踏まえつつ、方向としては試す価値がある。

三つ目、プレイテストの計測粒度。この論文で最も実務的な教訓は、同じ操作が個人単位では見えず試行単位で見えた、という点かもしれない。もし自分がデイリーパズルの改修を評価するなら、「今日は楽しかったか」を1問聞いて集計するより、1手ごとの所要時間、手戻りの回数、中断の位置といった細かい行動ログを主指標に据える。主観尺度は補助に回す。

四つ目、難易度カーブの置き所。この実験で「技能と挑戦が釣り合う」点に最も近かったのは、中程度の難しさに高い期待を重ねた条件だった(主観的難しさの平均 -0.11)。ハイパーカジュアルの PCG(Procedural Content Generation、コンテンツの自動生成)で難易度を自動調整するなら、正答率の中央付近を狙ったうえで、そこに「解けそうだ」という信号を重ねる二段構えが、少なくともこの条件下では無理のない置き方だったことになる。

限界

著者自身が認めている弱点は多い。期待の操作をブロック単位で行ったため試行ごとの影響が薄まった可能性があり、効果量が小さかったこと。統制条件の50%という値が既に高く、天井効果でより低い期待条件との差が見えなかった可能性があること。参加者37名という規模は検定力分析ではなく実務的事情で決めたと明記されていること。瞳孔径は課題の性質(処理時間が長く眼球運動が頻繁)のため使えず、生理指標が P300 に限られたこと。そして全体として、結果は「初期的だが新しい示唆」に留まると著者らが書いていること。

Fukai がここで指摘するのは、まず p 値の並びである。主要な結果が 0.053、0.074、0.099 と境界に集まっている。ひとつなら偶然と言えるが、こう並ぶと「効果はあるかもしれないが、この標本では確かめきれていない」と読むのが正確だ。少なくとも「フローは難しさではなく努力で決まる」と言い切る材料ではない。試行単位で有意になった期待の効果も、効果量は d=0.04〜0.05 と、実務で体感できる大きさとは言いがたい。

もう一点、課題の性質である。この実験の課題は抽象的な視覚弁別で、物語も、目標も、他者の視線もない。パズルゲームで生じるフローは「解けたことの意味」に支えられている部分が大きく、そこを取り除いた課題で測ったフローを、そのままデイリーパズルへ持ち帰るのは慎重にしたい。加えて参加者は同一大学の学部生37名で、平均年齢は19.87歳。一般の解答者層とは重ならない。

総じて、この論文は「フローと努力を切り分ける実験を組める」ことを示した点に価値があり、「切り分けた結果こうだった」と断定するには至っていない、と整理できる。事前登録の記載がなく著者自身が探索的と位置づけている以上、追試が出るまでは仮説として扱うのが妥当だ。心理学の再現性問題を踏まえるなら、この態度は慎重すぎるということもないだろう。

Fukai の読み

ここからは私の解釈である。私はこの研究を、「難易度」という一語に押し込められてきた設計変数を分解していく流れの中に置きたい。課題の側の難しさと、プレイヤーが実際に注ぎ込む努力と、解けそうだという見込み——設計の現場では、この三つがずっと一つのつまみとして扱われてきた。この論文が差し出したのは結論ではなく、つまみが少なくとも三つあるという地図だと私は読む。設計批評の語彙で言えば、難易度調整とは課題を易しくすることではなく、努力を注ぎ込む価値があるとプレイヤーに思わせる条件の設計に近い。もっとも、その読み自体をこの論文が実証したわけではない。

おわりに

もっと深く知りたい人には、Strojny らが2023年に PLOS ONE で発表した研究を合わせて薦めたい。動機づけ強度理論を実際のゲーム(Icy Tower)で検証したもので、39名の参加者に難易度4段階を遊ばせている。結論は「課題が達成可能な範囲にあるうちは難易度とともに関与が上がり、達成不可能になると急落する」。今日の論文が実験室の抽象課題で扱った枠組みを、実ゲームの側から見ている。二本を並べると、難易度と努力と関与の関係がどのあたりまで分かっていて、どこから分かっていないかの地図が描ける。

フロー研究そのものは数十年の蓄積があり、今日の論文はその一角に検証を入れたに過ぎない。だからこそ、この一本を読んで「フローの正体が分かった」と受け取るのは誤りで、「フローという言葉で束ねてきたものが、実験の手つきで分解されはじめている」と受け取るのが正確だと私は考える。パズルを作る側にできるのは、その分解の途中経過を、自分の盤面で確かめてみることだ。

参考文献

本記事で参照した論文と関連資料:

・Disentangling the effects of task difficulty and effort on flow experience (Hairong Lu, Dimitri Van der Linden, Arnold B. Bakker, 2025, Psychological Research 89(4), Article 113 / peer-reviewed)

・DOI: 10.1007/s00426-025-02128-x

・同論文のオープンアクセス版 (PubMed Central, PMC12202627)

・関連研究: Player involvement as a result of difficulty: An introductory study to test the suitability of the motivational intensity approach to video game research (Paweł Strojny, Agnieszka Strojny, Krzysztof Rębilas, 2023, PLOS ONE)

リアクション(ログイン不要)

匿名で残せます • 同じリアクションは1日1回まで

学ぶ — カリキュラム

学ぶ第4編 難易度編 — 学習曲線と失敗の設計第12章 難しさを測る6 / 10本

関連シリーズ

論文ダイジェスト第60回 / 全98回

次に読む

編集部からのおすすめ