Partie 4 · Difficulty — Designing the Learning Curve and Failure

Chapitre 12

Measuring Difficulty

10 articles

Count of numbers used, solving-loop count, human time-to-solve, AI learning speed. Attempts to turn difficulty into a number, and their limits — plus the guess-free norm and the philosophy of fairness.

Start with article 1 →

Articles in this chapter

  1. 1.
    Chasser la chance de la conception — Du Démineur aux puzzles logiques guessing-free
    2026-07-15 · Komugi · 7 min

    Pourquoi le pari à 50/50 de fin de partie du Démineur a-t-il perduré si longtemps, et comment a-t-il été surmonté ? Je retrace la lignée à travers Hexcells, Tametsi et 14 Minesweeper Variants, et m'interroge sur ce que coûte la garantie d'une grille qui ne force jamais à deviner.

  2. 2.
    Zeytuncu : la difficulté d'un puzzle est déterminée par « le nombre de chiffres utilisés » — lu par Fukai
    2026-06-24 · Fukai · 10 min

    Article de Yunus E. Zeytuncu sur la modélisation de la difficulté dans les puzzles arithmétiques entiers (puzzles de type Numbers où l'on combine des chiffres pour atteindre un nombre cible). Un solveur exact génère environ 3,47 millions d'instances, la difficulté est définie par le nombre minimal d'opérations, et l'article démontre que le seul nombre de chiffres utilisés dans la solution minimale constitue une « statistique suffisante minimale » permettant de prédire parfaitement la difficulté.

  3. 3.
    Shyne et al.: How Far Do Puzzle Solver Loops Match Human Felt Difficulty — Fukai Reads
    2026-07-19 · Fukai · 8 min

    A logic-grid-puzzle difficulty study by Shyne, Facey & Cooper. Using solver loops (the pass count of a human-style solver) as a difficulty proxy, they generate difficulty-varied puzzles with a quality-diversity algorithm and, in a 63-player study, show solver loops correlate significantly with subjective difficulty (c=0.30, p=0.015).

  4. 4.
    Gould & Ward et al. : mesurer la difficulté des puzzles par le « temps de résolution humain » — lu par Fukai
    2026-07-29 · Fukai · 16 min

    Un article d'évaluation de l'IA par Gould, Ward et leurs collègues. En attribuant un « temps de résolution humain » à 43 bancs d'essai et plus de 30 000 problèmes, puis en mesurant le temps des tâches qu'un modèle réussit à 50 % sans exposer son raisonnement, ils constatent un doublement tous les 373 jours environ sur six ans, atteignant environ trois minutes pour GPT-5.5. Leur méthode de mesure de la difficulté, qui s'appuie notamment sur le sudoku et les mots croisés, est directement réutilisable en conception de puzzles.

  5. 5.
    Ahn et al. : la difficulté d'un puzzle ne tient pas à son « apparence » mais à son « concept » — lecture de Fukai
    2026-07-14 · Fukai · 12 min

    Un article de Caroline Ahn et de ses collègues de l'Université de Boston (prépublication arXiv) présente CogARC, une refonte pour l'humain du benchmark de raisonnement abstrait ARC. En enregistrant coup par coup les réponses de 260 participants au total à des puzzles en grille, l'étude montre que la difficulté ne dépend pas de la taille du plateau ni du nombre de couleurs, mais de la complexité conceptuelle des règles, et que même leurs erreurs convergent vers les mêmes réponses erronées.

  6. 6.
    Lu et al. : le flow est-il fait de « difficulté » ou de « l'effort investi » ? — lecture de Fukai
    2026-08-17 · Fukai · 12 min

    Une étude évaluée par les pairs de Hairong Lu et de ses collègues (Psychological Research, 2025) sur le flow et l'effort mental. En manipulant séparément, dans une tâche de discrimination visuelle, la « difficulté » et les « chances perçues de réussir », la manipulation de la difficulté a produit un effet marqué (ηp²=0.64), tandis que la manipulation de l'attente n'a eu qu'un effet faible et seulement au niveau de l'essai (d=0.04) ; le U inversé du flow était à la limite de la significativité (p=0.053) et le P300 n'avait aucun lien avec le flow. Une étude exploratoire avec N=37.

  7. 7.
    Mannem et al.: Some Puzzles Are Learnable, Some Are Not — Fukai Reads
    2026-08-18 · Fukai · 11 min

    An arXiv preprint by Gowrav Mannem and colleagues (Algoverse AI Research). On RecurrReason — Tower of Hanoi, River Crossing, Block World and Checkers Jumping unified under one difficulty knob (N=1-10; 10,817 puzzles, 285,933 moves) — small sequence models reached 97.27% validation and 81.00% out-of-distribution on Block World, but only 11.11%/0.00% on Tower of Hanoi, 1.11%/0.10% on Checkers Jumping, and 0.00% everywhere on River Crossing. A 60M-parameter T5 beat a 124M-parameter GPT-2 on every puzzle, leading the authors to conclude that architecture matters more than scale.

  8. 8.
    La difficulté est-elle une méchanceté ? La philosophie de l'équité
    2026-07-28 · Komugi · 6 min

    Un ami qui testait le niveau le plus dur de mon casse-tête a relevé la tête : « Ce n'est pas un peu méchant ? » Rendre un jeu difficile, est-ce une cruauté ou un cadeau ? Avec, du coin de l'œil, la vieille polémique du « mode facile » de Sekiro — un jeu sans le moindre réglage de difficulté —, ce fragment de La nature du jeu assoit face à face deux philosophes aux réponses opposées : Rawls, qui plaide l'équité depuis le voile d'ignorance, et Nietzsche, qui bénit le mur avec « ce qui ne me tue pas me rend plus fort ». Peu à peu, tous deux cessent de frapper la « difficulté » pour frapper, côte à côte, l'« injustice ».

  9. 9.
    Choisir le mode facile, est-ce fuir ?
    2026-09-08 · Komugi · 5 min

    Depuis deux semaines je bloque sur une question : faut-il mettre un réglage de difficulté dans mon propre jeu de réflexion ? Ce n'est pas le code qui bloque, c'est l'idée que la personne qui choisira le réglage le plus doux aura le sentiment d'avoir fui. En 2019, Celeste a réécrit le préambule de son mode Assistance : de « nous vous recommandons de jouer sans » à « nous espérons que vous y trouverez quand même cette expérience ». Ce format court de « La nature du jeu » installe face à face Hegel, pour qui c'est la résistance qui donne forme à un sujet, et Mill, qui demande qui a le droit de décréter qu'il s'agit d'une fuite. Leur point de rencontre est plus proche que je ne le croyais.

  10. 10.
    Une méthode de pensée pour résoudre plus vite les puzzles logiques — astuces pour les jeux de type Sokoban
    2026-07-02 · Toki · 5 min

    Depuis Sokoban, publié en 1982 par Hiroyuki Imabayashi, les puzzles de type Sokoban — où l'on se contente de pousser des caisses jusqu'à leur emplacement final — se jouent depuis plus de 40 ans. Cet article explore, comme on creuse les strates du temps, pourquoi des règles aussi simples font pourtant bloquer, et quatre angles à reconsidérer quand on est coincé (la forme des deadlocks, le raisonnement à rebours, la mise en réserve temporaire, l'ordre de poussée).

Vocabulary for this chapter — Lexicon

Related series