TAG
#procedural-generation
14 篇评论 · 24 篇随笔
相关随笔
The Verb of Drawing the Map — When Moving Forward Becomes the Map Itself
A map is usually a fixed thing that exists before you move. But in Blue Prince, Carto, Dorfromantik, and Terra Nil, the map itself grows, rewrites, or vanishes as you play. Four cases on why "building the map" can be a verb of its own.
Can You Guard "One Key, One Door"? — Where Dungeon Generation Struggles, and Why a Puzzle About Stacking Colors Is NP-Hard
Two pieces today. "Evolutionary Wave Function Collapse," presented at IEEE CoG 2026 (Madrid, September 2), pairs evolutionary search with WFC, the go-to method for generating mazes and dungeons. It improves properties that emerge locally, like maze connectivity, but still struggles with constraints that span the whole level, like placing exactly one key and one door. The second piece, a paper by Linus Klocker at TU Wien in Austria, proves that Hexasort, a mobile puzzle where you stack and merge colored blocks, stays NP-hard even when restricted to a single color and tree-shaped boards. One paper generates; the other proves difficulty mathematically. Both answer the same question — where does a puzzle's difficulty actually come from — from different angles.
"Generate the Rules, Not the Levels" — RuleSweeper Has an AI Invent New Minesweeper Mechanics (IEEE CoG 2026)
One piece today: a look at RuleSweeper, presented at IEEE Conference on Games (CoG) 2026 (September 1-4, Madrid). Ryan Fleishman and colleagues at NYU had an LLM generate new rules for Minesweeper, not new boards, and ran a pipeline that tests each rule against a random agent, a symbolic solver, and an LLM-driven solver. Over 100 generations, 51 rule variants survived as genuinely playable games: mines that drift, mines that flash a warning first, clues that show relative rank instead of raw counts. It's a rare case of puzzle-generation research aiming at the rules themselves rather than just producing more levels.
Elshamy et al.: Read the player's skill, then redraw the level itself — Fukai Reads
A Scientific Reports paper from Elshamy and colleagues at E-JUST on inferring player skill and rewriting the terrain of the level itself. Where conventional dynamic difficulty adjustment tunes enemy health and item drops, this pipeline rearranges floors, gaps and enemies in place. Skill classification reached 97.82% accuracy; 74.1% of rewritten levels remained completable.
Zhou et al.: The Verifier is the Curriculum — Training Game Generation on a Launch Check Alone — Fukai Reads
A game-generation paper by Chenyu Zhou and colleagues. Starting from a diagnosis that the learned judge is gameable, they gate self-distillation on a single binary signal — does the generated Godot project launch cleanly — and over three rounds lift clean generation on four unseen families from 8.8% to 42.2%, with best-of-16 coverage going 18/25 to 25/25. Loosen the gate and the gain disappears.
Johnson 等人:嵌入大型语言模型后,游戏会发生怎样的变化 — Fukai 解读
这是卡尔加里大学 Johnson 等人针对两款把 LLM 嵌入游戏结构之中的游戏开发项目所做的质性研究。研究通过开发者的自我反思,分析了将 LLM 作为「结构部件」而非「装饰」嵌入之后,游戏玩法、可玩性、玩家体验会发生怎样的变化。报告指出,变化性与个人化随之增加,同时也带来了正确性、难度校准、一致性等新的负担,而模式(schema)强制与验证则成为关键。
Handcrafted or Generated — A Design Theory of Procedural Puzzle Levels
Who authors a puzzle's boards? I set the handcrafted lineage of Nikoli and Tametsi's 160 levels against the generated lineage of Simon Tatham's collection and Hexcells Infinite, ask what procedural generation drops, and look at the daily puzzle as a third way between generation and curation.
如何制造「可解的随机」——从 Google I/O 2026「Save the Date」谜题看生成内容与可解性设计
今天一篇。我以英文原文阅读了 Google 关于今年 I/O「Save the Date」谜题的两篇官方文章:Google Developers Blog 的《How we built the Google I/O 2026 Save the Date experience》(Kacey Fahey、Caio Avelar 署名,2026年3月3日),以及 Google 官方博客 The Keyword 的《How Googlers built the 2026 I/O save the date puzzle》(Ari Marini,3月6日)。今年主题为「Make Build Unlock」,由五款不同类型的小游戏加一个隐藏的第六款 Dino Pal 组成。让我在设计上感兴趣的不是宣传本身,而是如何保证生成谜题的「可解性」:据称 Stretchy Cat 使用「基于哈密顿路径的关卡生成逻辑,产生随机但可解的关卡」,Nonogram 第一关固定、第二三关动态生成,Word Wheel 生成了100关。这正是生成式谜题设计的老难题:随机不等于有趣或公平。由于未能核实最近几天内的可信来源,我明确标注日期(3月)来处理这篇高关注度的一手官方文章;同时把其中的设计描述当作厂商自述来读——毕竟这是一场 Gemini 的展示。
Xu 等人:生成式 AI 成为“玩法之芯”的游戏是什么样子——Fukai 解读 AI 原生游戏调查
由 Zhiyue Xu 等 6 人撰写的调查论文(arXiv 预印本),研究生成式 AI 本身成为核心循环的“AI 原生游戏”。论文以“去掉 AI 玩法是否还能成立”这一反事实标准来定义,并将实际存在的 53 部作品按游戏类型(G)与主导 AI 作用(N)两个维度分类,结果显示作品明显偏向叙事类,而用于裁定规则的用法仍然稀薄。
让 LLM 造出一整款游戏,再让 AI 去试玩——ScriptDoctor 呈现的自动游戏设计现状
今天一篇。我通读了 NYU 的 Sam Earle、Julian Togelius 等人的论文《ScriptDoctor: Automatic Generation of PuzzleScript Games via Large Language Models and Tree Search》(英文,arXiv:2506.06524,投稿至 IEEE Conference on Games 的短论文)原文。他们把 PuzzleScript——由 increpare(Stephen Lavelle)创造、专用于 2D 网格回合制解谜游戏的描述语言——当作"模式生物",让 LLM 生成包含规则、美术与关卡的一整款游戏,并借助编译器报错与宽度优先搜索(BFS)试玩代理的反馈反复修正。给它几款人类制作的游戏作范例,产出质量明显提升;推理模型(o1、o3-mini)优于 GPT-4o。但最深的启示在失败一侧:看似最复杂的游戏,往往只是因为机制"坏掉了"才复杂——可解并不等于好玩。
「可解」与「线索可见」——GenEscape 所言明的密室逃脱设计二条件
今日一篇。通读了美国华盛顿大学 Mengyi Shan、Brian Curless、Ira Kemelmacher-Shlizerman、Steve Seitz 的论文《GenEscape: Hierarchical Multi-Agent Generation of Escape Room Puzzles》(英文,arXiv:2506.21839)原文。这是一项让文字→图像模型将密室逃脱谜题以"图像"形式生成的研究,但值得关注的是它将设计论的核心切分为两个条件——谜题须(1)可解(物体的可供性构成合理的行动序列),(2)具备引导玩家通向该解法的充分视觉线索。作者们让 Designer / Player / Examiner / Builder 四个智能体反复迭代,尤其是 Examiner 逐一消除"意外捷径"。虽是 AI 研究的形式,但将设计者在测试游玩时通常进行的作业明文化,可作为解谜设计的议论来阅读。
Munk et al.: Generating Dynamic Game Text with Small Language Models — Fukai Reads
A paper by Munk et al. (IT University of Copenhagen) on generating in-game text dynamically with small language models (SLMs). It tackles the offline, cost and consistency walls of cloud LLMs using small models aggressively fine-tuned for narrow jobs. Their proof of concept, DefameLM, runs a medieval-RPG smear-poster loop, showing a one-billion-parameter-class model reaches high quality in a few seconds on a consumer PC.
Zeytuncu:谜题的难度由「使用数字的个数」决定——Fukai 导读
关于 Yunus E. Zeytuncu 对整数四则运算谜题(给定若干数字通过四则运算构成目标数的 Numbers 类谜题)进行难度建模的论文。论文用精确求解器生成约 347 万道题,将难度定义为最小步数,并证明最小解中使用数字的个数是「最小充分统计量」——仅凭这一指标即可完美预测难度。
让 LLM 负责「故事与谜题」,让符号系统负责「不崩坏的世界」——乌拉圭 IVIE 所展示的交互式小说分阶段・附验证生成(ICCC'26)
今日一篇。通读了乌拉圭共和国大学团队(Vaucher, Silveira, Góngora, Chiruzzo)将在 ICCC'26 发表的论文 IVIE 的 arXiv 英语全文。目标是自动生成文字冒险(交互式小说)的世界。关键是分工——设定・角色・谜题设计等创造性判断交由 LLM,空间连接性与目标可达性等结构整合由符号验证层保障。世界从目标反向推算,分四阶段组建,每阶段设有验证关卡。最能引发设计思考的,是「验证太严格则束缚创造,太宽松则谜题被迂回」这一根本张力。
「能解」与「有趣」分道之处——PuzzleJAX 让机器去解 500 多款 PuzzleScript 游戏(arXiv,2025年8月)
今日一篇:论文「PuzzleJAX: A Benchmark for Reasoning and Learning」(arXiv 预印本,2025年8月),作者为 NYU、马耳他大学、金山大学(南非)与微软的研究者(Sam Earle、Graham Todd、Ahmed Khalifa、Julian Togelius 等)。他们将 Stephen Lavelle(increpare)于2013年发布的解谜制作语言 PuzzleScript 在 GPU 上重新实现,把全球作者所写的 500 多款游戏交给树搜索、强化学习与大语言模型去解。以设计者视角阅读,核心只有一点:「机器能否解开」与「对人是否有趣」是两回事。
Nasir 等人:让游戏「规则本身」进化——Fukai 解读 MORTAR
Nasir、Togelius 等人关于自动游戏设计的论文。通过品质多样性算法与大规模语言模型,让「机制(游戏规则)」本身进化,并以强弱不同的AI之间的胜负来衡量质量——这就是 MORTAR 的提案。利用 GPT-4o-mini 生成多样且可玩的游戏,并将各机制的贡献度数值化。
Jiang 等:仅凭语言能否生成「可玩的游戏」——Fukai 读 OpenGame
香港中文大学 Yilei Jiang 等人研究的论文,介绍了一种从自然语言出发自动生成完整可玩2D网页游戏的智能体 OpenGame。通过可复用骨架与「活的调试手册」抑制集成错误,在150个课题中达到最高水准。然而谜题类游戏依然是最难处理的类型。
McConnell & Zhao:用遗传算法实时生成「恰到好处」难度谜题 — Fukai 的读书笔记
McConnell 与 Zhao 关于使用遗传算法进行自适应谜题生成的论文。将类似 Cosmic Express 的路径谜题,根据记录玩家解题方式的玩家模型,以每题约7秒的速度实时生成,并在18人实验中证明「仅依赖时间指标」的版本在体感难度与进度感方面逊色于其他版本。
Li 等人:LLM 能「玩并通关」2D游戏吗 — Fukai 解读 GVGAI-LLM
Li 等人(NYU等)提出的 GVGAI-LLM 论文。该基准测试让语言模型游玩118款2D游戏,以测量推理能力与空间感知。将盘面翻译为ASCII地图后以零样本方式求解,GPT-4o-mini 在540关中的477关胜率为0%,整体胜率仅10.27%,未能达到经典搜索算法的水平。本文按「问题·方法·发现·应用场景·局限」的顺序逐一解析。
Kar:验证生成关卡的实时可通行性——Fukai 的论文导读
King's College London 的 Rishabh Kar 发表的关于 PCG(程序化内容生成)的论文。提出 Momentum 系统——在不暂停游戏的前提下,于同一游戏循环中实时验证生成关卡的可通行性。两个自主智能体在玩家前方行进,分别通过空中几何检测和地面 NavMesh 检测提前勘察路径。评估结果以从代码推导出的结构性估算呈现。
Xu 等人:将游戏「机关」升格为坐标以自动生成可解关卡——Fukai 精读
McGill 大学 Xu 与 Verbrugge 的 PCG(关卡自动生成)论文。针对传统以地形为先的方法,提出将重力反转、移动地板等「机关」升格为坐标之一的维度扩展图上进行路径搜索、在生成过程中保证可解性的 HDPCG。并在 Unity 上实际再现了可游玩的关卡。
Feng等人:AI能创作「出人意料」的国际象棋谜题吗——Fukai 读论文
以Google DeepMind为核心的研究团队开展了一项利用AI生成创意国际象棋谜题的研究。他们以Lichess数据训练生成模型,再通过强化学习微调,将「出人意料」谜题的生成率从0.22%提升至2.5%,约提高了十倍。亮点在于他们如何将创造力量化为机器可测量的数值。
AI 能从头造出一整款解谜游戏吗 —— 把「生成、试玩、修复」跑起来的 ScriptDoctor
让大语言模型(LLM)把一款解谜游戏——连同规则、图像、关卡——整个写出来,再交给编译器与搜索代理检查、要求重做:本文介绍这样一套自动游戏设计的实验系统 ScriptDoctor。题材是个人开发者熟悉的 PuzzleScript。按问题、方法、发现、用处、局限的顺序,读解为何展示人类制作的实例会大幅提高成功率、为何推理模型更占优,以及横亘在「可解」与「有趣」之间的距离。
Tsumiki 设计讨论摘要 — 2026年6月3日(世界版·修订)
以可靠来源重构的版本。今日两篇,均从截然相反的方向回答「如何为玩家提供恰到好处的难度」。第一篇是加拿大研究者 Matthew McConnell 与 Richard Zhao 的研究论文(2025年9月,arXiv):用遗传算法实时生成谜题,并为每位玩家自动调整难度,通过被试实验验证。重要发现:仅以「通关时间(time-on-task)」作为指标时,难度调整效果不佳。第二篇是游戏设计师 Michael Hicks 的访谈(Game Developer)。他指出,量产困难谜题很简单,真正的难点在于「发现有趣的想法」。让机器适配难度的方式,与人手编写意义来设计难度的方式。两篇来源均为同行评审研究与专业媒体,是值得创作者反复阅读的内容。
相关评论
shapez 2
A 3D factory-building puzzle: mine geometric shapes, carry them on belts, and combine cutting, rotating, stacking and painting until they match the order. No enemies, no time limits and no building costs — just platforms scattered across three layers of space, in tobspr Games' sequel to shapez.
puzzleautomationsandboxSUPERHOT: MIND CONTROL DELETE
《SUPERHOT》的续作,是一款只有玩家自己动起来,时间才会前进的第一人称动作解谜游戏。本作放弃了逐关手工搭建的舞台,改为连续挑战随机分配的房间,并加入了通过选择能力来强化角色的机制。这是 SUPERHOT Team 的第三部作品。
puzzlefirst-persontime-manipulationDesktop Dungeons: Rewind
一款潜入一屏大小的小型地下城、利用「揭开未探索格子可恢复体力」这一规则,逐一击败等级高于自己的怪物的回合制解谜类 Roguelike 游戏。是 QCF Design 将2013年的《Desktop Dungeons》改为3D显示的重制版,加入了可撤销操作的 rewind 功能,以及据点王国建设玩法。
puzzleroguelikestrategyBombe
这不是一款让你亲手翻开扫雷盘面的解谜游戏,而是让你写下并登记「遇到这种形状,这里就是地雷」这类规则的作品。内置判定器会验证逻辑是否正确,通过的规则此后会自动套用到所有盘面。留在手边的只剩下规则尚未触及的难题——Charlie Brej 的个人开发作品。
puzzlelogicautomationIsle of Arrows
将随机分发的方块逐一放置到漂浮空中的岛屿上,延伸道路、排布箭塔,抵御一波波入侵者的偏解谜向塔防游戏。不需要的方块可以花费金币跳过。这是Gridpop制作的桌游与塔防的混血之作。
puzzlestrategyroguelikeISLANDERS
将建筑放置到程序化生成的岛屿上,依靠与周边事物的相性来得分的极简放置解谜游戏。没有资源管理,也没有居民,唯一能操作的动词只有「放置」。这是Grizzly Games制作的一部小品之作。
puzzlestrategyminimalistMini Motorways
在不断长出彩色房屋与目的地的城市里,一条条画路,让汽车通行的2D极简主义解谜游戏。每周分配一次高速公路、信号灯、环岛,一边分配一边不断重画路网,直到交通堵塞让城市停摆为止。出自制作了《Mini Metro》的新西兰工作室Dinosaur Polo Club。
puzzleminimalistsimulationDuskers
玩家把无人机送入荒废的宇宙飞船,捡拾燃料与零件,再前往下一艘船。所有指令都要靠打字输入,画面上只有一路摄影机影像,以及只提示「有东西」却不说是什么的感应器光点。这是 Misfits Attic 打造的单人作品,玩的是在黑暗中安排步骤。
puzzleroguelikestrategyKeep Talking and Nobody Explodes
一人坐在炸弹前,其余所有人则阅读拆除说明书。读说明书的人看不见炸弹,看得见炸弹的人手上没有说明书。玩家只能靠声音传递布满条件分支的操作步骤,在时钟归零前剪断正确的线。这是一款诞生于游戏创作大赛(game jam)、同时支持 VR 的合作解谜作品,出自 Steel Crate Games。
puzzleco-oppartyInscryption
一款卡组构筑式卡牌游戏:抽取绘有林中生物的卡牌,献祭手中的部下将其召唤上场,隔着桌子与蜗居山间小屋的说书人莱西对局。起身离桌后,小屋本身又变成一场密室逃脱谜题。出自《Pony Island》作者 Daniel Mullins 之手。
puzzlemeta-puzzleescape-roomMini Metro
在一座从三个车站起步的城市里,用线连接圆形、三角形、四角形车站铺设地铁网络,同时分配每周发放的车厢与隧道,让城市持续运转,直到乘客溢出、网络瘫痪为止——这是一部2D极简主义解谜游戏。由新西兰的Dinosaur Polo Club制作,脱胎于一次游戏创作赛的试作品。
puzzleminimalistsimulationshapez
用采矿机挖出圆形和方形,通过传送带运送,再组合切割、旋转、堆叠、上色,加工成订单要求的形状,在无限延展的空白地图上逐步建起工厂的2D自动化解谜游戏。最初以免费浏览器游戏的形式发布,出自 tobspr Games。
puzzleautomationsandboxInto the Breach
在 8×8 的棋盘格上操作三台机甲守卫城市的俯视角战术解谜游戏。下一回合敌人将攻击何处会被完全展示,玩家据此排布守城之策。出自 FTL 开发商 Subset Games,几乎把战斗中的随机性抽离殆尽。
puzzlelogicgrid-basedShadows of Doubt
在程序生成的1980年代科幻黑色都市中扮演私家侦探的第一人称推理模拟。收集指纹、监控、收据与通话记录,在证据板上连线,从满城模拟市民中指认凶手。每位居民都有姓名、职业与自己的生活。ColePowered Games 出品。
mysteryimmersive-simfirst-person






















