12 · 试玩、度量与迭代
12 · 试玩、度量与迭代
你不是玩家。你的判断在试玩面前一律无效。
12.1 试玩的三个层级
| 层级 | 何时 | 参与者 | 看什么 |
|---|---|---|---|
| T1 自检 | 每天 | 自己 | 能不能跑通、有没有崩溃 |
| T2 内部试玩 | 每周 | 团队/朋友(知道设计) | 手感、时长、难度 |
| T3 陌生试玩 | 每里程碑 | 完全不了解的人 | 引导、理解、留存、情绪 |
只有 T3 是有效的。 T1/T2 只能发现"坏掉的",不能发现"不好玩的"和"看不懂的"。
12.2 陌生试玩的执行规范
人数与频次
- 每次 5–8 人(5 人能发现 ~85% 的问题)
- 每关至少 2 轮陌生试玩(灰盒 1 轮 + 成品 1 轮)
- 关键关卡(教学、首 Boss、结局)需要 ≥8 人
观察规范(强制)
- 不解释、不提示、不救场。玩家卡住就让他卡。
- 设计师只看不说,直到玩家结束。
- 录屏 + 录脸(面部表情是最真实的反馈)
- 记录"出声思考"(Think Aloud):让玩家边玩边说在想什么
禁止
- ❌ "你试试按这个键" → 引导已经失败了,记下来
- ❌ "这里其实是要……" → 同上
- ❌ 只问"好玩吗?" → 玩家会礼貌地说好玩
12.3 定量指标(Telemetry / 手工统计)
即使没有埋点,试玩时也要手工统计这些:
| 指标 | 计算 | 健康值 |
|---|---|---|
| 完成率 | 完成该 Beat 的人数 / 到达人数 | ≥90%(非 Boss 段) |
| 首测通过率 | 一次通过的人数 / 尝试人数 | 40–70%(考试段) |
| 死亡次数 | 该段平均死亡数 | 教学段 <1;常规 <3;考试 3–8 |
| 卡住时长 | 决策点犹豫秒数 | ≤8 秒 |
| 迷路事件 | 走错方向/折返的次数 | 每关 ≤2 次 |
| 时长 | 实测 vs 设计 | 误差 ≤±40% |
| 放弃点 | 玩家停下的位置 | 任何一个都是红灯 |
| 重玩率 | 主动再玩一次的比例 | 越高越好 |
| 收集率 | 找到的收集品 / 总数 | 60–80%(太低=藏太深) |
埋点版本(有条件时)
事件: level_start / beat_enter / beat_exit / death / checkpoint / collect / quit
字段: 关卡ID, BeatID, 时间戳, 死亡原因, 重试次数, 当前进度%
关键漏斗:每个 Beat 的"进入→完成"转化率。转化率的异常下跌 = 卡点。
12.4 定性反馈:问什么
不要问:"好玩吗?""喜欢吗?""这个设计怎么样?"
要问(开放式,问事实不问评价):
- "刚才你在想什么?"(在关键决策点问)
- "你觉得接下来要做什么?"(测引导)
- "你为什么死在这里?"(测公平性)
- "哪一段你觉得最长/最短?"(测节奏)
- "如果只能删掉一段,你删哪段?"(测价值排序)
- "你能用一句话说说这个地方发生过什么吗?"(测环境叙事)
- "你记得哪几个画面?"(测 Beacon)
- "你想继续玩下去吗?为什么?"(测钩子)
12.5 试玩报告模板结构
见 templates/05。核心是把观察转成可执行的修改项:
| 观察 | 推断 | 修改项 | 优先级 |
|---|---|---|---|
| 5/6 玩家在 A3 岔路右转 | 左路看起来不像路 | 加宽左路 + 出口打光 | P0 |
| 3 人在 B2 死亡且说"不知道被什么杀了" | 无预警 | 加 0.5s 前摇 + 音效 | P0 |
| 平均时长 18 分钟 vs 设计 12 | C 段变奏过多 | 删 C3、C5 | P1 |
规则:每条观察必须有修改项。只记录不修改 = 没试玩。
12.6 迭代节奏
| 轮次 | 目标 | 允许改动范围 |
|---|---|---|
| 第 1 轮(灰盒) | 结构对不对 | 随便改,包括推倒重来 |
| 第 2 轮(灰盒) | 节奏与难度对不对 | Beat 增删、参数调整 |
| 第 3 轮(半成品) | 引导与可读性 | 视觉、灯光、标记 |
| 第 4 轮(成品) | 打磨 | 只调数值与细节,不改布局 |
| 第 5 轮(候选) | 验收 | 只修 bug |
迭代次数上限:每关 2–3 轮。超过 3 轮还不好玩 → 砍掉或重做,不要再修。
12.7 常见试玩发现与对应修改
| 症状 | 根因 | 修改 |
|---|---|---|
| 玩家走错路 | 主路视觉层级不足 | 加宽/打光/材质区分;或减少岔路 |
| 玩家不知道要干嘛 | 无可见目标 | 加远景地标 / 目标提示 |
| 玩家死了但不知道为什么 | 无预警 / 无归因 | 加前摇 + 死亡提示 |
| 玩家觉得太长 | Beat 过多或重复 | 删重复 Beat;加捷径 |
| 玩家觉得太简单 | 变奏不足 / 考试缺失 | 加 CV 组合段 |
| 玩家跳过收集品 | 回报无意义 / 路径不顺 | 让收集品在主路可见处 / 换回报类型 |
| 玩家停下来不玩了 | 无钩子 / 疲劳 | 检查最近 3 分钟是否有回报 |
| 玩家说"没什么印象" | 缺 Beacon | 加记忆点 |
| 玩家一直在问"这是哪" | 区域无辨识度 | 加主色 + 地标 + 形态母题 |
12.8 设计师自我校准
设计师玩了 100 次后已经不是玩家了。校准方法:
| 方法 | 说明 |
|---|---|
| 手残模拟 | 故意用非惯用手 / 限制自己只能用基础操作 |
| 断片模拟 | 隔 2 周再玩,模拟"回坑玩家" |
| 新手视角 | 找一个从没玩过该类游戏的人 |
| 禁用已知 | 假装不知道捷径与隐藏内容 |
| 数据优先 | 当主观判断与数据冲突,信数据 |
12.9 出货前验收清单(关卡维度)
- 全流程盲玩通关测试 ≥3 人,零 P0 卡死
- 每关实测时长在设计 ±40%
- 难度曲线无异常尖峰
- 零迷路事故(>8 秒犹豫)
- 所有收集品可达且可达率 60–80%
- 所有检查点生效,Boss 前有检查点
- 无不可通过/卡死位置(碰撞测试通过)
- 性能达标(最低配置机器测过)
- 无占位灰盒残留、无占位贴图
- 无 debug 物件/触发残留
12.10 自检清单
- 每关 ≥2 轮陌生试玩
- 试玩时设计师不提示、不解释
- 录屏 + 出声思考
- 定量指标已统计(完成率/死亡数/时长/卡住时长)
- 定性问题用了"问事实不问评价"的问法
- 每条观察都转成了修改项
- 迭代 ≤3 轮,超过则砍/重做
- 出货前验收清单全绿