Axıs
技能目录

12 · 试玩、度量与迭代

12 · 试玩、度量与迭代

你不是玩家。你的判断在试玩面前一律无效。

12.1 试玩的三个层级

层级 何时 参与者 看什么
T1 自检 每天 自己 能不能跑通、有没有崩溃
T2 内部试玩 每周 团队/朋友(知道设计) 手感、时长、难度
T3 陌生试玩 每里程碑 完全不了解的人 引导、理解、留存、情绪

只有 T3 是有效的。 T1/T2 只能发现"坏掉的",不能发现"不好玩的"和"看不懂的"。

12.2 陌生试玩的执行规范

人数与频次

  • 每次 5–8 人(5 人能发现 ~85% 的问题)
  • 每关至少 2 轮陌生试玩(灰盒 1 轮 + 成品 1 轮)
  • 关键关卡(教学、首 Boss、结局)需要 ≥8 人

观察规范(强制)

  • 不解释、不提示、不救场。玩家卡住就让他卡。
  • 设计师只看不说,直到玩家结束。
  • 录屏 + 录脸(面部表情是最真实的反馈)
  • 记录"出声思考"(Think Aloud):让玩家边玩边说在想什么

禁止

  • ❌ "你试试按这个键" → 引导已经失败了,记下来
  • ❌ "这里其实是要……" → 同上
  • ❌ 只问"好玩吗?" → 玩家会礼貌地说好玩

12.3 定量指标(Telemetry / 手工统计)

即使没有埋点,试玩时也要手工统计这些:

指标 计算 健康值
完成率 完成该 Beat 的人数 / 到达人数 ≥90%(非 Boss 段)
首测通过率 一次通过的人数 / 尝试人数 40–70%(考试段)
死亡次数 该段平均死亡数 教学段 <1;常规 <3;考试 3–8
卡住时长 决策点犹豫秒数 ≤8 秒
迷路事件 走错方向/折返的次数 每关 ≤2 次
时长 实测 vs 设计 误差 ≤±40%
放弃点 玩家停下的位置 任何一个都是红灯
重玩率 主动再玩一次的比例 越高越好
收集率 找到的收集品 / 总数 60–80%(太低=藏太深)

埋点版本(有条件时)

事件: level_start / beat_enter / beat_exit / death / checkpoint / collect / quit
字段: 关卡ID, BeatID, 时间戳, 死亡原因, 重试次数, 当前进度%

关键漏斗:每个 Beat 的"进入→完成"转化率。转化率的异常下跌 = 卡点。

12.4 定性反馈:问什么

不要问:"好玩吗?""喜欢吗?""这个设计怎么样?"

要问(开放式,问事实不问评价):

  1. "刚才你在想什么?"(在关键决策点问)
  2. "你觉得接下来要做什么?"(测引导)
  3. "你为什么死在这里?"(测公平性)
  4. "哪一段你觉得最长/最短?"(测节奏)
  5. "如果只能删掉一段,你删哪段?"(测价值排序)
  6. "你能用一句话说说这个地方发生过什么吗?"(测环境叙事)
  7. "你记得哪几个画面?"(测 Beacon)
  8. "你想继续玩下去吗?为什么?"(测钩子)

12.5 试玩报告模板结构

见 templates/05。核心是把观察转成可执行的修改项:

观察 推断 修改项 优先级
5/6 玩家在 A3 岔路右转 左路看起来不像路 加宽左路 + 出口打光 P0
3 人在 B2 死亡且说"不知道被什么杀了" 无预警 加 0.5s 前摇 + 音效 P0
平均时长 18 分钟 vs 设计 12 C 段变奏过多 删 C3、C5 P1

规则:每条观察必须有修改项。只记录不修改 = 没试玩。

12.6 迭代节奏

轮次 目标 允许改动范围
第 1 轮(灰盒) 结构对不对 随便改,包括推倒重来
第 2 轮(灰盒) 节奏与难度对不对 Beat 增删、参数调整
第 3 轮(半成品) 引导与可读性 视觉、灯光、标记
第 4 轮(成品) 打磨 只调数值与细节,不改布局
第 5 轮(候选) 验收 只修 bug

迭代次数上限:每关 2–3 轮。超过 3 轮还不好玩 → 砍掉或重做,不要再修。

12.7 常见试玩发现与对应修改

症状 根因 修改
玩家走错路 主路视觉层级不足 加宽/打光/材质区分;或减少岔路
玩家不知道要干嘛 无可见目标 加远景地标 / 目标提示
玩家死了但不知道为什么 无预警 / 无归因 加前摇 + 死亡提示
玩家觉得太长 Beat 过多或重复 删重复 Beat;加捷径
玩家觉得太简单 变奏不足 / 考试缺失 加 CV 组合段
玩家跳过收集品 回报无意义 / 路径不顺 让收集品在主路可见处 / 换回报类型
玩家停下来不玩了 无钩子 / 疲劳 检查最近 3 分钟是否有回报
玩家说"没什么印象" 缺 Beacon 加记忆点
玩家一直在问"这是哪" 区域无辨识度 加主色 + 地标 + 形态母题

12.8 设计师自我校准

设计师玩了 100 次后已经不是玩家了。校准方法:

方法 说明
手残模拟 故意用非惯用手 / 限制自己只能用基础操作
断片模拟 隔 2 周再玩,模拟"回坑玩家"
新手视角 找一个从没玩过该类游戏的人
禁用已知 假装不知道捷径与隐藏内容
数据优先 当主观判断与数据冲突,信数据

12.9 出货前验收清单(关卡维度)

  • 全流程盲玩通关测试 ≥3 人,零 P0 卡死
  • 每关实测时长在设计 ±40%
  • 难度曲线无异常尖峰
  • 零迷路事故(>8 秒犹豫)
  • 所有收集品可达且可达率 60–80%
  • 所有检查点生效,Boss 前有检查点
  • 无不可通过/卡死位置(碰撞测试通过)
  • 性能达标(最低配置机器测过)
  • 无占位灰盒残留、无占位贴图
  • 无 debug 物件/触发残留

12.10 自检清单

  • 每关 ≥2 轮陌生试玩
  • 试玩时设计师不提示、不解释
  • 录屏 + 出声思考
  • 定量指标已统计(完成率/死亡数/时长/卡住时长)
  • 定性问题用了"问事实不问评价"的问法
  • 每条观察都转成了修改项
  • 迭代 ≤3 轮,超过则砍/重做
  • 出货前验收清单全绿