做心理测评产品时,常有人把用户测试理解成发问卷问「喜不喜欢」。喜欢是态度;完不成、看不懂、被标签吓到,才是产品要修的问题。测试也不是神秘洞察,而是在可控任务里观察行为。
测什么
- 能否在限定步骤内开始作答并提交
- 题目与选项是否被理解成设计意图
- 结果页是否读得懂:含义、边界、下一步
- 在手机上是否卡顿、误触、中断后能否续测
方法可以是可用性测试、出声思维、完成率与漏斗,而不是只看五星好评。记录要写清:卡在哪一屏、原话怎么误解题目、花了多久。同一任务至少观察几名真实目标用户,避免只测同事。
也可以设对照:旧结果页与新结果页各测一轮,只改文案或信息层级,看完成与理解是否变化。这样改版才有依据。
伦理边界
涉及情绪内容时,要说明用途、可退出、数据如何用;高风险结果页应避免恐吓式文案。测试记录服务于改产品,不应变成对受试者的人格评价档案。未成年人与组织强制测评场景,同意与权限要更严。
橙星云这类测评系统在迭代报告提示、施测流程时,同样应靠任务观察与完成路径,而不是用无法核对的报告总量证明「已经懂用户」。
用户测试有用,是因为它暴露真实摩擦:哪一句说明多余、哪一屏该加「这不是诊断」。问「好不好」太粗;问「卡在哪」才能改。
测试纪要里记下原话比记下分数更有用:用户怎么误解选项,产品就改哪里。
