适用场景

用户体验(UX)研究适用于:

  • 产品改版:改版前了解现状、改版后验证效果;
  • 可用性问题诊断:用户在哪一步卡住、流失、困惑;
  • 新功能验证:功能上线前的可用性测试与概念验证;
  • 体验旅程梳理:从认知到使用的完整旅程与关键时刻;
  • 体验指标建立:UX 关键指标(任务完成率、满意度、流失点)监测。

核心业务问题

  • 用户的核心任务是什么?完成顺利吗?
  • 用户在旅程的哪个环节流失?为什么?
  • 新设计/新功能是否比旧版更好用?
  • 体验改进是否带来可衡量的业务收益?

推荐研究框架

体验研究组合
├─ 定性:可用性测试(发现“怎么用、卡在哪”)
├─ 定性:深访/日记(动机与场景)
├─ 定量:体验问卷 SUS/CSAT(规模化测量)
├─ 行为:埋点数据(任务漏斗、时长、流失点)
└─ 实验:A/B 测试(方案对比验证)
→ 痛点清单 → 旅程地图 → 优先级 → 改版 → 再验证

迭代节奏:开发前(探索)→ 开发中(测试)→ 上线后(测量),形成持续循环。

方法选择

阶段推荐方法样本
需求探索深访/情境访谈8–12 人
概念验证概念测试/纸面原型5–10 人/轮
可用性测试任务式测试(出声思考)5–8 人/轮(多轮)
体验量化SUS/CSAT 问卷≥ 100/版本
行为验证埋点 + 漏斗分析全量
方案对比A/B 测试按流量计算
线下门店体验神秘顾客覆盖计划见神秘顾客研究如何设计

可用性测试的铁律:5–8 名用户即可发现 80% 的可用性问题,重点是“多轮迭代”而非“一轮大样本”。

样本设计

  • 可用性测试:5–8 人/轮 × 2–3 轮;招募真实目标用户(或高度相似人群);覆盖新手/普通/熟练用户;
  • 体验问卷:≥ 100–200/版本(版本对比需 A/B 或前后测);追踪测量保持同一量表;
  • 组合建议:定性(为什么)+ 定量(多少)+ 行为(真相)三源合一,互证互补。

问卷模块

可用性测试任务(示例):

  1. 请找到并完成“修改收货地址”;
  2. 请将商品加入收藏并分享给好友;
  3. 请完成一次结算流程(使用虚拟数据)。

体验问卷(SUS 系统可用性量表示例题)

  1. 我认为我会经常使用这个产品
  2. 我觉得这个产品没必要这么复杂
  3. 我认为这个产品用起来很简单
  4. 我需要技术人员的帮助才能使用这个产品 …(10 题,5 点量表)

其他模块:任务完成自评、CSAT、开放题(“最困扰你的地方?”)、背景(使用经验)。

设计要点 可用性测试中:任务给目标不给步骤(“把价格改为 200 元”而非“点设置按钮”);观察记录“卡点+情绪”;出声思考引导词标准化。

分析输出

  • 可用性问题清单:按严重度分级(致命/严重/一般/轻微)× 频次,标注复现率;
  • 任务指标:完成率、完成时长、出错率(对比旧版或基准);
  • 旅程地图:触点 × 情绪 × 流失的可视化,标注关键时刻(Moments of Truth);
  • SUS 得分:≥ 68 分及格线、> 80 优秀(行业常用基准);
  • 行为验证:漏斗流失点、改进前后指标对比;
  • 改进优先级:问题严重度 × 用户影响 × 成本矩阵;
  • 迭代建议:每个问题的具体修改方案 + 复测计划。

常见错误

  1. 可用性测试样本求多不求轮:一轮 20 人不如三轮各 7 人——问题发现率随轮次递增;
  2. 测试用户非目标人群:朋友/同事代测,发现的问题不是真实用户的问题;
  3. 任务引导过细:把步骤都说了,测不到真实使用中的困惑;
  4. 只测方案不测基线:没有对比(旧版/竞品/基准),无法判断“好还是不好”;
  5. 忽略行为数据:问卷说“满意”但漏斗说“流失”——行为数据是真相;
  6. 一次测试包办所有:探索、测试、测量阶段混在一起,方法错位。
工具推荐 想自动整理可用性测试与体验问卷的分析?使用 SurveyKit Quant,自动计算 SUS、任务指标与问题优先级清单。