适用场景
用户体验(UX)研究适用于:
- 产品改版:改版前了解现状、改版后验证效果;
- 可用性问题诊断:用户在哪一步卡住、流失、困惑;
- 新功能验证:功能上线前的可用性测试与概念验证;
- 体验旅程梳理:从认知到使用的完整旅程与关键时刻;
- 体验指标建立:UX 关键指标(任务完成率、满意度、流失点)监测。
核心业务问题
- 用户的核心任务是什么?完成顺利吗?
- 用户在旅程的哪个环节流失?为什么?
- 新设计/新功能是否比旧版更好用?
- 体验改进是否带来可衡量的业务收益?
推荐研究框架
体验研究组合
├─ 定性:可用性测试(发现“怎么用、卡在哪”)
├─ 定性:深访/日记(动机与场景)
├─ 定量:体验问卷 SUS/CSAT(规模化测量)
├─ 行为:埋点数据(任务漏斗、时长、流失点)
└─ 实验:A/B 测试(方案对比验证)
→ 痛点清单 → 旅程地图 → 优先级 → 改版 → 再验证
迭代节奏:开发前(探索)→ 开发中(测试)→ 上线后(测量),形成持续循环。
方法选择
| 阶段 | 推荐方法 | 样本 |
|---|---|---|
| 需求探索 | 深访/情境访谈 | 8–12 人 |
| 概念验证 | 概念测试/纸面原型 | 5–10 人/轮 |
| 可用性测试 | 任务式测试(出声思考) | 5–8 人/轮(多轮) |
| 体验量化 | SUS/CSAT 问卷 | ≥ 100/版本 |
| 行为验证 | 埋点 + 漏斗分析 | 全量 |
| 方案对比 | A/B 测试 | 按流量计算 |
| 线下门店体验 | 神秘顾客 | 覆盖计划见神秘顾客研究如何设计 |
可用性测试的铁律:5–8 名用户即可发现 80% 的可用性问题,重点是“多轮迭代”而非“一轮大样本”。
样本设计
- 可用性测试:5–8 人/轮 × 2–3 轮;招募真实目标用户(或高度相似人群);覆盖新手/普通/熟练用户;
- 体验问卷:≥ 100–200/版本(版本对比需 A/B 或前后测);追踪测量保持同一量表;
- 组合建议:定性(为什么)+ 定量(多少)+ 行为(真相)三源合一,互证互补。
问卷模块
可用性测试任务(示例):
- 请找到并完成“修改收货地址”;
- 请将商品加入收藏并分享给好友;
- 请完成一次结算流程(使用虚拟数据)。
体验问卷(SUS 系统可用性量表示例题):
- 我认为我会经常使用这个产品
- 我觉得这个产品没必要这么复杂
- 我认为这个产品用起来很简单
- 我需要技术人员的帮助才能使用这个产品 …(10 题,5 点量表)
其他模块:任务完成自评、CSAT、开放题(“最困扰你的地方?”)、背景(使用经验)。
设计要点
可用性测试中:任务给目标不给步骤(“把价格改为 200 元”而非“点设置按钮”);观察记录“卡点+情绪”;出声思考引导词标准化。
分析输出
- 可用性问题清单:按严重度分级(致命/严重/一般/轻微)× 频次,标注复现率;
- 任务指标:完成率、完成时长、出错率(对比旧版或基准);
- 旅程地图:触点 × 情绪 × 流失的可视化,标注关键时刻(Moments of Truth);
- SUS 得分:≥ 68 分及格线、> 80 优秀(行业常用基准);
- 行为验证:漏斗流失点、改进前后指标对比;
- 改进优先级:问题严重度 × 用户影响 × 成本矩阵;
- 迭代建议:每个问题的具体修改方案 + 复测计划。
常见错误
- 可用性测试样本求多不求轮:一轮 20 人不如三轮各 7 人——问题发现率随轮次递增;
- 测试用户非目标人群:朋友/同事代测,发现的问题不是真实用户的问题;
- 任务引导过细:把步骤都说了,测不到真实使用中的困惑;
- 只测方案不测基线:没有对比(旧版/竞品/基准),无法判断“好还是不好”;
- 忽略行为数据:问卷说“满意”但漏斗说“流失”——行为数据是真相;
- 一次测试包办所有:探索、测试、测量阶段混在一起,方法错位。
工具推荐
想自动整理可用性测试与体验问卷的分析?使用 SurveyKit Quant,自动计算 SUS、任务指标与问题优先级清单。