Jakob Nielsen 的研究表明:对 5 位目标用户进行可用性测试,可以发现约 85% 的可用性问题。更多用户带来的边际收益急剧递减。资源有限时,多轮 5 人小测试远胜于一次大型测试。
团队通常面临两个极端:要么等待一次昂贵的大规模用户测试(耗时数月,产出堆叠报告,发现的问题根本来不及修);要么干脆不测试(直接上线,在真实用户身上发现问题)。
Nielsen 在 1993 年通过研究证明了第三条路。可用性问题的发现遵循边际递减规律:第 1 位用户揭示最明显的核心问题,到第 5 位用户,你已经开始重复听到相同的问题——收益开始急剧下降。
真正的洞见不是「5 个用户」本身,而是「多轮 5 人迭代测试」的节奏:测 5 人 → 发现问题 → 修复 → 再测 5 人 → 发现新问题 → 再修复。三轮下来,15 个人就解决了你本来需要 45 个人才能解决的问题——而且已经修好了前两轮发现的 bug。
理解 5 用户法则的关键,是理解两件事:为什么边际收益在第 5 人后骤降,以及如何通过迭代轮次最大化每一个测试用户的价值。
5 用户可用性测试适合任何需要快速发现真实交互问题的节点,特别是在开发周期内嵌入的迭代测试,而非作为发布前的一次性审查。
TurboTax 的报税产品是市场上最复杂的消费级软件之一——用户需要在压力下完成数十步操作,任何一个可用性问题都可能导致用户放弃并转向竞品。Intuit 从 2000 年代初开始,将每年的产品迭代建立在多轮 5 用户测试循环上。
以下是一个完整的迭代测试周期记录,展示了三轮测试如何在三个月内将核心可用性问题逐步消除。
5 用户法则很容易被误解为「只测 5 个人」,但真正的价值在于迭代节奏和测试质量。
"测试5个用户就足够发现85%的可用性问题"这一结论,来自可用性研究之父雅各布·尼尔森与数学家托马斯·兰道尔1993年发表的经典论文。这项研究将可用性测试从昂贵的大规模项目转变为任何产品团队都能负担的日常实践,深刻改变了互联网时代软件产品的迭代节奏。