Playbook
产品诊断:四步扫一遍
你要两样东西:一套能反复用的诊断流程,加一批拿来练手的产品。流程就四步——先定靶子(谁的产品、核心动作、要办的事),走一遍关键路径做体检,对着一张固定清单逐项扫(Nielsen 十大可用性原则 + 高浓度词),最后写成三条问题 + 严重度 + 改法假设。素养靠刻意练习——不是刷一堆 App,而是每看一个就写一份诊断,再拿你的判断对照专家的 teardown 校准。文末给你一批分门别类、值得诊断的产品和现成的拆解库。
方法在前,练法和练材在后
先给方法论:一节讲诊断的前提(定靶子),一节给四步流程和那张固定清单,一节拿一个真产品从头走一遍给你看。再讲练法:怎么把"看产品"变成真能涨素养的刻意练习。最后给练材:一批分类的、值得诊断的产品,和现成的拆解库。想直接上手就先看第 2、3 节,想要练材直接跳第 5 节。
诊断的第一步,是先定靶子
没有靶子,任何"这里不好"都只是个人口味。一个产品不存在抽象的好坏,只有"能不能让某一类用户完成某一个动作"的好坏。所以打开任何产品,先定三件事:谁是目标用户、这产品最想让他做哪一个核心动作、他是来办什么事的(也就是上一篇说的 JTBD)。
定了靶子,你的每条判断才有参照系。"CTA 不行"成立,是因为你知道这一屏的核心动作是"注册",而注册按钮没被突出。换个产品,核心动作是"浏览内容",那满屏大按钮反而是问题。🟢 high 同一个设计,对不同靶子,诊断完全相反。
你打开一个完全陌生的 App,第一步该干什么?(提示:不是马上开始挑毛病。)先答再翻。
试着先答
先定靶子:看出它想服务谁、最想让你做哪一个动作。最快的办法是做"5 秒测试"——只看首屏五秒,你能不能说出"这是给谁的、想让我干嘛"。说不出,本身就是第一条诊断(价值主张和核心动作没传达清楚)。定不下靶子就开始挑毛病,你列的只是自己的审美偏好,不是诊断。
诊断从定靶子开始——没有"谁 + 哪个核心动作"这个参照系,所有"问题"都只是口味。
四步诊断流程 + 一张固定清单
方法论本体就四步,顺序固定:
- 定靶子——谁、哪个核心动作、办什么事。
- 走关键路径——以真实用户身份把核心路径走一遍(注册 → 第一次用出价值 → 核心循环),边走边记每一处卡顿、犹豫、想退出的点。
- 对清单逐项扫——拿一张固定清单挨条对,而不是凭感觉扫。这一步让诊断从"我觉得"变成"对照标准"。
- 写诊断——挑出最严重的三条,每条标严重度、给一个改法假设。
第 3 步那张清单,是整套方法的硬核。它由两部分拼成:Jakob Nielsen 的十大可用性原则(1990 年提出,至今是行业标准)1,加上一组高浓度设计词。所谓"启发式评估",就是让评估者对照这些公认原则,逐条检查界面、找出问题——成本低、好上手,任何能交互的东西都能用23。🟢 high
| 看哪一层 | 对照什么(清单节选) |
|---|---|
| 系统状态 | 用户随时知道现在发生了什么吗?(Nielsen:可见性 / 反馈)1 |
| 认知负荷 | 选项是不是太多(Hick)?要靠记忆还是能直接认出(识别优于回忆)? |
| 注意力 | 视觉层级清不清?核心动作 CTA 突不突出?首屏说没说清价值? |
| 阻力 | 核心路径有几步多余?表单有几个多余字段?默认值帮没帮用户填? |
| 容错 | 能不能防错、能不能撤销、出错了说不说人话?(Nielsen:错误预防 / 恢复)1 |
| 激活 | 新用户多快摸到 aha 时刻?空状态给没给清晰的下一步? |
严重度怎么定?按影响 × 频率 × 是否反复出现——同一个问题影响越大、碰到的人越多、越是每次都撞,就越该先修2。🟢 high 这一步逼你排序,而不是把一堆小毛病平铺。
四步流程里:① 定靶子 → ② 走关键路径 → ③ ? → ④ 写三条诊断。第 3 步是什么?为什么它最关键?
对答案
第 3 步:对着一张固定清单逐项扫(Nielsen 十原则 + 高浓度词)。它最关键,因为这是诊断和"凭感觉吐槽"的分界线——有固定清单,你不会漏掉系统性问题(比如容错、反馈),而且你是在拿产品对照公认标准,而不是对照自己今天的心情。少了这一步,前面定的靶子也白定。
四步:定靶、走路径、对清单扫、写三条诊断;那张固定清单是它从"凭感觉"变成"方法"的关键。
走一遍:一次完整诊断长什么样
拿一个常见场景演示:一个团队协作工具的新用户首次进入。把四步走完。
① 靶子:目标用户是小团队负责人;核心动作是"建第一个项目并拉同事进来";要办的事是"让团队在一个地方协作"。
② 走关键路径:注册要填 6 个字段(卡);进来是一个全空的界面,没有任何提示(卡);想建项目,按钮藏在右上角小图标里(卡);建完了不知道下一步怎么拉人(卡)。
③ 对清单扫:注册阻力过高(friction);空状态没引导(激活 / 新手引导缺失);建项目入口视觉层级太低(CTA + 层级);拉人这一步没有反馈和指引(系统状态 + 容错)。
④ 写诊断(按严重度排):1)空状态没把人引向第一个核心动作——影响激活,最严重,假设:进来就给一张"建项目"的引导卡。2)注册字段过多——卡在漏斗最前端,假设:砍到邮箱+密码,其余进来再补。3)建项目入口不显眼——假设:空状态里放一个大号主按钮。
产物不是一长串吐槽,是三条按严重度排好、各带一个改法假设的诊断。这就是一次诊断该有的样子。
把诊断写成 20 条小毛病的找茬清单:图标颜色、圆角大小、某个文案的标点……错在哪:没按严重度排,也没对着靶子,把"影响激活的致命问题"和"无关痛痒的像素"混成一锅。诊断是 top 3 by 影响,不是挑刺比赛2。
一次好诊断的产物,是按严重度排好的三条 + 改法假设,不是一长串毛病。
把"看产品"变成刻意练习
产品素养是练出来的,不是天生的——靠的是刻意练习:定期找新产品来拆解,养出"为什么有的产品好用、有的不好用"的直觉45。🟢 high 但"看量"本身不等于练习。刷一千张 Mobbin 截图,只是看过,不会涨素养。刻意练习的关键是主动 + 即时反馈:你得先做出判断,再拿到对错6。
所以练法是一个闭环:看一个产品,先自己写一份诊断(预测哪儿不好、该怎么改),再去对照专家的 teardown——Built for Mars 这类拆解专门讲"为什么这样设计有效或失败"7,拿它当你的"答案",校准你"什么叫好"的模型,然后看下一个。Julie Zhuo 把这一步叫"把你的判断拿给毕加索看"——不只是研究大师,是先亮出你的判断,再让专家批5。
有人说"看量不重要,关键是质"。一半对:漫无目的地刷确实没用。但在"先自己诊断、再对照反馈"的前提下,量是必要的——你"什么叫好"的模型,只有见得足够多才校得准;只看过三五个产品,你的标准就只来自这三五个样本。所以本讲稿要的是带反馈的量:每周固定诊断几个,而不是要么不看、要么瞎刷。
素养靠带反馈的量练出来:每看一个产品,先自己写诊断,再对专家拆解校准,然后看下一个。
一批可被诊断的产品
挑产品有个诀窍:优先选靶子清楚、反馈快的。下面这批各自最值得学一类东西,拿来对照练手正好。
| 产品 / 类别 | 最值得学什么 | 诊断时盯哪儿 |
|---|---|---|
| Duolingo | 游戏化 onboarding 与留存 | 新手怎么被一步步带到 aha;连续打卡、即时反馈怎么留人 |
| Notion | 复杂工具的上手门槛 | 空状态、模板、渐进披露;强大但陡的上手曲线怎么缓 |
| 电商结账(亚马逊等) | 漏斗与减阻力 | 结账几步、一键下单、游客结账;每多一步漏多少人 |
| 订阅类(Calm / Headspace) | 订阅漏斗与付费墙 | 免费到付费怎么过渡、付费墙摆在哪、试用怎么设计 |
| 内容流(抖音 / 小红书) | 核心循环与上瘾设计 | 核心动作的循环、可变奖励、停止线索被怎么消灭 |
| 任意银行 / 政务 App | 反面教材:堆积的阻力 | 哪些步骤本可省、哪些术语没说人话、错误提示像不像天书 |
对照用的"标准答案"去这几个库找:Built for Mars——讲"为什么"的 UX 案例拆解7;Mobbin——上千个 App、几十万张截图和流程,看"别人做成什么样"8;Growth.Design——用心理学拆产品的图文案例9;UserOnboard——专拆新手引导流程11。Mobbin 给"是什么"、Built for Mars 给"为什么",两个配着看最划算10。🟡 med
这批产品,你该从哪类先练?为什么?
试着先答
从你天天用、且转化目标清晰的 C 端产品起——电商结账、订阅 App:靶子一眼能定(让你下单 / 让你订阅),路径短、反馈快,容易判对错。别一上来啃 Notion 这种 B 端复杂工具:靶子模糊、路径长,新手很容易钻进像素细节出不来。先在简单清楚的产品上把四步走顺,再上复杂的。
先挑靶子清楚的日常产品练,边诊断边对照拆解库校准,量上去素养就上来。
所以这套方法和练法怎么用
方法论就一句话:把产品诊断当成一次启发式评估——定靶子 → 走关键路径 → 对固定清单(Nielsen 十原则 + 高浓度词)逐项扫 → 写出按严重度排的三条问题加改法假设1。它把"我觉得"换成可复用、可对照标准的流程。练法也一句话:产品素养靠刻意练习,而刻意练习 = 带反馈的量——每看一个产品先自己写诊断,再对照 Built for Mars、Growth.Design 这类专家拆解校准你"什么叫好"的模型5。练材就用第 5 节那批靶子清楚的产品起步。把这套跑上几十遍,你看产品的眼睛就换了。
什么时候这套不够用:启发式评估查的是"好不好用",查不出"该不该存在"。一个产品可以每条清单都过关,却根本没人需要——那是用户需求和市场的问题,得靠真实用户研究和数据,不是对着清单扫能看出来的。所以这套方法管"怎么做得更好"这一层;"这东西到底有没有人要"那一层,清单帮不了你。
这几处我说实话也没全把握
- 清单查可用性,查不出值不值得做。启发式评估能挑出"难用",挑不出"没人要"——后者得靠用户研究和真实数据。别把"每条都过"当成"这是个好产品"。
- "什么叫好"会随场景和时间变。B 端和 C 端的标准不一样,移动端改写了很多桌面端习惯,文化差异也在。清单是地板不是天花板,练的时候要带着"对谁、在什么场景"去看。
- 产品素养怎么练,多是经验总结。"刻意练习 + 反馈"方向可信6,但"练多少个产品能到什么水平"没有硬数据,因人而异。
读完盖住,试着答这几题
诊断的四步是什么?为什么第一步是"定靶子"?
试着先答
定靶子 → 走关键路径 → 对固定清单逐项扫 → 写按严重度排的三条诊断 + 改法假设。先定靶子,是因为产品没有抽象好坏,只有"能不能让某类用户完成某个核心动作"的好坏;没有靶子,所有判断都只是个人口味。
"看大量产品"为什么不等于练习?怎么才算刻意练习?
试着先答
光看是被动浏览,不涨素养。刻意练习要主动 + 即时反馈:每看一个产品先自己写诊断(做出判断),再对照专家 teardown 校准(拿到反馈),更新"什么叫好"的模型,再看下一个。带反馈的量,才算练。
应用题:一个 App 每条可用性清单都过了,但上线后没人用。问题最可能出在哪?这套方法能查出来吗?
试着先答
最可能是"没人需要"——需求 / 市场问题,不是可用性问题。启发式评估查"好不好用",查不出"该不该存在"。这层得靠真实用户研究和数据,清单扫不出来。
把这几题截图,过两三天再凭记忆答一遍 —— 记得住才算真学会。
Sources
- Nielsen Norman Group — 10 Usability Heuristics for User Interface Design — https://www.nngroup.com/articles/ten-usability-heuristics/
- Nielsen Norman Group — How to Conduct a Heuristic Evaluation(含严重度评级) — https://www.nngroup.com/articles/how-to-conduct-a-heuristic-evaluation/
- UXtweak — How to Conduct Heuristic Evaluation with Nielsen's 10 Heuristics — https://blog.uxtweak.com/usability-heuristics/
- Lenny's Newsletter(Jules Walter)— How to develop product sense — https://www.lennysnewsletter.com/p/product-sense
- Lenny's Newsletter — Julie Zhuo on building product sense(把判断拿给"毕加索"批) — https://www.lennysnewsletter.com/p/episode-2-julie-zhuo
- James Clear — The Beginner's Guide to Deliberate Practice — https://jamesclear.com/deliberate-practice-theory
- Built for Mars — UX case studies(讲"为什么") — https://builtformars.com/
- Mobbin — UI & UX design reference library(上千 App、数十万截图与流程) — https://mobbin.com/
- Growth.Design — Product psychology case studies — https://growth.design/case-studies
- Mobbin Blog — Mobbin × Built for Mars(「是什么」配「为什么」) — https://mobbin.com/blog/2024-03-25-bfm-partnership
- UserOnboard — Teardowns of popular products' onboarding — https://www.useronboard.com/