怎么把「找 PMF」拆成一串可检验的假设
「这个季度的目标是找到 PMF」——这句话看上去像目标,实际上不能执行。它没说要做什么,没说做完之后怎么算数,也没说什么情况下算它没成。
a16z 2017 年那篇总结 PMF 的十二条要点,第 3 条给的是另一种说法:PMF 是个过程,运气确实存在,但它存在于一套可重复、可检验的方法之内,推进方式是假设驱动的迭代(A5.1#3)。
重心在「可检验」三个字上。本站的判断是,这条要点在实践里失效,通常不是因为没人想到要提假设,而是写下来的那句话本身没法被检验。
一、你写下来的多半是愿望,不是假设
常见的形态是这样几句:
- 用户需要一个更省事的方案。
- 我们的产品比竞品体验更好。
- 做出来应该会有人用。
这三句都不是假设,是愿望。愿望的识别方法只有一条:不管后面发生什么,它都不会被推翻。产品没人用,可以解释成「省事那个点还没做到位」;有人用了,可以解释成「果然是需要的」。一句怎么样都不会错的话,指导不了下一步做什么。
假设长得不一样。它是一句你主动去撞的话——你写它的时候就已经想好了它可能会碎,也想好了碎的时候是什么样子。
一个可以照抄的写法:
【某一类具体的人】在【某个具体场合下】会【做某个具体动作】,因为【某个具体的理由】。
我打算通过【看什么】来判断它站住了; 如果出现【什么结果】,就算它倒了。
四个中括号填完,句子就从愿望变成了假设。后面那两行是最常被略过的部分,也正是「可检验」的全部含义所在。
二、一条合格的假设要填满四个格子
把上面那个模板拆开,就是四个格子。缺任何一个,这条假设都跑不动:
- 主语是一群能被指认出来的人。 不是「用户」「大家」「中小企业」,而是你能说出他们平时在哪儿、干什么活、这件事一周发生几次的一群人。主语越模糊,后面三格全都失效——因为你不知道该去问谁、看谁。
- 谓语是一个会发生或不会发生的动作。 「觉得有用」「感兴趣」「认可价值」都不是动作,因为它们无法被观察到。付费、回来用第二次、把链接转给同事、主动来问什么时候上某个功能——这些才是。
- 判据:你打算看什么才算它站住了。 判据必须在你动手之前先写死。事后再定判据,等于允许自己按结果挑标准。
- 证伪条件:什么结果出现就算它倒了。 这一格最常缺。
第 4 格缺了会发生什么,是可以推演的(这是本站的判断,依据在 A5.1#3 的「可检验」上):没有证伪条件的假设,任何结果都能被解释成「还需要再迭代一下」。 于是迭代变成了没有出口的循环——每一轮都在改,每一轮都没有结论,跑了半年之后你说不清哪条假设已经站住、哪条已经倒了。
a16z 那篇的第 6 条正好写了这个循环的终点形态:创始人经常把早期的一点起色误当成真的 PMF(A5.1#6)。本站的判断是,这两件事是同一件事的两头——没有事先定下的证伪条件,「一点起色」就是唯一能拿到手的东西,而它天然会被读成好消息。
三、拆的顺序:价值假设在前,增长假设在后
一串假设不是平铺的,它有依赖关系。a16z 那篇里把最粗的那一刀已经切好了(A5.3):
- 价值假设——说清楚「客户为什么会用你的产品」。它要回答造什么、谁需要、怎么交付。
- 增长假设——只有在价值假设被验证之后才做,它关注的是怎么规模化地获客。
这个先后不是建议,是那篇文章里的明确排序。它对应的风险在第 9 条:在验证 PMF 之前扩张,会失败(A5.1#9)。同一篇文章里还引用过一个说法,称大约七成的创业公司存在过早扩张的问题——这个数字是那篇 2017 年的文章转引自更早的材料,源头本站没有追到,所以它只能当一句被引用过的说法看,不作为判断依据。
顺序颠倒在实践里的样子很具体(本站判断):假设表最上面几条全是「投哪个渠道更划算」「获客成本能压到多少」「发布日能带来多少访问」,而「谁、在什么场合、因为什么理由会掏钱」那一格还空着。这时候你跑的每一轮实验都在测量一个尚未成立的东西的传播效率。
一个简单的排序办法:把你的假设一条条摆开,问每一条「如果它成立,能不能推出下一条」。推不动的,说明中间缺了一条没写出来的假设,补上。能推动的,就是它们的依赖顺序。价值那一串排完之前,增长那一串先按住不动。
四、判据可以是定性的——2007 年那批判据一个数字都没有
第 3 格「判据」容易卡住,卡点通常在一个默认前提上:判据得是一个百分比。它不必是。
2007 年 Andreessen 那篇文章里给的「没到 PMF」的症状是六条(A2.3):客户没有从产品里拿到足够的价值;口碑传播很慢;使用量涨得不快;媒体报道反应平淡;销售周期拖得很长;交易频繁地谈崩。
「到了」的症状也是六条(A2.4):客户买的速度快过你能生产的速度;使用量涨的速度快过你能加服务器的速度;客户的钱不断进来;在拼命招销售和客服;媒体主动找上门要采访;开始拿创业者奖项。
这十二条全是定性描述,一个数字都没有。它们本身就是「判据可以怎么写」的示范。
但这十二条有个前提必须说清楚:它们描述的是一家融过资、有销售团队、有服务器扩容压力的公司。 一个独立开发者身上不会出现「在拼命招销售」这种症状。把这组症状搬到个人产品上需要一次换算,而换算办法是本站的推演,不是那篇文章里的内容:
| 2007 年那篇写的症状 | 换到个人产品上看什么 |
|---|---|
| 口碑传播很慢 | 有没有人在你没提醒的情况下把链接转给了别人 |
| 销售周期拖得很长 | 从对方第一次接触到掏钱,中间隔了多久,你推了几次 |
| 交易频繁地谈崩 | 试用到期后,有多少人是自己回来问续费的 |
| 客户的钱不断进来 | 上个月的收入里,有多少来自你这个月完全没管过的人 |
| 使用量涨得快过你加服务器 | 有没有出现你自己没预料到的用法或用量峰值 |
换算的原则是保留结构、替换载体:症状说的是那件事的机制(价值有没有溢出到你之外),换的只是它在小规模上的表现形式。
五、判据要贴着行为写,不要挂在总量指标上
把判据挂在注册数、日活这类总量指标上,是第 3 格另一种失效方式。
a16z 那份消费级 AI 应用榜单第 6 版(2026-03-09 发布,榜单数据截至 2026 年 1 月)里,作者自己写了一句话:这个排名越来越低估了人们用得最多的那些 AI 产品。文中举的例子是——一个每天泡在 Claude Code 里八小时的开发者是不折不扣的重度 AI 用户,但在网页流量数据里几乎体现不出来(B4)。
一家把「排 AI 应用榜」做成招牌的机构,手里拿着专业的流量与月活数据源,仍然要在自己最新一版榜单里给口径打这个补丁。本站由此得出的判断是:总量指标和「你的假设成立与否」之间隔着好几层,隔的层数越多,判据越钝。一个人拿注册数去判断价值假设有没有站住,钝的程度只会更高。
可操作的替代做法:判据直接抄你假设里第 2 格那个动作。假设里写的是「会把链接转给同事」,判据就是这个月有几个人是别人转来的;写的是「会回来用第二次」,判据就是首次使用之后七天内回来的那批人具体做了什么。数值可以很小——个位数也是数据,因为你要的不是统计显著性,是这条假设站没站住。
六、假设表是活的,不是一次性写完的清单
Superhuman 在 2018 年那篇复盘里的四步流程,最后一步是循环:持续对新用户发问卷,并且每个季度按新的回答重建一次路线图(A4.2)。落到假设表上是同一个动作——每跑完一轮,做三件事:
- 站住的那几条挪进「已验证」,并写清是靠什么判据站住的;
- 倒了的那几条不要删,写清它是怎么倒的——被推翻的假设是你手上最贵的东西,它划掉了一整片你不用再试的区域;
- 这一轮新冒出来的疑问,按第二节那四个格子补全,排进队列。
「已验证」那一栏也不是永久的。a16z 那篇的第 8 条把几个迷思列了出来,其中一个就是「PMF 是一次性的、大爆炸式的事件」;文中转述 Ben Horowitz 的观点:PMF 是迭代的、连续的,而且如果停止适应就会丢掉(A5.4)。这是 2017 年就写在那篇文章里的判断,不是为了讲 AI 产品才发明的新概念。对做 AI 产品的人来说,它的现实含义是:价值假设里那句「因为某个理由」,理由本身可能会被外部变化掏空——所以已验证那一栏需要定期回看,而不是封存。
七、今天就能做完的一件事
拿一个空文件,把你手上产品此刻正在赌的东西全部写成编号假设,然后:
- 每条按四个格子过一遍:人、动作、判据、证伪条件。四格填不满的,就地补,补不出来的划掉——那条本来就是愿望。
- 给每条标上「价值」还是「增长」。
- 把价值那一串按依赖顺序排开,推不动的地方插一条新的。
- 增长那一串整体挪到价值串的后面,暂时不动它。
- 挑出最上面那一条,只跑它。
跑完一轮回来改这张表,就是第 3 条说的那个「可重复、可检验的方法」在你手上的样子(A5.1#3)。
与站内既有课程的分工
站内 L5 阶梯有一篇讲从竞品差评里挖需求的课,里面给了一个需求假设的填空模板——那篇解决的是单条假设怎么成形,材料从哪儿来、怎么把一句吐槽变成一条可以写下来的话。这篇讲的是另一层:一串假设怎么排顺序、每条怎么定证伪条件、判据该贴着什么写。
L9 阶梯有一篇讲数据闭环和一周迭代节奏的,讲的是 build-measure-learn 这个循环怎么转起来、最少要埋哪些点。那篇讲循环怎么转,这篇讲循环里跑的那个东西要长成什么样才转得动——一条没有证伪条件的假设塞进那个循环里,循环转得再快也出不来结论。
L9 还有几篇在讲投放和分发时,反复用「到了 PMF 再放量」当决策开关。那几篇告诉你到了之后该做什么,这篇讲的是怎么把「到没到」这个含糊的问题,拆成一串能一条条销掉的句子。
延伸阅读
本篇提到的站内课程,可以直接接着往下读:
名词不熟可以先看术语页:PMF(产品市场契合)