Superhuman 那套 PMF 引擎,一个人能不能复用

2026-08-25

Superhuman 创始人 Rahul Vohra 在 First Round Review 上那篇复盘(2018-11-13)里给了一整套流程:发问卷、把回答「非常失望」的人单独拎出来、搞清他们喜欢什么、按一半一半的配比排路线图、然后持续对新用户再问一轮(A4.2)。写得完整,步骤清楚,看上去可以直接抄。

然后你打开自己的后台,看到上个月新增的活跃用户,一屏就能列完。

这篇只回答一个问题:那套流程里,哪些部分和你有几个人无关,哪一步你必须改掉才跑得动。

一、先看清这套引擎原本跑在什么条件上

那篇复盘里给了三个时点的分数(A4.1):2017 年夏天起步时是 22%,做完用户分段之后到 33%,再过三个季度到 58%。这是 2017 到 2018 年之间的历史快照,不代表现在。

真正值得注意的不是这三个数,是它们之间的间隔:以季度为单位。而四步流程的最后一步写得很明白——持续对新用户发问卷,每季度重建一次路线图(A4.2)。

这里有一个没被写出来的前提:每个季度都得有一批够数的新用户可以问

有说法认为,这类问卷至少要约 30 份有效回答才有参考价值,到 100 份以上信心才明显更高(A3.2,这个建议本站只见于转述,未追到一手出处)。新用户来得慢的产品,攒到第一个门槛的周期要按季度算,攒到第二个门槛的周期长到没有决策价值——等你凑够了,产品早就不是当初那个产品了。

本站的判断是:这套引擎被卡住的地方只有一处,就是 A4.2 的第四步「循环测量」。它依赖的是新用户流量,而不是人手。其余三步被卡住的程度,比大多数人以为的小得多。

二、四步拆开,哪两步与规模无关

把 A4.2 的四步按「它到底是什么性质的活」重新归类一遍:

步骤是什么性质的活一个人跑得动吗
① 分段找到支持者读的活跑得动,而且更轻松
② 分析反馈、看谁能转化读的活跑得动,而且更轻松
③ 一半强化、一半清阻碍分配的活跑得动,但计量单位要换
④ 循环测量、每季重排节奏的活跑不动,必须改

第①②步为什么反而更轻松(本站的判断,依据 A4.2 与 A4.3):这两步的工作量随样本量上升,不随样本量下降。几十份回答,你能一份一份逐字读完,谁说了什么话你能记住。样本量到了几百上千,才必须先归类、打标签、统计词频——那套归类动作本身会把用户的原始措辞磨掉一层,而 A4.3 恰恰强调画像要用用户自己的措辞和关键词,不是用你的行业黑话。样本小的时候你天然就在用原话。

第③步要换的是计量单位。 那一步说的是一半资源强化用户已经喜欢的地方、一半资源处理阻碍,并优先做低成本高影响的(A4.2)。公司的「资源」是人月,一个人的资源是每周能真正坐下来写代码的那几段时间。配比可以照抄,但你得先知道自己一周有多少可支配的开发时间,否则「一半一半」是句空的。

三、分数这一项,一个人先别要

一个人跑这套流程,最该丢掉的恰恰是那个最出名的百分比。

理由一,样本量不够(A3.2)。这条上一节已经说了。

理由二,小样本下分数的抖动大过真实变化(本站的判断)。回答总数很少的时候,一个人从「有点失望」改口成「非常失望」,分数就能跳好几个百分点。你做完一轮改动,看到分数动了,分不清动的是产品还是名单里换了两个人。这时候把分数当指标看,看的是噪音。

理由三,连专业机构拿着专业数据都在承认自己量不准这个品类。 a16z 的消费级生成式 AI 应用榜第 6 版(2026-03-09 发布,榜单数据截至 2026 年 1 月)在原文里明确承认:它的排名越来越低估了人们用得最多的那些 AI 产品(undercount the AI products people use most)。它举的例子是,一个每天泡在 Claude Code 里八小时的开发者显然是重度 AI 用户,可在网页流量数据里几乎体现不出来(B4)。

这三条串起来是一个意思:在这个品类里,把一个用户的真实依赖程度压缩成一个数,本来就会损失掉最重要的那部分信息。 机构拿着 SimilarWeb 和 Sensor Tower 的量级数据尚且如此,你拿一小把问卷算出来的百分比,精度只会更低。

那不要分数要什么?要名单和原话。A4.3 给的高期待用户定义是:目标客群里最苛刻、最能从核心价值里获益、并且会主动推荐的那批人;筛选办法是从回答「非常失望」的人里提取,依据他们对「你觉得谁最能从这个产品受益」的回答来构建画像。

画像不需要 100 份回答。 几个人的原话里如果反复出现同一组词,那已经是信号了。a16z 2017 年那篇十二条里的第 5 条也是这个意思:认出 PMF 靠的是大量客户产生共鸣的那一刻,这需要定性判断,不是纯看数(A5.1)。

四、2007 年那两组症状,换算到一个人身上

在问卷和分数被发明出来之前,判据是纯定性的。Andreessen 2007 年那篇里列了「到了」的六条症状(A2.4):客户买的速度快过你能生产的速度、使用量涨得快过你加服务器的速度、钱不断进来、在拼命招销售和客服、媒体主动上门、开始拿创业者奖项。另有「没到」的六条(A2.3):客户没拿到足够价值、口碑传得慢、使用量涨得不快、媒体反应平淡、销售周期拖得长、交易频繁谈崩。

这两组是给融过资、有销售团队、有服务器扩容压力的公司写的。 一个人身上不会出现「拼命招销售」。所以要用它,必须先换算,而这个换算是本站的判断,不是原文里的东西:

2007 年的公司症状(A2.4)一个人身上可能的对应形态(本站判断)
客户买的速度快过你能生产的速度付费用户提的需求你已经清不完,积压在往后滚
使用量涨得快过加服务器的速度你开始为成本和限流发愁,而不是为没人用发愁
客户的钱不断进来你整周没做任何推广,仍然有新的付费发生
在拼命招销售和客服回消息、答疑占掉的时间开始压过写代码的时间
媒体主动找上门有人在你没参与的场合主动提到你
开始拿创业者奖项没有对应形态,直接丢掉

「没到」那六条里,对一个人最有分辨力的是最后两条。销售周期拖得长、交易频繁谈崩,换算过来就是:聊过的人普遍给出「挺好的,我再看看」这类回答,然后没有下文。这个形态一个人也能观察到,而且不需要任何工具。

A5.1 的第 6 条说,创始人经常把早期的一点起色误当成真的 PMF。上面这张换算表的用法是当否定项用,不是当打卡表用:六条里勾中一两条不说明什么,六条一条都对不上,才是需要你改动作的信号。

五、一个人版的四步怎么排

把上面几节合成可执行的排法。这五条是本站基于 A4.2 与 A4.3 做的改写,不是那篇复盘的原文:

  1. 改季度普查为触发式发问。 不等季度末统一发,每有一个新用户第一次完整跑完你的核心流程,隔几天问他一次。样本是一滴一滴攒的,不是一桶一桶收的。
  2. 只记回答,先不算分数。 建一张表,三列:这个人是谁、他的原话、他说自己拿到的收益。原话原样贴,不许翻译成你的行业词——这是 A4.3 那条约束在小样本上的落法。
  3. 三道配套题里先用第二道。 A4.4 给了三道题:谁最受益、你拿到的主要收益是什么、我们该怎么改。本站的判断是,一个人在样本很少的时候先用第二道。因为「谁最受益」在回答少的时候答案会很散,凑不出画像;而「主要收益」的回答是可以直接拿去改首页第一句话的,当天就能用上。
  4. 把一半一半落到周排期上。 先数清自己一周有几段能写代码的时间,对半分:一半加固支持者已经明确说喜欢的地方,一半清他们提到的阻碍,两边都优先做低成本高影响的(A4.2 第三步)。
  5. 把循环的触发条件从时间改成事件。 不按季度重排路线图,改成「名单里又新增了几个能说清收益的人」或者「上一轮改动做完了」就重排一次。对新用户来得慢的产品来说,季度是个太粗的刻度。

六、与站内既有课程的分工

站内 coding 支柱的 L9 阶梯反复把 PMF 当决策开关用——没到 PMF 别砸投放、到了 PMF 再放量、pre-PMF 阶段时间该怎么分。那条主线告诉你开关拨到哪一边会发生什么,但没有一篇讲这个开关本身怎么判断。这篇补的就是判断那一层里的一个具体问题:那套最常被引用的判断流程,一个人该怎么改才跑得动。

L9 还有一篇专讲一个人该盯哪几个指标、指标怎么做减法。那篇管的是日常运营指标的取舍;这篇只管 PMF 判断这一件事,而且给的结论恰好是反方向的——在这件事上,先要名单,后要指标。

本专题里另有一篇讲分数低时该换题还是该继续做。那篇讲的是分数出来之后怎么读;这篇讲的是在你还凑不出一个可信分数的阶段,这套流程怎么拆着用

七、这周可以做完的一件事

不要先去发问卷。打开你已有的全部用户反馈、聊天记录、工单,把说过「离不开」「没有它我得手动做」「每天都在用」这类话的人挑出来,一人一行,原话原样贴进一张表,再补上一列:他说自己拿到的收益是什么。

挑得出几行,你就有了画像的起始材料,下一步是按 A4.3 的办法找他们措辞里的共同词。

一行都挑不出来,那说明你现在缺的不是分数,是还没有任何人用到那个程度。这时候发问卷只会得到一个更难看的数字,什么也不会告诉你。该做的是回到核心流程本身,先让至少几个人完整跑通它。

延伸阅读

本篇提到的站内课程,可以直接接着往下读:

名词不熟可以先看术语页:PMF(产品市场契合)

想系统学会用 AI?报名体系课或加入会员,照着学、照着用。