一路都在说「到了 PMF 再说」,这个开关怎么判断

2026-08-25

站内 coding 支柱的 L9 阶梯有十五篇课,「PMF」这个词在其中八个文件里出现了大约二十五次,全部是不加定义的背景状态词——「pre-PMF 阶段」「PMF 之后再放量」「逼近 PMF 最快的方式」(C0 发现一)。

该不该投放、该不该把跑通的渠道放大、时间在做功能和做分发之间怎么分,这三个决定都挂在同一个开关上。而整条阶梯里对这个词唯一的一处解释,是某篇正文里的一个括号注释:PMF(产品市场契合)。

开关用了一路,判据一直没给。这篇补判据那一层。

一、原始定义里一个数字都没有

2007 年 6 月 25 日,Marc Andreessen 在《The Only Thing That Matters》里给的定义是(A2.1):处在一个好市场里,并且手上的产品能满足这个市场。

这句 2007 年写下的话里没有任何数字。40% 也好,留存曲线也好,NPS 也好,都是后来的人为了回答「那我怎么知道到了没有」而发明的测量手段,不是定义本身。把测量手段当成定义,是中文 PMF 内容里最常见的一种错位——一个把分数刷到线上的产品,和一个处在好市场里的产品,不是同一件事。

顺带把 40% 的出处说清楚,一句话就够:这个说法最常被引用的转述来自 Superhuman 创始人 2018 年那篇复盘,本站没有取到最早提出它的那篇博客正文,所以本专题一律按「那篇复盘里的转述」处理,不写成某人在某文里怎么说(A3.1、A3.2)。考据到此为止,它不是这篇要解决的问题。

同一篇 2007 年的文章里还有一个排序:市场 > 团队 > 产品(A2.2)。理由是好市场会主动把产品从你手里拉出去,哪怕产品并不完美;团队可以换,糟糕的市场换不掉,而且它会把最好的团队和产品一起摧毁。

这个排序直接决定了判据该往哪儿看。你要观测的不是自己有多努力、代码有多干净、界面改了多少版,而是市场那一侧有没有回应。所有指向自己的证据,在这个问题上都不算证据。

二、2007 年给的判据是「你不会不知道」

同一篇文章给了两组可观察的症状,各六条,全是定性描述。

没到的时候(A2.3):客户没从产品里拿到足够的价值;口碑传得很慢;使用量涨得不快;媒体报道反应平淡;销售周期拖得很长;交易频繁地谈崩。

到了的时候(A2.4):客户买的速度快过你能生产的速度;使用量涨的速度快过你能加服务器的速度;客户的钱不断进来;你在拼命招销售和客服;媒体主动找上门要采访;开始拿创业者奖项。

这十二条里一个数字都没有。它隐含的判据其实是一句话:到了你不会不知道。后来之所以要发明问卷、发明留存曲线,是因为在某些形态的产品上,你真的会不知道。

还有一层限制得先说破:这两组描述的对象是融过资、有销售团队、有服务器扩容压力的公司。一个独立开发者身上不会出现「拼命招销售」这种症状,机械照搬只会得出「十二条我一条都不占」这种没用的结论。要用它,就得先换算。

三、换算成一个人做产品的六条判据

下面这组换算是本站的判断,原始素材只有 A2.3 和 A2.4 那十二条,换算过程里的每一条阈值都是本站定的,没有外部依据。它的作用不是给你打分,是逼你把「感觉差不多了」换成一句能拿出证据的话。

  1. 「买的速度快过你能生产的速度」→ 你的待办队列由谁决定。 判据:连续四周,开发队列里由真实用户提出的条目,多于你自己想出来的条目。反过来的状态很好认——队列全是你自己的点子,说明推力在你这边,不在市场那边。
  2. 「涨得快过你加服务器的速度」→ 你被迫做过成本或容量上的取舍。 判据:你至少有一次因为真实用量而不得不动额度、限速、排队或价格。一次都没有,意味着规模还没触到任何一条约束。
  3. 「客户的钱不断进来」→ 静默期还有没有付费。 判据:挑出你完全没做任何推广动作的那几周,看有没有新的付费发生。这一条是六条里最难糊弄的,因为它把你自己的动作从因果链里摘掉了。
  4. 「口碑传得很慢」的反面 → 你能点名的转介数。 判据:你能说出至少三个用户,他们既不是你联系过的,也不是你发帖带来的,是被别人告诉的。说不出具体是谁,就当作零。
  5. 「媒体主动找上门」→ 一个人产品的等价物是陌生来信。 判据:有你不认识的人主动写信来问功能、问价格、问能不能接他们那个场景——方向是他们问你,不是你去问他们。
  6. 「销售周期拖得很长、交易频繁谈崩」→ 从进门到付钱的间隔在变长还是变短。 判据:把最近十个付费的人排出来,看这段间隔的走向。变长通常意味着你在靠说服而不是靠对上,这比绝对时长更能说明问题。

用法:六条里能拿出实打实证据的少于两条,就按「还在开关的这一侧」处理。这条线同样是本站定的,它不精确,但它比「我觉得用户挺喜欢的」精确。

第 5 条和第 6 条最容易被含糊过去,因为它们要求你点出具体的人。点不出来,那一条就是零,不要用「大概有几个吧」补位。

四、AI 产品是「你真的会不知道」的重灾区

2017 年 2 月那篇 a16z 的《12 Things About Product-Market Fit》里,有三条要点专门讲这件事(A5.1):创始人经常把早期的一点起色误当成真的 PMF;PMF 并不总是显而易见;PMF 不是一次性事件,而且是会丢的。

到了 AI 产品这里,「不显而易见」这一条被放大到了另一个量级,而且有一条很硬的旁证。

a16z 在 2026 年 3 月发布的第六版消费级生成式 AI 应用榜里(数据截至 2026 年 1 月),作者 Olivia Moore 自己写明,这份榜单越来越「undercount the AI products people use most」(B4)。她举的例子是:一个每天泡在 Claude Code 里八小时的开发者,无疑属于重度 AI 用户,但在网页流量数据里几乎体现不出来。

这句自承的分量在于说话的人是谁。一家把「排 AI 应用榜」做成招牌产品的机构,手里拿着网页端和移动端两家最主流的数据源,仍然承认自己量不准这个品类。一个独立开发者拿注册数、拿日活去判断自己到没到,只会更不准。

本站的判断(依据 B4 与 A2.4):AI 产品上「你不会不知道」这条 2007 年的判据之所以失灵,不是因为信号不存在,而是因为你惯用的那几个计数器恰好数不到它。用得最深的人可能一天只开两次会话,每次两小时,在按次数、按访问、按停留页数的口径里,他和一个点进来看了两眼就走的人分不出来。

所以在 AI 产品上,第三节那六条判据里,第 3、4、5 条的权重要高于第 1、2 条——它们观测的是「有没有人肯为它付钱、肯替你说话、肯主动找上门」,这几件事不依赖任何一个容易失真的计数器。

五、把开关写成一句能回答的话

判据能不能落地,取决于你问谁、以及用谁的措辞记录答案。

Superhuman 那套做法里,除了那道主问题之外还配了三道题(A4.4):你觉得哪类人会最受益于这个产品;你从这个产品里拿到的主要收益是什么;我们要怎么做才能把它为你改得更好。

这三道题真正的价值在措辞。A4.3 讲得很直白:高期待用户的画像要用他们自己的词去构建,不是用你的行业黑话。你写「面向中小团队的效率工具」,他们写「我不用再手动导表格了」——后一种说法才是能拿去做判断和做文案的原料。

具体动作,本周就能做:

  • 问的人限定在「最近还在用的人」,不是所有注册过的人。注册过但早就不来的人,回答的是他当初为什么点进来,不是产品现在值不值。
  • **三道题原样问,不要提示、不要给选项。**你一给选项,收回来的就是你自己的词。
  • **把回答里重复出现的名词抄成一列。**只抄名词和动词,别抄形容词——「很好用」是零信息,「导表格」「对账」「写周报」才是。

判据:如果这列名词彼此对不上,落在完全不同的场景上,那你面对的就不是「到了没到」的问题,而是还没有一个明确的市场。这时候回到 A2.1 那句定义的前半截——好市场——比继续测量更有用。

六、和站内那几篇课的分工

站内 L9 讲「分发大于产品」的那篇,告诉你 pre-PMF 阶段时间该怎么分、到了 PMF 之后再放量;讲「要不要做投放」的那篇,告诉你没到 PMF 就砸广告等于往漏桶里浇水。那两篇解决的是「到了以后怎么办」,这篇解决的是「你怎么知道到了没有」,两边不重复,是接起来的关系(C5)。

L9 还有一篇专讲「一个人该盯哪几个指标」和虚荣指标的课,那篇处理的是日常经营看板该做减法到什么程度。本篇第四节讲的是同一批计数器在「判断到没到 PMF」这个特定问题上会失准,两件事不冲突:日常该看的还是要看,只是别拿它们回答这个问题。

需求验证那一层——该问什么、怎么做访谈、怎么跑冒烟测试和预售——L5 已经讲透,这篇一句都不重复。

七、一页纸,四格

把下面四格填完,你就有了一个可以拿去跟人争论的答案,而不是一种心情。

  1. **支持者是谁。**用他们自己的措辞写一句画像,不许出现你的行业黑话(A4.3)。
  2. **三条可观测证据。**从第三节那六条里挑,写证据本身(谁、什么时候、做了什么),不写结论。
  3. **一条你自己的时间线。**最近一批用户里,从第一次进来到第一次「你没催他他自己回来」,这段间隔是什么样。
  4. **一个否定条件。**什么情况出现了,你就承认这一轮没到。事先写下来,比事后解释诚实得多。

第 4 格最容易跳过,也最有用。A5.1 那条「创始人经常把早期的一点起色误当成真的 PMF」,防的正是没有第 4 格的人。

延伸阅读

本篇提到的站内课程,可以直接接着往下读:

名词不熟可以先看术语页:PMF(产品市场契合)

想系统学会用 AI?报名体系课或加入会员,照着学、照着用。