跳到正文
YibudYibud

Beta 测试用户

如何为创业公司找到 Beta 测试用户

原型在你的机器上跑得通。朋友和家人都说看起来不错。每个处于发布前阶段的创始人都遇到同一个问题:去哪里找最初 10–50 个愿意用半成品、告诉你哪里坏了、且不会因为客气而假装喜欢它的人?

最后更新 · 2026年9月11日

快速回答

怎么为创业公司找 Beta 测试用户?

Beta 测试用户是这样一个人:使用未完成的产品、运行它要支持的工作流、并报告哪里坏了、哪里能用、哪里需要改。他们不是焦点小组受访者,也不是点头说好的朋友和家人。最快的找法是 Mom Test 规则:问关于承诺和具体细节的问题,不要问观点和假设。七个一手渠道——自己的人脉、买家已经聚集的小众社区、Product Hunt 和 BetaList 这两个发布平台、买家参加的会议和聚会、竞品的现有用户、小预算付费投放、上一次创业的现有客户——每种产出的测试用户形态不一样。前十个的教条来自 Paul Graham 的《Do Things That Don't Scale》(2013):一个一个手动招募,直到样本量足够大,让真正的获客渠道开始起作用。三个筛选条件会剔掉不合格的人:不会在自己的工作流里用它、承诺只是口头、没为类似问题付过费或绕过过。

关键要点

30 秒读完的实操

  • Beta 测试用户是真正会在自己的工作流里用未完成产品的人,不是客气捧场的朋友。
  • 把 Mom Test(Rob Fitzpatrick,2013)应用到招募上:问关于承诺和具体细节的问题,不要问观点和假设。
  • 七个一手渠道可用——自己的人脉、小众社区、Product Hunt、BetaList、会议、竞品的现有用户、付费投放——每种产出的测试用户形态不一样。
  • 前十个不要规模化:一个个手动招募。教条来自 Paul Graham 的《Do Things That Don't Scale》(2013)。
  • 三个筛选条件剔掉错误的测试用户:不会在自己的工作流里用它、承诺只是口头、没为类似问题付过费或绕过过。
  • 五个反复出现的失败模式:拿朋友和家人当数据、找毫不相干的陌生人、只用免费访问当激励、报名后没有跟进、把样本当发布公告而不是工作组。

定义

Beta 测试用户到底是什么

Beta 测试用户是这样一个人:会在与生产版本同一工作流中使用未完成产品,会报告哪里坏了、哪里难用、哪里缺东西,且不与创始人的成败绑定。「在自己的工作流里用」这一条,是把大多数错误候选人筛掉的条件。一个不会把产品作为日常工作一部分的测试用户,能告诉你的只是产品能否打开,无法告诉你是产品是否能解决问题。 Mom Test 的框架——Rob Fitzpatrick 2013 年那本关于如何跟客户交谈的书——把测试用户定义为一个反馈可以被信任的人,原因恰恰是他没有给出反馈的额外动机。一个同时也是投资人、联合创始人的亲属、或在做类似产品的创始人,会因为动机不是「真」而污染信号。

Beta 测试用户不是什么

Beta 测试用户不是焦点小组受访者,不是 Twitter 粉丝,不是捧场的朋友或家人,不是报过名但从没点过链接的人,也不是装上了 App 但没跑过工作流的人。一份来自抽奖的邮箱列表不是 Beta。一份好奇陌生人的预热名单也不是 Beta。

Beta 测试用户是什么

Beta 测试用户是这样一个:在生产版本要用的工作流里运行产品、会报告自己观察到的事、且能被再次联系的人。你需要的测试用户数量取决于工作流的广度——每个产品要覆盖的独立工作流对应一个测试用户,是粗略的下限。

Mom Test 规则

把 Mom Test 应用到招募,而不只是访谈

Mom Test(Rob Fitzpatrick,2013)是为客户访谈写的,但同样的三条规则管着你如何请一个陌生人做你的 Beta 测试用户。变化是从「你会用这个吗?」变成问陌生人已经做出或即将做出的承诺。

  1. 1

    问他们上一次类似的承诺

    不要问「你会试一下吗?」,问「你上次想解决这个问题是什么时候,你用了什么?」一个真实的回答——具体工具、具体日期、具体痛点——说明测试用户遇到过这个问题。一个含糊的回答说明没有。

  2. 2

    问具体细节,不要问观点

    不要问「你怎么看这个想法?」,问「这个问题出现的时候,你今天会一步步怎么做,告诉我一遍。」具体细节告诉你测试用户是不是对的画像;观点只告诉你测试用户是否在客气。

  3. 3

    测试开始前先让对方做出一个小承诺

    发 Beta 链接之前,先让对方承诺未来 7 天里抽出 15 分钟通话,把他们用产品做的事展示给你。口头「好的我试一下」不是承诺。一个敲定的日程是承诺。承诺就是把 Beta 测试用户和免费报名区分开的过滤器。

Rob Fitzpatrick 关于这个话题的配套文章发在 momtestbook.com/how-to-find-beta-testers/。文章和书合起来是这个学科的经典一手来源;下面的渠道应被理解为「在哪应用规则」,而不是规则的替代品。

渠道

七个找 Beta 测试用户的渠道,含一手来源说明

每个渠道产出的测试用户形态不同。单独任何一个都不足以支撑前十个;正确的组合取决于买家和工作流。渠道按成本排序:最便宜(自己的人脉)排在最前,最贵(付费投放)排在最后。

自己的人脉——一度联系和二度介绍

从列出每个符合买家画像的一度联系开始,加上能把你介绍给其中一个的二度联系。给每个人发下一节的招募消息。预期 10–30% 的正面回复率;剩下的要么不符合画像,要么太忙。这是最便宜的渠道,也是产出前 3–5 个测试用户最高信号的渠道,因为你可以在发 Beta 链接前做一次 Mom Test 谈话。

一手来源:Paul Graham,《Do Things That Don't Scale》(2013),paulgraham.com/ds.html——文章主张任何创业公司的前十个用户都来自手动外联。

小众社区——论坛、subreddit、Slack 群、Discord 服务器

找到买家已经聚集的具体社区。对 B2B 买家通常是一个小众 Slack 或 Discord;对 B2C 通常是一个 subreddit 或论坛。发帖前先读社区规则——大多数社区禁止直接推销,违反规则会被封号。正确的做法是先参与对话 2–4 周再招募,并在一个社区已经关心的帖子语境里请求分享 Beta。

没有一个平台统一发布所有社区的规则;发帖前要核实每个社区的侧边栏、规则页或版主指引。

竞品的现有用户

如果有竞品存在,他们的用户群是你能找到的最合格的测试用户池。招募动作很直接:找到竞品的用户面向表面(论坛、需求板、社区),识别那些公开描述你产品要解决的问题的用户,给他们发一段用他们的话重述问题的一段话。优势是测试用户已经用时间投过票证明问题是真实的;代价是这条消息必须具体到不会被当垃圾邮件归档。

一手来源:Fitzpatrick,《The Mom Test》(2013)——「问上一次承诺」的规则适用;竞品的用户已经做出了 Beta 测试要验证的承诺。

Product Hunt——发布前的「coming soon」页面

Product Hunt 为尚未发布的产品提供「coming soon」表面。上面挂的是一个带邮箱报名的单页公告。平台自己发布的发布指南(producthunt.co/launch)指出这个表面是社区驱动的;挂上页面不保证曝光,且不能直接拉票。把 Product Hunt 的「coming soon」页面当作一个被动渠道——作为合格报名的次要来源有用,但不是主要的。

一手来源:producthunt.co/launch——Product Hunt 自己发布的发布机制。

BetaList——付费提交拿到推荐位

BetaList 发布有提交标准(betalist.com/criteria),约束可被列出内容:产品必须相对较新(私有 Beta、最近发布或未发布),listing 必须指向一个定制设计的着陆页(不能是免费托管子域名,不能是 LaunchRock 风格页面),且 listing 必须给访客报名或获取访问的途径。BetaList 是一个带快速通道选项的付费目录;把它当作已有着陆页的分发表面来用,不要拿来给空页面招人。

一手来源:betalist.com/criteria——BetaList 自己发布的提交规则。提交前务必核实当时的规则页,因为提交标准会变。

会议、聚会和行业展会

画像会参加的行业会议是 B2B 测试用户的高信号渠道。成本是注册费加差旅;优势是测试用户专程飞来思考你产品要解决的问题。招募动作是带着一个能跑的 Beta 参加,现场跑 3–5 场 20 分钟的会话。这就是 Graham 在他 2013 年那篇文章里描述的「一个个手动招募」。

一手来源:Paul Graham,《Do Things That Don't Scale》(2013)——同一篇文章把面对面招募当作前十个用户的标准机制。

小预算的付费投放

付费投放——Google Ads、LinkedIn Ads、Reddit Ads、付费 newsletter——是最贵的渠道,产出测试用户质量最低。产出的测试用户是因为广告文案吸引人而点击的陌生人,不是真遇到过这个问题的人。这个渠道在着陆页转化率已知之后有一席之地,但不是第一个该跑的。先跑免费渠道。

说明:付费投放测试用户的转化质量取决于广告定向和着陆页;把它当作前十个样本的最后手段。

招募消息

怎么写那条让陌生人愿意测试的消息

招募消息是创始人在 Beta 招募阶段产出的最高杠杆的一段文字。一条问关于承诺、用买家的话命名问题、把请求写得具体的消息,会产出一条问观点、用免费访问当激励的消息完全不同的样本。

模板

主题:下周 15 分钟?(含一个 Beta) 你好 [姓名], 你之前提到过 [他们自己描述的具体问题]。我在为 [同一画像] 做 [产品],他们会遇到 [同一问题]。Beta 还很粗糙;我更想听哪里坏了,而不是哪里看起来不错。 两个请求,挑一个: 1. 下周 20 分钟通话,你现场试一下 Beta,告诉我哪里坏了。 2. 短回复,告诉我你上一次想解决 [具体问题] 是什么时候,用了什么。 任何一个都真的有用。如果都不方便,不回也行。 [你的名字]

  • 用他们自己的话命名他们描述过的具体问题。泛泛的文案(「给忙碌的职场人」)产出泛泛的测试用户。
  • 提供两个具体的请求(一通电话、一条回复),而不是一个开放式请求。两个具体请求让对的测试用户容易挑一个;一个开放式请求让对方容易忽略。
  • 说明不回也行。这一句去掉会产生客套式不回的压力,让正面回复更诚实。
  • 不要用「免费」打头。免费访问吸引的是想要免费产品的测试用户,不是想解决问题的测试用户。你要的是反馈,不是慈善。

前十个

前十个手动招募。不要规模化。

Paul Graham 的《Do Things That Don't Scale》(2013)是被引用最多的文章,核心论点没变:创业公司的前十个用户不来自渠道,来自手动外联。原因不是渠道不行——后面行——而是前十个是教会你产品要变成什么样的人,渠道教不了你,只有对话可以。 前十个,正确的做法是组合两个渠道:自己的人脉(渠道 1)和小众社区(渠道 2)。两个都不用预算;两个都产出你能谈得上的测试用户;两个都让你能在发 Beta 链接前应用 Mom Test 规则。样本量故意小。样本量也是一个工作组,不是发布公告——他们应该预期会被再次联系,创始人应该预期要做这个联系。

手动招募——前十个不要用渠道

招募是一份具体人的名单,不是活动。名单上每个名字都是一个你能打电话的人。给每个人都发上面的招募消息。预期三分之一会正面回复。总量小;信号高。

发链接前先做一次 Mom Test 通话

用第一次接触确认测试用户符合画像且遇到过这个问题。通话就是 Mom Test:问他们上次类似的承诺,问具体细节,把 Beta 承诺做小做具体。通话也是下面筛选条件被应用的地方。

现场跑 Beta,不要异步

前十个,要看着测试用户用产品。20 分钟的现场会话产出的信号是异步报名加反馈表单的十倍。通话也是创始人能学到工作流是否端到端能跑的地方——异步的测试用户会静悄悄地跳过。

七天内再联系每个测试用户

前十个是工作组,不是发布公告。第一周内再联系他们——一个问题、一个更新或一个修复。再联系是把报名名单变成 Beta 样本的纪律;没有它,样本会衰变成一个沉默的安装基础。

筛选条件

三个剔除错误测试用户的筛选条件

大多数 Beta 招募的失败来自接受了本应被筛掉的测试用户。下面的三个筛选条件彼此独立;任何一个都是把测试用户从样本里移出去的理由。

不会在自己的工作流里用它

一个不会把产品作为自己一天的一部分去跑的测试用户,能告诉你的只是产品能否打开,无法告诉你是产品是否解决了问题。淘汰信号是测试用户问「下一版什么时候?」或「什么时候发布?」——这两个都说明测试用户在评估,不在使用。

承诺只是口头

说「好的,我试一下」的测试用户没有真的试过。Mom Test 规则——测试开始前先做出一个小承诺——适用于此。承诺可以是一个敲定的通话、一份签过的表单、或一笔押金;重点是测试以一个真实动作开始,不是口头意图。

没为类似问题付过费或绕过过

一个没有为竞品付过费、没请过承包商、或没为这个问题做过手动绕过的测试用户,对你的解决方案没有切身需要。他们的反馈是关于产品好不好的,不是关于产品是否被需要。你要的测试是有切身利益的测试。

常见错误

把 Beta 名单变成沉默安装基础的五个错误

下面每个错误都是把一份看起来像 Beta 样本的报名名单产出出来的方式。错误的代价不是花在招募上的时间,而是基于错误测试用户反馈做的几个月产品工作。

拿朋友和家人当测试用户

朋友和家人会说产品很棒,因为想支持你,不是因为他们会用。信号被「不是真」的动机污染。Rob Fitzpatrick 的 Mom Test(2013)把这个当作坏客户研究的典型例子;同样的逻辑适用于 Beta 招募。

找毫不相关的陌生人

一条要一个陌生人测试一个他没有切身利益的产品消息,产出的是客套式的不回。请求必须具体到画像和问题;一条泛泛的「我们在找 Beta 测试用户」产出泛泛的不回。

只用免费访问当激励

免费访问吸引的是想要免费产品的测试用户,不是想解决问题的测试用户。第一组产出关于想要什么功能的反馈;第二组产出关于产品是否解决问题的反馈。你要的是反馈,不是慈善。

报名后没有跟进

一个报了名再没听到回音的测试用户,已经停止使用产品。七天内再联系。报名后的第一次联系是把报名变成测试用户的那个联系。如果第二次联系也沉默,测试用户已经被上面三个筛选条件之一剔掉——没有切身需要、不在自己的工作流里用、或承诺只是口头。

把样本当发布公告

Beta 样本是工作组,不是发布名单。样本量故意小;样本预期被再次联系;创始人预期做再联系。被当作公告对待的样本会在 30 天内衰变成一个沉默的安装基础。

Yibud 能帮上什么

Yibud 怎么连到找 Beta 测试用户

Yibud 的工具在人脉、问题和渠道对齐之前浮现出问题,让你不用花几周招错人。Startup MRI 评分的八个维度是招募消息依赖的输入;画像尤其是一个渠道必须匹配的变量。

检查画像是否已经在输入里

创业点子评估器按你给的输入——点子、受众、变现、获客渠道、技术背景——给八个维度打分。市场或分销维度的低分通常说明画像还没定义到任何渠道都能去招的程度。先把画像修好;再开始招募。

打开评估器 →

读客户发现的实操

客户发现页面记录了更广的学科——怎么找到对的买家、怎么跑不撒谎的访谈、怎么判断信号已经够了。Beta 招募是这个学科的最后一步;这个页面是前面几步的实操。

打开客户发现 →

判断样本告诉了你什么

决策指南讲 Beta 样本产出的证据要怎么处理——信号支持继续、信号指向转型、信号指向终止的时候分别怎么做。样本是这个决策的一个输入;指南是 Beta 跑完之后的下一读。

打开决策指南 →

常见问题

常见问题

我需要多少个 Beta 测试用户?

大致上是每个产品要覆盖的独立工作流对应一个测试用户。一个只有一个核心工作流的产品,3–5 个测试用户就能产出有用的信号;一个有五个工作流的产品至少每个工作流一个,样本量从这里往上长。数字不是目标——工作流的覆盖度才是目标。

如果找不到任何符合画像的人怎么办?

那就是答案。一个在你的网络里找不到测试用户、在买家聚集的小众社区里也找不到测试用户的画像,是一个还没被验证过的画像。正确的做法是回头重新定义画像和问题的描述,不是降低招募门槛。

我应该给 Beta 测试用户付钱吗?

一般不付——付费吸引的是想要钱的测试用户,不是遇到过这个问题的测试用户。例外是:一个本来抽不出时间的测试用户(按小时计费的顾问、时间有限的资深从业者),或一个特定专长对工作流不可少的测试用户。在这些场景里,付费是拿时间的预算,不是 Mom Test 通话的替代品。

Beta 应该跑多久?

长到测试用户能在自己的工作流里跨至少两个工作循环使用产品,短到样本不会衰变成一个沉默的安装基础。2–4 周是 Beta 的标准窗口;更长的是软发布,不是 Beta。

我应该跑私有 Beta 还是公开 Beta?

前十个跑私有 Beta。私有 Beta 已经产出稳定工作流和清晰反馈循环之后,再公开 Beta。私有 Beta 是创始人学到该建什么的地方;公开 Beta 是创始人学到建出来的东西有没有人在用的地方。

如果测试用户报名后就沉默怎么办?

七天内再联系。报名后的第一次联系是把报名变成测试用户的那个联系。如果第二次联系也沉默,测试用户已经被上面三个筛选条件之一剔掉——没有切身需要、不在自己的工作流里用、或承诺只是口头。

前十个可以用 Product Hunt 或 BetaList 吗?

前十个不要用。两个平台在着陆页转化率已知、Beta 已经稳定之后才有用。前十个的招募是手动的——自己的人脉和买家已经聚集的小众社区。两个平台是第二波渠道,不是第一波。

Yibud 能帮上什么?

Yibud 不替你招测试用户——没有算法能做。工具做的是浮现画像、问题和渠道是否对齐。创业点子评估器给点子的八个维度打分;市场或分销的低分通常说明画像还没定义到能去招的程度。客户发现页面记录更广的学科;决策指南覆盖样本产出的证据要怎么处理。

参考资料

一手来源

检查画像是否已经在输入里

一分钟内把点子跑过 Startup MRI 评估器。输入里的画像是招募渠道必须匹配的变量——错误样本的第一个来源,就是一个渠道够不着的画像。

分析我的想法