跳到正文
YibudYibud

在一个数字变成覆盖证据之前

客户访谈做多少次才够——先写停止规则,再数次数

人头数不是判决。“客户访谈做多少次才够?”问的是覆盖:在一个收得很紧的细分里,我们是不是已经听到了大部分需求和痛点——不是他们会不会付钱、会不会用。第一次通话之前把停止规则写好。然后这个数字才是你愿意遵守的合同,不是周日发明的奖杯。

最近更新:2026年10月5日

直接回答

客户访谈做多少次才够?

访谈次数回答的是同一细分里的覆盖问题,不是需求问题。第一次通话前先写停止规则——细分、批次大小、最少次数、饱和检查、上限、具名动作——然后大约每 5–6 人一批,整批不再出现新的重要需求或痛点编码就停。Hennink 与 Kaiser 2022 年对实证检验的综述发现:同质、目标收窄的研究里,饱和落在 9–17 次访谈;Guest、Bunce 与 Johnson(2006)在 60 次访谈的前 12 次里看到饱和;Griffin 与 Hauser(1993)假设,在他们那个品类、按细分,20–30 次一对一能覆盖 90–95% 的需求——如果你跨过这个区间还在听到新需求,就拆细分,而不是继续谈。

要记住的

带走这五句

  • 次数量的是同一细分里需求的覆盖。它不量需求强弱、付钱,也不量产品市场契合。
  • 第 1 次访谈前写好停止规则:细分、批次大小、最少 N、饱和检查、上限,以及规则触发时的具名动作。
  • 从下面研究推导出的起步规则——不是定律:大约 5–6 人一批;整批不再出现新的重要编码就停;同质细分里大约落在 9–17。
  • 异质、多细分的点子,每个细分单独计数。一个新细分,胜过旧细分里的第 40 次。
  • 饱和的意思是没有新主题。它不表示点子已被验证。饱和之后,转到行为或付钱证据。

为什么要做

一个魔法数字,会让创始人一直约人,而不是做决定

我见过创始人把“再谈一个”当成性格。两句恭维变成十次。十个混在一起的岗位,变成他们在帖子里看到的整数。次数从来不会告诉他们有没有人会付钱。它只能告诉他们:在同一份工作的一群人里,需求是不是大多听过了。Guest、Bunce 与 Johnson(2006)对加纳和尼日利亚的女性做了 60 次深度访谈,在前 12 次里看到饱和;他们提醒,12 次适合相对同质的群体和收窄的目的。Hennink 与 Kaiser(2022)综述了 23 篇文章,实证研究的饱和落在 9–17 次——同样主要是同质人群、目标收窄。Griffin 与 Hauser(1993)在一个品类里一对一访谈了 30 位顾客,并假设按细分,20–30 次能覆盖 90–95% 的顾客需求。即便那项研究里的 30 位顾客,也没有覆盖到每一条需求;他们的模型估计,这 30 位顾客占全部需求的 89.8%,因为低概率需求仍然缺失。恭维之后再写的规则,是复盘。

用语

停止规则的六个字段是什么意思

这一页不是“谈到感觉够了再停”。它是一份写了日期的合同:谁算同一个细分、怎么分批、什么叫“没有新编码”、上限在哪、规则触发你做什么。每个字段都要有陌生人能读的记录。

1. 细分——同一份工作、同一个情境、同一类买家

细分是共享同一份近期工作和约束的一群人——不是“中小企业”,也不是“可能会喜欢这个的人”。Guest、Bunce 与 Johnson 提醒,他们关于 12 次的发现适合相对同质的群体。把两份工作混在一起,你数的是自己并没有的覆盖。

2. 饱和——整批不再出现新的重要编码

这里的饱和是:完整的一批里,没有新的重要需求或痛点编码。它不表示人们喜欢这个点子。也不表示他们会付钱。Hennink 与 Kaiser 写得很清楚:9–17 不是通用规则;异常值(多国、元主题、编码意义饱和)需要更大样本。

3. 批次——大约 5–6 次,然后重新编码

批次是你决定要不要继续之前先做完的一小撮。Guest、Bunce 与 Johnson 最早在 6 次访谈里就看到元主题的基本元素。把大约 5–6 当作从这一早期主题发现、以及你必须重新编码这一实务需要推导出的起步批次,不是定律。

4. 停止规则——六个字段,第 1 次通话前写好

细分、批次大小、最少 N、饱和检查、上限、具名动作。任何一个字段是空的,你就还没有规则。热闹的一周之后发明的数字,是复盘。

5. 覆盖 vs 验证

覆盖问的是:这个细分里的需求和痛点,我们是不是大多听过了?验证问的是:他们会不会付钱、使用或承诺?访谈次数量的是前者。定金、结账、烟雾测试点击和稀缺承诺量的是后者。不要互相换算。

证据

这四项研究实际量了什么——以及没量什么

这些是研究发现和作者的假设,按原样标注。它们不是对你个人的预报,也不是 Yibud 规则。本页没公布的数字,不要自己搬进来。

Guest、Bunce 与 Johnson(2006)——60 次里,前 12 次饱和

对加纳和尼日利亚的女性做了 60 次深度访谈。饱和出现在前 12 次。元主题的基本元素最早在第 6 次就出现。12 次之后,他们得到加纳 30 份转录里 109 个编码中的 92%(100 个),以及全部 60 次里 114 个编码中的 88%(100 个)。作者提醒:12 次适合相对同质的群体和收窄的目的。

Hennink 与 Kaiser(2022)——实证饱和在 9–17 次

对 23 篇文章的系统综述(17 篇实证,6 篇统计建模)。实证研究在 9–17 次访谈或 4–8 个焦点小组达到饱和,主要是同质人群、目标定义收窄。异常值需要更大样本。作者没有给出通用规则。

Griffin 与 Hauser(1993)——20 次访谈,覆盖了 30 次里发现的需求的 90% 以上

在一个品类里对 30 位顾客做一对一访谈。大约 20 次就浮现了 30 次里发现的需求的 90% 以上。作者假设:要覆盖 90–95% 的顾客需求,需要 20–30 次访谈;一对一可能比焦点小组更划算。他们还说,多位分析者应该读转录。把这些标成他们的研究和假设,按细分——不是普遍定律。

Nielsen(2000)——只作对照:可用性测 5 个用户,不是发现访谈

Jakob Nielsen 的《Why You Only Need to Test with 5 Users》讲的是对已有设计做可用性测试。大约 5 个用户能发现约 85% 的可用性问题;多轮小测试更好。它不是发现访谈的样本量。把“5”借来做客户访谈,是常见误用。

你可以采用的起步规则——第 1 次通话前写好

在一个收得很紧的细分里,大约每 5–6 人一批。每批之后列出新的需求和痛点编码。整批不再出现新的重要编码就停。同质细分里,预期大约落在 9–17(Hennink 与 Kaiser)。如果在同一细分里跨过大约 20–30 还在听到新需求(Griffin 与 Hauser 假设的区间),细分大概太宽——拆开它,而不是继续谈。

不是同一页

访谈次数 vs 脚本、产品市场契合问卷、付钱测试、认人滤镜、合同和分数

Yibud 好几页挨着本页。混在一起,就会把客气的脚本、一个使用百分比,或中段引擎分数,变成“我们访谈够了”。

妈妈测试、顾客发现、方案访谈——怎么问,不是问多少

那些页是对话:不问推销的上周行为、发现过程,或问题已被证出之后按脚本展示物件。本页是同一细分里谈多少次、何时停。一个好问题不是饱和检查。走查做完也不是覆盖。

产品市场契合问卷——使用百分比,不是饱和

那一页的信号是:最近有真实使用的人里,产品消失会非常失望的百分比。本页的信号是:同一细分的一批还是否会加上新的需求编码。饱和不是 Sean Ellis 的百分比。“非常失望”分数也不是访谈覆盖。

产品市场契合问卷 →

付费意愿、烟雾、假门、落地页——覆盖之后的行为和钱

那些页测的是触达、点击、定金或结账。通常发生在访谈饱和之后——或者当最贵的未知已经是钱或触达时,用来代替更多访谈。等候名单不是新的需求编码。定金也不是饱和。

早期福音用户和设计合作伙伴——认谁,以及稀缺承诺

那些页过滤一个叫得出名字的人(Blank 的五条特征),或一份稀缺的共同开发承诺。本页在你已经点名的细分里数覆盖。对上五条不是饱和。签了的合作伙伴也不是一批编码。

停止、转向、假设、决策——以后能读这条规则的合同

那些页写停止、改一个维度、点名一条主张,或读取你已经有的一周证据。本页提供那些合同以后能读的一种输入:同一细分里、写了日期的覆盖检查。它不是一次停止 / 转向 / 继续的会议。

Yibud 分数——不是饱和度量

验证分数含义页和分数计算器页解释的是 Startup MRI 的数字,来自确定性引擎,输入是一句话点子加五个问题。那些分数是照向假设的手电筒。它们不是访谈饱和,也不是 Guest 或 Hennink 的次数。不要把中段分数读成“访谈够了”,也不要把 12 次谈话读成 Yibud 的 GO。

这一坐

如何在一次坐下来写好并跑完访谈停止规则

在约下一位陌生人之前做。定个计时器。六个字段填完之前,日历先关上。如果有联合创始人,各自先写一稿,然后留下更紧的那个细分。

  1. 1

    请任何人之前,先写六个字段

    细分:同一份工作、同一个情境。批次大小:起步大约 5–6。最少 N:至少完整的一批。饱和检查:整批不再出现新的重要需求或痛点编码。上限:该拆而不是该继续的点——Griffin 与 Hauser 假设的 20–30 区间,你可以当作默认上限,并标成他们的假设。动作:停这个细分、拆开它,或去做点名的付钱或行为测试。任何一个字段是空的,你还没准备好邀约。

  2. 2

    把细分写到陌生人也能按它招人

    写一句话:近期的工作、约束、买家。“正在用邮件追 5–20 个客户应收账款的美国独立簿记员”是细分。“小企业”是一场会。Griffin 与 Hauser:即便那项研究里的 30 位顾客,也没有覆盖到每一条需求;他们的模型估计,这 30 位顾客占全部需求的 89.8%,因为低概率需求仍然缺失。一个新细分,胜过旧细分里的第 40 次。

  3. 3

    大约每 5–6 人一批,然后重新编码

    先做完这一批。约下一个人之前,列出每一个新的需求和痛点编码。Guest、Bunce 与 Johnson 最早在 6 次就看到元主题的基本元素。不要因为这一周很忙,就把两份工作平均成一条“洞察”。

  4. 4

    套用你写好的饱和检查

    如果做完的这一批没有新的重要编码,规则就触发了。停这个细分。Hennink 与 Kaiser 的 9–17 是许多同质、收窄的实证研究落到的地方——当作你可能落到的区间,不是要打中的靶。

  5. 5

    遵守上限或拆分——不要发明更松的区间

    如果在同一细分里跨过大约 20–30 还在听到新的重要编码,就拆细分。那是 Griffin 与 Hauser 假设的 90–95% 区间,标成他们的,针对一个品类、按细分。因为故事很暖就拉高上限,是另写一页并写明理由。

  6. 6

    规则触发的当天,做具名动作

    饱和的意思是没有新主题,不是“点子已被验证”。动作通常是:停这个细分的访谈,去做点名的付费意愿、烟雾、假门、落地页、设计合作伙伴或早期福音用户测试。恭维不会触发另一种动作。

你带走什么

访谈停止规则合同(抄这份)

如果这一坐只留下心情,你没做完。这一页应该有一条陌生人能套用的、填好的规则。填中括号。不要留下“用户”、“很快”或“到时候就知道了”。

停止规则

细分:[同一份工作 + 同一个情境 + 同一类买家——不是“中小企业”]。批次大小:[起步大约 5–6]。最少 N:[至少完整的一批]。饱和检查:整批不再出现新的重要需求/痛点编码。上限:[同一细分约 20–30 → 拆分;Griffin & Hauser 的假设,一个品类]。规则触发时的动作:[停这个细分 / 拆开它 / 做点名的付钱或行为测试]。你要记录的编码:[用他们原话的需求和痛点]。

任何一个括号还写着“顾客”、“够了”或“以后”,合同就还没写完。两份工作的访谈,不共享一个计数。恭维不是编码。

什么不算这个信号

不是这个信号:Yibud 分数、一句恭维、“我会用”、Sean Ellis 的“非常失望”百分比、等候名单、烟雾或假门点击、定金或结账、对上 Blank 的五条、签了的设计合作伙伴、做完的方案访谈走查、Nielsen 的 5 个可用性用户。以后可选:那些工具各有各的页。

你仍可以记下夸奖或付钱。你不能让它们触发这条停止规则。做完的一批里出现新的重要需求/痛点编码会触发它——或者它们的缺席会。

示例起步规则(模板——数字是研究里的默认值,已标注)

在[点名的细分]里,每 6 人一批访谈。每批之后列出新的需求/痛点编码。最少:6。整批不再出现新的重要编码就停(同质细分里预期大约 9–17——Hennink & Kaiser 2022,不是定律)。如果跨过约 20–30 还在听到新需求,就拆细分(Griffin & Hauser 1993 的假设,一个品类,按细分)。动作:停这个细分,去做点名的付费意愿或烟雾测试。

9–17、12、20–30 来自本页点名的研究,标注为发现或假设。它们不是 Yibud 的结果,也不是你这个品类“通常会怎样”的声称。本页不编造其他 N。

分叉

什么时候访谈覆盖是最贵的未知——什么时候不是

本页只决定:现在该不该花钱去证“这个细分里的需求,我们是不是大多听过了”。怎么问、付钱、稀缺承诺、触达、使用问卷和决策合同各有各的页。不要对已经饱和的细分继续访谈。

先写停止规则

你能点名一个细分。最贵的未知是需求和痛点的覆盖。写六个字段。约第一批。不要先开广告或开工厂。

先转到付钱或行为

完整的一批已经不再出现新的重要编码,或者未知已经是他们会不会付钱或点击。用付费意愿、烟雾、假门或落地页。更多访谈不会让钱动起来。

先拆细分

你在所谓的“同一个细分”里跨过大约 20–30,还在听到新的重要编码。细分大概太宽。一个新细分,胜过旧细分里的第 40 次。

什么时候访谈停止规则是最贵的未知

你能点名同一份工作和同一类买家。你还不知道下一批会不会仍加上新的需求编码。你还没写上限或动作。那就是本页。Yibud 报告上一条弱的“我们还不了解顾客”假设,挨着这个分叉——是手电筒,照你该访谈哪个细分或哪条主张,不是次数。

什么时候访谈停止规则是错的下一步

你点不出细分。你还在问“你会用吗?”你只需要一份脚本、对已经做过那件真事的人做使用问卷、一个稀缺承诺的合作伙伴,或一笔收费。你把三种工作混进一个计数。你在做可用性测试,却引用 Nielsen 的 5。改走那些页。把混细分里的恭维加总,是演戏。

演算例子

一份可以抄的停止规则合同(示意)

下面这一周是示意——名字、产品和数字都是编的,好让你看见怎么搭。它不是研究,不是饱和基准,也不是 Yibud 报告。抄方法,别抄数字。Guest 的 12、Hennink 与 Kaiser 的 9–17、Griffin 与 Hauser 的 20–30,留在他们的论文里;不是这个故事。

覆盖赌注,第 1 次通话前写好

示意名字:创始人 Mei Chen,产品 Ledgerping,一个帮独立簿记员起草催款邮件的 B2B SaaS。第 1 次通话前写好的细分:正在用邮件为 5–20 个客户追应收账款的美国独立簿记员。“会计师”和“中小企业”都不算。诱人的下一步是对任何肯占日历的人做 40 次访谈冲刺。

停止规则,同一天写好

细分:如上。批次大小:6。最少:完整的一批。饱和检查:做完的一批不再出现新的重要需求或痛点编码。上限:这个细分 24 次——如果重要新编码还在出现,就拆(采用 Griffin 与 Hauser 的 20–30 假设作上限,标成他们的)。规则触发时的动作:停这个细分的访谈,对两个反复出现的痛做点名的定金测试。恭维不算编码。

三批之后,停止长什么样

示意收尾:第 1 批(第 1–6 次)加上许多编码——周五晚上追款、客户不愿打开门户、对逾期发票的难堪。第 2 批(7–12)加上两个编码。第 3 批(13–18)没有创始人标成重要的新编码。这就是你已经点名的覆盖停止——转到付钱证据。这不是“大家很暖所以再约二十个”的理由。这个虚构故事里的 18 次,不是 Guest 的 12,也不是对你这一周的声称。

窗口里不该发生的事

不要把代账所簿记员和公司内部会计主管折进同一个计数。不要把“我会用”当成新的需求编码。不要借用 Nielsen 的 5,谈完五句恭维就停。不要把 Yibud 分数当成饱和。不要因为故事押韵就越过上限——那是该拆,或另写一页并写明理由。如果在点名的细分里找不到一批人,你可能是触达有问题——走发现或烟雾,不要伪造一次通过。

第 1 次通话前写停止规则。如果整批不再出现新的重要编码,就遵守动作。如果跨过上限还在听到新需求,就拆细分。饱和之后,继续做下一个最便宜的测试——常常是付钱或设计合作伙伴请求,不是开工厂。方法是那页写了日期的纸,不是事后讲的故事。

Yibud 放在哪

把免费验证器当手电筒,停止规则还是你自己写

Yibud 是免费、不用注册的创业点子验证器。分数来自确定性规则引擎,不是语言模型在猜成功。可选的 AI 文本如果开着,只润色措辞。它不发明数字。一份 Startup MRI 报告可以点出一条弱的顾客或假设维度,再给出第 7 天的继续 / 收窄 / 重测 / 停止信号。访谈次数的工作挨着那条假设——用最弱的维度,决定访谈哪个细分或哪条主张。不要指望中段分数意味着“我们已经访谈够了”。如果你已经有报告,用点名的假设开始合同——不要用总分。然后自己跑批次。如果你从不打开分析器,本页的方法也能单独成立。

分析我的点子 →

常见错误

什么通常会浪费这条访谈停止规则

把 Nielsen 的“5 个用户”误当成发现样本

Nielsen(2000)写的是对已有设计做可用性测试:大约 5 个用户能发现约 85% 的可用性问题,多轮小测试胜过一轮大的。那不是发现访谈的次数。五句关于幻灯片的恭维,不是饱和。

把混在一起的细分加总计数

对三种不同工作谈 12 次,不是 Guest 的 12。覆盖是按细分算的。Griffin 与 Hauser:即便那项研究里的 30 位顾客,也没有覆盖到每一条需求;他们的模型估计,这 30 位顾客占全部需求的 89.8%,因为低概率需求仍然缺失。一个新细分,胜过旧细分里的第 40 次。

把饱和当成验证

没有新主题,表示你大概已经听到那一群人的需求。它不表示他们会付钱、点击或留下来。规则触发之后,去做点名的付钱或行为测试。不要宣布产品市场契合。

听到恭维就停——或从来不写动作

“我会用”是客气。它不是新编码,也不是提前停的理由。如果第 1 次通话前没点名动作,每一次暖和的谈话都会变成“质性洞察”。把失败线写在和细分同一页。

把 12 或 20–30 当成定律或奖杯

Guest、Bunce 与 Johnson 提醒,12 次适合同质群体和收窄的目的。Hennink 与 Kaiser 说 9–17 不是通用规则。Griffin 与 Hauser 的 20–30 是一个品类、按细分的假设。第 1 次通话前采用起步规则,或改写它。混乱的一周之后发明的区间,是复盘。

来源

这些想法从哪来

一段话

可以引用的摘要

客户访谈做多少次才够,是同一细分里的覆盖问题,不是需求问题。第一次通话前写停止规则:细分、批次大小、最少 N、饱和检查、上限、具名动作。从本页研究推导出的起步规则——不是定律——是大约每 5–6 人一批,整批不再出现新的重要需求或痛点编码就停;同质、收窄的研究里预期大约 9–17(Hennink 与 Kaiser,2022);Guest、Bunce 与 Johnson(2006)在 60 次的前 12 次看到饱和,并提醒 12 次适合同质群体和收窄目的;Griffin 与 Hauser(1993)假设在他们的品类、按细分,20–30 次一对一能覆盖 90–95% 的需求——跨过这个区间还在听到新需求,就拆细分。Nielsen 的 5 个用户是对设计做可用性测试(约 85% 的可用性问题;多轮小测试),不是发现。饱和的意思是没有新主题,不是点子已被验证。规则触发之后,转到行为或付钱证据。Yibud 分数不是饱和度量。对照你先写好的规则,才是方法。

常见问题

创始人真正会问的

客户访谈做多少次才够?

够覆盖同一个细分:写好停止规则,大约每 5–6 人一批,整批不再出现新的重要需求或痛点编码就停。Hennink 与 Kaiser(2022)发现,同质、收窄的研究里实证饱和在 9–17 次。Guest、Bunce 与 Johnson(2006)在 60 次的前 12 次看到饱和。这些是研究发现,不是定律,也不是需求测试。

5、12 或 20–30 是魔法数字吗?

不是。Nielsen 的 5 是对设计做可用性测试(约 85% 的可用性问题;多轮小测试),不是发现。Guest、Bunce 与 Johnson 提醒,12 次适合相对同质的群体和收窄的目的。Griffin 与 Hauser 的 20–30 是一个品类、按细分的假设。第 1 次通话前采用起步规则,或改写它。

饱和表示点子已被验证吗?

不表示。饱和的意思是整批不再出现新的重要主题。它不表示有人会付钱、点击或留下来。规则触发之后,去做点名的付费意愿、烟雾、假门、落地页、设计合作伙伴或早期福音用户测试。

同一细分里谈过 20–30 次还在听到新需求,怎么办?

细分大概太宽。拆开它。Griffin 与 Hauser 假设,在他们的品类、按细分,20–30 次一对一能覆盖 90–95% 的需求。即便那项研究里的 30 位顾客,也没有覆盖到每一条需求;他们的模型估计,这 30 位顾客占全部需求的 89.8%,因为低概率需求仍然缺失。一个新细分,胜过旧细分里的第 40 次。

Yibud 分数是饱和度量吗?需要账号吗?

不是。Yibud 分数来自对你点子输入的确定性规则引擎。饱和来自在同一个细分里给需求和痛点原话编码。你不需要账号。本页的方法可以单独成立。如果你想在写规则之前,用手电筒照一下弱的顾客假设,再跑免费分析器。可选的语言模型文本只润色措辞。

下一次占日历之前,先写停止规则

Yibud 用确定性引擎给弱的顾客假设打分。你在还诚实的时候写下细分、批次、饱和检查、上限和动作——然后次数才是覆盖,而不是感觉。

生成 Yibud 报告 →