一句话答案
什么是创业验证清单?
创业验证清单是一份在写一行代码前需要逐项打勾的证据收集清单。它覆盖九个维度——问题、客群、方案、市场、渠道、付费意愿、产品-市场契合度、MVP 和问题-方案匹配——并把每个维度拆成 3–5 个一周内能回答完的是/否问题。清单的产出不是分数也不是结论,而是一份「哪些假设有证据、哪些还需要测试」的清单。先用它找出计划中风险最高的未知数,再跑最便宜的实验去验证它。
核心要点
如何使用这份清单
- 验证是收集证据,不是预测未来。清单把客套话和假设变成可以用真实客户和真实承诺回答的是/否问题。
- 九个版块,按顺序跑:问题 → 客群 → 方案 → 市场 → 渠道 → 付费意愿 → 产品-市场契合度 → MVP → 问题-方案匹配。每一步都建立在上一步的基础上。
- 每个版块 3–5 项核对,单人 founder 一周内可完成。如果答不上来,那就是最值得先测的假设。
- 清单的产出不是分数、结论或保证。产出是「哪些假设有证据、哪些还需要测试」的清单。
- 用清单找到计划中风险最高的未知数——它的失败会让整个计划作废的那个——然后跑最便宜的实验去验证它。
如何使用
如何使用这份清单
不要一次性回答完九个部分。这份清单最好当作一个循环来用:先挑出那个「如果判断错了,会最快让整个想法崩塌」的假设,验证它,然后回头重读那些被新证据改变了的部分。
从问题开始
在做任何事之前,把问题写成一句别人可以反驳的话。如果你说不清谁在受困、多久发生一次,剩下八个部分就没有可依附的东西。
确定目标客户
一直收窄,直到你能说出这周去哪里找到其中十个人。「中小企业」不是客户;「按小时计费的独立记账人」才是你能真正去对话的群体。
优先验证最强的假设
按「这个假设为假时,计划会崩掉多少」来排序,而不是按验证的难易程度。风险最高的假设通常是:会不会有人付钱,以及你到底能不能触达这个客户。
收集证据,而不是意见
记录真实发生的事——某人做了什么、付了什么、承诺了什么——而不是他们说自己「可能会」做什么。什么算证据,见下面的证据层级。
决定下一步验证什么
每一轮都要以一个明确的下一步实验和一个日期结束。只产出阅读量、却没有下一次验证的清单,就没有完成它的工作。
清单
九个版块、三十多项核对
按顺序跑。每一步建立在上一步的基础上。在第一个答「否」的版块停下来,先跑那个版块对应的实验。
第 1 部分 · 问题
这个问题真实存在吗?
在验证客群和方案之前,先验证问题本身是否真实存在。一个常见的失败模式是 founder 自己感同身受,于是跳过这一步——但 founder 只是一人,不是一个市场。
- 能用一句话描述这个问题的具体当事人吗?「忙碌的父母」不够;「每周在家做饭四次、家有五岁以下两个孩子的双职工父母」才够。
- 问题会按固定节奏反复出现吗(每天、每周、每月)?可重复的问题比一次性烦恼更容易变现。
- 人们已经在为某个替代方案花时间或金钱吗?电子表格、外包、自由职业者、零散工具——替代方案是疼痛最实在的信号。
- 至少有五个人在不被打招呼时主动告诉你他们有这个问题?问卷里礼貌性的同意不算;讲述自己过去具体经历的故事才算。
- 12 个月后这个问题仍然存在吗?趋势、监管和平台变化可能让一个真实问题一夜消失。检查你赖以成立的假设是否脆弱。
第 2 部分 · 客群
客户是谁——你能否触达他们?
无法触达的客户等于没有客户。这一节把「所有人」变成一个具体、可触达的人。
- 你能说出客户已经在花时间的一个具体渠道吗?(Reddit、Slack 群、行业会议、播客、垂直 YouTube 频道。)可触达性胜过可寻址性。
- 你能详细描述他的一天,细致到在咖啡馆能认出他来吗?ICP 越具体,对渠道选择的倒推越有力。
- 过去两周你跟他们中 5 个人真正聊过吗?不是问卷——是聊天。30 分钟对话胜过 300 份问卷,适合早期验证。
- 他们已经在为部分解决方案付费吗?钱流向哪里,替代方案就在哪里,那就是你的竞争集合。
- 购买决定是一个人做的,还是一个委员会?单人买家和 B2B 委员会的验证实验截然不同。
第 3 部分 · 方案
提出的方案是否对得上问题?
最便宜的方案是已经存在的方案——或者挂靠在客户已有的替代方案上。这一节的目标是找到「最小的有用答案」。
- 能用一句话描述客户使用产品后会做哪些不同的事吗?如果答案是「省时间」之类的模糊词,说明方案还不够具体。
- 仍然能交付核心结果的最小版本是什么?任何不贡献核心结果的功能都是范围蔓延。
- 客户能不能用一个 Notion 模板、一段 Loom 视频、一个 30 分钟的自由职业者服务解决?如果能,那 MVP 必须在价格、速度或质量上击败手工版本。
- 方案是否要求客户改变现有习惯?每一次必须的习惯改变都是摩擦成本,要把它算进去。
- 方案是否明显优于替代方案,且客户能用一句话向朋友转述?口碑取决于那一句话。
第 4 部分 · 市场
市场可触达吗?它在变化吗?
市场存在的条件是:足够多、可触达的人体验这个问题、为替代方案付费,并且有可能切换。对单人 founder 来说,可触达性比 TAM 重要得多。
- 你能说出客户今天在用的至少三个替代方案吗?没有替代方案通常意味着问题还未被感知为问题。
- 现在市场里有什么变化——新监管、新平台、新行为——正在让这个问题被重新感知或被重新解决?顺风会复利。
- 是否已经有竞争对手在服务这个市场?适度竞争是好信号(需求被验证过)。拥挤又没有明显定位就是黄灯。
- 买家细分是否足够窄,窄到你能在一个季度内把他们服务好?「全世界的每一家小企业」不是目标——挑一个细分。
- 你能画出一条进入这个市场的现实路径吗?无法触达的市场等同于没有市场。
第 5 部分 · 渠道
你如何触达前 100 个客户?
渠道是创业计划里最被忽略的一节,也是计划失败的最常见原因。如果你触达不到第一个客户,其他假设都没意义。
- 你选了一个主渠道和一个备用渠道吗?一个 founder 同时跑五个渠道等于零渠道。
- 你能说出前 100 个客户的姓名、来源渠道和触发事件吗?一份具体名单胜过抽象画像。
- 渠道是否可重复?一次爆红是彩票;SEO、社群或销售节奏才是系统。
- 通过这个渠道触达一个客户要花多少时间或金钱?如果答案是「我还不知道」,那是首先要搞清楚的事。
- 你已经实际跑了两周并测量了响应吗?关于渠道的「计划」是猜测,「测量」才是证据。
第 6 部分 · 付费意愿
客户会付费吗?你怎么知道?
客气的「我会买」不是付费意愿。付费意愿是一笔信用卡、一笔电汇、一份签好的合同或一份预购——任何把意愿变成真实承诺的东西。
- 你已经为某个细分客群标了一个具体美元价格吗?「免费」或「待定」不是价格。
- 在你动手之前有人付过钱吗——哪怕只是小额定金?预购、定金和意向书是不需要成品就能得到的付费信号。
- 你请过五个目标客户给出一个具体金额吗?锚定问题(「你愿意付 X 吗?」)不可靠;开放式问题(「你预期付多少?」)更可靠。
- 这个价格能不能覆盖获客成本和服务成本?负的单元经济无法靠增长救活。
- 付费意愿是持续性(订阅、长期合同)还是一次性的?持续性收入改变了整套假设和 MVP 范围。
第 7 部分 · 产品-市场契合度
用户会反复获得价值吗?
产品-市场契合度不是一个发布动作,而是一组行为模式。留存、自发口碑是信号;发布日的流量不是。
- 有意义比例的用户在第 2、7、30 天会回来吗?早期产品的留存曲线胜过漏斗顶部指标。
- 至少有一部分用户在没被打招呼的情况下把产品推荐给朋友或同事吗?自发口碑是早期最强的契合信号。
- 当你问「如果我们停服你会错过什么」时,用户能说出具体功能或结果吗?模糊赞美(「挺好的」)不是契合;具体的损失才是。
- 没有你主动导量,用户能自己找到产品吗?自然发现、搜索或口碑是营销花销无法伪造的测试。
- 你能说出与留存相关的那一个行为吗?那个行为就是要优化和保护的东西。
第 8 部分 · MVP
能验证最危险假设的最小实验是什么?
MVP 不是一个小型产品。它是对「如果失败会让整个计划作废」那个假设的最小测试。如果它不能给出明确的是/否答案,它还不够小。
- 你能说出 MVP 必须测试的那一个最危险的假设吗?「有人会用」不够具体;「14 天内 10% 的试用用户会付费转化」才够。
- 能做的最小版本是什么?落地页、礼宾式 MVP、巫师-Oz、单功能范围、纸质原型——选最小的那个。
- 通过的测试长什么样?要有数字、要有一个具体阈值。「积极反馈」不是通过的测试;「40% 接受访谈的客户承诺交定金」才是。
- 这个测试多久能产生信号?如果答案超过四周,把范围再切小。
- 运行这个测试最少需要哪些功能?哪些可以等?不在测试路径上的都是范围蔓延。
第 9 部分 · 问题-方案匹配
当问题出现时,用户真的会用你的方案吗?
问题-方案匹配介于问题验证和产品-市场契合度之间。它是「对的客户在对的场景里反复够到对的产品」的时刻。信号是反复且自发的使用,不是注册量。
- 用户会用他们自己的话描述「什么时候会去用这个产品」吗?他们的话就是你的营销文案。
- 有没有一个具体的触发事件在驱动使用?日/周/月——频次应该匹配疼痛的频次。
- 你看过真实用户在真实问题上用产品吗?观察胜过问卷。
- 用户描述的是结果(「我一小时就交付了报告」)还是仅仅活动(「我用了一下工具」)?结果是信号。
- 如果产品明天消失,用户是不是得自己拼一个替代方案?能说出替代方案就是最强的契合证据。
证据层级
并非所有证据都等价
最常见的验证失误,是把鼓励当成了证明。不同信号消除不确定性的能力差别很大:别人说什么不需要付出代价,别人做什么需要付出代价,别人付钱则代价最大。在做任何决定之前,先给你的证据分级。
较弱的信号
这些对对方来说成本很低。早期值得收集——它们能产生假设——但不足以支撑你开始开发。
- 你自己坚信这个问题真实存在
- 朋友、同行或粉丝对这个点子的称赞
- 关于「未来假设行为」的问卷回答
- 没有附带任何进一步承诺的邮件订阅
- 社交媒体点赞、投票,以及「我会用的」这类回复
较强的信号
这些需要对方付出时间、金钱或声誉。它们不保证任何结果,但每一条消除的不确定性都超过上面整张清单。
- 同一位客户在无人提示的情况下,不止一次主动描述这个问题
- 已经有人为某个替代方案、竞品或人工处理付费
- 预订、定金,或已签署的意向书
- 付费试点,哪怕金额很小或有折扣
- 在你不提醒的情况下,产品被反复使用
- 第二次购买,或者无需任何人催促的续费
没有任何单一信号能证明一个点子会成功。付费试点仍可能长不成生意,安静的发布也可能找到市场。更强的证据并不预测结果——它只是缩小了你「可能仍然搞错」的范围,而这也是验证唯一能诚实为你做到的事。
深入了解最强的那几类信号
决策框架
从清单到决策
验证是一连串证据收集步骤,不是单一测试。用下面的框架把清单产出转化为「建 / 不建」的决策。
问题
跑「问题」核对。如果答案是「否」,项目不值得继续——任何计划都救不了一个不存在的问题。
客群
跑「客群」核对。如果你说不出一个可触达的客户,问题存在但项目不存在。
方案
跑「方案」核对。如果方案不能产生客户能描述的明确结果,计划需要换一种形状。
市场
跑「市场」核对。如果市场不可触达或没有可行的进入路径,项目不可融资。
渠道
跑「渠道」核对。如果你描述不出前 100 个客户和他们怎么被触达,计划就是残缺的。
付费
跑「付费意愿」核对。如果没人会为真实结果投入真实金钱,商业模型就是要去测试的假设。
留存
用真实用户跑「产品-市场契合度」核对。如果留存走平、口碑为零,产品就是要测试的假设。
MVP 实验
设计一个最小实验去测试剩余最危险的未知数。MVP 是实验,不是产品。
决策
决定:建、缩范围或终止项目。把学到的东西写回清单,重新跑产出最多新证据的那一节。
框架是顺序的,但当后面的节产出新证据时,你可以回到前面的节再跑一遍。第一次 founder 几乎总会学到重写至少前面一节的东西——这正是验证的目的。
当证据不足时
如果验证没通过怎么办
证据不足既不是对这个点子的判决,也不是对你的判决。它通常意味着某一个具体假设错了——有用的做法是找出是哪一个,只改那一处,而不是放弃整个计划,或者干脆硬着头皮继续。以下六件事你可以改变,大致按成本从低到高排列:
重新审视问题
如果没人能用自己的话说出这个问题,你描述的可能只是一点麻烦,而不是一项成本。回到访谈里去听:人们已经在为什么事情花时间或花钱绕路。
收窄客户群体
广泛人群里不温不火的反应,常常掩盖了某个狭窄人群里的强烈反应。挑出反应最强的子群体,只针对他们重跑同样的检查。
更换解决方案假设
问题可以是真实的,而你提出的解法是错的、太重了,或者改变现有习惯的代价太大。保留问题,替换解法,重新验证。
尝试另一个获客渠道
渠道结果衡量的是渠道,不亚于衡量点子本身。在某个平台没有起色,几乎说明不了需求在别处是否存在。
测试定价
拒绝某个价格,不等于拒绝付费。在断定「没有付费意愿」之前,先换一种收费模式、换一个计价单位,或换同一家机构里的另一个决策人。
做一个更小的实验
如果一次测试大到无法给出清晰答案,就把它缩小。一次以明确承诺收尾的对话,胜过一次只带来含糊流量的发布。
把验证看成一组可调的旋钮,而不是一个及格/不及格的成绩。多数最终跑通的点子,是被早期证据改变的,而不是被早期证据确认的。决定停下来同样是一个正当结果——这份清单的存在,就是为了让这个决定在开发之前廉价地做出,而不是在开发之后昂贵地做出。
常见错误
初次 founder 常犯的八个验证错误
每个错误都有命名的失败模式和应对动作。这份清单是有立场的——它们是在真实 founder 访谈里出现频率最高的几种。
错误 1
还没跟客户聊就开始写代码
应对:本周跟五个目标客户聊完,再写代码。谈话比任何画像模板都能给出更锋利的 ICP。
错误 2
把恭维误当成需求
应对:要承诺,不要观点。信用卡、定金、签好的意向书——任何把客套赞美转化为真实代价的东西。
错误 3
假设「所有人」都是客户
应对:挑一个能用一句话描述的细分。可触达性胜过规模。其他细分以后再说。
错误 4
只盯着 TAM
应对:列出前 100 个客户和触达他们的渠道。TAM 是给投资人看的,不是给单人 founder 用的。
错误 5
没有证据就定价
应对:先选一个能覆盖单元经济的价格,再问五个客户他们实际愿意付多少。开放式问题胜过锚定问题。
错误 6
只盯虚荣指标
应对:优化留存、自发口碑、未被引导的转介绍。这些才是与可持续增长相关的指标。
错误 7
把 MVP 做得太大
应对:砍掉所有不贡献「最危险假设」的功能。如果 MVP 要超过四周才能跑通,它还不够小。
错误 8
忽略负面证据
应对:把每个「不」当作最有信息量的回应。如果连续三个客户告诉你同一件负面的事,计划要改的是计划,不是客户。
何时动手
你不需要 100% 确定才能动手
清单是收集证据,不是许可书。founder 不需要每个问题都答「是」才能写代码。目标是先把最重要的未知数缩小,再构建能测下一个未知数的最小实验。
如果你能说出风险最高的假设和能测它的最便宜实验,那就可以开始了。如果你说不出,那就是清单在告诉你下一步该做什么。
在每次实验后重新跑产出最意外答案的那一节。第一次 founder 几乎总会学到重写至少一节的东西。计划随证据积累而改变——这正是验证的意义。
工具的位置
什么时候该用 Startup MRI
这份清单免费,在纸上也能用。当你希望把同样的结构套用到你自己的具体点子上、并让风险最高的部分被直接指出来时,Startup MRI 才派得上用场。以下这些场景可以用它:
- 评估一个全新的点子,想要一个结构化的起点,而不是一张白纸
- 比较几个创业点子,需要一个一致的比较基准
- 准备客户访谈,想先知道该重点追问哪些假设
- 在一轮实验之后,决定下一步该验证什么
- 复查现有创业项目中某个悄悄一直没被验证过的假设
从这里往下走
每一个入口解决的问题都不一样。挑那个和你此刻真正的疑问相匹配的。
- 创业点子评估工具
在全部九个清单维度上给一个点子打分,看清哪一部分的证据最薄弱。
- 创业评分计算器
在生成完整报告之前,先看清各项分数是如何从你的输入计算出来的。
- 创业点子验证工具
针对特定类型的点子逐步验证——SaaS、市场平台、移动应用等。
- Startup MRI 报告示例
在提交任何东西之前先读一份完整报告,知道你会拿到什么。
- 获得 7 天验证行动计划
提交你的点子,获得由最高风险假设推导出的确定性 7 天计划——动作、证据、第 7 天的决策规则。
Startup MRI 不预测一家创业公司会不会成功,任何工具都无法诚实地做到这一点。它把本页这些检查套用到你的输入上,告诉你证据最薄弱的地方在哪里。
常见问题
创业验证的高频问题
短答案,使用与「创业验证中心」一致的措辞。更详细的答案见链接文章。
- 什么是创业验证清单?
- 创业验证清单是一份覆盖九个维度——问题、客群、方案、市场、渠道、付费意愿、产品-市场契合度、MVP 和问题-方案匹配——的是/否证据核对清单。每项都是单人 founder 一周内能回答的。产出是「哪些假设有证据、哪些还需要测试」的清单。
- 我该如何验证一个创业想法?
- 按顺序跑清单:问题 → 客群 → 方案 → 市场 → 渠道 → 付费意愿 → 产品-市场契合度 → MVP。在第一个答「否」的版块停下来,先跑那个版块最便宜的实验。免费 Startup MRI 分析覆盖同样九个维度,并指出你最值得先测的那一节。
- 在构建 MVP 之前我应该验证什么?
- 在 MVP 之前,验证问题、客群、方案和市场。如果问题真实、客户可触达、方案匹配问题、市场没有把你关在门外,那 MVP 是合理的。渠道和付费意愿留到 MVP 里再测。
- 我如何知道一个创业问题是否真实?
- 五个不同的人主动讲述他们遇到这个问题的故事——不是对问卷的礼貌同意。最强的信号是替代方案:他们今天为绕过这个问题付出的时间和金钱越多,问题就越真实。
- 我如何验证付费意愿?
- 要真实的承诺,不要观点。信用卡、定金、签好的意向书或预购——任何把意愿转化为成本的东西。用业务模型的价格跑 30 天礼宾式 MVP、五位付费客户,是验证持续付费意愿最便宜的实验。
- 我如何验证产品-市场契合度?
- 看三个信号:留存曲线在零以上走平、未被引导的自发转介绍、具体的损失(「我会想念 X」)。发布日的尖峰不是契合;走平的留存曲线才是。在判断之前,至少用 20–50 位真实用户跑 4–8 周。
- 创业验证需要多久?
- 计划 2–6 周的结构化工作:1–2 周做问题访谈,1–2 周做落地页或冒烟测试,1–2 周做付费意愿测试。免费 Startup MRI 分析 60 秒就能给出,并指向你最值得先测的那一节。
- AI 能验证创业想法吗?
- AI 能基于你给的输入打分并指出最值得测试的假设。它不能替你跟客户聊天、不能跑实验、不能投入真实金钱。用 AI 找出风险最高的未知数;用客户对话去验证它。
- 在动手前我应该收集什么证据?
- 动手前请收集:五位不同人士的问题故事、一个客户已经在花时间的可触达渠道、一个客户同意的具体价格、一个客户今天在用的具体替代方案。低于这些就是猜测。
- 如果验证结果是负面的该怎么办?
- 把每个负面答案当作最有信息量的回应。更新计划、缩小客群、调整价格或转向方案。不要收集更多负面证据却无视它——重新跑产出最意外答案的那一节。