跳到正文
YibudYibud

决策链

Startup 决策指南 — 从想法到下一次实验

五步。一个确定性规则引擎。从一句话想法到本周最值得运行的那一次实验的最短路径。

最后更新 · 2026年9月3日

快速回答

什么是 Yibud 决策链?

Yibud 决策链是 Startup MRI 工具设计支持的五步路径:想法、验证、评估、评分、Startup MRI 报告,以及下一次验证实验。每一步都有一个输入、一个输出、一个下一步动作。四个产品界面——Startup 想法验证器、Startup 想法评估器、Startup 评分计算器,以及 Startup MRI 分析向导——并不是四个不同的产品,而是同一个规则引擎的四种形态,让创始人可以从最匹配当前阶段的步骤进入链条。验证(引擎权重 0.25,最高)在链条中被视为头等步骤,因为便宜、具体的验证,是创始人在动手之前能买到的最便宜的保险。

核心要点

Yibud 如何把想法变成下一次实验

  • 链条共五步:想法、验证、评估、评分、Startup MRI 报告,以及报告建议的下一次实验。Yibud 的每个工具都对应其中一步。
  • 验证器、评估器和评分计算器不是三个不同的产品,而是同一个确定性规则引擎的三种框架,针对习惯不同动词或不同输出形态的创始人。
  • 验证在引擎中权重最高(25%),因为便宜、具体的测试是创始人在动手之前能买到的最便宜的保险。链条把验证视为头等步骤,而非事后补充。
  • Startup MRI 报告以基于最高风险维度的 7 天验证行动计划结束。行动计划才是决策,评分只是起点;它告诉创始人本周应该运行哪一个实验。
  • 每次实验后重新进入链条。评分会随着信念变成证据而变化,单维度的位移会告诉创始人哪个实验产生了最强的信号。

五步链

从想法到下一次实验

每一步都有一个输入、一个输出、一个下一步动作。链条很短是有意的——目标是信念到证据之间最便宜、最可信的路径。

  1. 1

    第一步 · 想法

    输入
    一句话描述你想构建什么、为谁构建。
    输出
    一个可以被评分的明确想法。
    下一步
    当这句话足够具体、可以测试时再进入第二步。'一个给营销人员用的 AI 工具' 还不够;'一个为 SMB 销售团队总结客户通话记录的 Slack 机器人' 就可以了。
    工具
    暂不需要工具——想法本身就是输入。
  2. 2

    第二步 · 验证

    输入
    想法加上你已经拥有的证据(候补名单人数、访谈数量、具名买家、付费意愿信号)。
    输出
    一个列出该想法所依赖的所有假设的清单,并标出风险最大的那个。
    下一步
    挑出那个唯一的关键假设——它的失败会让其他计划全部失效的那个。带着它进入第三步。
    工具
    打开 Startup 想法验证器,查看七级测试阶梯——每级对应一个维度。
  3. 3

    第三步 · 评估

    输入
    已经命名的假设、目标用户和所选渠道。
    输出
    一个想法-执行力对照读数:想法哪里强/弱,创始人能否执行。
    下一步
    把想法放到 2 × 2 上(强/弱想法 × 强/弱执行力)。每个象限对应不同的下一步动作。带着象限和对应的动作序列进入第四步。
    工具
    打开 Startup 想法评估器,查看 2 × 2 网格和每个象限的动作计划。
  4. 4

    第四步 · 评分

    输入
    规则引擎评分的同样五个输入:想法、用户、商业模式、渠道、技术背景。
    输出
    一个 0–100 的总分、七个维度的子分数,以及一个区间读数(基础缺失 / 信号混合 / 多数输入一致 / 实际少见)。
    下一步
    阅读单维度拆解,而不是总分。找出评分最低的维度——下一步要测试的就是它的关键假设。
    工具
    打开 Startup 评分计算器,查看区间和单维度拆解。
  5. 5

    第五步 · Startup MRI 报告

    输入
    第四步的五个输入加上你目前拥有的证据。
    输出
    一份结构化报告:分数、首要三大风险、命名的关键假设、MVP 蓝图、4 周首批客户计划,以及一份基于最高风险维度的 7 天验证行动计划。
    下一步
    运行 7 天计划里命名的最便宜的实验——通常是用户访谈、按计划定价的落地页、或 30 天礼宾式服务。带着新证据回到第四步。
    工具
    运行免费的 Startup MRI 分析,60 秒内即可拿到报告。

报告之后

'下一个实验' 究竟意味着什么

报告以基于最高风险维度的 7 天验证行动计划结束。每天都有一个动作、一个目的、一个证据目标。第 7 天有一个明确的 Continue / Refine / Re-test / Stop 信号。

  1. 1

    第 1 天 · 锁定关键假设

    报告命名的那个会让其他计划全部失效的单一假设。评分最低的维度通常就是这个位置,但并不总是。

  2. 2

    第 2 天 · 设计最便宜的行为信号测试

    一次用户访谈、一个按计划定价的落地页、一个 30 天礼宾式服务,或者一个 Wizard-of-Oz 流程。行为信号是可数且有时限的;观点不是。

  3. 3

    第 3 天 · 预先确定决策规则

    提前决定什么算有用证据、什么是不确定的、什么会触发重跑、什么会强制停止。没有决策规则的测试,换了包装就是上线。

  4. 4

    第 4 天 · 运行测试

    一到两周,取决于命名的行为。先不要发布完整 MVP——测试是为了得到证据而做的最小构建。

  5. 5

    第 5 天 · 记录证据

    观察到了什么、没看到什么、什么让你意外。每个信号一行,记在一个能跨越下一轮链条的日志里。

  6. 6

    第 6 天 · 用新证据重新评分

    用更新后的输入重新跑 Startup MRI。单维度的位移会告诉你哪个实验产生了最强的信号。

  7. 7

    第 7 天 · Continue、Refine、Re-test 或 Stop

    挑四个明确信号之一。链条再从这里开始。

实验之后

如果实验强化了假设,从第四步带着新证据重新进入。如果削弱了假设,从第二步重新列出假设。如果推翻了关键假设,从第一步换一个新想法。链条很短是有意的——目标是信念到证据之间最便宜、最可信的路径,重复直到决策被逼出来。

实验 BRIEF

Yibud 实验 brief 长什么样

每一份 Startup MRI 报告都会以一个具体实验结尾,该实验由最高风险维度选出。每份 brief 有九个固定字段,中英文都一样。内容是手写且确定性的;语言模型不选择实验。

设计建议,不是已完成的测试

Yibud 的实验 brief 是一份你可以跑起来的验证设计。它不是验证已经完成的证据。Brief 告诉你要测试什么、找谁测、观察什么、以及基于结果做什么决定。结果来自你的实验,不来自 Yibud。

做 5 次 30 分钟的问题访谈

对应风险: 市场需求

目标

确认你点名的痛点是真实、经常发生、足够尖锐的——以至于对方已经在花时间或金钱绕着走。

假设

符合 ICP 的 5 个人能用他们自己的原话,描述最近一次这个痛点真正伤到他们的瞬间;其中至少一个已经在为某个临时方案付费。

为什么是它

问卷和投票测的是观点,只有对话能让你看到问题背后的真实语言和行为。当最高风险是这个,观点不是证据。

测试对象

5 个匹配 ICP 且最近 30 天里亲身遇到过这个问题的人。从 LinkedIn、目标用户常读的 subreddit、或相邻付费产品的现有客户里找。

步骤

  1. 用一句话写清楚要聊的问题。念给自己听——听起来像推销就改成问句。
  2. 用「最后一次」开场,而不是「将来会不会」。坏例子:「你会用一个能…的 App 吗?」好例子:「上一次遇到这个问题是什么时候?走一遍你当时怎么处理。」
  3. 听到痛点出现在他们原话里时多问一句「为什么」/「然后呢」,连续追问三次。
  4. 前 25 分钟不要解释你的方案。最后 5 分钟再说。目标是收他们的语言,不是卖东西。
  5. 结尾问他们已经试过什么、为它付过什么——已经花出去的钱,是最强的信号。

待收集证据

  • 5 份纪要(或录音)+ 每人一行「最痛瞬间」摘要。
  • 几个人在不提示的情况下自己说出了同一个根本原因。
  • 其中几个人已经在为某个和你的方案重叠的临时方案付费。

支持假设的信号

5 人里有 3 个以上用相近的词独立描述了同一个痛点,且至少一人已经在为某种 workaround 付费。

削弱假设的信号

访谈对象要么记不起最近一次的具体瞬间,要么描述的是另一个痛点,要么客气地同意却没有行为上的变化。

下一步决定

5 人里至少 3 个独立说出同一痛点且已存在 workaround → 继续。痛点稳定但 workaround 不存在 → 重新框定问题。连续 3 个访谈都说不出一个具体瞬间 → 停止或转向。

Yibud 支持的七种实验类型

每种实验类型精确映射到规则引擎的一个风险维度。你的报告会选出匹配你最弱维度的那种实验。

  • 对应风险: 市场需求

    做 5 次 30 分钟的问题访谈

    5 次 30 分钟访谈,看你点名的痛点会不会在别人的最近一次回忆里真正出现。

  • 对应风险: 变现模式

    用真钱做一次定价 reveal

    真实价格 + 真实付款链接 + 20 个 ICP 匹配的人。客气的 yes 不是价格。

  • 对应风险: 获客渠道

    用真实 artifact 探测一个渠道

    一个渠道,5 天内 5–10 条 artifact,真实回复率——不是想象中的回复率。

  • 对应风险: 创始人适配

    量化「临时方案」的预算

    用一个真实数字替代「大家需要这个」——ICP 已经在 workaround 上花了多少时间和钱。

  • 对应风险: 竞争

    让你的楔子在位者面前见真章

    把楔子给 10 个在位者客户看。数多少人在不提示的情况下把它说出是切换触发。

  • 对应风险: 验证成本

    上一张一屏落地页测试

    一屏 + 一个 CTA + 一个渠道 200–500 个目标访客。SEO 暂时不做,几天内要信号。

  • 对应风险: 构建复杂度

    5 天交一个手工端到端切片

    5 天端到端切片,除最难那一步外全部手工,真实用户在你面前用。

这些是根据你的具体输入生成的实验设计,不是泛泛的创业建议。不同的想法、不同的最弱维度,会从同一个引擎里产出不同的实验。

为什么验证是头等步骤

验证在规则引擎中权重最高

七个维度及其权重,取自当前 V4 规则引擎。验证以 0.25 居首;构建难度以 0.05 垫底。权重总和为 1.00。

  • 验证

    0.25

    对最危险假设的便宜、具体的测试。具名的候补名单、具名的访谈人数、具体的买家数字、清晰的工作描述(JTBD)会拉高评分;模糊的用户、泛泛的证据、高成本的验证路径会拉低评分。

  • 分发

    0.20

    到达前一百名客户的一条可信路径。对单人创始人而言,社区驱动和小众论坛是最高分的渠道;付费获客和冷外联是负分。

  • 市场需求

    0.18

    用户群是否足够具体、问题描述是否足够具体。模糊的用户和一句话想法在这里会失分。

  • 变现

    0.12

    可以按真实价格测试的收入模型。订阅制得分最高。没有给出变现答案是引擎里最重的输入惩罚。

  • 竞争

    0.10

    这个品类是否已经被大量类似产品占据?目标用户是否足够窄以守住阵地?落入饱和品类模式的想法在这里失分。

  • 创始人技能

    0.10

    所填背景是否匹配实现和售卖这件事所需要的能力。有经验的开发者加分最多;非技术创始人会小幅失分——雇佣或学习是真实成本,但不是一票否决。

  • 构建难度

    0.05

    从想法到客户能反应的东西之间隔着多少工作。技术背景是唯一能推动这一维度的输入。

链条不是什么

链条是决策辅助,不是预测。引擎从未见过你的客户,语言模型也从不决定数字。每次实验产出证据后,重新进入链条;单维度的位移会告诉你想法在变强还是变弱。

常见问题

关于决策链的常见问题

简短回答,与 Startup 验证 hub 一致。更长的答案在相关文章里。

Startup 想法验证器、评估器和评分计算器之间有什么区别?

这三个界面是同一个 Startup MRI 规则引擎的三种框架。验证器把报告框成一个七级测试阶梯,每级一个维度,并为每级指向最便宜的行为信号测试。评估器把它框成一个 2 × 2(想法强度 × 执行力),每个象限对应一个动作计划。评分计算器把它框成一个 0–100 的分数,含四个区间、四种常见模式和一个四步阅读流程。挑一个最匹配你今天问题的那一个。

我应该先用验证器、评估器还是评分计算器?

用最匹配你在链条中所处阶段的那扇门。如果你的问题是'我应该先测试哪个假设?',打开验证器。如果是'这个想法值得追求吗?',打开评估器。如果是'这个 0–100 的数字到底意味着什么?',打开评分计算器。三个工具都用同样的五个输入跑同一个确定性规则引擎,输出的单维度分数完全一致。

链条应该花多长时间?

第一步(想法)和第四步(评分)各 60 秒——评分就是免费的 Startup MRI 分析。第二步(验证清单)一到两天。第三步(评估)是把想法放到 2 × 2 上所需的时间。整个链条很短是有意的。昂贵的部分是第五步——7 天验证行动计划命名的最便宜实验——通常需要一到两周。

可以跳过链条里的步骤吗?

可以从任意一步进入链条,但不能跳过实验。评分是决策辅助,实验才是决策。没有实验的评分,换了包装就是上线。

如果我的评分很高怎么办?

高评分意味着引擎在你告诉它的信息里没找到该想法会不成立的理由。它并不意味着想法会成功。阅读单维度拆解、找出评分最低的维度,然后运行 7 天验证行动计划里命名的最便宜实验。带着新证据回到第四步。

如果我的评分很低怎么办?

低评分意味着你提供的输入里至少有一个维度没有支撑。阅读单维度拆解,找出评分最低的维度。要么打磨该输入(更清晰的用户、更具名的渠道、更具名的变现),要么运行 7 天验证行动计划里命名的最便宜实验。评分只是起点,不是结论。

验证在规则引擎里是怎么加权的?

验证权重为 0.25,是七个维度中最高的。总和为 1.00:验证 0.25、分发 0.20、市场需求 0.18、变现 0.12、竞争 0.10、创始人技能 0.10、构建难度 0.05。权重是一种观点,而非中性均值;规则引擎假设项目最常见的死亡原因是没人去验证。单维度拆解会单独展示,可以不带权重地阅读。

规则引擎来自哪里?

规则引擎在 Startup MRI 方法论页面里有文档。报告里的每一个数字都来自引擎;语言模型只润色文风。相同的输入总会产出相同的报告,每一个分数都可以追溯到一条具体触发的规则。该引擎自 2026 年起在生产环境使用,每次新增维度都会更新。

拿到低创业评分后应该怎么做?

阅读单维度拆解,找出评分最低的维度,然后运行报告推荐的实验。实验由最高风险假设选出,不是最容易跑的那个。带着实验产出的证据回到链条第四步。

Yibud 是怎么把评分变成验证实验的?

规则引擎从你的输入中识别出最弱维度。每个维度精确映射到一种实验类型——针对该风险最便宜的具体测试。实验 brief 由你的输入确定性地生成;相同的输入总会产出相同的实验。语言模型不选择实验,也不选择 brief 的内容。

创业验证测试里什么算证据?

行为,不是观点。付费比说 yes 更强。完成一次访谈比一次问卷回答更强。回访比点赞更强。实验 brief 会写明要观察的具体信号,以及什么数量足以支持或削弱假设。

Yibud 会替我完成真实的市场验证吗?

不会。Yibud 提供的是分析、评分和具体的实验设计。验证结果来自你跑完实验并将证据提交回报告。证据评估器会根据你的原始评分重新运行评估,告诉你哪些变了,哪些没变。

进入链条

挑一扇最匹配你今天所处阶段的门。门的另一边,链条是同一条。