Reading Archive
← 返回文章列表
铜匠AI・十点睡觉 @CopperForgeAI · 2026-05-17

Anthropic 给创始人的内部手册:AI 原生创业的 4 阶段方法论

昨晚Anthropic官方发布了一个文章,里面有一个完整的ppt文档:构建AI原生的创业公司,把"我有一个想法"到"我有一个产品"的距离压缩到了一个下午。按理说这应该让创业更容易成功。

但 Anthropic 发的这篇《BuildinganAI-nativestartup》——他们写给创业者看的一本内部手册——里讲了一个反直觉的判断:

AI 让创业的失败率,只会上升。

Article image

这本手册是谁写的,凭什么值得看

写这本东西的是 Anthropic 自己。

他们不是只在卖 API。他们的工程团队自己在用 Claude Code 构建产品;他们投了一堆 YC 早期项目;他们的 Startup Program 直接管着一批正在用 Claude 跑 MVP 的公司。这本手册基本上是他们看着自家产品和投资组合里的创始人趟过来的坑,反过来整理出的"AI 原生创业操作系统"。

我把整个ppt完整的翻译成为了中文,仔细看了2次(完整翻译ppt在下方github地址)想要看下最牛逼的AI公司怎么来解决提高创业成功概率.

我看完最强烈的感受是:这不是一本鼓动你拥抱 AI 的宣传册,反而处处在浇冷水。

它把创业拆成 4 个阶段(Idea / MVP / Launch / Scale),每个阶段最值得讲的不是 AI 能帮你做什么,而是 AI 在每个阶段会放大什么陷阱。

下面是我把全书 36 页啃完之后提炼的 4 个核心要点。


① Idea 阶段:原型不等于验证

42% 的失败率会上升,根源就在这。

过去要造一个能跑的原型,需要找一位有合适技术栈的联合创始人,或者一笔预算外包给开发团队。一来一回最少几个月。这个慢本身是一种保护:它逼着创始人在没造出东西的几个月里,必须去和真实用户对话。

现在 Claude Code 一个下午就能给你一个能 demo 的版本。

听起来很好。但 Anthropic 直接点破了:

"一个能跑的原型很容易被误以为是'你在解决真实问题'的硬证据——但它不是。"

原型只是一根用来跟潜在用户对话的压力测试棒,对话本身才是证据。

更狠的一击在后面。手册里有一句我反复读了好几遍:

"确认偏误(confirmation bias)

现在配上了一个研究引擎。"

Article image

意思是:你让 AI 验证你的创业想法,它会去找支持的证据;你让它估你的 TAM,它会找让你的 TAM 看起来值得融资的那个数字。AI 沿着你给的方向前进——一个不发出尖锐问题的创始人,可以为一个糟糕的想法构造一份精致、看起来有研究依据的论证,比以往任何时候都更快,同时还感觉自己已经在做尽职调查。

Anthropic 给的解药是把同一把 AI 反过来用——让 Claude 当结构化反方辩手,专门去找证据否定你的假设。这个用法他们说"是 AI 原生创业生命周期里每一个阶段的核心用例"。

我自己的体会:现在用 AI 写 BP 这件事,本质就是在让 AI 帮自己做自我催眠。真正应该让 AI 做的事是:专门找反对你的理由。


② MVP 阶段:当心一种新东西叫"Agentic 技术债"

到了 MVP 阶段,Anthropic 提出了一个我没在别的地方看到过的概念。

传统技术债是线性的:你写了个临时方案,欠下一笔,慢慢还。

AI 时代的技术

债是复利的。

Article image

原文是这么说的:

"如果规约和架构约束没有写在 AI 能读到的地方,每一次会话都会从零重新推导基础决策,这些决策就开始漂移。最终你得到一个没有任何连贯心智模型的代码库——不是因为任何单个部分糟糕,而是因为这些部分从未被设计成能拼到一起。"

这一段我建议每一个用 Cursor/Claude Code 写代码的人贴墙上。

Anthropic 给的具体解法是:在 Claude Code 写下第一行代码之前,先让 Claude(不是 Claude Code)和你一起讨论清楚——

  • 这个产品的核心问题是什么

  • 你 6 个月内现实预期的规模是多少

  • 因此应该遵循哪些架构原则

  • 因此应该避免哪些依赖

  • 这个阶段你有意接受的权衡是什么

把这次讨论的输出存为一个叫 CLAUDE.md 的文件。

这个文件之后会被 Claude Code 在每个新会话开始时自动读到。它不是文档,是项目的持久化记忆——以及你和 AI 之间共享的、关于"为什么这么设计"的契约。

Anthropic 的建议更狠:每个 Claude Code 会话结束后,花 5 分钟把今天做了什么决定、引入了什么假设,加一条日志到 CLAUDE.md

"每会话 5 分钟的文档化,是对抗'复利成不可管理代码库的架构漂移'的便宜保险。"

顺便提一句,手册里另一个我喜欢的观点是关于零摩擦的范围蔓延。当加一个功能从"一个 sprint"变成"一个下午",每一个 feature 的添加单独看都说得通。这种范围蔓延在当下感觉不到,因为代价太小,但它会让你的产品在几周内膨胀到失去方向。

解药:在写第一行代码之前,写一份 scope 文档,明确你的 MVP 刻意不做什么,以及什么样的真实用户证据才足以加新东西。


③ Launch 阶段:你自己就是最大的瓶颈

到了 Launch 阶段,前两阶段那个"创始人事事亲为"的本能开始反噬。

这是 Anthropic 给出的几个非常具体的征兆:

  • 本该 1 小时完成的决策,现在要等一周才轮到你

  • 只有你知道答案,所以支持工单越

  • 积越多

Article image

  • 只有你亲自记得做的运营任务才会发生

我看到这一段的时候笑了——这画面太熟悉了,身边见过好几个创始人就是卡在这一步。

更难的是:没有一个清晰的时刻告诉你"这个转换发生了"。你只会在某个月底某天突然发现,公司停滞了,而你以为自己在埋头干活。

Anthropic 给的方法是做一次全开式审计——把你亲自处理的所有事列出来,从最微小的任务到最高风险的决策,然后让 Claude 帮你分成三类:

  • 可以完全自动化的

  • 需要人但不一定是你的

  • 真正需要创始人判断的

第三类才是你这个阶段应该花时间的。其余的,要么交给 Claude Cowork 自动化,要么招人或委派。

这一阶段还有两个值得记的细节:

关于安全——Anthropic 直接说:"智能体编码工具生成的是能工作的代码,不是天然安全的代码。"功能性问题肉眼可见,安全漏洞要被利用才知道。他们建议在任何真实用户碰你的应用前,专门做一轮安全审查(认证、会话、API 数据暴露、注入风险、有漏洞依赖)。

关于度量——那些把早期 traction 误判成 PMF 的人,往往是发布之后才开始追踪数据的。Anthropic 的建议是反过来:在第一个用户出现之前,先和 Claude 一起定义清楚什么是假阳性(注册但没激活、收入但没留存、热情但没回访),等数据进来时,专门让 Claude 用怀疑者视角解读这些数字。


④ Scale 阶段:累积深度,才是真护城河

到了 Scale 阶段,Anthropic 的论调变了。

前三个阶段都在讲"AI 是工具"。到这里,他们讲的是怎么让 AI 沉淀出一条别人复制不了的护城河。

最有意思的一个例子是这样的:

"一个通用的 AI 医疗账单工具会在 340B 药品计划 claim 上崩溃,但你的工具针对它们有专门逻辑。"

Article image

340B 是美国一个非常细分的药品折扣项目。通用 AI 不可能懂这种垂直行业的边界情况——但领域创始人懂。

Scale 阶段的核心工作,是把这些只有你知道的东西——行业行话、监管陷阱、为什么显而易见的答案行不通——通过 Claude 的对话/项目/记忆结构化外化出来,再通过 Skills 把"我如何审计一份商业租约"或"我如何分诊一份病人接诊表"变成 Claude 每次都能以同样方式跑的可重用流程。

Anthropic 的话是:

"几个月之后,这就成为一种没有任何通用 AI 能匹敌的专有知识基底。"

更进一步是用户数据飞轮——用户与你产品的每一次互动都生成行为信号,这些信号是"时间锁定的、上下文相关的、抄袭者买不到的"。Anthropic 让你针对这件事专门写一份给产品营销用的"一页护城河叙事":

"你的数据飞轮怎么转、转了多久、为什么一个今天才起步的、资源充足的竞品在两年内都无法复刻。"

我读这一段的时候反应是:直觉上 AI 时代护城河应该更难造,因为模型谁都能用。但 Anthropic 的论点完全反过来——AI 时代护城河反而更深,因为它来自一个通用模型永远拿不到的东西:你这个特定垂直里的边界情况、特定用户群的行为指纹、和已经嵌进客户日常工作流的集成深度。


我的一句话总结

这本手册的最后一句话,是我读完后停了很久的:

"瓶颈不再是你能造什么,而是你选择造什么。"

过去创业的瓶颈是执行——找到联合创始人、招到工程师、攒够现金跑道。现在这些瓶颈被 AI 大部分抹平了。

剩下的瓶颈只有一个:判断力。

  • 在 Idea 阶段,判断力 = 在 AI 帮你立刻造原型的诱惑面前,先去和真实用户说话

  • 在 MVP 阶段,判断力 = 在加一个 feature 只要 30 分钟的诱惑面前,坚持你写下的 scope

  • 在 Launch 阶段,判断力 = 在自己干快又顺手的诱惑面前,主动把工作交出去

  • 在 Scale 阶段,判断力 = 在通用 AI 越来越强的对比下,坚持往你的垂直深度里下注

AI 让"造"变得无成本,但判断反而变得前所未有地致命。

每个阶段都对自己说一句:我这是在编排,不是在打工。


你现在在 4 个阶段里哪一阶段?你撞上的最大那个"AI 陷阱"是什么?评论区聊聊。

查看原文 ↗