ESC
↑↓ 选择↵ 打开esc 关闭⌘K 唤起
← Home NO.25
第 25 期 · AGENT 工程 · 收录于 2026 年 8 月 15 日

运营AI原生工程组织

A
Anthropic · Claude
视频 26:38 原文约 2.9 万字 预计阅读 26 分钟 来源视频 ↗ 中英对照全文
双人对谈 · 本期速读电台 00:00 / 40:04
TL;DR · 三句话
  1. 瓶颈已经转移,旧流程会"悄无声息地不再奏效"(quietly stops working)——当编码(写代码)不再是瓶颈,从规划、评审到组织形态的所有团队规范(team norms,团队内部约定俗成的做事规矩)都得拿出成长型心态(growth mindset,相信能力可以持续成长、旧办法该被新办法替代的心态)重写一遍。 这不是行业第一次换瓶颈:21 世纪初"云"还不存在、一次只能合并 6 个 PR 时,瓶颈是构建队列;云和持续构建来了瓶颈就移走了。如今在 Claude Code 团队,"编码真的已经不是慢的那部分了",所以上下游流程都得改。 → 详细
  2. Fiona Fung 的核心打法是"Claude 化一切 + 验证左移 + 明确授权砍掉老流程":Claude Code 几乎每个 commit 都由 Claude 共同署名(co-authored by Claude,提交记录里把 Claude 列为共同作者),团队"用 Claude 构建 Claude、用 Claude Code 构建 Claude Code",每个 manager(经理/带人主管)都先做一段 IC(individual contributor,一线动手写代码的工程师),代码取代文档成为唯一真相来源(source of truth,团队默认以谁为准的那份权威信息)。 → 详细
  3. 成效信号清晰可见——上手时间(onboarding ramp-up,新人从入职到能干活所需时间)下降、对队友的占用成本下降、Claude 辅助提交上升;但她反复强调"比吞吐量更重要的是产品质量",留给观众的作业是:挑出你最"吵"(noisiest)、成本最高的那个工作流,反复自问"它还在发挥它该有的作用吗"。 → 详细

讲者 Fiona Fung 在 Code with Claude 大会上做单人分享

🎯 于你何益 为你定制 · 非通用结论

这期相关度。Fiona 讲的是"当编码不再是瓶颈,一个工程组织该怎么重写它的所有规矩"——这恰好是你两件最核心的事正在经历的:一是 Holdwell 那座多-Agent PRD 工厂(一群 agent 替代人写代码/写 PRD,瓶颈被推到了别处),二是你本人作为单兵同时扛多线(你就是个"一人工程组织",AI 把你的产能放大后,真正卡你的不再是动手,而是别的环节)。她全场反复敲的那句"以前对你管用的,现在可能不再管用了——它还在发挥它原本的作用吗?",几乎就是替你这套知识库的摄入 SOP 和你那些半自动流程量身写的。下面按你的项目分。

给 Holdwell 工厂(一个组织怎么运营)

1. 瓶颈一移走,旧流程会"悄无声息地不再奏效"——要主动审计,而不是等它出事

  • 怎么做的:Fiona 的核心洞察是旧流程"quietly stops working(悄无声息地不再奏效)"——它不报错、不崩,只是默默地不再值得做了。她补了一层因果:"每当有人定下一个流程,那都是为了解决某个问题。但我们经常忘了去复盘:'等等,这些流程现在还有必要吗?'"她的反例极具体:以前团队里堆了"一大堆不同的 SLA——P0 bug 一个、事故响应一个",多到工程师跑来问她"一天就 24 小时,我到底该先做哪个 SLA?",她才意识到"该好好审计一下了"。
  • 你可以怎么做:你的工厂 2026-06 刚把旧的一整套重流程退役、换成三驾马车 + 碰撞协议——那正是 Fiona 说的一次审计。但别以为审一次就完:碰撞协议的六个环节,同样是在"当下模型能力"的假设下设计的。拿 Fiona 的镜子定期照一遍:哪个环节是为"保护稀缺人力/补当下模型短板"才设的、模型再进一步后就不再是它原本的作用?别等跑出一堆"走了流程但没产生价值"的证据才动,主动列一张"可能已经悄悄失效的环节"清单,逐个问"它还在发挥它原本的作用吗"。

2. 瓶颈不是消失,是转移到"验证 / 评审 / 维护"——把质量把关"左移"

  • 怎么做的:她明说编码不再是瓶颈后,新瓶颈是三个:验证(它对不对?)、谁来评审、怎么维护。验证她称为"a big one(大问题)",因为"带宽一下涨太多,角色边界开始模糊,越来越多人在提交改动"。她给的解法叫**"左移"(shift left)**——把质量把关尽量往源头挪,并配了一句很扎心的反转:"有什么比你自己撞上 bug 更糟?是听到客户撞上。但有什么比你先撞上更好?是提前部署好自动化,在更靠近源头的地方就把它抓住。"
  • 你可以怎么做:你工厂当前最痛的就是"碰撞协议纪律是否真执行、agent 产出的可观测/可验证"——这正是"验证瓶颈"的同一张脸。把"左移"翻译成你的活:别把质量检查全堆在流程末端的真人评审当一道终审闸,而是在每个环节交接处(澄清→独立初稿、初稿→碰撞、碰撞→合成定稿…)插一个轻量自动校验(比如 agent 自动核对本环节产出有没有偏离上游澄清结论)。这就引出下一条——

3. 把"真相来源"做成能 check-in 的东西,否则它必然过时——直击你的跨线对齐地基

  • 怎么做的:她最硬的一条建议:"不管你的真相来源是什么,哪怕是一份 spec,你都可以把它转成一个 skill、check in 到代码库里。"理由讲透了:"写代码的时候带宽大得多,这意味着任何不在这个更新循环里的文档,都更容易变得过时。"对应到评审,她还说"如果你有一份 spec,我鼓励你把它提交进代码库,因为 Claude 特别擅长检查代码有没有偏离 spec(spec drift)"。
  • 你可以怎么做:你的痛点列表里写着"跨线对齐"——六条强耦合产品线的"真相来源"(共享实体、术语、跨线约定)正是这条建议要治的地方。Fiona 在告诉你:一份没被纳入日常更新循环的实体定义,等于没有,因为它会比代码/PRD 漂移得更快。所以别把共享定义当一份静态字典写完就放着,把它做成 agent 每跑一个工单都会读、并能反向校验"这个 PRD 有没有引用了字典里不存在的实体"的活物。先填一个最小可用版本(覆盖最高频的几个核心实体),让它进流程的强制校验链——比一次性写全但没人维护的大字典有用得多。

4. 砍流程要"明确授权",因为人只会往上堆、不会主动删——你刚退役一整套旧机制,这条帮你守住

  • 怎么做的:她优先抓的第三件事是**"明确授权大家去砍掉老流程(explicit permission to kill old processes)",因为"人是不会主动删流程的,流程只会越堆越多"。注意她的措辞:不是"建议大家精简",而是给一个明确的、制度化的"准许你删"的口子**——连她们自己定的团队原则,"过几个月也总给自己留出这种权限,随时去批判、随时重新审视"。
  • 你可以怎么做:你 2026-06 刚做过一次大处决——把整套旧流程退役、换成三驾马车碰撞协议,证明你砍得动。但那是一次性壮举,不是制度,新流程照样会往上堆。借她这招:在工厂治理里立一条明文规则——每个环节的 owner 有权且被要求定期标记"这一步可以砍/可以并",并设一个固定的复盘点(比如每月一次)集中处决。把"删流程"从一件需要勇气的事,变成一件被制度要求做的事。

给本人 / 你的精力(单兵怎么类比这套打法)

5. "管理者先做 IC、亲手用产品"= 你别只当流程设计师,定期回去亲手跑一遍

  • 怎么做的:她最先改的一件事是让每个 manager 先做一段 IC(一线写代码),动机是"我太信亲自用产品了——在 Claude Code,我们用 Claude 构建 Claude、用 Claude Code 构建 Claude Code"。她说唯有亲手用,才会"打心底里感受到你的产品(feeling your product in your bones)";不然"过一阵子你会发现自己做的产品决策全都只基于指标、仪表盘或 PowerPoint"。她还说现在正是把"动手时间(maker hours)拿回来"的好时机,因为上手比过去轻松多了。
  • 你可以怎么做:你的元约束是精力稀缺,所以你天然倾向于站在"设计 agent 链路/写 SOP"的高层,把脏活交给 agent。Fiona 在警告你:全交出去、自己只看 dashboard,你会逐渐丧失"打心底里的判断力"——而判断力恰恰是你 2021 年写下的操作系统第一条("判断力 > 努力")。给自己定一条:每隔一段时间,亲手从头到尾跑一个真实需求穿过你的工厂(不靠任何快捷),或亲手用一次 StockHelp 看板做一个真实买卖决策。这不是浪费时间,这是你"在骨子里感受自己产品"的唯一渠道。

6. 别再问"这是谁改的",要深挖你到底想知道什么 + 用 routine 自动汇总

  • 怎么做的:对"这块最后是谁动过的?"这类问题,她的建议是深挖根源:"你到底想搞清楚什么?是找谁引入了回退,还是找人答个问题,还是想补点背景?"很可能 Claude 就能帮你。她还举了自己设的一个 routine:每天早上"就着那杯咖啡",让它"把所有反馈渠道的反馈过一遍、汇总、识别出共性主题"。
  • 你可以怎么做:你同时扛 6 个项目,最大的隐性成本是"上下文反复重建"——每次切回某个项目都要重新想"我上次到哪了、最近有什么新输入"。照搬她的 routine:给你最在乎的一两条线(比如这本知识库的摄入、或 xiaohongshu 选题)设一个每日/每周自动汇总的 routine,开机第一件事让它替你把分散的新信息归并成几个主题。把"重建上下文"这件高频高耗的活左移、自动化掉。

给 Chief of Staff(治理 / 守门)

7. "强制函数" + "自上而下对齐价值、自下而上留适配空间"——正好是你宪法外脑的形态

  • 怎么做的:落地她用两条腿:自上而下必须对齐的几条团队原则,她们称为**"强制函数(forcing function)"**——一种强制大家照做、把行为掰过来的机制;自下而上则给每个 pod 留空间("Claude 在 triage、规划、站会里怎么用,哪些工作流先被 Claude 化,很大程度自下而上决定")。她的总结:"在什么重要这件事上对齐、并随情况不断更新,同时给每个小组留出适配的空间。"
  • 你可以怎么做:你的 CoS 本质就是把你写过的原则放回你眼前、做跨域守门——这跟 Fiona 的"强制函数"是同一个机理:光把价值观写下来不够,得有个机制在决策时刻强制它现身。她的"自上而下对齐 + 自下而上适配"给你 CoS 的痛点("跨域守门、软教练质量")一个结构:哪些是宪法级、跨所有项目都不可破的红线(对齐、强制),哪些是各项目自己拿主意的(放权、不越界替它下结论)。把这条分界明文化,正好对应你 CONSTITUTION 里"软教练不替你决定、只把张力摆到你面前"的诉求。

给 app_incubator(把"该做什么"前移到 agent)

8. 验证左移 + 自动化"靠近源头抓 bug"= 你想做的"把该做什么前移给 agent"

  • 怎么做的:贯穿全场的"shift left(左移)"——把质量把关从下游挪到尽量靠源头;以及她优先抓的"Claude 能做的就让 Claude 做,把人解放出来攻硬骨头"。她还反复说现在最该投的是验证:产能充裕之后,"怎么验证质量"比"产出多少"重要得多。
  • 你可以怎么做:你 app_incubator 的明确目标就是"把'该做什么'前移到 agent"、解决"激活/首屏体验"。Fiona 的"左移"给你一个更锋利的版本:不只是把任务前移,更要把验证前移——让 7-Agent 链路在生成设计稿/首屏的同时,自带一个 agent 去校验"这个首屏有没有偏离当初的产品意图/契约"。你那条"设计稿即工程强制契约"恰好是她说的"把 spec check in、让 Claude 检查 spec drift"的完美载体:契约是真相来源,让一个 agent 持续盯着实现有没有漂离契约。

顺带·投资视角(StockHelp / 你本人的价值投资)

  • 怎么做的:整场是一堂"如何提升一个组织的运营质量与人效"的公开课——衡量信号她给了三个:上手时间↓、PR 周期时间↓(且要拆成各环节看,别只看端到端)、AI 辅助提交↑;但她跳出来强调"比纯吞吐量更重要的是质量,想办法去衡量你真正想改变的东西"。
  • 对你的投资有什么用:作为找"卓越生意"的价值投资者,这给你一把看科技/软件公司运营质量的镜子。当你研究一家公司时,可以多问一句:它的工程组织在"AI 把编码变便宜"这件事上,是还在用旧瓶颈的成本结构(人力堆在写代码上),还是已经把人力重配到"验证、品味、攻硬骨头"上了?谁先完成这次"瓶颈转移",谁的单位人效(护城河的一种)就更强。⚠️ 诚实闸门:这只是一个定性观察镜头,不是可量化的选股因子,别试图硬塞进 StockHelp 看板的比率里——它属于你读财报/电话会时脑子里多挂的一个问题,不属于 Phase 1 那块数据面板。

更深三角度

  • 该反着用:Fiona 是在资源极其充裕的前沿实验室里说话——满编工程团队、专职设计师、随时能拉 Boris 争论、模型还是自家的。你是精力稀缺的单兵 + 多副业。所以她"为了享受 maker hours 而把动手时间拿回来"对你要反过来:你的稀缺不是"想动手没机会",而是"动手的诱惑太多、聚焦不够"。对你而言"砍流程/砍工作流"的真正意义,不是腾出时间写更多代码,而是腾出时间思考"该不该做"(你操作系统里的"判断力先于做多快")。她的"砍",目的地是"造得更多";你的"砍",目的地应该是"造得更少但更准"。

  • 和你现在做法冲突:她说**"代码取代文档成为唯一真相来源""任何不在更新循环里的文档都会过时"——这跟你正在精心搭建的这本第二大脑(以文档/原子笔记为核心)直接顶上了。你押注"主题骨架→原子笔记"这套人写、人读的文档体系能长期保值;她押注"会过时的文档不如能 check-in、被自动更新的真相来源"。这个张力值得你坐下来想清楚(我不替你下结论):你知识库里哪些是该被做成"活的、能被 AI 重读和校验的源"(比如 entities 字典、各 skill 的契约),哪些确实适合留作人脑慢思考的静态笔记**(比如思维模型、读书顿悟)?两者混在一个目录里、用同一种更新纪律,可能正是你"摄入 SOP、信噪比"痛点的根因之一。

  • 对你的镜子:Fiona 那个"成本极高的房间"——所有人低头盯笔记本、只在轮到自己汇报时抬头——照出的不是某个会,而是你那些"还在跑、但你已经不确定它在解决什么问题"的半自动流程和目录。你不缺新流程、新 skill、新主题,你缺的是一个定期把它们拖出来问"它还在发挥它原本的作用吗"的习惯。她这堂课对你最大的价值,不是某个具体做法,而是把这句话焊进你的脑子。


One Human Company 新号(2026-07 回填)

1 · C 类候选:「Anthropic 高管说'Claude 能做的就该让 Claude 做',我把一人公司的活全清点了一遍」

  • 怎么做的:Fiona(Anthropic 负责 Claude Code/Cowork 的工程产品负责人)优先抓的三件事之二就是 Claude 化——「如果 Claude 能做,那就该让 Claude 做,这永远是我们在问自己的问题」,且因为模型进步快,「两三个月前 Claude 做不好的事,一次更新后就行了」,要定期重审。第三件是「明确授权砍老流程」,因为「人不会主动删流程,流程只会越堆越多」。
  • 你可以怎么做:候选标题——《Anthropic 说"AI 能做的就该 AI 做",我把公司里我还亲手干的活列了张清单》。你的一人公司是这句话的极限试验场:清点你在 drizzle tech 里仍亲手做的每件事,逐项问"是 Claude 真做不了,还是我没授权自己砍",晒清单和一个月后的变化。可抄物现成:那张两列清点表(我还在做 / 为什么还是我)。闸门自检:清单和取舍理由全是你的实操,成立。

2 · 办号镜子:「dogfood 才有产品直觉」正是 build-in-public 的底层逻辑

  • 怎么做的:Fiona 最先改的一件事是让每个 manager 先做一段 IC,理由是「唯有亲手用,才会打心底里感受到你的产品」,否则「产品决策全都只基于指标、仪表盘或 PowerPoint」。她还举了自己每天早上就着咖啡跑的 routine:自动汇总所有反馈渠道、识别共性主题。
  • 你可以怎么做:这句话就是你新号"验证派"定位的护城河解释——你能写 C 类"大佬说 X 我试了",恰恰因为你在 drizzle tech 里天天 dogfood;一旦你开始靠转述而不是亲测出内容,号的独占性就没了。经营动作:把她的晨间 routine 抄成你的内容雷达——每天让 agent 把关注博主的新观点汇总成"今天值得我试什么"的候选清单,喂 C 类选题池。这直接服务 Phase 0 攒 ≥4 篇 C 类存稿的硬指标。

3 · B 类素材:AI 产能上来后,你自己就是那个新瓶颈

  • 怎么做的:她的核心判断——编码不再是瓶颈后,瓶颈转移到验证、评审、维护三处;她给的成效指标也提醒「PR 周期没降不一定是没用 AI,可能是吞吐量上来后别的环节堵住了」。
  • 你可以怎么做:写一篇 B 类《我的 AI 员工一周出活 N 件,卡住公司的原来是我自己》——统计 drizzle tech 一周里 agent 等你验收/拍板的时长 vs 它们干活的时长,这个"老板才是瓶颈"的账没人替你算得出来。自检:数据是你的排队实录,过闸门。

所以呢

  • 可迁移思维模型:

    • 【耐用】"瓶颈会转移,旧规范会悄无声息地失效"——这是个跨技术周期都成立的元规律(她自己用云时代→AI 时代两次换瓶颈做了佐证)。值得当成你审视任何系统(工厂、知识库、副业、甚至一门生意)的固定提问:此刻真正的瓶颈在哪?我现有的流程是不是还在保护一个已经不稀缺的资源?
    • 【耐用】"砍流程要明确授权,因为熵只增不减"——人和组织默认往上堆、从不删,这是人性常数,不会过期。
    • 【会过期】"编码不再是瓶颈,把人重配到验证/品味"这个具体结论——它绑定在"模型刚好强到能写大部分代码、但还不够强到能替代品味/验证"这个当下的能力快照上。她自己都说"两三个月前 Claude 还做不好的事,一次更新后就行了"。所以"哪些该留人"这条线会持续移动,别把今天的分工当永久真理。
  • 判断更新:你之前可能默认"把活尽量交给 agent、自己站在高层设计"就是杠杆最大化。这期提醒你修正一条:当产能变便宜,稀缺性和你的注意力都应该往"验证"和"判断该造什么"上迁移,而不是往"造得更多"上迁移。对你这个把判断力奉为第一原则的人,这其实是把你的价值观,翻译成了 AI 时代的具体动作。

  • 这周一个赌注:照 Fiona 的作业,挑你最"吵"的那一个工作流下注。建议就锁定 Holdwell 工厂的**"碰撞协议纪律是否真执行":这周只做一件最小的事——给一个**环节交接(比如 PRD 定稿→真人评审)加一个 agent 自动校验"产出有没有偏离跨线共享的实体定义",哪怕共享定义此刻只有 3 个核心实体。它一箭三雕:给纪律补了强制点、给跨线对齐的地基填了第一块、并把"验证左移"从理念变成了你工厂里第一个能跑的实例。一步一步来(do this one step at a time)——她原话。

接着读