ESC
↑↓ 选择↵ 打开esc 关闭⌘K 唤起
← Home NO.60
第 60 期 · AGENT 工程 · 收录于 2026 年 8 月 15 日

编码被解决之后

FF
Fiona Fung · Lenny's Podcast
视频 98:45 原文约 11.1 万字 预计阅读 49 分钟 来源视频 ↗ 中英对照全文
双人对谈 · 本期速读电台 00:00 / 01:05:07
TL;DR · 三句话
  1. 写代码不再是瓶颈,天花板被整个抬高,剩下的只剩"你能有多大野心"。 Anthropic 工程师如今平均每季度交付的代码量是 2025 年的 8 倍——曲线"平、平、平、平,然后砰地冲上月球";瓶颈从"写"转移到了"验证",而且现在工程师、设计师、PM 全在提交代码。理论上一切都做得到了,问题变成"你敢想多大"。→ 详细
  2. 管理者的新工作方式 = 给自己跑一个能看全公司的 Claude 远程会话 + 用 routines(例行任务)把每天的管理动作自动化,让 agent 替你生成 prompt 和 PR。 Fiona 把所有代码仓库 + 所有 Slack 频道 + 所有指标接进一个 Claude 会话,从"让它生成 PR 修 bug"升级成"靠它和团队聊清楚哪些上线了、表现如何、反馈在哪、质量有没有热点缺口"。→ 详细
  3. 角色边界全在模糊,留下来的核心是"品味/判断/验证"和那份"往下钻一层"的理解力;而最让她夜里睡不着的不是技术,是高速扩张里团队文化的漂移。 她招两类人(有产品 sense 的创造型 builder + 啃硬骨头的深度系统专家),推"管理者先做 IC"和"结对编程午餐"对抗孤独,并反复问自己"这套流程现在还有用吗"——因为领域变得太快,连指标本身都可能需要换掉。→ 详细
01

0:00–9:30 · 开场金句 + 25 年工程史回顾(从 Vim 到 8 倍代码量)

  • 三句核心暴击:写代码不再是瓶颈 / 天花板被抬高 / 问题变成「你能有多大野心」;Anthropic 工程师季度交付代码量是 2021–2025 的 8 倍。→ 详细
  • 介绍 Fiona 履历:微软 TypeScript/Visual Studio → Facebook Marketplace(年 GMV 1000 亿+)→ Meta 智能眼镜/Orion → Instagram 管 500 人。→ 详细
  • 软件工程史上的台阶式飞跃(IBM 用 Vim → 微软第一次用 IDE → CD 发行的硬截止 → 在线发布),dogfooding 之爱源自「用 VS 编辑器构建 VS 编辑器」。→ 详细
  • 抛出全片主题:人人变 builder、瓶颈转向「验证」。→ 详细
02

9:30–17:00 · 管理新工作方式:全公司 Claude 会话 + routines + 代码评审 + TDD 复活

  • 跑一个接入所有仓库/Slack/指标的 Claude 远程会话,每月共享屏幕和团队一起复盘。→ 详细
  • 「Make new mistakes」:零失误意味着跑得不够快。→ 详细
  • routines 把晨间管理动作自动化:醒来就有总结 + 可 review 的 PR。→ 详细
  • 代码评审:把「什么是好」写成框架/spec 塞进 repo,让 Claude 对照验证;TDD 从「不得不付的税」变成 AI 替你先写测试。→ 详细
03

17:00–26:00 · 招聘两画像 + 成长型心态 + 用「掌控之内的行动」对抗恐惧

  • 只招两类人:有产品 sense 的创造型 builder + 啃硬骨头的深度系统专家。→ 详细
  • 做得好的人共性 = 成长型心态、好奇心、敢做让自己害怕的事。→ 详细
  • 把「冲我发生」翻转成「为我发生」,找一个掌控之内的行动;她高中当银行柜员供自己读工程学院的亲历。→ 详细
  • 金句「你恐惧的洞穴里藏着你追寻的宝藏」。→ 详细
04

26:00–35:00 · AI 鸿沟 + 小企业 + Cowork 缘起 + 潜在需求

  • 外婆、毛线店与社区感:她帮小企业用 AI 的热情之源。→ 详细
  • Cowork 缘起于她自己讨厌报销;催生 Claude for Small Business;餐厅老板用 Claude 做菜单定价市场分析。→ 详细
  • Anthropic 总能早押大机会的关键 = 紧盯「潜在需求」、看人们为跑通某事而折腾的地方。→ 详细
05

35:00–48:00 · 异步/成群 agent + 高 agency=高担责 + 衡量 ROI + bad/sad 质量框架

  • 工程下一前沿 = 异步 + fleets of agents + routines 派生 agent,抽象层级上移。→ 详细
  • 高 agency 必配高 accountability。→ 详细
  • 衡量生产力别用代码行数(会被刷量/被框架升级误导),盯「产出有没有导向结果」;Marketplace「卖家数量 vs 超级卖家」指标踩坑。→ 详细
  • 主动式质量 + bad/sad 框架 + 监控测试胜过人工评审 + 脏话仪表盘。→ 详细
06

48:00–63:00 · 管理者先做 IC + dogfooding + 孤独感 + 角色双向模糊

  • 每位管理者先做 IC、持续兼 IC;她从管 500 人到在 Anthropic 重做 IC、Claude 当入职搭子。→ 详细
  • 编码能力会不会退化 → 要保留「往下钻一层(double click)」的元能力。→ 详细
  • 新世界丢失的:孤独感(对策结对编程午餐/黑客松)、写代码的心流与顿悟时刻。→ 详细
  • PM/数据科学等「编码相邻」角色全在变;边界双向模糊。→ 详细
07

63:00–78:00 · dogfooding 深挖 + 个案胜数据 + 开放问题 + 上下文切换 + 招聘悖论

  • 痴迷用产品才能把住脉搏(卖 MacBook 遇诈骗、VR 地面高度 bug)。→ 详细
  • 智利弱网拖垮 Marketplace 增长 → 信个案胜过信数据。→ 详细
  • 三个开放问题(iOS/Android 组织、自动化评审推多远、产出公平);异步带来上下文切换负荷飙升、她也没解。→ 详细
  • 招聘悖论 + 怎么培养下一代(fellowship/师徒制)+ 在能力边缘做东西。→ 详细
08

78:00–98:45 · 文化漂移(最大焦虑)+ Airbnb 守文化 + 砍流程 + JIT 规划 + 快问快答

  • 让她睡不着的是团队文化漂移;坦诚讲「哪里不顺」,噩梦是「着火房间里说一切安好」。→ 详细
  • Airbnb 守文化经验:创始人自上而下痴迷 + Sandberg「这是好问题」。→ 详细
  • 留给听众:明确授权砍掉不再服务你的流程;她现在用「JIT 月度规划」(一张小表 + 每周核对)。→ 详细
  • 快问快答 + 织毛衣彩蛋(见下节)。→ 详细

Q1 · 最常推荐给别人的两三本书?

  • 小说作家两位:Margaret Atwood(玛格丽特·阿特伍德)——她在加拿大长大读了很多,爱其「推想小说(speculative fiction)」(眯眼一看「这真有可能发生在某个社会吗」);Haruki Murakami(村上春树)——爱其「魔幻现实主义」风格。→ 详细
  • 一本她每年至少读一遍、推荐给所有人的书:《小王子》(The Little Prince)——「提醒我去想一想,到底什么才是真正重要的」。→ 详细

Q2 · 最近喜欢的电影/电视剧?

  • 她基本不看电视剧(Lenny 说这在 Anthropic 嘉宾里是「共同主题」)。但手机里常存三部「复古片」供飞机上看:→ 详细
  • 《天使爱美丽》(Amelie)——法国电影,超天马行空;捕捉到了她 16 岁高中去巴黎旅行时感受到的「魔力」(她当年想当视觉艺术家)。→ 详细
  • 《千与千寻》(Spirited Away)——吉卜力,她最爱的吉卜力电影之一。→ 详细
  • 《风之谷》(Nausicaä of the Valley of the Wind)——吉卜力(改编自漫画);她八九岁看的,女主角娜乌西卡的领导方式深深影响了她许多领导原则。Lenny 调侃:这相当于把它和 Andy Grove 的《High Output Management》并列成「两本顶级管理学读物」。→ 详细

Q3 · 最近发现的、特别喜欢的产品?

  • Sweet Sisters Bodycare——Whidbey Island 上的一家本地小店,一整套有机护发/护体/护肤产品(她强调「这不是广告」)。→ 详细
  • 故事:她几年前鼻子长了种很疼、会出血的疹子,查不出原因;后来发现是身体对用了十几年的普通棕瓶洗发水里的化学成分过敏了(洗头时洗发水会流到全身)。换成这家有机洗发水后就好了,从此全换;最近出差用了一周酒店洗发水皮肤又有反应,提醒她该带旅行装。→ 详细
  • (插曲:她这趟出差是去参加全球巡回的 Code with Claude 活动,SF/伦敦已办,下周东京是最后一站,将来还会有更多场。)→ 详细

Q4 · 经常回想的人生格言?

  • 工作上:「keep it simple(保持简单)」——真正想做好的那件事是什么,专注在它上面,因为「我们有时候会想得太复杂」。→ 详细
  • 生活上:「在一个你可以成为任何样子的世界里,选择善良(in a world where you can be anything, be kind)」。→ 详细
  • 配套故事(疫情期间的一次「小善意」):她外婆住加拿大养老院、疫情没法探望,只能偶尔 FaceTime,时间难定;某天阿姨突然说「外婆今天中午 12 点能 FaceTime」,正撞上她一直想约的一对一;她临时跟下属请求改期,对方一句「当然没问题,完全 OK」、毫无负担——这个小小善意让她得以和外婆 FaceTime,意义重大。→ 详细

Q5 · 织毛衣彩蛋(Boris 爆料:重要会议背景里常听到 Fiona 织毛衣的咔哒声)

  • 自己织自己的衣服(最近织了一件上衣)。Lenny 笑称「这简直就是 Claude Code 自己构建自己,特别 meta」,她接「我们一直在『构建』自己的衣服嘛」。→ 详细

  • 一个编织 ⇆ 编程的妙喻:织毛衣基本就两种针法——下针(knit)和上针(purl),相当于 0 和 1,很多栈/队列概念都能对上,「我织毛衣时有点像一个编译器、像在生成一个可执行文件」。→ 详细

  • 八岁时是外婆教她织的(呼应前面毛线店的故事),每次织都想起外婆;她熟练到「不用看手在干嘛」,「就像别人玩指尖陀螺」,且一心多用——「坐着闲下来就 kick off 好几个 agent、同时『生成』更多毛衣」(还自嘲有「轻微毛线囤积症」)。→ 详细

  • 她的终极梦想:「以外婆的名字开一家毛线店,营造那样一个社区」——然后让 Cowork 帮她自动化一切,「尤其是开发票」。→ 详细

  • LinkedIn:Fiona 说自己主要在 LinkedIn 上。→ 详细

  • 她希望听众能帮的两件事:① 反馈「哪里做得好、哪里做得不好」,以及你正在用的任何有意思的「潜在需求」用例(她举例:有朋友用 Claude 帮自己生成一个小棚屋的搭建方案);② 花点时间手把手带身边一个还没接触 AI 的人/小店,看 AI 能在哪些地方帮到他们。→ 详细

🎯 于你何益 为你定制 · 非通用结论

这期是 5 支里跟你最对路的一支。Fiona 管的恰恰是「多个 agent 替人干活、人来验证和把关」这件事的产品工程化——这正是你 Holdwell 的多-Agent PRD 工厂、app_incubator 造 App 链路天天在啃的题。下面按项目对。

Holdwell ERP(多-Agent PRD 工厂)

1 ·「把『什么是好』写成框架塞进 repo,让 Claude 对照验证」直接解你「产出可验证」的痛点

  • 怎么做的:Fiona 说去年都还没有 Claude Code Reviews、人工 review 是最大瓶颈;他们的破法不是堆人,而是「越能把『什么是好』的框架自动化地检查出来越好——你给 Claude 一个框架去对照验证,它做得非常好」,具体动作是「把 spec 也提交进 repo,并让 spec 和代码经常同步更新」(例:给内容设计加了一套评分标准 scale)。→ 详细
  • 你可以怎么做:你的痛点是「碰撞协议纪律靠自觉、agent 产出缺可观测/可验证」。把碰撞与评审每个环节的「过/不过」判据写成一份机器可读的 checklist(spec)放进仓库,让评审 agent 拿这份 spec 去逐条打分、输出「哪条没过 + 证据」——而不是靠人读 PRD 主观判断。这把「软门」变成「Claude 能对照的硬门」,可验证的证据就是那份对照打分记录。

2 ·「bad vs sad」两档框架——给你的碰撞与真人评审加一个"严重度分层"

  • 怎么做的:面对很多不同产品界面、一堆原始指标时「很难判断这个数字到底算好还是不好」,所以她自创高层框架:bad = 不可恢复的严重错误;sad = 可恢复的痛点;关键洞察是「sad 一个个堆起来,整体往往演变成 bad」;而且让每个团队自己针对负责的界面去定义 bad/sad(高 agency)。→ 详细
  • 你可以怎么做:你三驾马车的碰撞意见和真人评审的回炉意见往往一锅炖、看不出轻重。给评审产物加一层 bad/sad 标记:bad = 阻断上线的硬伤(实体口径冲突、跨线定义打架),sad = 体验/一致性小瑕疵。规则是「bad 必须清零才放行,sad 累积到阈值也升级为 bad」——这给你「意见回炉的闭环」一条清晰、可自动判定的红线。

3 · routines = 你那个「把『该做什么』前移到 agent」的现成形态

  • 怎么做的:routines 的本质是「以前我顶多自己生成几个 prompt;现在像是有个 agent 帮我生成那些 prompt 和 PR」——她设一个 routine「盯着反馈渠道、发现 bug 就把能顺手搞定的打磨修复做掉」,醒来就有可 review 的 PR。抽象层级在「同步敲 prompt → 异步起多个 prompt → routine 替我派生 agent」一路上移。→ 详细
  • 你可以怎么做:你一直想「把该做什么前移到 agent」。别再让自己手写每个环节的启动 prompt——做一个「碰撞协议调度 routine」:它读上一环节产物、自动判断下一步该唤起哪个角色(该起独立初稿、该互看碰撞、还是该合成定稿)、生成那个角色的输入、把结果摆到你面前等验证。你的角色就从「写 prompt 派活」上移到「看 routine 派生的结果、做 go/no-go」。

app_incubator(7-Agent 造 App)

4 ·「监控+测试 > 花更多时间评审」+「为 agent 闭环」

  • 怎么做的:Lenny 提炼的核心收获是「把控质量最好的工具是监控和测试,而不是花更多时间做评审」,因为速度快到根本盯不过来;它呼应「为 agent 闭环」——让 agent 知道成功长什么样,于是「我们自己来修」。投入重点放在 eval/测试/监控上。→ 详细
  • 你可以怎么做:你的「设计稿即工程强制契约」其实就是一种「成功长什么样」的定义。把它再往前推一步——给造 App 链路配一组自动 eval:Chrome MCP 截图后对照 Figma 设计稿自动比对(间距/层级/激活态),不符就让 agent 自己改。这样首屏/激活体验的把关从「你人肉看」变成「agent 闭环自修」。

5 ·「revisit 当初没成的尝试」——模型升级后旧失败可能已变能力

  • 怎么做的:「我之前想自动化某件事、Claude 当时还不够格;到下一个模型,诶,现在就够用了——所以要时常回头重试当初没成的尝试」;配套 Lenny 的高频建议「做一些当下几乎能跑、卡在能力边缘的东西,模型一追上你就遥遥领先」。→ 详细
  • 你可以怎么做:给 app_incubator 和 Holdwell 各建一个「当前模型还做不好的尝试」清单(哪一步 agent 还经常翻车),每次大模型更新就重跑一遍。你单兵作战、精力稀缺,这份清单让你不必凭记忆,新能力一到位就能第一时间把卡点变成自动化。

Personal Thinking(这本第二大脑)

6 ·「明确授权砍掉不再为你服务的流程」+「JIT 即时规划」治你的摄入 SOP 与信噪比

  • 怎么做的:团队文化里很重要的一条是「明确授权大家砍掉不再服务你的流程」;她刚加入时引入「六个月路线图文档」,三个月后发现「我们还在参照它吗?变化太大了」,于是把自己引进的东西亲手改掉;现在用「JIT 月度规划」——连文档都没有,一张小表 + 每周核对,极度聚焦。→ 详细
  • 你可以怎么做:你这本第二大脑的痛点是「摄入 SOP 重、信噪比」。拿这条当季度自查:挑一个你做起来最发怵/最手工的环节(比如每支视频都要人工提炼原子笔记),先问「它还有存在意义吗、能不能更自动化」。规划上也别给副业铺六个月大计划——一张「本月就推这几件」的小表 + 每周一次「还作数吗」核对,正好对上你「精力是元约束」。

xiaohongshu_momorain(一个人的增长团队)

7 ·「指标会过期,别戴眼罩盲追」+「卖家数量 vs 超级卖家」

  • 怎么做的:Marketplace 早期紧盯「卖家数量」,但某地区卖家少、人们却在找到想要的东西(真正目标),原因是有一批「超级卖家」;差点因为「卖家数量」这个指标误判扩张。结论:「不管什么指标,永远盯着点、别盲目追随一个『曾经合理』的指标,连指标本身都可能要换」。→ 详细
  • 你可以怎么做:你那张「带红线的指标盘」空着没在跑。先别纠结追哪个虚荣数(粉丝数=你的「卖家数量」陷阱)。先把盘搭起来跑数,再像她那样问「这个数真的导向我的目标吗」——你的目标是「决策型生活记录者」的影响力,那真正的「超级卖家信号」可能是收藏/保存率、单篇带来的私信咨询,而非涨粉。

8 ·「分享一件真改变你生活的用例」是最低门槛的内容钩子

  • 怎么做的:要在 AI 鸿沟上撕开口子,她的办法是「从一件你真正觉得给你生活带来有意义改变的事说起」;Lenny 举例自己用 Claude 帮儿子填夏令营表格、发推后一堆人「我都没想到能这么用」。她自己也承认开口「有点尴尬」,但「最后总能玩得很开心」。→ 详细
  • 你可以怎么做:你做家居号、又是重度 AI 用户,但「PM 思维/AI 这张牌没打」。一条低成本选题:把你用 AI 解决某个具体家居/生活决策的真实过程拍出来(比如让 Claude 横向比价/做选购市场分析,正如视频里餐厅老板做菜单定价那样)——既是你独有的「不公平优势」,又天然是「我都没想到能这么用」的钩子。

投资视角(StockHelp / 你本人的价值投资)

9 ·「潜在需求」是一种可迁移的选股/看赛道镜头

  • 怎么做的:Anthropic 总能早押大机会,关键是紧盯「latent demand(潜在需求)」——「看人们为了把某件事跑通而绞尽脑汁、各种折腾的地方」,那里往往藏着可以做成顺滑体验的大机会(编程、知识工作 Cowork、小企业都是这么来的)。→ 详细
  • 你可以怎么做:作为价值投资者,把这条当一面镜子看你 watchlist 里的公司——它是在满足一个「用户正各种折腾、绕路硬凑」的潜在需求,还是在卷一个已饱和的存量市场?前者是更可能扩张天花板的「卓越生意」特征。Fiona 那句「token maxing 本质上跟代码行数一样是动作不是结果」也提醒你:看一家 AI 公司别被「烧了多少 token/发了多少功能」迷惑,盯它有没有导向真实结果(留存、付费、ROI)。

更深三角度

  • 该反着用:Fiona 资源极厚——免费无限 token、几百号工程师、Anthropic 自己人当首批用户做极快反馈。你是单兵 + 精力稀缺。所以她「跑一个接全公司仓库/Slack/指标的远程会话」你学不动,但内核可反向缩小:你也给自己跑一个接住你全部项目仓库的会话,每周一次「回头看看」——把她的「管 500 人全局视野」缩成「管你 6 个副业的全局视野」,对抗你最大的敌人「失焦」。
  • 和你现在做法冲突:你的 PRD 工厂偏好「重流程、多环节、碰撞评审」求稳;她反复在喊「砍掉不再服务你的流程」「六个月规划太长、改 JIT」「零失误说明你太慢」。这是真张力——不替你下结论,但值得你诚实问一句:你那套六步碰撞重流程,有没有哪一步其实早就没人参照了、只是惯性还在跑
  • 对你的镜子:她从「管 500 人」主动跳回「IC 工程师、亲手修第一个 bug、让 Claude 当入职搭子」,理由是「不每天活在产品里就会和手感脱节」。你是 8 人 PM 之一、又在自建一堆 app——这面镜子在问你:你是更多时间在「写文档/搭流程/管 agent」,还是真的在亲手用自己造的东西? 你的「不公平优势」恰恰来自后者。

One Human Company 新号(2026-07 回填)

1. 「瓶颈从写转向验证」是你 B 支柱的顶层叙事,也是一篇 C 类选题

  • 怎么做的:Anthropic 工程师平均每季度交付代码量是之前的 8 倍("平、平、平,然后砰地冲上月球"),Fiona 说瓶颈因此从"写"转到"验证";她的解法是把"什么是好"写成机器可读的框架进 repo 让 Claude 对照打分,再配"bad/sad"两档分层——bad 清零才放行、sad 攒够也升级成 bad。
  • 你可以怎么做:候选标题《Claude Code 的 PM 说"代码 8 倍了,瓶颈在验证",一人公司的我把验证外包给了另一个 AI 员工》——在 drizzle tech 实测:给流水线里某个产出环节写一份 bad/sad 判据 checklist,让评审 Agent 对照打分,记录它拦下了几个真问题、放过了几个、误报几次,给判断"AI 验证 AI 到底能信几分"。可抄物是那份 bad/sad 判据模板。闸门自检:没有拦截/误报的实测记录就只是转述 Fiona,不成立——带数据发,能过。

2. routines 派活 = 一人公司老板的每日管理动作(B 支柱最独占的素材)

  • 怎么做的:Fiona 的抽象层级一路上移——"同步敲 prompt → 异步起多个 prompt → routine 替我派生 agent":设一个 routine 盯反馈渠道、发现 bug 顺手修掉,她醒来就有可 review 的 PR。
  • 你可以怎么做:你的 9+1 流水线迟早也要从"你手动派活"升到"routine 自动派活"。这个升级过程本身就是连续几篇 B 类内容:《我把自己从 AI 公司的派活岗上裁掉了》——写清 routine 怎么设、翻了什么车(自动派的活哪次跑偏)、你保留了哪个不可自动化的拍板位。这类"老板管理动作自动化"的第一手记录,全网做的人极少,是你 B 支柱 25% 里最独占的一块。
  • 对你的镜子:Fiona 说"零失误说明你太慢"、敢砍不再服务自己的流程。你 Phase 0 攒存稿也一样——别把发号仪式感拖成六个月路线图,用她的 JIT 小表:本月就推这几篇,每周核对一次"还作数吗"。

所以呢

  • 可迁移思维模型 ①【耐用】「框架化『什么是好』+ 让 agent 对照验证」:与其人肉守门,不如把判据写成机器可读的 spec/checklist 进库,让 agent 去打分。这是你「碰撞纪律靠自觉」的通用解,也是评审产出能自证「可验证」的路子。
  • 可迁移思维模型 ②【耐用】「bad/sad 严重度分层 + sad 累积升级为 bad」:任何评审/质量体系都该有这层分层——bad 清零才放行,sad 攒够也阻断。简单、可自动判定、给软门一条硬红线。
  • 可迁移思维模型 ③【会过期】「时常重试当初没成的 agent 尝试」:因为模型在指数级进步,旧失败常已变新能力。这条的「会过期」在于它依赖「模型还在飞速变」这个前提;但在未来一两年,它对你这种精力稀缺的单兵格外划算。
  • 这更新了你的什么判断:你可能一直把「多 Agent 工厂」的重心放在「流程设计得多严密」。Fiona 的整支访谈把重心挪到了验证(怎么搭一套验证机制确认产物真是你想要的)+ 砍流程(敢杀掉不再服务你的环节)——前者是瓶颈新所在,后者是单兵省精力的真杠杆。
  • 这周一个赌注:挑你 Holdwell PRD 工厂里一个最关键的关卡,把它的「过/不过」判据写成一份机器可读的 checklist 进仓库,让一个评审 agent 拿它对一份真实 PRD 跑一遍、输出「哪条没过+证据」——这就是你「agent 产出可验证」缺的那份证据的最小版本。
接着读