直接相关度:很高。你是 8 人 PM 团队里的一员,同时正在用多个 Agent 把「一个 PM 团队」压缩成一个人——这一期正好是一位 CPO 站在另一头回答同一道题:他手里也是二十来个 PM 撑着一个高速增长的平台,他的答案是「少而资深、绑问题不绑团队、最强的人自己下场」。跟你库里那期 Nikhyl Singhal(《为什么一半的产品经理岌岌可危》)合起来看,是同一个母题的两轮——Nikhyl 讲的是个体该怎么活下来,Tom 讲的是一个团队该怎么被重新设计。下面只挑真能用的,按项目分。
Holdwell ERP · 8 人 PM 团队 + 多-Agent PRD 工厂
1. 「PM 绑问题、不绑团队」——这是你那 8 个人可以直接拿去试的组织手术
- 怎么做的:Whatnot 21、22 个 PM 撑着美国增长最快的市场平台,做法是彻底放弃「一个 PM 对一个团队」。每 6 个月,CEO 和几位负责人坐下来只做一件事:把「未来半年什么必须成立」列成清单,然后一条条问「这件事的 DRI 是谁」。清单过完常会发现一条「在好几个团队路线图上都排第二第三、可看着真的很重要」的事——于是抓一个 PM 过来说「恭喜,这就是你接下来 6 个月要交付的东西」。代价他也认:某个工程团队可能整整一年身边没有 PM,哪怕活一大堆。他坚持这对 PM 本人更好——「你在不同的问题之间流动,等于练到更多块肌肉」。
- 你可以怎么做:你的团队痛点里有「跨线对齐」——六条产品线强耦合,可人被钉死在线上,线之间的缝没人负责。下个规划周期,别再从「谁负责哪个模块」开始,改成从「这半年什么必须成立」开始列 5–8 条,然后逐条点名 DRI——尤其要故意留出一两条跨两条产品线、谁的路线图上都排第三的事,专门派一个人半年只干这个。这一条你不需要任何授权就能在自己负责的那摊上先做实验:把自己这半年要交付的东西,从「我的模块列表」改写成「三条必须成立的事」。
2. 「先验证、再信任」+ 追问到一手事实——这正是「真人评审」该有的牙齿
- 怎么做的:Tom 直接说「招好人然后别挡道」是错的,Whatnot 活在 verify then trust(先验证再信任) 而不是「信任但验证」。配套的是一段可以逐字抄走的追问链:有人说「那个是欺诈」→ 你怎么知道?→「数据集里标着」→ 标签怎么打上去的?→「我猜是运营打的」→ 他们打标签的 SOP 是什么?→「不知道」→ 那你其实并不知道那到底是不是欺诈。 他说真正有经验的人会回一句「说得对,我去查清楚」,而这一追,顺手把打标签那套系统也加固了。创始人 Grant 的版本更狠:评审里说一句「我觉得这不对」,然后「我把今天剩下的时间全清了,我们坐下来把它搞清楚」——工单、代码、数据一行行过。
- 你可以怎么做:你的工厂里评审意见难回炉、agent 产出缺可验证的证据,说到底是没人被强制追到一手事实那一层。把这条追问链做成真人评审的固定三问,谁都不能跳过:这个结论的数据从哪来?这个数据是谁、按什么规则产生的?如果这条规则是错的,结论会怎么变?——三问答不出就不放行,这比再写一份评审清单有效得多。另外 Grant 那个动作值得抄成你的个人纪律:每个月挑一件你「觉得不对但说不清哪不对」的事,清掉半天,把工单、日志、数据亲手过一遍。
3. 「没有微观就做不出好的宏观决策」——给你的 T 型自查
- 怎么做的:Tom 承认自己答不出 Whatnot 推荐模型的具体权重,「跟那个团队的工程师比我肯定答错——这是好事」;但他紧接着说「我其实有责任随着时间把这些学会,因为我在要求他们做决策,而且我在审批他们做的东西」。他的另一串追问是:我们的推荐机制怎么跑的?风控判定推荐无效用什么逻辑?→ 地址信号 → 地址信号怎么算的?是标准化处理还是用户随手填的自由文本?结论一句话:没有微观,你就做不出好的宏观决策。
- 你可以怎么做:这条正好戳你的跨线对齐——六条产品线各说各话,你的 Agent 们在「宏观」层面写 PRD,底下却没有一份关于「这个字段到底怎么产生、谁在维护」的一手事实。别把它当文档任务,当成 Tom 这套追问的产物:每周挑一个核心实体,用他那串问句把它问穿,把答案沉成共享定义。 8 周就有 8 个实体,比一次性规划一个完整的实体模型现实得多。
4. 「你不能为了招 PM 而招 PM」这句话,对你其实是「你不能为了加 Agent 而加 Agent」
- 怎么做的:他反对的不是 PM,是那条 HR 配比——每 6 个工程师自动配 1 个 PM、1 个设计、1 个 EM,规模一大就冒出一堆「其实不需要」的岗位;「大多数情况下,你并不需要给通知系统基础设施配一个 PM」。他要求的是:招人一定是因为有一个非常具体的需求。
- 你可以怎么做:把「PM」换成「Agent」,这句话就是给你那套三驾马车 + 碰撞协议的体检表。逐个问一遍:这个角色、这一步流程是因为一个具体的、反复出现的需求存在,还是因为「一个完整的 PM 流程应该有它」? 后者就是你自己长出来的 HR 配比。他那句「pod 配比一旦成型,规模一大就自动繁殖」,在 Agent 编排里发生得只会更快——因为加一个 Agent 几乎零成本,而每一个都在消耗你的上下文和注意力。
职业 / 本人精力 · 他给的是「怎么把一个人用出一个团队的效率」
1. 「少做几件事,但每件做透」——whole-ass a few things
- 怎么做的:他反复讲一条文化底线:「增长太容易掩盖一切问题了,你规模越滚越大,所有人都在看平均数过日子。」所以必须坚定地「少做几件事,但保证把它们执行到极致」,同时逼最好的人扎进每一处细节。他甚至给了个时间分配上的自查:「除了招人,我一天剩下的时间还能有什么,比把我说过这半年要搞定的那五件事做成更重要?例会之类全都可以清掉。」
- 你可以怎么做:你的元约束是精力和聚焦,而你手上同时挂着七八条线。这条给你一把很干脆的尺子:列出你这半年真正要「做成」的事,如果超过五件,那你现在做的其实是「看平均数过日子」。 具体动作:这周把七八个项目按「半年后能不能拿出一个成了的证据」排一次序,前三名以外的明确降到维护档(不是砍掉,是不再占用你的判断带宽)。
2. 「AI 让你能干成的事太多,多到你为没干的焦虑」——他给这种新型焦虑命了名
- 怎么做的:他和几位资深负责人的共同感受是:「现在借着 AI 能干成的事太多了,多到你反而会为『还有一堆没干』而焦虑——因为你心里清楚,只要再挤出两三个小时,就能推动一大片事情。」注意他没有把这当成好事来庆祝,而是当成一个需要用「聚焦」去对冲的副作用。
- 你可以怎么做:这就是你现在的状态被人准确说出来了。诚实的用法不是「那我再挤两小时」,而是承认能力上限已经不再是瓶颈,判断力和注意力才是——这跟你自己写下的「判断力 > 努力、杠杆 > 工时」是同一句话。把「这周我又多干了多少」换成「这周我少做了哪件事、并且没后悔」当自检指标。
3. 「我能搞定」这句座右铭的后半句,才是给你的
- 怎么做的:他的信条是 I'll figure it out,但完整版是:「只要你愿意投入必要的时间、金钱、精力和心力,几乎任何问题都能解决;而如果你不愿意投入,那它大概也算不上什么大问题。」
- 你可以怎么做:后半句是一把很好的取舍刀,直接接上你「问该不该做先于做多快」的操作系统。当某个副业项目卡了很久、你也一直没真的投入——那就不是「我没时间」,而是「它没那么重要」。把这句当成季度回望时对每条线的一问:过去三个月我愿意为它掏出真金白银的时间吗?不愿意,就诚实降档。
One Human Company · 这一期是现成的高质量弹药
1. 「我们后悔 PM 这个岗位存在」——一个 CPO 说的,比你自己说有力十倍
- 怎么做的:这句话出自一位在做极其 to C 产品的 CPO(不是开发者工具公司),而且他给了完整论证:产品管理是手艺不是资格证、靠 reps 练出来、PM 越多别人的肌肉越萎缩、「招这么多 PM 是在把工程师和设计师当小孩养」。配上 31,832 : 1 的招聘数字和 21 个 PM 撑起最快增长市场平台的事实,论据链是闭合的。
- 你可以怎么做:这是你「大佬说 X 我试了」那条支柱的完美原料,而且你恰好是唯一能拿实测回答它的人——你不是评论这个观点,你是把它做到了极端:你的公司里只有一个人类。候选标题方向:「Whatnot 的 CPO 说他后悔 PM 这个岗位存在,我干脆把整个 PM 团队换成了 Agent——半年后我告诉你哪块肌肉萎缩了」。关键是他那句「你越把人从做决策里抽离,他的肌肉越萎缩」要老实兑现到自己身上:晒出你自己这半年亲手写了多少判断、多少是 Agent 替你写的、哪一块你明显手生了。过弹药库闸门:删掉你的实测这篇就不成立,过。
2. 「先验证再信任」+「追问到一手事实」是可抄物做成卡片的最佳候选
- 怎么做的:那串「你怎么知道那是欺诈」的五连问,本身就是一张卡。加上他划的微观管理分界线——「自上而下能奏效的前提是领导层足够强、能钻进细节、且在具体问题上判断是对的;它崩掉的地方在于你其实并不掌握实情,却还想从上面管人」。
- 你可以怎么做:你的每篇要有「可抄物」,这一期直接给了两张:一张「一手事实五连问」卡、一张「你在微管还是在钻细节」的自查判断卡。而且第二张对到你自己带 Agent 的处境格外锋利——你审 Agent 产出时,到底是掌握了实情在改,还是不掌握实情在瞎指挥?把这条做成 AI 员工管理成本账那条支柱下的一篇。
3. 「产品剧场」这个概念,是你这个号最好的靶子
- 怎么做的:Tom 承认「过去 5 年我们奖励的不是核心产品能力,是讲故事、拉齐、讲战略」,很多人把「向管理层输出框架」练到炉火纯青(Marty Cagan 叫这个「产品剧场」),而现在「这里面已经没什么地方可藏了」。他的验证手段也很实:任何岗位录用前都要做实操 case——给题目和数据出一份 PRD 然后当面口头答辩,「那些擅长表演但不抠细节的人,思考质量崩塌得有多快,相当说明问题」。
- 你可以怎么做:这条适合做成一篇有立场、可被反驳的观点短评:「AI 时代第一个失业的不是 PM,是产品剧场」——论据用你自己的实测:你让 Agent 写的 PRD 和你手写的,哪一份经得起「口头答辩」;Agent 最擅长的恰恰是生产漂亮框架(也就是剧场),所以人剩下的价值只能是抠细节和拍板。这一篇天然带你的判断,不是转述。
app_incubator · 「拉手风琴」是你把「该做什么」前移到 Agent 的现成机制
- 怎么做的:他唯一愿意用的心智模型:先把手风琴整个拉开吸气(我们到底要做成什么、长期影响是什么),再按下键推回去压成一个 V1——「拉开的那一下并不创造价值,价值全是在推回去的那一下产生的」,然后再拉开。他用商品列表的例子演了一遍:直播卖货本来不需要列表(做一条 3.5 分钟,举起来说两句 0 分钟)→ 拉远:新买家默认搜索得能用,没有列表就没法把人导进对的直播间 → 那让所有人做列表?→ 再拉远:每件多花 3 分钟,卖家每小时出货量断崖式下滑 → 这条也不行。
- 你可以怎么做:你的痛点是「把该做什么前移到 agent」,但 Agent 天生擅长的是「推回去」(压成一个 V1、生成方案),最不擅长的正是「拉开」(想清楚二阶三阶影响)。所以别指望一个 Agent 同时干两件事——在链路最前面加一个只负责「拉开」的角色,它的唯一产出是「这个改动如果被大规模采用会怎样 / 有哪些连锁反应 / 谁会因此变慢」,不许出方案。配上他那两句评审追问「绿了怎么办、红了怎么办」和「使用量高一千倍会怎样」,就是这个角色的提示词骨架。
Chief of Staff · 两条可以直接植入的问句
- 怎么做的:他有两句在评审里反复用的固定追问——「如果结果是绿的你打算怎么办?如果是红的呢?」(答不出就说明这件事压根没想清楚,先停下),以及内部口号 know then go(把所有可能出问题的地方想一遍,然后照样往前推——「你不需要把它们都解决掉,你只需要都想一遍,最后你解掉的会比你以为的多」)。
- 你可以怎么做:这两句比抽象的「季度回望」颗粒度细得多,适合做成 CoS 在你要做决定时的固定反问:「这件事成了你下一步做什么?没成你下一步做什么?」——两边答案一样就说明这个决定本身没意义。know then go 则正好对冲你「想太多不敢动」和「想都不想就冲」两种失衡,可以当成 CoS 给建议时的默认句式。
StockHelp / 投资视角 · 有真东西,但是背景透镜不是信号
1. 「电商三十年从未超过美国零售的 20%」是一组值得记进你脑子的长期数据
- 怎么做的:他给 agentic commerce 泼的冷水建立在硬数据上——电商发展三十年,在美国零售支出里从未超过 20%,英国大约 75:25;美国零售是个 7.5 万亿美元的行业,「我不认为这是赢家通吃的局」。理由是大部分购物是低意图的:我去逛商场,是因为我不确切知道自己想要什么。实体店的价值在于店主有主见、有品味、精选、有橱窗、有服务。
- 你可以怎么做:对你判断零售/电商/平台类公司的长期天花板,这是个很好的定量锚——别把「线上化率必然趋近 100%」当成默认假设,三十年 20% 是个极强的经验证据。同样地,当某个 AI 应用叙事说「agent 会接管所有消费决策」时,用这条反问一句:它接管的是高意图部分还是全部?高意图那部分占多少?这是估值时的定性背景,不构成任何买卖判断。
2. 「CPM 和电商是两套经济模型」——一个很干净的商业模式分析范式
- 怎么做的:他在 Twitch 的经验是「一场直播不到一千人,经济上就不成立,因为你吃的是 CPM」;但在 Whatnot,一个直播间三五十人就够——「你想象一下你在商场开一家鞋店,店里同时站着 50 个人,你根本不会关门」。同一个「直播」的产品形态,换一套变现模型,可行的规模门槛差了 20 倍。
- 你可以怎么做:这就是你找「卓越生意」时该问的那类问题——同样的用户行为,不同的变现模型会让单位经济差出一个数量级。看一家公司时把这条当固定检查项:它现在吃的是哪套模型?有没有可能换到一套让门槛骤降的模型?(这也是护城河「是否耐用」的一个来源。)
3. 「平均值对个体毫无意义」是他最贵的一课,对看数据的你同样成立
- 怎么做的:他说自己所有「对自己失望级别」的错误决策,主线都是同一条——依赖平均值、没去看藏在底下的个体用例。「只有 3% 的人在用」的功能,可能是另一群人 100% 的核心行为;下掉它「有点像 Westfield 商场在圣诞季前夕想都不想就把电闸拉了」。Lenny 接的是 Bezos 那句:数据和个案冲突时,相信个案。
- 你可以怎么做:两处都能用。在 ERP 那边,砍功能/改流程前先问「有没有一小撮客户,这个功能是他们全部工作流」;在你的选股看板那边,别只看整体分位和平均比率——一家公司的「平均利润率」常常掩盖了一块正在腐烂或一块正在爆发的业务,看板 Phase 2 加信号时,优先加「拆分后差异最大的那个维度」,而不是更多平均数。
更深三角度
- 该反着用:Tom 的处方是「PM 少而资深、一个人横跨多件事、最强的人自己下场」——但他能这么干,是因为他有 21 个人的余量、有两位创始人兜底、还能一句话清空自己的日程。你的处境正好相反:你已经是那个「一个人横跨全部」的极端。 所以他那句「让最好的人扎进每一处细节」对你不该翻译成「什么都亲自钻」,而该反过来读——正因为你只有一个人,你必须明确宣告哪三四件事归你亲自钻、其余的接受「知道得不够细」。他自己就是这么干的:Grant 盯的事他明确抽身,「有整整一半人在做的事我说不出每天进展到哪一步,这完全没问题」。允许自己在大部分事情上不知道细节,是这套模式能跑的前提,不是它的失败。
- 和你现在做法冲突:这是这期最该让你停一下的地方。Tom 全场的核心主张是——层级越多、管理层离一手事实越远,质量越差;AI 的价值在于让人能直接贴到事实上。而你正在做的多-Agent PRD 工厂,本质是在你和事实之间新增了一层(甚至八层)中介。他那句「你越是把人从做决策里抽离,他那块肌肉就越萎缩」,如果成立,那么对象既包括被 Agent 替代的团队,也包括把判断外包给 Agent 的你自己。更尖锐的是:他说组织之所以长出一堆层级,正是因为「管理层看不清底下到底在发生什么」——多加一层 Agent,和当年多招一层初级 PM,在「看不清」这件事上是不是同一种病?这个张力我不替你下结论,但值得你在下一次工厂迭代时正面回答一次:你的工厂是在放大你的判断,还是在替你判断?
- 对你的镜子:他给自己的定位是「我的工作是帮着把创始人的愿景和直觉翻译成现实」,而不是跟创始人争愿景归谁——「这不是你的公司,是他们的」。对到你身上有两面:在 Holdwell,你可能一直在争「产品方向该听谁的」这场其实不属于你的仗,而真正属于你的是「把方向翻译成能落地的东西,并且在细节上比所有人都准」;而在你自己的一人公司,情况彻底反过来——那里的愿景第一次真的归你,所以那里才是你该花判断力的地方。 分清这两个身份,比在两边都用同一种劲要省太多力气。
所以呢
可迁移思维模型
- 【耐用】手艺不是资格证,肌肉靠一组组练出来——任何你想保有的能力,都必须持续给自己留 reps;把某件事完全外包出去(给人或给 Agent),就等于接受那块肌肉萎缩。这条几十年内都不会过期。
- 【耐用】平均值对个体毫无意义 / 数据和个案冲突时相信个案——这是产品、投资、写内容通用的反直觉纠偏。
- 【耐用】拉手风琴:拉开定方向,压回出价值,来回循环——比任何「路线图 vs 敏捷」的站队都更好用,因为它承认两边都必要。
- 【耐用】know then go——把风险想穿再照样往前推,比「因为有风险所以慢下来」和「不想就冲」都强。
- 【会过期】「三个资深 IC 比一个金字塔便宜」这笔薪酬账——它成立的前提是资深产品人还没被市场重新定价;一旦这种「高杠杆 IC」成为标配,薪酬会跟上去,这笔账就不那么划算了。
- 【会过期】具体的工具与数字:Hex Threads、21 个 PM、「问 Claude 就能懂代码库」——工具一年换一茬,别把工具当结论。
判断更新
- 你的库里 Nikhyl 那期给的结论是「一半 PM 岌岌可危,你得成为建设者」——那是个体求生视角。Tom 这期把镜头拉到组织层:问题从来不是 PM 不行,是「每 6 个工程师配 1 个 PM」这条配比不该存在。 两期合起来的判断更新是:你要防的不是「被 AI 替代」,是「待在一个因为配比而存在、而不是因为具体需求而存在的位置上」。这个问题对你的正职和你的 Agent 编排是同一道题。
- 第二个更新:你原本可能默认「多-Agent = 更高杠杆」。Tom 给了一个反向的成立条件——杠杆来自「一个判断力强的人能同时看到棋盘上更多格子」,不是来自「更多执行单元」。所以衡量你那套工厂的指标应该改成「它让你看到了多少你原本看不到的一手事实」,而不是「它替你产出了多少文档」。
这周一个赌注
挑你正职里一件你觉得结论不对、但说不清哪不对的事,学 Grant:清掉半天,不开会、不问人,自己把工单、日志、数据一行行过一遍,用那串「你怎么知道 → 数据哪来的 → 谁按什么规则产生的 → SOP 是什么」追到底。赌注是:你会在这半天里找到至少一个所有人都以为成立、其实没人验证过的假设。 如果找到了,就把这串追问固化成你评审的强制三问;如果没找到,说明你的团队地基比你以为的扎实,那你可以放心把更多判断交给 Agent——这一个下午,两种结果都值。