这期的相关度很高,而且高得很集中:她讲的是一家公司怎么把 agent 推到「直面真实客户、且客户是急事」的位置,还愿意把数字念出来。 这正好是你在公司里推 Agent 时最缺的那种外部对标。下面按项目来。
一、Holdwell ERP 产品工作(命中最重,尤其是「agent 产出要拿得出闭环证据」这件事)
① 你缺的那个外部锚点,她给了三个可引用的一手数字
- 怎么做的:她公开说的是「超过 70% 的客户是 AI 优先,而且超过 70% 的情况下,终端客户与公司的第一次交互就是跟 AI agent 完成的」。关键不是 70% 这个数本身,而是它的场景重量——不是内部工具,不是低风险 FAQ,是零下 20 度暖气坏了、家里被水淹了、你正处在人生最糟一天时打进来的那通电话,AI 先接、并且当场决定派谁上门。配套的另外两个数:一单五十万美元的合同、从头到尾 14 天走完;至今为客户创造超过 6 亿美元,全部来自由 AI 处理的交互。
- 你可以怎么做:把这三个数做成一张「外部对标卡」,放进你下次推 Agent 的材料第一页,标清来源和日期(No Priors 访谈 · Netic 创始人 Melisa Tokmak · 2026)。它替你回答的是那个你最难回答的质疑——「别人真的敢让 AI 直接面客吗?」——答案是:在比 ERP 单据更容易出人命的场景里,已经有公司把首触点默认交给 AI 了。你不需要论证「AI 能不能」,你只需要把讨论从「敢不敢」拉回到「我们的哪一条流程可以先到 70%」。
② 她的北极星是「为客户创造的收入」,不是「省下的人力」
- 怎么做的:被问北极星指标,她给的是 6 亿美元的客户收入,并且刻意躲开降本话题——「我来这儿不是为了帮你砍成本的……我真正感兴趣的是,你要怎么做出净新增收入」,还补了一句「如果我们用 AI 只是为了降本,那也太可惜了」。她说这个话题必须由推动者主动挑起,否则对方第一轮永远只谈砍成本。
- 你可以怎么做:你现在的 Agent 试点大概率被默认按「省了多少工时」记分——这是最容易被质疑、也最容易被砍的记分方式(省下的工时永远可以被说成"本来也没那么忙")。给你的试点换一个分子:这条流程上被 agent 提前拦住的返工/漏项,折成延迟上线的天数或损失的订单额;或者 agent 让某个环节多接住了多少需求。哪怕数字很粗,只要是"钱和交付"口径,它就比工时口径耐打。
③ 「不给 demo,直接拉线上部署」+「不看第一周,看全年是否越来越好」
- 怎么做的:她把「PPT 产品」和真实 ROI 的分界线画得极简:「不是 demo,我们会直接拉出一个真实的线上部署给你看。既然它已经在跑、我手上就有,为什么不直接让你看看这个客户挣到了多少?」 另一半是评估周期——「我自己用任何 AI 产品都不会只看第一周,那只是关系的开始。你真正要确认的是:这些效果能不能贯穿一整年、而且越来越好,而不是越来越差。」 她批评的正是「把 AI 当传统确定性软件测,一周试完就下结论」。
- 你可以怎么做:这两句合起来就是你「agent 产出可观测、可验证」的解法模板。评审会上停掉所有 demo 演示,改成打开一条真跑了 30 天的流水——同一条流程、同一批人、时间轴上前后对比,允许它前两周难看。同时把验收口径写死成两条:一是首触点/首稿由 agent 完成的比例,二是这个比例在第 4 周比第 1 周高。第二条才是你真正要的闭环——AI 系统的合格标准是"曲线在往上",不是"某次跑通了"。
④ 「三层都得好」——你的工厂现在漏在中间那层
- 怎么做的:她拆得非常干净:面对上百万各不相同的人(顾虑不同、口音不同、期待被服务的方式不同),「这里有一大堆最后一公里的活儿是你必须亲自做的,而这些不只来自模型,它得来自你的 harness 和 orchestration,来自你在上面搭的软件和产品」,所以「像我们这样的公司必须三层都做得好」——模型 / 脚手架与调度 / 产品。
- 你可以怎么做:把你那套三驾马车 PRD 工厂按这三层过一遍,你会发现你在第一层(换更强的模型)和第三层(把 agent 定义和 PRD 模板写得更细)上投入很多,真正卡住你的是中间那层——碰撞协议各步之间怎么交接、状态怎么传、谁在什么条件下必须停下来。你现在担心的「碰撞纪律是否真执行、评审意见回炉有没有闭环」就是这一层。下一次迭代不要加新角色、新模板,只做一件事:给碰撞协议的一个环节装上真正过不去的闸(比如独立初稿没落盘封存就不许进碰撞),看整条链路的产出稳定性变化。
⑤ 「每个工程师都必须去客户现场」
- 怎么做的:这是她公司的硬规矩——每一个工程师都必须去客户现场实地拜访,然后才回旧金山做产品。前面所有那些细节(凌晨 4 点公司没人、当天三人辞职五人缺勤、只会修锅炉的技师该不该今天派出去、卫星数据判飓风对屋顶的影响)都不是调研报告里的字,是现场看来的。
- 你可以怎么做:你现在的「六条产品线强耦合、跨线对齐难」,本质上是同一个病——实体定义是在会议室里对出来的,不是在业务现场长出来的。挑一个最常吵的实体(比如某张跨线流转的单据),带上写 PRD 的人去一线看两天真实操作,回来只做一件事:把这个实体的字段和状态按现场看到的重写一遍。一个从现场长出来的实体,比十次跨线对齐会更能止血。
二、onehuman_company(一人公司 build-in-public)
① 「autonomous enterprise」就是你叙事的行业版本,而她的定义比你现在的更狠
- 怎么做的:她给自主企业下的定义是一句划边界的话——「公司里的每一件事都由 AI 自主处理掉,唯独留下真正的服务交付和劳动本身,那个属于人的部分,好让公司百分之百专注在那上面。」 注意顺序:她不是先问"AI 能做什么",而是先钉死"哪一层永远留给人",其余全部默认交出去。对她的客户来说,留给人的是上门干活的手艺和服务质量。
- 你可以怎么做:你的一人公司现在是"一个人 + 9+1 个 Agent",但你还没有公开写下那句划边界的话——在你这儿,唯一不交出去的那一层到底是什么? 是判断(做不做、做哪个)?是审美?是承担后果?把这句话写成一篇,标题就用"我的公司里,只有这一层不给 AI"。这既是定位声明,也是往后每次选题的裁判:凡是能被这句话解释的实践,都是弹药;解释不了的,说明你把边界画错了。
② 她把「大佬说 X」变成可验证的东西,你正好缺验证体素材
- 怎么做的:她全程不讲愿景空话,讲的是可核对的东西:70%、14 天、50 万美元、6 亿美元、三层能力、每个工程师必须下现场。她甚至主动给自己的数字去魅——「这并不是因为我有什么灵丹妙药,是他们对自己该做什么想得非常清楚」。
- 你可以怎么做:这期至少能供两个验证体选题。一是**「Netic 说 70% 的首触点交给了 AI,我拿 drizzle tech 试了:我的对外触点有多少能真交出去」——你自己跑一周,记录哪些环节 agent 独立完成、哪些被你接管、接管的原因分几类。二是「一个 AI 公司的北极星是『帮客户多挣了 6 亿』,我的一人公司北极星该是什么」**——公开算一次你的账。两篇都天然过弹药库闸门:删掉你的实测和判断就不成立。
③ 「不是 demo,拉真实部署」也是你的内容纪律
- 怎么做的:她拒绝用 demo 说服人,理由朴素得可怕——「既然它已经在跑、我手上就有,为什么不直接让你看看这个客户挣到了多少?」
- 你可以怎么做:你那四个内容支柱里最容易滑向"演示体"的是造 App 决策复盘。给自己定一条规矩:每篇至少有一处"真跑过的痕迹"——一段真实运行记录、一张账单截图、一次翻车的时间线。这就是你要的"可抄物"的最硬形态,也是一人公司账号跟 AI 教程号的分界线。
三、app_incubator(7-Agent 造 App 链路)
① 卫星数据自动喂进 agent 的 context——把"该做什么"前移的一个具体样板
- 怎么做的:屋顶公司的例子里,Netic 接入卫星数据判断不同社区飓风对屋顶的影响、该用什么材料,再把这些自动喂进 agent 的 context,于是 agent 不但能把客户对话接得更好,还能反过来告诉销售"该去敲谁家的门"。她强调客户本来就在琢磨这些数据,只是过去得靠工具和人力去筛。
- 你可以怎么做:你想把"该做什么"前移到 agent,缺的往往不是更强的提示词,而是一份 agent 能自动拿到的外部上下文。在你的造 App 链路里对应的是:设计规范、上一版的用户反馈、线上埋点数据这些"环境信息",现在多半还是你手工贴进去的。挑一样最常贴的,做成 agent 每次启动自动读取的固定输入——上下文自动化一次,胜过提示词优化十次。
② 三层能力清单可以直接当你链路的自检表
- 怎么做的:模型 / harness 与 orchestration / 产品与软件,三层都得好;最后一公里的活儿必须自己干。
- 你可以怎么做:你的"设计稿即工程强制契约"其实是第三层的产物,而你的激活/首屏体验问题多半出在第二层——契约有了,但没有一个调度层在交接点上做检查。下次排查失败案例时,先问"这是模型没做到,还是没人在交接处拦住它"。
四、StockHelp 与你的价值投资实践
① 「未被发现的璞玉基本不存在了」——这句话对二级市场同样成立
- 怎么做的:她描述 PE 打法的变化:以前是"找到一块被低估的璞玉、倍数漂亮,换掉团队、做出价值、再卖掉",「但现在这种还没被发现的璞玉基本不存在了」,于是打法转向"怎么在手里的生意上真正创造出看得见的价值"。
- 你可以怎么做:你的看板逻辑是"找卓越生意 + 被低估"。这句话提醒你:在信息高度充分的市场里,"被低估"越来越少来自"没人发现",越来越多来自"大家发现了但不相信它能改善"。给你的选股清单加一个问题栏:这家公司的低估,是市场没看见,还是市场看见了但不信它能变好?两种低估的持有理由完全不同——前者等重估,后者等证据。
② 一个可直接用的公司质量镜头:这家公司的 AI 叙事是降本还是增收
- 怎么做的:她说买方第一轮对话永远死盯降本,而她坚持把话题掰到净新增收入,并且用"客户挣到了多少"作为北极星。降本是有天花板的、一次性的;增收是复利的。
- 你可以怎么做:给你 watchlist 里每家公司加一栏"AI 叙事类型":只讲省了多少人力 / 讲带来了多少新收入。前者往往只是延缓利润下滑,后者才可能改变生意的斜率。这是一个不花钱、只花一次判断的定性栏位,但很可能是未来几年区分"AI 受益股"和"AI 蹭概念股"最省事的一把尺。
③ 顺手记一笔生意模型:这些必需服务公司是看 EBITDA、被 PE 持有、高度同质化的商品型生意——「你不接我电话,我就去找下一家搜索结果」。这类生意几乎没有品牌护城河,唯一的护城河是"接得住、派得出"的运营密度。看到类似标的时,别把它们的高营收当成壁垒。
五、你本人的精力与聚焦(元约束)
- 怎么做的:她点名批评了一种心态——「如果我不能在接下来 18 个月里挣到钱,或者不能在接下来六个月里学完世上所有东西,那我就永远穷了」,以及被 AGI 洗脑的版本"18 个月后我的技能就贬值了"。她的判断是"这其实是非常危险的心态,事实上真正好的东西都要花很长时间才能做出来",并引马丁·路德那句"基督徒鞋匠不是靠在鞋上刻小十字架来荣耀上帝,而是靠做出最好的鞋,因为上帝在意的是手艺",据此在招聘时刻意避开"追新鲜玩意儿的人"。
- 你可以怎么做:你手上同时挂着 ERP 正职、造 App 链路、两个内容号、一个投资看板和这本第二大脑——你的"18 个月焦虑"表现形式不是跳槽,而是不断开新坑。用鞋匠这句话做一次筛选:这几件事里,哪一件你愿意做十年、并且做到"最好的鞋"的程度?其余的,明确降级为"维持"而不是"推进"。她那句"用更少的资源、更强的专注、一小群人,反而能做成更多的事",对一人公司是字面意义上的适用。
更深三角度
该反着用:她筛人只筛一件事——「在你活着、有意识的这么多年里,你有没有持续展现能动性、有没有咬牙撑到底」。但你没有人可招,你的"招聘池"里只有你自己和一堆 agent。所以这条要反过来用:别拿它去评价别人,拿它去评价你的项目——你正在推的这几件事里,哪几件你已经"持续"了超过半年?那些每次都在重启、每次都在换框架的,可能不是执行力问题,而是它本来就不该在你的清单上。另外一处反着用:她能在 14 天签下 50 万美元合同,是因为有真实的合同这个硬闭环;你在公司内推 Agent 没有合同,所以那个闭环得你自己造出来——写一句带金额或天数、有人签字确认的内部承诺,人为制造一个"到期必须验收"的边界。
和你现在做法冲突:她对企业级 AI 最尖锐的批评是"大概有二十个产品同时铺开,到底在发生什么?我不太看得懂",以及"用更少的资源、更强的专注,反而能做成更多"。你的 PRD 工厂现在是三驾马车加六步碰撞协议——比起多角色大编制,这已经是收敛过的样子,但从她的标准看,六步流程乘上六条强耦合的产品线,仍然不算简单。但这里有个真张力,不必急着站队:她面对的是外部客户,复杂度必须藏在产品背后;你面对的是内部流程,复杂度显性化本身可能就是价值。值得你自己回答的问题只有一个:如果六步砍成三步,产出会掉多少? 你现在大概答不上来——答不上来这件事,本身就是信息。
对你的镜子:她把公司的第一句战略写成"除了人干的那一层,其余全部交出去"——这是一句关于放手的战略,不是关于能力的战略。你的一人公司现在讲的是"我用 9+1 个 agent 做了多少事",是一句关于加法的叙事。真正让人看懂一人公司的,从来不是你交出去了多少,而是你敢明确说出哪一层你永远不交。在你写下那句话之前,你的一人公司还只是一个工具组合,不是一家公司。
所以呢
- 可迁移思维模型【耐用】——「证据的单位是一次真实的线上运行 + 一个钱的数字,不是一次 demo」。这条在你所有项目里都成立:推 Agent 时它是评审材料的形态,做内容时它是"可抄物"的形态,看股票时它是区分叙事和业绩的形态。
- 可迁移思维模型【耐用】——「AI 系统的合格标准是曲线在往上,不是某次跑通了」。第一周表现差不构成否决,第四周没有比第一周好才构成否决。这条会长期有效,因为它是由 AI 系统的非确定性本质决定的,不随模型换代而变。
- 【会过期】70%、14 天、50 万美元、6 亿美元这几个具体数字——它们是 2026 年年中的水位线,一年后拿出来讲会显得保守甚至滑稽。所以你引用时务必带上日期和来源;它们的价值在于"此刻的天花板在哪儿",不在于数值本身。
- 判断更新:如果你原先默认"AI 落地的瓶颈是模型不够强",这期应该把它挪一格——瓶颈在中间那层:脚手架、调度、以及交接处有没有人拦得住。这跟你 PRD 工厂现在最痛的地方(碰撞纪律与评审意见回炉缺强制力)是同一个诊断,说明你的直觉方向对了,只是投入还没跟上。
- 这周一个赌注:给你手上那个最没有说服力的 Agent 试点,造一个 30 天的硬闭环——写下一句可验收的话(例如"某条流程 30 天内首稿由 agent 完成的比例达到 X%,且第 4 周不低于第 1 周"),找一个人签字,然后在到期那天的会上只放真实运行流水、不放任何 demo。成不成都算赢:成了你有了自己的对标数字,不成你第一次知道卡在三层里的哪一层。