/personality 之类的命令告诉它"我要你当个批评者";② 每跑完一轮,用一个专门做对抗性批判 / 对抗性 review 的 skill;③ 关键在于起一个全新的、没有任何 context 的 agent,专门来把这套东西拆掉**,然后从中学习再往下走。→ 详细本期没有固定的闪电问答环节,收尾是三段对话,值得单独留下来:
使命一句话(Peter:所以使命就是把这种 agent 带给每一个人?)——"让每个人都拥有同等水平的智能,都有自己的 agent;然后再为每个人做个性化,让他们能抵达属于自己的那一刻顿悟、那个高点、那份彻悟,把自己的巅峰真正实现出来。"→ 详细
关于未来的公平性(Peter:有个开放 harness 跟闭源 harness 同场竞技,你就不用被绑死在一家公司身上)——Karan 完全同意,并把它归结成一句可操作的话:"我们给你的这份自由意味着,你想干什么都行,你从哪儿来都行。"→ 详细
他自己的定位——"我只是在那儿干活的一个普通人而已……这件事的重点是这场运动本身,把这些东西带到你们面前,才是对我们最重要的事。"Peter 的收尾评价:"我觉得这可能是我到目前为止做过的最有激情的一场访谈。"→ 详细
一个花絮:录制中途 Karan 的猫叫了一声,Peter 说"看来你的猫挺认同你刚才说的",Karan 答"它是 open-source 的铁杆粉丝"。→ 详细
Karan Malhotra:X(推特)@karan4d,个人站 karan4d.com,网络别名 Mephisto。
但他本人明确说更希望大家去关注组织而不是他个人:Nous Research 主页 / Nous Army——"我只是在那儿干活的一个普通人而已。"→ 详细
片中出现的其他关键人物:Technium(Hermes 系列与 Hermes Agent 的最初创造者,"Hermes 真正的爹")、Jeffrey Quesnelle / emozilla(CTO)、Bowen Peng(首席科学家,与前者合著 YaRN)、Dylan(CEO,通过 info@nousresearch.com 主动找上门)。
这期是罕见的正面命中。你有一本以"和 AI 对话为入口"为野心的第二大脑、一家只有你一个人类的公司(十个 agent 在干活)、还有一个自己写的"什么算 AI 腔"的技能。而这个人整场都在回答一个问题:一个 agent 怎么才能真的越用越好,而不是每次从零、或者越用越烂。 所以这段会写得比平时厚很多。
① Curator 这套,几乎可以原样搬到你的 skills 目录上
content-radar、sources-to-notion、video-to-text、wiifm 一路加,加完就没人回头看了;video-to-text 的写法规范已经"第三次校准",说明规则确实在漂,但每次都是你自己手动去改。这周做的事很小:在 skills 里新开一个 curator/,里面只放一份 SKILL.md,内容就是那三句话的你本人版本 + 一份已知烂点清单(比如"同一条规则在两个技能里各写了一遍""某个步骤最近三次都被跳过""某段说明只有我看得懂")。然后配一条每周一次的定时任务,让它扫一遍 skills/ 和 90_meta/,只输出一份"建议删 / 建议合并 / 建议改写"的清单——先不让它自动动手,先让它每周交作业。跑四周你就知道该不该放权。② 自我改进 = 往里写 + 往外删,缺一个就是自我污染
ingestion-sop.md 管怎么进来,ingest-log.md 记进了什么,没有任何一条规则管"什么时候该出去"。给 SOP 补一个对称的另一半:每期总结入库时,顺手记一行"这条跟哪个已有主题重复 / 可能取代哪条旧笔记";主题 MOC 每季度跑一次"这个主题下最近半年没被引用过的笔记",列出来你亲自裁。你的信噪比痛点本质上不是"进得太多",是"从来没有出口"。③ 你已经有一个 curator 了,只是它还没被安排上班
de-ai-flavor 技能——它就是一份"什么算 slop"的成文标准(六定式 + 十几个开源项目 + AI 文风清单)。但它现在只在你发小红书前手动触发一次,用来管人看的文案;Hermes 的做法是把同一份标准接到一个定时循环上,去管 agent 自己写的东西。 具体动作:把 de-ai-flavor 里那部分跟平台无关的通用判据(空话、注水、模板腔、正确的废话)抽成一个共享片段,让上面那个 curator 直接引用它。这样你就有了 Karan 描述的完整形态——一个用你自己的审美标准、按你的节奏、自动运行的清洁工。① "改进存在 harness 里,不在模型里"——这句话直接决定你的成本账怎么算
② Kanban 编排:人和 agent 在同一块板上随时互换
onehuman_company 的存稿流程(选题 → 实测 → 初稿 → 去 AI 腔 → 封面 → 发)做成一个真的看板文件,每一列都允许填人或 agent。顺带你会发现哪几列其实一直卡在"你"这一格。③ 这一整期就是你那个号的选题矿
① agent 定义的腐烂速度,比你想象中快
.Codex/agents/*.toml 里。定义写得越厚,"什么时刻该用哪一段"这件事本身就越贵——这正是他说的 context 管理问题。给定义里每一块职责补一行触发条件(不是描述它会做什么,是写死"只在流程哪一步被取出来"),然后跑一次盘点:最近十张工单里,哪几段指令一次都没被真正用上过? 那几段不是没用,是触发条件写糊了——要么改清楚,要么合并掉。② 起一个"没有任何 context"的新 agent 专门拆台
① "你说得完全对"应该被当成故障报警,而不是好消息
该反着用:Karan 的口号是"只要是能在电脑上做的事,都尽管丢给 Hermes"——他在做增长,用例越多越好,一个新用户多试一件事就是多一分留存。你的元约束正相反:精力是你最稀缺的东西,你的瓶颈从来不是"能不能做",是"该不该做"。 所以这句话到你这儿要反过来念:先删再加。同理,Nous 必须做一套保守的通用 curator(因为要服务几十万口味不同的人),而你只有一个用户就是你自己——你压根不该经历"先用通用版再改"这一步,一上来就写死你自己的标准。他们的默认档是不得已,不是最佳实践。
和你现在做法冲突:这期有两处真张力。第一处——你上周刚把 CLAUDE.md 从 126 行瘦到 45 行,这是一次人工 curator 作业,而且做得不错。Karan 的整套主张是这活儿应该由 agent 按 cron 自动干,人只维护标准。冲突点很清楚:你相信"质量得我亲自把关",他相信"把标准写下来交给机器执行"。谁对取决于一件事——你能不能把"什么算 slop"写到足够可判定。你的 de-ai-flavor 恰好证明了你能,所以这个冲突对你其实是个提醒:你已经具备放权的条件,只是还没放。第二处——他说"忠诚会孕育能力",鼓励你和 agent 建立那种拟人化的信任关系;而你的 CoS 要的是一个敢顶撞你的外脑。一个越来越忠诚、越来越懂你的 agent,会不会同时变得越来越不敢反驳你?他自己的答案是"用人格设定和对抗技能强行制造抵触"——但那是外挂上去的对抗,不是自然长出来的。这个张力你得自己判,我不替你下结论。
对你的镜子:你一直把"和 AI 对话为入口"当成第二大脑的野心。但看完这期,真正的分水岭可能不在入口——Hermes 那句"最大的贡献者是它自己"之所以成立,前提是它同时也是最勤快的删除者。你的知识库现在有一个很好的入口、一套很扎实的入库 SOP、和一个从没上过班的清洁工。决定这本第二大脑是资产还是负债的,不是你往里放了多少,是它有没有一个自动往外扔的机制。
skills/curator/SKILL.md,判据从 de-ai-flavor 抄通用那部分,挂一条每周一次的定时任务,只让它出清单不让它动手。四周后看一件事——它建议删的东西里,有多少是你也同意该删的。这个命中率,就是你该不该把清扫权真正交出去的唯一依据。