新智元报道

「别再给 Claude 写提示词了,你该搭一张能让它自己跑起来的图。」

就在最近,Anthropic 工程师 Lamis 登上伦敦 AI Native DevCon,用近30分钟的时间公开拆解了一套让 AI 「越用越聪明」的内部方法。

刚开场,她就开起了玩笑:你们听了一天演讲,脑子里的「上下文窗口」应该快塞满了吧?希望还留着点余量,因为我接下要讲的,恰好就是上下文。

笑完后,她就把 Anthropic 一年的家底全给掀了。

记忆,最后变成了一个文件夹

Lamis 上来就放了个大招:**光有智能不会产生复利。**

再牛逼的模型,开箱也不知道在你的组织里怎么才算把活干成。这些东西得有人喂给它,还得让它记住。

Anthropic 过去一年就在琢磨怎么喂,前后换了四代方案。

第一代是 CLAUDE.md。人能读、agent 能写的 markdown 文件,塞在会话开头,效果「好得不讲道理」。但代价是会越写越长。

第二代是 memory 工具。干脆放权:什么时候读、什么时候写、什么时候更新,让 agent 自己定。

第三是 Skills,核心思路叫渐进式披露。

Lamis 用书架做了个比喻:有人用法语搭话,我抽出那本法语词典就能应付——不需要提前把七年法语课的内容全背进脑子。同样的,agent 只看文件顶部那几句摘要决定要不要加载,但 skill 本身可以塞进任意深度的细节。

第四代,也是他们现在认准的做法:把记忆直接建成文件系统。理由朴素——agent 天生会翻文件、搜关键词,你只管把它索引好。

思路听着漂亮,一上真实环境就出事。几千个 agent 同时改一份记忆,谁说了算?一个 agent 犯了错,错的信息瞬间传染全体。

Anthropic 的解法是设置四道护栏:能回滚、防撞车(你写到一半别人先交了,你这份作废重来)、分权限(全局知识只读,agent 只能写自己的草稿本)、可搬家。

现场当时就有观众灵魂拷问:这不就是在重新发明数据库吗?Lamis 笑了:确实是回到那些老套的软件工程原则,只不过换成 agent 能用的方式。

用起来也很简单,5 分钟搞定:新建一个 CLAUDE.md,写清楚活干成什么样才算合格。以后每踩一个坑,回来补一行。

让 AI 做梦:校长夜里批全校的卷子

上面这些,都是 agent 一边干活一边顺手做的。但这里有两个天花板。

**一是分心**——你既让它完成任务,又让它花算力写文件。

**二是视野**——它只看得见这一次会话里发生的事。你眼看着它反复犯同一个错,急得跺脚,它却毫无感觉。

因为每次会话对它来说都是一张白纸,上次犯的错根本不存在。几个 agent 在不同环境各跑各的,彼此踩过什么坑,更是互相看不见。

说白了:写记忆不该跟干活抢时间,也不该让一个 agent 蒙着眼睛干。得有人站在全局,事后统一复盘。

**于是有了 dreaming——做梦。**

做法简单粗暴:等 agent 们都收工了,单独起一个专职「复盘」的 agent,把记忆库和一大批历史对话记录摊开来,找出反复出错的地方,逐条提出修改建议,附上「哪几次对话里出的事、出了多少次」,最后交给人类拍板。

Lamis 用学校来打比方:学生交卷,老师批改,校长复盘全局。

学生每天交作业,老师每天批,但没人看全局。直到校长把全校试卷摊开一看——地理科所有同学同一道题全答错了。为什么?翻开课本一查,这个知识点根本没教过。校长把它补进课纲,第二天所有人自然就会了。

听起来要额外花钱?Lamis 说恰恰相反——记忆库一旦干净,agent 更容易一把过,犯错少了,成本反而降下来。这是真正的复利。

不用等 Anthropic 把这套东西做成产品,自己每周就能跑一遍:开个新会话,把这周的聊天记录丢给 AI,让它挑出你老是卡住的地方,直接在 CLAUDE.md 添上就行。

你手上那条工作流

是一张画烂了的图

记忆管的是时间:让 agent 跨会话攒经验。她讲的另一半管的是结构:一次任务内部,步骤到底该怎么排。

随讲座一起流出的还有一份图工程指南,核心观点用一句话说:你的工作流本来就是一张图,只是画得太烂。

比如,「先调研、再总结、再写稿」——三步排成一条线,每一步都在等上一步。但真的每一步都非等不可吗?

指南里给了个方法,叫**假边测试**对着工作流里的每一个箭头问一句:这一步真的用到了上一步的输出吗?数据真的流过去了吗?如果没有,这个箭头就是假的,等待纯属白费。

把假箭头删掉之后,最常出现的形状叫钻石:一个步骤做完,下面岔成好几条路同时跑,跑完再收拢到一个点汇总。你等的时间是最慢那一条路,而不是几条加在一起。

但同时跑也有风险——其中一路跑出了垃圾,会不声不响混进最终结果。所以汇合之前要加一道质检:这份输出能不能用?能用才往下走。

为什么说这是个转折

提示词有个根上的毛病:**改进不累积。**

你把一句提示词调到完美,这次它表现很好。下个任务,从头再来。功夫全留在了聊天框里,第二天什么也没剩下。

图和记忆在干同一件事——让功夫留下来。图把结构写成文件,记忆把经验写成文件,dreaming 让 AI 自己往里补。

人的位置也跟着变了:从一句一句喂指令的人,变成第二天早上点头或者摇头。

Keep thinking, keep learning, and keep dreaming.

参考资料:

https://x.com/Mahaximus\_/status/2083172782364315891

编辑:所罗门