智能体背后的“记忆”从技术概念成长为行业赛道
创始人
2026-08-31 22:30:53
0

每经记者|可杨 每经编辑 杨翼

同样是使用Claude(一款大模型),问它一样的问题,为什么有人得到的建议是A,有人得到的建议却是B?

Agent(智能体)有不同的“性格”,这背后的一大关键要素,是Memory(记忆)。在长期的使用中,智能体积累了与用户相关的诸多记忆,就越来越会“揣摩人心”,知道用户的习惯,怎样决策和工作,哪些要求不必反复解释。这个过程也可以被理解为“养成”或者“调教”。

每经媒资库 祝裕 摄

“未来,每个人都会有一个AI(人工智能)智能体。”微软创始人比尔·盖茨曾在多个场合表达过这个观点,这也是Meta公司创始人扎克伯格等科技大佬的看法。

过去,大模型主要学习人类留在互联网里的知识,而随着智能体真正开始“上班”,就像每一个职场人那样,如何保存记忆、提炼经验,成为一场考验。

基于此,Memory赛道的创业公司开始获得连续融资,腾讯等云厂商开始把长期记忆做进基础设施,商汤等大模型公司把它加速推向产品底层。

记忆的困难发生在存储之后

人保存记忆靠大脑,Agent保存记忆则靠日志。一开始的问题并不复杂,但Agent工作越来越久,它留下的东西越来越多。比如,一次代码运行会产生日志,一次运行失败后还有修改、重试和新的计划。如果只是把所有内容塞进越来越长的上下文里,一个Agent每往前走一步,都要重新背上一部分过去。

不过,存储现在并不是Agent记忆能力的障碍,记忆的困难发生在存储之后。

腾讯云数据库副总经理罗云介绍,数据库行业已经发展几十年,分片、副本、冷热分层都不是新的工程问题。至少以今天Agent产生的信息规模,存储容量还远没有成为最主要的限制。

罗云进一步指出,智能化地选择哪些Token(词元)是重要的。

和过去几年大模型追求更多参数、更多训练数据、更长的上下文不同,Memory要解决的是一个反面问题——为什么还要重新读取这一段。人会凝炼和升华自己的记忆,但Agent在这方面能力欠佳。

这也正是该领域公司主攻的方向。今年4月,美国科技公司Cloudflare的Agent Memory进入私测,目标之一是让智能体保留真正重要的信息,同时避免把所有历史不断堆进上下文窗口。

不过,在要求模型从海量知识中准确提取并输出特定事实的能力测试任务中,完整上下文的效果仍然可能优于Memory,因为10万Token被压缩成几千Token之后,一些重要的细节可能会消失。

这就带来了一个问题,当用户需要让大模型记住新知识时,到底该把知识“刻在脑子里”,还是“记在笔记本上”?

传神语联研发总监吕华介绍,参数化记忆(刻在脑子里)更适合容错率很低,或对模型推理响应速度要求极高的场景,例如终端物联网设备、辅助诊疗决策等。而绝大多数企业问答、客服、文档总结等场景,只需要用RAG(检索增强生成)即可。

记忆污染与指令冲突更具挑战

“保留重要信息”不是Memory 最困难的部分,记忆污染与指令冲突带来的挑战更难克服。

PilotDeck 是由清华大学THUNLP实验室、面壁智能、OpenBMB与AI9stars联合开发的一款开源智能体操作系统。PilotDeck项目负责人、启元实验室副研究员、清华THUNLP实验室客座研究员闫宇坤在受访时举例称,用户希望Agent能够跨几十轮对话,保持小说的世界观、人物关系和用户反馈,但如果这些偏好没有边界,又会污染其他任务。

“什么时候要跟随你前面的要求,什么时候要跟随你后面的要求,Agent会混乱。”闫宇坤说。

简而言之,Agent虽然记忆力很好,但如果缺乏有效的隔离机制和优先级判断,记忆就会带来一笔糊涂账,导致其工作彻底混乱。Agent在拥有了“过去”后,不仅要懂得在什么时候“记住”,更要懂得什么时候“忘记”。

OpenAI在今年6月升级ChatGPT Memory时提到,关于“用户正在为下周六的生日派对做计划”的记忆,会随着周日的到来而流逝。OpenAI称,新版系统会在后台综合多段对话,以应对记忆的陈旧性、正确性与规模问题,并强调记忆需考虑时间流逝。

北京邮电大学人工智能学院副院长张曼在受访时强调,要把聊天记录和Memory区分开,原始对话只是一条不断增长的数据流水,真正的Memory还要进一步抽象、压缩、分层、纠错、衰减和按需召回。哪些信息值得长期留存、哪些只是临时要求;用户已经明确改口以后,旧偏好什么时候退出;两条冲突的经验如何取舍——这些问题直到今天都没有完全解决。

商汤小浣熊家族负责人贾安亚也认为,目前,行业对于“记住”和“遗忘”的处理仍然相当工程化,按照时间淘汰、按照一段记忆被调用的次数判断重要性,都是现阶段可行的办法,但这些方法距离真正类似人类的记忆仍有差距。

“现在,市场上没有最优的Memory,Agent的Memory和真正的人类Memory,其实相差还是比较大的。”贾安亚进一步透露,其团队正在探索一种类似“闪回”的机制,即定期把系统沉淀的用户记忆重新呈现给用户,由用户自己确认或修改。

“记忆”如何最终变成生产力

8月6日,腾讯云旗下开源项目TencentDB Agent Memory发布全新版本Team Memory,将长期记忆能力从个人使用扩展到团队协作场景,团队成员与Agent协作过程中产生的对话、文档、代码库和工作方法,都可以保存为长期记忆被统一管理,再按角色和任务装配给Code Buddy、Open Claw、Claude Code等不同Agent使用。

罗云介绍,此前,腾讯内部一名工程师转到一个新团队时,原本给自己留了大约三天的上手时间——即使用AI,他也预计前一两天需要先读代码、熟悉项目,到第三天才能真正开始第一个任务。但借助团队Memory里已经保存的Skills(技能)、代码关系图和过去的信息,他一天就完成了原本预计三天的准备和任务。

事实上,这是企业过去几十年一直试图解决的问题,一个人已经获得的经验,怎样低成本地交给另一个人。培训、SOP(标准作业程序)、Wiki(维基,多人协作的写作工具系统)和知识库保存了大量显性知识,却很难记录一个高级工程师为什么面对某类报错先查A而不是B。这些经验依附在人身上,人离开以后,一部分经验也随之流失。

以此为起点,Memory成为AI经济账本中的一环。企业并不会因为一个Agent记得更多就天然愿意付更多钱,更多消耗不等于更多生产率,Memory 最终也要回答同一道题:留下这些“过去”之后,Agent下一次是不是更好了?

吕华把企业为AI付费的本质概括成一个词:熟练度。一种情况是,企业没有专家,希望买到专家能力;另一种是,企业本来就有专家,希望把其专业能力沉淀下来。做一件事情调用什么工具、决策逻辑是什么、验收标准是什么,这些并不是通用大模型在预训练阶段天然知道的,却构成了一家企业自己的行为能力。

闫宇坤认为,理想的状态是,在Agent的使用过程中,低价值信息逐渐退出,高价值经验不断被提炼。

但记录过去是一件相对容易的事情,把过去变成经验就要困难得多。Agent 开始有机会参与一家企业如何工作,是Memory可能真正产生商业价值的地方。

过去几年,大模型公司争夺的是互联网已经留存下来的数据,它们是这个世界最终留下的静态成果,而Agent长期工作以后,过程、失败、选择、反馈和纠正,成为新的动态数据。

罗云把这看成两个飞轮,第一个是用户飞轮,一个产品用得越久,对用户越熟悉,用户也越容易觉得它很聪明;第二个是数据和模型飞轮,在用户授权的前提下,Agent使用过程中产生的数据可能继续帮助模型优化。

定义和标准范式暂无行业共识

今年3月,Google给Gemini(某大模型)增加了一项功能,从其他AI应用导入Memory和聊天历史。

Google在产品说明中提到,只需几次点击,即可从其他服务商转移AI Memory和聊天记录,“与其重新开始,不如快速让Gemini了解你最重要的背景和对话”。Anthropic(一科技公司)也开始支持Memory导入和导出,Claude用户可以把其他AI服务整理出来的Memory带进来,也可以把Claude已经积累的Memory导出去,用于备份或者迁移。

类似于过去手机厂商对“一键换机”的争夺,AI企业也开始尝试“一键搬运”AI的过去。

当“记忆”开始沉淀“经验”,它就不再是某个模型的附属品,还是用户的数字分身。如果一个Agent已经和一家企业一起工作三年,里面留下的是项目历史、用户纠正、客户偏好、失败路径和团队的工作方式,换掉它的成本就不再只是重新购买一个API(应用程序编程接口)。

从技术上来说,迁移记忆是可行的。外部Memory并不天然绑定某一个模型。结构化规则、经验和向量数据理论上都可以迁移。

闫宇坤提到,问题在于整个行业没有对Memory的定义和标准范式形成共识。

张曼也认为,从技术上看,真正的问题是有没有统一的存储和适配标准,以及平台愿不愿意让用户搬走。“如果行业没有统一的迁移标准、厂商封闭记忆数据,长期积累的私人记忆和工作经验,就可能成为新的平台壁垒。”

尽管OpenAI、Google、Anthropic都在做Memory,腾讯云、阿里云、火山引擎也在布局记忆能力。但这些平台之间的拉扯,给了独立Memory公司生存的空间。

如果记忆最终只是模型产品的一项默认能力,独立创业公司的空间可能不断被底座平台吸收;而如果企业越来越重视权限、备份、隔离、审计、跨模型迁移和数据主权,Memory又可能像数据库一样,从模型里发展出一个单独的基础设施层。

专为AI Agent设计的开源智能记忆层服务——Mem0在去年末宣布完成两轮融资时,把其目标直接定义为构建AI的Memory layer(记忆层)。今年,国内连续获得融资的记忆张量、Memora X也都把长期Memory指向基础设施和模型之外的一层。

独立Memory公司押注的是“模型厂商不敢把记忆的所有权彻底交出去”,但记忆的所有权理应从平台向用户转移。

封面图片来源:每经媒资库 祝裕 摄

相关内容

热门资讯

原创 苹... 有不少朋友疑惑苹果iPhone 16 Pro和16 Pro Max有什么区别?该选择哪一款更好?各自...
2024年OPPO手机全攻略:... 手机已不仅仅是通讯工具,它更是我们记录生活、享受娱乐、提升工作效率的重要伙伴。随着科技的飞速发展,O...
2025年值得入手的2款智能手... 在科技飞速发展的今天,智能手表已成为我们生活中不可或缺的伙伴。无论是健康监测、信息提醒,还是时尚搭配...
原创 2... 从去年华为用上了麒麟芯片开始,华为的市场份额就蹭蹭的往上涨,当时抢购的人特别多,一时间还买不到现货,...
第五轮学科评估对比:西安交大突... 在之前的文章中,我们已经提及西安交通大学第五轮学科评估的表现可圈可点,新晋的3个A+学科:机械工程、...
vivo手机5g开关在哪里打开 vivo手机5G开关的打开方式可能因手机型号、系统版本及运营商网络支持情况的不同而有所差异。但总体来...
原创 麒... 为了普及原生鸿蒙(鸿蒙5.0),抢占更多的中端手机市场份额,华为nova系列今年开始计划一年两更,n...
解决FaceTime无法使用的... FaceTime是苹果公司推出的一款视频通话应用,广泛应用于iPhone、iPad和Mac等设备上。...
steam官网无法访问?这个办... 对于广大游戏爱好者而言,Steam平台无疑是获取最新游戏资讯、购买游戏、与全球玩家互动的重要阵地。然...
原创 直... #热点周际赛# 随着科技的进步,儿童智能穿戴设备逐渐成为了家庭中的新宠。华为作为智能穿戴领域的领军者...