开源项目Memmy打通所有Agent记忆,换工具不用重新投喂
短短半年,我电脑里已经装了七八款Agent,但真正常用的只有一两款,其它尝鲜后都慢慢吃灰了。用惯一个Agent后很容易养成依赖,里面有聊过的方案、改过的要求,还有做到一半的项目。但总有必须换着用的时候。比如项目做到一半,Claude Code额度不够,想让Codex接着干,可之前聊过的细节它全不知道,还得整理聊天记录重新投喂,本来只是想换个工具继续干活,结果先给自己加了一道整理资料的工序。
不过最近我发现了一个开源项目Memmy,它可以把原本分散在不同Agent里的“记忆孤岛”连接起来,让Cursor、Claude Code、Codex、OpenCode、OpenClaw、WorkBuddy等所有外部Agent基于同一份上下文协作。之前在CC里聊过的方案、确认过的要求,换到Codex直接无缝衔接,所有Agent都能共用一个大脑皮层。

打开客户端后,新用户注册可直接领取200万Token体验额度,邀请新用户还能再得50万Token。也可以不登录,直接填写自己的模型API和Key。接着Memmy会申请读取本地Agent的历史记录,可以选择“仅扫描”先把已有对话导进来,也可以同时允许常用Agent接入,方便后续读取和写入记忆,之后想调整可到“跨Agent接入”页面修改。导入后,它还会根据这些记录生成一份“初见报告”,整理你的偏好和最近的项目。比如我这份报告里就提到,习惯先把方案、边界和实现细节聊清楚,再进入代码修改,后面还列出了最近在Codex里讨论的项目。
具体导进来了哪些内容,可以到“记忆管理”里看。概览中有记忆数量和来源分布,哪些来自Codex,哪些来自WorkBuddy,都有对应统计。Memmy也会把这些内容分层整理,从原始对话,到做事经验、项目认知,再到可复用的Skill。进入列表,还可以查看具体内容、搜索关键词,或者按来源筛选。

这些记录能找到,那换到另一个Agent后能不能接着用呢?我之前在WorkBuddy里做过一个订阅管理小工具,把各种AI工具、网盘、影音会员的订阅放在一起,看看每个月大概要花多少钱,哪些服务快续费了。功能和实现方案都聊过,也做出了一版页面,后来就搁在那里了。安装部署好Memmy和记忆服务、完成接入后,我就在Codex里重新提起了这件事。Codex开始通过memmy-memory检索之前的讨论,随后结合实际页面文件,确认项目的进度。它找到了WorkBuddy当时的项目记录,还指出这个工具已经做过一版,人民币、页面内提醒、未来12个月的现金流图都已经确定了。还有一些更细的要求,比如月均费用和当月实际支付要分开算,年付1200元的订阅摊下来每月是100元,但扣款的那个月实际支出就是1200元。另外,取消的订阅要保留记录但不再计入未来支出;自己用,不做登录,数据保存在本地浏览器里。这些之前聊过的细节,Codex都列了出来,我这次提问时并没有重新交代。
背景接上了,后面就好办了。我直接让Codex顺着之前的方案继续做,它在原来的基础上又完成了一版。页面里把月均费用和当月实际支出分开显示,下面也有未来12个月的现金流图,之前确定的要求在接着做的时候保留了下来。一个在WorkBuddy里搁置的项目,就这样换到Codex里继续往前走了。

简单来说,Memmy不仅是一个开源的个人AI Agent,同时也是不同Agent共用的记忆中心。它自己的Agent和记忆服务是分开运行的,你可以直接在Memmy里提出需求、调用工具,也可以只使用它的记忆服务。所以即使平时不用Memmy聊天,继续用Codex、Claude Code等工具,也可以用上这份共享记忆。大家也不用担心这些记忆会泄露出去,Memmy的记忆服务默认保存在本地,导入哪些来源、接入哪些工具,以及哪些内容需要保留,都可以由自己管理。
有了Memmy,以后跨Agent执行任务的时候,不用再把这些细枝末节的细节重新发一遍。我觉得这是一个难度不高但很繁琐的麻烦,好在现在已经解决了。之前在WorkBuddy里聊过的要求,换到Codex后还能找回来,连“月均费用和当月实付要分开算”这样的细节都保留着。这让我想起以前WPS与Office的恩怨情仇,兼容对方的文件格式绝对是一件正确的事,放到Agent上其实也一样。Agent可以换,模型可以换,但之前积累的上下文绝对不能丢。某种程度上,Memmy做的就是给不同Agent补上了这一层兼容性。如果你平时也同时用Codex、WorkBuddy这类Agent,我觉得Memmy挺值得体验的。
更多推荐阅读

谷歌TPU推理成本反超英伟达,黄仁勋三次断言被数据打脸
英伟达死守的推理性价比神话被打破。SemiAnalysis发布谷歌第七代TPU Ironwood首份第三方推理性能测算:在完全对等负载下,TPU每美元性能最高领先B200达50%,对B300领先幅度达96%。每百万Token成本,TPU仅0.181美元,B200为0.222美元,B300高达0.276美元。 今年4月,黄仁勋曾在播客中称TPU与Trainium不敢跑分,并鼓励挑战者用Infere...
2026-09-10
AI每周三晚7点直接给你安排约会,已获920万美元融资
过去十几年,约会 App 形成了成熟逻辑:先看照片,右滑左滑,匹配后聊天,再约见面。Tinder、Bumble、Hinge 基本都没跳出这套流程。但美国两个伯克利辍学生做的产品 Ditto,把这套流程删得差不多了。 Ditto 没有照片瀑布流,不需要不停刷人,也没有匹配列表,甚至不鼓励匹配后先聊几天。用户只需给 iMessage 号码发消息,告诉 AI 自己是谁、喜欢什么样的人。每周三晚 7 点...
2026-09-10
苹果AI未至,Apple Watch先成个人智能中枢
曾几何时,Apple Watch 和 AirPods 被苹果定义为「配件」类产品。但在今年这个苹果面向 AI 转型的关键年,这些产品扮演了前所未有的重要地位。不只是 iPhone,连过去的配件也要自我进化,成为「AI 硬件」。 苹果在秋季新品发布会上带来了 Apple Watch S12 与 Ultra 4,这是今年 iPhone 之外更新最大的硬件产品。苹果将手表定义为与用户更亲密的「个人智能...
2026-09-10
27岁AI研究员辞职:担心AI致人类灭绝
昨天,Jacob Coxon在X上发帖,流量过亿。他27岁,英国人,数学出身,曾两次入选英国国际数学奥林匹克竞赛队伍,后进入剑桥大学Trinity College学数学。2021年参与过一篇eLife医学统计论文。2023年左右加入OpenAI,是GPT-4o官方贡献者,GPT-4.5核心贡献者。今年从OpenAI去了Anthropic,继续做大模型预训练,但很快辞职。原因是他认为OpenAI和A...
2026-09-10
神秘模型Omen Alpha实测:25分钟速搓“牛来”版YouTube
智东西9月9日报道,匿名模型Omen Alpha近日突然出现,凭借超高性价比迅速引发热议。上线5天后,在免费模型Muse Spark 1.3 Contributor冲击下,仍高居OpenCode调用量榜单第七,被网友称为“又是来自东方的神秘模型”。社区测试中,开发者普遍反馈“快”,有人仅用1小时30分钟完成简易3D世界建模,而用GLM 5.3 Flash和GPT 5.6 Luna以同样提示词开发用...
2026-09-10
DeepSeek V4.1 Flash上线:552B MoE模型全面超越V4 Pro
周四上午,DeepSeek V4.1 Flash 正式在网页、App 和 API 端全面上线。官方称其在性能、响应速度、效率等核心指标上全面超越 V4 Pro,采用新架构并原生支持多模态。 V4.1 Flash 是一款总参数 552B 的 MoE 模型,采用全新 Causal-Encoder-Decoder 架构,输入与输出采用非对称计算设计:输入侧仅激活 8B 参数,输出侧激活 16B 参数,...
2026-09-10