Compare · 横评对比
Mem0 vs Zep:AI Agent 记忆 API、时间图谱与真实成本对比
比较 Mem0 的独立记忆层与 Zep 的时间 Context Graph,拆解用户隔离、纠错、删除、免费额度、credits 及七天同样本试点。
| 维度 | mem0 | zep |
|---|---|---|
| 主要定位 | 独立持久记忆 API 与开源 SDK | 时间 Context Graph 与 Agent Memory |
| 典型接入 | 按 user_id 写入并过滤检索 | 用户、thread、episode 与 Context Block |
| 更适合 | 现有应用补长期偏好 | 复杂客户实体和时间关系 |
| 托管免费入口 | Hobby:10,000 add / 1,000 retrieval 每月 | 免费计划:10,000 credits 每月 |
| 付费起点 | Starter $19/月 | Flex $125/月 |
| 计费重点 | 写入与检索请求额度 | 输入 Episode 大小对应 credits |
| 自建路线 | 开源 SDK 可自托管 | 企业部署选项依合同核对 |
| 共同限制 | 需要纠错、隔离与删除验收 | 需要纠错、隔离与删除验收 |
简短结论
已有聊天应用,只需要一层可按用户写入、检索和维护事实的记忆 API,优先试 Mem0。要把对话、客户资料及会随时间变化的关系组合成上下文,尤其面对复杂企业场景,优先试 Zep。两者都无法替代应用自身的用户授权、工具权限和人工审核。
这不是“谁更聪明”的绝对排名。相同检索问题在不同数据、模型和提示词下会产生不同结果。最可靠的决定方法,是在一批脱敏对话里同时测正确召回、旧信息纠错、用户隔离、删除回归、延迟与完整费用。
产品边界:记忆层与时间图谱
Mem0 是独立记忆层。托管 Platform 的典型流程是给消息标注 user_id,写入,然后使用同一标识过滤搜索;它会提炼可复用的长期事实。开源 SDK 允许团队自行配置模型与存储。这个结构适合已经选定 Agent 框架、只缺“跨会话记住什么”的应用。
Zep 的 Agent Memory 则以用户和 thread 为边界,把聊天消息和相关业务数据变成 Context Graph 中的 episodes。应用可获取用于下一次模型调用的 Context Block,或进一步通过 Graph API 自行查询。它特别适合“张先生三月在 A 公司,六月转入 B 公司”这类带时间的事实,以及客户、公司、订单等多实体关系。图谱带来的表达力也意味着更仔细的数据建模和权限设计。
实际接入:先跑同一个问题
假设客服机器人要记住某用户希望周二下午回电,后来改为周四。用 Mem0 时,先将得到授权的对话写入该用户记忆,再在新会话搜索“最佳回电时间”;若仍返回旧偏好,检查写入延迟、更新行为和检索阈值,不要让应用同时显示互相冲突的两条建议。
用 Zep 时,为该用户创建稳定 user ID 和 thread,将两次对话按顺序加入,检索其 Context Block。检查上下文能否反映后来的更正,以及模型是否引用了过期事实。Zep 官方也提醒最新消息可能因摄入处理而暂未进入上下文,应用应在当前请求中另外保留最近几轮对话。两边都要把返回上下文作为不可信数据送入模型,不能放进高优先级指令通道。
价格为什么不能直接比月费
截至 2026 年 9 月,Mem0 托管版 Hobby 免费档每月含 10,000 次 add、1,000 次 retrieval;Starter 每月 19 美元,Pro 每月 249 美元。高阶能力和多项目限制依套餐区分,开源自托管另计模型、数据库与运维费用。Mem0 官方价格给出了当前细项。
Zep 免费计划有每月 10,000 credits;Flex 月付 125 美元,含 50,000 credits。它主要按输入 Episode 的字节长度消耗 credits:小于等于 350 字节的 Episode 用 1 credit,增加字节会增加消耗;检索、用户和存储不另按条收费。自动充值与超额使用也应纳入预算。Zep 官方价格有计算器。不能把“Mem0 一次 add”等同于“Zep 一个 credit”。
做预算时取一周真实脱敏流量,分别记录:每名活跃用户的写入次数、检索次数、平均 episode 字节数、下游模型 token、重试、人工纠错、冷启动与删除任务。最后算每个通过人工检查的有效回答成本,而不是只比较订阅首页的大数字。
数据控制、部署与风险
Mem0 有托管 Platform 与开源 SDK 两条路线。自托管能更直接控制数据与组件,但需要负责密钥、网络、备份、升级、模型供应商和日志。Zep 提供托管服务与面向企业的部署选项;部署位置、密钥控制、审计与合同应按实际计划核对。两种产品都不能凭官网安全标识替代自己做数据分类。
多租户测试要故意使用同名、相似偏好和相同业务对象,证明用户 A 的事实不会在用户 B 的检索里出现。删除测试不能只看 API 返回成功,还要重新搜索、检查缓存与审计记录。对合同、医疗、财务或身份数据,先确认授权和保留期;不适合写入长期记忆的原文应在进入 API 前剔除。
谁应该选谁
选 Mem0:你已有聊天或 Agent 系统,希望用最少架构变更增加长期偏好;团队能自行管理检索结果进入提示词的方式,也愿意先用免费档量化写入、检索额度。选 Zep:事实有明显时间关系或多实体连接,需要把对话和业务数据构成更完整的客户上下文,且能接受图谱建模、credits 成本分析与治理工作。
若只是需要查询最新知识库文章,这两个产品都应与普通文档检索方案一起比较。若你需要完整有状态 Agent 运行时,还应对照 Letta。不要为了“有记忆”而让机器人自动修改订单或发起付款;记忆只能提供上下文,动作仍需独立授权。
7 天试点与验收
第 1 天确定 100 条脱敏样本和预期答案,标记稳定偏好、临时偏好、纠错、过期、多用户与删除案例。第 2—3 天按各自官方 Quickstart 接入,统一使用相同模型和回答提示词。第 4—5 天跑跨会话和并发测试,保存检索结果、原始来源和模型输出。第 6 天逐条核查误召回、漏召回与越权,第 7 天计算每个有效回答成本并演练删除。任何跨租户泄露或删除失败,都应阻止上线,而不是在平均准确率里被掩盖。
官方资料
结论
已有 Agent 只需补跨会话记忆,先试 Mem0;要把会随时间变化的客户和业务关系组成上下文,重点评估 Zep。用同一批脱敏样本和完整成本决定。
常见问题
- Mem0 和 Zep 哪个更适合已有客服机器人?
- 如果只需补充用户长期偏好,先试 Mem0;如果客服需要把对话、订单和客户实体的时间变化统一建模,可同时试 Zep。
- Zep 的 50,000 credits 等于 50,000 条消息吗?
- 不一定。credits 取决于 Episode 的字节长度;超过 350 字节会消耗更多 credits,应使用真实消息长度估算。
- Mem0 的开源版与托管版费用一样吗?
- 不一样。开源软件可自行部署,但模型、数据库、服务器、备份与运维都需要单独计算;托管版按官方请求额度和套餐计费。
- 哪个工具能保证用户改口后不会引用旧事实?
- 两者都不能无条件保证。要测试写入处理、纠错与检索链路,并在模型回答前加入冲突校验和最近对话。
- 检索到的记忆可以直接放在系统提示词吗?
- 不建议。记忆可能来自用户或外部数据,应作为低信任上下文输入,避免内容越过应用的系统规则与工具权限。
- 多租户上线前最重要的测试是什么?
- 用同名用户、相似问题和交叉数据验证隔离;再复测删除、缓存、审计与异常重试,任何越权都应阻止上线。