主题
企业级 Agent 的记忆持久化、租户隔离和数据生命周期怎样设计?
题型:深入 · 企业场景中,正确授权比召回更多记忆更重要。
建议回答
每条记忆都带 tenantId、ownerId、scope、source、sensitivity、createdAt、expiresAt 和 version,并区分会话级、用户级、组织级与任务级作用域。读写必须使用服务端身份和授权策略,过滤条件由系统注入,不能由模型自由指定;存储层可再使用行级策略、独立集合或物理隔离加强边界。
长期记忆写入前要经过事实提取、敏感信息识别、去重和置信度判断,高风险数据需要用户同意或禁止持久化。数据按分类加密、审计、设置保留周期,并提供查询、更正、删除和导出能力。Embedding 或摘要只是一种派生数据,源记录删除时相关向量、缓存和索引也要同步失效。
Checkpoint 与 Memory 的边界
- Checkpoint 面向一次运行的恢复和追踪。
- Memory 面向跨轮或跨任务的上下文复用。
- 二者可以引用相同消息,但生命周期和访问策略不同。
易错点
- 向量库中的 tenantId 过滤不能只依赖应用层自觉传参。
- 审计日志本身也可能包含敏感数据,需要脱敏和访问控制。