记忆与上下文
配置跨会话记忆并理解长对话上下文压缩
Clouisle 有三层上下文:当前活动消息分支、会话级摘要,以及跨会话用户记忆。三者解决的问题不同。
启用跨会话记忆
- 打开 Agent 编排 > 记忆。
- 开启启用记忆。
- 设置每次检索的最大记忆数,范围
1-50,默认10。 - 按需开启自动提取记忆,默认开启。
- 保存 Agent,并在两次不同会话中验证用户偏好是否被复用。

长对话如何压缩
上下文压缩默认开启,按模型上下文窗口计算可用输入预算,并预留默认 4000 个输出 Token 和 1000 个安全余量。
- 利用率
70%时进入警告压力。 - 利用率
80%时触发选择性压缩。 - 利用率
92%时升级到阻塞级宏压缩。 - 默认保留最近
3个原始轮次和2个工具轮次。 - 遇到上下文长度错误时,系统最多执行一次更激进的重试。
流式 API 可发送 compression_start 与 compression_end,用于解释本轮为何整理历史。
会话摘要
会话级摘要默认在至少 4 个轮次后异步提取,注入预算默认 400 Token。连续失败 3 次后打开熔断器,冷却 600 秒。摘要只服务当前会话,不会替代跨会话记忆。
排查
- 未记住偏好:确认 Agent 已启用记忆、信息达到重要性阈值,并使用同一已登录用户。
- 回复忽略很早的细节:长会话可能已压缩;把关键约束重新陈述,或开启新会话。
- 压缩频繁:检查模型上下文长度、输出预留和工具结果体积。
这篇文章对你有帮助吗?