ClouisleClouisle

记忆与上下文

配置跨会话记忆并理解长对话上下文压缩

Clouisle 有三层上下文:当前活动消息分支、会话级摘要,以及跨会话用户记忆。三者解决的问题不同。

启用跨会话记忆

  1. 打开 Agent 编排 > 记忆
  2. 开启启用记忆
  3. 设置每次检索的最大记忆数,范围 1-50,默认 10
  4. 按需开启自动提取记忆,默认开启。
  5. 保存 Agent,并在两次不同会话中验证用户偏好是否被复用。
Agent 记忆配置
Agent 记忆配置

长对话如何压缩

上下文压缩默认开启,按模型上下文窗口计算可用输入预算,并预留默认 4000 个输出 Token 和 1000 个安全余量。

  • 利用率 70% 时进入警告压力。
  • 利用率 80% 时触发选择性压缩。
  • 利用率 92% 时升级到阻塞级宏压缩。
  • 默认保留最近 3 个原始轮次和 2 个工具轮次。
  • 遇到上下文长度错误时,系统最多执行一次更激进的重试。

流式 API 可发送 compression_startcompression_end,用于解释本轮为何整理历史。

会话摘要

会话级摘要默认在至少 4 个轮次后异步提取,注入预算默认 400 Token。连续失败 3 次后打开熔断器,冷却 600 秒。摘要只服务当前会话,不会替代跨会话记忆。

排查

  • 未记住偏好:确认 Agent 已启用记忆、信息达到重要性阈值,并使用同一已登录用户。
  • 回复忽略很早的细节:长会话可能已压缩;把关键约束重新陈述,或开启新会话。
  • 压缩频繁:检查模型上下文长度、输出预留和工具结果体积。

这篇文章对你有帮助吗?

本页目录