跳转到内容

上下文压缩

对话越聊越长,迟早装不下模型的上下文窗口。Lyra 会自动把较早的部分压成摘要,原文仍然完整留在会话记录里。

输入框里模型名左边的圆环,表示这段对话占了上下文窗口多少。点开能看到分项:对话消息、内置工具、MCP 工具、技能目录、系统提示词、项目指令、项目记忆,还有剩余空间。

数字取自上一次回复的真实用量,还没回复过时先按估算显示。超过 80% 圆环会变红。

从便宜到贵,分三步:

  1. 裁掉过大的工具结果:不用请求模型,很多时候这一步就够了。
  2. 写摘要:占用到 80% 时,把较早的对话换成一份结构化摘要,最近的对话保留原文。
  3. 按需找回:recall 工具随时能把原始记录读回来,被摘要的内容不会真的丢。
  • 输入 /compact,后面可以跟一句希望摘要保留的重点。
  • 或者在 @ 菜单的「操作」里选 compact。

刚做完一件事、准备开始下一件时手动压一下,既能腾出空间,又不丢结论。

默认用当前会话的模型。想用更便宜的模型写摘要,到「设置 → 智能体」的「会话」一栏,给「压缩上下文」单独选一个。它只负责写摘要,不会改变回答用的模型。