上下文压缩
对话越聊越长,迟早装不下模型的上下文窗口。Lyra 会自动把较早的部分压成摘要,原文仍然完整留在会话记录里。
输入框里模型名左边的圆环,表示这段对话占了上下文窗口多少。点开能看到分项:对话消息、内置工具、MCP 工具、技能目录、系统提示词、项目指令、项目记忆,还有剩余空间。
数字取自上一次回复的真实用量,还没回复过时先按估算显示。超过 80% 圆环会变红。
从便宜到贵,分三步:
- 裁掉过大的工具结果:不用请求模型,很多时候这一步就够了。
- 写摘要:占用到 80% 时,把较早的对话换成一份结构化摘要,最近的对话保留原文。
- 按需找回:
recall工具随时能把原始记录读回来,被摘要的内容不会真的丢。
- 输入
/compact,后面可以跟一句希望摘要保留的重点。 - 或者在
@菜单的「操作」里选 compact。
刚做完一件事、准备开始下一件时手动压一下,既能腾出空间,又不丢结论。
用哪个模型写摘要
Section titled “用哪个模型写摘要”默认用当前会话的模型。想用更便宜的模型写摘要,到「设置 → 智能体」的「会话」一栏,给「压缩上下文」单独选一个。它只负责写摘要,不会改变回答用的模型。