dsh-auto-compact
在终端中运行以下命令:
dsh plugin install songoao25/dsh-auto-compact
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在终端执行 dsh plugin install songoao25/dsh-auto-compact 即可安装,项目源码地址为 https://github.com/songoao25/dsh-auto-compact ,安装后重启 DeepSeek Harness 生效。
插件介绍
DeepSeek Harness 的自动上下文压缩默认在窗口容量达到 80% 时才触发,对于拥有两百万甚至一百万 token 上下文窗口的模型来说,这个时机往往已太迟——长会话的响应延迟会悄然累积,用户却难以察觉根源。dsh-auto-compact 正是为此而生:它将触发线降至 75%,并支持按模型逐一微调策略,让上下文在还来得及的时候就被整理,长会话始终保持流畅。
它直接在用户安装的 agent preset 中注入压缩策略,默认保留最近 20% 的历史原文,同时为 GPT-5.6(272K 窗口)设定 70% 触发、为 DeepSeek V4(1M 声明窗口)设定 65% 触发。整个注入过程幂等、自动备份、可一键回滚,且绝不触碰只读的出厂 preset;摘要失败时保留原始历史而非静默丢弃。
如果你正使用大上下文模型进行长时间多轮对话,或管理多个 agent preset 并期望统一的压缩节奏,这个插件能帮你把上下文管理从事后补救变成提前预防,而无需重写任何 Harness 源码。
使用场景
- 大上下文模型长会话中提前触发压缩,保持响应速度
- 多 agent preset 统一压缩策略,避免逐一手动调整
- 按模型窗口大小定制触发阈值,灵活管理上下文
适合人员
- 使用大上下文模型进行长时间多轮开发的重度用户
- 管理多个 agent preset 并追求一致压缩体验的 Harness 用户
- 希望上下文管理提前预防而非事后补救的开发者