DSH Plugins
返回列表
dsh-context-compression-improved

dsh-context-compression-improved

模型推理 更新于 2026.09.16

在终端中运行以下命令:

dsh plugin install drscrewdriver/dsh-context-compression-improved

将以下提示词粘贴到 DeepSeek Harness 对话框中:

从源码仓库 https://github.com/drscrewdriver/dsh-context-compression-improved 克隆并构建后,通过 dsh plugin install drscrewdriver/dsh-context-compression-improved 将该插件添加到 DeepSeek Harness 配置文件中即可启用上下文压缩选择器。

插件介绍

在 DeepSeek Harness 中运行多轮 agent 任务时,工具输出会不断堆积——文件读取结果、API 响应、编译日志——迅速撑满上下文窗口,既浪费 token 预算,也稀释模型对关键信息的注意力。dsh-context-compression-improved 在不修改 Harness 核心代码的前提下,提供一组可选择的、完全可审计的压缩策略:Fresh 在模型看到结果之前就压缩新出现的超大段落;Aggregate 在聚合后仍超预算时二次压缩;History 以微压缩方式替换过期工具结果、保留近期工作上下文;TailTrim 提供可选的尾部削减路径;Native 将经典的头-中-尾裁剪保留为一个显式 Profile。每一次决策都记录阶段、压缩器、触发条件、跳过原因和精确 token 计数,整条管线透明可追溯。

在此之上,这个 fork 新增了一个正交的代码骨架压缩门控。当大型源代码工具结果(如一次 read_file 返回的整文件)超出阈值时,门控先尝试骨架压缩:保留 import、类型注解和函数/类声明,函数体以标记省略,省略区域内的错误行则原样保留。若骨架无法生成或校验失败,插件自动回退到原有头部裁剪,确保门控永远不会让上下文变得更糟。该门控与所有 Profile 完全独立、默认关闭、严格依赖 DeepSeek 官方 tokenizer 进行无损测量,且受会话冻结机制约束。

如果你正在 DeepSeek Harness 中运行多轮编码、文件操作或 API 驱动的 agent 任务,并且希望在不侵入核心代码的前提下,对工具结果压缩拥有细粒度、可验证的控制,那么这套基于 Profile 的选择器加上可选的代码骨架门控,正是为这类场景准备的。

截图预览

使用场景

  • 多轮编码 Agent 任务中文件读取和编译日志不断堆积,需要精细控制上下文体积。
  • API 驱动工作流中 JSON 工具结果反复膨胀,需要在模型推理前自动裁剪。
  • 长时间调试会话中冗长的堆栈跟踪和构建输出挤占窗口,需要保留关键错误行的同时压缩其余内容。

适合人员

  • 在 DeepSeek Harness 中构建多轮 Agent 管线的开发者。
  • 需要管控长时间自动化任务 token 预算的工程团队。
  • 希望在不修改框架核心代码的前提下获得可审计、可回退压缩策略的工程师。