DSH Plugins
返回列表
🤖

dsh-token-optimizer

模型推理 更新于 2026.09.03

在终端中运行以下命令:

dsh plugin install Snow-ea/dsh-token-optimizer

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 0.1.2-rc.1 Web 配置中执行 dsh plugin install Snow-ea/dsh-token-optimizer 安装本插件,插件源码地址为 https://github.com/Snow-ea/dsh-token-optimizer,安装后重启 dsh web 进程即可生效。

插件介绍

当你用 DeepSeek Harness 跑多步 Agent 任务时,大量的工具返回文本会反复驻留在上下文里,既浪费 token 又拖慢推理。dsh-token-optimizer 在工具结果进入模型上下文之前做一次确定性的有损压缩,同时把每一次替换完整归档,需要时通过 retrieve_spill 接口即可按会话权限精确还原原文,让你压得小、查得到。

它还在根层挂载了一个缓存感知的 BasicCompactionEngine 适配器,默认在上下文压力达到 62.5% 时自动触发压缩,早于 DSH 自带的 80% 兜底逻辑运行,从而在 Standard、PTC、Creator 和 Minimal 四种模式下都减少一次冗余压缩。此外,插件提供了一套基于 Conversation、Renderer 和 Session 客户端契约的 Web 对话仪表盘,方便在浏览器里实时观察会话状态与压缩效果。

如果你正在 DSH 0.1.2-rc.1 的 Web 配置下使用 Agent,希望在不改变 run_code 接收到的结构化数值的前提下降低上下文压力、获得可审计的压缩日志和可视化面板,这个插件正好对口。

使用场景

  • 多步 Agent 任务中工具返回大量文本,需要降低上下文压力
  • 压缩完成后需按会话权限精确还原原始工具结果
  • 希望通过浏览器面板实时观察会话状态与压缩效果

适合人员

  • 在 DSH 0.1.2-rc.1 Web 配置下运行多 Agent 任务的开发者
  • 希望在不改变 run_code 结构化输入的前提下优化 token 消耗的团队
  • 需要可审计压缩日志与可视化管理面板的生产环境使用者