dsh-token-saver
在终端中运行以下命令:
dsh plugin install Shaw529/dsh-token-saver
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 终端中执行 dsh plugin install Shaw529/dsh-token-saver 即可安装,插件源码位于 https://github.com/Shaw529/dsh-token-saver
插件介绍
跑过 DeepSeek Harness 长任务的人大概都撞过同一堵墙:一次性 read 一份 60 万行的迁移脚本,或者 grep 扫几十个文件,动辄往 prompt 里灌上百万 token,而模型根本没读完就进入下一步。dsh-token-saver 就是为这个场景而生的 Cordis 插件——它只盯着工具返回结果,做无损头尾裁剪和 grep 折叠,把真正送进模型的字符压缩到原来的百分之几,而折叠前的完整内容仍完整保留在 session log 中,随时可回放、可重建。
四档模式(off / conservative / balanced / aggressive)让你自己拿捏松紧。默认 conservative 只做一件事:保留头尾、用一行 metadata 标记中间被截断,不碰 dsh 原生 compaction 链路,任务推理零风险。balanced 收紧头尾预算并把压力滑窗委托给官方 ctx.compaction 钩子。aggressive 进一步接管 dsh-compaction-basic,可挂载可选的 LLM-summary 引擎。所有改写都走 dsh 事件流,listener 先 await next() 再修改,错误结果和极小载荷自动放行,不 mutate 任何私有字段,保证 deriveMessages() 在任何快照点输出一致。
它适合跑多步骤 dsh agent 任务、频繁读大文件或执行重度 grep、希望压低 token 花费又不想牺牲输出质量的开发者。八组真实基准场景下,总 token 从 382 万降到 9 万(conservative,省 97.6%)或 5.7 万(balanced,省 98.5%),装好即用,不需改动现有工作流。
使用场景
- 长任务中单次 read 大文件导致 prompt token 爆增
- grep 命中数十条后回填结果撑满上下文窗口
- 多步 agent 会话中工具返回结果累计消耗过高
适合人员
- 使用 dsh 运行多步 agent 任务的开发者
- 需要控制 LLM API 调用成本的团队
- 工作流中频繁读取大文件或执行重度 grep 的用户