dsh-context-lens
在终端中运行以下命令:
dsh plugin install gordonlu/dsh-context-lens
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 中执行 dsh plugin install gordonlu/dsh-context-lens 即可安装本插件,源码地址:https://github.com/gordonlu/dsh-context-lens
插件介绍
用 DeepSeek Harness 跑多轮对话或 Agent 流程时,每次请求真正发出去的上下文其实一直在变:系统提示词被改写、工具集增删、声明顺序调整、请求配置微调。这些变化对缓存命中率的影响往往是隐性的——账单上多了几十个 uncached token、缓存读数跳了几下,却很难说清楚到底是哪一次、改了哪里导致的。dsh-context-lens 为回答这个问题而生:它是一个纯观察者插件,逐请求读取 session log,不向模型注入任何 prompt,也不产生新的 session 事件,零开销地叠加在 Harness 之上。
打开 Request Context 标签页后,每个真实 LLM 请求生成一张紧凑卡片,涵盖四层信息:请求标识(turn:step、模型、provider、状态);已提交上下文的规范化指纹(系统提示词、工具集 schema 哈希与估算 token、请求配置、工具声明顺序);基于 provider 返回的 disjoint usage buckets 严格计算的缓存复用读数(uncached input / cache reads / cache writes),缺失字段显示为横杠而非零;以及与上一次请求的逐项 diff,覆盖系统、工具增减改、工具顺序、配置、模型、provider 和缓存边界的变化幅度。当复用率下降越过阈值,插件触发 Drop alert,按相关性排序列出同时发生的变化并明确标注是相关而非因果。
它适合在 Harness 上构建多轮 Agent 或工具调用流水线的开发者:如果你经常看到缓存利用率莫名下滑、token 账单波动,却缺乏一个一眼可见的逐请求变更面板来定位根因,dsh-context-lens 正好补上这块缺角。它只呈现可观测的事实,不猜测 provider 内部缓存键构造,也不声称因果,把判断留给使用者。
截图预览
使用场景
- 逐请求对比系统提示词、工具集、声明顺序等字段变化,定位缓存命中率下降的具体原因
- 监控每次真实 LLM 请求的 uncached input 与 cache reads 读数,发现隐性成本波动
- 当缓存复用率骤降时,自动列出同时发生的上下文变更并按相关性排序,辅助排查根因
适合人员
- 在 Harness 上构建多轮 Agent 或工具调用流水线的开发者
- 需要排查 token 账单波动与缓存利用率下降的 LLM 应用工程师
- 希望以纯观察方式审计每次请求提交内容、不侵入模型调用的平台运维人员
