dsh-token-stats
在终端中运行以下命令:
dsh plugin install 1148281964/dsh-token-stats
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 终端中执行 dsh plugin install 1148281964/dsh-token-stats,或手动从 https://github.com/1148281964/dsh-token-stats 下载包放入 profile 的 packages/ 目录后重启即可。
插件介绍
如果你一直在跑 DeepSeek Harness,多半已经注意到:每次调用的 token 花费、各模型的实际消耗、缓存命中率散落在日志里,没有一个统一入口。dsh-token-stats 正是为此而生:它在 llm/stream 层拦截每一次真实调用,记录输入、输出、缓存读/写、推理 tokens 等计费口径数据(非估算),逐条追加到本地 JSONL 账本,重启或热重载后数据只增不减。
在账本之上,插件按供应商、模型、会话、日期四个维度聚合,并结合 OpenRouter 实时价格表估算费用,同时追踪缓存命中率、成功率与首字延迟(TTFT)。右下角可拖动的悬浮球支持「全局 / 当前会话」一键切换;点击后展开居中大屏弹窗,包含 KPI 卡片、请求占比环形图、近 31 天趋势、模型明细表格与近期调用记录。模型侧可通过 token_stats 工具直接查询,历史回扫脚本还能把插件安装前的调用补录进来。
如果你同时对接多个供应商、想搞清楚哪条流水线在烧预算,或者只是想要一份清晰的可读账单,这个插件非常合适。纯 JavaScript、无构建步骤,放入 packages 目录重启即用。
截图预览
使用场景
- 多供应商并行时实时对比各模型 token 消耗与费用
- 排查某次会话缓存命中率异常或首字延迟偏高
- 为团队出具月度 token 用量与成本报告
适合人员
- 同时对接多个 LLM 供应商的 Harness 用户
- 关注 API 成本与缓存效率的开发者
- 需要为团队或客户出具用量账单的运维人员





