dsh-cost-stats
在终端中运行以下命令:
dsh plugin install thezavtrak-a11y/dsh-cost-stats
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在终端运行 dsh plugin install thezavtrak-a11y/dsh-cost-stats 即可安装该插件,源码见 https://github.com/thezavtrak-a11y/dsh-cost-stats
插件介绍
DSH 只报告 token 数量,从不给出任何金额——你看到一堆数字,却永远不知道一整个会话到底花了多少钱。dsh-cost-stats 补上了这块缺口:用本地价格表做算术,把结果直接放在你已经在看的地方。每一轮完成后的操作行里多了一枚右对齐的成本药丸,风格与旁边自带的 Used N tokens 一致;composer 下方的状态条也多了四个数字,代表整个会话的累计花费。点开花丸,就能看到分桶明细(未命中输入、缓存输入、缓存写入、输出含推理)、所用模型、轮次编号、TTFT 与 tok/s。
Cost 标签页是真正深入的地方。每个模型请求被归入三种互斥类别之一——工具调用、纯推理、或读取与分析——因此各份额加起来必然等于总额。标签页内包含 KPI 卡片、花费构成环形图、最贵轮次 / 工具 / 请求 / 模型的排行榜,以及一条完全可交互的时间线。时间线支持滚轮围绕光标缩放、拖拽平移、双击或按钮复位、10 s 到 15 min 的步骤粒度;悬停任意柱形显示其独立数据,图上方的摘要行则报告当前可见窗口内的请求数、窗口花费、平均速率与峰值速率。
这些数字是估算而非账单:token 数来自 provider,金额来自你可以就地编辑的每模型四列价格表。缓存输入默认按零计价——审计长期 DSH 日志后发现约 99.4 % 的 prompt token 以缓存命中到达,按公开缓存单价计算会高估一个数量级;如果你的套餐确实对缓存读取收费,把真实数字填进去,所有总额都会随之变动。插件不修补任何上游代码,注册进 DSH 官方的 slot、session-source 和 locale 注册表,升级不丢失,卸载只需删一行。如果你日常用 DSH 网页端做编码或 agentic 工作,想知道钱到底花在了哪、而不必翻 JSONL 日志,这个插件就是为此而写的。
使用场景
- 日常用 DSH 网页端编码,想一眼看到每轮和整段会话的实际花费
- 对比工具调用、推理、读取分析三类操作的花费占比,定位最贵的操作类型
- 长会话后展开交互时间线,缩放查看花费高峰时段和异常请求
适合人员
- 日常使用 DSH 网页端进行开发或 agentic 工作的工程师
- 关注 LLM API 成本、希望按类别优化 token 用量的技术负责人
- 运行多轮 agentic 工作流、需要事后核算各操作类型花费的团队