dsh-thinking-token-stat
在终端中运行以下命令:
dsh plugin install Six6stRINgs/dsh-thinking-token-stat
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 终端中执行 dsh plugin install Six6stRINgs/dsh-thinking-token-stat 即可安装该插件,源码位于 https://github.com/Six6stRINgs/dsh-thinking-token-stat 。
插件介绍
DSH 的回复面板只能逐轮报告 reasoning token 计数,而不同模型供应商对思考 token 的报告方式差异很大:有的直接给出数值,有的只回传思考文本,有的则完全不提供。当你跑完一整段多轮对话,想回顾总体的思考开销和推理占比时,缺乏一个会话级的汇总视图。dsh-thinking-token-stat 正是为此设计:它在消息框下方的统计栏中增加一个可点击的思考 token 总量指标,并展开一个详情面板,展示推理输出占全部输出的比例、占所有计费 token 的比例、实际思考的轮数,以及哪些数值是估算而非报告所得。
点击统计栏中的数字后,详情面板以清晰分行列出各项指标;底部再进入逐轮表格,按最新优先展示每一轮的 thinking token、该轮全部输出、数值来源、实际运行的模型,以及 thinking 占该轮输出的份额。表格支持三个筛选开关,分页渲染每页 100 轮,每行末尾的跳转按钮可直接定位到对话中对应的回复。对于供应商未报告计数的场景,插件按字符密度对思考文本进行估算,所有估算值都带有波浪线标记,并附可展开的说明。
在技术层面,插件采用 host 端一次性折叠会话事件日志并注册为 DSH session projection 的方式,确保数值覆盖整段会话、不受窗口滑动或 compaction 影响,且刷新后保持一致。浏览器端仅读取该投影值进行渲染,不发起任何网络请求、不写入本地存储、不维护任何插件级状态。如果你希望在不改动对话、不额外请求数据的前提下,获得一段对话完整的思考 token 账本,这个插件提供了最轻量的路径。
截图预览
使用场景
- 跑完长对话后查看整段思考 token 总开销
- 对比不同模型的推理输出占全部输出的比例
- 定位哪些轮次缺少 provider 报告的 reasoning token 计数
适合人员
- 使用 DSH 日常对话并希望追踪思考开销的用户
- 需要横向评估不同模型推理效率的开发者
- 要求插件零网络请求和零本地存储的隐私敏感用户