dsh-composer-tokens
在终端中运行以下命令:
dsh plugin install wbycloud/dsh-composer-tokens
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 终端中执行 dsh plugin install wbycloud/dsh-composer-tokens 即可完成安装,插件完整源码位于 https://github.com/wbycloud/dsh-composer-tokens
插件介绍
当你在 DeepSeek Harness 的 Web 界面里反复调试提示词、挂载工具定义、引用技能文件时,一个始终悬在头顶的问题是:这条消息到底要吃掉多少 token?上下文窗口还剩多少余量?固定开销(系统提示词 + 工具声明)又占了几成?dsh-composer-tokens 就是为回答这些问题而生的纯客户端插件,它在你输入框的最右侧挂上一枚实时徽标,无需任何服务端支持,打开即可用。
展开来看,这枚徽标背后是一套分层的 token 计量体系:它优先用与官方 tokenizer 完全对齐的精确引擎(支持 DeepSeek-V3、o200k、cl100k 三套词表)计算基线,草稿部分以 250 ms 防抖增量刷新;精确引擎不可用时则自动回退到与 DeepSeek 官方 token-meter 同口径的启发式估算,并用波浪号标记区分。悬停或键盘聚焦后,Tooltip 会列出基线来源、技能引用增量、消息帧常数、本次请求预计总 token、上下文占用率、会话累计真实 usage 四桶明细,以及输入缓存命中率——让你对每一次请求的成本结构一目了然。颜色还会随总量分级,接近窗口上限时徽标背景与边框同步转红,无需展开就能感知压力。
如果你每天在 Harness 里写长提示、调试多轮对话、或者在多个模型之间切换,dsh-composer-tokens 能让你把「感觉快满了」变成「还剩 12 % 余量」,把「这次缓存命中了吗」变成一条可量化的命中率数字。它不改变任何请求行为,只是在客户端多看了一眼账本。
使用场景
- 调试长提示词或多轮对话时,实时查看当前请求预计消耗与窗口剩余余量
- 跟踪整段会话的累计 token 消耗、固定开销占比和输入缓存命中率
- 切换模型后确认基线口径是否自动校准,避免对上下文占用产生误判
适合人员
- 在 DeepSeek Harness Web GUI 中编写和调试提示词的工程师
- 需要量化上下文窗口占用、为多工具场景做成本预算的 AI 应用开发者
- 频繁切换模型或挂载技能文件、对 token 口径敏感的重度 Harness 用户