DSH Plugins
返回列表
🖥️

dsh-response-meta

客户端 更新于 2026.08.25

在终端中运行以下命令:

dsh plugin install Unintendedz/dsh-response-meta

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在终端中执行 dsh plugin install Unintendedz/dsh-response-meta,安装后重启 DSH Web 服务即可生效,插件源码位于 https://github.com/Unintendedz/dsh-response-meta 。

插件介绍

DSH Web 中每次模型回复的运行时指标——模型名、推理量、tokens/s、首 token 延迟、总耗时——原本藏在 hover 才展开的原生 timing 组里,手动中断或推理中途停止的回复则完全没有 usage 记录。想快速判断一次调用的实际表现,往往需要反复悬停、甚至无法查看。

dsh-response-meta 在每条助手回复的固定第二行始终渲染一条运行时摘要,同时覆盖已完成和已中断两种情况。模型名从会话 header 事件读取并在无新 header 的后续轮次自动继承;推理量优先取 provider 报告的 reasoning tokens,回退到推理文本长度;tokens/s 按 DSH 原生语义从首 token 到消息完成计算。中断回复因通常缺少 usage 记录,插件会展示已获取的模型名与流式推理量,若 finalization 竞态提供了真实数据则一并保留。所有字段缺失时逐条省略,全部缺失则不渲染任何内容,窄屏自动换行、无横向溢出。

适合频繁在多个模型间切换、关注首 token 延迟与推理深度、或经常手动中断生成流程的 DSH Web 日常用户,无需额外配置即可让每次回复的关键指标一目了然。

使用场景

  • 快速查看每次调用的实际耗时、推理深度与 tokens/s。
  • 中断生成后仍能确认所用模型及已流式输出的推理量。
  • 多模型对比时直观比较 TTFT 与吞吐速率。

适合人员

  • 频繁切换模型、关注首 token 延迟的 DSH Web 日常用户。
  • 经常手动中断生成、需要确认中断时刻状态的开发者。
  • 希望量化每次调用性能以便调优的 Prompt 工程师。