DSH Plugins
返回列表
🤖

dsh-sleev

模型推理 更新于 2026.08.28

在终端中运行以下命令:

dsh plugin install xarleyn/dsh-sleev

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在终端运行 dsh plugin install xarleyn/dsh-sleev 即可安装,插件源码位于 https://github.com/xarleyn/dsh-sleev 。

插件介绍

通过 Sleev 网关为模型推理路由启用上下文优化后,一个常见的盲区是:流跑通了,但每次调用究竟消耗了多少 effective input token、哪些属于 agent 推理、哪些只是 session-title 生成,始终缺少一个不介入链路的轻量观测视角。dsh-sleev 正是为此而生——它不改写 prompt、不执行压缩、不代理转发,只在 llm/stream 边界安静地记录匹配路由的调用元数据。

核心能力包括:按精确别名或前缀(默认 sleev-)匹配观测路由;将每次调用分类为 agent、compaction、session-title 或 one-shot;逐 chunk 透传流内容不做任何修改;记录 provider usage 与 effective input token 量;维护一段有界的无密钥内存历史;每次观测调用输出一条结构化 completion 记录;所有观测参数(匹配规则、保留条数、日志级别)均可在 Settings > Plugins 页面实时编辑,保存后对下一次匹配调用即生效,无需重启 Host。

适合已经配好 Sleev 路由、想量化验证上下文压缩是否真的降低了 token 开销的 DeepSeek Harness 用户,以及需要区分 agent / compaction / one-shot 调用成本来做归因分析的小团队。它不承诺节省 token,只负责把省了多少这件事看得清清楚楚。

使用场景

  • 配置 Sleev 路由后,观测每次调用的 effective input token 开销
  • 区分 agent、compaction、one-shot 调用类型,做成本归因分析
  • 在 Web UI 中实时调整匹配前缀和日志级别,保存即生效,无需重启 Host

适合人员

  • 已接入 Sleev 网关、想量化验证上下文压缩效果的 DeepSeek Harness 用户
  • 需要按调用类型拆分 token 成本做归因的小团队
  • 希望在不改动推理链路的前提下获取轻量遥测数据的开发者