DSH Plugins
返回列表
🤖

model-catalog

模型推理 更新于 2026.08.25

在终端中运行以下命令:

dsh plugin install JohnXu22786/model-catalog

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 终端中执行 dsh plugin install JohnXu22786/model-catalog 即可安装该插件,源码地址为 https://github.com/JohnXu22786/model-catalog 。

插件介绍

在 dsh 生态中接入一个 OpenAI 兼容主机后,模型清单、按百万 token 计价的输入/输出/缓存价格、上下文长度、是否支持工具调用与结构化输出等信息散落在不同端点,单位也五花八门——美元每 token、倍数配额、按次计费并存。手动翻端点、换算单位、逐项填入配置既费时又容易出错,尤其是换一台网关或加一个本地 Ollama 实例时几乎要重来一遍。model-catalog 要解决的就是这件事:你只配好 baseUrl,它自动完成探测、拉取、归一化和配置生成。

核心能力围绕三条主线展开。第一是主机类型自动识别,覆盖六种形态:标准兼容端点、带丰富元数据的网关、配额倍数计费的中继、能力标志代理、Ollama 以及 vLLM,探测失败时支持手动指定类型。第二是端到端价格归一化,无论源数据是美元每 token 字符串、科学计数法数值、倍数×基准价还是按次计费,最终都统一为 USD/百万 token,来源链路可追溯,DeepSeek 官方的峰谷动态定价也以结构化 tier 形式保留。第三是可选的能力实时探测,对元数据中缺失的工具调用、结构化输出、流式支持发送极小请求实测,结果按主机和模型缓存 24 小时,401/403 时自动中止以保护配额。

最终产出三份文件:catalog.json 完整目录、dsh-models.json 可直接交给 harness 的配置片段、report.md 人类可读报告(含未知价格列表与动态定价说明)。适合已经在 dsh 中接入多家 API 供应商、中继网关或本地推理服务,希望一次性拿到干净、可审计模型配置,而不是逐字段手抄的开发者。

使用场景

  • 接入多家 OpenAI 兼容网关后一次性拉取完整模型目录与参数
  • 将配额倍数、按次计费等异构价格统一换算为美元每百万 token
  • 为零配置成本自动生成可直接交给 dsh harness 消费的模型配置

适合人员

  • 已在 dsh 中接入多家 API 供应商或本地推理服务的开发者
  • 需要跨网关统一管理模型价格与能力参数的平台运维者
  • 希望消除逐字段手抄、减少重复配置工作的 AI 应用开发者