dsh-model-modes
在终端中运行以下命令:
dsh plugin install DTSFO/dsh-model-modes
将以下提示词粘贴到 DeepSeek Harness 对话框中:
要在 DeepSeek Harness 中安装该插件,请运行命令:dsh plugin install DTSFO/dsh-model-modes,源码地址为:https://github.com/DTSFO/dsh-model-modes
插件介绍
在使用 DeepSeek Harness (DSH) web composer 进行模型推理时,开发者常常面临在多个 AI 提供商间灵活切换 Fast 模式以优化速度,同时保持推理配置精细控制的挑战。dsh-model-modes 插件通过提供感知能力的推理配置文件和 provider-native Fast 模式,解决了这一问题。它自动将 Fast 模式与推理正交处理,在不改变模型或降低推理质量的前提下,应用提供商原生的快速请求参数,如 OpenAI 的 service_tier 或 Google 的 config.serviceTier,从而简化多提供商环境下的性能优化。
插件的核心能力在于智能适配不同提供商的 Fast 模式契约,支持 Max 和 Ultra 作为独立推理级别,并确保 Fast 开关仅影响请求传输层,不干扰推理设置。它还跟踪官方模型目录,防止无效路由,同时提供清晰的 UI 集成,让用户在 composer 中直接切换 Fast ON/OFF。这种设计使得 Fast 模式与推理配置解耦,适用于需要高效推理和精细控制的场景,如实时应用、批量处理或成本敏感的任务。
这个插件特别适合使用 DeepSeek Harness 进行模型推理的开发者、AI 工程师和研究者,尤其是那些依赖多提供商(如 OpenAI、Google、xAI)并需要快速、可靠切换 Fast 模式的用户。它帮助用户简化配置流程,避免手动调整模型或提供商,从而专注于核心 AI 应用开发,提升工作效率和推理性能。
使用场景
- 在多提供商AI环境中优化推理速度。
- 精细控制推理级别与Fast模式切换。
- 简化DeepSeek Harness中的Fast模式配置。
适合人员
- 使用DeepSeek Harness的AI开发者。
- 需要多提供商Fast模式支持的研究者。
- 追求推理效率优化的工程师。