dsh-llm-ollama
在终端中运行以下命令:
dsh plugin install 1035041186/dsh-llm-ollama
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness web profile 下执行 dsh plugin install 1035041186/dsh-llm-ollama,插件源码见 https://github.com/1035041186/dsh-llm-ollama,安装后 bundle 补丁会自动把 llm-ollama 插件挂入组合树,刷新页面即可在设置中看到 Ollama 选项。
插件介绍
如果你在本地或容器里跑着 Ollama,却希望把对话流程接进 DeepSeek Harness(dsh),dsh-llm-ollama 就是那座桥。它不经过任何 OpenAI 兼容中间层,直接走 Ollama 原生 /api/chat NDJSON 流式协议,将 num_ctx、num_predict、keep_alive、temperature 等专有参数原封不动透传——设置页填多少,请求体就是多少,不存在映射丢失或参数截断。模型发现也是一键完成:插件调用 GET /api/tags 把服务器上已拉取的全部模型拉进弹窗,勾选即入目录;本地 ollama serve 还是远端容器,配置方式完全一致,只是 API 地址换一下。对推理型模型(Qwen3、DeepSeek-R1/v3.1、GPT-OSS 等),插件在后台按 /api/tags 返回的 capabilities 自动判断是否露出「推理等级」菜单:布尔 think 模型给 On/Off 开关,多档模型可切 levels 并预设默认档位;判断不准时还能手动覆盖,且不阻塞模型选择器加载。流式响应中的 message.thinking 轨迹会被渲染为可读推理块,工具调用与图片附件走原生通道。想在某次会话临时把上下文从 32K 拉到 128K?输入 /ollama-context 调出面板,覆盖值只作用于当前会话,关掉即回默认。插件以 bundle 补丁自动挂入 profile 组合树,装完即用。
适合本地跑 Ollama 的个人开发者、需要自托管 LLM 的团队,以及任何希望在 dsh 里精细调控上下文窗口、推理等级、模型驻留时间而不想被兼容端点束缚的人。
使用场景
- 本地 ollama serve 启动后在 dsh 设置页一键导入全部模型并流式对话
- 远程部署 Ollama 容器,通过原生协议精确透传 num_ctx、keep_alive、temperature 等参数
- 输入 /ollama-context 临时将当前会话上下文窗口调到 128K,关闭后自动回落到模型默认值
适合人员
- 本地跑 Ollama、希望绕过 OpenAI 兼容层直接控制专有参数的独立开发者
- 需要自托管 LLM 容器且要求参数精确可控的工程团队
- 想在 dsh 中使用 Qwen3、DeepSeek-R1 等开源推理模型并看到可读推理过程的终端用户