dsh-vision-opencode
在终端中运行以下命令:
dsh plugin install poiuyjie/dsh-vision-opencode
将以下提示词粘贴到 DeepSeek Harness 对话框中:
请在 DeepSeek Harness 中使用插件命令安装 https://github.com/poiuyjie/dsh-vision-opencode,完成后重启 dsh 并在输入框右侧选择识图模型。
插件介绍
很多用户会遇到一个尴尬场景:主聊天模型擅长文字,却不能稳定处理图片;一旦需要识别截图、文档、表格或界面设计,往往只能切换模型或借助外部工具。dsh-vision-opencode 的思路是让识图能力以旁路方式接入现有主模型:当聊天中出现图片时,插件会先把图片交给一个可配置的视觉模型,将图片内容转换为文字,再交给原来的纯文本主模型继续回答。
它的核心能力是“自动识图、手动可控、异常兜底”。输入框右侧可以选择识图模型,设置页也能独立管理视觉模型,并支持 OCR、图表理解、截图分析等场景。对于不想自动转换图片的用户,可以关闭自动转换,只保留识图工具与模型选择能力;对于网络或模型失败的情况,插件会进行超时、重试和降级处理,尽量不拖垮整轮对话。
这个插件适合使用 DeepSeek 或其他纯文本主模型、但经常需要处理图片信息的用户,也适合希望在不更换主模型的前提下获得多模态体验的人。它不是完整的多模态替换方案,而更像一层轻量视觉入口,让原本只能“读文字”的模型也能“先看图、再回答”。
截图预览
使用场景
- 聊天中发送截图,由识图模型先转成文字再回答
- 需要识别文档、表格、图表或界面元素
- 主模型是纯文本模型,但仍需要图片理解能力
适合人员
- 使用 DeepSeek 等纯文本主模型的用户
- 经常需要处理截图、文档和图表的用户
- 希望不更换主模型就能获得识图能力的用户
