dsh-tool-vision
在终端中运行以下命令:
dsh plugin install gloryxpnv/dsh-tool-vision
将以下提示词粘贴到 DeepSeek Harness 对话框中:
要在 DeepSeek Harness 中安装此插件,请执行命令 dsh plugin install gloryxpnv/dsh-tool-vision。源码地址:https://github.com/gloryxpnv/dsh-tool-vision
插件介绍
许多强大的语言模型(如 DeepSeek 和 GLM)本质上是纯文本的,无法直接理解图像内容。这不仅限制了它们在视觉任务中的应用,也带来了隐私和成本的顾虑。如果你需要在本地运行视觉语言模型,但又受限于只能使用文本模型,那么这个插件正是为你量身定制的解决方案。
dsh-tool-vision 能够让你的纯文本模型瞬间获得"视觉"能力。它通过连接你本地运行的视觉语言模型(如 LM Studio 或 Ollama),实现了零 API 成本和完全的本地化推理。最令人称道的是,它不仅仅返回模糊的描述,而是强制要求输出结构化的 JSON 证据,包括摘要、OCR 文本、版面布局和语义关系。这种设计不仅提高了信息提取的准确性,还内置了反幻觉机制,通过显式的不确定项列表来避免模型凭空捏造。
无论你是注重隐私的数据分析师,还是需要在本地工作站上处理敏感文档的研究人员,这个插件都能大显身手。它特别适合那些需要从截图、文档图片或图表中提取精确结构化数据的场景。通过简单的配置,你就可以让模型像专家一样阅读并分析图片,而无需将任何数据上传到云端。
使用场景
- 从本地截图提取结构化数据
- 在不离开机器的情况下分析文档图片
- 使用文本模型进行 OCR 和版面分析
适合人员
- 注重隐私的开发者和研究人员
- 需要从图片中提取数据的分析师
- 在本地工作站运行 AI 的用户