dsh-vision-lmstudio
by tiankundai
DSH(DeepSeek Harness)Web GUI 的本地 LM Studio 视觉识别插件——用本地视觉模型识别、描述并 OCR 本地图片或剪贴板截图
Local LM Studio vision recognition plugin for the DSH (DeepSeek Harness) Web GUI — recognize, describe, and OCR local images or clipboard screenshots with a local vision model.…
安装
dsh plugin --profile web add github:tiankundai/dsh-vision-lmstudioGitHub 源码安装:首次需按提示配置 allowBuilds 构建授权后重试
安装与环境配置指引、插件开发教程见 DSH 中文社区文档 ↗
安装即在你的机器上以你的权限运行第三方代码——它可读写文件、使用凭据、访问网络,DSH 的工具审批不会为插件代码加沙箱。「检测到 manifest」仅代表发现 dsh.bundle / dsh.plugin 清单,不构成兼容性或安全审查;安装前请审阅源码,不熟悉的插件先在不含密钥的环境试用。
README
English | 中文
为 DSH(DeepSeek Harness)Web GUI 提供本地 LM Studio 视觉识别插件:连接
LM Studio 的 OpenAI 兼容接口(默认 http://127.0.0.1:1234),
调用其视觉模型对本地图片与 Windows 剪贴板图片做识别、描述与 OCR。所有推理都在本机完成,
图片不会离开本机。
功能
- Agent 工具(host 半区注册,任何会话可用)
lmstudio_vision— 按绝对路径识别本地图片文件lmstudio_clipboard— 直接识别剪贴板中的图片(截图 / 复制后),无需文件路径lmstudio_models— 列出已加载模型并标注最后加载的一个(自动选择)
- 设置页面板:「设置 → LM Studio 视觉识别」— 配置服务地址 / 模型 / 默认提示词 / 温度 / 最大 Token,刷新模型列表,一键识别本地图片或剪贴板图片
- 模型自动选择 — 省略
model时自动使用当前已加载模型中最后加载的那个 (即服务器模型列表的第一个;通过原生/api/v0/models按state过滤,JIT 下 未加载的模型不会混入),不预设任何具体模型 - 配置持久化 —
~/.dsh/dsh-lmstudio-vision.json(原子写入),设置面板与 agent 工具共用
环境要求
- 带 web profile 的 DSH(DeepSeek Harness)
- LM Studio:已加载视觉模型并启动本地服务 (Developer → Start Server,默认端口 1234)
- 剪贴板工具需要 Windows(使用 Windows PowerShell 5.1
Get-Clipboard -Format Image)
安装
pnpm install
pnpm build
dsh plugin --profile web add link:<本仓库路径>/packages/dsh-lmstudio-vision
然后重启 DSH(dsh web)并刷新页面。dsh plugin 会自动把包加入
dsh.profile.bundles(本包声明了 dsh.bundle)。安装后设置页会出现
「LM Studio 视觉识别」面板,三个 agent 工具随宿主常驻,任何会话都可用。
配置
可在设置面板中修改,或直接编辑 ~/.dsh/dsh-lmstudio-vision.json:
{
"baseUrl": "http://127.0.0.1:1234",
"model": "",
"prompt": "请详细描述这张图片的内容。",
"temperature": 0.2,
"maxTokens": 1024
}
model 留空表示自动使用最后加载的模型;填写具体模型 ID 则手动指定。
仓库结构
packages/dsh-lmstudio-vision/src/index.ts— host 半区:LM Studio engine、API 路由、 agent 工具、system-prompt 公告packages/dsh-lmstudio-vision/src/client/— browser 半区:设置页面板packages/dsh-lmstudio-vision/cordis.patch.yml— bundle patch 插件行shared/tsdown.client.ts— 构建预设(遵循 dsh-web-ui 的clientBundle约定)
许可证
原始 README: https://github.com/TiankunDai/dsh-vision-LMstudio/blob/main/README.zh.md ↗
同类插件
查看全部 →
modlens
为纯文本模型架起视觉桥梁:粘贴图片,输出结构化 JSON 证据(OCR、版面、语义)。

dsh-vision-toolkit
让纯文本模型更好地做视觉任务:带意图的图片问答、长截图 OCR、UI 还原等。

dsh-vision-router
为纯文本 Agent 提供视觉能力:内置免 Key 视觉链 + 像素级视觉工具(看图问答、定位、裁剪、像素对比、取色、OCR、矢量化、抠图、截图);粘贴图片即可用。

dsh-vision-complete
给 DeepSeek 补上「眼睛和耳朵」的多模态视觉插件:看图 / OCR / 物体检测 / 视频理解 / 语音转写 / 截图直读,一键安装(DSH 插件)。

dsh-media-skills
面向纯文本模型的免费视觉桥与生图:粘贴读图、GLM-4V-Flash 与 Gemini 引擎故障转移、modlens 同款结构化证据输出,并自动播种免费视觉模型路由。

dsh-vision-opencode
给纯文本主模型加可配置识图模型:vision_read_image 工具、输入框识图模型选择器,以及纯文本路由的图片自动转文字。