dsh-vision-paste
by hel10o
DSH 插件:把图片粘贴进聊天即变成模型可用的文件路径
DSH plugin: paste an image into the chat and it becomes a file path the model ha
安装
dsh plugin --profile web add github:hel10o/dsh-vision-pasteGitHub 源码安装:首次需按提示配置 allowBuilds 构建授权后重试
安装与环境配置指引、插件开发教程见 DSH 中文社区文档 ↗
安装即在你的机器上以你的权限运行第三方代码——它可读写文件、使用凭据、访问网络,DSH 的工具审批不会为插件代码加沙箱。「检测到 manifest」仅代表发现 dsh.bundle / dsh.plugin 清单,不构成兼容性或安全审查;安装前请审阅源码,不熟悉的插件先在不含密钥的环境试用。
README
DSH 插件:让「粘贴图片」变成「粘贴路径」,配合 vision-bridge-mcp 给纯文本模型加识图能力。
组成(一个包,两个半)
- host 半(lib/index.js):注册
POST /vision-paste路由,接收浏览器发来的图片字节,校验 PNG/JPEG/WebP/GIF,存入本地目录(默认~/.zcode/cli/image-cache,由os.homedir()推导,vision-bridge 的latest约定能直接找到),返回绝对路径。 - client 半(lib/client.js):捕获聊天框的图片粘贴事件,调上面的接口,把
识别这张图:<路径>插入输入框并弹缩略图提示。
配置(可选,写在插件行 config 里)
saveDir:图片保存目录,默认<家目录>/.zcode/cli/image-cachemaxBytes:单张上限,默认 26214400(25MB)
安装(DSH ≥ 0.1.0-rc.6)
dsh plugin --profile web add dsh-vision-paste
# 或本地源码: dsh plugin --profile web add file:D:/path/to/dsh-vision-paste
在 ~/.dsh/profiles/web/cordis.patch.yml 的 insert 列表加入:
- id: vision-paste
name: 'dsh-vision-paste'
config:
saveDir: 'C:/Users/你/.dsh/vision-bridge/image-cache' # 可选,默认 ~/.zcode/cli/image-cache
# 同时接入 vision-bridge MCP(API Key 自备):
- id: mcp-vision-bridge
name: '@deepseek-ai/dsh-mcp-client'
config:
serverName: vision-bridge
transport: stdio
command: node
args: ['--use-env-proxy', 'C:/path/to/vision-bridge-mcp/server.js']
cwd: 'C:/path/to/vision-bridge-mcp'
env:
VISION_API_KEY: '<你的Key>'
VISION_API_BASE: 'https://wawapii.com/v1' # 任意 OpenAI 兼容视觉端点
VISION_MODEL: 'gemini-3.5-flash'
VISION_API_STYLE: openai
# 代理按需删除
HTTPS_PROXY: 'http://127.0.0.1:7897'
HTTP_PROXY: 'http://127.0.0.1:7897'
NO_PROXY: 'localhost,127.0.0.1'
toolCallTimeoutMs: 90000
failOnStartupError: true
重启 dsh web 生效。聊天框里 Ctrl+V 粘贴截图 → 输入框自动出现文件路径 → 发送 → 模型调用 mcp__vision-bridge__ocr_image 识图。
更新
pnpm 会把本包复制进 ~/.dsh/profiles/web/node_modules/dsh-vision-paste(不是符号链接),修改源码后需重新同步:
dsh plugin --profile web add dsh-vision-paste
改的是 client 半(lib/client.js)时,同步后在浏览器按 Ctrl+F5 强制刷新即可;改的是 host 半(lib/index.js)时需重启 dsh web。
适用说明
- 适配 DSH
0.1.0-rc.6的 client 插件 API(ctx.effect),DSH 升级前先验证; - 主模型为纯文本模型(不声明图片输入)时收益最大;模型本身支持图片的部署可以跳过本插件直接传图。
原始 README: https://github.com/Hel10o/dsh-vision-paste/blob/master/README.md ↗
同类插件
查看全部 →
modlens
为纯文本模型架起视觉桥梁:粘贴图片,输出结构化 JSON 证据(OCR、版面、语义)。

dsh-vision-toolkit
让纯文本模型更好地做视觉任务:带意图的图片问答、长截图 OCR、UI 还原等。

dsh-vision-router
为纯文本 Agent 提供视觉能力:内置免 Key 视觉链 + 像素级视觉工具(看图问答、定位、裁剪、像素对比、取色、OCR、矢量化、抠图、截图);粘贴图片即可用。

dsh-vision-complete
给 DeepSeek 补上「眼睛和耳朵」的多模态视觉插件:看图 / OCR / 物体检测 / 视频理解 / 语音转写 / 截图直读,一键安装(DSH 插件)。

dsh-media-skills
面向纯文本模型的免费视觉桥与生图:粘贴读图、GLM-4V-Flash 与 Gemini 引擎故障转移、modlens 同款结构化证据输出,并自动播种免费视觉模型路由。

dsh-vision-opencode
给纯文本主模型加可配置识图模型:vision_read_image 工具、输入框识图模型选择器,以及纯文本路由的图片自动转文字。