DSH 原生图像理解
oil-oil/dsh-vision · 技能
DeepSeek Harness 的近乎原生图像理解
★ 30GitHub 星标
2分支
2026-08-15最近更新
TypeScript开发语言
MIT许可证
项目简介
dsh-vision 是一个 DeepSeek Harness 插件。它让支持图片的模型继续使用原生视觉;当主模型只有文本能力时,自动调用外部视觉模型观察原图,再由原来的 DeepSeek 模型完成回答。 它怎么工作 当前主模型 · 图片处理方式 · 最终回答者 当前主模型: 支持图片 · 图片处理方式: 原图直接发送,不压缩、不预先 OCR · 最终回答者: 当前模型 当前主模型: deepseek-official 等文本模型 · 图片处理方式: 外部视觉模型读取原图,观察结果作为非可信附件上下文注入 · 最终回答者: DeepSeek 当前主模型: 云端视觉不可用 · 图片处理方式: macOS Vision 或 Tesseract 本地降级 · 最终回答者: DeepSeek
重启 Harness 后即可正常粘贴或拖入图片。插件会替换官方 deepseek-official 适配器,但继续使用原有模型列表、DeepSeek 设置和凭据,并在「设置 → 插件 → 插件配置」中新增「视觉识别」卡片。 DeepSeek Harness 仍处于 Developer Preview。当前版本固定兼容 0.1.0-rc.6。 配置视觉识别
打开「设置 → 插件 → 插件配置 → 视觉识别」,选择 ZenMux、百炼、TokenDance 或 OpenRouter,然后填写对应的 API Key。同一张卡片还可以修改模型 ID、API 地址和单次图片上限。
安装命令
dsh plugin --profile web add github:oil-oil/dsh-vision