Native OCR plug-in
CraZY222123/dsh-ocr-plugin · model-adapters
GitHub repository for the DeepSeek Harness ecosystem.
★ 8GitHub stars
0Forks
2026-08-16Last updated
PythonLanguage
MITLicense
Project overview
给 DeepSeek Harness 加"眼睛"的本地 OCR 插件: 让纯文本模型真正看到图片内容——截图、发票、表格、扫描件、多栏文档,全部本地识别,不依赖任何云 OCR。 背景:DeepSeek API 当前不接收图片输入,对话里发图只能看到"这是一个图片附件"。 本插件在消息序列化时把图片本地 OCR 成文本再发给模型,图片从此可被理解。 快速通道秒级出结果(rapidocr),深度通道用 DeepSeek-OCR-2 做版面级解析。 ⚠️ 平台兼容性(先看这里)
1. 把 package.json、lib/、tools/ 复制到 /.dsh/profiles/nodemodules/@deepseek-ai/dsh-ocr/(flat-fallback 解析)。 2. 在 /.dsh/profiles/web/cordis.patch.yml 追加:
1. 打开你自己的 DSH Web 界面,新建一个会话; 2. 把图片拖进输入框(或点附件按钮选择图片;若装了 tools/paste-image-plugin.json,也可以直接 Ctrl+V 粘贴截图); 3. 正常发送消息,模型就能"看到"图片内容了——可以问"这张图里有什么"、"把表格转成 Markdown"、"提取发票上的字段"等。
Install command
dsh plugin --profile web add github:CraZY222123/dsh-ocr-plugin