Tesseract 在本地 OCR 附加图像
maxwell-feng/dsh-tesseract-ocr · 模型适配
dsh 插件:使用 Tesseract 在本地 OCR 附加图像 — 纯文本模型可以看到,隐私优先
★ 5GitHub 星标
1分支
2026-09-04最近更新
JavaScript开发语言
MIT许可证
主要功能
- dsh 的 skill 只是注入模型上下文的 Markdown 指令:不能执行代码、不能钩住请求管线、更拦不住图片被序列化上传。
- 这个功能恰好需要这些,所以它是一个 cordis 插件,钩住 llm 服务的两个公开接缝(与 windows-ocr 同一设计)
- 在文本模型会话里附加一张图片并发送——模型应能引用识别出的文字作答。
- 识别质量取决于已装语言包和 psm
- 能力声明(shim)——包装 ctx.llm.resolveModelInfo(以及 listModels)。
使用条件
- dsh web 报端口占用(EADDRINUSE)说明有旧实例在跑:ss -ltnp · grep 3080 找到进程并停止后再启动。
- 打包分发(npm / tarball / githubuser/repo)时按组合包方式打包(dsh.bundle + cordis.patch.yml,见 docs/user/develop/basic/publish)
安装命令
dsh plugin --profile web add github:maxwell-feng/dsh-tesseract-ocr