纯文本模型的像素到文本图像读取
jing-hy/picturereader · 技能
DSH 插件:纯文本模型的像素到文本图像读取。
★ 37GitHub 星标
4分支
2026-08-24最近更新
JavaScript开发语言
MIT许可证
主要功能
- Proxy 原位包装对被勾选的模型所属 provider,用 Proxy 把其 adapter 包装成「孪生」并原位替换(registerTwinAdapters,卸载经 ctx.effect 还原),不重复注册。
- 每次看图,模型面对的问题其实是同一个「这张图,值得花什么成本、用哪条路线读懂它?
- 隐私模式(Privacy)——零外呼硬门禁
- 智能/严谨模式在需要且已配置时才走外部语义理解。
- stream 拦截捕获请求里的 image block → 导出到 /.dsh/picturereader-vision/images/ → 替换成文本路径 + 本地工具链引导 → 转发给原始 adapter。
使用条件
- DSH 的 tools 呈现有三种 modenative(默认,模型可直呼所有工具)、code(只允许模型直呼 run_code,其它工具折叠进 run_code 的生成 SDK 内调用)、both(两种都能用)。
- picturereader 所有工具与 mode 无关native / both 下全部可直呼
安装命令
dsh plugin --profile web add github:jing-hy/picturereader