智能体视觉工具箱
wangyang10/image-vision · 技能
image-vision 让没有视觉能力的模型(如 DeepSeek 等纯文本模型)也能"看图":自动调用 OpenAI 兼容的识图模型 API(OpenRouter、SiliconFlow、智谱、Kimi、通义千问、 本地 Ollama 等),完成图片描述、问答、OCR 等任务。
★ 7GitHub 星标
0分支
2026-08-14最近更新
JavaScript开发语言
MIT许可证
项目简介
image-vision 让没有视觉能力的模型(如 DeepSeek 等纯文本模型)也能"看图":自动调用 OpenAI 兼容的识图模型 API(OpenRouter、SiliconFlow、智谱、Kimi、通义千问、 本地 Ollama 等),完成图片描述、问答、OCR 等任务。
安装命令
dsh plugin --profile web add github:wangyang10/image-vision