仅支持文本的智能体获得看图能力
Koreyer/easy-vision · 模型适配
让仅支持文本的智能体获得"看图"能力 —— 通过任意 OpenAI 兼容视觉模型。
★ 2GitHub 星标
0分支
2026-08-25最近更新
JavaScript开发语言
MIT许可证
主要功能
- 自动识别真实格式 —— 通过魔数(magic bytes)识别 PNG / JPEG / GIF / WebP,即使文件扩展名错误也能正确处理
- 需要一个 OpenAI 兼容 且接受 base64 imageurl data URI 的端点。
- 发送图片 —— 以 base64 data URI 通过 chat completions 发送给你配置的 OpenAI 兼容视觉模型
- 返回文字描述 —— 或可选择直接写入 Markdown 文件,用于 UI 说明文档、设计稿笔记等
安装命令
dsh plugin --profile web add github:Koreyer/easy-vision