探索包含 describe-image 主题特性的所有开源仓库、扩展插件与智能体组件。
支持将截图和本地图片经MindSee转成文字,让对话模型能看图作答。安装即可使用,无需额外配置,自动提取图像信息并融入上下文,强化多模态交互。
轻量级插件,借助兼容OpenAI的视觉语言模型端点,自动把图片转成文字描述,让纯文本模型获得看图能力。无需训练,配置好端点即可直接调用。