探索包含 qwen-vl 主题特性的所有开源仓库、扩展插件与智能体组件。
内置11类主流视觉模型预设,支持OpenAI兼容视觉模型快速接入智能体,可勾选对应能力项自动注入实时提示词,无需复杂配置即可高效扩展视觉能力。
作为轻量级视觉桥接工具,可在无内置视觉能力的模型接收图像时自动调用视觉模型完成内容识别,无需额外配置,部署便捷,可无缝接入现有大模型调用流程
轻量级插件为编码模型
为纯文本模型添加视觉通道,自动判断前端实现是否匹配设计稿,内置多组基准测试量化判定准确率,一键运行生成结构化报告。
轻量级视觉桥,自动将贴图经LLM/Stream转为VL文字描述,消除内容不支持报错;内置view_image/ocr_image视觉工具,原生多模态路由自动跳过,零依赖。
轻量级插件,借助兼容OpenAI的视觉语言模型端点,自动把图片转成文字描述,让纯文本模型获得看图能力。无需训练,配置好端点即可直接调用。
轻量级视觉语言网关插件,直接粘贴图像即可自动识别并输出文本。依托多模态模型,实现视觉内容到文本的无缝转换,操作简单,即贴即用。
MCP视觉服务器,为纯文本LLM与AI代理提供图像理解、OCR、视觉分析及UI检查能力。通过标准MCP协议无缝集成,让现有模型直接获得多模态视觉,无需额外训练。