探索包含 image 主题特性的所有开源仓库、扩展插件与智能体组件。
兼容多模态数据接入,支持文本、图像等不同类型的输入输出处理,可无缝对接主流MCP服务框架,无需复杂配置即可快速扩展模型能力边界,部署使用门槛低。
生态图像生成插件,可为无原生图像处理能力的agent补全图像生成能力,部署轻量接入便捷,调用后可直接输出符合需求的图像,无需额外适配复杂流程。
直接上传或粘贴图片,自动调用 OpenAI 兼容视觉 API 生成英文描述,随后将描述喂给纯文本模型继续推理。轻量桥接层,让不具备视觉能力的模型也能读懂图片内容。
提供图像描述工具,粘贴图片即自动转译,按会话隔离保存对话记忆与状态胶囊,详情页展示上下文,支持随时回溯与复用。
支持将截图和本地图片经MindSee转成文字,让对话模型能看图作答。安装即可使用,无需额外配置,自动提取图像信息并融入上下文,强化多模态交互。
DeepSeek Harness (DSH) native plugin — describe_image tool: a vision bridge (image → mimo-v2.5 → text description) over ...
轻量级前端插件,为Markdown渲染和聊天窗口中的图片添加点击缩放灯箱。点击缩略图即弹出遮罩层显示原图,支持滚轮缩放、左右切换、ESC关闭,事件回调可自定义,零依赖,轻松集成到现有页面。
支持将粘贴的图片自动上传至任意OpenAI兼容视觉端点,识别为文字后回传给文本模型,零改动即可让模型看懂截图、图表和照片,操作丝滑。
轻量级视觉插件,融合图像理解与光学字符识别能力,自动提取图片中的文字、物体与场景,输出结构化结果,接口简洁,调用灵活,可顺畅集成至智能体工作流。
聊天输入框支持图片粘贴直发,无需手动指定路径;纯文本模型可调用视觉技能识图,多模态模型原生直通,零技能绑定零配置。
支持本地图片、网页图片和AI生成图片直接发送到对话窗口,免去下载再上传的繁琐步骤。轻点即达,让分享视觉内容像发文字一样自然。
内置识图工具,自动解析聊天图片并转为文本描述,供纯文本模型理解。安装后一条命令即可启用,无需额外配置,让不支持视觉的模型也能顺畅处理图片对话。