标签主题词 (Topic)

# image

探索包含 image 主题特性的所有开源仓库、扩展插件与智能体组件。

PicGo
Molunerfinn

提供多平台适配与多图床兼容的图片上传服务,原生对接Obsidian、Typora、VS Code等60余款主流工具,兼容S3、阿里云OSS、Imgur等60余种图床,拖拽即可完成上传并自动生成对应格式链接,无需手动复制跳转。

tongflow
tong-io

TongFlow — multimodal workflow studio and engine (canvas + Python plugin engine) and dsh-tongflow, the DeepSeek Harness ...

聊天输入框支持图片粘贴直发,无需手动指定路径;纯文本模型可调用视觉技能识图,多模态模型原生直通,零技能绑定零配置。

直接上传或粘贴图片,自动调用 OpenAI 兼容视觉 API 生成英文描述,随后将描述喂给纯文本模型继续推理。轻量桥接层,让不具备视觉能力的模型也能读懂图片内容。

dsh-vision-bridge
Xieweikang123

支持将粘贴的图片自动上传至任意OpenAI兼容视觉端点,识别为文字后回传给文本模型,零改动即可让模型看懂截图、图表和照片,操作丝滑。

dsh-vision-skill
DDDFXYqiming

轻量级视觉插件,融合图像理解与光学字符识别能力,自动提取图片中的文字、物体与场景,输出结构化结果,接口简洁,调用灵活,可顺畅集成至智能体工作流。

图片附件自动降级插件,实现超限图片自动压缩适配,提供2000px边长、3.

零依赖纯客户端运行,支持聊天输入框图片上传、区域截图操作,可注入草稿图片轨道,依托Electron desktopCapturer实现本地截屏,无需后端服务,操作流畅无额外负担。

支持给纯文本模型新增视觉识别能力,采用类Codex聊天框拖拽交互,用户上传的图片会自动分流至已配置的视觉模型转文字,v4版本无需切换模型即可直接完成识图,操作流畅便捷。

dsh-Sight
cransmathenia666-hash

给纯文本dsh代理赋予视觉能力,粘贴的图片会自动转换为文本描述,依托持久缓存机制,每张图片仅需转换一次即可复用,无需重复处理,降低视觉能力接入成本。

easy-vision
Koreyer

轻量插件可自动识别本地图像真实格式,调用OpenAI兼容视觉模型生成详细文本描述,让纯文本智能体快速获得图像内容理解能力,无需额外复杂配置。

mimo-vision
wulusai2333

DeepSeek Harness (DSH) native plugin — describe_image tool: a vision bridge (image → mimo-v2.5 → text description) over ...