标签主题词 (Topic)

# image

探索包含 image 主题特性的所有开源仓库、扩展插件与智能体组件。

直接上传或粘贴图片,自动调用 OpenAI 兼容视觉 API 生成英文描述,随后将描述喂给纯文本模型继续推理。轻量桥接层,让不具备视觉能力的模型也能读懂图片内容。

dsh-vision-bridge
Xieweikang123

支持将粘贴的图片自动上传至任意OpenAI兼容视觉端点,识别为文字后回传给文本模型,零改动即可让模型看懂截图、图表和照片,操作丝滑。

支持给纯文本模型新增视觉识别能力,采用类Codex聊天框拖拽交互,用户上传的图片会自动分流至已配置的视觉模型转文字,v4版本无需切换模型即可直接完成识图,操作流畅便捷。

dsh-imagegen
glangzh

生态图像生成插件,可为无原生图像处理能力的agent补全图像生成能力,部署轻量接入便捷,调用后可直接输出符合需求的图像,无需额外适配复杂流程。

mimo-vision
wulusai2333

DeepSeek Harness (DSH) native plugin — describe_image tool: a vision bridge (image → mimo-v2.5 → text description) over ...

dsh-Sight
cransmathenia666-hash

给纯文本dsh代理赋予视觉能力,粘贴的图片会自动转换为文本描述,依托持久缓存机制,每张图片仅需转换一次即可复用,无需重复处理,降低视觉能力接入成本。

dsh-image-zoom
sijidoubi

轻量级前端插件,为Markdown渲染和聊天窗口中的图片添加点击缩放灯箱。点击缩略图即弹出遮罩层显示原图,支持滚轮缩放、左右切换、ESC关闭,事件回调可自定义,零依赖,轻松集成到现有页面。

dsh-periscope
lmh-2026

可自动识别请求是否携带图片,纯文本请求直连DeepSeek V4-Flash/V4-Pro,带图请求自动路由至官方视觉模型,无需手动切换模型配置,使用过程无需额外操作。

零依赖纯客户端运行,支持聊天输入框图片上传、区域截图操作,可注入草稿图片轨道,依托Electron desktopCapturer实现本地截屏,无需后端服务,操作流畅无额外负担。

HyoJoo-MCP
hyojoo207

兼容多模态数据接入,支持文本、图像等不同类型的输入输出处理,可无缝对接主流MCP服务框架,无需复杂配置即可快速扩展模型能力边界,部署使用门槛低。

dsh-mindsee
123cdxcc

支持将截图和本地图片经MindSee转成文字,让对话模型能看图作答。安装即可使用,无需额外配置,自动提取图像信息并融入上下文,强化多模态交互。

dock-images
AKS1st

支持PNG/JPEG/GIF/WebP/BMP/SVG/ICO/AVIF共八种格式的图片查看,其中SVG仅做安全渲染规避风险,依托dock与dock-files运行,轻量易用可直接集成到现有dock生态工作流。