标签主题词 (Topic)

# image-recognition

探索包含 image-recognition 主题特性的所有开源仓库、扩展插件与智能体组件。

vision-exp-tile
Nicholas023

DSH 插件:大图切 800×800 无损小块 + 坐标标注 + 分块聚合逻辑,直连 deepseek-v4-flash-vision-exp 识别;仅用纯官方 DSH 功能,零依赖第三方插件,不统计 token/费用。

适配deepseek-v4-flash-vision-exp高清识图需求,放宽原有图片尺寸限制,内置highres_read分块识图工具,可直接处理高清大图,识别结果更精准。

AI Agent技能与DeepSeek函数调用适配器,可将用户创意、公开参考图自动转化为可直接用于图像生成的生产级提示词,无需手动调参即可获得高质量出图效果。

作为图片识别插件,可自动判断当前模型的识图能力,支持多供应商视觉模型的统一管理与能力检测,无需手动配置即可适配不同模型的视觉识别需求,部署使用轻量便捷。

dsh-mingmu
Lab-sku

作为轻量级视觉桥接工具,可在无内置视觉能力的模型接收图像时自动调用视觉模型完成内容识别,无需额外配置,部署便捷,可无缝接入现有大模型调用流程

支持DeepSeek无需切换模型即可自动路由视觉理解与图像生成能力,兼容Gemini及所有OpenAI兼容后端,可调用GPT-4o、通义千问VL、GLM-4V等多类模型,直接完成对应任务。

dsh-youreyes
54xkeee

提供模型可直接调用的视觉工具集,内置OpenAI兼容、Gemini、本地Ollama等多类VLM通用通道与包装适配器,可快速为纯文本大模型扩展视觉理解能力,开箱即用无需复杂配置。

可将纯文本模型路由至可配置的视觉模型,默认调用免费的智谱GLM-4V-Flash,让原本仅支持文本输入的模型直接获得图像理解能力,无需额外适配原生视觉功能。

dsh-deepeye-setup
grasir-ctrl

支持一键安装DeepSeek视觉插件,依托免费的智谱GLM-4V-Flash模型提供多模态能力,可直接将图片粘贴输入纯文本大模型,无需额外配置即可完成图片内容的识别与理解。

依托 CDP 桥接技术打造豆包桌面端宿主插件,开箱即用无需手动配置,支持为纯文本模型新增聊天图片识别能力,识别操作可随时取消,降低多模态交互门槛。

dsh-vision-relay
junhongchashui

零修改接入视觉能力,支持云端与本地Ollama双后端自动切换,纯文本模型粘贴图片即读,ModLens v2风格结构化证据输出,兼顾效率与可解释性。

dsh-vision
54xkeee

Vision for DeepSeek Harness: Doubao Web by default (zero-cost, no API key), Antigravity IDE quota (flash/pro), any IDE C...