dsh-image-describe
其他 活跃维护

dsh-image-describe

sd1g1/dsh-image-describe

轻量级图片多模态描述工具,可自动识别图片中的视觉元素、文本信息与场景语义,输出结构化内容描述,支持快速接入主流AI应用流程,无需复杂配置即可完成图片内容的高效解析与标注。

1
Stars 标星
0
Forks 分支
1
Watchers 关注
0
Open Issues
JavaScript
主要语言
MIT
开源协议
30 KB
仓库大小
1 个月前
最后推送
一键安装扩展 / 插件指令
dsh plugin --profile web add github:sd1g1/dsh-image-describe
git clone https://github.com/sd1g1/dsh-image-describe.git
git clone git@github.com:sd1g1/dsh-image-describe.git
README.md main

dsh-image-describe

DeepSeek Harness 宿主插件:让不支持图片输入(纯文本)的主模型也能通过 describe_image 工具“看图”。

安装

npx @deepseek-ai/dsh plugin --profile web add github:sd1g1/dsh-image-describe

配置

首次启动会自动创建 ~/.dsh/image-describe.json,请填写支持图片输入的视觉模型:

{
  "vision": { "provider": "my-vision-provider", "model": "vision-model" },
  "prompt": "请详细描述这张图片的内容",
  "maxTokens": 1500
}
  • vision.provider / vision.model:必填
  • prompt:可选,默认兜底指令
  • maxTokens:可选,默认 1500

配置保存后热生效,无需重启。文件不存在时插件休眠,不影响正常请求。

卸载

npx @deepseek-ai/dsh plugin --profile web remove @local/dsh-image-describe