探索包含 dashscope 主题特性的所有开源仓库、扩展插件与智能体组件。
轻量级视觉桥,自动将贴图经LLM/Stream转为VL文字描述,消除内容不支持报错;内置view_image/ocr_image视觉工具,原生多模态路由自动跳过,零依赖。
纯文本模型现可上传图片,按需调用view_image工具,借助任意OpenAI兼容视觉端点(默认Qwen/DashScope)识别图像内容并作答,轻量接入,即刻拥有多模态反馈。
DeepSeek Harness 插件:DeepSeek 大脑 + 自动识图。GUI 附加图片自动经 OpenAI 兼容 VLM 转译成文字后交给 DeepSeek 作答;支持百炼/智谱/OpenRouter 等任意 OpenAI 兼容端点...
整合Qwen视觉理解、语音转文字、文生图三类多模态能力,提供统一规范的调用接口,无需复杂配置即可快速接入使用,开发部署简单高效。
轻量级插件为编码模型
语音插件提供逐条消息语音播放、自动公告播报、麦克风听写输入能力,支持自由组合阿里云DashScope或火山引擎的云端TTS、ASR服务,无需复杂配置即可快速接入。
依托DashScope千问能力打造的MCP服务插件,可直接识别长视频、大体积图片与音频文件,支持生成对应多媒体内容,通过百炼临时OSS直传突破文件大小限制。
该插件适配DashScope平台的Kimi大模型,支持kimi-k3的图片输入、思考推理与工具调用能力,无构建步骤,开箱即用,可快速集成至大模型应用框架。
给 DeepSeek 补上「眼睛和耳朵」的多模态视觉插件:看图 / OCR / 物体检测 / 视频理解 / 语音转写 / 截图直读,一键安装(DSH 插件)。
支持全双工实时语音交互,可适配主流WebUI平台,后续将兼容微信小程序端调用,部署轻便,交互低延迟,支持多轮语音对话与上下文语义理解。
支持多供应商路由调度,可一站式完成媒体生成与视觉理解任务,集成Iris工作台简化操作流程,开箱即用无需复杂配置。
Qwen / DashScope Token Plan web search provider plugin for DeepSeek Harness (dsh)