探索包含 dashscope 主题特性的所有开源仓库、扩展插件与智能体组件。
支持多供应商路由调度,可一站式完成媒体生成与视觉理解任务,集成Iris工作台简化操作流程,开箱即用无需复杂配置。
依托多模态大模型,自动生成UI线框与高保真原型,输出组件级可调整的视觉素材,支持快速迭代。
支持全双工实时语音交互,可适配主流WebUI平台,后续将兼容微信小程序端调用,部署轻便,交互低延迟,支持多轮语音对话与上下文语义理解。
整合Qwen视觉理解、语音转文字、文生图三类多模态能力,提供统一规范的调用接口,无需复杂配置即可快速接入使用,开发部署简单高效。
该插件适配DashScope平台的Kimi大模型,支持kimi-k3的图片输入、思考推理与工具调用能力,无构建步骤,开箱即用,可快速集成至大模型应用框架。
依托DashScope千问能力打造的MCP服务插件,可直接识别长视频、大体积图片与音频文件,支持生成对应多媒体内容,通过百炼临时OSS直传突破文件大小限制。
Qwen / DashScope Token Plan web search provider plugin for DeepSeek Harness (dsh)
语音插件提供逐条消息语音播放、自动公告播报、麦克风听写输入能力,支持自由组合阿里云DashScope或火山引擎的云端TTS、ASR服务,无需复杂配置即可快速接入。
轻量级插件为编码模型
轻量级视觉桥,自动将贴图经LLM/Stream转为VL文字描述,消除内容不支持报错;内置view_image/ocr_image视觉工具,原生多模态路由自动跳过,零依赖。
DeepSeek Harness 插件:DeepSeek 大脑 + 自动识图。GUI 附加图片自动经 OpenAI 兼容 VLM 转译成文字后交给 DeepSeek 作答;支持百炼/智谱/OpenRouter 等任意 OpenAI 兼容端点...
纯文本模型现可上传图片,按需调用view_image工具,借助任意OpenAI兼容视觉端点(默认Qwen/DashScope)识别图像内容并作答,轻量接入,即刻拥有多模态反馈。