支持纯文本模型绕过图像准入限制,自动将图像块改写为本地路径,通过OCR或视觉描述能力完成图像内容的读取与输出,无需模型本身具备多模态能力,开箱即用。

原生适配多运行时的实验控制面,覆盖基线构建、消融实验、可复现评估全流程,统一管控实验配置与结果追踪,简化多运行时研究的实验组织与复现操作。

自动扫描本机项目目录,一键生成带双向链接的Obsidian笔记,无需手动整理即可在Obsidian图谱视图里自动渲染项目知识关联,轻量化配置就能同步项目结构到个人知识库。

dsh-socrates
Cruciforms

支持先澄清需求再开展多轮自适应深度研究,自动生成带证据闭环引用的研究报告,内置交叉验证与引用审计能力,保障研究结论的严谨性与可信度。

可通过analyze_image接口将图片自动转发至任意OpenAI兼容视觉端点,为仅支持文本输入的模型补全图像识别能力,无需修改模型本体即可实现图文混合输入处理。

dsh-memory
34262315716

提供情景、语义、画像三层记忆架构,内置知识图谱与世界线版本管理能力,可自动沉淀交互知识,无需手动配置即可实现智能体长期记忆的增量更新与回溯查询。

deepseek-visual-plugin
zhangzhimou78-code

轻量级视觉能力拓展插件,可快速为开发工具与大模型应用接入图像识别、内容理解等多模态处理能力,开箱即用无需复杂配置,兼容主流开发框架与工作流。

提供图像查看工具,兼容本地Ollama及各类OpenAI兼容视觉大模型,作为聊天图像附件桥接,支持粘贴、拖拽上传图片,让原本仅支持文本交互的模型可直接识别图像内容。

dsh-file-drop
tianleyitian

支持将本地任意文件拖拽至目标输入窗口,自动提取文件真实路径并填充至输入框,无需手动复制路径,操作轻便高效,兼容各类格式文件的拖拽操作。

dsh-ragflow
staff-os

支持对接RAGFlow知识库实现语义检索与相关片段召回,开箱即用无需复杂配置,可快速为应用接入知识增强能力,降低知识类应用的开发成本。

dsh-vision-suite
princefrogdida-ux

原生适配Windows系统,集成图像内容理解、OCR文字识别、截图差异比对三类核心视觉能力,支持多AI服务提供商路由调度,部署简单使用流畅。

支持给纯文本模型新增视觉识别能力,采用类Codex聊天框拖拽交互,用户上传的图片会自动分流至已配置的视觉模型转文字,v4版本无需切换模型即可直接完成识图,操作流畅便捷。