生态分类

文件与数据

探索当前分类下精选的开源项目与高质量扩展插件。

精选收录
dsh-windows-ocr
maxwell-feng

轻量级文字识别插件,直接调用系统自带识别引擎,支持多语言文字提取,提供图像文字输出,无需额外模型,安装即可使用,运行高效。

dsh-pdf
sunshine-lang

PDF toolbox for DeepSeek Harness: extract text, metadata, and page ranges via pdfjs-dist (local, no API key)

图片以原生附件体验直接送入纯文本模型,文档、压缩包、音视频在附件栏显示为方块;点击发送自动转为工作区路径,配合 vision-toolkit 可粘贴即看图,兼顾视觉与文本信息。

aflare
alib8b8

本地优先自动化执行任务,数据全程不出设备。支持接入你自己的LLM、数据库和知识库,基于ReAct推理,附带300+技能模板。采用DAG、WAL、Saga等机制实现确定性工作流,兼容MCP协议,离线内网环境可用。

visual-review
wang-bool

轻量级插件,支持图像上传与识别,让对话具备多模态理解。发送图片即可自动识别并参与对话,交互直观高效。

locallens
uknowmyface

Local OCR for DeepSeek Harness — read text from screenshots on your Mac with Apple's Vision framework. No API key, no up...

dsh-see-image
tiefeiyu

图像描述插件,可调用任意OpenAI兼容的视觉模型,如GitHub Copilot、Ollama、vLLM等,直接对图片生成文字说明,即插即用,部署简单。

轻量搜索插件,为DeepSeek Harness扩展实时网页检索能力。内置DuckDuckGo搜索接口,支持自然语言查询并返回结构化结果,零API成本即可获取最新网络信息,部署简单即插即用。

直接为模型注入本地知识库检索能力,自动向量化文档并匹配上下文,回答引用私有数据,全程无需上传云端,插件式安装即刻启用。

统一接口直接调用LM Studio加载的本地视觉模型,支持图像输入与视觉问答。自动封装连接和请求格式,只需传入图片与提示词即可返回结果,离线环境使用流畅。

自动将图像读取请求路由到Kimi K3等专用视觉模型,让只支持文本的智能体也能看懂图片。轻量插件机制,不改动主模型,即可快速获得多模态读图能力。

dsh-eyes
Leeminjing

纯文本模型现可上传图片,按需调用view_image工具,借助任意OpenAI兼容视觉端点(默认Qwen/DashScope)识别图像内容并作答,轻量接入,即刻拥有多模态反馈。