探索包含 deepseek-harness 主题特性的所有开源仓库、扩展插件与智能体组件。
轻量化桌面工具,内置无限制OCR识别能力,支持多语言、多类型图像文字提取,配套可视化配置面板,无需复杂操作即可快速完成识别任务,上手简单易用。
零依赖纯客户端运行,支持聊天输入框图片上传、区域截图操作,可注入草稿图片轨道,依托Electron desktopCapturer实现本地截屏,无需后端服务,操作流畅无额外负担。
支持接入AnySearch、Bing、DuckDuckGo、Tavily、Exa等多搜索服务,可一键完成网页检索与目标页面内容抓取,开箱即用无需复杂配置。
可让纯文本模型会话直接发送图片,自动调用视觉模型完成识图转文字,原生兼容 read_image 工具,无需额外配置即可在原有会话流程中实现图片内容解析,使用门槛低且流程顺畅。
可自动留存项目上下文信息,调用时无需重复说明工程背景,即装即用,减少重复输入提升交互效率,适配主流AI编程助手插件体系
官方级视觉扩展,可将图像理解任务自动路由至智谱GLM、硅基流动Qwen等免费视觉模型池,模型不可用时自动降级切换,无需额外配置即可稳定获取图像理解结果。
轻量级视觉能力拓展插件,可快速为开发工具与大模型应用接入图像识别、内容理解等多模态处理能力,开箱即用无需复杂配置,兼容主流开发框架与工作流。
提供图像查看工具,兼容本地Ollama及各类OpenAI兼容视觉大模型,作为聊天图像附件桥接,支持粘贴、拖拽上传图片,让原本仅支持文本交互的模型可直接识别图像内容。
支持将本地任意文件拖拽至目标输入窗口,自动提取文件真实路径并填充至输入框,无需手动复制路径,操作轻便高效,兼容各类格式文件的拖拽操作。
支持对接RAGFlow知识库实现语义检索与相关片段召回,开箱即用无需复杂配置,可快速为应用接入知识增强能力,降低知识类应用的开发成本。
原生适配Windows系统,集成图像内容理解、OCR文字识别、截图差异比对三类核心视觉能力,支持多AI服务提供商路由调度,部署简单使用流畅。
支持给纯文本模型新增视觉识别能力,采用类Codex聊天框拖拽交互,用户上传的图片会自动分流至已配置的视觉模型转文字,v4版本无需切换模型即可直接完成识图,操作流畅便捷。