DeepSeek Harness 的 Codex 扩展:粘贴识图、生图/改图,本机 Codex CLI 子代理干活
将图片经光学字符识别与在线视觉大模型转化为纯文本描述,自动注入模型上下文,使纯文本模型直接理解图像内容。无需改造模型架构,即插即用,支持视窗环境,为纯文本模型补上视觉能力。
轻量级大模型维基插件,自动将工作区内容本地聚合为可检索的知识库。支持作用域隔离,确保数据留存在本地,兼顾团队协作与隐私安全。开箱即用,无需复杂配置即可生成结构化维基。
提供持久化TBox与ABox领域知识,支持类型化声明、断言与推理查询,在schema约束下保证数据一致性,让代理知识可复用、可演进。
Zero-core-change vision capability for DeepSeek Harness: the describe_image tool + profile bundle, installable via 'dsh ...
自动判断任务难度并路由到已配置模型,内置困难/普通/简单三档分级,视觉任务走独立路由通道,全套自动运行,无需手动切换模型。
轻量级视觉桥接插件,感知主模型无法处理图片时,自动转发给本地Umi-OCR完成识别,全程无需外部API密钥,数据保留在本地,兼容现有模型链路,即插即用。
集成DDGS和Tavily双搜索源,配合Firecrawl实现网页内容精准提取。搜索结果与抓取内容结构化返回,支持灵活配置,让智能体实时获取网络信息,处理链路清晰可控。
支持按对话轮次追踪文件变更,生成独立差异面板,可逐文件查看diff并一键跳转至文件系统目录。基于web插件实现,轻量集成,无需离开页面即可完成每次变更审查。
自动从论文PDF抽取文本并转为可选中内容,图表和数学公式原样保留,版面结构清晰;内建“问论文”对话框,直接对全文提问,快速定位关键信息。
依托苹果与微软系统内置文字识别引擎,按需本地识别图片文字,全程离线运行。无需上传数据,保护隐私,响应迅速,轻量插件设计,方便集成。
支持洛谷、HDOJ、POJ、ZOJ、Nowcoder、LeetCode等主流OJ,基于CYaRon自动生成测试数据。只需编写简单脚本,即可批量产出标准输入输出,覆盖自定义规模与边界情况,省去手工构造用例的繁琐。