标签主题词 (Topic)

# ocr

探索包含 ocr 主题特性的所有开源仓库、扩展插件与智能体组件。

支持PDF、Word、Excel、文本等格式文件拖拽上传,自动完成内容解析,搭配双轨上下文与原生WinRT OCR识别扫描件,无需修改上游代码即可接入使用。

dsh-file-convert
zzy-12345678

支持图片、PDF、音视频、办公文档等26种格式互转,内置7类转换工具,无需API密钥与文件上传,所有转换流程均在本地完成,数据不会外传,开箱即用。

支持将各类Office文档、含扫描件的PDF转为结构化Markdown,采用CPU优先路由OCR方案,搭配PP-DocLayout-L布局分析、RapidOCR文字识别、SLANet表格提取、FormulaNet公式识别等轻量模型,本地运行...

本地方运行的OCR插件,支持识别手写中文内容与数学公式,输出带LaTeX语法的Markdown文本,提供GPU、CPU双计算后端可选,无需联网即可完成本地识别。

dsh-plugin-vision
aijunjiang

内置11类主流视觉模型预设,支持OpenAI兼容视觉模型快速接入智能体,可勾选对应能力项自动注入实时提示词,无需复杂配置即可高效扩展视觉能力。

zhanzhen
Ya-MiC

轻量级中小企业审计风险管控框架,基于FastAPI与Vue3开发,内置本地化规则引擎,采用证据哈希链存证,开箱即用即可快速搭建审计风险管理系统。

dsh-baidu-ocr
pipiwolve

Baidu cloud OCR bundle for DeepSeek Harness: drag images/PDFs in, OCR to Markdown with PaddleOCR-VL or Unlimited-OCR. 百度...

modlens
Minglink

该插件可作为大模型能力扩展模块无缝接入,打通视觉多模态输入与OCR文本识别的桥接链路,支持图像理解、文档文字提取等能力快速启用,部署轻量无额外依赖,运行稳定易集成

可从邮箱批量拉取PDF/OFD/XML格式电子发票,自动完成OCR识别、分类归档,一键生成Excel报销汇总表,提供Windows/macOS桌面版与配套插件。

Full-coverage image tiling for DeepSeek Harness vision models, dense-text OCR, and document AI

MinerU内核驱动,无需绑定特定供应商服务即可完成PDF内容解析,支持文本、表格、公式等多类元素识别,本地部署即可使用,解析精度高且无外部服务依赖风险。

dsh-pdf-reader
ydlstartx

依托AI能力提供PDF阅读与批注功能,支持多PDF联动处理、图文混合内容检索,可按需触发OCR识别,适配学术文献、技术文档等场景的高效阅读与研读需求