MinerU支持PDF、Word、PPT、Excel、图片、HTML等多类文档一键转写为结构化Markdown,内置拖拽上传面板,免费Agent API快速模式与Token精准模式自动路由,输出内容可直接供Agent阅读。
PaddleOCR-VL与Qwen构建的视觉模型适配插件,可快速为Codex、DeepSeek Harness等开发框架接入图像识别能力,无需复杂配置即可完成模型部署与调用,轻量易用适配主流开发场景。
MinerU支持PDF、Word、PPT、Excel、图片、HTML等多类文档一键转写为结构化Markdown,内置拖拽上传面板,免费Agent API快速模式与Token精准模式自动路由,输出内容可直接供Agent阅读。
PaddleOCR-VL与Qwen构建的视觉模型适配插件,可快速为Codex、DeepSeek Harness等开发框架接入图像识别能力,无需复杂配置即可完成模型部署与调用,轻量易用适配主流开发场景。