深度理解 PDF
页面布局、阅读顺序、表格结构、代码、公式、图片分类,逐页重建文档的逻辑结构。


从页面布局到表格结构,从扫描版 OCR 到图表理解,Docling 把原始文档转换成富有表达力的统一表示。
页面布局、阅读顺序、表格结构、代码、公式、图片分类,逐页重建文档的逻辑结构。

柱状图、饼图、折线图可转换为表格或代码,并补充详细描述。

统一且富有表达力的文档表示格式,导出 Markdown、HTML、WebVTT、DocTags 与无损 JSON。
支持 DocLang、USPTO 专利、JATS 论文与 XBRL 财务报告等专用格式。
全流程可在本地运行,适用于敏感数据与网络隔离环境,数据不出域。
安装、转换、集成。从第一行命令到结构化 Markdown,只需几分钟。
pip install docling需要 Python 3.10 或更高版本。支持 macOS、Linux 与 Windows,x86_64 与 arm64 架构均可运行。
支持 MP4、AVI、MOV、MKV、WebM,输出 ASR 转写文本与代表性关键帧。
OpenDocument 文本文档(.odt)、电子表格(.ods)、演示文稿(.odp)。
解析可扩展商业报告语言文档,面向财务数据结构。
支持 .eml 与 .msg 邮件格式,保留正文与附件结构。
解析 EPUB 电子书文件,输出连续的结构化内容。
兼容两代容器格式(Pages 5+ 与 iWork '09)。
解析 .txt、.text 以及 .qmd、.Rmd 文件。
柱状图、饼图、折线图可转换为表格或代码,并补充详细描述。