跳转至

Python-native PDF toolkit

Python的方式处理PDF,核心由Rust驱动。

用一套熟悉的API完成PDF编辑、渲染、提取与最终处理,无需沉重的运行时依赖。

pip install pylopdf
  • MIT许可
  • 5–6 MB wheel
  • 无必需Python依赖
  • Python 3.10–3.14
01 / EDIT

精准编辑

合并、选页、添加批注、填写表单,并保留关键的PDF结构。

02 / RENDER

忠实渲染

通过紧凑的原生引擎,将页面稳定输出为PNG或SVG。

03 / EXTRACT

提取信息

通过统一API读取文本、单词、区块、坐标与OCR不可见文本层。

Useful constraints, visible evidence

足够轻,便于部署;足够完整,胜任真实工作流。

pylopdf使用lopdf进行编辑、hayro进行渲染与提取,并通过krilla和 HarfRust生成文本与表单外观,将这些能力组合成一个紧凑的Python包。

5–6 MB 已发布v0.10 wheel的大小范围,适合AWS Lambda等容量受限的环境。
必需Python依赖。编译后的Rust组件已包含在wheel中。
3.10–3.14 单一abi3 wheel系列覆盖五代Python。
MIT 宽松许可,适合开源与商业产品。

Deliberate scope

专注的PDF核心,与Python生态系统协同工作。

项目公开可复现的性能基准,包括不占优势的结果;相邻领域则采用成熟工具, 而不是重复实现。

pylopdf负责

  • 页面管理、元数据、书签与加密
  • 带坐标的文本提取、搜索与Markdown转换
  • PNG/SVG渲染、图像、批注与OCR文本层
  • AcroForm填写、附件与页码标签

通过生态协作

  • 使用Typst排版并生成新的PDF/A
  • 使用pyHanko添加PAdES签名
  • 使用veraPDF验证PDF/A
  • 连接任何能够返回单词与矩形的OCR引擎