
MinerU
MinerU是一款将PDF 转化为机器可读格式的强大工具(如 Markdown、JSON)。MinerU 诞生于书生-浦语的预训练过程中,能够保留原 PDF 文档结构,提取文字、图片、图片描述、表格等内容。它自动识别并转换 LaTeX 格式、HTML 格式,支持多语言 OCR 功能,确保高效准确地处理文档。
Stirling-PDF 是一款开源的、基于 Web 的 PDF 处理工具,它提供了一个健壮的、可本地托管的平台,使用 Docker 实现。这个工具允许用户执行多种 PDF 文件操作,包括分割、合并、转换、重新组织、添加图像、旋转和压缩等。
Stirling-PDF 是一款开源的、基于 Web 的 PDF 处理工具,它提供了一个健壮的、可本地托管的平台,使用 Docker 实现。这个工具允许用户执行多种 PDF 文件操作,包括分割、合并、转换、重新组织、添加图像、旋转和压缩等。
Stirling-PDF:开源基于 Web 的 PDF 处理工具
这些场景展示了 Stirling-PDF 作为一个多功能 PDF 处理工具的强大能力,适合个人用户和企业用户进行文档管理和编辑。