微信扫码
添加专属顾问
我要投稿
开源神器OCRmyPDF,30.6k星项目帮你轻松将扫描PDF转为可搜索可编辑文档,大幅提升工作效率! 核心内容: 1. 一键转换扫描PDF为可搜索/可复制格式,保留原始布局 2. 支持100+语言识别、自动纠偏和智能压缩优化 3. 跨平台兼容性强,通过Docker实现快速部署
OCRmyPDF 是一款开源的 PDF 处理工具,通过添加 OCR 文本层,OCRmyPDF 能够将无法直接编辑的扫描 PDF 文件变为可以搜索和编辑的格式,同时保留原始布局和图像质量。支持 Windows、macOS、Linux 与 FreeBSD 平台,也可通过 Docker 镜像运行。
•项目地址:https://github.com/ocrmypdf/OCRmyPDF
•开发者:James R. Barlow(核心)及社区贡献者
•Stars / Forks:约 30.6k ⭐ / 2.1k 🍴
•License:Mozilla Public License 2.0(MPL‑2.0,核心)/文档为 CC‑BY‑SA 4.0
•技术栈:Python 3, Shell, Ghostscript, Tesseract, qpdf, pngquant, jbig2enc
•目标用户:对扫描文档进行 OCR 的个人用户、图书馆/档案数字化、法律文件归档等。
▶ 安装步骤
✅方法 A:推荐(包管理器/Docker 快速安装)
✅ 方法 B:进阶用户(Python + pip 安装)
brew install ghostscript tesseract qpdf pngquant
或在 Debian/Ubuntu:
sudo apt update
sudo apt install ghostscript tesseract-ocr tesseract-ocr-eng qpdf pngquant
pip install / upgrade ocrmypdf
sudo apt install tesseract-ocr-chi-sim
然后执行如下命令:
ocrmypdf -l eng+chi_sim input.pdf output.pdf
▶ 使用流程示例
# 单页测试
ocrmypdf input.pdf output.pdf
# 在原文件基础上进行 OCR(成功覆盖原文件)
ocrmypdf input.pdf input.pdf
# 添加识别语言(英文 + 简体中文)
ocrmypdf -l eng+chi_sim scanned.pdf searchable.pdf
# 自动纠偏并输出 PDF/A
ocrmypdf --rotate-pages --deskew --output-type pdfa input.pdf output.pdf
# 批量处理(示例替换当前目录中所有 PDF,需自行验证)
for f in *.pdf; do
ocrmypdf "$f" "ocr/$f"
done
安装完成后,用 ocrmypdf --help 可查看所有命令选项及说明。
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业
2025-08-09
使用 ADK 架构开发 Agent 自动化评估脚本
2025-08-09
告别选择困难症!Dify、n8n、Coze、Fastgpt、Ragflow 怎么选?看这篇就够了。
2025-08-09
独家|陈天桥布局端到端Deep Research生态赛道,MiroMind发布全栈开源深度研究项目ODR
2025-08-09
腾讯开源重磅项目:WeKnora让企业文档瞬间变身AI知识库!
2025-08-08
Ollama还是vLLM?深度解析四大顶级LLM服务框架:性能、特性与技术选型指南
2025-08-08
免费GPU算力部署体验gpt-oss-20b
2025-08-07
自主搜索AI的突破:阿里通义实验室WebAgent项目深度解析
2025-08-07
OpenAI开源gpt-oss大模型,本地测试可用性比较高
2025-07-23
2025-06-17
2025-06-17
2025-07-23
2025-07-14
2025-07-12
2025-07-27
2025-07-29
2025-07-29
2025-05-29