RapidOCR:适合本地部署的轻量中文 OCR
基于 ONNX Runtime 的开源 OCR 工具,适合在普通电脑上批量识别图片和文档。
2026年8月9日0 次阅读
项目介绍
RapidOCR 是一个面向本地部署的 OCR 工具,提供 ONNX Runtime 等推理路径,适合把图片中的文字提取成可编辑文本。
解决什么问题
当你不想把截图、合同或内部资料上传到第三方服务时,可以使用它在本机完成识别。
核心功能
- 中文和英文印刷体识别
- 图片文字检测与识别
- CPU 推理,支持继续扩展到 GPU
- 可作为 Python 工具或服务接入
- 批量整理截图和扫描件
- 票据、表格和资料归档
- 给知识库准备可检索文本
- 安装 Python 依赖和 ONNX Runtime。
- 下载默认模型。
- 对图片执行 OCR,并将结果保存为 Markdown 或 JSON。
- 对复杂图片先裁剪、放大和去噪。
- Tesseract OCR
- OpenCV
- 扫描资料 → OCR → Markdown → 知识库
- 企业内部资料整理
- 个人研究资料归档