本指南仅支持Windows 10/11 64位系统,不需要高端配置,普通办公电脑CPU即可运行,全程零成本,不需要编程基础,所有资源都给出直接下载链接,不需要到处查找。
直接点击链接下载预编译好的程序包,不需要自己编译,下载地址:
https://github.com/PaddlePaddle/PaddleOCR/releases/download/v2.7.1/PaddleOCR-2.7.1-windows-x86_64.zip
下载完成后,将压缩包解压到任意非中文路径下(注意:路径不要有中文,比如不要放在D:\档案工具,要改成D:\ocr_tool,否则一定会报错),解压后得到名为PaddleOCR-2.7.1的文件夹,进入后重命名为PaddleOCR方便后续操作。
需要下载三个预训练模型,全部直接下载,链接分别是:
在刚才的PaddleOCR文件夹中,新建一个名为inference的文件夹,所有字母必须小写,然后把三个下载好的模型压缩包分别解压,将每个解压后文件夹内的所有文件,直接复制到inference文件夹中,不要把模型文件夹整个放进inference,这是90%用户出错的地方。复制完成后,inference文件夹下应该能直接看到ch_PP-OCRv3_det_infer.pdiparams、ch_PP-OCRv3_rec_infer.pdmodel等文件,就说明放对了。
操作第一步:打开你放PaddleOCR的文件夹,点击文件夹顶部的地址栏,删除原有地址,输入cmd后按下回车键,就能直接在当前文件夹打开命令提示符,这个操作比从开始菜单找cmd更简单,不会出错。
操作第二步:输入以下命令,直接复制即可,不需要修改除了图片路径之外的内容:
``` paddleocr.exe --use_gpu=False --image_dir=./你的档案图片.jpg --output=./识别结果.txt ```命令参数说明:
--use_gpu=False:代表不用独立显卡运行,CPU就可以跑,所有电脑都能用;如果你的电脑有NVIDIA独立显卡,可以改成--use_gpu=True,识别速度提升5-10倍--image_dir:改成你要识别的档案图片的完整路径,比如你的档案放在D:\扫描档案\档案001.jpg,就要写成--image_dir=D:/扫描档案/档案001.jpg,路径要用正斜杠,不要用Windows默认的反斜杠,否则会报错--output:是识别结果保存的txt文件路径,识别完成后直接打开这个txt就能看到所有文字,不需要额外操作
输入完命令后按下回车,CPU运行的情况下等待10-30秒,命令行显示执行完成后,就能在输出路径找到识别好的txt文件。
如果你的扫描档案有几十上百张,放在同一个文件夹里,可以直接批量识别,不需要一张一张操作,步骤和单张识别一样,只是命令改成:
``` paddleocr.exe --use_gpu=False --image_dir=D:/你的档案文件夹 --output=./所有档案识别结果.txt ```命令中的image_dir改成你存放所有档案图片的文件夹路径即可,所有图片的识别结果会按文件名排序,自动合并到输出的txt文件中,每张结果前会标注对应的原始文件名,方便后续整理归档。
按以下两步检查即可解决:
inference文件夹,有没有把模型文件直接放在文件夹内,不是把模型文件夹整个放进去如果你的档案包含手写内容,可以替换专门的手写识别模型:删除原来inference文件夹里的旧识别模型文件,下载新的手写识别模型https://paddleocr.bj.bcebos.com/PP-OCRv3/chinese/ch_PP-OCRv3_rec_handwritten_infer.tar.gz,解压后把文件放到inference文件夹,重新识别即可,手写体识别准确率能提升30%以上。
可以用免费的在线工具转换,打开https://www.ilovepdf.com/zh-cn/pdf_to_jpg,上传你的PDF档案,直接转换成图片,下载后再按上面的步骤识别即可,不需要下载软件,没有水印和大小限制。
打开输出的txt文件的时候,如果出现乱码,用记事本打开后,选择「另存为」,把编码改成UTF-8,保存后重新打开就能正常显示。
本方案搭建的档案OCR软件完全运行在本地,所有档案数据不会上传到任何第三方服务器,完全符合档案管理的隐私安全要求,没有使用次数限制,没有付费门槛,对于常规清晰度的扫描档案,识别准确率可以达到95%以上,完全满足档案数字化整理的需求。