本文适配鲲鹏 ARM 架构银河麒麟 Linux 服务器,完整讲解轻量化数字档案系统配套OCR 识别部署流程。

1. pip升级

pip install --upgrade pip

2. pip3安装

yum -y install python3-pip

python3 -m pip install --upgrade pip

pip3 install docker-compose

3. 安装paddlepaddle

上传paddlepaddle,进入对应上传目录执行:

python3 -m  pip install paddlepaddle-0.0.0-cp39-cp39-linux_aarch64.whl

4. 安装paddleocr

python3 -m pip install paddleocr -i Simple Index

拉取OCR工程文件

git clone https://gitee.com/PaddlePaddle/PaddleOCR.git(推荐)

git clone https://github.com/PaddlePaddle/PaddleOCR.git

5. 安装 HubServing

# paddlehub 需要 python>3.6.2

cd PaddleOCR/

pip install paddlehub==2.1.0 --upgrade -i https://mirror.baidu.com/pypi/simple

依赖安装:

pip install -r requirements.txt -i https://pypi.tuna.tsinghua.edu.cn/simple

6. 上传轻量的推理模型

创建inference模型文件夹

mkdir inference && cd inference

上传轻量推理模型

检测模型:/inference/ch_ppocr_mobile_v2.0_det_infer

识别模型:/inference/ch_ppocr_mobile_v2.0_rec_infer
方向分类器:/inference/ch_ppocr_mobile_v2.0_cls_infer

或直接下载

cd /home/PaddleOCR/deploy/hubserving/ocr_system

# 下载并解压检测模型

wget https://paddleocr.bj.bcebos.com/PP-OCRv3/chinese/ch_PP-OCRv3_det_infer.tar && tar -xf ch_PP-OCRv3_det_infer.tar && rm -rf ch_PP-OCRv3_det_infer.tar

# 下载并解压识别模型

wget https://paddleocr.bj.bcebos.com/PP-OCRv3/chinese/ch_PP-OCRv3_rec_infer.tar && tar -xf ch_PP-OCRv3_rec_infer.tar && rm -rf ch_PP-OCRv3_rec_infer.tar

# 下载并解压方向分类器

wget https://paddleocr.bj.bcebos.com/dygraph_v2.0/ch/ch_ppocr_mobile_v2.0_cls_infer.tar && tar -xf ch_ppocr_mobile_v2.0_cls_infer.tar && rm -rf ch_ppocr_mobile_v2.0_cls_infer.tar

7. 修改模型路径

修改/root/PaddleOCR/deploy/hubserving/ocr_system/下params.py文件模型路径,如下:

7.1 CPU模式

CPU模式,需要进入/zjck/PaddleOCR/deploy/hubserving/ocr_system/修改config.json文件如下:

8. 安装服务模块

hub install deploy/hubserving/ocr_det/

hub install deploy/hubserving/ocr_cls/

hub install deploy/hubserving/ocr_rec/

hub install deploy/hubserving/ocr_system/

如果报错:ModuleNotFoundError: No module named 'paddle.nn.layer.layers'

paddlepaddle 2.4.2时 会自动安装最新版的paddlenlp 目前paddlenlp版本是2.6.1 该版本与paddlepaddle 2.4.2不兼容会报这个错

手动pip安装paddlenlp 2.5.2

pip install paddlenlp==2.5.2

其它问题缺什么模块安装什么模块就行。

9. 修改加载配置文件

 hub serving start -c deploy/hubserving/ocr_system/config.json

10. 全量启动 OCR服务

nohup hub serving start -m ocr_system &

注:本文技术提供来源成都轻量化数字档案管理系统供应商成都中禁创科科技有限公司

Logo

鲲鹏昇腾开发者社区是面向全社会开放的“联接全球计算开发者,聚合华为+生态”的社区,内容涵盖鲲鹏、昇腾资源,帮助开发者快速获取所需的知识、经验、软件、工具、算力,支撑开发者易学、好用、成功,成为核心开发者。

更多推荐