PaddleOCR/deploy/cpp_infer/readme.md

286 lines
9.4 KiB
Markdown
Raw Normal View History

2020-07-13 02:48:10 +08:00
# 服务器端C++预测
2021-02-02 21:08:13 +08:00
本章节介绍PaddleOCR 模型的的C++部署方法与之对应的python预测部署方式参考[文档](../../doc/doc_ch/inference.md)。
C++在性能计算上优于python因此在大多数CPU、GPU部署场景多采用C++的部署方式本节将介绍如何在Linux\Windows (CPU\GPU)环境下配置C++环境并完成
PaddleOCR模型部署。
2020-07-13 02:48:10 +08:00
2021-09-09 15:08:56 +08:00
* [1. 准备环境](#1)
+ [1.0 运行准备](#10)
+ [1.1 编译opencv库](#11)
+ [1.2 下载或者编译Paddle预测库](#12)
- [1.2.1 直接下载安装](#121)
- [1.2.2 预测库源码编译](#122)
* [2 开始运行](#2)
+ [2.1 将模型导出为inference model](#21)
+ [2.2 编译PaddleOCR C++预测demo](#22)
+ [2.3运行demo](#23)
<a name="1"></a>
2020-07-13 02:48:10 +08:00
## 1. 准备环境
2021-09-09 15:08:56 +08:00
<a name="10"></a>
### 1.0 运行准备
2020-07-13 02:48:10 +08:00
- Linux环境推荐使用docker。
2020-07-21 01:23:49 +08:00
- Windows环境目前支持基于`Visual Studio 2019 Community`进行编译。
* 该文档主要介绍基于Linux环境的PaddleOCR C++预测流程如果需要在Windows下基于预测库进行C++预测,具体编译方法请参考[Windows下编译教程](./docs/windows_vs2019_build.md)
2020-07-13 02:48:10 +08:00
2021-09-09 15:08:56 +08:00
<a name="11"></a>
2020-07-13 02:48:10 +08:00
### 1.1 编译opencv库
* 首先需要从opencv官网上下载在Linux环境下源码编译的包以opencv3.4.7为例,下载命令如下。
```
2021-07-19 20:16:14 +08:00
cd deploy/cpp_infer
2020-07-13 02:48:10 +08:00
wget https://github.com/opencv/opencv/archive/3.4.7.tar.gz
tar -xf 3.4.7.tar.gz
```
最终可以在当前目录下看到`opencv-3.4.7/`的文件夹。
* 编译opencv设置opencv源码路径(`root_path`)以及安装路径(`install_path`)。进入opencv源码路径下按照下面的方式进行编译。
```shell
2020-07-13 21:05:36 +08:00
root_path=your_opencv_root_path
2020-07-13 02:48:10 +08:00
install_path=${root_path}/opencv3
rm -rf build
mkdir build
cd build
cmake .. \
-DCMAKE_INSTALL_PREFIX=${install_path} \
-DCMAKE_BUILD_TYPE=Release \
-DBUILD_SHARED_LIBS=OFF \
-DWITH_IPP=OFF \
-DBUILD_IPP_IW=OFF \
-DWITH_LAPACK=OFF \
-DWITH_EIGEN=OFF \
-DCMAKE_INSTALL_LIBDIR=lib64 \
-DWITH_ZLIB=ON \
-DBUILD_ZLIB=ON \
-DWITH_JPEG=ON \
-DBUILD_JPEG=ON \
-DWITH_PNG=ON \
-DBUILD_PNG=ON \
-DWITH_TIFF=ON \
-DBUILD_TIFF=ON
make -j
make install
```
2020-07-13 21:05:36 +08:00
其中`root_path`为下载的opencv源码路径`install_path`为opencv的安装路径`make install`完成之后会在该文件夹下生成opencv头文件和库文件用于后面的OCR代码编译。
2020-07-13 02:48:10 +08:00
最终在安装路径下的文件结构如下所示。
```
opencv3/
|-- bin
|-- include
|-- lib
|-- lib64
|-- share
```
2021-09-09 15:08:56 +08:00
<a name="12"></a>
2020-07-13 21:05:36 +08:00
### 1.2 下载或者编译Paddle预测库
* 有2种方式获取Paddle预测库下面进行详细介绍。
2021-03-19 10:39:51 +08:00
2021-02-02 22:27:21 +08:00
#### 1.2.1 直接下载安装
2021-06-02 14:32:14 +08:00
* [Paddle预测库官网](https://www.paddlepaddle.org.cn/documentation/docs/zh/2.0/guides/05_inference_deployment/inference/build_and_install_lib_cn.html) 上提供了不同cuda版本的Linux预测库可以在官网查看并选择合适的预测库版本*建议选择paddle版本>=2.0.1版本的预测库* )。
2021-02-02 22:27:21 +08:00
* 下载之后使用下面的方法解压。
```
tar -xf paddle_inference.tgz
```
最终会在当前的文件夹中生成`paddle_inference/`的子文件夹。
#### 1.2.2 预测库源码编译
2020-07-13 21:05:36 +08:00
* 如果希望获取最新预测库特性可以从Paddle github上克隆最新代码源码编译预测库。
2021-06-02 14:32:14 +08:00
* 可以参考[Paddle预测库安装编译说明](https://www.paddlepaddle.org.cn/documentation/docs/zh/2.0/guides/05_inference_deployment/inference/build_and_install_lib_cn.html#congyuanmabianyi) 的说明从github上获取Paddle代码然后进行编译生成最新的预测库。使用git获取代码方法如下。
2020-07-13 02:48:10 +08:00
```shell
git clone https://github.com/PaddlePaddle/Paddle.git
2021-06-02 14:32:14 +08:00
git checkout release/2.1
2020-07-13 02:48:10 +08:00
```
* 进入Paddle目录后编译方法如下。
```shell
rm -rf build
mkdir build
cd build
cmake .. \
-DWITH_CONTRIB=OFF \
-DWITH_MKL=ON \
2020-07-13 21:05:36 +08:00
-DWITH_MKLDNN=ON \
2020-07-13 02:48:10 +08:00
-DWITH_TESTING=OFF \
-DCMAKE_BUILD_TYPE=Release \
-DWITH_INFERENCE_API_TEST=OFF \
-DON_INFER=ON \
-DWITH_PYTHON=ON
2020-07-13 21:09:58 +08:00
make -j
2020-07-13 02:48:10 +08:00
make inference_lib_dist
```
2021-06-02 14:32:14 +08:00
更多编译参数选项介绍可以参考[文档说明](https://www.paddlepaddle.org.cn/documentation/docs/zh/2.0/guides/05_inference_deployment/inference/build_and_install_lib_cn.html#congyuanmabianyi)。
2020-07-13 02:48:10 +08:00
2020-12-16 18:28:26 +08:00
* 编译完成之后,可以在`build/paddle_inference_install_dir/`文件下看到生成了以下文件及文件夹。
2020-07-13 02:48:10 +08:00
```
2020-12-16 18:28:26 +08:00
build/paddle_inference_install_dir/
2020-07-13 02:48:10 +08:00
|-- CMakeCache.txt
|-- paddle
|-- third_party
|-- version.txt
```
2020-12-16 18:28:26 +08:00
其中`paddle`就是C++预测所需的Paddle库`version.txt`中包含当前预测库的版本信息。
2020-07-13 02:48:10 +08:00
2021-09-09 15:08:56 +08:00
<a name="2"></a>
2020-07-13 21:09:58 +08:00
2020-07-13 02:48:10 +08:00
## 2 开始运行
2021-09-09 15:08:56 +08:00
<a name="21"></a>
2020-07-13 02:48:10 +08:00
### 2.1 将模型导出为inference model
* 可以参考[模型预测章节](../../doc/doc_ch/inference.md)导出inference model用于模型预测。模型导出之后假设放在`inference`目录下,则目录结构如下。
```
inference/
|-- det_db
2021-06-02 20:17:02 +08:00
| |--inference.pdiparams
| |--inference.pdmodel
2020-07-13 02:48:10 +08:00
|-- rec_rcnn
2021-06-02 20:17:02 +08:00
| |--inference.pdiparams
| |--inference.pdmodel
2020-07-13 02:48:10 +08:00
```
2021-09-09 15:08:56 +08:00
<a name="22"></a>
2020-07-13 02:48:10 +08:00
### 2.2 编译PaddleOCR C++预测demo
* 编译命令如下其中Paddle C++预测库、opencv等其他依赖库的地址需要换成自己机器上的实际地址。
2021-08-10 15:58:01 +08:00
```shell
2021-08-11 21:37:41 +08:00
sh tools/build.sh
2020-07-13 02:48:10 +08:00
```
2021-08-11 21:37:41 +08:00
* 具体的,需要修改`tools/build.sh`中环境路径,相关内容如下:
2020-07-13 21:05:36 +08:00
```shell
2020-07-13 21:09:58 +08:00
OPENCV_DIR=your_opencv_dir
LIB_DIR=your_paddle_inference_dir
CUDA_LIB_DIR=your_cuda_lib_dir
CUDNN_LIB_DIR=/your_cudnn_lib_dir
2020-07-13 21:05:36 +08:00
```
2021-08-10 15:58:01 +08:00
其中,`OPENCV_DIR`为opencv编译安装的地址`LIB_DIR`为下载(`paddle_inference`文件夹)或者编译生成的Paddle预测库地址(`build/paddle_inference_install_dir`文件夹)`CUDA_LIB_DIR`为cuda库文件地址在docker中为`/usr/local/cuda/lib64``CUDNN_LIB_DIR`为cudnn库文件地址在docker中为`/usr/lib/x86_64-linux-gnu/`。**注意:以上路径都写绝对路径,不要写相对路径。**
2020-07-13 21:05:36 +08:00
2021-08-11 21:37:41 +08:00
* 编译完成之后,会在`build`文件夹下生成一个名为`ppocr`的可执行文件。
2020-07-13 02:48:10 +08:00
2021-09-09 15:08:56 +08:00
<a name="23"></a>
2020-07-13 02:48:10 +08:00
2021-09-09 15:08:56 +08:00
### 2.3 运行demo
2021-08-11 21:37:41 +08:00
运行方式:
```shell
./build/ppocr <mode> [--param1] [--param2] [...]
2021-09-09 15:08:56 +08:00
```
2021-08-11 21:37:41 +08:00
其中,`mode`为必选参数,表示选择的功能,取值范围['det', 'rec', 'system'],分别表示调用检测、识别、检测识别串联(包括方向分类器)。具体命令如下:
##### 1. 只调用检测:
2020-07-13 02:48:10 +08:00
```shell
2021-08-11 21:37:41 +08:00
./build/ppocr det \
2021-08-10 21:07:57 +08:00
--det_model_dir=inference/ch_ppocr_mobile_v2.0_det_infer \
2021-08-10 15:58:01 +08:00
--image_dir=../../doc/imgs/12.jpg
```
2021-08-11 21:37:41 +08:00
##### 2. 只调用识别:
2021-08-10 15:58:01 +08:00
```shell
2021-08-11 21:37:41 +08:00
./build/ppocr rec \
2021-08-10 21:07:57 +08:00
--rec_model_dir=inference/ch_ppocr_mobile_v2.0_rec_infer \
2021-08-10 15:58:01 +08:00
--image_dir=../../doc/imgs_words/ch/
```
2021-08-11 21:37:41 +08:00
##### 3. 调用串联:
2021-08-10 15:58:01 +08:00
```shell
# 不使用方向分类器
2021-08-11 21:37:41 +08:00
./build/ppocr system \
2021-08-10 21:07:57 +08:00
--det_model_dir=inference/ch_ppocr_mobile_v2.0_det_infer \
--rec_model_dir=inference/ch_ppocr_mobile_v2.0_rec_infer \
2021-08-10 15:58:01 +08:00
--image_dir=../../doc/imgs/12.jpg
# 使用方向分类器
2021-08-11 21:37:41 +08:00
./build/ppocr system \
2021-08-10 21:07:57 +08:00
--det_model_dir=inference/ch_ppocr_mobile_v2.0_det_infer \
--use_angle_cls=true \
--cls_model_dir=inference/ch_ppocr_mobile_v2.0_cls_infer \
--rec_model_dir=inference/ch_ppocr_mobile_v2.0_rec_infer \
2021-08-10 15:58:01 +08:00
--image_dir=../../doc/imgs/12.jpg
```
更多参数如下:
2021-08-10 21:07:57 +08:00
- 通用参数
2021-08-10 15:58:01 +08:00
|参数名称|类型|默认参数|意义|
| --- | --- | --- | --- |
|use_gpu|bool|false|是否使用GPU|
|gpu_id|int|0|GPU id使用GPU时有效|
|gpu_mem|int|4000|申请的GPU内存|
|cpu_math_library_num_threads|int|10|CPU预测时的线程数在机器核数充足的情况下该值越大预测速度越快|
|use_mkldnn|bool|true|是否使用mkldnn库|
2021-08-10 21:07:57 +08:00
- 检测模型相关
|参数名称|类型|默认参数|意义|
| --- | --- | --- | --- |
2021-08-10 15:58:01 +08:00
|det_model_dir|string|-|检测模型inference model地址|
|max_side_len|int|960|输入图像长宽大于960时等比例缩放图像使得图像最长边为960|
|det_db_thresh|float|0.3|用于过滤DB预测的二值化图像设置为0.-0.3对结果影响不明显|
|det_db_box_thresh|float|0.5|DB后处理过滤box的阈值如果检测存在漏框情况可酌情减小|
|det_db_unclip_ratio|float|1.6|表示文本框的紧致程度,越小则文本框更靠近文本|
|use_polygon_score|bool|false|是否使用多边形框计算bbox scorefalse表示使用矩形框计算。矩形框计算速度更快多边形框对弯曲文本区域计算更准确。|
|visualize|bool|true|是否对结果进行可视化为1时会在当前文件夹下保存文件名为`ocr_vis.png`的预测结果。|
2021-08-10 21:07:57 +08:00
- 方向分类器相关
|参数名称|类型|默认参数|意义|
| --- | --- | --- | --- |
2021-08-10 15:58:01 +08:00
|use_angle_cls|bool|false|是否使用方向分类器|
|cls_model_dir|string|-|方向分类器inference model地址|
|cls_thresh|float|0.9|方向分类器的得分阈值|
2021-08-10 21:07:57 +08:00
- 识别模型相关
|参数名称|类型|默认参数|意义|
| --- | --- | --- | --- |
2021-08-10 15:58:01 +08:00
|rec_model_dir|string|-|识别模型inference model地址|
|char_list_file|string|../../ppocr/utils/ppocr_keys_v1.txt|字典文件|
* PaddleOCR也支持多语言的预测更多支持的语言和模型可以参考[识别文档](../../doc/doc_ch/recognition.md)中的多语言字典与模型部分,如果希望进行多语言预测,只需将修改`char_list_file`(字典文件路径)以及`rec_model_dir`inference模型路径字段即可。
2020-07-13 02:48:10 +08:00
最终屏幕上会输出检测结果如下。
<div align="center">
2021-04-14 11:25:02 +08:00
<img src="./imgs/cpp_infer_pred_12.png" width="600">
2020-07-13 02:48:10 +08:00
</div>
2020-07-14 14:45:52 +08:00
2021-09-09 15:08:56 +08:00
**注意在使用Paddle预测库时推荐使用2.0.0版本的预测库。**