【鸿蒙南向开发】OpenHarmony集成OCR三方库实现文字提取

1. 简介

Tesseract(Apache 2.0 License)是一个可以进行图像OCR识别的C++库，可以跨平台运行。本样例基于Tesseract库进行适配，使其可以运行在OpenAtom OpenHarmony（以下简称“OpenHarmony”）上，并新增N-API接口供上层应用调用，这样上层应用就可以使用Tesseract提供的相关功能。

2. 效果展示

动物图片识别文字

在这里插入图片描述

身份信息识别

在这里插入图片描述

提取文字信息到本地文件

在这里插入图片描述

3. 目录结构

在这里插入图片描述

4. 调用流程

在这里插入图片描述

调用过程主要涉及到三方面，首先应用层实现样例的效果，包括页面的布局和业务逻辑代码；中间层主要起桥梁的作用，提供N-API接口给应用调用，再通过三方库的接口去调用具体的实现；Native层使用了三方库Tesseract提供具体的实现功能。

5. 源码分析

本样例源码的分析主要涉及到两个方面，一方面是N-API接口的实现，另一方面是应用层的页面布局和业务逻辑。

N-API实现

首先在index.d.ts文件中定义好接口

/**
 * 初始化文字识别引擎
 * @param lang 识别的语言, eg:eng、chi_sim、 eng+chi_sim,为Null或不传则为中英文（eng+chi_sim）
 * @param trainDir 训练模型目录，为Null或不传则为默认目录
 *
 * @return 初始化是否成功 0=>成功，-1=>失败
 */
export const initOCR: (lang: string, trainDir: string) => Promise<number>;

export const initOCR: (lang: string, trainDir: string, callback: AsyncCallback<number>) => void;

/**
 * 开始识别
 * @param imagePath 图片路径（当前支持的图片格式为png, jpg, tiff）
 *
 * @return 识别结果
 */
export const startOCR: (imagePath: string) => Promise<string>;
export const startOCR: (imagePath: string, callback: AsyncCallback<string>) => void;


/**
 * 销毁资源
 */
export const destroyOCR: () => void;

代码中可以看出N-API接口initOCR和startOCR都采用了两种方式，一种是Promise，一种是Callback的方式。在样例的应用层，使用的是它们的Callback方式。

2 注册N-API模块和接口

EXTERN_C_START
static napi_value Init(napi_env env, napi_value exports) {
napi_property_descriptor desc[] = {
{
"initOCR", nullptr, InitOCR, nullptr, nullptr, nullptr, napi_default, nullptr
},
{
"startOCR", nullptr, StartOCR, nullptr, nullptr, nullptr, napi_default, nullptr
},
{
"destroyOCR", nullptr, DestroyOCR, nullptr, nullptr, nullptr, napi_default, nullptr
},
{
};
napi_define_properties(env, exports, sizeof(desc) / sizeof(desc[0]), desc);
return exports;
}
EXTERN_C_END

static napi_module demoModule = {
.nm_version = 1,
.nm_flags = 0,
.nm_file