通用文字识别 - 高精度版(含位置信息)
拉起相机拍照后识别,识别精度高于 general,结果包含文字坐标位置
(words_result 数组的 location 字段,开启 vertexesLocation 时返回 vertexes_location)。
可选data: GeneralLocationScanData识别参数(可选)
识别结果(服务端原始 JSON)
通用文字识别 - 高精度版(基础版,无位置信息)
拉起相机拍照后识别,识别精度高于 generalBasic。
结果 JSON 的 words_result 数组包含识别文本(words 字段)。
可选data: GeneralScanData识别参数(可选)
识别结果(服务端原始 JSON)
银行卡识别
拉起相机拍照识别银行卡卡号、发卡行及卡片类型(借记卡/信用卡)。
结果 JSON 包含 bank_card_number、bank_name、bank_card_type 等字段。
可选data: ScanData通用识别参数(可选)
识别结果(服务端原始 JSON)
名片识别
拉起相机拍照识别名片上的姓名、电话、公司、职位等字段。
可选data: CommonScanData通用卡证识别参数(可选)
识别结果(服务端原始 JSON)
营业执照识别
拉起相机拍照识别营业执照的注册号、有效期、法人姓名、地址、名称等关键字段。
可选data: CommonScanData通用卡证识别参数(可选)
识别结果(服务端原始 JSON)
iOCR 自定义模板文字识别
拉起相机拍照后按自定义模板识别,模板在百度智能云 iOCR 控制台创建。
自定义模板识别参数(templateSign 必填)
识别结果(服务端原始 JSON)
驾驶证识别
拉起相机拍照识别驾驶证所有关键字段(证号、姓名、性别、准驾车型、有效期等)。
可选data: CommonScanData通用卡证识别参数(可选)
识别结果(服务端原始 JSON)
通用文字识别(含位置信息)
拉起相机拍照后识别,识别结果包含每个文字的坐标位置
(words_result 数组的 location 字段,开启 vertexesLocation 时返回 vertexes_location)。
可选data: GeneralLocationScanData识别参数(可选)
识别结果(服务端原始 JSON)
通用文字识别(基础版,无位置信息)
拉起相机拍照后识别,识别结果中仅包含识别文本,不含文字位置信息。
结果 JSON 的 words_result 数组包含识别文本(words 字段)。
可选data: GeneralScanData识别参数(可选)
识别结果(服务端原始 JSON)
通用文字识别(含生僻字版)
拉起相机拍照后识别,对生僻字、多语言等复杂场景识别效果更好。
结果 JSON 的 words_result 数组包含识别文本(words 字段)。
可选data: GeneralScanData识别参数(可选)
识别结果(服务端原始 JSON)
港澳台证件识别
拉起相机拍照识别港澳通行证、台湾通行证、台胞证、返乡证等出入境许可证件。
港澳台证件识别参数(exitentrypermitType 必填)
识别结果(服务端原始 JSON)
身份证 - 背面识别(手动拍照)
拉起相机手动拍照识别身份证背面(国徽面)各字段:签发机关、签发日期、失效日期。
可选data: IdCardScanData身份证识别参数(可选)
识别结果(服务端原始 JSON,words_result 包含各字段识别结果)
身份证 - 背面识别(自动采集)
相机检测到身份证背面后自动拍照识别,无需用户点按拍照按钮;
自动采集依赖本地质量检测模型与 License 文件(initSdk 中配置),
License 不可用时自动退回手动拍照。
可选data: IdCardScanData身份证识别参数(可选)
识别结果(服务端原始 JSON,words_result 包含各字段识别结果)
身份证 - 正面识别(手动拍照)
拉起相机手动拍照识别身份证正面(头像面)各字段:姓名、民族、性别、出生日期、住址、身份证号码。
可选data: IdCardScanData身份证识别参数(可选)
识别结果(服务端原始 JSON,words_result 包含各字段识别结果)
身份证 - 正面识别(自动采集)
相机检测到身份证正面后自动拍照识别,无需用户点按拍照按钮;
自动采集依赖本地质量检测模型与 License 文件(initSdk 中配置),
License 不可用时自动退回手动拍照。
可选data: IdCardScanData身份证识别参数(可选)
识别结果(服务端原始 JSON,words_result 包含各字段识别结果)
初始化 OCR SDK
注册在线识别能力并完成鉴权预校验,应用生命周期内建议只初始化一次; 重复调用会先释放旧实例再重新初始化。 access_token 的获取方式参考 获取 access_token。
初始化参数
初始化结果(支持识别的类型列表与 SDK 版本号)
护照识别
拉起相机拍照识别中国大陆居民护照资料页(姓名、性别、国籍、护照号、有效期等)。
可选data: CommonScanData通用卡证识别参数(可选)
识别结果(服务端原始 JSON)
二维码识别
拉起相机拍照识别图片中的二维码/条形码内容。
可选data: CommonScanData通用卡证识别参数(可选)
识别结果(服务端原始 JSON)
通用票据识别
拉起相机拍照识别各类票据的关键字段。
可选data: CommonScanData通用卡证识别参数(可选)
识别结果(服务端原始 JSON)
直接图片识别(无 UI)
不拉起相机采集页,直接对传入的图片进行识别, 适用于自定义相机、批量识别、服务端图片下发等场景。
直接识别请求(type 与图片来源必填)
识别结果(服务端原始 JSON)
移除监听器
通用扫描识别(带 UI)
拉起相机拍照识别任意 SDK 支持的识别类型,覆盖未提供专用方法的扩展类型 (社保卡、户口本、结婚证、VIN 码、快递面单等)。
通用扫描识别请求(type 必填)
识别结果(服务端原始 JSON)
设置监听器,接收 eventName 事件名称,data 事件数据
注意: 此接口为覆盖操作,仅保留最后一个监听器,最后的 listener 才能收到事件通知。
增值税发票识别
拉起相机拍照识别增值税发票关键字段(发票代码、发票号码、开票日期、金额等)。
可选data: CommonScanData通用卡证识别参数(可选)
识别结果(服务端原始 JSON)
行驶证识别
拉起相机拍照识别行驶证正副页所有关键字段(号牌号码、车辆类型、所有人、使用性质等)。
可选data: CommonScanData通用卡证识别参数(可选)
识别结果(服务端原始 JSON)
网络图片文字识别
拉起相机拍照后识别,针对网络图片进行专项优化。
结果 JSON 的 words_result 数组包含识别文本(words 字段)。
可选data: GeneralScanData识别参数(可选)
识别结果(服务端原始 JSON)
百度文字识别(百度智能云 OCR)
基于百度 OCR HarmonyOS SDK 封装,支持在线 API 鉴权、带 UI 相机扫描识别与无 UI 直接图片识别。
initSdk完成初始化(需在用户同意隐私协议后调用)module.json5中声明(ohos.permission.CAMERA,必须包含reason字段); 调用扫描识别时插件会自动申请相机权限,用户拒绝授权会返回错误码PERMISSION_DENIED示例