uipath自带OCR识别图片内容,判断文件类型对文件做筛选(发票、文件)
场景描述:
文件夹中包含多种类型的文件,例如包含增值税普票、增值税专票、火车票、打车票、行程单等多种单据,但是文件都在内网环境下(不能连接访问公网),只能在内网做文件识别或筛选。
解决方案:
1.首先在内网环境下利用uipath自带的OCR对文件做初步筛选,过滤掉敏感文件,
2.将需要的文件拿到外网环境下利用外网接口(百度AI识别、阿里AI识别)做进一步识别,对识别后的内容做数据处理整理。
遇到问题:
图片的角度对uipath自带的OCR识别准确率有影响,如果上传的图片是倒立的,有可能识别不出来,但是通过旋转180后,有可能能够识别成功。通过uipath自带的组件,对识别失败的图片进行指定角度的旋转,再次进行识别,提高图片识别的准确率。
Uipath解决方案:
1.需要提前下载图片旋转组件