Uipath PDF 自动化详解

Uipath PDF 自动化详解


PDF 活动组件

下载Uipath.PDF.Activities

Uipath.PDF.Activities 包含从PDF文件中提取数据并将其存储到字符串变量中的活动。默认创建项目时不包含Uipath.PDF.Activities 程序包,需手工下载安装。

在这里插入图片描述
Uipath.PDF.Activities 包含活动清单如下:
在这里插入图片描述

1 Read PDF Text-读取PDF文件

1.1. Read PDF Text 活动说明

Read PDF Text 读取PDF文件
描述:从指定的PDF文件读取所有字符,并将提取的所有内容存储在字符串变量中。
在这里插入图片描述

1.2.示例

创建一个项目,新建一个Sequence文件,命名为ReadPDFText.xaml,在序列里添加Read PDF Text活动。
FileName 设置为"Data\Input\invoice\油票01-0906.pdf“
Range 设置为All,默认读取所有数据
Text 设置为变量pdfText(String 类型)
通过Log Message 将变量pdfText 打印出来
在这里插入图片描述

2 Read PDF With OCR-使用OCR读取PDF

2.1. Read PDF With OCR 活动说明

Read PDF With OCR 使用OCR读取PDF
描述:使用 OCR 技术读取指定 PDF 文件中的所有字符,并将它们存储在字符串变量中。
在这里插入图片描述

2.2.示例

创建一个项目,新建一个Sequence文件,命名为OCRPDFText.xaml,在序列里添加Read PDF With OCR活动。
FileName 设置为"Data\Input\invoice\油票01-0906.pdf“
Range 设置为All,默认读取所有数据
Text 设置为变量ocrPDFText (String 类型)
通过Log Message 将变量pdfText 打印出来
提示:Read PDF With OCR 需结合OCR 引擎活动,本示例采用Microsoft OCR,如果OCR引擎识别不高,可采用其他的引擎来替换尝试。

在这里插入图片描述

3 Join PDF Files-合并PDF 文件

3.1. Join PDF Files活动说明

Join PDF Files-合并PDF 文件
描述:将存储在字符串数组中的多个PDF文件合并到单个PDF文件,适用于将多个文件合并成一个PDF文件场景。

在这里插入图片描述

3.2.示例

创建一个项目,新建一个Sequence文件,命名为joinPdf.xaml,在序列里添加Join PDF Files活动。
FileList 设置为字符串数组,
{
“D:\pingesoft\rpa\RPA录制\Code\Uipath PDF自动化\code\Data\Input\invoice\油票300-0828.pdf”,
"D:\pingesoft\rpa\RPA录制\Code\Uipath PDF自动化\code\Data\Input\invoice\油票300-0827.pdf“
}
OutputFileName 设置 合并后的新PDF文件为 “joinPdf.pdf”

在这里插入图片描述

4 Extract Images From PDF-从PDF中提取图像

4.1. Extract Images From PDF 活动说明

Extract Images From PDF-从PDF中提取图像
描述:从指定PDF文件中,将页面导出图像格式。
在这里插入图片描述

4.2.示例

创建一个项目,新建一个Sequence文件,命名为ImgePdf.xaml,在序列里添加Extract Images From PDF活动。
FileName 设置为 “Data\Input\invoice\油票300-0827.pdf”
OutputFileName 设置为 "D:\pingesoft\rpa\RPA录制\Code\Uipath PDF自动化\code\Data\Output“
ImageExtension 设置为PNG
在这里插入图片描述

5 PDF Page As Image-将PDF 页面导出为图像

5.1. PDF Page As Image 活动说明

PDF Page As Image-将PDF 页面导出为图像
描述:从指定 PDF 文件中的页面创建图像。
在这里插入图片描述

5.2.示例

创建一个项目,新建一个Sequence文件,命名为ExportPDFImge.xaml,在序列里添加Export PDF Page As Image活动。
FileName 设置为 “Data\Input\invoice\油票300-0827.pdf”
OutputFileName 设置为 "D:\pingesoft\rpa\RPA录制\Code\Uipath PDF自动化\code\Data\Output“
ImageExtension 设置为PNG
在这里插入图片描述

6 Extract PDF Page Range-提取PDF 页面范围

6.1. Extract PDF Page Range活动说明

Extract PDF Page Range-提取PDF 页面范围
描述:从 PDF 文档中提取指定范围的页面。
在这里插入图片描述

6.2.示例

创建一个项目,新建一个Sequence文件,命名为PdfRange.xaml,在序列里添加Extract PDF Page Range活动。
FileName 设置为 “Data\Input\invoice\油票300-0827.pdf”
OutputFileName 设置为 "Data\Output\rangeTest.pdf“
Range 设置为”2“,提取第二页pdf文件

在这里插入图片描述

7 Get PDF Page Count-获取PDF页数

7.1. Get PDF Page Count活动说明

Get PDF Page Count-获取PDF页数
描述:获取指定PDF文件页数。
FileName 设置需指定的PDF文件路径
PageCount 设置输出的PDF页数变量
在这里插入图片描述

8 Manage PDF Password-管理PDF密码

8.1. Manage PDF Password活动说明

Manage PDF Password-管理PDF密码
描述:管理更改指定 PDF 文件的密码。
FileName 设置需指定的PDF文件路径
OutputFileName 将FileName加密后的PDF文件名称
NewOwnerPassword 指定的PDF文件设置的新所有者密码
NewUserPassword 指定的PDF文件设置的新用户密码
OldOwnerPassword 用户的旧密码,用于修改某些文档限制
OldUserPassword 用户的旧密码,以只读模式打开文档时,需要使用此密码
eg: NewOwnerPassword 所有者密码为”123456x” NewUserPassword 打开只读pdf 密码为“987654321x“
在这里插入图片描述
在这里插入图片描述

  • 1
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值