pdf转图片

最新推荐文章于 2024-09-05 10:28:02 发布

亼小自

最新推荐文章于 2024-09-05 10:28:02 发布

阅读量135

点赞数

文章标签： python

本文链接：https://blog.csdn.net/weixin_37572260/article/details/114312521

版权

因公司业务目前需要对PDF进行识别，目前先做PDF转图片功能

在此记录，如有错误请各位指正

import fitz 
import os
import datetime


def pyMuPDF_fitz(pdfPath, imagePath):
    startTime_pdf2img = datetime.datetime.now()  # 开始时间

    print("imagePath=" + imagePath)
    pdfDoc = fitz.open(pdfPath)
    for pg in range(pdfDoc.pageCount):
        page = pdfDoc[pg]
        rotate = int(0)
        # 每个尺寸的缩放系数为1.3，这将为我们生成分辨率提高2.6的图像。
        # 此处若是不做设置，默认图片大小为：792X612, dpi=72
        zoom_x = 1.33333333  # (1.33333333-->1056x816)   (2-->1584x1224)
        zoom_y = 1.33333333
        mat = fitz.Matrix(zoom_x, zoom_y).preRotate(rotate)
        pix = page.getPixmap(matrix=mat, alpha=False)

        if not os.path.exists(imagePath):  # 判断存放图片的文件夹是否存在
            os.makedirs(imagePath)  # 若图片文件夹不存在就创建
        pdfName = pdfPath.split('.')[0]
        pix.writePNG(imagePath + '/' + pdfName + '_%s.png' % pg)  # 将图片写入指定的文件夹内

    endTime_pdf2img = datetime.datetime.now()  # 结束时间
    print('pdf2img时间=', (endTime_pdf2img - startTime_pdf2img).seconds)


if __name__ == "__main__":
    pdfPath = 'text.pdf'
    imagePath = 'image'
    pyMuPDF_fitz(pdfPath, imagePath)

亼小自

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
1
评论
pdf转图片

因公司业务目前需要对PDF进行识别，目前先做PDF转图片功能在此记录，如有错误请各位指正import fitz import osimport datetimedef pyMuPDF_fitz(pdfPath, imagePath): startTime_pdf2img = datetime.datetime.now() # 开始时间 print("imagePath=" + imagePath) pdfDoc = fitz.open(pdfPath)
复制链接

扫一扫