處理pdf文檔
第一、
從文本中提取文本

第二、
創(chuàng)建PDF
兩種方法

#使用PdfFileWriterimport PyPDF2 pdfFiles = []for filename in os.listdir('.'):if filename.endswith('.pdf'):pdfFiles.append(filename)print(pdfFiles)pdfWriter = PyPDF2.PdfFileWriter() pdfFileObj = open(pdfFiles[0],'rb')pdfReader = PyPDF2.PdfFileReader(pdfFileObj) # 得到PdfFileReader對象first,end =map(int,input('從多少頁到多少頁(用空格隔開):').split())for pageNum in range(first-1,end):pageObj = pdfReader.getPage(pageNum)pdfWriter.addPage(pageObj)pdfOutput = open ('split_pdf.pdf','wb')pdfWriter.write(pdfOutput)pdfOutput.close() 
#使用PdfFileMerger()import PyPDF2merger = PyPDF2.PdfFileMerger()a = [str(i)+'webbook.pdf'for i in range(0,124)]for i in a:print(i)merger.append(open(i,'rb'))print("合并完成第"+str(i))with open('combintion.pdf','wb') as f:merger.write(f)總結(jié)
以上就是本文關(guān)于淺談Python處理PDF的全部內(nèi)容,希望對大家有所幫助。有什么問題可以隨時留言,小編會及時回復大家的。感謝朋友們對本站的支持!
新聞熱點
疑難解答
圖片精選