中文字幕av专区_日韩电影在线播放_精品国产精品久久一区免费式_av在线免费观看网站

溫馨提示×

溫馨提示×

您好,登錄后才能下訂單哦!

密碼登錄×
登錄注冊×
其他方式登錄
點擊 登錄注冊 即表示同意《億速云用戶服務條款》

pdf用python讀取的方法

發布時間:2020-07-02 14:21:36 來源:億速云 閱讀:201 作者:清晨 欄目:編程語言

這篇文章主要介紹pdf用python讀取的方法,文中示例代碼介紹的非常詳細,具有一定的參考價值,感興趣的小伙伴們一定要看完!

python中可以使用pdfminer庫來讀取PDF文件中的內容。

安裝命令:

pip install pdfminer
pip install pdfminer3k

python中讀取PDF文件代碼:

from urllib.request import urlopen
from pdfminer.pdfinterp import PDFResourceManager, process_pdf
from pdfminer.converter import TextConverter
from pdfminer.layout import LAParams
from io import StringIO
from io import open

def readPDF(pdfFile):
    rsrcmgr = PDFResourceManager()
    retstr = StringIO()
    laparams = LAParams()
    device = TextConverter(rsrcmgr, retstr, laparams=laparams)

    process_pdf(rsrcmgr, device, pdfFile)
    device.close()

    content = retstr.getvalue()
    retstr.close()
    return content

pdfFile = urlopen("http://pythonscraping.com/pages/warandpeace/chapter1.pdf")
outputString = readPDF(pdfFile)
print(outputString)
pdfFile.close()

解析pdf文件用到的類:

PDFParser:從一個文件中獲取數據

PDFDocument:保存獲取的數據,和PDFParser是相互關聯的

PDFPageInterpreter處理頁面內容

PDFDevice將其翻譯成你需要的格式

PDFResourceManager用于存儲共享資源,如字體或圖像。

以上是pdf用python讀取的方法的所有內容,感謝各位的閱讀!希望分享的內容對大家有幫助,更多相關知識,歡迎關注億速云行業資訊頻道!

向AI問一下細節

免責聲明:本站發布的內容(圖片、視頻和文字)以原創、轉載和分享為主,文章觀點不代表本網站立場,如果涉及侵權請聯系站長郵箱:is@yisu.com進行舉報,并提供相關證據,一經查實,將立刻刪除涉嫌侵權內容。

AI

盈江县| 临泉县| 分宜县| 高邑县| 通河县| 大同市| 遵义市| 惠东县| 五莲县| 张家港市| 佳木斯市| 镇巴县| 淮安市| 堆龙德庆县| 沂南县| 剑川县| 惠安县| 稻城县| 东乌珠穆沁旗| 北票市| 广水市| 琼中| 介休市| 奉新县| 钦州市| 上林县| 夹江县| 临高县| 东乡| 陆良县| 平利县| 广宗县| 磐石市| 佛教| 仁布县| 鹰潭市| 东光县| 汉沽区| 五华县| 容城县| 章丘市|