中文字幕av专区_日韩电影在线播放_精品国产精品久久一区免费式_av在线免费观看网站

溫馨提示×

溫馨提示×

您好,登錄后才能下訂單哦!

密碼登錄×
登錄注冊×
其他方式登錄
點擊 登錄注冊 即表示同意《億速云用戶服務條款》

怎么使用Python提取Word中的圖片

發布時間:2022-07-19 17:13:06 來源:億速云 閱讀:318 作者:iii 欄目:開發技術

這篇文章主要介紹“怎么使用Python提取Word中的圖片”,在日常操作中,相信很多人在怎么使用Python提取Word中的圖片問題上存在疑惑,小編查閱了各式資料,整理出簡單好用的操作方法,希望對大家解答”怎么使用Python提取Word中的圖片”的疑惑有所幫助!接下來,請跟著小編一起來學習吧!

    1.思路

    在網上查找了半天,基本都是提取word中文字的,沒有找到可以把word中的圖片提取出來的方法。一個巧合的情況下,發現將word的后綴名改為zip,然后解壓該zip,可以看到原來word是這樣存儲的:

    怎么使用Python提取Word中的圖片

    圖片就存放在固定的文件夾下:/word/media/;

    怎么使用Python提取Word中的圖片

    那么我們就只需要批量的修改文件后綴名,并且解壓之后將圖片拷貝到需要存放的地方,然后將該文件夾清空留作下次的路徑,并且將文件從zip改回docx即可。(注意:doc不支持這個方法,如果需要提取doc格式的圖片,可以先轉為docx,再提取即可)

    2.具體實現

    2.1導入相關庫

    '''
    ===========================================
      @author:  renjiaxin
      @time:    2018/8/9 0009   10:00
    ===========================================
    '''
     
    import zipfile
    import os
    import shutil

    2.2定義函數

    為了方便和其他函數調用,直接寫了個函數完成這個功能,在這里,我們需要以下四個參數:

    • word文檔的路徑

    • zip壓縮文件的路徑

    • 臨時解壓的tmp路徑

    • 最后需要保存的store_path路徑

    def word2pic(path, zip_path, tmp_path, store_path):
        '''
        :param path:源文件
        :param zip_path:docx重命名為zip
        :param tmp_path:中轉圖片文件夾
        :param store_path:最后保存結果的文件夾(需要手動創建)
        :return:
        '''

    2.3重命名word文件,將后綴名docx改為zip

        # 將docx文件重命名為zip文件
        os.rename(path, zip_path)
        # 進行解壓
        f = zipfile.ZipFile(zip_path, 'r')
        # 將圖片提取并保存
        for file in f.namelist():
            f.extract(file, tmp_path)
        # 釋放該zip文件
        f.close()

    2.4zip還原為docx文件,并獲得圖片的列表

        # 將docx文件從zip還原為docx
        os.rename(zip_path, path)
        # 得到緩存文件夾中圖片列表
        pic = os.listdir(os.path.join(tmp_path, 'word/media'))

    2.5將圖片復制到需要保存的文件夾中

    并且我們將文件的名字命名為word所在的路徑

        # 將圖片復制到最終的文件夾中
        for i in pic:
            # 根據word的路徑生成圖片的名稱
            new_name = path.replace('\\', '_')
            new_name = new_name.replace(':', '') + '_' + i
            shutil.copy(os.path.join(tmp_path + '/word/media', i), os.path.join(store_path, new_name))

    2.6刪除tmp緩沖文件夾中的文件,用以存儲下一次的文件

        # 刪除緩沖文件夾中的文件,用以存儲下一次的文件
        for i in os.listdir(tmp_path):
            # 如果是文件夾則刪除
            if os.path.isdir(os.path.join(tmp_path, i)):
                shutil.rmtree(os.path.join(tmp_path, i))

    2.7運行程序

    if __name__ == '__main__':
        # 源文件
        path = r'E:\dogcat\提取圖片\log.docx'
        # docx重命名為zip
        zip_path = r'E:\dogcat\提取圖片\log.zip'
        # 中轉圖片文件夾
        tmp_path = r'E:\dogcat\提取圖片\tmp'
        # 最后保存結果的文件夾
        store_path = r'E:\dogcat\提取圖片\測試'
        m = word2pic(path, zip_path, tmp_path, store_path)

    3效果預覽

    3.1源word

    怎么使用Python提取Word中的圖片

    3.2提取的圖片

    怎么使用Python提取Word中的圖片

    4附:doc轉docx

    from win32com import client
    import traceback
     
    def doc2docx(doc_name, docx_name):
        '''
        # doc轉docx
        :param doc_name: doc文檔路徑
        :param docx_name: docx文檔路徑
        :return:
        '''
        try:
            # 首先將doc轉換成docx
            word = client.Dispatch("Word.Application")
            doc = word.Documents.Open(doc_name)
            # 使用參數16表示將doc轉換成docx
            doc.SaveAs(docx_name, 16)
            doc.Close()
            word.Quit()
        except:
            traceback.print_exc()

    到此,關于“怎么使用Python提取Word中的圖片”的學習就結束了,希望能夠解決大家的疑惑。理論與實踐的搭配能更好的幫助大家學習,快去試試吧!若想繼續學習更多相關知識,請繼續關注億速云網站,小編會繼續努力為大家帶來更多實用的文章!

    向AI問一下細節

    免責聲明:本站發布的內容(圖片、視頻和文字)以原創、轉載和分享為主,文章觀點不代表本網站立場,如果涉及侵權請聯系站長郵箱:is@yisu.com進行舉報,并提供相關證據,一經查實,將立刻刪除涉嫌侵權內容。

    AI

    加查县| 乳山市| 信宜市| 自治县| 连山| 甘孜县| 山阳县| 盐津县| 信宜市| 嵊州市| 白玉县| 马边| 嘉善县| 台中县| 四子王旗| 石泉县| 焉耆| 长岭县| 鹤庆县| 克山县| 广宁县| 泸定县| 玛纳斯县| 宁夏| 从化市| 张家界市| 绥德县| 垫江县| 化州市| 南岸区| 建宁县| 屏边| 黄大仙区| 澎湖县| 贞丰县| 北碚区| 梁河县| 高台县| 白朗县| 济源市| 肃宁县|