本文實例講述了Python實現批量讀取word中表格信息的方法。分享給大家供大家參考。具體如下:
單位收集了很多word格式的調查表,領導需要收集表單里的信息,我就把所有調查表放一個文件里,寫了個python小程序把所需的信息打印出來
#coding:utf-8import osimport win32comfrom win32com.client import Dispatch, constantsfrom docx import Documentdef parse_doc(f): """讀取doc,返回姓名和行業 """ doc = w.Documents.Open( FileName = f ) t = doc.Tables[0] # 根據文件中的圖表選擇信息 name = t.Rows[0].Cells[1].Range.Text situation = t.Rows[0].Cells[5].Range.Text people = t.Rows[1].Cells[1].Range.Text title = t.Rows[1].Cells[3].Range.Text print name, situation, people,title doc.Close()def parse_docx(f): """讀取docx,返回姓名和行業 """ d = Document(f) t = d.tables[0] name = t.cell(0,1).text situation = t.cell(0,8).text people = t.cell(1,2).text title = t.cell(1,8).text print name, situation, people,titleif __name__ == "__main__": w = win32com.client.Dispatch('Word.Application') # 遍歷文件 PATH = "H:/work//aaa" # windows文件路徑 doc_files = os.listdir(PATH) for doc in doc_files: if os.path.splitext(doc)[1] == '.docx': try: parse_docx(PATH+'//'+doc) except Exception as e: print e elif os.path.splitext(doc)[1] == '.doc': try: parse_doc(PATH+'//'+doc) except Exception as e: print e希望本文所述對大家的Python程序設計有所幫助。
新聞熱點
疑難解答
圖片精選