从PDF文件提取表格

使用page对象的extract_table方法提取指定页中的单个表格。如果页面有多个表格,我们可以使用extract_tables方法提取。提取结果是一个二维列表,里面每一行是一个元素,每一行本身又是一个列表,作为二维列表的元素,里面这个子列表就是这一行的所有数据。

code.python
>>> import pdfplumber as pp
>>> pdf=pp.open('D:\\test.pdf')
>>> pg1=pdf.pages[1]
>>> tbl=pg1.extract_table()    #单个表格
>>> #tbl2=pg1.extract_tables()    #多个表格