python中使用tabula爬取pdf數據並導出表格

Tabula是專門用來提取PDF表格數據的,同時支持PDF導出CSV、Excel格式。 首先安裝tabula-py: tabula-py依賴庫包括Java、pandas、numpy所以需要保證運行環境中安裝了這些庫。 在Python中配置好Java後看能否正常運行 把PDF中爬取出來的數據製成表格,需要加載openpyxl: 需要讀取平均頁數有二三百多頁的PDF文件數據,爬取出需求數據,以及按需求
相關文章
相關標籤/搜索