国产成人AV无码一二三区,少女1到100集,国产精品久久久久精品综合紧,巜公妇之诱感肉欲HD在线播放

文章 > Python常见问题 > pdf如何用python读取?

pdf如何用python读取?

头像

yang

2020-05-28 16:00:373855浏览 · 0收藏 · 0评论

python中可以使用pdfminer库来读取PDF文件中的内容。

安装命令:

pip install pdfminer
pip install pdfminer3k

python中读取PDF文件代码:

from urllib.request import urlopen
from pdfminer.pdfinterp import PDFResourceManager, process_pdf
from pdfminer.converter import TextConverter
from pdfminer.layout import LAParams
from io import StringIO
from io import open

def readPDF(pdfFile):
    rsrcmgr = PDFResourceManager()
    retstr = StringIO()
    laparams = LAParams()
    device = TextConverter(rsrcmgr, retstr, laparams=laparams)

    process_pdf(rsrcmgr, device, pdfFile)
    device.close()

    content = retstr.getvalue()
    retstr.close()
    return content

pdfFile = urlopen("http://pythonscraping.com/pages/warandpeace/chapter1.pdf")
outputString = readPDF(pdfFile)
print(outputString)
pdfFile.close()

解析pdf文件用到的类:

PDFParser:从一个文件中获取数据

PDFDocument:保存获取的数据,和PDFParser是相互关联的

PDFPageInterpreter处理页面内容

PDFDevice将其翻译成你需要的格式

PDFResourceManager用于存储共享资源,如字体或图像。

更多Python知识请关注Python自学网

关注

关注公众号,随时随地在线学习

本教程部分素材来源于网络,版权问题联系站长!

法国《监狱伦理3》| 灵媒| 潮湿的体温2| 强多干伦久久久久久久久| 《停不了的爱》床戏| 上课被同桌揉搓到高潮H| 《出租屋1》| 啄木鸟军舰女兵3法版| 正常硬度是多硬| 初三小奶长得怎么样| 我的姨母中字ID| 我把刘姨俩腿扛在肩上是哪一集的 | YY影院免费观看电视剧网站| 电视剧在线观看免费 | 可切换老司机模式浏览器| 一线产区和二线产区的标准图| 麻豆传媒| 私处按摩SPA养生精油| 臭小子快拔出来危险期会怀孕| 亚洲尺码和欧洲尺码的区别在哪在.. | 小B又骚又紧日不死你视频免费| 《后宫狂热》动浸全集完整 | 暴躁少女免费看完整版| 两阳夹一阴与其他强势形态的比较 | 《公的浮之手中字》免费| 99YE| 《哺乳》电影完整版观看| 只有几根带子遮住重要部位 | 打开网站免费进入| 妈妈叫我戴上避孕套英文| 坤坤寒入桃子里电视剧| 美女和老板一起努力做豆浆| .公与媳2电视剧免费| 扌暴辶鬲和扌暴辶的区别| 《尼姑庵春梦》| 免费观看已满十八岁电视剧中文版..| 美女被咬小头头视频大全| 夹子夹R头多久| 《开裆裤》法国1980年 | 当着全班面被C到高潮哭视频| 《酒店激战》动漫1-5集免费观..