国产成人AV无码一二三区,少女1到100集,国产精品久久久久精品综合紧,巜公妇之诱感肉欲HD在线播放

文章 > Python常见问题 > pdf如何用python读取?

pdf如何用python读取?

头像

yang

2020-05-28 16:00:373855浏览 · 0收藏 · 0评论

python中可以使用pdfminer库来读取PDF文件中的内容。

安装命令:

pip install pdfminer
pip install pdfminer3k

python中读取PDF文件代码:

from urllib.request import urlopen
from pdfminer.pdfinterp import PDFResourceManager, process_pdf
from pdfminer.converter import TextConverter
from pdfminer.layout import LAParams
from io import StringIO
from io import open

def readPDF(pdfFile):
    rsrcmgr = PDFResourceManager()
    retstr = StringIO()
    laparams = LAParams()
    device = TextConverter(rsrcmgr, retstr, laparams=laparams)

    process_pdf(rsrcmgr, device, pdfFile)
    device.close()

    content = retstr.getvalue()
    retstr.close()
    return content

pdfFile = urlopen("http://pythonscraping.com/pages/warandpeace/chapter1.pdf")
outputString = readPDF(pdfFile)
print(outputString)
pdfFile.close()

解析pdf文件用到的类:

PDFParser:从一个文件中获取数据

PDFDocument:保存获取的数据,和PDFParser是相互关联的

PDFPageInterpreter处理页面内容

PDFDevice将其翻译成你需要的格式

PDFResourceManager用于存储共享资源,如字体或图像。

更多Python知识请关注Python自学网

关注

关注公众号,随时随地在线学习

本教程部分素材来源于网络,版权问题联系站长!

星空无痕MV免费视频观看| 强壮的公2伦理| 全飞秒手术2024价目表| 无人区免费观看高清电视剧| 姐姐呀姐姐快停下是什么歌曲| 妈妈你真棒里面的插曲叫什么| 双乳被四个男人吃奶动态图 | 女子蹲下尿裤子的视频| 巨乳童颜| 蜜桃| 停电了同桌把我拉入怀中小说 | 露全胸衣服| 线人2009| 坤坤寒进桃子里在线看歌词 | 彩浸福利| 惠灵顿牛排| 《办公室高潮秘书2》| 火车上荫蒂添的好舒服图片| 女被扒开腿狂躁XXXXX视频| 免费高清在线观看免费的PPT软..| 亚洲精品久久久久久久| 老卫抱着淑蓉进房间导演是谁| 我的女老师| 老公刚日完又让朋友日| 越南校服| 两个奶头被吃得又翘又肿特别疼| 午马影视免费观看电视剧| 《疯狂伴娘》在线观看| 《炸裂吧!巨棒》免费阅读漫画 | 男按摩师舌头伸进去了SPA漫画| 被两个男人吃奶三P| 东北老阿姨高清免费观看电视剧 | 7777影院免费观看电视剧大全| 妹妹的性放荡日记H| 女性三角毛毛区有片毛掉光正常吗| 《性爽2》电影| 《无能的丈夫》完整版| WWW.1688.COM麻豆.| 日本MV与欧美MV的区别| 麻花星空影视在线看电视免费版| 日产无码久久久久久精品红桃