Python中怎样把html网页转换成pdf

998次阅读
没有评论
Python中怎样把html网页转换成pdf

当我们看到一篇好文章时,难免会有想保存的想法,但是会存在作者删除了文章或者链接丢失的情况。所以今天小编教大家如何在Python中把html网页转换成pdf。

Python里面有个模块是pdfkit,他可以帮咱们把一个html(也就是一个网页)变成一个pdf文件。

pdfkit是Python对wkhtmltopdf这个把网页转成pdf工具的一个封装,所以咱们必须得先安装一个wkhtmltopdf,这个工具的下载网站是:https://wkhtmltopdf.org/downloads.html,根据自己的操作系统下载对应的版本即可。

ps:这里要记住安装目录啊,下面要用到它,不要忘记它的安装目录~

上面说到了pdfkit这个模块,这个是第三方模块,需要安装,使用pip安装即可。

pip install pdfkit

</pre>
pdfkit它给咱们提供了很多功能,可以给它一个 url,他会自动获取 url 里面的内容,帮你保存好,也可以给他一个 html 文件,也可以保存,也可以给他一个字符串,也可以保存成 pdf。

下面是代码:

import pdfkit url=’https://www.cnblogs.com/sriba/p/8043294.html’#一篇博客的url confg = pdfkit.configuration(wkhtmltopdf=’C:Python35wkhtmltopdf.exe’) #这里指定一下wkhtmltopdf的路径,这就是我为啥在前面让记住这个路径 pdfkit.from_url(url, ‘jmeter_下载文件.pdf’,configuration=confg) # from_url这个函数是从url里面获取内容 # 这有3个参数,第一个是url,第二个是文件名,第三个就是khtmltopdf的路径 #pdfkit.from_file(‘my.html’, ‘jmeter_下载文件2.pdf’,configuration=confg) # from_file这个函数是从文件里面获取内容 # 这有3个参数,第一个是一个html文件,第二个是文生成的pdf的名字,第三个就是khtmltopdf的路径 html=”’title
content
”’#这个html是我从一个页面上拷下来的一段,也可以 #pdfkit.from_string(html, ‘jmeter_下载文件3.pdf’,configuration=confg) # from_file这个函数是从一个字符串里面获取内容 # 这有3个参数,第一个是一个字符串,第二个是文生成的pdf的名字,第三个就是khtmltopdf的路径
<pre class="brush:js;toolbar:false">

学会了的小伙伴以后再也不怕喜欢的文章被删除或链接丢失啦。

神龙|纯净稳定代理IP免费测试>>>>>>>>天启|企业级代理IP免费测试>>>>>>>>IPIPGO|全球住宅代理IP免费测试

相关文章:

版权声明:wuyou2021-06-08发表,共计1111字。
新手QQ群:570568346,欢迎进群讨论 Python51学习