python3爬虫之如何使用浏览器cookie-创新互联

小编给大家分享一下python3爬虫之如何使用浏览器cookie,希望大家阅读完这篇文章后大所收获,下面让我们一起去探讨吧!

成都一家集口碑和实力的网站建设服务商,拥有专业的企业建站团队和靠谱的建站技术,10余年企业及个人网站建设经验 ,为成都数千家客户提供网页设计制作,网站开发,企业网站制作建设等服务,包括成都营销型网站建设,高端网站设计,同时也为不同行业的客户提供做网站、网站制作的服务,包括成都电商型网站制作建设,装修行业网站制作建设,传统机械行业网站建设,传统农业行业网站制作建设。在成都做网站,选网站制作建设服务商就选创新互联


以网页提取标题为例

>>> import re

>>> get_title = lambda html: re.findall('(.*?)', html, flags=re.DOTALL)[0].strip()

未登录情况下下载得到的标题:

>>> import urllib2

>>> url = 'https://bitbucket.org/'

>>> public_html = urllib2.urlopen(url).read()

>>> get_title(public_html)

'Git and Mercurial code management for teams'

使用第三方库browsercookie,获取cookie再下载:

>>> import urllib.request

>>> public_html = urllib.request.urlopen(url).read()

>>> opener = urllib.request.build_opener(urllib.request.HTTPCookieProcessor(cj))

看完了这篇文章,相信你对python3爬虫之如何使用浏览器cookie有了一定的了解,想了解更多相关知识,欢迎关注创新互联行业资讯频道,感谢各位的阅读!


网页题目:python3爬虫之如何使用浏览器cookie-创新互联
URL链接:http://bzwzjz.com/article/dpogeg.html

其他资讯

Copyright © 2007-2020 广东宝晨空调科技有限公司 All Rights Reserved 粤ICP备2022107769号
友情链接: 成都网站制作 成都做网站建设公司 成都企业网站建设 成都网站设计 成都网站制作 重庆网站建设 成都网站建设 网站制作 移动手机网站制作 盐亭网站设计 成都网站设计 成都网站设计 成都网站制作 网站制作公司 成都网站建设 营销型网站建设 品牌网站建设 成都响应式网站建设 网站设计 手机网站建设 企业网站设计 成都网站建设