如何解决python爬虫中有中文的url问题-创新互联

这篇文章主要为大家展示了“如何解决python爬虫中有中文的url问题”,内容简而易懂,条理清晰,希望能够帮助大家解决疑惑,下面让小编带领大家一起研究并学习一下“如何解决python爬虫中有中文的url问题”这篇文章吧。

创新互联建站专注于网站建设,为客户提供成都网站建设、网站设计、网页设计开发服务,多年建网站服务经验,各类网站都可以开发,高端网站设计,公司官网,公司展示网站,网站设计,建网站费用,建网站多少钱,价格优惠,收费合理。

如果URL中存在中文,而你却不对它做任何处理,他不会达到你所想的那样,因此我们需要将中文部分进行处理,要用到urllib.parse模块中的quote将中文转化成URL所需的编码,url中的中文要单独处理,不能中英文全部合在一起处理(因为一部分的特殊字符也会被处理掉)。

import urllib.parse 
 
word='龙' 
word=urllib.parse.quote(word) 
url='https://baike.baidu.com/search/word?word=%s'%word 
print(url)

运行结果为:

如何解决python爬虫中有中文的url问题

以上是“如何解决python爬虫中有中文的url问题”这篇文章的所有内容,感谢各位的阅读!相信大家都有了一定的了解,希望分享的内容对大家有所帮助,如果还想学习更多知识,欢迎关注创新互联行业资讯频道!


分享题目:如何解决python爬虫中有中文的url问题-创新互联
分享路径:http://bzwzjz.com/article/djoghj.html

其他资讯

Copyright © 2007-2020 广东宝晨空调科技有限公司 All Rights Reserved 粤ICP备2022107769号
友情链接: 自适应网站建设 四川成都网站设计 网站建设 成都商城网站建设 定制网站建设 网站建设方案 商城网站建设 温江网站设计 成都网站建设 重庆网站建设 成都营销网站建设 成都网站设计制作公司 成都网站建设 成都营销网站制作 成都做网站建设公司 网站设计公司 营销网站建设 网站建设改版 成都网站建设 响应式网站设计 成都网站建设 外贸网站建设