问答文章1 问答文章501 问答文章1001 问答文章1501 问答文章2001 问答文章2501 问答文章3001 问答文章3501 问答文章4001 问答文章4501 问答文章5001 问答文章5501 问答文章6001 问答文章6501 问答文章7001 问答文章7501 问答文章8001 问答文章8501 问答文章9001 问答文章9501

python爬虫抓取到的数据用网页打开时是乱码,怎么解决

发布网友 发布时间:2022-04-06 07:32

我来回答

3个回答

懂视网 时间:2022-04-06 11:53

python写入html文件中文乱码问题

使用open函数将爬虫爬取的html写入文件,有时候在控制台不会乱码,但是写入文件的html中的中文是乱码的

案例分析

看下面一段代码:

# 爬虫未使用cookiefrom urllib import requestif __name__ == '__main__':
 url = "http://www.renren.com/967487029/profile"

 rsp = request.urlopen(url)

 html = rsp.read().decode() with open("rsp.html","w")as f: # 将爬取的页面
 print(html)
 f.write(html)

看似没有问题,并且在控制台输出的html也不会出现中文乱码,但是创建的html文件中

ba7eb27c8a76a73427692c57650df14.png

解决方案

使用open方法的一个参数,名为encoding=” “,加入encoding=”utf-8”即可

# 爬虫未使用cookiefrom urllib import requestif __name__ == '__main__':
 url = "http://www.renren.com/967487029/profile"

 rsp = request.urlopen(url)

 html = rsp.read().decode() with open("rsp.html","w",encoding="utf-8")as f: # 将爬取的页面
 print(html)
 f.write(html)

运行结果

39353137a8f9ac7f0e3fac26e375b21.png

感谢大家的阅读,希望大家收益多多。

本文转自: https://blog.csdn.net/qq_40147863/article/details/81746445

推荐教程:《python教程》

热心网友 时间:2022-04-06 09:01

写爬虫是经常会遇到这样的问题,这种问题很显然是编码问题,解决的方法其实也不难。
你可以用下面的两个方法来解决你的编码问题:
第一种是,通过浏览器打开你写的html之后,找到浏览器中的文字编码修改,将编码改为Unicode编码,即可修复。

第二种方法是修改你的前端代码:在你的代码output_html方法中,规定网页的文字编码即可

热心网友 时间:2022-04-06 10:19

写爬虫是经常会遇到这样的问题,这种问题很显然是编码问题,解决的方法其实也不难。
你可以用下面的两个方法来解决你的编码问题:
第一种是,通过浏览器打开你写的html之后,找到浏览器中的文字编码修改,将编码改为Unicode编码,即可修复。

第二种方法是修改你的前端代码:在你的代码output_html方法中,规定网页的文字编码即可。
声明声明:本网页内容为用户发布,旨在传播知识,不代表本网认同其观点,若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。E-MAIL:11247931@qq.com
自离后能补办离职证明吗? 我是家里自离的,可以补办辞职手续吗 急救!!!狗狗受凉吃什么就吐什么,该吃什么药 狗狗受凉呕吐吃什么药好得快 公告栏标题里的字如何设定字体及大小 公告栏怎移动啊 我的公告栏 如何设置 怎么让QQ拍拍公告栏文字不滚动 在滚动的公告栏中鼠标放上去时就停止,这种效果怎么做?谢谢了 王者荣耀铂金1和黄金3双排排到的是什么段位的 python爬到的html乱码怎么解决 processing自增自减运算符怎么用 关于java的自增自减运算符 c语言关于自增自减运算的问题 C语言 计算机语言 自增自减运算符 ++var和var++有什么区别(C语言自增自减详解) C语言的逻辑运算符与自增自减混合运算的规则 C语言中自增自减运算符如何最好的理解 自增自减运算的优先级是怎样的? c语言中的 自增和自减运算符自学看不懂 c语言中自增自减运算符。怎样理解? C语言中自增自减运算符如何最好的理解? 自增、自减运算符 C语言自增自减运算符用法 什么是自增运算,什么是自减运算 web在线客服系统的实现方案? 微信开发php怎么实现,一个关键字回复多个消息 求一个PHP+MYSQL写的在线客服代码要完整的 向高手求一个php在线客服系统,ECSHOP系统能用的。万分感谢! 如何用PHP做一个网站悬浮的客服窗口 用python抓取的网页保存后为什么乱码? python 乱码问题 Python3.6 想在文件中输入乱码怎么办 Python+requests 爬取网站遇到中文乱码怎么办 怎么解决中文网页HTML中,编码不一致问题(Python,BeautifulSoup) 用Python的BeautifulSoup解析网页时,里面的中文显示乱码,要怎样才能正常显示中文? python代码中文乱码怎么解决 Python中中文乱码问题 Python中好用的爬虫框架? python语言的创始人 当下热度最高的编程语言Python究竟是怎样诞生的? python的创始人是谁? python 判断合法标识符 class是合法的python标识符吗 合法的C语言标识符有什么要求? Python中什么系统内置函数用来判断某一标识符是否合法 print在python中什么意思 print()在python里是干什么用的? 在Python中,print(a,b)的意思? 编写Python鬼叔哪国人?