打开注册表编辑器,找到HKCU\Software\Microsoft\Fiddler 2\,在里面添加一个字符串值,名叫HeaderEncoding,值设置为默认编码。建议设成GB18030。然后要记得重启Fiddler才能生效。 win71、windows按钮+R 2、输入regedit +回车+是3、HKEY_CURRENT_USER\Software\Microsoft\Fiddler24、右键新建,选字符串值 加上HeaderEncoding 然后值输入 GBK
firefox网络传输的默认编码格式是由用户自定义设置的。
配置路径:菜单->查看->文字编码。
而响应中看到的乱码推测实际为网站的掩码,这只是内容展示的方式,其编码格式仍然由浏览器配置决定。
如果你说的乱码是指模拟器工具栏上的显示的话,
模拟器本身是能换中文简体的。
点击模拟器工具栏的第四项的最后一项,这里就有中文语言包的选择。。
在d窗中默认的是打开模拟器的‘lang’文件夹。
里面的都是语言包文件,我忘了那一个是中文了。你一个一个试一下就知道了。
如果这个‘lang’文件夹里没有语言包文件的话,你可以在网上下载一个winkawaks模拟器,中文版的。只要把你光碟上的roms文件夹整个复制到新下载的中文版winkawaks模拟器里就能用了
1 遇到的中文乱码问题
11 简单的开始
使用requests来拔取网站内容十分方便,一个最简单的代码段只需要2-3行代码就行。
点击(此处)折叠或打开
url = '>
req = requestsget(url)
print(reqtext)
tree = htmlfromstring(reqtext)
print(treexpath("//h1[@class='title']/text()"))
上面的代码段起作用的也就3行(2,4,5)代码就获取到我们想要的内容。当然还要导入一系列的包,比如说requests、lxml、html等。当然由于/是英文网站,不存在中文乱码问题。12 麻烦的开始
本来当时的想法是写一些基础模块,方便之后开发的时候调用,减少重复性工作。为了保证代码在任何情况下都不会出现bug,所以想着用同样的代码爬取中文网站获取里面的文字
修改上面代码中的两行代码:
点击(此处)折叠或打开
url = '>
print(treexpath("//span[@class='sec_blk_title']/text()"))
运行程序可以发现,在语句print(reqtext)输出的内容中,中文字体已经是乱码了。最后的结果输出是['©è§\x86é\x91', '\x80\x9c\x9f\x9b\x9eé']2 乱码解决办法
21 试错
由于之前爬取csdn上一个网页没有出现乱码问题,但是在sina体育网站上出现了乱码,所以当时以为不是编码问题,以为是文档压缩问题。因为csdn获取的页面header里没有“Content-Encodings”属性,但是sina体育获取的页面header有“Content-Encodings”属性--“Content-Encoding: gzip”。
总结:参考上述文献,结果还是没有解决问题,但是就考虑是不是方向错了。不过这部分工作也没有白做,很多网站返回数据都会有压缩问题,之后的工作中也能用上。
22 乱码终极解决办法
后来查阅官方文档中response-content相关内容,说明了Requests会自动解码来自服务器的内容。Requests会基于模块是最简单的一种方式。)
另一份官方文档片段明确说了reponse编码处理方式:
Requests遵循RFC标准,编码使用ISO-8859-1 。
只有当才不去猜测编码方式。
现在直接上实验结果,在原始代码中添加以下代码片段:
点击(此处)折叠或打开
print(reqheaders['content-type'])
print(reqencoding)
print(reqapparent_encoding)
print(requestsutilsget_encodings_from_content(page_contenttext))
输出结果分别是:text/html
ISO-8859-1#response内容的编码
utf-8#response headers里设置的编码
['utf-8']#response返回的html header标签里设置的编码
返回的内容是采用‘ISO-8859-1’,所以出现了乱码,而实际上我们应该采用‘utf-8’编码
总结:当response编码是‘ISO-8859-1’,我们应该首先查找response header设置的编码;如果此编码不存在,查看返回的Html的header设置的编码,代码如下:
点击(此处)折叠或打开
if reqencoding == 'ISO-8859-1':
encodings = requestsutilsget_encodings_from_content(reqtext)
if encodings:
encoding = encodings[0]
else:
encoding = reqapparent_encoding
encode_content = reqcontentdecode(encoding, 'replace')encode('utf-8', 'replace')
以上就是关于如何解决fiddler的响应显示乱码问题全部的内容,包括:如何解决fiddler的响应显示乱码问题、firefox调试时响应内容的编码方式是什么,像乱码:MDAyMDAyMDMw。。。。。、katalon响应体出现乱码怎么解决求助等相关内容解答,如果想了解更多相关内容,可以关注我们,你们的支持是我们更新的动力!
欢迎分享,转载请注明来源:内存溢出
评论列表(0条)