如何解决fiddler的响应显示乱码问题

如何解决fiddler的响应显示乱码问题,第1张

打开注册表编辑器,找到HKCU\Software\Microsoft\Fiddler 2\,在里面添加一个字符串值,名叫HeaderEncoding,值设置为默认编码。建议设成GB18030。然后要记得重启Fiddler才能生效。 win71、windows按钮+R 2、输入regedit +回车+是3、HKEY_CURRENT_USER\Software\Microsoft\Fiddler24、右键新建,选字符串值 加上HeaderEncoding 然后值输入 GBK

firefox网络传输的默认编码格式是由用户自定义设置的。

配置路径:菜单->查看->文字编码。

而响应中看到的乱码推测实际为网站的掩码,这只是内容展示的方式,其编码格式仍然由浏览器配置决定。

如果你说的乱码是指模拟器工具栏上的显示的话,

模拟器本身是能换中文简体的。

点击模拟器工具栏的第四项的最后一项,这里就有中文语言包的选择。。

在d窗中默认的是打开模拟器的‘lang’文件夹。

里面的都是语言包文件,我忘了那一个是中文了。你一个一个试一下就知道了。

如果这个‘lang’文件夹里没有语言包文件的话,你可以在网上下载一个winkawaks模拟器,中文版的。只要把你光碟上的roms文件夹整个复制到新下载的中文版winkawaks模拟器里就能用了

1 遇到的中文乱码问题

11 简单的开始

使用requests来拔取网站内容十分方便,一个最简单的代码段只需要2-3行代码就行。

点击(此处)折叠或打开

url = '>

req = requestsget(url)

print(reqtext)

tree = htmlfromstring(reqtext)

print(treexpath("//h1[@class='title']/text()"))

    上面的代码段起作用的也就3行(2,4,5)代码就获取到我们想要的内容。当然还要导入一系列的包,比如说requests、lxml、html等。当然由于/是英文网站,不存在中文乱码问题。

12 麻烦的开始

    本来当时的想法是写一些基础模块,方便之后开发的时候调用,减少重复性工作。为了保证代码在任何情况下都不会出现bug,所以想着用同样的代码爬取中文网站获取里面的文字

    修改上面代码中的两行代码:

点击(此处)折叠或打开

url = '>

print(treexpath("//span[@class='sec_blk_title']/text()"))

    运行程序可以发现,在语句print(reqtext)输出的内容中,中文字体已经是乱码了。最后的结果输出是['©è§\x86é\x91', '\x80\x9c\x9f\x9b\x9eé']

2 乱码解决办法

21 试错

    由于之前爬取csdn上一个网页没有出现乱码问题,但是在sina体育网站上出现了乱码,所以当时以为不是编码问题,以为是文档压缩问题。因为csdn获取的页面header里没有“Content-Encodings”属性,但是sina体育获取的页面header有“Content-Encodings”属性--“Content-Encoding: gzip”。

总结:参考上述文献,结果还是没有解决问题,但是就考虑是不是方向错了。不过这部分工作也没有白做,很多网站返回数据都会有压缩问题,之后的工作中也能用上。

22 乱码终极解决办法

    后来查阅官方文档中response-content相关内容,说明了Requests会自动解码来自服务器的内容。Requests会基于模块是最简单的一种方式。)

    另一份官方文档片段明确说了reponse编码处理方式:

        Requests遵循RFC标准,编码使用ISO-8859-1 。

        只有当才不去猜测编码方式。

    现在直接上实验结果,在原始代码中添加以下代码片段:

点击(此处)折叠或打开

print(reqheaders['content-type'])

print(reqencoding)

print(reqapparent_encoding)

print(requestsutilsget_encodings_from_content(page_contenttext))

输出结果分别是:

    text/html

    ISO-8859-1#response内容的编码

    utf-8#response headers里设置的编码

    ['utf-8']#response返回的html header标签里设置的编码

    返回的内容是采用‘ISO-8859-1’,所以出现了乱码,而实际上我们应该采用‘utf-8’编码

        

    总结:当response编码是‘ISO-8859-1’,我们应该首先查找response header设置的编码;如果此编码不存在,查看返回的Html的header设置的编码,代码如下:

点击(此处)折叠或打开

if reqencoding == 'ISO-8859-1':

encodings = requestsutilsget_encodings_from_content(reqtext)

if encodings:

encoding = encodings[0]

else:

encoding = reqapparent_encoding

encode_content = reqcontentdecode(encoding, 'replace')encode('utf-8', 'replace')

以上就是关于如何解决fiddler的响应显示乱码问题全部的内容,包括:如何解决fiddler的响应显示乱码问题、firefox调试时响应内容的编码方式是什么,像乱码:MDAyMDAyMDMw。。。。。、katalon响应体出现乱码怎么解决求助等相关内容解答,如果想了解更多相关内容,可以关注我们,你们的支持是我们更新的动力!

欢迎分享,转载请注明来源:内存溢出

原文地址: http://outofmemory.cn/web/9547468.html

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
上一篇 2023-04-29
下一篇 2023-04-29

发表评论

登录后才能评论

评论列表(0条)

保存