python爬虫遇到一个莫名其妙的编码

因为目前浏览器大都会自动解gzip都响应,所以拿到个gzip过的response body也没啥好稀奇的。你这本应收到html的请求现在收到的绝对不是html,那么是个gzip压过的响应应该是最可能的事情。而urllib又没那么聪明,不会因为响应头里有个gzip标签就帮你给解了,只能劳烦自己动手解gzip了。建议任何写爬虫的人都先了解http协议,稍微了解一些前端和后端知识之后再写爬虫。建议所有写Python的不要没事撑的去折腾手机上的问题多bug多缺支持缺文档缺pip的QPython。这年头一台电脑不贵,实在不行弄个跑win的atom小平板都挺好。


    推荐阅读