python爬虫遇到一个莫名其妙的编码
因为目前浏览器大都会自动解gzip都响应,所以拿到个gzip过的response body也没啥好稀奇的。你这本应收到html的请求现在收到的绝对不是html,那么是个gzip压过的响应应该是最可能的事情。而urllib又没那么聪明,不会因为响应头里有个gzip标签就帮你给解了,只能劳烦自己动手解gzip了。建议任何写爬虫的人都先了解http协议,稍微了解一些前端和后端知识之后再写爬虫。建议所有写Python的不要没事撑的去折腾手机上的问题多bug多缺支持缺文档缺pip的QPython。这年头一台电脑不贵,实在不行弄个跑win的atom小平板都挺好。
推荐阅读
- 怎样成为一名合格的Python程序员?
- python 爬虫,咋获得输入验证码之后的搜索结果
- python的html5lib这个库咋使用啊我在网上也没有找到相关文档
- 中年|开车遇到“锯齿车道”,新手司机勇往直前,老司机驾照还有分吗
- 分享分享你生活中除游戏外,遇到过哪些恨电脑配置不够的情况
- 零基础入门学习啥语言好
- Python3.4和3.5区别大么
- python 中 def_():...... return _有啥作用
- 新互联网网站用Java还靠谱么对比Php,Python,Ruby的话
- 躲开|跑高速时遇到小动物,躲开还是撞上去?记不住别开车
