python 爬虫爬取网页源码问题
这是典型的编码问题,python经常出现的,多见不怪。方法楼上已经说了,主要是把编码标准给改一下
■网友
把pycharm的编码换一下或者加个decode()
■网友
print前面加一句,req.encoding = \u0026#39;utf-8\u0026#39;帮网页加上编码。
【python 爬虫爬取网页源码问题】
■网友
import sysreload(sys)sys.setdefaultencoding("utf-8")再把这个加进去
■网友
编码解析的问题,把encoding修改一下
■网友
遇到非法字符了,没办法转换。用ignore忽略掉就可以了。
推荐阅读
- 怎样成为一名合格的Python程序员?
- python 爬虫,咋获得输入验证码之后的搜索结果
- python的html5lib这个库咋使用啊我在网上也没有找到相关文档
- 零基础入门学习啥语言好
- Python3.4和3.5区别大么
- python 中 def_():...... return _有啥作用
- 新互联网网站用Java还靠谱么对比Php,Python,Ruby的话
- 30岁男,创业失败转行学python,是否很晚?也不好找工作?
- Python 的开发速度比 C#.net 或 Vb.net 更快吗?
- 1、相同的网址,为啥浏览器http和https都能登录,而爬虫不行\n2、网页下载内容不全
