用python爬虫可以爬(在时间上)过去的网站吗
不行,除非这个网站有备份之前的内容并且提供对外的接口。或者有些提供互联网网页备份的网站,以及Google cache之类的,算是一个替代方案吧。
■网友
有的网站有发布日期,比如一些电影网站会有发布日期,那么你需要爬的时候对比发布日期,需要对日期进行格式化然后对比if(date=\u0026#39;2017-03-01\u0026#39;) fetchingelse nex_page//完全可以抓回来入库,在数据库里检索当然如果没有日期和楼上回答的基本一样!
推荐阅读
- 用泡沫箱来养多肉老桩?只要我们把细节做好,同样可以养出状态来
- ■养宠物真可以缓解孤独吗?一起来听听“铲屎官”的心声吧!
- 用EagleGet下载时总提示无效URL地址,无法下载,而用迅雷、QQ旋风则可以,咋回事~
- 银行的数据中心可以跳槽去互联网公司吗
- 银行高管的薪酬结构图表最新的,请问在哪里可以收集
- 医院|感染艾滋病毒初期有哪些征兆?可以自行检查吗?共用马桶会传染吗
- 电动车第一线|电动车配多大的电池,可以跑100公里以上?师傅告诉你真实答案!
- 有啥方法,网站,项目可以自己练习计算广告学
- 怎样成为一名合格的Python程序员?
- 学图像处理有哪些不错的书推荐
