快捷导航
主题“文学评论文艺作品中国第二级“
为什么换了一个网页感觉做了所有的还是不断抓取出错呢?是我还是有什么地方没做到位吗?

举报 使用道具
| 回复

共 1 个关于本帖的回复 最后回复于 2018-6-12 11:24

bowieD 金牌会员 发表于 2018-6-12 11:24:16 | 显示全部楼层
应该是网页间的结构不一样,用规则加载采集失败的网页,看是哪个抓取内容失效了,再分析网页间的结构是哪里不同,从而修改规则。

另外不要给所有的抓取内容都勾上关键内容,这样遇到没有关键内容的网页就会匹配失败,给一个最常出现的字段勾上关键内容就可以了,比如书名
举报 使用道具
您需要登录后才可以回帖 登录 | 立即注册

精彩推荐

  • 批量爬取亚马逊商品价格、评论信息
  • 批量爬取eBay商品价格、销售情况信息
  • 批量爬取淘宝商品sku、价格、评价数据
  • 批量爬取速卖通商品价格、评论信息
  • 爬取微博影评人数据做职业特征分析

热门用户

集搜客GooSeeker网络爬虫 ( 粤ICP备11065265号-2 )

GMT+8, 2018-6-20 01:54