快捷导航
主题“文学评论文艺作品中国第二级“
为什么换了一个网页感觉做了所有的还是不断抓取出错呢?是我还是有什么地方没做到位吗?

举报 使用道具
| 回复

共 1 个关于本帖的回复 最后回复于 2018-6-12 11:24

bowieD 金牌会员 发表于 2018-6-12 11:24:16 | 显示全部楼层
应该是网页间的结构不一样,用规则加载采集失败的网页,看是哪个抓取内容失效了,再分析网页间的结构是哪里不同,从而修改规则。

另外不要给所有的抓取内容都勾上关键内容,这样遇到没有关键内容的网页就会匹配失败,给一个最常出现的字段勾上关键内容就可以了,比如书名
举报 使用道具
您需要登录后才可以回帖 登录 | 立即注册

精彩推荐

  • 集搜客网络爬虫软件实现屏幕截屏
  • 怎样使用搜狐新闻搜索列表快捷工具抓取关键
  • 用于清洗文本内容的Excel函数公式
  • 用网络爬虫采集小红书的笔记
  • 集搜客网络爬虫怎么用?

热门用户

集搜客GooSeeker网络爬虫 ( 粤ICP备11065265号-2 )

GMT+8, 2019-5-23 06:35