问:要抓的内容分别存在两个样例上,怎么抓取?

这两个项在不同的地方,我创建规则的时候要怎么弄


答:用自定义xpath,而且用专用定位表达式。你用第一个作为样例做规则,没有的抓取内容照样在整理箱中创建一个字段,做内容映射的时候都用第一个样例有的网页节点(比如,div)自定义xpath的定位表达式都指向这个节点,内容表达式就用各自的xpath,自定义xpath的说明在这里:http://www.gooseeker.com/doc/thread-701-1-1.html

但是没有你说的这个情形,自己揣摩一下,如果不行,找人帮忙做个规则。或者把网址发出来,大家讨论一下

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有帐号?立即注册

x
举报 使用道具
| 回复

共 0 个关于本帖的回复 最后回复于 2015-12-13 15:59

您需要登录后才可以回帖 登录 | 立即注册

精彩推荐

  • 利用AI阅读和分析文本:扣子COZE记录用户反
  • 在网页片段内直观标注——以B站评论采集为
  • 利用AI阅读和分析文本:使用COZE建设游记文
  • 使用AI工具Kimi生成python代码为文本分析结
  • 苹果mac电脑安装集搜客网络爬虫软件失败的

热门用户

GMT+8, 2024-10-7 02:42