层级抓取第二级的时候,一共是3000多个线索,前面运行得好好的,然后就出现这个提示了,要怎么解决?

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有帐号?立即注册

x
举报 使用道具
| 回复

共 4 个关于本帖的回复 最后回复于 2016-11-24 15:43

沙发
xandy 论坛元老 发表于 2016-11-2 15:32:11 | 只看该作者
这个提示表示网站暂时访问不了。
你可以看这个帖子解决:只看到线索编号,怎么找地址呢
举报 使用道具
板凳
Fuller 管理员 发表于 2016-11-2 17:11:09 | 只看该作者
下个版本(V8.0.3)所有的系统报错都将采用页面方式,但是,下个版本还完成不了所有界面汉化。
举报 使用道具
地板
ym 版主 发表于 2016-11-24 15:25:44 | 只看该作者
我在采集微博关键词搜索时,遇到搜索结果为0的页面如下图,就会有弹窗提示“the document contains no data”,需要点击OK,看到底部日志显示抓取失败,然后就可以继续采集下去了。所以,其实就是网页与规则不匹配的一个提示。


本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有帐号?立即注册

x
举报 使用道具
5#
Fuller 管理员 发表于 2016-11-24 15:43:12 | 只看该作者
ym 发表于 2016-11-24 15:25
我在采集微博关键词搜索时,遇到搜索结果为0的页面如下图,就会有弹窗提示“the document contains no data ...

你应该下载一个最新版本了,最新版本不再弹出alert窗口,而是直接在页面上显示错误提示。The document contains no data的意思是网站暂时不可访问
举报 使用道具
您需要登录后才可以回帖 登录 | 立即注册

精彩推荐

  • 为BERTopic安装需要的预训练SBERT模型
  • 在什么情况下使用弹窗模式和回退功能?
  • 爬网址做层级采集——以当当商品爬虫为例
  • 网络爬虫采集列表数据
  • UMAP的min_dist参数有什么作用?

热门用户

GMT+8, 2026-8-23 10:54