将网页上的数据分批次抓取并分开处理。
评论
收藏

将网页上的数据分批次抓取并分开处理。

经验分享
西
西南
2025-01-23 20:37·浏览量:1281
西
西南
发布于 2025-01-23 20:371281浏览

一、问题背景:

在某些场景中,可能会遇到需要将网页中的数据定量抓取下来并按照一定的要求分批次处理的情况。如不同的数据需要发送给不同的人,以及写入到或保存到不同的位置等。

我们以影刀商城→订单管理中的订单数据为例( 影刀商城 ),我们的需求是将每页的订单编号分成两次抓取,并且每次抓取三条数据(每页指定抓取六条数据),然后将两次数据分别发送给不同的人或者保存到不同的位置。对于这种需求我们应该怎么处理呢?

二、解决方案:

2.1、第一种方式是通过循环相似元素,并且在外层嵌套for次数循环,来控制每次处理的元素个数,流程如下:

第三条的for次数循环用来翻页,这里我们假设最大页数为5。第五条的for次数循环用来控制每页中需要抓取的次数(这里我们需抓取两次),在第六条的循环相似元素指令的高级选项中我们可以控制每次抓取的数据量(在这个需求中每次需抓取三条,所以循环结束的位置是开始位置+2)。

注:关于后续两次抓取到的数据如何分开处理,大家可以自行写在if判断中,我这里就不赘述啦。

运行结果如下:


2.2、第二种方式是利用列表之间的转换,将获取到的相似元素组按照需要求拆分成二维列表,通过循环二维列表拿到里面每一个一维列表,再去循环里面的一维列表,实现对相似元素组的分批次的定量的处理。流程如下:

同样的,第三条的for次数循环用来翻页,第七条的foreach列表循环用来对二维列表循环拿到每一项一维列表,而第八条的foreach列表循环则是用来对一维列表进行循环。If判断同样是用来对两次数据做不同的处理。

运行结果如下:


以上就是这次分享的内容啦,希望在遇到上述场景的时候可以给大家带来些许灵感。

收藏
全部评论1
最新
发布评论
评论