对于某些用户来说,直接自定义规则可能有难度,所以在这种情况下,我们提供了网页简易模式,网页简易模式下存放了国内一些主流网站爬虫采集规则,在你需要采集相关网站时可以直接调用,节省了制作规则的时间以及精力。

天猫商品数据采集下来有很多作用,比如可以分析天猫商品价格变化趋势情况,评价数量,竞品销量和价格,竞争店铺分析等,快速掌握市场行情,帮助企业决策。

所以本文绍八爪鱼简易采集模式下“天猫商品列表采集”的使用教程以及注意要点。

步骤一、下载八爪鱼软件并登陆

1、打开/download,即八爪鱼软件官方下载页面,点击图中的下载按钮。

天猫商品采集python代码 天猫店铺采集软件_自定义

2、软件下载好了之后,双击安装,安装完毕之后打开软件,输入八爪鱼用户名密码,然后点击登陆。

天猫商品采集python代码 天猫店铺采集软件_表数据_02

步骤二、设置天猫商品列表抓取规则

1、进入登陆界面之后就可以看到主页上的网站简易采集了,选择立即使用即可。

天猫商品采集python代码 天猫店铺采集软件_数据_03

2、进去之后便可以看到目前网页简易模式里面内置的所有主流网站了,需要采集天猫内容的,这里选择天猫即可。

天猫商品采集python代码 天猫店铺采集软件_php天猫列表数据抓取_04

3、天猫爬虫规则下内置了两条规则,分别是“天猫-商品列表采集”,“天猫-详情页采集”,这里仅以“天猫商品列表采集”这条爬虫规则举例说明,点击“立即使用”即可使用。

天猫商品采集python代码 天猫店铺采集软件_自定义_05

4、天猫商品列表简易采集模式任务界面介绍

查看详情:点开可以看到示例网址

任务名:自定义任务名,默认为天猫-商品列表采集

任务组:给任务划分一个保存任务的组,如果不设置会有一个默认组

商品名称:自定义输入商品名称即可,如“拖布”

示例数据:这个规则采集的所有字段信息

天猫商品采集python代码 天猫店铺采集软件_天猫商品采集python代码_06

5、 天猫商品列表抓取规则设置示例

例如要采集商品名称为“拖布”的商品列表信息。

在设置里如下图所示:

任务名:自定义任务名,也可以不设置按照默认的就行

任务组:自定义任务组,也可以不设置按照默认的就行

商品名称:输入“拖布”

步骤三、保存并运行天猫商品列表采集规则

1、设置好爬虫规则之后点击保存。

天猫商品采集python代码 天猫店铺采集软件_自定义_07

2、保存之后,点击会出现开始采集的按钮。

天猫商品采集python代码 天猫店铺采集软件_天猫商品采集python代码_08

3、 选择开始采集之后系统将会弹出运行任务的界面,可以选择启动本地采集(本地执行采集流程)或者启动云采集(由云服务器执行采集流程),这里以启动本地采集为例,我们选择启动本地采集按钮。

天猫商品采集python代码 天猫店铺采集软件_表数据_09

4、选择本地采集按钮之后,系统将会在本地执行这个采集流程来采集数据,下图为本地采集的效果(示例中商品列表数据较多,为方便展示故先行停止采集,诸位可以根据需求决定是否采集完。)

天猫商品采集python代码 天猫店铺采集软件_表数据_10

5、采集完毕之后选择导出数据按钮即可,这里以导出excel2007为例,选择这个选项之后点击确定。

天猫商品采集python代码 天猫店铺采集软件_数据_11

6、然后选择文件存放在电脑上的路径,路径选择好之后选择保存。

7、这样天猫商品列表数据就被完整的采集导出到自己的电脑上来了。

天猫商品采集python代码 天猫店铺采集软件_数据_12