本文为younghz原创,文章链接为:http://blog.csdn.net/u012150179/article/details/37306629

这个问题最初是源于我在知乎上一个回答(http://www.zhihu.com/question/24368542/answer/27579662),涉及了两个方面:数据抓取和数据分析。

1、数据爬取

爬取对象:淘宝“连衣裙 夏”的搜索结果。爬取对象的选择分析我在文章中也有提及。

工具:Scrapy。

代码:我把当时实现的代码放在了GitHub上,地址:https://github.com/younghz/TBBKAnalysis,感兴趣的可以看一下。关于Scrapy的知识与爬虫的编写可以见专栏:http://blog.csdn.net/column/details/younghz-scrapy.html

2、数据分析

分析内容可见上述Repository的Wiki(https://github.com/younghz/TBBKAnalysis/wiki)。我也会将其写在下面。或者直接看上面知乎问题中我写的答案。

工具:ipython & matplotlib。

3、分析内容

分析内容放在了Wiki中,链接:https://github.com/younghz/TBBKAnalysis/wiki。或者直接见下面正文。(注意:如果Wiki中图片无法打开,请使用较高版本的Chrome浏览器。)

4、正文

一、案例选择。

现在着手分析的对象是能让你在三个月获得大把钞票的“爆款”。这 当然得拿最有代表性的商品当例子,最有代表性就是最火的。看看什么最火。下面是淘宝指数(http://shu.taobao.com/top/16/search)数据。


图一 搜索排行


图二 成交排行

很明显,那么就取商品的搜索量和成交量二者交集——“连衣裙 夏”做案例进行分析。

二、案例分析

在淘宝中搜索“连衣裙 夏”,首先提取有用数据,这里我基于Scrapy框架实现了一个爬虫,爬取按销量排行的前五页数据(听说前五页是所有商家的梦哦),销量在三千到三万,销量低于三千的款也不够‘爆’吧(我也不清楚,呵呵)。 这里提取每个宝贝销量、宝贝价格、店铺性质以及店铺名称等分析。

三、数据分析

下面对提取的数据进行分析,分析分为两种:首页和前五页。(以下图表使用ipython基于matplotlib生成) 如果说前五页属于‘爆’级别,那么首页就是‘爆爆’了吧。

(1)最关心的当然还是销量

基于上面抓取的数据,分析。

图三 前五页销量趋势


图四 首页销量趋势

看过了什么感受,这怎么成指数下降趋势啊。即便是爆款,销量差距还是很悬殊的啊。即使在‘爆爆’级别的首页销量老大和老二都不是一个级别的啊。竞争好激烈不是吗。
我们继续进行局部放大,看看销量在一万以上的是什么情况。

图五 销量大于一万趋势

小伙伴,是不是有种要做就做老大的感脚。

(2)看价格

下面是前五页商品的价格曲线。

图六 前五页商品价格及平均价格图

其中红色的线是所有商品的平均价格,低于50块。而且价格可分为三个区间:

  • 区间一:50以下。这部分商品最密集,大部分商品价格集中在这个区域。
  • 区间二:50到100。这属于第二阶梯。
  • 区间三:100以上,看上去这部分好刺眼啊,总有零星的几个拔出来。相对比例很少。

有什么感想,要是你做,把你的东西价位定义在哪个区间呢。继续看下首页的价格数据。

图七 首页商品价格走势图

要是感觉这个不够明显,我们还是来看销量高于一万的走势图。

图八 销量大于10000商品价格走势图

下面来研究下这些爆款都来自哪里。

(3)卖家地点

来看看这些做爆款的卖家都在哪,地点是不是也为他们提供了一定的优势?

图九 卖家地点分布

从高到低分别是——广东、浙江、北京、上海、江苏、山东、湖北、河南、辽宁、江西。

(4)店铺是否是天猫卖家


图十 是否是天猫(前五页数据)


图十一 是否是天猫(首页数据)

这个比例看起来都差不多。看来也没什么必然的关系。

(5)商品名字

给你举两个: “夏季新款女式连衣裙莫代尔背心长裙波西米亚气质长裙打底裙子” “14夏季新款韩版短袖V领波西米亚连衣裙大码女装沙滩裙子” “夏装新款女连衣裙短袖韩国性感修身显瘦包臀V领大码” 呵呵,想没想好你的叫什么名字了? 如果买的是内裤,按照上面的规则应该就叫:“14夏季新款波西米亚修身显瘦包臀韩国气质新版安全防盗内裤”,呵呵。

(6)买家分析

刚才说的都是卖家的,现在看看消费者。看看关键词喜好度(http://shu.taobao.com/searchindex?spm=0.0.0.0.3Mt2Y2&query=%E8%BF%9E%E8%A1%A3%E8%A3%99%20%E5%A4%8F)对你有没有帮助。

图十二 搜索喜好度

第一是黑龙江,辽宁也入围前十了。

本文为younghz原创,文章链接为: http://blog.csdn.net/u012150179/article/details/37306629




关于“淘宝爆款”的数据抓取与数据分析相关推荐

  1. 让机器人告诉你当下淘宝爆款商品

    让机器人告诉你当下淘宝爆款商品 能够自动将千牛生意参谋的数据汇总.整理.分析的电商机器人. 机器人代替人工进行自动查询.批量下载等操作,高效实现数据的整理与分析:新品动态实时监控,帮助商家第一时间挖掘 ...

  2. 实现从淘宝(天猫)定时抓取订单数据、打印电子面单并保存到ERP表中

    实现从淘宝(天猫)定时抓取订单数据.打印电子面单并保存到ERP表中 前言 实现思路 代码片段参考 前言 最近有厂商提出想把天猫店铺的数据拿到后台ERP管理系统中,并能实现线下打印电子面单功能.接手这个 ...

  3. 淘宝商家如何通过淘宝客来打造淘宝爆款?

    打造爆款大家就会想到直通车和钻展以及刷单,但是这些方法很烧钱,而且爆款不一定能打造出来,那么大家有没有想过用淘宝客推广来打造爆款呢?淘宝客推广是个双赢的选择,淘宝客拿到佣金,卖家自己能将推广风险降到最 ...

  4. 淘宝爆款返场什么意思?淘宝爆款返场怎么报名?

    一.淘宝爆款返场什么意思? 淘宝爆款返场栏目定义:针对参加活动的爆款商品,奖励其在7天后手机端独立频道同活动价返场再售的活动形式.即参加聚划算.淘抢购等爆款商品再次促销,获得更多的展现. 二.淘宝爆款 ...

  5. 淘宝爆款详情页制作的几个方法(理论)

    淘宝爆款详情页制作的几个方法 如果你是运营淘宝的店主,抑或是准备从事这个行业的,这个文章将会对你有很大帮助. 转载于:https://www.cnblogs.com/lanren2017/p/7746 ...

  6. 打造淘宝爆款的思路和补单技巧整理

    我们做爆款的目的是什么?是为了让我们通过爆款赚钱,通过爆款弓|来的流量带动其他产品赚钱.并且是持续稳定的赚钱.而我们做爆款最需要的流量就是自然搜索流量. 所以看到很多新人朋友盲目的拿直通车,拿淘客去怼 ...

  7. 如何快速打造淘宝爆款

     打造网店单品爆款 网络零售行业自2003年快速发展以来已经经历了15个年头.八年来很多人都在研究该如何更好地做好网店推广工作. 在传统的市场营销概念中,大家对推广的理解相当简单,一般都认为是让我们的 ...

  8. 淘宝爆款的误区,怎么合力打造爆款流量

    淘宝搜索优化,是很多卖家获取自然流量的必修学分.有道是,经验主义害死人.在获悉基本的搜索优化原理之后,因为对实践中一些重要细节的忽视或错误理解,很多卖家往往进入了一些搜索优化误区,不知不觉损耗掉一些珍 ...

  9. 淘宝爆款打造——测款测图,如何打造爆款,淘宝X模型

    一.重点 想要打造爆款,首先最重要的就是这个产品本身有成为爆款的潜质,丑小鸭之所以能成为白天鹅,那是因为他本身就是白天鹅.所以我们在打造爆款之前最重要的是先进行测款测图,确认宝贝有潜力后再进行后续操作 ...

最新文章

  1. Intel发布FPGA
  2. linux下安装boost
  3. LeetCode Spiral Matrix II (生成螺旋矩阵)
  4. CAP原理和BASE思想
  5. CF-1140 E - Palindrome-less Arrays
  6. CNCF 官方大使张磊:Kubernetes 是一个“数据库”吗?
  7. Unity热更新方案探索与讨论
  8. jQuery从入门到忘记
  9. vue的使用(引用/创建vue项目)(一)
  10. HDU 4920 Matrix multiplication(矩阵相乘)
  11. mui dtpicker 时间的设置 以及MUI的弹窗
  12. mysql-5.7在CentOS-7下的rpm安装
  13. K/3 WISE期初余额调整和出库异常调整的差别
  14. 小D课堂 - 零基础入门SpringBoot2.X到实战_第11节 Logback日志框架介绍和SpringBoot整合实战_44、新日志框架LogBack介绍...
  15. 费马大定理的启示:记笔记是一种信仰
  16. 自己动手写网络爬虫学习笔记
  17. mark制图软件_mac自带的画图工具在哪?如何使用苹果电脑自带的预览工具进行画图操作...
  18. python实现Kmeans算法
  19. 极限-反函数极限问题
  20. ble HCI 流控机制

热门文章

  1. Python实现获取汉字笔画数,根据汉字笔画数量排序
  2. tanx的n次方不定积分递推方法
  3. 【jQuery插件】用jQuery Masonry快速构建一个pinterest网站布局
  4. 用Java实现一个抽奖系统(附完整代码)
  5. android-App启动过程
  6. 看图记设计模式【四】,创建模式系列:生成器模式
  7. python游戏库pygame经典教程
  8. python学习-108-根据经纬度坐标计算距离
  9. 【MTK】flashlight驱动部分调试
  10. Java代码与计算机内核