转自: http://blog.sina.com.cn/s/blog_72e6be570101o62r.html
在电商数据运营中,对于客户而言,有两个很重要的指标对于扩大销售规模是很重要的:第一,提升顾客重复购买次数;第二,提升客户订单中的Basket size(即购物篮件数)。而第二个指标提升Basket size,就是让客户从之前只购买一件产品的转换到如今购买多件产品,从而提升整个购物篮的销售金额,最大限度地实现销售增加。html
可是如何挑出那些产品之间有关联销售的机会,从而造成相应的组合优惠套装呢?去过零售商场的人都知道,常常看到很多组合的套装打包在一块儿优惠销售,例如P&G的产品:飘柔洗发水+玉兰油沐浴露、海飞丝洗发水+舒肤佳沐浴露等等。再例如本人参与撰写的Excel疑难千寻千解之《Excel 2010 数据透视表大全》+《Excel 2010 操做与技巧》+《Excel 2010 函数与公式》在当当网上造成了一个促销礼包,就说明该组合是顾客最喜欢购买的,而且是销售比较好的组合。对于P&G的产品组合,背后必然有相应的数据进行支撑, 才敢推出相应的优惠组合套装;而对于本人书本的组合,有多是当当网作了相应的分析,确认这三本书捆绑在一块儿能产生最大的销售机会,也有多是出版社经过 人为的数据协助当当推出这样的组合。但不管怎么样的决策,优惠组合套装都离不开数据支撑,而这背后的原理就是涉及到数据挖掘中的关联分析。提及关联分析, 也许是太过于专业了,但连那些都不知道啥数据挖掘的最土鳖的那些土人都据说过啤酒与尿布的典型案例,啤酒与尿布就是关联分析的典型,让无数的人都对该规则 津津乐道,但这个都已经成为过去了,如今数据增加及产品增加飞速,会出现愈来愈多啤酒与尿布的规则指导市场运营。结合本人的参与的电商数据挖掘、零售大商场的数据挖掘经验,分享一点我对关联分析的所谓经验,帮助他人或帮助本身不断提升。数据库
第1、关联分析具体能用来作什么呢?编程
能够一句话来归纳:最大限度地从你口袋里面掏出更多的钱买个人产品。函数
- 经过关联规则,推出相应的促销礼包或优惠组合套装,快速帮助提升销售额。如前面所说的:飘柔洗发水+玉兰油沐浴露、海飞丝洗发水+舒肤佳沐浴露等促销礼包;还好比全家里面推出的牛奶+面包、豆奶+面包的早餐组合。
- 零售超市或商场,能够经过产品关联程度大小,指导产品合理摆放,方便顾客最购买更多其所须要的产品。最多见的就是超市里面购买肉和购买蔬菜水果等货架会摆放得很近,目前就是不少人会同时购买肉与蔬菜,产品的合理摆放也是提升销售的一个关键。
- 进行相关产品推荐或者挑选相应的关联产品进行精准营销。最 常见的是你在亚马逊或京东购买产品的时候,旁边会出现购买该商品的人,有百分之多少还会购买以下的产品,快速帮助顾客找到其共同爱好的产品。物以类聚,人 以群分。例如,穷人通常和穷人在一块儿,富人也喜欢和富人在一块儿。还有数据挖掘的人喜欢和数据挖掘的人打交道,都离不开这些鸟道理。
- 寻找更多潜在的目标客户。例如:100人里面,购买A的有60人,购买B的有40人,同时购买A和B的有30人,说明A里面有一半的顾客会购买B,反推而言。若是推出相似B的产品,除了向产品B的用户推荐(由于新产品与B的功能效果比较相似)以外,还能够向A的客户进行推荐,这样就能最大限度地寻找更多的目标客户。
注:以上的具体应用场景是目前本人知识范围内能想到的且都用在实际场景的。工具
第2、如何作好关联分析呢?大数据
- 必须进行大量的产品梳理工做,区分不一样等级的层次关系,而且给相应的产品打上合适的标签。产品梳理是一项纯手工的而且须要耗费大量的人力及时间才能完成的。通常的企业,其产品不会不少,就好比P&G的产品或者其SKU数,也不过是几千个,但产品梳理的标准是很重要的。产品标准过于粗放,对于后期的关联分析意义不大;产品标准过于细化,如涉及到SKU的层面的话,关联分析出的规则也不必定很理想。因此选定好一个比较合理的产品梳理规范,对于关联分析的结果精准程度很重要。
由于不少SKU通常只有产品名称及价格,对数据管理比较规范的企业会打上品牌标签,其余相应的信息都是须要进行手工梳理。具体的产品梳理示例以下:spa
若是对于大零售超市或商场,其SKU数通常都是几十万甚至上百万,产品梳理工做是一项很痛苦的工做,但若是要从数据角度进行产品运营,建议能够开展相应的产品梳理咨询项目,经过半年多的产品梳理,造成标准化的产品梳理流程及产品目录。过去的半年里,在对某商场的产品梳理时候,发现目前的产品体系仍是漏洞百出,不少仍是很不规范的。作好关联分析或数据运营,请从产品梳理工做开始。
- 建议选取SAS EM模块里面的关联分析模块。合适的工具是作好关联分析的关键。我的使用过SPSS Clementine里面的关联分析模块,其实其对数据格式要求很严格,但不符合常规的数据库录入的基础源数据,操做也不算很简单。R语言里面的关联分析缺陷也很多,别看目前大吹特吹R语言在大数据上的应用有多广,前途有多光明,但咱们只是从业务角度去挖掘商业机会,不懂那些Java等更高级的编程。其实发现仍是SAS的EM模块比较好用,纯图形化操做。
- 请深入理解关联分析中的三度:置信度、支持度、提高度,同时不能忽略产品规模。若是规则的提高度很高,但其相关的置信度很小,说明其市场规模很小。市场经营必须同时考虑市场规模大小及精准程度大小的两个维度。若是该规则真的很精准,但其受众客户就只有几百个,对于销售额而言,一点都没有影响。而另一条规则虽然提高度不是很高,但其受众客户涉及了几万人,对该部分客户进行营销,可以有效地扩大规模,大幅提升销售额。因此后期的营销规则选取也必需要切合实际的商业应用。
第3、关联分析有哪些后遗症?
- 注意购买产品赠送礼品的人为因素影响规则。有些挖掘师或分析师在作出关联分析后,看到了几条提高度及置信度都很高的规则,就兴奋不已地告诉客户:我以为产品A和产品B有很大的关联性,从数字上看,捆绑销售确定可以取得很好的销售效果。当拿到这样的结果的时候,客户很镇定地说:“你不知道咱们在某月的时候,大量开展了购买产品A便可免费赠送产品B的活动么?”杯具,坑爹。对于这个时候的挖掘师是很悲催的。在筛选关联规则的时候,必须对该企业过去一年开展的活动有了解,还必须对不一样时间段的主推产品进行提早沟通,确保关联规则不受人为因素影响。
- 注意产品之间的位置摆放是否有很大的影响。在 零售大商场中,产品摆放的位置对产品关联销售会产生很大的影响的,由于关联分析就是为了更方便地让顾客找到其须要的产品,购买更多其须要的产品。人流比较 大的两个相隔货架之间的产品关联性比较大,在咱们项目中会发现很多的这样规则。但其结果代表了货架关联性比较大,摆放在一块儿就确定比较合理的。但在进行关 联分析的时候,客户更但愿能从其余不相隔的货架之间找出更好的关联销售机会,这决定了后期的关联规则挑选难题。
- 注意关联推荐的规则合理性及流失成本的大小。后期的关联推荐应用于主要是三个方面:一、重购:继续购买原来的产品;二、升级:购买更高档次的产品;三、交叉销售:购买相关的产品。若是该规则的客户原本是买了50块钱的产品的,发现关联规则里面出现了推荐其购买30块的同类型产品,这等于给客户降档推荐了,会让销售额大幅减小,销售机会白白浪费而且形成了损失,因此在进行关联推荐的时候,那些涉及到了降档的规则必定要剔除。
关联分析是一个颇有用的数据挖掘模型,可以帮助企业作不少颇有用的产品组合推荐、优惠促销组合,同时也能指导货架摆放是否合理,还可以找到更多的潜在客户,的确真正的把数据挖掘落到实处。