RFM分析

RFM分析是根据客户活跃程度和交易金额贡献,进行客户价值细分的一种方法;
可以通过R,F,M三个维度,将客户划分为8种类型。

RFM分析过程

1.计算RFM各项分值

R_S,距离当前日期越近,得分越高,最高5分,最低1分

F_S,交易频率越高,得分越高,最高5分,最低1分

M_S,交易金额越高,得分越高,最高5分,最低1分

2.归总RFM分值

RFM=100*R_S+10*F_S+1*M_S

3.根据RFM分值对客户分类

RFM分析前提,满足以下三个假设,这三个假设也是符合逻辑的

1.最近有过交易行为的客户,再次发生交易的可能性要高于最近买有交易行为的客户;
2.交易频率较高的客户比交易频率较低的客户,更有可能再次发生交易行为;
3.过去所有交易总金额较多的客户,比交易总金额较少的客户,更有消费积极性。
我们了解了RFM的分析原理后,下面来看看如何在Python中用代码实现:

import numpy
import pandasdata = pandas.read_csv('D:\\PDA\\5.7\\data.csv'
)data['DealDateTime'] = pandas.to_datetime(data.DealDateTime, format='%Y/%m/%d'
)data['DateDiff'] = pandas.to_datetime('today'
) - data['DealDateTime']data['DateDiff'] = data['DateDiff'].dt.daysR_Agg = data.groupby(by=['CustomerID']
)['DateDiff'].agg({'RecencyAgg': numpy.min
})F_Agg = data.groupby(by=['CustomerID']
)['OrderID'].agg({'FrequencyAgg': numpy.size
})M_Agg = data.groupby(by=['CustomerID']
)['Sales'].agg({'MonetaryAgg': numpy.sum
})aggData = R_Agg.join(F_Agg).join(M_Agg)bins = aggData.RecencyAgg.quantile(q=[0, 0.2, 0.4, 0.6, 0.8, 1],interpolation='nearest'
)
bins[0] = 0
labels = [5, 4, 3, 2, 1]
R_S = pandas.cut(aggData.RecencyAgg, bins, labels=labels
)bins = aggData.FrequencyAgg.quantile(q=[0, 0.2, 0.4, 0.6, 0.8, 1],interpolation='nearest'
)
bins[0] = 0;
labels = [1, 2, 3, 4, 5];
F_S = pandas.cut(aggData.FrequencyAgg, bins, labels=labels
)bins = aggData.MonetaryAgg.quantile(q=[0, 0.2, 0.4, 0.6, 0.8, 1],interpolation='nearest'
)
bins[0] = 0
labels = [1, 2, 3, 4, 5]
M_S = pandas.cut(aggData.MonetaryAgg, bins, labels=labels
)aggData['R_S']=R_S
aggData['F_S']=F_S
aggData['M_S']=M_SaggData['RFM'] = 100*R_S.astype(int) + 10*F_S.astype(int) + 1*M_S.astype(int)bins = aggData.RFM.quantile(q=[0, 0.125, 0.25, 0.375, 0.5, 0.625, 0.75, 0.875, 1],interpolation='nearest'
)
bins[0] = 0
labels = [1, 2, 3, 4, 5, 6, 7, 8]
aggData['level'] = pandas.cut(aggData.RFM, bins, labels=labels
)aggData = aggData.reset_index()aggData.sort(['level', 'RFM'], ascending=[1, 1]
)aggData.groupby(by=['level']
)['CustomerID'].agg({'size':numpy.size
})

如何在Python中实现RFM分析相关推荐

  1. 【机器学习基础】如何在Python中处理不平衡数据

    特征锦囊:如何在Python中处理不平衡数据 ???? Index 1.到底什么是不平衡数据 2.处理不平衡数据的理论方法 3.Python里有什么包可以处理不平衡样本 4.Python中具体如何处理 ...

  2. linux中python如何调用matlab的数据_特征锦囊:如何在Python中处理不平衡数据

    今日锦囊 特征锦囊:如何在Python中处理不平衡数据 ? Index 1.到底什么是不平衡数据 2.处理不平衡数据的理论方法 3.Python里有什么包可以处理不平衡样本 4.Python中具体如何 ...

  3. 中boxplot函数的参数设置_如何在Python中生成图形和图表

    在本章中,我们将学习如何在Python中生成图形和图表,同时将使用函数和面向对象的方法来可视化数据. Python中常用的一些可视化数据包括以下几种. Matplotlib. Seaborn. ggp ...

  4. float在python_如何在python中读取.float文件? - python

    Improve this question 我正在处理大脑MRI数据,它是.float数据. 您知道如何在python中使用它吗? 与 with open('[43x25520].float') as ...

  5. python 线性回归模型_如何在Python中建立和训练线性和逻辑回归ML模型

    python 线性回归模型 Linear regression and logistic regression are two of the most popular machine learning ...

  6. 教你如何在Python中读,写和解析CSV文

    摘要:在这篇文章中关于"在Python如何阅读CSV文件"中,我们将学习如何读,写和解析的CSV文件的Python. 您知道将表格数据存储到纯文本文件背后的机制是什么吗?答案是CS ...

  7. java opencsv 乱码_教你如何在Python中读,写和解析CSV文

    摘要:在这篇文章中关于"在Python如何阅读CSV文件"中,我们将学习如何读,写和解析的CSV文件的Python. 您知道将表格数据存储到纯文本文件背后的机制是什么吗?答案是CS ...

  8. 如何在Python中加速信号处理

    如何在Python中加速信号处理 This post is the eighth installment of the series of articles on the RAPIDS ecosyst ...

  9. 【干货书】Python中的商业分析概念、技术和应用的数据挖掘

    来源:专知 本文为书籍介绍,建议阅读5分钟读者将学习如何在Python中实现各种流行的数据挖掘算法,以解决业务问题和机会. 商业分析的数据挖掘:Python中的概念.技术和应用介绍了数据挖掘概念和方法 ...

最新文章

  1. Windows8.1+Eclipse搭建Hadoop2.7.2本地模式开发环境
  2. gsonformat插件_IntelliJ IDEA18个常用插件,动图演示,让你效率翻倍!
  3. 在PowerDesigner中设置字段唯一约束 --相当于unique
  4. Apache CXF实现Web Service(3)——Tomcat容器和不借助Spring的普通Servlet实现JAX-RS(RESTful) web service...
  5. Parity Game CodeForces - 298C
  6. linux下统计文件的数目,Linux下如何统计文件数目
  7. Flsak项目--图片验证码
  8. 线程中如何使用对象_在 Flink 算子中使用多线程如何保证不丢数据?
  9. [Python] L1-012. 计算指数-PAT团体程序设计天梯赛GPLT
  10. $bzoj1079-SCOI2008$ 着色方案 $dp$
  11. DEM数据基本概念介绍
  12. 利用Axure制作动态表格(Axure学习日志1)
  13. 分享117个PHP源码,总有一款适合你
  14. 动态场景下的语义SLAM的简单实现(基于YOLOv5目标检测)
  15. matlab小波变换函数总结,matlab小波变换函数的总结与程序
  16. java中n次方怎么表示_java中的一个数的N次方
  17. RS-485什么情况下需要上下拉电阻?
  18. 怎么实现类似星星闪烁的效果(box-shadow)
  19. 任天堂FC专题 (现在还有没有人对FC感兴趣? 红白机游戏汉化)
  20. Z-Blog模板安装和使用教程

热门文章

  1. python实现获取计算机硬件信息并写入excel
  2. python读取docx文件_Python读写docx文件
  3. 三只猫。。。俺家小豹小的时候,哪个更可爱呢???
  4. Java 实现数据库导出Word
  5. python做线性回归_利用python实现简单的线性回归
  6. 同相放大器和反相放大器
  7. 【光纤通信—第三部分 光检测与光接收机】光接收机
  8. KMP--君住长江头,我住长江尾,日日思君不见君,共饮长江水
  9. 邮件发送(邮件服务器+邮件客户端)
  10. GlobalMapper20把地形数据(tif)转为可打印的STL格式模型