暂无图片
暂无图片
暂无图片
暂无图片
暂无图片

SQL Server聚类数据挖掘信用卡客户可视化分析

拓端数据部落 2022-12-16
534

全文链接:http://tecdat.cn/?p=30925


近年来商业银行利用先进数据挖掘技术对信用卡客户进行分类,区分不同的客户群体,然后针对不同客户群体,采取不同的发卡方式,营销策略,风险控制措施点击文末“阅读原文”获取完整代码数据


这些举动都是十分有必要的,也是对信用卡产品获得市场份额有巨大帮助作用的。

在信用卡分析时,我们向客户演示了用SQL Server的数据挖掘算法可以提供的内容。

查看数据

查看信用卡资料库:

 变量信息:

导入数据库

数据导入数据库中。

数据挖掘

(1) 打开visual studio ,新建项目,选择商业智能项目,analysis services项目

(2) 在解决方案资源管理器中,右键单击数据源,选择新建数据源

(3)数据源名称保持默认,完成

选择聚类,继续下一步

相关视频


关闭处理窗口后,就可在挖掘模型查看器看到系统经过分析得出的结果和文件:

  从聚类结果可以看到,聚类将所有用户分成了10个信用级别。

从不同类别的依赖图可以看到,类别10、7、9、5之间具有较强的相关关系。说明这几个类别中的信用级别是类似的。下面可以具体看下每个类别中的各个属性的分布的比例。

从上图可以看到不同类别的呆账比例是不同的。

从结果来看,相对来说,第7、10类别的呆账比例最小的,其他几个类别中呆账比例较高,因此可以认为这些类别中的用户的信用级别较高。同时可以看到这些类别的其他信息,这类用户的月开销较低,大多在10000元以下。同时可以看到,这类用户大多是都是都市用户,较少的城镇用户,说明都市用户的信用等级相对城镇用户的信用等级较高。另一方面,可以看到呆账用户中 ,有大部分是高收入人群,而低收入用户的呆账比例反而较低,可以认为低收入用户的信用等级反而较高。

从每个类别的倾向程度来看,月开销较低的用户呆账比例较低。从另一方面来看,月收入较低的用户,倾向于是分类10的用户,也就是它们的信用等级较好。同时可以看到,户籍为都市的用户倾向于分类10的用户,而户籍为城镇的用户倾向于其他分类。说明都市用户的信用等级相对较高。同时,可以看到与收入越高的用户,更倾向于非10类别,因此,可以认为,收入越高的用户,越存在信用风险。



本文中分析的数据分享到会员群,扫描下面二维码即可加群!



点击文末“阅读原文”

获取全文完整代码数据资料


本文选自《SQL Server聚类数据挖掘信用卡客户可视化分析》。


点击标题查阅往期内容

PYTHON链家租房数据分析:岭回归、LASSO、随机森林、XGBOOST、KERAS神经网络、KMEANS聚类、地理可视化
MATLAB用改进K-Means(K-均值)聚类算法数据挖掘高校学生的期末考试成绩
R语言主成分PCA、因子分析、聚类对地区经济研究分析重庆市经济指标
Python用KShape对时间序列进行聚类和肘方法确定最优聚类数k可视化
R语言中的SOM(自组织映射神经网络)对NBA球员聚类分析
K-means和层次聚类分析癌细胞系微阵列数据和树状图可视化比较
KMEANS均值聚类和层次聚类:亚洲国家地区生活幸福质量异同可视化分析和选择最佳聚类数
PYTHON实现谱聚类算法和改变聚类簇数结果可视化比较
有限混合模型聚类FMM、广义线性回归模型GLM混合应用分析威士忌市场和研究专利申请数据
R语言多维数据层次聚类散点图矩阵、配对图、平行坐标图、树状图可视化城市宏观经济指标数据
r语言有限正态混合模型EM算法的分层聚类、分类和密度估计及可视化
Python Monte Carlo K-Means聚类实战研究
R语言k-Shape时间序列聚类方法对股票价格时间序列聚类
R语言对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归
R语言谱聚类、K-MEANS聚类分析非线性环状数据比较
R语言实现k-means聚类优化的分层抽样(Stratified Sampling)分析各市镇的人口
R语言聚类有效性:确定最优聚类数分析IRIS鸢尾花数据和可视化
Python、R对小说进行文本挖掘和层次聚类可视化分析案例
R语言k-means聚类、层次聚类、主成分(PCA)降维及可视化分析鸢尾花iris数据集
R语言有限混合模型(FMM,finite mixture model)EM算法聚类分析间歇泉喷发时间
R语言用温度对城市层次聚类、kmean聚类、主成分分析和Voronoi图可视化
R语言k-Shape时间序列聚类方法对股票价格时间序列聚类
R语言中的SOM(自组织映射神经网络)对NBA球员聚类分析
R语言复杂网络分析:聚类(社区检测)和可视化
R语言中的划分聚类模型
基于模型的聚类和R语言中的高斯混合模型
r语言聚类分析:k-means和层次聚类
SAS用K-Means 聚类最优k值的选取和分析
用R语言进行网站评论文本挖掘聚类
基于LDA主题模型聚类的商品评论文本挖掘
R语言鸢尾花iris数据集的层次聚类分析
R语言对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归
R语言聚类算法的应用实例
对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归
分位数回归、GAM样条曲线、指数平滑和SARIMA对电力负荷时间序列预测
【视频】R语言广义相加模型(GAM)在电力负荷预测中的应用
R语言里的非线性模型:多项式回归、局部样条、平滑样条、 广义相加模型GAM分析
R语言用标准最小二乘OLS,广义相加模型GAM ,样条函数进行逻辑回归LOGISTIC分类
R语言ISLR工资数据进行多项式回归和样条回归分析
R语言中的多项式回归、局部回归、核平滑和平滑样条回归模型
R语言用泊松Poisson回归、GAM样条曲线模型预测骑自行车者的数量
R语言中的多项式回归、B样条曲线(B-spline Curves)回归
R语言广义相加模型 (GAMs)分析预测CO2时间序列数据
R语言中实现广义相加模型GAM和普通最小二乘(OLS)回归
在r语言中使用GAM(广义相加模型)进行电力负荷时间序列分析
R语言用泊松Poisson回归、GAM样条曲线模型预测骑自行车者的数量
Python用广义加性模型GAM进行时间序列分析
R语言广义线性模型GLM、多项式回归和广义可加模型GAM预测泰坦尼克号幸存者
R语言中的广义线性模型(GLM)和广义相加模型(GAM):多元(平滑)回归分析保险资金投资组合信用风险敞口
R语言对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归
对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归



文章转载自拓端数据部落,如果涉嫌侵权,请发送邮件至:contact@modb.pro进行举报,并提供相关证据,一经查实,墨天轮将立刻删除相关内容。

评论