您现在的位置是：首页 > 数据库

当前栏目

SQL Server聚类数据挖掘信用卡客户可视化分析

2023-02-18 16:32:21 时间

全文链接：http://tecdat.cn/?p=30925

原文出处：拓端数据部落公众号

近年来商业银行利用先进数据挖掘技术对信用卡客户进行分类,区分不同的客户群体,然后针对不同客户群体,采取不同的发卡方式,营销策略,风险控制措施。这些举动都是十分有必要的,也是对信用卡产品获得市场份额有巨大帮助作用的。

在信用卡分析时，我们向客户演示了用SQL Server的数据挖掘算法可以提供的内容。

查看数据

查看信用卡资料库：

变量信息：

导入数据库

数据导入数据库中。

数据挖掘

（1）打开visual studio ，新建项目，选择商业智能项目，analysis services项目

（2）在解决方案资源管理器中，右键单击数据源，选择新建数据源

（3）数据源名称保持默认，完成

选择聚类，继续下一步

关闭处理窗口后，就可在挖掘模型查看器看到系统经过分析得出的结果和文件：

从聚类结果可以看到，聚类将所有用户分成了10个信用级别。

从不同类别的依赖图可以看到，类别10、7、9、5之间具有较强的相关关系。说明这几个类别中的信用级别是类似的。下面可以具体看下每个类别中的各个属性的分布的比例。

从上图可以看到不同类别的呆账比例是不同的。

从结果来看，相对来说，第7、10类别的呆账比例最小的，其他几个类别中呆账比例较高，因此可以认为这些类别中的用户的信用级别较高。同时可以看到这些类别的其他信息，这类用户的月开销较低，大多在10000元以下。同时可以看到，这类用户大多是都是都市用户，较少的城镇用户，说明都市用户的信用等级相对城镇用户的信用等级较高。另一方面，可以看到呆账用户中，有大部分是高收入人群，而低收入用户的呆账比例反而较低，可以认为低收入用户的信用等级反而较高。

从每个类别的倾向程度来看，月开销较低的用户呆账比例较低。从另一方面来看，月收入较低的用户，倾向于是分类10的用户，也就是它们的信用等级较好。同时可以看到，户籍为都市的用户倾向于分类10的用户，而户籍为城镇的用户倾向于其他分类。说明都市用户的信用等级相对较高。同时，可以看到与收入越高的用户，更倾向于非10类别，因此，可以认为，收入越高的用户，越存在信用风险。

最受欢迎的见解

1.R语言k-Shape算法股票价格时间序列聚类

2.R语言基于温度对城市层次聚类、kmean聚类、主成分分析和Voronoi图

3.R语言对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归

4.r语言鸢尾花iris数据集的层次聚类

5.Python Monte Carlo K-Means聚类实战

6.用R进行网站评论文本挖掘聚类

7.R语言KMEANS均值聚类和层次聚类：亚洲国家地区生活幸福质量异同可视化

8.PYTHON用户流失数据挖掘：建立逻辑回归、XGBOOST、随机森林、决策树、支持向量机、朴素贝叶斯模型和KMEANS聚类用户画像

9.R语言基于Keras的小数据集深度学习图像分类

猜你喜欢

DAG任务调度系统 Taier 演进之道，探究DataSourceX 模块
小游戏赛道是如何变现的？
【技术分享】如何实现功能完备性能优异的RTMP、RTSP播放器？
Science & Nature 双开花：改善过继性免疫细胞疗法的新手段 - MedChemExpress
Eudic欧路词典 for Mac v4.2.9增强激活版
关闭OSX的rootless和修改MAMP的php.ini配置
Laravel 非常规教程之1 生命周期
Laravel 非常规教程之0 引入篇
解读 2022 诺贝尔生理学或医学奖 | MedChemExpress
智慧城管视频监控AI智能分析系统线上巡城
使用命令行下载youtube的视频和字幕
CCK-8，让细胞活性检测 So Easy! - MedChemExpress
两个好用的命令行工具 watch 和 rsync
把zsh放到docker里
Centos7下使用Squid快速搭建带认证的HTTP代理服务器
python守护进程 - python-daemon
nginx+php 上传大文件
Nexus6刷机笔记
河道水面漂浮物垃圾识别监测系统
Linux下简单计算md5,base64,sha1,sha2

zl程序教程