SPSS聚类分析用于筛选聚类变量的一套方法.docx

上传人:b****6 文档编号:6882096 上传时间:2023-01-12 格式:DOCX 页数:7 大小:203.75KB
下载 相关 举报
SPSS聚类分析用于筛选聚类变量的一套方法.docx_第1页
第1页 / 共7页
SPSS聚类分析用于筛选聚类变量的一套方法.docx_第2页
第2页 / 共7页
SPSS聚类分析用于筛选聚类变量的一套方法.docx_第3页
第3页 / 共7页
SPSS聚类分析用于筛选聚类变量的一套方法.docx_第4页
第4页 / 共7页
SPSS聚类分析用于筛选聚类变量的一套方法.docx_第5页
第5页 / 共7页
点击查看更多>>
下载资源
资源描述

SPSS聚类分析用于筛选聚类变量的一套方法.docx

《SPSS聚类分析用于筛选聚类变量的一套方法.docx》由会员分享,可在线阅读,更多相关《SPSS聚类分析用于筛选聚类变量的一套方法.docx(7页珍藏版)》请在冰豆网上搜索。

SPSS聚类分析用于筛选聚类变量的一套方法.docx

SPSS聚类分析用于筛选聚类变量的一套方法

SPSS聚类分析--用于筛选聚类变量的一套方法

SPSS聚类分析:

用于筛选聚类变量的一套方法

来源:

数据小兵

聚类分析是常见的数据分析方法之一,主要用于市场细分、用户细分等领域。

利用SPSS进行聚类分析时,用于参与聚类的变量决定了聚类的结果,无关变量有时会引起严重的错分,因此,筛选有效的聚类变量至关重要。

案例数据源:

在SPSS自带数据文件plastic.sav中记录了20中塑料的三个特征,分别是tear_res(抗拉力)、gloss(光滑度)、opacity(透明度),相关经验表面这20中塑料可以分为3个种类,如果用这三个变量进行聚类,请判断和筛选有效聚类变量。

一套筛选聚类变量的方法

 

一、盲选

将根据经验得到的、现有的备选聚类变量全部纳入模型,暂时不考虑某些变量是否不合适。

本案例采用SPSS系统聚类方法。

对话框如下:

 

统计量选项卡:

聚类成员选择单一方案,聚类数输入数字3;

绘制选项卡:

勾选树状图;

方法选项卡:

默认选项,不进行标准化;

保存选项卡:

聚类成员选择单一方案,聚类数输入数字3;

二、初步聚类

这是盲选得到的初步聚类结果,并且在数据视图我们可以看到已经自动生成了一个聚类结果变量,这个变量非常有用。

三、方差分析

是不是每一个纳入模型的聚类变量都对聚类过程有贡献?

利用已经生成的初步聚类结果,我们可以用一个单因素方差分析来判断分类结果在三个变量上的差异是否显著,进而判断哪些变量对聚类是没有贡献的。

分类的差异很大,而两外两个变量则在三个分类上没有显著差异,没有很好的类别区分度,所以,我们可以认为,这两个变量对聚类无作用或者无贡献,可考虑踢出模型。

我们还想从可视化的角度来查看和判断,单因素方差分析为我们提供了均值图,可惜,这三个图却最容易误导我们的判断,因为spss在自动生产均值图时为每一个变量单独制图,而且分配不同的纵轴坐标,导致每个图看起来都有非常大的差异,从视觉上迷惑我们做出错误的判断。

 

这里需要改进!

四、均值描述

为改进以上SPSS默认选项的不足之处,我们需要自己生成三个变量在不同类别上的均值,means过程可以帮助到我们。

 

从数字上来看,抗拉力(6.8、6.7、7.1)、光滑度(9.3、9.4、9.2)两个指标在三个类别上并没有多大的差异,而对聚类有贡献的透明度指标在不同类别上区分度非常明显。

 

五、多线均值图

克服纵轴刻度的方法是将这三个指标放在同一个坐标轴上进行对比,也就是制作一个多线均值图。

 

此时,结果已经一目了然了。

综上,我们可以将抗拉力、光滑度两个指标从模型中剔除,只留下透明度一个指标再进行聚类。

 

我们发现,前后两次聚类的结果一模一样,用一个指标可以代替以前三个指标的进行聚类。

我们这样做的意义何在?

如果能将这些整理成为规则,形成经验,那我们就可以不用测量抗拉力和光滑度这两个指标了,你不觉得多测量两个指标成本会增加吗?

展开阅读全文
相关资源
猜你喜欢
相关搜索

当前位置:首页 > 解决方案 > 学习计划

copyright@ 2008-2022 冰豆网网站版权所有

经营许可证编号:鄂ICP备2022015515号-1