作者YEEK (我最喜欢陈小麒)
看板Statistics
标题[问题] SAS跑cluster
时间Tue Jun 10 14:33:46 2008
大家好
目前边做边学边找资料学着跑群集分析 有些问题想请教板上先进。
目前手上有彭昭英的SAS与统计分析 以及陈顺宇的多变量分析
小妹目前是用18个题目缩减成五个因素後
以FACTOR SCORE来做群集分析
参考过论文和PAPER的群集分析过程
多半先以阶层式群集分析(PROC CLUSTER)并画出树型图决定组数後
再以互斥群集分析的K-MEANS法分组 (PROC FASTCLUS)
但目前自己试着做 却在决定组数时遇到一些问题
1.在PAPER上看到决定组数时有看到用agglomeration coefficient增加量来决定组数
(作者使用SPSS),但SAS在PROC CLUSTER後的报表并没有看到没有类似的值,只有看到
RMSSTD=1.2649,而书上写这个值愈小群体内相似性愈高,但PROC CLUSTER只会有一个
RMSSTD值并没有办法看出分成几组後RMSSTD等於多少..
2.尝试用树型图判断大略看出可分成三组,但是分成三组之後和因素之间的解释很无趣
因为用SHEFFE事後检定发现3个组在每个正向的因素几乎都是1>2>3,负向的因素则是
3>2>1,只能看出最好和最差的组别,中间那一组就很难讨论
3.另外有在PAPER上看过用PROC FASTCLUS在限制不同组数下的PSEUDO F及 R^2来决定
组数,只是R^2是组数愈多愈大没甚麽参考价值,PSEUDO F在我自己RUN的结果是组数
遇大值愈小,所以也不知道怎麽判别组数的最适解
4.或者先分组完後,以区别分析或其他方式来看适切度? (这个还没试)
请有用SAS跑过群集分析的朋友给些迷津了 感恩!
--
※ 发信站: 批踢踢实业坊(ptt.cc)
◆ From: 163.29.76.66
1F:推 tew:建议你看周文贤老师的书,他有SAS的范例 06/10 16:19