作者waterfat520 ( )
看板Statistics
标题[问题] 类别资料与连续资料比较二者平均值
时间Thu Sep 18 11:18:49 2008
※ [本文转录自 Math 看板]
作者: waterfat520 ( ) 看板: Math
标题: [统计] 类别资料与连续资料如何比较二者平均值差异
时间: Mon Sep 15 17:46:43 2008
目前碰到一个问题 有一栏资料是类别型资料(A B C)
想比较是否是造成另一栏连续资料的因素(drive)
例如说 资料如下 想比较 机器平台是否造成产能的差异(机器平台vs产能)
或 包装法是否造成产能的差异(包装法vs产能)
(栏位1) (栏位2) (栏位3)
机器平台 包装方法 产能
A a 287
A b 82.5
A c 1107.31
A a 86.9
A b 336.3
A d 84
B d 23.2
A b 130.3
A a 116
D a 72
A a 258.7
A f 230.7
A e 157
A a 246.9
C a 69.9
我想到的是用one-way ANOVA,先把类别资料编码A=1 B=2 C=3 D=4 E=5 F=6,
可是手上目前有的软体是EXCEL跟SPSS EXCEL似乎用"单因子变异数分析"还要手工把资料
处理成每一个类别一个栏位然後把产能放进来
像是机器平台变成四个栏位 平台A 平台B 平台C 平台D 各别的产能放到对应平台下
这样另一个问题又出现了因为每一个类别的个数不一样 例如平台D只有一笔
如果我用SPSS的one-way ANOVA不需要特别手工处理(上面的资料编码後丢进去)
其中Dependent list选产能 Factor选平台
就可以跑出来F值和显着性Sig. 但我不知道这样是不是对的
SPSS可以自行处理类别个数不一样的情形吗?还是我上述的问题不应该用ANOVA?
--
※ 发信站: 批踢踢实业坊(ptt.cc)
◆ From: 140.114.5.154
--
※ 发信站: 批踢踢实业坊(ptt.cc)
◆ From: 140.114.123.153
1F:推 inzee:two-way呢? 09/18 14:36
2F:→ inzee:oh sorry 应该不能用two way 09/18 14:36
3F:→ inzee:我会直接丢model中去跑跑看 GLM 09/18 14:37
4F:→ waterfat520:为什麽用GLM 只是想知道栏位1vs栏3 栏2vs栏3 09/18 20:49
5F:→ waterfat520:并没要考虑栏1栏2交互影响 还是GLM不是gen lin model 09/18 20:51
6F:→ yhliu:由於不是直交设计, 应采 two-way ANOVA 而非 one-way. 09/19 10:43
7F:→ yhliu:至於软体是采用哪个程序完成非直交的 ANOVA, 恕不回. 09/19 10:45
8F:→ waterfat520:我不懂为何要用two-way 一次只要比一种因素对栏3影响 09/20 21:05
9F:→ waterfat520:栏1与栏2为类别资料 栏3为连续资料 如何进行ANOVA? 09/20 21:12
10F:→ waterfat520:可否大约说明一下使用two-way的原因? 09/20 21:13
11F:→ yhliu:不同机器平台之间, 其使用的包装方法不一致. 09/24 21:50
12F:→ yhliu:One-way ANOVA 在比较机器平台之效应时, 掺杂了不同包装之效 09/24 21:51
13F:→ yhliu:应. 类似地, 比较不同包装方式之效应时, 有机器平台效应掺杂 09/24 21:52
14F:→ yhliu:这就像复回归不能以简单回归取代. 09/24 21:53