作者bmka (游子)
看板Statistics
标题Re: [问题]ANOVA是如何同时比较"变异数"和"平均数"
时间Thu Jun 5 07:23:46 2008
※ 引述《gsuper (绿色苏打心)》之铭言:
: ANOVA 的可能状况实在太多了...
: 越想越混乱
: 我先陈述我的想法
: -----------------------课本的公式-------------------------------------------
: SStotal = SStreat + SSerror
: test statistic = Global F = MSt/MSe
: MSt = SStreat / k-1
: MSe = SSerror / N-k
: -----------------------自己稍微整理一下-------------------------------------
: Global F = SStreat/(N-K) 除以 SSerror/(k-1)
: = SStreat/SSerror * (N-k/k-1)
: where (N-k) / (k-1)
: 一般来说是一个大於 1 的常数 (k为treatments数量 N为总data的数量)
: 既然是常数就暂时不要理它了
不能不理, 少了这项就不是F distribution
The d.f.'s involve both the sample size and the number of predictors.
: 然後进行下一步
: -----------------------现在来考虑各种情况-----------------------------------
: 这边我都是自己设计一些data来代入
: 考虑这个变数
: SStreat/SSerror
: 究竟发生了什麽事
: SStreat 有3个状况
:
: 1. 极小 很接近0
: 2. 普通
: 3. 巨大
: SSerror 也有3种状况
:
: 1. 极小 很接近0
: 2. 普通
: 3. 巨大
: 简单来看
: 是可以画出一个 九宫格
: 区分成 3 X 3 的范畴来考虑
: 再来...
: 每个九宫格里面
: 都可以区分成以下的模式
:
: 1. 0 <= F < 1 ?
: 2. 1 <= F <= C.V. accept Ho
: 3. C.V. < F reject Ho
:
: 所以
: 总共可以区分成 3*3*3 = 27 种状况的立方体
:
: However!
: SStotal = SStreat + SSerror
: SStreat 和 SSerror 是有关联的!!!
: 想到这里我就软一半了...
: 而且必须再考虑一件事
: 当 SStreat 下降 时
: SSerror 多了3种可能性
: 下降 不变 上升
Given a dataset, SStotal is fixed.
哪里来的三种可能性啊???
:
: 所以总共又多了9种可能性
: 27 * 9 = 243种....
: 我一整天都在思考每种状况的情形
: 可是想越多
: 就越搞不懂......
: -------------------------------------------------------------
: 我只是想了解
: 究竟这个统计方法
: 是怎麽同时验证证 变异数和平均数的相等性
Analysis of variance 这个名字取得不好,
它其实主要是用来检验difference in means, 而不是检验 variance
: 还可以在 Model 1 和 Model 2 之间游走不定
: 见鬼!
: 拜托有没有版友前辈擅长 ANOVA 理论的大大敎我一下吧
: 我卡在这里足足3天了
: 这些东西不懂我没办法去念 two-way ANOVA 阿!
One way or two way, 不就是regression 罢了
没那麽难啦
一个好的统计方法通常都是很直觉的,
建议你不妨先把ANOVA method的intuition先把握住, 再来看理论部份
希望下面网页里的图能对你有帮助
http://www.westgard.com/lesson40.htm
: -------------------------------------------------------------
: extra :
: 若是加入 alpha = 0.10 0.05 0.01
: 一共3种状况
: 那又要 243*3 = 729 种了
: 见鬼见鬼!!!
把significance level 扯进来干嘛??
※ 编辑: bmka 来自: 71.251.59.112 (06/05 08:26)
1F:→ gsuper:扯 alpha 是因为我假设 不同的alpha会影响到 pre F test 06/05 14:23
2F:→ gsuper:我是猜想 global F 是一种 test statistic 同时结合了 06/05 14:25
3F:→ gsuper:pre F 和 unpaired t 两种 test statistic... 06/05 14:26
4F:→ gsuper:套入不同的 dataset 也是尝试去切割 global F 06/05 14:28
5F:→ gsuper:自己都觉得有点误入歧途... 06/05 14:29
6F:→ bmka:What is pre F test? 06/05 20:13
7F:→ bmka:significance level 是不会影响到 test statistic的值的 06/05 20:13