作者squall500 (一年之後又一年)
看板Statistics
标题Re: [问题] 关於Z score
时间Wed Oct 29 23:51:52 2008
※ 引述《IamPUMA (我是普马)》之铭言:
: : 不好意思,有个很怪的问题想请问大家
: : 标准化是将样本值减去均数後,再除标准差
: : 而这样得到的结果称为Z-score或standard score
: : 我的问题是
: 你的问题不是这个吧~~~????
: _
: X - mean
: 还是 所谓 Z = ________________
: sigma
您这里提到的我想应该是分配收敛到Normal
而我只是很单纯的计算标准化之後的值
我们讲的应该是不一样的东西吧
如果有错麻烦指正
: : 1.这是否需建立在母体为常态的假设上?
: : 2.若母体非常态,标准化後的值是否仍有对应的名词?
: : 虽然这样算出来的值没办法对应到z-table
: : 不过仍然可视为一个衡量相对位置的值吧
: : (还是可以表示该样本距离均数几个标准差)
: : 3.若不存在母体,将作何解释?
: : 例如我要将班上10个同学的考试成绩标准化
: : 但不一定代表背後有一个成绩的母体对吧?
: : 若没有母体则同学的成绩也就不能说是抽样的结果了
: : 那麽这样标准化是否还有意义,是否还有对应的名词?
: 不存在母体...那你是要推论什麽 ?
: 你那10个同学就是母体啊 !!!!!!!!!!!! 你这叫做普查 Census
: 你没有搞清楚你要干什麽哦 ~! 为什麽要标准化 ??
: 盲目的操作会出问题的唷
很抱歉,我也觉得我思绪有点混乱,竟然会有没有母体这种想法
重新想过之後,我再试着把问题表示清楚一点
现有甲、乙两班学生分别用A、B两份考卷进行测验
考完试後要将甲、乙两班混合排名
但因为考卷不同,难易度不同,直接用原始分数排名不够公平
所以产生将两班成绩各自标准化後再比较的想法
问题是我不知道该怎麽定义什麽是母体、什麽是样本,随机变数又是哪个?
想法1:
甲、乙两班各为一个母体,分数是随机变数
每一个同学的分数是一个抽样结果
也就是X是代表甲班的分数随机变数
若甲班有10位同学,他们的成绩分别是X1...X10的抽样结果
这个情况下无论母体是何种分配,标准化之後都是一个可比较的值
但如果A、B两份考券恰巧难易度相同,而且甲班程度本来就比较好
这样却可能让乙班本来成绩比甲班差的,标准化後得到比甲班更好的Z值
(如 甲1 > 乙2,Z乙2 > Z甲1 可能会发生这个标准化後反而之真的例子)
想法2:
把这两个母体用随机变数表示也许是错误的想法
如果是所谓的「普查」,那麽标准化这个过程是否还有意义?
或者,两班的分数根本就没办法比较呢?
有什麽方法可解决这个问题呢?
麻烦大家了,真是不好意思
--
※ 发信站: 批踢踢实业坊(ptt.cc)
◆ From: 123.204.50.253
※ 编辑: squall500 来自: 123.204.50.253 (10/29 23:57)
1F:推 kenshin528:根本没有统一的比较标准 你要怎样混合排名? 10/30 10:56
2F:→ squall500:谢谢,我再好好想想 10/31 08:35