作者sleepwu ( hopeless)
看板Statistics
标题[问题] 样本"出现机率"的标准差
时间Tue Aug 14 01:02:58 2012
不好意思,连续好几天碰到太多数据眼花撩乱无法思考
向各位大大问两题很基本的问题,第一个回答我的大大附上500P(含税)聊表谢意
1.假设从一个班级里抽出5个人的身高来做统计,那麽计算标准差时应该是要用样本标准
差
也就是n-1对吗??
2.
姓名 身高
甲 160
乙 160
丙 155
丁 150
戊 140
这是身高资料,我现在想要知道"每一种身高的出现机率的均数和标准差"
也就是
身高 出现次数 出现机率
160 2 40%
155 1 20%
150 1 20%
140 1 20%
那请问出现机率的平均数是
100%/4=25% 还是 (40%*2+20%*1+20%*1+20%*1)/5=28%??
我困惑点在"160的出现机率是40%,但它出现2次",那计算标准差的时候
是要2*(40%-25%)^2呢,还是不用管出现次数?
我原本的想法是"出现机率"已经考虑到出现次数了,所以计算出现机率的标准差时,
就不用再去管样本在群体中的出现次数,不知道这样对不对?
谢谢m_ _m
--
※ 发信站: 批踢踢实业坊(ptt.cc)
◆ From: 118.169.212.63
1F:推 goshfju:这五个人比较像样本 另外你为何要算"出现机率"的标准差 08/14 02:40
2F:→ sleepwu:这是我简化後的题目 原本是从母体找出样式(pattern)种类 08/14 02:48
3F:→ sleepwu:再计算每个样式的出现机率(即支持度) 标准差可以帮助订定 08/14 02:49
4F:→ sleepwu:最小支持度 这样我才知道有那些样式是有意义的 08/14 02:49
5F:→ sleepwu:原本的样式是user的网页浏览模式 08/14 02:50