作者aoishingo (拼)
看板Statistics
标题Re: [问题] 抽样的问题
时间Sun Jul 1 13:51:58 2007
※ 引述《[email protected] (老怪物)》之铭言:
: ※ 引述《[email protected] (P.P + Ray Allen)》之铭言:
: > 抽样的问题
: > 假设我现在想要抽样1068个样本
: > 希望样本的受访者居住地 性别 年龄 教育程度 都符合该地母体
: > 母体资料来说 有办法查到母体的居住地 性别 年龄 教育查不到(所以无法做加权)
: 加权其实有很大的成分只是自我安慰. 已经有偏的样本,
: 不因加权就能修正偏误.
: 人口统计有教育程度资料, 只是大概很难取得小地区, 且
: 按性别、年龄别交叉分类的详细资料.
yhliu 您是认为说 加权这种东西很不真实 是在刻意放大或缩小
甚至制造受访者的声音吗 如果这样 是否代表 事前的筛选比较好
是否说 加权这种东西 能够不要使用 就不要使用?
: > 该地区河东河西的居民 河东比河西是0.48比0.52
: > 但是在电话抽样时 因为电话分布的关系 抽到河东比河西却是颠倒成0.52子0.48
: 如果是两地区电话普及率不同, 或平均每千人电话号码数
: 不同导致样本与群体结构不一致, 你的样本真正代表的是
: 有电话的群体,或 "电话号码群体". 不论人为控制样本数,
: 或用事後加权, 都是自我安慰, 以为电话号码群体与实际
: 目标群体之间的差异, 只在於居住地分布.
: 如果是抽样或其他操作程序造成样本结构与群体结构不符,
: 这样本的可信程度令人怀疑.
: 因抽样群体(电话号码)与目标群体不一而衍生的加权问题,
: 究竟以控制两地区样本数或事後加权, 实际上两者皆无不
: 可. 事实上若非电访, 事先控制两地区样本数而两地区独
: 立抽样, 理论上比事後加权好些. 但在电访, 实际操作是
: 否能令人信赖? 其一是清单上的样本顺序是否确定随机?
: 其次是既然能因某地区样本已足而放弃其他同地区样本,
: 是否也能轻易因其他理由放弃其他特性之样本? 再者, 一
: 地区先足额而後放弃该地区其他被选中样本, 是否能保证
: 另一地区也能完成预定样本数?
如果jacky大大 河东河西无法独立抽样 但是用电访软体可以确保清单上顺序随机
这样是用加权还是筛选比较好
该市河东河西只差4% 理论上 一地问完就煞车 应该可以问完另一地
因为差4% 大概差50通左右 要整个问完应该不难 那筛选还是加权好
如果河东河西人口如jacky说的48%比52% 但是电话比变成60%比40%甚至更惨的情形
这样子是要筛选还是加权好呢
: > 请问 是不管比例颠倒 直接拨打 到时候再加权
: > 还是说 河东问到1068x0.48 = 512 时 就停下来 只问河西 问到相加成1068
: > 这段时间内 电话拨到河东的就放弃
: > 哪个比较自然 比较符合抽样原理呢 ??
: > 统计初学 请多多指教
我在统计版常常看到您热心回文 真是感谢您 辛苦了 !!
--
※ 发信站: 批踢踢实业坊(ptt.cc)
◆ From: 218.169.118.187
1F:推 flunk:你误会y大的意思了,他应该是说假如抽样的过程已经造成样本 07/01 14:19
2F:→ flunk:偏误,那再加权那个偏误的情形不会因此消失 07/01 14:19
3F:→ flunk:反过来说,如果抽样过程是正确的,那使用事後加权未尝不是一 07/01 14:21
4F:→ flunk:种补救的方法 07/01 14:21