作者tew (咖啡王子)
站内Statistics
标题Re: [问题] 回归问题急问
时间Sun Dec 28 14:26:24 2008
这边令我在意的不是方法学
而是心态
你在心态上已经认定
好的回归模型就是要建立出变数都显着的模型
因此 很在意造成不显着的变数跟outlier
那麽 我这样说明好了
你的模型之所以会显着 其实就是那极端值也是那不显着的变数造成的
为什麽呢
因为y=a+bx中
b的意义就是当x变动一单位时,y会随之变动几单位
但如果x变异不大时,表示X集中於平均数
但如果有outlier的产生 那变异性就会增加
那麽b就会显着 那麽有没有意义呢?
接下来就是变数
请考虑共线性问题以及交互作用
放入变数显着 删去不显着的变数後不显着
你可以把不显着的变数当作是化学作用的催化剂
有催化剂以後 促进化学作用的产生
进行化学反应後 催化剂不会有任何改变
因此催化剂不显着
但是没有催化剂 化学作用一样会产生 只是费时长久
所以 请思考不显着的原因
而不是删了就好
接下来回答本文
建立一个好的模型
在於完善的理论基础与架构
然後 有多少证据说多少话
好的模型 不必在於星星的多寡
※ 引述《coolcarl83t (??????????????????)》之铭言:
: 请问在建立回归模型时,是要先透过STEPWISE等方法把不显着的变数删掉
: 把多余变数删掉後,在开始删除资料中的离群值??
: 还是要先透过COOK/DFFITS法先将离群值删除後
: 再透过STEPWISE等法来把不显着的变数删掉以找出最适合的MODEL??
: 今天在跑回归时,我先透过STEPWISE的方法把不显着的变数删掉,结果
: 开始删离群值後,那些剩下来显着的变数却变不显着了???
: 之後我采用先删离群值的方法,然後再删变数,结果在删完变数後
: 又有过大的离群值要删了???
: 感觉这两个都是互相关联
: 请问各位大大要这两个的优先顺序是如何
: 到底要建立一个好的回归模型是要先删离群值或是先删除多余的变数??
: 感谢各位大大的回答
--
※ 发信站: 批踢踢实业坊(ptt.cc)
◆ From: 134.208.29.230
1F:推 angelmoomin:说得很好,推一个 12/28 15:38