作者gsuper (統計的巴比倫塔)
看板Statistics
標題[問題] 請問一個關聯性研究的小問題
時間Wed Oct 6 15:55:07 2010
我剛剛透過 odds_ratio 得到一個結果
Control Case(肺癌)
-------------------------
不抽菸 | 100人 | 100人 |
-------------------------
抽菸 | 100人 | 150人 | (非真實數字)
-------------------------
Odds_ratio = 100*150/(100*100) = 1.5 (***) [1.4,1.7]
接下來我知道肺癌在台灣的盛行率為 20%
我需要計算抽菸這個因子的絕對風險
意思是說
我必須下一個結論說
"假如你抽菸" 你得肺炎的
個人發生率是多少
因此我把 1.5 * 20% = 30%
----------------------------------------------
我想問的是
我覺得這樣計算太粗糙
因此想在文獻資料庫裡面搜尋可行的演算法
但我發現我不知道要用甚麼關鍵字去查比較好
"Association study" 範圍有點太廣
請問我該用甚麼關鍵字去查?
--
--
※ 發信站: 批踢踢實業坊(ptt.cc)
◆ From: 140.113.239.247
※ 編輯: gsuper 來自: 140.113.239.247 (10/06 15:57)
1F:→ yhliu:少一條件: 多少比例的人吸菸? 10/06 21:22
不能用 p = 250/(250+200) 嗎? (改一下數字,之前心算錯誤)
※ 編輯: gsuper 來自: 140.113.239.247 (10/06 23:16)
2F:→ bmka:先查一下case-control study design 就知道y大為什麼這樣說了 10/07 05:33
3F:→ kingbee:吸菸盛行率 10/07 09:40
我之前學的
是因為這不是前瞻式的研究
所以分母不能用橫向的兩格相加
因為 case 和 control 是人為訂定
非隨機取樣 , 因而改用 OR
除非是一開始先隨機抽樣
再事後切成四格
才能自由方向的做加總
所以我這裡就是犯了這個錯誤嗎?
因為我還是不太肯定~~~
※ 編輯: gsuper 來自: 140.113.239.247 (10/07 16:33)
※ 編輯: gsuper 來自: 140.113.239.247 (10/07 16:34)
我發現我忘了問最重要的問題
假設已知抽菸盛行率 : 30%
Odds ratio : 1.5
肺癌盛行率 : 20%
那吸菸者
個人的絕對風險要怎麼算?
因為我不知道吸菸盛行率要怎麼用
比方說
我的客戶叫 大米
大米來我的公司做健康檢查
我必須告訴他
因為你抽菸
根據我們做了一個樣本數為 450 的關聯性研究
你得肺癌倍率是正常人的 1.5 倍 (OR)
95% 的信賴區間為 [1.4,1.7] (CI of OR)
而台灣的肺癌盛行率是 20% (Prevalence)
所以你個人的得病率估計是 1.5*20% = 30% (個人得病率)
這樣吸菸盛行率要用在哪裡?
※ 編輯: gsuper 來自: 140.113.239.247 (10/07 16:37)
※ 編輯: gsuper 來自: 140.113.239.247 (10/07 16:37)
※ 編輯: gsuper 來自: 140.113.239.247 (10/07 17:02)
4F:→ bmka:Your description of the study design is not correct. 10/08 07:48
5F:→ bmka:In fact, the cases are a random sample of the disease. 10/08 07:50
6F:→ bmka:Similarly, the controls are a random sample of the 10/08 07:50
7F:→ bmka:disease-free population. 10/08 07:51
8F:→ bmka:Oops... insert "population" after line 2. 10/08 07:52
9F:→ bmka:之前沒看仔細,的確只要知道肺癌的盛行率就可以算 10/08 10:54
10F:→ bmka:y 大的提示有誤 10/08 10:55
11F:→ bmka:原來你問的問題,用貝氏定理就可以解答 10/08 11:00
12F:→ yhliu:我對 "多少比例的人吸菸" 的疑問來自對於原數據我只接受了 10/08 15:35
13F:→ yhliu:OR=1.5 這假設...因為本來的數據就都是假設的. 10/08 15:36
14F:→ yhliu:若是真實抽樣資料, 不管是 case/control 獨立抽樣或配對抽樣 10/08 15:37
15F:→ yhliu:都分別能估計 case 與 control 的抽菸比例, 再加上患者比例, 10/08 15:38
16F:→ yhliu:即可知整個群體的抽菸比例了, 何必再問? 10/08 15:39
那我再重複一下之前的問題
因為我有點搞混了
患者比例可以用 p = 250/(250+200) 來估計嗎?
因為我手邊的資料
很多都是只給 4 個條件
1. case 的抽菸比例
2. control 的抽菸比例
3. case 的總人數
4. control 的總人數
我是用代數的方法算出 OR 與 p
算 OR 應該是 OK
但我一直對這個 p 有很大的疑慮...
甚至有得資料給得更少
1. case 的抽菸比例
2. control 的抽菸比例
4. control 的總人數
這種資料我也只能暫時 Discard
原因都卡在這個 p 的計算
※ 編輯: gsuper 來自: 140.113.239.247 (10/08 16:44)
※ 編輯: gsuper 來自: 140.113.239.247 (10/08 16:47)
※ 編輯: gsuper 來自: 140.113.239.247 (10/08 16:49)
17F:→ LittlePet:嗯...你好 我個人的小意見 整個問題不在於怎麼算 10/10 10:46
18F:→ LittlePet:而是在你對於"盛行率" "發生率"的定義了不了解 10/10 10:48
19F:→ LittlePet:"個人發生率"這句話邏輯就不對了 發生率怎麼會有個人? 10/10 10:49
20F:→ LittlePet:"全台"盛行率 x"該研究"OR值 光是分母就不一樣了 10/10 10:52
21F:→ LittlePet:乘出來的數字也是沒有意義的吧! 10/10 10:53
22F:→ LittlePet:建議可以翻一下流行病學的書籍 我才疏學淺不敢亂說= = 10/10 10:55
23F:→ LittlePet:相信流病的書可以幫你釐清這些問題 10/10 10:55
24F:→ LittlePet:附注一下 你可能還要去查有關"直接標準化" "間接標準化" 10/10 10:58
25F:→ LittlePet:的概念 這些都是流行病學上常使用的 10/10 10:58
26F:→ gsuper:真的不能直接乘嗎? 因為我是有看到別人這樣做 10/10 18:51
27F:→ gsuper:沒關係我在去查查看流病的東西好了 3Q 10/10 18:52