作者saltlake (SaltLake)
看板AfterPhD
标题[问题] 靠开放数据集出论文
时间Sun Dec 18 00:23:05 2016
发表学术论文的常见模式是
研究目标是验证某个假说
设计适当的方法验证假说
例如用电脑模拟或动物试验或人体试验产出数据
再透过对资料的分析证明或证误假说
不知各位网友是否注意到以发表和提供开放式数据集
(Open Dataset) 来发论文的模式?
像是开放某个临床数据集供世界各团队的纯研究使用
而这临床数据集可能是某种疾病的患者群之各种医学影像资料
等的形式?
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 114.44.194.21
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/AfterPhD/M.1481991787.A.FD7.html
1F:推 qtzbbztq: 美国NHANES? 12/18 01:32
2F:→ caseypie: 很多生物和医学期刊都有database这个类别 12/18 02:03
3F:→ LiamIssac: optimization很多 特别是NP-hard问题都有题库 就看谁 12/18 08:48
4F:→ LiamIssac: 有能力解得更好或更快 12/18 08:48
5F:→ lail: 健保资料库算不算?不过是要付费申请 12/18 10:09
6F:→ milkpa: 健保资料库的研究已经被盯上了,不要再搞它了 12/18 14:55
忘了厘清
这边感兴趣的是
*** 这类文章如何审查其所提供数据的品质
提供已经测过的患者组成的数据库供他其他研究团队测试其学术假说
或者新设备或新算则的预测能力 某种程度可以减少人体试验的次数
对人类整体有它的好处
可先决条件是这数据库品质可靠 那麽这方面要怎麽审查它
有网友有经验知道这类文的审查重点吗?
另外 记得学界对於人体试验的设计所提供的验证强度之评价
前驱试验还是强於回溯试验 而这种数据库做的是回溯试验不是吗?
还是说有新的统计理论开发出来了?
※ 编辑: saltlake (220.136.209.65), 12/18/2016 19:13:12
8F:→ moondark92: Sprint挖宝活动... 12/18 19:21
9F:→ moondark92: 话说回来假说从哪里来的? 不就是从自然观察与归纳来的 12/18 19:22
10F:→ moondark92: 自然界可不会自动randomize好放在那边等大家分析 12/18 19:23
11F:→ moondark92: 观察到的假说常常都会有干扰因子(假说外部变数)存在 12/18 19:24
12F:→ moondark92: 所以验证假说必须控制外部因子,在临床上用随机分组来 12/18 19:25
13F:→ moondark92: "控制"外部因子... 12/18 19:25
14F:推 moondark92: 健保资料库最大的问题在於缺乏lab data,而ICD码并未区 12/18 19:33
15F:→ moondark92: 分疑似或确诊... 12/18 19:33
16F:推 redsa12: 所以健保资料库在精於解决内生性问题的经济学者的手上才 12/20 11:40
17F:推 redsa12: 能发挥更大的价值 尤其里面还一堆家计单位的资料 12/20 11:41
18F:推 r7544007: 我对於用健保资料库看健保的经济效应这类的研究有点反感 12/20 22:45
19F:→ r7544007: 而且健保资料库又没有自费的资料 12/20 22:47