作者callisto2 (tte)
看板Statistics
標題[問題] 多個母體之間的相似度
時間Tue Apr 1 20:33:00 2008
我有二十個利用不同方法的實驗, 我想知道這二十個實驗之間的相似度.
在每個實驗中, 每 0.01 秒我讀取一次數據, 一共進行 200 秒,
每次讀取的數據共有七個值(x1,x2,...x7), 每個值代表某一種特性.
實驗結束後, 我在每個實驗會得到 20000x7 筆資料.
對兩組不同的實驗, 如果 |x1-x1'|<t, |x2-x2'|<t,..., |x7-x7'|<t
那我們認為這兩個實驗在 (x1,x2,..,x7) 和 (x1',x2',...,x7')
實驗 A 實驗 B
這一點上有相同特性.
我目前想到的方法是, 對每兩個實驗, 比對所有的資料,
所以會有 20000x20000 次比較, 並且紀錄有多少資料是小於 t.
舉例來說, 如果實驗A 有 4000 筆資料可以在實驗B裡找到相似的值,
那相似度就是 4000/20000=0.2. 當這樣就沒辦法考慮時間上的變化.
之前想用 ANOVA, 不過發現不適用在我的實驗中,
希望前輩們可以提供一些意見,
(1) 如何定義相似度 (2) 如何用統計方法解釋這個實驗.
謝謝
--
※ 發信站: 批踢踢實業坊(ptt.cc)
◆ From: 68.50.229.196
1F:推 mrk:首先你要先知道你的那些值是等距的嗎? 04/01 21:40
2F:→ mrk:如果是,或許可以試試看mix design,但是這樣只有接受與否。 04/01 21:41