作者duckgentlema (少n)
看板VideoCard
标题[请益] 显卡记忆体频宽效用会否被DDR平均
时间Tue Oct 6 01:05:13 2015
由於正在看绘图卡
初阶的quadrok系列和中高阶的似乎主要差别在CUDA颗粒数
和记忆体大小频宽
目前在未来组装机上打算插满32G的OC2400记忆体
利用XMP设定提高时脉
想请教这样是否能提升显卡的记忆体频宽运作值呢?
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 218.173.46.44
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/VideoCard/M.1444064716.A.180.html
1F:推 a2935373: 你要不要看看VRAM的频宽是和谁在交流用的.. 10/06 01:13
2F:推 miau9202: 难道你想做HSA? 10/06 01:21
3F:→ duckgentlema: 这就来去做功课@@ 10/06 01:45
4F:推 tint: NV虽然是说要达成统一记忆体定址 但在Maxwell这代还没法完全 10/06 02:03
5F:→ tint: 实现 目前GPU一般情况下还是以存取VRAM为主 10/06 02:05
7F:→ duckgentlema: 请问目前有没有外插PCI卡可以直接做到HSA/FSA呢? 10/06 09:59
8F:→ tint: 跑2400时脉的系统记忆体对整体系统运作效率会有助益 但对於 10/06 14:50
9F:→ tint: GPU在处理/存取VRAM上的资料效率不会有明显提昇 不说3D成像 10/06 14:53
11F:→ tint: 运算流程 当然 NV喊很久的 Unified Memory (统一记忆体) 10/06 14:56
13F:→ tint: 显卡似乎还是无法实际达成 10/06 14:59
14F:→ tint: 实际上目前系统记忆体的频宽 差不多30GB/s 这相较於显卡上的 10/06 15:03
15F:→ tint: 高速VRAM频宽差距非常多 直接挑张规格高的显卡(流处理器数、 10/06 15:05
16F:→ tint: VRAM频宽高) 会比较实际 10/06 15:06
17F:推 Khadgar: 不过这样的好处到底在哪边阿? vRAM和sysRAM一定越差越大 10/06 18:01
18F:→ Khadgar: 就算6通道3GHz,也才144GB/s可是HBM2之後vRAM都是>1TB/s的 10/06 18:06
19F:→ duckgentlema: 请问CUDA版本是否跟核心数没有关联呢? 10/06 18:58
20F:→ duckgentlema: 里面有人说GXT 750ti会用到UndefinedMemory架构 10/06 19:12
*改成GTX 750ti
21F:→ duckgentlema: 是否有实现或正在实现的影子呢? 10/06 19:12
22F:推 a2935373: 无关 750Ti没有用到吧? 你看哪边写的 10/06 22:06
23F:→ duckgentlema: t大的第五行link里面Mark Harris提到的 10/06 23:00
24F:推 a2935373: 有些CUDA会应用到的意思 你要看本文的应用 10/07 01:19
25F:→ a2935373: 不过基於同一个架构都差不多的情况下 这一代的应用不用 10/07 01:21
26F:→ a2935373: 太过於期待 而且支援的效果如何也是只字未提 听听就好 10/07 01:21
※ 编辑: duckgentlema (218.173.46.44), 10/07/2015 08:28:23
27F:推 nucleargod: 拿 APU 写 OpenCL 就可以 zerocopy 啦 10/07 09:38
28F:→ nucleargod: 你要写 CUDA 就乖乖挑张记忆体大的,资料统统上显卡 10/07 09:39
29F:→ nucleargod: RAM 快根本没屁用,瓶颈是 PCI-E 通道 10/07 09:40
30F:→ duckgentlema: 请问PCI-E通道传输要看MB的数值吗? 10/07 11:49
31F:推 a2935373: 总是要技术宣示一下 不然NV的潮度不够 10/07 13:40
32F:→ caramel623: pcie就2.0/3.0 x16 x8 x4 这样啊 10/07 13:44
33F:→ caramel623: 这世代的几乎都是3.0 然後通常一定有一条x16的 10/07 13:44