作者tint (璇月)
看板VideoCard
标题Re: [情报] GTX1080比TITAN X效能提升30% !
时间Mon May 16 07:37:51 2016
※ 引述《tank9 (飞星)》之铭言:
: 标题: [情报] GTX1080比TITAN X效能提升30% !
: 时间: Fri May 13 14:57:51 2016
: 30%效能提升
: 感觉很猛
: 未来会有GTX1080TI吗
: 9系列又会出现抛售潮吧
Videocardz网站揭露了GTX 1080的完整规格
http://goo.gl/BvhyaH
GP104晶片面积314mm2,比GM204的398mm2小了一些
电晶体数量为72亿个,GM204则为52亿个
有趣的是,SM数量是20组
从2560个CUDA去算的话
可以发现GP104维持Maxwell架构的每SM(M)有128个CUDA
而非先前传闻的Pascal架构每SM将改良为64个CUDA
从该文章上贴出的 GP104 Block Diagram也可以观察到
每组SM总共为128个CUDA
结构和Maxwell的Block Diagram很类似
文章提到要到GP100时才会改良为每组SM是64个CUDA
过往从Fermi开始采用SM单元的设计以来
每代SM中CUDA数量的变化都是明显的
Fermi(每SM有32SP)->Kepler(每SMX有192SP)->Maxwell(每SMM有128SP)
但这次Pascal架构的GP104仍维持每SM是128个CUDA
比较这次GP104的改变
1.双精度浮点效能的提昇?
(电晶体数量比GM204增加了20亿个,CUDA只增加512个)
2.ROP数维持GM204的64个,但引入新的图像压缩技术
文章中提到比GM204能提高1.7倍的等效记忆体频宽
3.硬体解码线路的提昇
https://en.wikipedia.org/wiki/Nvidia_PureVideo
PureVideo的版本看来会比GM206(GTX960)还新
-----
之前网友的讨论有提到
GP104的每CUDA同时脉下其实并没有比GM204快
从这篇跑分来看
http://tinyurl.com/gn8gmth
如果GTX980的晶片时脉从1216MHz->1733MHz
CUDA数目从2048个->2560个
换算後可得到约23000分,还比GTX1080约22000分还快一些
如同板上这篇Khadgar大提到的
https://webptt.com/cn.aspx?n=bbs/VideoCard/M.1462589286.A.501.html
如果不靠时脉提昇效能的话
同时脉下GP104的CUDA效能是和前代Maxwell差不多
必须算上时脉的提昇,每CUDA效能才有增长
我觉得这样子
也许GP104使用的Pascal架构(GP100或许会在改良)
其实是Maxwell架构的新制程高频改良版而已!?
再加上支援新技术(图像压缩技术)、新功能(硬解规格)
(或者也有补回双精度效能)
如这篇讨论
http://bbs.pceva.com.cn/thread-131069-1-1.html
GP104在DX12的Asynchronous Compute效能
可能就是靠高时脉来硬上了?
在PC_Shopping板也有网友提到这部份
之前看一些讨论
Pascal架构是2014年才突然在Nvidia的路线上插入的
之前的路线图Maxwell架构後就是接着Volta
Pascal架构可能像是垫档用的改良架构
或许16nm制程的真正全新架构要等到Volta
如同Mxwell之於Kepler在同制程下的改进一样(970能打到780)
obov大的推文
DX12效能暴增可能要等到Volta
https://webptt.com/cn.aspx?n=bbs/PC_Shopping/M.1462861708.A.9D0.html
平心而论
这次GP104用新制程时脉大幅提昇冲高效能也算是有提昇
1080/1070目前公布的价格没有比前代980/970贵太多
接下来就看AMD能拿出怎样的产品和怎样的价格来对打了
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 218.187.85.25
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/VideoCard/M.1463355479.A.A93.html
※ 编辑: tint (218.187.85.25), 05/16/2016 07:47:16
1F:推 Khadgar: 突然发现这个Block Design的图好像怪怪的... 05/16 08:11
2F:→ Khadgar: 1080竟然有8个记忆体控制器? 是GDDR5X需要这样吗? 05/16 08:14
3F:→ JoyRex: 32位元控制器啊... 05/16 10:51
4F:→ Khadgar: GPU的记忆体控制器是64bit已经非常非常非常久了 05/16 12:07
5F:→ Khadgar: GT200 8个,GF100/110 6个, GK110 6个,GM200 6个 05/16 12:09
6F:→ JoyRex: 会转贴至少看下文章里面写的东西吧... 05/16 12:15
7F:→ JoyRex: GP104 is equipped with eight 32-bit memory controllers 05/16 12:16
8F:→ JoyRex: 这一行都没看就直接贴出来了? 05/16 12:16
9F:→ JoyRex: 人家贴的东西至少看一下吧!除非又是愚人节的玩笑... 05/16 12:18
10F:推 iceyeman: 他是在试16nm高频极限吧??? 05/16 17:24
11F:→ tint: 这样做或许是可以配合1070甚至更低的1060Ti产品来删减? 05/16 19:23
12F:→ qhua: 跟那没关系 05/16 20:24
13F:推 IL2: 我赞成tint大的推测,因为AMD在HD5K的时代也是这样玩,NV强推还 05/17 22:47
14F:→ IL2: 不够成熟的fermi反而搞得灰头土脸. 而且我猜AMD在北极星之後 05/17 22:50
15F:→ IL2: 的下一代中阶甚至中高阶又会是马甲,然後碰上全新架构的Volta 05/17 22:51
16F:→ tint: HD5000系列的DX11特性Tessellation效能偏弱 当年它这样做是 05/17 23:33
17F:→ tint: 沿用之前流处理器架构的设计 然後加上DX11功能的支援 05/17 23:33
18F:推 IHD: 480没有灰头土脸吧? 当初猛攻效能啊 是现在有功耗能打才打吧? 05/18 02:02
19F:→ tint: Fermi架构时Tessellation效能赢HD5000系列不少 不过功耗偏高 05/18 02:14
20F:推 IL2: 因为当初GTX480预定的规格更强,是因为功耗和良率一直搞不定才 05/19 23:09
21F:→ IL2: 阉掉一部分变成後来的GTX480,然後NV搞定480又多花了几个月,结 05/19 23:11
22F:→ IL2: 果变成比HD5870晚半年才上市,然後效能比预期差,功耗也不好看 05/19 23:12
23F:→ IL2: 最主要会被酸(?)的点是,AMD放话说HD5870不是顶阶,顶阶让给NV 05/19 23:14
24F:→ IL2: 就像是现在NV说要拿GTX980打AMD的Fury吧,结果没想像中的赢很 05/19 23:17
26F:→ IL2: 打好对NV後来的决策造成相当程度的影响 05/19 23:19
27F:→ IL2: 当初还有人放话GTX480会让HD5870看不到车尾灯,原始规格的 05/19 23:22
28F:→ IL2: GTX480应该是很强悍,也让NV很有信心会完虐HD5K,可惜了 05/19 23:24