作者thinksilver (银白色的沉思)
看板Stock
标题[新闻] AI算力成本腰斩!AMD MI355X跑GLM 5.2
时间Tue Jul 7 08:30:24 2026
原文标题:
AI算力成本腰斩!AMD MI355X跑GLM 5.2
成本仅辉达一半
原文连结:
https://reurl.cc/3yrRj0
发布时间:
2026-07-07 04:44
记者署名:
钜亨网新闻中心
原文内容:
随着 AI 推理需求爆炸性增长,算力成本成为企业落地的最大痛点。近期,推理优化公司
Wafer 公布的一组数据引发了 AI 业界的高度关注:
在AMD(AMD-US)MI355X
晶片上运行最新开源模型 GLM 5.2,不仅实现了高效能表现,其成本更仅为辉达
(NVDA-US) 旗舰 GPU B200 的一半。
这项结果显示,
AMD 正逐步缩小与辉达在 AI 推理市场的差距,也让外界重
新审视 GPU 市场长期由 CUDA 生态建立的竞争优势。
测试显示,MI355X 在执行 GLM 5.2 时,单节点聚合吞吐量达每秒 2,626 个 token(
tok/s),单流吞吐量则达每秒 213 个 token。在效能方面,约可达到同级辉达旗舰
B200 约八成水准,但部署成本却不到 B200 的一半。
消息公布後,立即引发开发者社群高度关注,相关讨论也迅速登上 Hacker News 热门排
行榜。
Wafer 表示,这次部署并非依靠特殊硬体,而是
透过一系列软体最佳化完成,
包括模型量化、推理引擎选择,以及多项相容性修正与效能调校,让 AMD GPU 能充分发挥
推理能力。
量化技术兼顾效能与精准度
在模型最佳化方面,Wafer 使用 AMD 官方 Quark 工具,将模型权重由 BF16 量化为
MXFP4,以降低运算资源需求。
根据测试结果,量化後模型在多项基准测试中的准确率仅有轻微变化,部分测试甚至较官
方量化版本更佳,代表压缩模型後仍能维持相当程度的推理品质。
推理引擎方面,Wafer 比较了 vLLM、ATOM 与 sglang 三种方案後,最终选择 sglang。
原因在於前两者无法同时兼顾量化效益与长文本输出品质,而 sglang 则能维持模型输出
的稳定性,成为此次部署的主要推理平台。
修补细节 推理速度大幅提升
在完成模型量化後,Wafer 又针对推理流程持续优化。其中最大的挑战来自 ROCm 平台对
投机解码(Speculative Decoding)的支援不足。
团队发现,共享专家层命名方式与 sglang 使用的命名规则不同,导致模型载入失败,透
过修正命名後,单流吞吐量便大幅提升近三倍。
此外,另一项问题来自程式码直接引用 CUDA 标头档,导致 ROCm 编译失败,Wafer 仅透
过加入编译保护即可解决。之後再调整平行运算方式,以及手动指定适合 GLM 5.2 专家
层的 Kernel,最终将单节点聚合吞吐量提升至每秒 2,626 个 token。
测试采用接近实际生产环境的设定,包括 2 万 token 输入、1,000 token 输出及 60%
快取命中率,首个 token 延迟控制在 2.22 秒内,整体成功率达 100%。
新创公司也能挑战 GPU 巨头
值得注意的是,完成这项成果的 Wafer 并非大型科技公司,而是一家仅获得 400 万美元
种子轮融资的新创企业,投资人包括 Fifty Years、Y Combinator、Liquid2,以及
Google 首席科学家 Jeff Dean、OpenAI 共同创办人 Wojciech Zaremba 与 Dropbox 共
同创办人 Arash Ferdowsi 等知名人士。
Wafer 将自身定位为利用 AI 优化 AI 基础设施的公司,并表示此次 GLM 5.2 的部分
Kernel 调校、命名冲突排查与最佳化工作,都已大量导入 AI 辅助工程。
相较过去为了提升效能仍需自行开发客制化 Kernel,如今更多工作已转向修补官方工具
链中的细节,代表 AMD 软体生态正逐渐成熟。
AMD 软体生态逐渐成熟
Wafer 指出,过去若每次模型发布都必须重新开发底层 Kernel,小型团队几乎无法跟上
市场节奏;如今官方工具链已能完成大部分工作,剩余仅需修正相容性与最佳化细节,新
创公司便有机会快速完成部署,这也是 Wafer 能在模型发布後短时间内完成适配的重要
原因。
Wafer 认为,目前顶尖模型能否顺利部署到 AMD 平台,愈来愈取决於官方软体支援速度
,而非硬体本身,CUDA 长期建立的软体优势正逐步受到挑战。
事实上,SemiAnalysis 今年稍早针对 GLM-5 的测试也得到类似结果。报告指出,在互动
式推理场景下,AMD MI355X 每百万 token 推理成本约为 0.22 美元,低於辉达 B200 的
0.30 美元,主要原因除了硬体整体拥有成本较低,也反映 AMD 软体最佳化已有明显进
展。
不过,目前 AMD 的优势仍主要集中於单节点部署。在多节点、大规模分散式丛集以及跨
机专家并行等企业级应用方面,辉达仍保有明显领先优势。
若未来云端业者能持续将 Wafer 的最佳化方式复制到更多开源模型,AI 推理成本仍有望
持续下降,也将进一步提升开源模型在市场上的竞争力。
心得/评论:
上次说花少少钱就能赢辉达的是不是deepseek?
不过最近AMD的股价走势是蛮不错的~相较於NVDA来说~
如果能降低成本有助於AI普及化其实也不是坏事,
果然NVDA的地位还是需要靠宿敌才能撼动?
想到90年代~ATI(Radeon)与NVDA(GeForce)的大战
各位老显卡玩家怎麽看呢?
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 163.17.149.199 (台湾)
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Stock/M.1783384228.A.19A.html
1F:推 xhs : 不太相信 因为amd显卡跟屎一样 07/07 08:31
2F:→ benptt : 坐等教主开示 07/07 08:31
3F:→ sing60905 : AMD YES 07/07 08:32
4F:推 s555666 : 最後nvidia赢了,nvidia产量大,软体支援度高,ati 07/07 08:32
5F:→ s555666 : 最後还是败北了 07/07 08:32
6F:→ aimlikenoob : 卖铲子的:你们打一架前先买我的货 07/07 08:32
7F:→ bnn : 我感觉他是拿FP4打FP16 07/07 08:33
8F:推 s155260 : 晶片是用GG的吗 07/07 08:33
9F:推 Utopiasphere: 演算法赢 但AMD显卡跟辉达有得比吗 07/07 08:33
10F:推 youga : 嗯 看不懂 07/07 08:34
11F:→ fallinlove15: 八成特定场景拿出来吹 07/07 08:34
12F:推 ssarc : 辉达也可以委托他优化 07/07 08:34
13F:→ e2204588 : FP4 ... 07/07 08:34
14F:推 livewater : 丸 07/07 08:34
15F:推 apolloapollo: 结论就是AI is over 在吹啊 07/07 08:34
16F:推 CKRO : 鬼故事 07/07 08:34
17F:推 s555666 : GPU本来就不是AI晶片的最佳解,ASIC才是AI特化晶片 07/07 08:35
18F:→ s555666 : ,但nvidia就靠着产量和支援拼出了王座 07/07 08:35
19F:推 LipaCat5566 : 击落i皇之後下个是辉达吗!? 07/07 08:36
20F:→ livewater : 算力果然过剩 07/07 08:36
21F:→ kausan : 推理大家马都赢 不然哪有asic的事 07/07 08:36
22F:推 keyneslan : 这样AI要重新定价吗 以前的半价搞定 07/07 08:36
23F:→ dannpptt : 真假啦 别乱吹,这样硬体股通通腰斩 07/07 08:37
24F:推 pom820117 : 话题性满满,实感还没有 07/07 08:37
25F:推 goodman5566 : 左打英特尔 右打辉达 amd yes 07/07 08:37
26F:推 abc12812 : 相信黄董 07/07 08:37
27F:推 eddy13 : 等真的不会限缩算力时再跟我说 07/07 08:38
28F:推 bcismylove : 糙灰搭鬼故事来了 07/07 08:39
29F:推 mitchness : 等到你的产品会被走私再说 07/07 08:39
30F:推 rahim03 : 就算真的硬体股为什麽要腰斩? 07/07 08:39
31F:推 s555666 : 科技业不进则退,老黄想吃下AI还是得研发出更适合A 07/07 08:40
32F:→ s555666 : I的晶片,不能老是靠cuda老本 07/07 08:40
33F:→ rahim03 : 长期来看推理成本本来就会越来越低 07/07 08:40
34F:→ JoeyChen : 这是指推论端吧? 07/07 08:40
35F:推 starport : 辉达完了 下去 07/07 08:41
36F:推 ckpetercheng: amd早就屌打nv了 07/07 08:42
37F:推 cowaksor : 算力过剩 台股2万 台积500 07/07 08:42
38F:推 Vvvahc : 引入标头档编译失败? 修正变数的命名才不会让模型 07/07 08:43
39F:→ Vvvahc : 初始data载入失败? 这是哪间的三流公司请工读生 07/07 08:43
40F:→ Vvvahc : 来操作吗? 07/07 08:43
41F:推 mig : 蒜粒过剩 07/07 08:44
42F:推 MorikonHase : 我不信 07/07 08:45
43F:推 foolwind : 怎麽会腰斩 当然是大家抢更多的货阿 07/07 08:46
44F:→ a9564208 : 听起来就是老问题,没有不一样 07/07 08:47
45F:→ energy100203: 鬼故事喔 07/07 08:47
46F:嘘 gj942l41l4 : …2026了还在跟B200比? 07/07 08:48
47F:嘘 Robert0213 : 天天上演鬼故事,不累吗? 07/07 08:49
48F:推 CTTSAI : 要相信黄董 马上就懂 07/07 08:49
49F:推 bensonla : 算力成本变低是好事 07/07 08:49
50F:推 sdbb : 楼下LDPC 07/07 08:49
51F:推 hunt0413 : 教主都不分析了 07/07 08:51
52F:→ salamender : 之前看人说amd可能再鳖一发大的 07/07 08:51
53F:推 baan : 两个都有量化? 07/07 08:51
54F:推 pru5566 : 算力过剩 台积腰斩 07/07 08:54
55F:推 cct1121 : 还早 07/07 08:54
56F:推 davie11333 : 楼下彦州 07/07 08:55
57F:推 lusifa2007 : 不信 N卡就是比A卡好 07/07 08:57
58F:推 j0918jack : 力成表示 07/07 08:57
59F:→ sing60905 : 大家成本低起来不是更好吗 对AI来说是好事 07/07 09:00
60F:→ loking : 有竞争是好事 07/07 09:00
61F:→ sing60905 : 之前怕赚不到钱 现在成本骤降不是更好 爽赚 07/07 09:00
62F:推 lnonai : 企业私有数据不上云 AMD好用又便宜 07/07 09:01
63F:推 guanting886 : 如果包含output的token的成本压在1M 0.2真的是吸引 07/07 09:02
64F:→ guanting886 : 人 但SA没讲的话就是呼咙人的ㄏㄏ 07/07 09:02
65F:→ timetostudy : 要崩了 07/07 09:02
66F:推 harrychen413: 天~崩~地~裂 07/07 09:03
67F:→ alex00089 : AI is over 07/07 09:03
68F:嘘 birdjack : 现在说什麽新创公司做了三小都是骗投资用的 07/07 09:03
69F:→ birdjack : 真的被踢爆的时候才说是有严苛限制条件 07/07 09:03
70F:推 xboxandone : 操辉达了吗 07/07 09:04
71F:→ WenliYang : 开始罗~ 07/07 09:04
72F:推 jjack11 : 专业掉驱动你行你上 07/07 09:06
73F:推 bunjie : 出货文? 07/07 09:07
74F:推 jaceda : 鬼! 07/07 09:07
75F:推 johnchiang : 还在显卡... 07/07 09:08
76F:推 BBKOX : NVIDIA 於 2024 年 3 月正式发表基於 Blackwell 架 07/07 09:08
77F:→ BBKOX : 构的 B200 GPU,并於该年底正式上市 07/07 09:08
78F:嘘 arm370x : 驱动现在有Ai都还没修好 问题一大坨 07/07 09:08
79F:推 henrylin8086: Linux上不会掉啦 07/07 09:09
80F:嘘 lionel20002 : NV就老AI死钱 07/07 09:10
81F:→ sheep2009 : 单卡效能就算了吧 07/07 09:10
82F:推 saya2185 : AMD 弯道超车 07/07 09:12
83F:推 ntr203 : amdeepseek 07/07 09:12
84F:推 gladopo : 跟以前一样,amd的卡在两年後准备接近老黄,但新卡 07/07 09:13
85F:→ gladopo : 又要出惹 07/07 09:13
86F:推 jorden : 真的假的 仅靠软体就能优化 07/07 09:13
87F:嘘 y80304 : 这骗点阅率喔...... 07/07 09:15
88F:嘘 win8719 : B200 现在是Rubin比B200快5倍以上 07/07 09:16
89F:推 boykid : 开崩!!! 07/07 09:23
90F:推 saladbread : 本是台南生,香煎何太急? 07/07 09:25
91F:→ WWIII : 崩了 07/07 09:26
92F:→ idernest : 完了 07/07 09:29
93F:→ linleex : 不支援cuda没用吧 07/07 09:29
94F:→ ivanchang : 这则新闻很无言,只觉得NV技术领先AMD很多 07/07 09:31
95F:推 furnaceh : 华西街又不会懂 能炒就赢了 07/07 09:32
96F:→ xiaoyao : 这故事也编得太烂 07/07 09:33
97F:→ ohyakmu : 要跑赢nivida很容易吧!我说股价 07/07 09:33
98F:推 SkyFee : AMD很猛 07/07 09:33
99F:推 Arctica : ㄟ唉伊死欧ver 07/07 09:36
100F:→ fallinlove15: 如果使用场景设定的好 可以先暂存比较可能被调动的 07/07 09:36
101F:→ fallinlove15: 模块达到加速的效果 这也是未来终端会推的做法 07/07 09:36
102F:→ fallinlove15: 但这不是多难的技术 说要赢辉达就来乱的 07/07 09:37
103F:推 exitingsoul : 尝试各种节省算力、降低精度的原因,不就是算力不够 07/07 09:37
104F:→ exitingsoul : 吗? 07/07 09:37
105F:→ fallinlove15: 总不可能每种应用都用全能型的啊 太贵 07/07 09:38
106F:→ fallinlove15: 所以根本不用担心过剩 同样一百块 你当然会希望能 07/07 09:39
107F:→ fallinlove15: 买到的东西性能越强越好 07/07 09:39
108F:→ fallinlove15: 如果对比手机发展 过剩也是十几年後的事了 07/07 09:40
109F:→ alex00089 : 没有鲨手级应用 07/07 09:40
110F:推 tomdavis : AMD 甘纳赛~~~ 07/07 09:40
111F:推 s881720 : AMD YES 苏妈钻石加大 07/07 09:40
112F:推 Dia149 : 过剩了 07/07 09:41
113F:→ Lhmstu : 洗洗睡吧,想太多 07/07 09:42
114F:嘘 strlen : 我也有苏妈啦但请苏妈救救贪狗卡蛙 07/07 09:46
115F:推 herculus6502: 推理没有问题 07/07 09:47
116F:推 young000 : 中国要弄新系统环境,AMD 铁定有帮忙,CUDA 独占太 07/07 09:47
117F:→ young000 : 贪了 XD 07/07 09:47
118F:推 randystock : 不管谁赢都是要找GG代工 07/07 09:51
119F:→ ojh : 股板高手3年前就提醒过gpu over了 果然准 07/07 09:53
120F:推 create8 : Amd yes!! 07/07 09:57
121F:→ frank072304 : 特定场景 07/07 09:58
122F:→ aloness : 3c产品是随时间越来越廉价的,各位愿意花iphone17 07/07 09:59
123F:→ aloness : 的钱买iphone7吗 07/07 09:59
124F:→ NankanAvenge: ASIC功能单一 不可能没有完全没有GPU 只是未来肯定 07/07 10:00
125F:→ NankanAvenge: 会用ASIC取代大部分算力 07/07 10:00
126F:推 jympin : 难怪大涨 07/07 10:05
127F:推 mkmdog5566 : 开源都是渣渣 07/07 10:06
128F:推 crtzeng : 90年代的AMD没有苏妈,这次输赢很难说 07/07 10:08
129F:推 hensel : 推论买AMD的跟gb10也差不多价钱,支援度又没nv好, 07/07 10:08
130F:→ hensel : 是喜欢瞎忙吗 07/07 10:08
131F:推 hugi147 : 好耶 我可以用便宜的高级模型了吗? 07/07 10:09
132F:推 MoneyDay5566: 庞氏骗局要破了 07/07 10:10
133F:→ gpx369 : 这两家无论是谁赢都还是要跟GG下单 07/07 10:11
134F:推 dynamo : 没差,赢的都是GG 07/07 10:13
135F:推 seemoon2000 : 三小 这就家用设备放大的开源模型而已啊 实际上训 07/07 10:14
136F:→ seemoon2000 : 练大模型和使用云端模型才是用GPU的大头啊.... 07/07 10:14
137F:→ bndan : AI成本腰斩的部份 记忆体税可以全拿去了 XD 07/07 10:15
138F:推 hook99 : 还是要买GG 07/07 10:16
139F:→ leo255112 : 老黄药丸? 07/07 10:18
140F:推 cms6384 : 该喷了吧 07/07 10:18
141F:推 jy760517 : AMD yes! 07/07 10:20
142F:推 centaurjr : 2026的AMD都能谈软体优化了XD 07/07 10:21
143F:→ aadsl : 再买amd的显卡我就是狗 07/07 10:21
144F:推 z70126 : 吞吐量......好涩喔 07/07 10:21
145F:推 jetx2110 : 等你好不容易追上来的时候,辉达又会出新的打趴你 07/07 10:21
146F:→ jetx2110 : 了 07/07 10:21
147F:推 ymlin0331 : 稳了 07/07 10:21
148F:推 dkfs789 : CUDA>>>>>>>>>>>>>>>>>ROCm 07/07 10:22
149F:推 jorden : 软体优化完 然後都卡死在硬体 XDDDDDD 07/07 10:22
150F:推 pkmfyw : 与其吹这个 倒不如研究省电40% 效能还能维持 07/07 10:24
151F:推 jvor0719 : 我不看了 长期投资 07/07 10:25
152F:推 CLisOM : 既然运算单元成本降价那三星又能涨价了 07/07 10:26
153F:推 piece1 : 再买amd显卡就剁掉..不能再同意更多了! 07/07 10:28
154F:推 waitrop : 汪汪 07/07 10:29
155F:推 rebel : Wow amd的PE已经到181了 07/07 10:31
156F:推 miloisgood : 丸 07/07 10:33
157F:推 lifeowner : 台湾智障:N卡的驱动值5000。 07/07 10:37
158F:推 pmebigGG : 感觉很多人推论跟训练分不清楚 07/07 10:43
159F:推 seemoon2000 : 在LLM模型情境ROCm甚至比Vulkan 还烂了 还跟cuda比 07/07 10:43
160F:推 CJonQuil : 天下苦黄久矣 07/07 10:45
161F:推 wuchanghan : 鬼故事来罗 07/07 10:46
162F:推 jaricho : 一堆人美股买NVDA耶 07/07 10:47
163F:→ luba2 : 重返农药? 07/07 10:51
164F:推 sakeru : 反正我欧印AMD了 没拆股不卖 07/07 10:52
165F:→ ezorttc : 苏妈遥遥领先 07/07 10:54
166F:推 stosto : 哪天模型要打掉asic 也要重来了 07/07 10:55
167F:→ KFC007 : NV赢在CUDA,但AMD发现了绕过CUDA的方式 07/07 10:56
168F:→ KFC007 : 大厂最终都希望两个铲子厂厮杀这样才能降低成本啊 07/07 10:58
169F:→ xxxzxcvb : 只有单节点而已 多节点还在努力 07/07 11:00
170F:→ jack1042 : 一堆东西没整合好 不觉得AMD有什麽优势 07/07 11:00
171F:推 x58420 : amd Yes 07/07 11:01
172F:推 ga278057 : 一句不谈cuda 07/07 11:03
173F:推 Courtney : 不信~ 07/07 11:03
174F:推 ted1985 : 老套路 捧A买N 07/07 11:03
175F:→ ga278057 : 怎麽不说转译跑cuda多少 07/07 11:03
176F:推 spen2005 : 只有用torch 的话rocm cuda没什麽差 07/07 11:06
177F:推 Haruna1998 : 等落地再说吧 实验室数据出来後实际都跟屎一样 07/07 11:09
178F:推 xxgogg : 腰斩还不块陶吗QAQ 07/07 11:17
179F:推 foxher : 99 NVDA 07/07 11:18
180F:→ hong414 : 不用为了一堆游戏搞驱动 07/07 11:19
181F:推 bizer : 看起来就是吹的 07/07 11:22
182F:→ atxmin : AMD本益比200倍 NVIDIA 30倍 爱买AMD就去买 07/07 11:23
183F:推 deathoflove : NV=拉基 07/07 11:25
184F:推 thinktwice31: 吹牛波 07/07 11:28
186F:推 k6416337 : NV 本益比30,股价跌到狗吃屎,跟跌不跟涨 07/07 11:35
187F:→ NekomataOkay: 怎麽办; ; 07/07 11:35
188F:→ kivan00 : 这什麽鬼故事 所谓的效能是砍精度跑出来的 07/07 11:41
189F:推 fhill12 : ati ?! 07/07 11:43
190F:→ kivan00 : 至於什麽CUDA ROCm别分那麽细 ROCm函式库就是抄着 07/07 11:43
191F:→ kivan00 : CUDA抄出来的 07/07 11:43
192F:嘘 wsxe2007 : 好好笑一早就有笑话看 07/07 11:43
193F:→ kivan00 : 所以才会看到大半年了还在那边改来改去追着改 07/07 11:45
194F:推 CYL009 : 来不及惹 大家都买铲子买到好几年後惹 07/07 11:46
195F:推 ckpetercheng: nv本益比高到可怕 未来市场又被瓜分 07/07 11:51
196F:推 greedypeople: 我自己是AMD NV都有 长期持有的话我对NV比较放心 07/07 11:53
197F:推 isco : 最重要的是ATI的显卡也没便宜到一半,同理的是AMD G 07/07 11:58
198F:→ isco : PU的机柜价格有便宜到一半吗? 07/07 11:58
200F:→ sushi11 : 苏妈谁叫你这麽认真的 07/07 12:08
201F:推 ronga : 算力一半 不代表算力需求满足啊 两回事 07/07 12:11
202F:→ tales1216 : 想太多 07/07 12:14
203F:→ ojh : 本益比高代表市场看好他的发展 nv是已经确认over了 07/07 12:14
204F:推 ZXSC : 教主预言成真?苏妈要干老黄惹 07/07 12:18
205F:推 k798976869 : 苏妈厉害 07/07 12:20
206F:推 chiki428 : 重仓按摩店 相信苏妈 做空辉达 07/07 12:21
207F:推 misthide : 开源模型就别提了吧 07/07 12:26
208F:推 ivan761016 : NV如果要吃ASIC会打到自家人所以疯狂建护城河 07/07 12:28
209F:推 hpk89 : 做一堆优化才把成本砍到一半? 同样方式NV优化完是 07/07 12:28
210F:→ hpk89 : 不是又屌打AMD? 07/07 12:28
211F:推 DogEggz : 所以显卡价格要跌了没 07/07 12:28
212F:嘘 gest7240 : 啊股价不是反应到月球了,nv的fpe杀到跟喘惨一样了 07/07 12:33
213F:→ gest7240 : 还怎样,想出货还是想进货 07/07 12:33
214F:推 kusotoripeko: 蒜粒鬼故事,拿去哪用了,这阵子ai还三不五时变傻子 07/07 12:40
215F:推 kimula01 : All in 2330 07/07 12:43
216F:嘘 WWIII : 崩烂 又不缺算力了 07/07 12:49
217F:推 Sianan : 哪是鬼故事 是好故事啊 推理成本降低有助於整体AI 07/07 12:53
218F:→ Sianan : 发展 CSP只怕投入一堆深不见底 你投入的本效比越好 07/07 12:53
219F:→ Sianan : CSP才敢继续投啊 07/07 12:53
220F:推 Heedictator : 妈妈 07/07 13:05
221F:→ kuinochi : MXFP4是maximum fp4的意思吗?? 07/07 13:09
222F:推 Zzell : 继续投 所以前面的投资怎麽办 07/07 13:09
223F:→ Zzell : token就已经在赔了 难道硬着头皮继续用 07/07 13:10
224F:推 gn00670191 : 这是不是在说AMD烂到有剩,做一堆optimize还只能跑 07/07 13:16
225F:→ gn00670191 : 到别人八成 07/07 13:16
226F:→ bndan : 前面的投资就是堆屍体阿 现在是TOKEN不贱价 那商业 07/07 13:18
227F:推 gn00670191 : optimize不用钱不用成本吗?换个model又要重新来一 07/07 13:18
228F:→ gn00670191 : 次,根本AMD鬼故事 07/07 13:18
229F:→ bndan : 应用层就居高不下 居高不下你要怎带起大AI时代取代 07/07 13:19
230F:→ bndan : 下面多数层级的人力? 07/07 13:19
231F:→ bndan : 反之TOKEN贵松松 那前面的投资回本的可能性就高了但 07/07 13:20
232F:→ bndan : 商业应用就只能停在特定高层级了 奢侈品的概念 07/07 13:20
233F:→ bndan : 而且这还没讲到最记忆体税对价格的影响 XD 只能说这 07/07 13:21
234F:→ bndan : 时期挤牙膏=自毁前程 但不挤嘛 爽基础零件记忆体海 07/07 13:22
235F:→ bndan : 捞一波而已 捞完造成3C需求大崩又怎样? 入袋才是赢 07/07 13:23
236F:推 hoo911ver25 : BF16跟MXFP4能一样吗 07/07 13:41
237F:推 zipupup : ATI的问题一直是驱动程式烂吧? 07/07 13:50
238F:推 lastsodeep : 等等….B200? 07/07 13:51
239F:推 hotbeat : AMD 不就内部也在用辉达的软体吗 07/07 14:08
240F:推 blue155305 : 天下苦老黄久矣 07/07 14:15
241F:推 traz04067 : Yes 07/07 14:30
242F:→ rdkirk : 突然每间公司都说自己比辉达更厉害喔 07/07 14:39
243F:推 d004093 : NV垃圾 07/07 15:27
244F:推 bunjie : 请支援海涛法师 假的.jpg 07/07 15:30
245F:推 bettybuy : 这样不是很好吗 太贵也很痛苦ㄟ 07/07 15:50
246F:推 skizard : 是特定模型还是多数模型都能是辉达一半 差很多喔 07/07 17:10
247F:推 zaza1128 : 苏妈努力多年 07/07 17:13
248F:嘘 bhmagic : 没有Cuda只跑不训练 那去跟Asic比 比的赢才怪 07/07 18:41
249F:→ rcro : 一眼假 绝对是特别调教的 07/07 21:57