作者Su22 (装配匠)
看板Stock
标题[新闻] 失去竞争优势?测试结果显示美国 AI 模型
时间Sun Aug 16 21:03:06 2026
原文标题:
失去竞争优势?测试结果显示美国 AI 模型成本比中国开源模型更低
原文连结:https://reurl.cc/be9O23
发布时间: 2026 年 08 月 14 日 15:15
记者署名:Atkinson
原文内容:
根据 《The Information》 引述 AI 搜寻与市场调查公司 AlphaSense 的最新研究指出
,在部分特定工作执行中,
美国 OpenAI 与 Anthropic 的闭源 AI 模型,其实际使用成
本其实比中国的开源模型更便宜,且能提供品质更好的回答。
这项研究於本月初公开,AlphaSense 采用了 245 个关系企业财报、投资人电话会议记录
及证券申报书等金融分析问题,对 9 款 AI 模型的回答品质与成本进行了测试。其结果
显示,一般而言,
若单看词元 (Token) 的定价,中国模型确实具有价格优势。
其在每 100 万个输出 Token 的单价上,中国月之暗面 (Moonshot)「Kimi K3」 为
15 美元。Anthropic「Opus 4.8」 来到 25 美元,而 OpenAI「GPT-5.6 Sol」 则是达
到 30 美元。然而,AlphaSense 的实测发现,
Kimi K3 虽然 Token 单价较低,但为了产
生回答,它会消耗更多 Token。这导致在处理单一问题时,
实际产生的总成本反而高於
GPT-5.6 Sol。
实测数据显示,
GPT-5.6 Sol 中位数总成本比 Kimi K3 低 13%,且回答品质评分高 20%
。Opus 4.8 实际总成本仅 Kimi K3 一半,但品质评分领先 13%。北京智谱(Z.ai)「
GLM-5.2」实际成本约为 Kimi K3 两倍,但品质却更低。
AlphaSense 执行长 Jack Coco 指出,那些表面看起来昂贵的模型,因
使用 Token 效率
更高,最终花费反而更少。OpenAI 董事会主席 Bret Taylor 7 月底也表达类似观点,指
出顶级模型回答或执行任务时使用 Token 较少,因此比开源模型更具成本效益。
不过,AI 竞争的胜负仍取决於评估方式。AI 模型分析公司 Artificial Analysis 相同
基准对比,便得出 Kimi K3 与 GLM-5.2 成本远低於美国闭源模型的结论。这代表定价竞
争力的最终结论,高度取决於测试的任务类型以及成本的估算方式。
面对这种局势,Jack Coco 建议,最佳的应对方式是混合使用多种模型。AlphaSense 自
身的搜寻服务便采用了这种逻辑。包括透过内部引擎,根据问题的性质,将需要高度规划
与推理的任务分配给高效能模型,而将执行与输出交给低成本模型,达到确保品质同时最
大化降低成本。
心得/评论:
有些人以为中国模型每Token单价低就是比较平价
但实际上,使用中国模型并不必然较省钱,C/P值也未必更好
也是要看问题类型与不同的评估方式
大家在选择平日用AI,乃至於选择要投资哪家AI模型供应商的股票时
也要将这方面的资讯纳入参考
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 58.114.13.212 (台湾)
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Stock/M.1786885388.A.046.html
1F:→ ahg : 这不是早就知道了吗 08/16 21:07
2F:推 sda84225 : 鬼故事来喽 给空蛙的 08/16 21:08
3F:推 chysh : 还有人不知道?代表平常没在用AI工作 08/16 21:13
4F:推 icem : deepseek表示 08/16 21:20
5F:推 nidhogg : 中国人用中国货,其他人用美国货 08/16 21:23
6F:→ nidhogg : 百度跟Google 一直都是这样的 08/16 21:24
7F:→ goodevening : 中国就是可以弄出不是顶尖但是能用成本很低的东西 08/16 21:32
8F:→ goodevening : 很正常 08/16 21:32
9F:嘘 zzzzzlss : 这id... 08/16 21:33
10F:→ zzzzzlss : 这id... 08/16 21:33
11F:推 tom77588 : 大纪元不可信 08/16 21:36
12F:→ a79111010 : 成本更低 收费更贵 你把世界当韭菜? 08/16 21:38
13F:嘘 esso78124 : ID 08/16 21:40
14F:→ tctv2002 : 美吹 中吹各种吹 08/16 21:43
15F:推 Haruna1998 : 还在吹中国模型的只剩下不能用外国模型的中国人而 08/16 21:47
16F:→ Haruna1998 : 已= = 08/16 21:47
17F:推 abccbaandy : 正常阿,claude自家的模型也有这问题 08/16 21:55
18F:推 karcher : 竟然不是大妓院 08/16 22:14
19F:推 house911 : 蛤 ? 08/16 22:16
20F:→ kimula01 : 用过豆包就知道回答有太多缀词 08/16 22:45
21F:→ excercang : 这是不考虑电费的情况下吧? 08/16 22:57
22F:→ seemoon2000 : kimi k3跟gpt 5.6sol任务总开销差不多 这是真的 08/16 23:12
23F:→ seemoon2000 : 现在问题就是claude非常贵的问题而已 GPT已经不贵了 08/16 23:12
24F:→ seemoon2000 : 但Claude远远贵於gpt5.6和kimi k3但还是一堆人在用 08/16 23:13
26F:→ strlen : 还在什麽ID不ID的?自己进去看图啊 08/16 23:50
27F:→ strlen : 专业评测机构不信?人傻钱多爱买哪个去买 08/16 23:50
29F:→ strlen : 基本上现状就是Luna干爆所有人 08/16 23:53
30F:→ js70864444 : 中国又赢了 08/17 00:01
31F:推 seemoon2000 : 现在GPT就真的是最便宜的 高阶的很强 低阶的超便宜 08/17 00:03
32F:推 ben1013 : 又多了两个黑单 08/17 00:41
33F:→ ksjr : 所以GPT赚钱没? 08/17 00:51
34F:嘘 supisces : 射箭再画靶的特化测试 08/17 00:53
35F:→ cphe : OpenAI现在就是降价保市占吧 再不保就完了 08/17 00:53
36F:嘘 supisces : 拿美商擅长的金融文本检索做特化测试,再宣布「美商 08/17 00:53
37F:→ supisces : 全面胜利」? 08/17 00:53
38F:嘘 supisces : 把 Chain-of-Thought 推理当作「讲废话」? 08/17 00:54
39F:嘘 supisces : 现代 AI 为了提升推理准确度,普遍采用思维链(Chai 08/17 00:55
40F:→ supisces : n-of-Thought)机制,多输出 Token 是为了确保逻辑 08/17 00:55
41F:→ supisces : 推演不幻觉。 08/17 00:55
42F:嘘 supisces : 开源模型的核心优势是能抓回本地自行部署(Self-hos 08/17 00:56
43F:→ supisces : ting)。 08/17 00:56
44F:嘘 supisces : 闭源 API 只要企业资料一上云,就是终身被厂商绑架 08/17 00:56
45F:→ supisces : 兼付租金。 08/17 00:56
46F:嘘 supisces : 台湾一堆企业与新创底层都在套开源模型省成本哦。 08/17 00:57
47F:嘘 supisces : 侧翼却还在拿API零售单价替美商昂贵的订阅制护航? 08/17 00:59
48F:推 seemoon2000 : 节省成本绝对不是用开源模型 08/17 01:02
49F:推 NgJovi : G点爆惹 08/17 04:15
50F:嘘 yangweiisi : 嘘,整天贴没有公信力的新闻 08/17 06:49
51F:推 LipaCat5566 : 安全不值钱 全上云就对了 08/17 08:34
52F:嘘 HZM : 看ID先嘘 08/17 08:42
53F:嘘 crazydj : 没救了 08/17 09:00
54F:→ dunjiin : 中国喜欢不惜一切代价。信奉努力有回报 08/17 11:11
55F:→ dunjiin : 埋头苦抄课文10遍,当成骄傲 08/17 11:12
56F:推 Kydland : Miula的M观点有分析过中国的成本和算力限制 08/23 09:56
57F:→ Kydland : 科技浪podcast也有很深度的分析 08/23 09:56
58F:→ Kydland : 看了看推文 股版真的被中国网军入侵了 08/23 09:57