作者Su22 (裝配匠)
看板Stock
標題[新聞] 失去競爭優勢?測試結果顯示美國 AI 模型
時間Sun Aug 16 21:03:06 2026
原文標題:
失去競爭優勢?測試結果顯示美國 AI 模型成本比中國開源模型更低
原文連結:https://reurl.cc/be9O23
發布時間: 2026 年 08 月 14 日 15:15
記者署名:Atkinson
原文內容:
根據 《The Information》 引述 AI 搜尋與市場調查公司 AlphaSense 的最新研究指出
,在部分特定工作執行中,
美國 OpenAI 與 Anthropic 的閉源 AI 模型,其實際使用成
本其實比中國的開源模型更便宜,且能提供品質更好的回答。
這項研究於本月初公開,AlphaSense 採用了 245 個關係企業財報、投資人電話會議記錄
及證券申報書等金融分析問題,對 9 款 AI 模型的回答品質與成本進行了測試。其結果
顯示,一般而言,
若單看詞元 (Token) 的定價,中國模型確實具有價格優勢。
其在每 100 萬個輸出 Token 的單價上,中國月之暗面 (Moonshot)「Kimi K3」 為
15 美元。Anthropic「Opus 4.8」 來到 25 美元,而 OpenAI「GPT-5.6 Sol」 則是達
到 30 美元。然而,AlphaSense 的實測發現,
Kimi K3 雖然 Token 單價較低,但為了產
生回答,它會消耗更多 Token。這導致在處理單一問題時,
實際產生的總成本反而高於
GPT-5.6 Sol。
實測數據顯示,
GPT-5.6 Sol 中位數總成本比 Kimi K3 低 13%,且回答品質評分高 20%
。Opus 4.8 實際總成本僅 Kimi K3 一半,但品質評分領先 13%。北京智譜(Z.ai)「
GLM-5.2」實際成本約為 Kimi K3 兩倍,但品質卻更低。
AlphaSense 執行長 Jack Coco 指出,那些表面看起來昂貴的模型,因
使用 Token 效率
更高,最終花費反而更少。OpenAI 董事會主席 Bret Taylor 7 月底也表達類似觀點,指
出頂級模型回答或執行任務時使用 Token 較少,因此比開源模型更具成本效益。
不過,AI 競爭的勝負仍取決於評估方式。AI 模型分析公司 Artificial Analysis 相同
基準對比,便得出 Kimi K3 與 GLM-5.2 成本遠低於美國閉源模型的結論。這代表定價競
爭力的最終結論,高度取決於測試的任務類型以及成本的估算方式。
面對這種局勢,Jack Coco 建議,最佳的應對方式是混合使用多種模型。AlphaSense 自
身的搜尋服務便採用了這種邏輯。包括透過內部引擎,根據問題的性質,將需要高度規劃
與推理的任務分配給高效能模型,而將執行與輸出交給低成本模型,達到確保品質同時最
大化降低成本。
心得/評論:
有些人以為中國模型每Token單價低就是比較平價
但實際上,使用中國模型並不必然較省錢,C/P值也未必更好
也是要看問題類型與不同的評估方式
大家在選擇平日用AI,乃至於選擇要投資哪家AI模型供應商的股票時
也要將這方面的資訊納入參考
--
※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 58.114.13.212 (臺灣)
※ 文章網址: https://webptt.com/m.aspx?n=bbs/Stock/M.1786885388.A.046.html
1F:→ ahg : 這不是早就知道了嗎 08/16 21:07
2F:推 sda84225 : 鬼故事來嘍 給空蛙的 08/16 21:08
3F:推 chysh : 還有人不知道?代表平常沒在用AI工作 08/16 21:13
4F:推 icem : deepseek表示 08/16 21:20
5F:推 nidhogg : 中國人用中國貨,其他人用美國貨 08/16 21:23
6F:→ nidhogg : 百度跟Google 一直都是這樣的 08/16 21:24
7F:→ goodevening : 中國就是可以弄出不是頂尖但是能用成本很低的東西 08/16 21:32
8F:→ goodevening : 很正常 08/16 21:32
9F:噓 zzzzzlss : 這id... 08/16 21:33
10F:→ zzzzzlss : 這id... 08/16 21:33
11F:推 tom77588 : 大紀元不可信 08/16 21:36
12F:→ a79111010 : 成本更低 收費更貴 你把世界當韭菜? 08/16 21:38
13F:噓 esso78124 : ID 08/16 21:40
14F:→ tctv2002 : 美吹 中吹各種吹 08/16 21:43
15F:推 Haruna1998 : 還在吹中國模型的只剩下不能用外國模型的中國人而 08/16 21:47
16F:→ Haruna1998 : 已= = 08/16 21:47
17F:推 abccbaandy : 正常阿,claude自家的模型也有這問題 08/16 21:55
18F:推 karcher : 竟然不是大妓院 08/16 22:14
19F:推 house911 : 蛤 ? 08/16 22:16
20F:→ kimula01 : 用過豆包就知道回答有太多綴詞 08/16 22:45
21F:→ excercang : 這是不考慮電費的情況下吧? 08/16 22:57
22F:→ seemoon2000 : kimi k3跟gpt 5.6sol任務總開銷差不多 這是真的 08/16 23:12
23F:→ seemoon2000 : 現在問題就是claude非常貴的問題而已 GPT已經不貴了 08/16 23:12
24F:→ seemoon2000 : 但Claude遠遠貴於gpt5.6和kimi k3但還是一堆人在用 08/16 23:13
26F:→ strlen : 還在什麼ID不ID的?自己進去看圖啊 08/16 23:50
27F:→ strlen : 專業評測機構不信?人傻錢多愛買哪個去買 08/16 23:50
29F:→ strlen : 基本上現狀就是Luna幹爆所有人 08/16 23:53
30F:→ js70864444 : 中國又贏了 08/17 00:01
31F:推 seemoon2000 : 現在GPT就真的是最便宜的 高階的很強 低階的超便宜 08/17 00:03
32F:推 ben1013 : 又多了兩個黑單 08/17 00:41
33F:→ ksjr : 所以GPT賺錢沒? 08/17 00:51
34F:噓 supisces : 射箭再畫靶的特化測試 08/17 00:53
35F:→ cphe : OpenAI現在就是降價保市佔吧 再不保就完了 08/17 00:53
36F:噓 supisces : 拿美商擅長的金融文本檢索做特化測試,再宣布「美商 08/17 00:53
37F:→ supisces : 全面勝利」? 08/17 00:53
38F:噓 supisces : 把 Chain-of-Thought 推理當作「講廢話」? 08/17 00:54
39F:噓 supisces : 現代 AI 為了提升推理準確度,普遍採用思維鏈(Chai 08/17 00:55
40F:→ supisces : n-of-Thought)機制,多輸出 Token 是為了確保邏輯 08/17 00:55
41F:→ supisces : 推演不幻覺。 08/17 00:55
42F:噓 supisces : 開源模型的核心優勢是能抓回本地自行部署(Self-hos 08/17 00:56
43F:→ supisces : ting)。 08/17 00:56
44F:噓 supisces : 閉源 API 只要企業資料一上雲,就是終身被廠商綁架 08/17 00:56
45F:→ supisces : 兼付租金。 08/17 00:56
46F:噓 supisces : 台灣一堆企業與新創底層都在套開源模型省成本哦。 08/17 00:57
47F:噓 supisces : 側翼卻還在拿API零售單價替美商昂貴的訂閱制護航? 08/17 00:59
48F:推 seemoon2000 : 節省成本絕對不是用開源模型 08/17 01:02
49F:推 NgJovi : G點爆惹 08/17 04:15
50F:噓 yangweiisi : 噓,整天貼沒有公信力的新聞 08/17 06:49
51F:推 LipaCat5566 : 安全不值錢 全上雲就對了 08/17 08:34
52F:噓 HZM : 看ID先噓 08/17 08:42
53F:噓 crazydj : 沒救了 08/17 09:00
54F:→ dunjiin : 中國喜歡不惜一切代價。信奉努力有回報 08/17 11:11
55F:→ dunjiin : 埋頭苦抄課文10遍,當成驕傲 08/17 11:12
56F:推 Kydland : Miula的M觀點有分析過中國的成本和算力限制 08/23 09:56
57F:→ Kydland : 科技浪podcast也有很深度的分析 08/23 09:56
58F:→ Kydland : 看了看推文 股版真的被中國網軍入侵了 08/23 09:57