[新聞] 失去競爭優勢?測試結果顯示美國 AI 模型

原文標題: 失去競爭優勢?測試結果顯示美國 AI 模型成本比中國開源模型更低 原文連結:https://reurl.cc/be9O23 發布時間: 2026 年 08 月 14 日 15:15 記者署名:Atkinson 原文內容: 根據 《The Information》 引述 AI 搜尋與市場調查公司 AlphaSense 的最新研究指出 ,在部分特定工作執行中,美國 OpenAI 與 Anthropic 的閉源 AI 模型,其實際使用成 本其實比中國的開源模型更便宜,且能提供品質更好的回答。 這項研究於本月初公開,AlphaSense 採用了 245 個關係企業財報、投資人電話會議記錄 及證券申報書等金融分析問題,對 9 款 AI 模型的回答品質與成本進行了測試。其結果 顯示,一般而言,若單看詞元 (Token) 的定價,中國模型確實具有價格優勢。 其在每 100 萬個輸出 Token 的單價上,中國月之暗面 (Moonshot)「Kimi K3」 為 15 美元。Anthropic「Opus 4.8」 來到 25 美元,而 OpenAI「GPT-5.6 Sol」 則是達 到 30 美元。然而,AlphaSense 的實測發現,Kimi K3 雖然 Token 單價較低,但為了產 生回答,它會消耗更多 Token。這導致在處理單一問題時,實際產生的總成本反而高於 GPT-5.6 Sol。 實測數據顯示,GPT-5.6 Sol 中位數總成本比 Kimi K3 低 13%,且回答品質評分高 20% 。Opus 4.8 實際總成本僅 Kimi K3 一半,但品質評分領先 13%。北京智譜(Z.ai)「 GLM-5.2」實際成本約為 Kimi K3 兩倍,但品質卻更低。 AlphaSense 執行長 Jack Coco 指出,那些表面看起來昂貴的模型,因使用 Token 效率 更高,最終花費反而更少。OpenAI 董事會主席 Bret Taylor 7 月底也表達類似觀點,指 出頂級模型回答或執行任務時使用 Token 較少,因此比開源模型更具成本效益。 不過,AI 競爭的勝負仍取決於評估方式。AI 模型分析公司 Artificial Analysis 相同 基準對比,便得出 Kimi K3 與 GLM-5.2 成本遠低於美國閉源模型的結論。這代表定價競 爭力的最終結論,高度取決於測試的任務類型以及成本的估算方式。 面對這種局勢,Jack Coco 建議,最佳的應對方式是混合使用多種模型。AlphaSense 自 身的搜尋服務便採用了這種邏輯。包括透過內部引擎,根據問題的性質,將需要高度規劃 與推理的任務分配給高效能模型,而將執行與輸出交給低成本模型,達到確保品質同時最 大化降低成本。 心得/評論: 有些人以為中國模型每Token單價低就是比較平價 但實際上,使用中國模型並不必然較省錢,C/P值也未必更好 也是要看問題類型與不同的評估方式 大家在選擇平日用AI,乃至於選擇要投資哪家AI模型供應商的股票時 也要將這方面的資訊納入參考

推文討論 55

1F strlen 08/16 23:52
2F seemoon2000 08/16 23:12
kimi k3跟gpt 5.6sol任務總開銷差不多 這是真的
3F supisces 08/17 00:55
n-of-Thought)機制,多輸出 Token 是為了確保邏輯
4F cphe 08/17 00:53
OpenAI現在就是降價保市佔吧 再不保就完了
5F supisces 08/17 00:56
ting)。
6F js70864444 08/17 00:01
中國又贏了
7F dunjiin 08/17 11:11
中國喜歡不惜一切代價。信奉努力有回報
8F goodevening 08/16 21:32
中國就是可以弄出不是頂尖但是能用成本很低的東西
9F seemoon2000 08/16 23:13
但Claude遠遠貴於gpt5.6和kimi k3但還是一堆人在用
10F supisces 08/17 00:53
全面勝利」?
11F supisces 08/17 00:56
兼付租金。
12F dunjiin 08/17 11:12
埋頭苦抄課文10遍,當成驕傲
13F strlen 08/16 23:53
基本上現狀就是Luna幹爆所有人
14F strlen 08/16 23:50
專業評測機構不信?人傻錢多愛買哪個去買
15F Haruna1998 08/16 21:47
已= =
16F goodevening 08/16 21:32
很正常
17F a79111010 08/16 21:38
成本更低 收費更貴 你把世界當韭菜?
18F ksjr 08/17 00:51
所以GPT賺錢沒?
19F supisces 08/17 00:55
推演不幻覺。
20F seemoon2000 08/16 23:12
現在問題就是claude非常貴的問題而已 GPT已經不貴了
21F kimula01 08/16 22:45
用過豆包就知道回答有太多綴詞
22F nidhogg 08/16 21:24
百度跟Google 一直都是這樣的
23F tctv2002 08/16 21:43
美吹 中吹各種吹
24F zzzzzlss 08/16 21:33
這id...
25F ahg 08/16 21:07
這不是早就知道了嗎
26F excercang 08/16 22:57
這是不考慮電費的情況下吧?
27F strlen 08/16 23:50
還在什麼ID不ID的?自己進去看圖啊
28F esso78124 08/16 21:40
ID
29F supisces 08/17 00:59
側翼卻還在拿API零售單價替美商昂貴的訂閱制護航?
30F supisces 08/17 00:57
台灣一堆企業與新創底層都在套開源模型省成本哦。
31F yangweiisi 08/17 06:49
噓,整天貼沒有公信力的新聞
32F supisces 08/17 00:53
射箭再畫靶的特化測試
33F supisces 08/17 00:54
把 Chain-of-Thought 推理當作「講廢話」?
34F supisces 08/17 00:53
拿美商擅長的金融文本檢索做特化測試,再宣布「美商
35F crazydj 08/17 09:00
沒救了
36F supisces 08/17 00:55
現代 AI 為了提升推理準確度,普遍採用思維鏈(Chai
37F HZM 08/17 08:42
看ID先噓
38F zzzzzlss 08/16 21:33
這id...
39F supisces 08/17 00:56
閉源 API 只要企業資料一上雲,就是終身被廠商綁架
40F supisces 08/17 00:56
開源模型的核心優勢是能抓回本地自行部署(Self-hos
42F icem 08/16 21:20
deepseek表示
43F NgJovi 08/17 04:15
G點爆惹
44F nidhogg 08/16 21:23
中國人用中國貨,其他人用美國貨
45F ben1013 08/17 00:41
又多了兩個黑單
46F tom77588 08/16 21:36
大紀元不可信
47F LipaCat5566 08/17 08:34
安全不值錢 全上雲就對了
48F abccbaandy 08/16 21:55
正常阿,claude自家的模型也有這問題
49F seemoon2000 08/17 00:03
現在GPT就真的是最便宜的 高階的很強 低階的超便宜
50F karcher 08/16 22:14
竟然不是大妓院
51F seemoon2000 08/17 01:02
節省成本絕對不是用開源模型
52F house911 08/16 22:16
蛤 ?
53F Haruna1998 08/16 21:47
還在吹中國模型的只剩下不能用外國模型的中國人而
54F chysh 08/16 21:13
還有人不知道?代表平常沒在用AI工作
55F sda84225 08/16 21:08
鬼故事來嘍 給空蛙的