日本經濟新聞旗下媒體 NIKKEI Digital Governance 與美國 Weights & Biases 聯手做了一次生成式 AI 實力對比調查。結果有點意思:中國月之暗面(Moonshot AI)開發的 Kimi K3 模型,綜合排名衝上第六。這個名次意味著什麼?它把投入大量資金和算力的 Google 以及 SpaceXAI(原 xAI)的模型都甩在後面了。
不過故事絕對沒這麼簡單。因為同一份調查的另一組數字,透露了完全不同的訊息。
高綜合得分背後的「偏科」危機
Kimi K3 的綜合排名確實亮眼。但拆開來看,單項成績的落差大得嚇人。在「軟體開發功能」這項,K3 排第九;「可靠性」(也就是不容易出錯或失靈的程度)排在第八。這兩個項目都有前十名的實力。
但到了「倫理觀」——也就是會不會做出違背道德或助長犯罪回答的評估——K3 直接掉到第 33 名。更慘的是「不當內容抑制」,也就是判斷檔案內容是否恰當的能力,排名第 70。
換句話說,Kimi K3 的性能確實有本事跟美國頂尖模型一較高下,但在安全防護機制上,存在明顯的漏洞,無法完全排除被網路攻擊者惡意利用的風險。
價格砍半,但門檻高得嚇人
評分數字看不出來的另一個優勢,是成本。Kimi K3 的單位使用量收費,只有 OpenAI GPT-5.6Sol 的大約一半,是 Opus5 的六成左右。以 CP 值來說,確實極具競爭力。
但問題在於部署門檻。K3 的參數量高達 2.8 兆,規模極度龐大。一般的個人電腦根本跑不動,企業要自行部署,至少得砸下數百萬到數千萬日圓等級的基礎設施投資。這可不是小數目。
有趣的是,K3 允許從自身模型提取資料,也就是業界所說的「蒸餾」。這代表第三方可以拿它來開發更小型、更輕量的模型。對整個生態系來說,這是一個重要的開放節點。
不只是月之暗面:中國開源軍團正在集結
崛起的中國 AI 新創絕對不只月之暗面一家。北京智譜華章科技(Z.ai)的 GLM-5.2 排在第 18 位,稀宇科技(Minimax)的 M3 排在第 28 位。這些新創模型,跟阿里巴巴旗下的阿里雲模型一起擠進前列。
它們有個共同點:採用開源式商業模式。靠著低成本和高性能的組合,正在一點一滴擴大市占率。這不是單一事件,而是整個中國 AI 產業的戰略路線。
【編輯觀點】從產業面來看,Kimi K3 的案例給了我們一個很重要的啟示:AI 模型的競賽已經從「能不能做到」進入了「能不能做得安全」的階段。過去大家比的是參數量、訓練成本、跑分數字,但接下來,安全性、倫理合規、防禦能力會成為新的決戰點。
K3 的安全性排名第 70,這不是靠降價就能解決的問題。如果月之暗面無法在短期內大幅提升這項指標,它在全球企業市場的競爭力將受到嚴重限制。畢竟,沒有企業會想用一個可能被惡意攻擊者利用的模型來處理機密資料。
話說回來,中國開源軍團的集體崛起確實值得關注。如果開源模型能在性能上持續逼近、甚至在某些領域超越閉源的美國模型,整個市場的權力結構可能會在未來兩到三年內發生顯著變化。對一般企業來說,這其實是好消息——更多選擇、更低價格、更大的議價空間。
美國主導權會鬆動嗎?接下來才是關鍵
報導點出了一個核心問題:開源型模型未來能否進一步提升性能,對以閉源型為中心的美國模型主導權構成威脅?
這不是一個能簡單回答的問題。開源模型的優勢在於生態系的協作與迭代速度,但閉源模型背後有龐大的資本和頂尖研究人才支撐。短期內,美國陣營的領先地位還不容易被撼動。但長期來看,如果開源模型能持續縮小性能差距,同時維持價格優勢,市場版圖確實有可能重新洗牌。
對台灣的企業和開發者來說,這代表什麼?你未來的 AI 工具選擇,不會只有美國那幾家巨頭。中國的開源模型,儘管有安全性的疑慮需要評估,但在成本和效能上的吸引力,絕對值得列入考量。
回到 Kimi K3 身上。它的綜合排名證明了一件事:中國的 AI 技術實力已經不是「追趕者」的層級。但要真正成為全球市場的重要玩家,安全性這塊短板,必須用最快的速度補上。否則,排名第 6 的掌聲,很快就會被排名第 70 的質疑聲淹沒。
你覺得呢?當一款 AI 模型性能強大、價格只要一半,但安全防護排名吊車尾,你會敢用嗎?
本文改寫整理自公開新聞來源,原始報導由科技新報發布。
常見問題 FAQ
Kimi K3 的綜合排名是多少?
Kimi K3 在日美聯合實施的生成式 AI 實力對比調查中,綜合排名第六,超越了 Google 和 SpaceXAI 的模型。
Kimi K3 最大的弱點是什麼?
安全性是 Kimi K3 的最大弱點,其中「倫理觀」排名第 33,「不當內容抑制」排名第 70,無法完全排除被網路攻擊者惡意利用的風險。
Kimi K3 的成本優勢有多大?
Kimi K3 的單位使用量收費大約只有 OpenAI GPT-5.6Sol 的一半,是 Opus5 的六成左右,CP 值明顯較高。
中國還有哪些開源 AI 模型值得關注?
北京智譜華章科技(Z.ai)的 GLM-5.2 排名第 18,稀宇科技(Minimax)的 M3 排名第 28,都採用開源商業模式,以低成本和高性能為優勢。
開源模型有可能威脅美國的主導地位嗎?
如果開源模型能持續提升性能,同時維持價格優勢,確實有可能對以閉源型為中心的美國模型主導權構成威脅,這是未來兩到三年的觀察重點。
※ 此篇文章由 AI 改寫或生成,內容僅供參考,可能存在錯誤或不準確之處。



