美中 AI 差距縮至 3%?彭博研究:中國憑「高效率與低成本」逼近美國領先優勢

美國 AI 業者與中國業者之間的性能差距,近幾個月快速縮小至歷來最低水準。彭博行業研究(Bloomberg Intelligence,BI)指出,在中國 AI 實驗室 DeepSeek 等業者持續追趕下,美國在 AI 技術上的領先優勢正面臨挑戰。

中國 AI 靠效率追趕:部分模型以五分之一成本處理多數工程任務

BI 資深分析師 Robert Lea 在報告中指出,DeepSeek 於 9 月推出 V4.1 Flash 後,中國頂尖 AI 模型與美國競爭對手在基準測試上的性能差距已縮小至約 3%。相比之下,今年 5 月的差距約為 9%,2026 年初則約為 15%。Lea 認為,性能持續改善將進一步推動中國 AI 業者取得更多市占率。

BI 認為,中國 AI 能力快速提升,來自業者累積的模型開發經驗,以及研究人員針對中國本土硬體進行模型最佳化的能力。這些進展也讓外界重新思考美國限制 NVIDIA 等先進 AI 晶片出口至中國的效果。相關出口管制原本是為了限制中國 AI 發展,並阻止華為等中國企業建立自身替代方案。

《Fortune》提及,中國 AI 業者在先進 NVIDIA 晶片受限下,轉而提升模型的運算效率,以較少算力縮小與美國的差距。AI 評估平台 Larridin 共同創辦人 Ameya Kanitkar 表示,部分中國模型能以約美國模型五分之一的成本,妥善處理約 75% 的工程任務。《Fortune》也提到,中國模型正逐步獲得企業採用。

Lea 表示,中國 AI 能力的進步,進一步讓外界質疑美國能否長期維持其在 AI 領域的技術優勢。美中兩國正競相掌握 AI 主導權,因為這項技術攸關經濟生產力、軍事領導地位與全球影響力。與此同時,中國成本較低的 AI 模型正逐漸縮小與美國模型在使用者數量上的差距,而 Anthropic 與 OpenAI 則標榜自家模型能力更勝一籌,在股票上市中爭取兆美元估值。

DeepSeek 的 V4.1 Flash 也在 AI 模型評測平台 LiveBench 上取得明顯進展。該模型在 9 月排名全球第 6,成為 DeepSeek 於 2025 年以推理模型 R1 引發關注後,中國 AI 模型取得的最高排名。LiveBench 主要根據 AI 模型回答及分析問題、謎題與各類任務的表現進行評分。

DeepSeek 最近一次公布的 LiveBench 分數為 81.1,低於 Anthropic 最高分模型的 83.4 分。Lea 認為,這代表 DeepSeek 模型已能展現與 Anthropic、OpenAI 等領先 AI 系統相近的性能。不過,儘管整體美中模型的性能差距已縮小至 3%,LiveBench 評估的全球前 15 名模型中,中國模型仍只有 3 個。Lea 也提醒,這類排名會變動。

性能追上仍難獲利?中國 AI 產業面臨價格戰與監管壓力

除了模型性能之外,中國 AI 業者仍面臨商業化與監管上的挑戰。Lea 指出,即使模型在排行榜上取得較高名次,仍不代表能夠順利實現獲利。在模型蒸餾(model distillation)指控傳出後,中國 AI 模型也面臨美國監管機構日益嚴格的審查,甚至可能遭到禁用。

BI 預期,中國 AI 產業可能要到 2030 年才有機會實現整體獲利。中國市場目前充斥著超過 1,100 個大型語言模型(LLM),業者普遍採取低利潤率的 token 供應模式,加上激烈的價格戰,可能使任何一家業者都無法取得競爭優勢。

在 AI 應用程式的商業化方面,目前以字節跳動旗下的豆包(Doubao)表現較為領先;相較之下,DeepSeek 與騰訊的聊天機器人目前仍採免費模式。Lea 認為,要讓中國 AI 產業建立可持續的獲利模式,仍需要降低市場競爭壓力、推動產業洗牌,以及讓價格策略回歸更理性的狀態。

科技的變化總是快得驚人,而我們每天的工作,就是從龐雜的趨勢中理出觀點、提煉出決策者真正需要的洞察。如果你也對 AI 發展充滿熱情,《TechOrange 科技報橘》正在徵內容編輯!
👉了解職缺內容

【推薦閱讀】

◆ Jev 爆紅後 Strands Decider、Clef 接連登場,決策模型正走出哪些不同路線?

◆ Gemini 4 終於登場:一次可輸出 100 萬 token,Google 為何要把 AI 單次工作量做這麼大?

◆ OpenAI 推出 Dots 到底新在哪?AI Agent 正從「接任務」走向「接責任」

*本文開放合作夥伴轉載,資料來源:《Bloomberg》、《The Business Times》、《Fortune》,圖片來源:Unsplash。