根據彭博行業研究的報告,美國AI企業相較中國的領先優勢在過去幾個月大幅收窄,降到歷史新低。像是DeepSeek等中國AI實驗室持續追趕,對美國的科技領先地位構成威脅。
彭博資深分析師李伊在報告中表示,隨著DeepSeek在9月推出V4.1 Flash,中國頂尖AI模型在基準測試中的得分,如今只落後美國競爭對手3%。這個差距比5月的約9%、今年稍早的15%,又大幅縮小。
中國AI實力提升,主要受惠於日益深化的AI技術能力,以及中國研究人員針對國產硬體優化模型的能力。這些進展也讓外界開始質疑,美國限制輝達等科技產品出口、意圖遏制中國AI發展的政策,究竟有多大成效。
李伊表示,中國AI產業的進步,讓人進一步質疑美國在AI領域的科技領先地位能否長期維持。
美中兩大強權正在爭相主導AI這項關鍵技術,因為AI將帶動經濟生產力、軍事優勢與全球影響力。中國以較低成本開發的AI模型,正透過使用者數量逐步縮小與美國競爭對手的差距。
同時間,Anthropic與OpenAI正在準備上市,力拚上兆美元的估值,並強調自家模型具備更優異的能力。
DeepSeek的V4.1 Flash上個月在LiveBench全球排名第6,成為這家新創公司自2025年憑推論模型R1取得突破性進展以來,排名最高的中國AI模型。
LiveBench是專門用來評估大型語言模型表現的基準測試平台,會根據AI模型對問題、謎題及各種任務的回答與分析能力進行評分,評測方式類似衡量人類智商。DeepSeek最近一次公布的LiveBench得分為81.1分,低於Anthropic最高模型的83.4分。
李伊表示,這意味著DeepSeek的模型已經展現出能與Anthropic和OpenAI頂尖AI系統「可比擬的性能」。不過,儘管雙方得分差距縮小到只剩3%,LiveBench評選的全球前15大模型中,仍然只有3款來自中國。
李伊也提醒,AI模型排名會不斷變動,而且即使模型在排行榜上表現突出,能否把技術優勢轉化為營收仍可能相當困難。中國AI模型目前面臨日益嚴格的美國監管審查,甚至可能遭到禁令,外界也指控部分中國AI業者涉及「模型蒸餾」。
他進一步指出,中國AI產業可能在2030年前都無法具有獲利能力,因為產業目前聚焦在低毛利的Token供應,加上激烈的價格戰,可能讓任何一家企業都難以建立真正的競爭優勢。尤其中國國內市場已經有超過1100個大型語言模型,競爭十分激烈。
在AI應用程式轉化為營收方面,字節跳動旗下的豆包目前處於領先地位。相較之下,DeepSeek與騰訊旗下競爭產品的聊天機器人,目前仍然免費提供。
李伊的結論是:要讓中國AI產業建立可持續的獲利模式,就必須讓競爭壓力降溫、推動產業洗牌,並採取更理性的定價方式。
這份報告描繪的圖像是:技術差距正在快速收窄,但商業化的路還很長。接下來可以觀察美國的出口管制政策會不會再加碼,以及中國業者能否在獲利模式上找到出路。