 |
|
張貼者: |
木蘭
|
|
| 時間: |
2026/10/8 下午 09:32:00
|
| 標題: |
中美 AI 技術差距急速拉近 DeepSeek 新模型基準測試得分僅落後美國對手3%
|
|
內容: |
2026/10/06 01:49:53 經濟日報 編譯葉亭均/綜合外電
根據彭博行業研究(BI)的報告,美國AI企業相較中國大陸的領先優勢在過去幾個月大幅收窄,降至歷史新低,因為像是DeepSeek等中國大陸AI實驗室持續追趕,這對美國科技霸主地位構成威脅。
彭博資深分析師李伊(Robert Lea)在提出的報告中表示,隨著DeepSeek於9月推出V4.1 Flash,大陸頂尖AI模型在基準測試中的得分,如今僅落後美國競爭對手3%。這一差距已經比5月的約9%、今年稍早的15%大幅縮小。
李伊表示,AI模型性能持續改善,意味大陸業者將搶下市占。
大陸AI實力提升,主要受惠於日益深化的AI技術能力,以及研究人員針對國產硬體優化模型的能力。這些進展也讓外界開始質疑,美國限制輝達等科技產品出口、意圖遏制大陸AI發展,並阻止華為等企業推進自有替代產品的政策,究竟有多大成效。
美中兩大強權正爭相主導AI這項關鍵技術,因為AI將帶動經濟生產力、軍事優勢與全球影響力。中國大陸以較低成本開發的AI模型,正透過用戶數量逐步縮小與美國競爭對手的差距。
DeepSeek的V4.1 Flash上月在LiveBench全球排名第六,成為這家新創公司自2025年憑推論模型R1出現突破性進展以來,排名最高的中國大陸AI模型。
LiveBench是專門用來評估大型語言模型(LLM)表現的基準測試平台,會根據AI模型對問題、謎題及各種任務的回答與分析能力進行評分,其評測方式類似衡量人類智商。
DeepSeek最近一次公布的LiveBench得分為81.1分,低於Anthropic最高模型的83.4分。這意味著DeepSeek的模型已展現能與Anthropic及OpenAI的頂尖AI系統「可比擬的性能」。
|
|