日經:中國AI Kimi的高性能再次衝擊世界

中國的人工智慧(AI)新興企業、月之暗面(Moonshot AI)的新模型「Kimi K3」的性能在美國的專家之間引起震驚。雖然性能未超過美國安Anthropic的最新人工智慧「Fable」,但被認為與之接近。在17日的美國股市,受Kimi K3的影響,美國谷歌母公司Alphabet和美國Meta分別較前一日下跌2%和3%。

圍繞源自中國的低成本AI,也有聲音擔心2025年1月動搖科技行情的「DeepSeek衝擊」的重現。當時由於即使沒有大量半導體也能高效運作的中國DeepSeek的AI問世,美國英偉達股價暴跌。

美國調查公司Artificial Analysis對編程、數學和科學等多領域的AI性能進行了綜合評價。Kimi K3排在安索羅匹克的最新模型「Fable」和OpenAI的最新模型「GPT-5.6」之後,居第3位。

 專家們也紛紛高度評價Kimi K3的性能。美國賓夕法尼亞大學華頓商學院教授伊森·莫利克在X(原推特)上表示,「雖然落後於OpenAI和Anthropic的最頂級模型,但作為(對外公開技術的)開源模型來説,已經非常出色」。

美國布魯金斯學會的凱爾·陳(Kyle Chan)表示,「這表明中國的AI模型已大幅縮小與美國的技術差距。儘管美國限制半導體出口,但中國的AI開發並沒有放緩」。

對美國川普政府的AI政策具有影響力的大衛·薩克斯表示,「正在獲得尖端水準或接近的分數,這是令人擔憂的事態」,對中國企業的崛起表示警惕。

在美國,認為中國企業的AI性能「將在6~12個月內趕上(美國)」(Anthropic的首席執行官達里奧·阿莫迪)的看法已成為主流。Kimi K3的問世顯示出,開發能力的差距比美國方面預想的要小,中國企業有可能提高了競爭力。

從性能指標來看,Kimi K3雖然不及Anthropic和OpenAI的最新模型,但很多觀點認為超越了上一代技術。如果Kimi K3的性能與Anthropic的「Opus 4.8」(5月發佈)和OpenAI的「GPT-5.5」(4月發佈)相同,那麼僅從一般提供的AI來看,中國可能在3個月左右就趕上了美國。在綜合性能方面,美國企業保持優勢。Kimi K3超越Anthropic最新AI Fable的僅限於衡量網站等開發能力的編程指標等的一小部分。

關於中國企業有優勢的低成本,也有觀點認為Kimi K3的使用費並不便宜。著名科技投資者加文·貝克(Gavin Baker)指出,「Kimi K3比GPT-5.6成本更高」。雖然每個詞元(token、數據處理量)的單價比美國AI便宜很多,但在相同作業上消耗的詞元量更多。

關於月之暗面,今年2月Anthropic指出Kimi的開發使用了從其他高性能AI中提取數據的「蒸餾」方法。認為月之暗面創建了數百個非法帳戶,與Anthropic的「Claude」進行了340萬次以上的對話。中美圍繞AI開發的競爭非常激烈。與壟斷尖端AI的美國相比,中國的目標是低價開發開源技術,在海外普及本國産AI。美國試圖通過禁止出口尖端半導體等延緩中國企業的開發,另一方面,中國則通過推進半導體國産化等官民合作進行對抗。

=半導體分析師吉姆·漢迪(Jim Handy)表示,「即使中國AI模型提高了競爭力,如果不能在尖端半導體領域趕上美國,就無法保持步伐」。他指出,美國方面也可以採用中國企業創造的AI開發新方法。

   摘自日經中文網


「月之暗面」發布新AI模型 DeepSeek 2.0式擔憂恐再現

 

中國新創「月之暗面」17日發布其最強AI模型Kimi K3,僅憑開源工具就能在48小時內自主完成一款功能性半導體晶片設計,並稱其在多項測試中超過部分美國尖端系統。這一突破性成果震撼科技圈,特斯拉創始人馬斯克也評價為「令人印象深刻」,還傳出月之暗面最快6個月內赴港上市。消息一出,不少投資者憂心重現去年「DeepSeek時刻」引發的市場震動,相關概念股股價重挫,摩根大通團隊將市場反應稱為「DeepSeek 2.0式擔憂」。

綜合觀察者網、加美財經報導,月之暗面發布新模型Kimi K3,擁有2.8萬億個參數,是目前全球規模最大的開源模型,公司計畫在本月底前將模型完全開源。發布當日,馬斯克在相關評測報道評論區留言:「令人印象深刻」。克再次發表評論稱,「我們的2兆參數模型將在下周完成初始訓練,有可能超越Kimi」。Kimi則回應稱,「@ElonMusk 歡迎加入『2兆+』俱樂部」。

據月之暗面公布的測試結果,Kimi K3在多數編程和智能體基準測試中超過Anthropic的Opus4.8和OpenAI的GPT-5.5,令不少矽谷士感到意外,也強化了市場對中國AI實驗室正在迅速縮小與美國同行差距的判斷。傑富瑞分析師將Kimi K3的發布稱為一次「意外突破」,認為這將推動人工智能行業進一步創新。摩根大通數據資產與阿爾法團隊則在報告中將市場反應概括為「DeepSeek2.0式擔憂」。

這說法指的是去年DeepSeek發布後引發的市場震動。當時,投資者擔心中國企業能夠以較低成本開發出性能強大的AI模型,從而削弱美國科技公司的領先優勢。

Kimi K3發布後,「DeepSeek時刻」類似擔憂再次升溫,投資者開始重新評估對美國大型科技公司投下的巨額資本是否能獲得足夠回報。相關擔憂也造成亞洲股市明顯波動,月之暗面的中國競爭對手Z.AI和MiniMaxGroup分別下跌28%和16%。OpenAI主要股東之一軟銀集團下跌9%,日本晶片製造商鎧俠控股下跌16%。美股早盤費用半導體指數一度下跌5%,後收回部分失地。

中國AI模型近年來在全球獲得愈來愈多用戶,部分原因是許多模型採用開源方式,而且運行成本通常低於西方產品。Anthropic國家安全政策主管塔倫·查布拉近日表示,美國在人工智能模型方面領先中國實驗室的時間,目前可能只剩大約六至九個月。 

而資本市場對中國AI企業的興趣仍然高漲。月之暗面的投資者包括風險投資公司HSG和阿里巴巴。據華爾街日報此前報導,月之暗面公司已經開始籌備在香港IPO。知情人士表示,月之暗面目前正在進行新一輪融資,估值達到315億美元。


大陸晶片崛起 可支援模型訓練

在今年的世界智能大會(WAIC),多家大陸國產算力晶片製造商相繼展出最新款式,並強調旗下晶片不僅能承擔繁重的推理任務,更已具備AI模型的訓練能力。摩爾線程創辦人張建中就強調,大陸國產晶片不僅可以支援模型訓練,更可提供比外國廠商更好的本地化服務。

長久以來,由於晶片生態與算力的差距,大陸國產算力晶片大多僅運用推理任務,而模型訓練領域幾乎被輝達等外國晶片壟斷。不過,在18日舉行的「詞元時代萬物智能」的分論壇上,摩爾線程創辦人、董事長兼CEO張建中就喊話,國產模型可以放心在國產晶片上做訓練。張建中提到,過去大陸模型商經常擔心,國產晶片的訓練平台或許將影響其追趕世界領先水準。

不過,如今他們有更好的硬體平台和先進的軟體技術,並且,使用國產晶片訓練模型還有一個優勢是,摩爾線程隨時可以為使用者提供本地化服務,能比國外廠商做得更好。此外,據澎湃新聞報導,另一家大陸算力晶片廠沐曦股份高級副總裁、首席產品官孫國梁也指出,沐曦晶片既可以做推理也可以做訓練。

孫國梁強調,沐曦一直公開表示旗下晶片是訓練推理一體的,雖然部分產品受性價比因素影響,設計成僅適用於推理,但完全具備訓練的能力。據了解,相比於輝達等外國廠商產品,大陸國產晶片不僅是算力相較落後,更長期處於生態環境不足的情況。這也是即便大陸官方有意限制輝達產品進口,主要模型開發商對輝達晶片的需求仍然旺盛的主因。

不過,隨著在推理端的實際運用與生態的培育,使用大陸國產晶片進行推理的條件已逐漸成熟,並且也有新創公司在針對模型訓練提供框架方案。如新創公司清程極智推出的八卦爐智慧軟體棧,就標榜其針對大陸國產晶片的適配能力,可更加高效地發揮晶片算力。

相關新聞

根據英國「金融時報」分析,野火與熱浪今年席捲歐洲所造成的損失已逾30億歐元(約新台幣1120億元),遠超歐盟對一般正常年份的平均災損預估,...
中國國務院日前公布《國務院關於出境入境管理的規定》,將於2026年9月15日起正式施行。它延續了過去幾年逐步收緊的邊控趨勢,...
聊天機器人、AI代理、虛擬人物及深偽內容,未來須以更明確的方式告知使用者其人工智慧屬性,意味生成式AI產業的競爭條件,...
奧拉說,Anthropic至今持續發現AI模型存在一些神秘且令人不安的現象,例如AI出現與人類神經科學研究相似的結構,模型內部浮現類似喜悅...