金色財經
作者:李丹,華爾街見聞
月之暗面正式打響中國大模型新一輪「開源戰」。
7月16日周四,月之暗面正式發布新一代開源基礎模型Kimi K3,參數規模達2.8兆,並同步上線API服務及開發者文檔。新華社報導稱,評測中,Kimi K3綜合智能水平接近全球前沿的閉源模型,並指出,這是目前全球參數最大的開源模型,標誌着我國人工智慧(AI)模型發展邁出新的一步。
Kimi K3是月之暗面迄今最強旗艦模型,專為長程智能體編程與自我演進工作流而打造。它引入了月之暗面自研的Kimi Delta Attention(KDA)混合線性注意力機制以及 Attention Residuals(AttnRes)結構,通過優化長序列資訊處理和深層網路資訊傳遞能力,提高大規模模型的訓練效率和推理表現。
Kimi K3支持100萬Token上下文窗口,並原生具備視覺理解能力,主要面向軟體工程、知識工作以及複雜推理等高難度場景。月之暗面稱,KDA技術實現了百萬級上下文下高達 6.3 倍的解碼加速,AttnRes機制以不到2%的額外成本,提升約25%的訓練效率。
月之暗面強調,該模型重點優化智能體編程(Agentic Coding)能力,能夠理解大型代碼庫、調用工具、執行測試,並根據反饋持續調整任務方案。同時,K3採用更高稀疏度的MoE設計,據社區整理資訊顯示,模型擁有896個專家模塊,但每次推理僅激活16個專家,在擴大模型容量的同時控制計算成本。
相比上一代模型,Kimi K3更強調從「回答問題」向「完成任務」轉變。尤其是在長周期軟體工程任務中,模型能夠結合代碼、運行日誌、測試結果以及視覺資訊進行綜合判斷,這使其在遊戲開發、前端工程、CAD設計和基礎設施優化等場景具備更強潛力。
Kimi K3發布後,模型性能測試成為市場關注焦點。
根據月之暗面公布的評測結果以及社區整理數據,Kimi K3在代碼生成、知識工作、長文本檢索和Agent任務等多個方向進入全球第一梯隊。在部分綜合能力評測中,K3被認為僅次於Claude Fable系列和GPT頂級模型,位列參與測試模型中的前列。
知識工作評測方面,社區整理的GDPval-AA v2數據顯示,Kimi K3取得1687分,超過Claude Opus 4.8 Max的1600分,僅次於Claude Fable 5 Max和GPT-5.6 Sol Max。該測試主要評估模型在44類職業、9個行業中的真實工作能力,涵蓋研究分析、商業判斷、專業寫作等複雜任務。
另據AA-Briefcase智能體知識工作測試,Kimi K3取得1527分,排名僅次於Claude Fable 5 Max,並超過GPT-5.6 Sol Max。
在長上下文和資訊檢索能力方面,社區數據顯示,Kimi K3在BrowseComp測試中取得91.2分。由於該模型支持100萬Token上下文窗口,並可在單智能體模式下無需額外上下文壓縮完成任務,因此被認為在長周期、高難度資訊檢索場景中具備明顯優勢。
除了Benchmark成績,Kimi K3在開發者社區中的實際體驗也引發大量討論。
一些提前測試用戶表示,在複雜智能體(Agent)任務、連續編程和多工具調用場景中,K3展現出的自主規劃和執行能力接近此前只有頂級閉源模型才能達到的水平,被部分開發者稱為具有「Fable級體感」。
有海外對沖基金經理提到的評測結果是,Kimi K3的性能超過Opus 4.8,定價差不多是Opus 4.8的60%。有內資行團隊測評後也認為,Kimi K3的能力超過Opus 4.8,接近Fable5和GPT-5.6 Sol。
不過,與Anthropic的Claude Fable系列相比,Kimi K3目前更準確的定位是「逼近」,而非全面超越。
由於Fable等模型並未公開完整參數和所有測試細節,外界無法進行嚴格的一對一比較。但從公開評測來看,Kimi K3已經在部分知識工作和智能體能力測試中超過Claude Opus 4.8,顯示中國開源模型正在進入與美國頂級閉源模型競爭的新階段。
業內認為,Kimi K3的意義不僅在於參數規模和Benchmark成績,更在於其選擇開放權重路線。與OpenAI、Anthropic主要通過API提供閉源模型不同,月之暗面希望通過開源模型擴大開發者生態。
繼DeepSeek之後,Kimi K3進一步證明,中國AI公司正在從此前的成本優勢競爭,轉向模型能力、Agent生態和開發者基礎設施的全面競爭。
事實上,在Kimi K3正式亮相之前,海外媒體已提前數日開始密集關注這款模型。
有報導稱,Kimi K3被內部定位為中國目前規模最大的AI模型之一,預計將在多項主流基準測試中超過Anthropic的Claude Opus 4.8,並將進一步縮小與Anthropic旗艦模型Claude Opus 4.8之間的性能差距,是月之暗面迄今最重要的一次模型升級。
雖然Anthropic未公開Opus 4.8參數規模,但業內普遍估計約為1.5兆至2兆參數。
金融時報援引知情人士稱,Kimi K3雖然預計仍無法超越Anthropic此前因安全問題而暫停發布的超前沿模型Fable,但已經足以挑戰市場長期以來認為"中國模型落後美國8至12個月"的普遍認知。
對於美國AI實驗室而言,更大的挑戰並不僅來自模型能力,而是商業模式。
由於Kimi K3採用開放權重方式發布,全球開發者可以免費下載、自行部署並進行修改,這意味著其有望像DeepSeek一樣迅速形成開發者生態,對堅持封閉模型策略的OpenAI、Anthropic形成持續競爭壓力。
過去一年,美國AI公司持續投入數千億美元建設AI基礎設施,並不斷推出更強大的前沿模型。
與此同時,其商業化價格也持續上升。
據Anthropic官網資訊,該司計劃自今年9月起,將Claude Opus 4.8價格進一步提高約50%,輸入Token價格升至每百萬3美元,輸出Token價格升至每百萬15美元。
相比之下,中國AI公司正採取另一條路徑。
包括DeepSeek、月之暗面在內,多家中國AI企業持續推出開放權重模型,不僅允許企業私有化部署,同時整體推理成本也明顯低於美國頭部模型。
以月之暗面此前發布的K2.6模型為例,其調用成本約為Claude Opus 4.8的三分之一。
隨著越來越多企業開始關注AI成本控制,不少海外企業也開始嘗試採用中國模型替代部分美國模型,以降低推理支出。
美國知名風投Andreessen Horowitz的聯合創始人Marc Andreessen此前就曾表示,智譜發布的GLM-5.2已經成為首個能夠在不少公開測試中與美國大型AI實驗室旗艦模型相匹敵甚至部分領先的中國模型。
今年以來,中國AI公司幾乎全部轉向開源路線。
DeepSeek憑藉R1系列迅速獲得全球開發者關注;智譜、MiniMax等公司隨後陸續推出開放權重模型;如今月之暗面也正式加入這一陣營。
與此同時,美國頭部AI公司則仍堅持閉源路線。
OpenAI最新GPT系列、Anthropic Claude旗艦模型均未開放模型權重,而是依賴API訂閱模式持續提高商業化收入。
這種模式差異,也成為全球AI競爭的新分水嶺。
金融時報指出,越來越多矽谷投資人和科技企業高管開始認為,中美前沿AI模型之間的性能差距正在快速收窄,而真正決定未來競爭格局的,可能不再只是模型排行榜,而是誰能夠建立覆蓋全球開發者的開放生態。
資本市場也正在重新評估中國AI公司的價值。
金融時報報導稱,月之暗面正在進行新一輪融資,估值約315億美元;DeepSeek也已啟動新一輪融資,估值約710億美元。相比之下,Anthropic最新融資後的估值約為9650億美元,OpenAI最新估值約為8520億美元。
隨著Kimi K3正式發布,中國頭部AI公司與美國前沿實驗室之間的競爭,也正從單純的模型能力比拼,進一步延伸至開源生態、開發者社區以及商業模式的全面較量。
來源:金色財經
發佈者對本文章的內容承擔全部責任
在投資加密貨幣前,請務必深入研究,理解相關風險,並謹慎評估自己的風險承受能力。不要因為短期高回報的誘惑而忽視潛在的重大損失。
暢行幣圈交易全攻略,專家駐群實戰交流
▌立即加入鉅亨買幣實戰交流 LINE 社群(點此入群)
不管是新手發問,還是老手交流,只要你想參與加密貨幣現貨交易、合約跟單、合約網格、量化交易、理財產品的投資,都歡迎入群討論學習!
上一篇
下一篇