金色財經
陶朱,金色財經
摘要:2026年7月16日,月之暗面正式推出Kimi K3。Kimi K3在能力上已接近美國前沿人工智慧實驗室Anthropic所開發的模型。這一進展表明,中美兩國在最先進人工智慧領域的差距正不斷縮小。
據《Kimi K3:智能的新前沿》介紹,Kimi K3 是一個 2.8 兆參數模型,基於 KDA 混合線性注意力機制(Kimi Delta Attention)和注意力殘差(Attention Residuals)技術構建,原生支持視覺理解,並擁有 100 萬 token 上下文窗口。它是全球首個開源的 3 兆級別模型,面向長程編程、知識工作和推理等前沿智能場景而設計。
雖然 Kimi K3 的整體表現仍落後於最強的閉源模型 Claude Fable 5 和 GPT-5.6 Sol,但它在整套評測中展現出前沿水平的能力,並穩定超過了其他所有模型。
Kimi K3 基於 Kimi Delta Attention(KDA)和 Attention Residuals(AttnRes)構建。這兩項架構更新,都是為了讓資訊在更長序列和更深模型中流動得更順暢。模型也進一步擴大了 Mixture of Experts(MoE)的稀疏度:結合 Stable LatentMoE 框架後,模型可以在 896 個專家中高效激活 16 個。再加上訓練方法和數據配方的優化,這些結構性改進讓 Kimi K3 相比 K2 的整體擴展效率提升約 2.5 倍,能更有效地把算力轉化為能力。
Kimi K3 具備很強的長程編碼能力。在極少人工監督的情況下,它可以持續完成長時間工程任務,理解和處理大型代碼庫,並協調使用終端工具。Kimi K3 也擅長結合軟體工程與視覺推理的任務。它能夠利用截圖和視覺反饋,優化遊戲開發、前端和 CAD 等場景。
據AI模型評測平台Arena顯示,Kimi-K3已在Frontend Code Arena中以1679分位居第一,超越了Claude Fable 5。
評估人工智慧模型性能的獨立公司 Vals AI 首席執行官雷揚·克里希南表示,根據該公司運行的基準測試,Kimi K3的表現略遜於Anthropic的Fable 5模型,但優於OpenAI的旗艦模型GPT-5.6 Sol。
就在Kimi K3上線的48 小時內,需求增長遠超預期,GPU 資源接近承載上限。為保障現有訂閱用戶體驗,平台甚至暫時暫停新增訂閱。
在預測市場Polymarket上,Anthropic年底前估值達到1.5兆美元的機率大幅下降。市場交易者普遍將這一變化與Kimi K3發布後的市場情緒變化聯繫在一起,並稱Anthropic的估值預期受到衝擊。7月17日,交易者認為Anthropic年內觸及1.5兆美元估值的機率約為77%;到7月18日,該數字降至67%,一天內下跌約10至11個百分點;截止7月20日,機率為66%。交易者認為Anthropic年內觸及1.25兆美元估值的機率最高,為92%。
受Kimi K3發布的影響,7月17日,Alphabet和Meta的股價分別較前一日下跌2%和3%;彭博亞洲半導體指數跌超6%;那斯達克100期貨跌約2%。
在面臨用戶流失的壓力時,各大美國模型突然開始頻繁重置免費用戶的限制:Anthropic抹去了Claude用戶的免費額度上限;OpenAI也在同一天重置了Codex的使用限制;Grok甚至在短短一周內重置了兩次限制。這種罕見的「慷慨」本質上是一種恐慌性算力贈送,目的是通過提升免費體驗來強行留住被廉價開源模型吸引走的開發者和用戶。
研究中國開源人工智慧生態系統的斯坦福大學教授格雷厄姆·韋伯斯特表示:一個模型是否處於絕對領先地位並不重要,因為中美領先模型之間的性能差距已經縮小。「對於中國落後美國多少個月,每個人都有不同的數字,估計普遍集中在六個月左右。這算不上多大的領先優勢。」
在美國,認為中國企業的AI性能「將在6~12個月內趕上(美國)」(Anthropic的首席執行官達里奧·阿莫迪)的看法已成為主流。從性能指標來看,Kimi K3雖然不及Anthropic和OpenAI的最新模型,但很多觀點認為超越了上一代技術。如果Kimi K3的性能與Anthropic的「Opus 4.8」(5月發布)和OpenAI的「GPT-5.5」(4月發布)相同,那麼僅從一般提供的AI來看,中國可能在3個月左右就趕上了美國。
Kimi K3 發布後引發部分美國人的討論:美國為什麼沒能留住Moonshot創始人楊植麟。
楊植麟是一位90後天才。1992年出生於廣東省汕頭市,本科就讀於清華大學最初主修熱能工程,後主修計算機。
從清華大學畢業後,前往美國卡內基梅隆大學攻讀博士學位。師從魯斯蘭·薩拉胡特迪諾夫(蘋果公司人工智慧研究總監)和威廉·科恩(谷歌DeepMind首席科學家)。在攻讀博士學位期間,他曾在谷歌大腦和元平台公司工作。他還與圖靈獎得主約書亞·本吉奧和揚·勒昆合作撰寫了關於計算機推理和模式識別的論文。
博士畢業後,楊植麟回國創業,參與創辦 Recurrent AI(循環智能)。主要利用 AI 技術分析銷售溝通數據,幫助企業提升銷售效率。
2023 年,楊植麟聯合團隊成立 Moonshot AI(月之暗面)。公司名稱來源於 Pink Floyd 樂隊經典專輯《The Dark Side of the Moon》。月之暗面的目標是開發具有更強通用能力的大模型,推動 AI Agent 和通用人工智慧方向的發展。公司核心產品包括:Kimi 智能助手、Kimi 大語言模型系列、長上下文 AI 應用等。Kimi 被認為是中國大模型創業公司中的代表產品之一,與OpenAI、Anthropic等國際 AI 公司展開競爭。
1)楊植麟的回國創業夢
楊植麟在卡內基梅隆大學的導師Russ Salakhutdinov發文表示:蘋果公司一位高級副總裁(蒂姆·庫克的直接下屬)曾問楊植麟是否會考慮加入蘋果,楊植麟表示想回中國。蘋果的回覆是,如果楊植麟願意,可以加入蘋果北京辦公室。但楊植麟當時非常堅定地要回中國創辦一家初創公司。楊植麟說,如果他不至少嘗試一次自己創業,他會後悔一輩子。
2)移民政策阻礙
牛津大學AI博士生JundeMorsenWu發文表示,由於美國移民政策(如PP10043和綠卡國別積壓)的阻礙,加之中國不斷提供高薪、住房和經費等優厚條件,在牛津攻讀人工智慧博士的我正逐漸動搖,開始懷疑是否還應堅持前往美國這個似乎並不歡迎我的國家。
對JundeMorsenWu的推文,潘興廣場CEO Bill Ackman表示,美國需要改革移民政策,以便接納真正的創造者,讓他們在美國本土發展,創造價值。尤其令人費解的是,把最優秀、最聰明的學生送進聯邦政府資助的教育機構,然後又把他們送回國。
在Russ Salakhutdinov的X帖子下,有大量網友加入討論。其中有支持楊植麟回中國創業的聲音,也有人質疑美國留不住人才。
@AKJay59396046:在美國,他可能不得不和一個像Altman這樣騙子似的傢伙共同創辦他的初創公司,這個傢伙搶走所有的風頭,然後像對待奴隸一樣踢他,因為前者與風險投資黑幫的文化親和力和影響力。很可能,他最終只能成為一名創始員工,勉強作為一個向能說會道的印度CTO匯報的技術苦力混日子。在中國,我懷疑情況會有所不同。他會如魚得水。黃仁勛可能屬於某種「亞洲人」——一種憑藉自身個性,加上技術能力,能夠克服制度性偏見的人。
@Orangeman1992:他來這裡學習,把家人留在家鄉。他學完了就回去了。他沒有義務留在這裡,特別是當中國為他提供了很好的機會和優質的生活方式時。我和耶魯大學的一位教授聊天,他告訴我幾個他的白人美國學生畢業後在中國找到了工作。
@ArcherZmq:從這麼多愚蠢的回覆來看,我認為他回中國確實是正確的選擇。
@btc_albert:核心觀點:現在已經不再明確美國是否是人們長期發展職業生涯的最佳地點。 如果我們希望頂尖人才留下來,我們需要解決以下所有問題: 種族主義和歧視的結合、缺乏安全保障、缺乏道德/濫用權力,以及缺乏改善生活的基建投資,這些問題已經累積到讓人們不再那麼有動力留下的地步。
@AvidFayaz:美國移民政策不僅應當允許,而且應當以鼓勵這類人選擇在美國而非其他市場創業作為目標。
@PlatoCosmos:我認為最聰明、最優秀的人正在選擇返回他們的祖國創業。他們不會因為簽證問題而浪費生命中最美好的幾十年。比起美國,海外的VC資金雖然沒有那麼多,但也非常充足。我們需要反思,為什麼有人會選擇留下來,犧牲幾十年只為了留在這裡。我們不應該對此習以為常。
前白宮加密和 AI 主管 David Sacks 在 X 平台發文表示: 中國 AI 模型 Kimi K3 首次登頂 Frontier Code Arena 前端代碼評測,並在其他多項基準評測中達到或接近行業領先水平,這一趨勢值得關注。在中國 AI 能力快速提升的同時,美國正因監管爭議陷入內耗。他批評部分美國政界人士和監管機構限制新數據中心建設、增加州級監管要求,並推動成立新的聯邦機構,對前沿 AI 模型進行事前審批。 David Sacks 警告稱,如果美國因過度監管放緩創新速度,可能在全球 AI 競爭中失去優勢。「美國憑藉無許可創新(Permissionless Innovation)贏得了網路時代,也可以通過同樣方式贏得 AI 時代;否則,我們將看到領先地位逐漸消失。」AI 發展仍需解決安全風險,但監管應採取精準方式,而非阻礙技術創新。其言論再次引發關於 AI 監管、算力基礎設施建設以及中美 AI 競爭格局的討論。
7月20日,David Sacks 再度發文:Kimi K3剛剛修復了15個關鍵安全漏洞,而Codex和Fable之前因「網路安全護欄」限制而拒絕處理這些問題。對於外國模型能順利完成的任務,沒有理由去限制美國模型。這樣做只會削弱我們自身的競爭力。
特斯拉CEO埃隆·馬斯克在相關評測報導評論區留言:「令人印象深刻。」隨後在7月18日,馬斯克在社交媒體平台「X」上透露,其2T參數模型將於下周完成初步訓練,新模型將全面優於1.5T的版本,他還表示,該模型可能可以超越Kimi。
SemiAnalysis月之暗面旗下大模型Kimi K3採用線性注意力機制,引發市場對英偉達、HBM以及網路設備需求可能受到削弱的擔憂。不過,半導體研究機構SemiAnalysis近日給出了截然不同的判斷:K3龐大的參數規模和推理架構需求,不僅不會削弱高端AI硬體需求,反而可能進一步強化對英偉達高端GPU、HBM以及高速互聯設備的需求。 SemiAnalysis指出,K3參數規模超過2.8兆,模型權重容量超過1.5TB HBM。即便在相對有限的用戶並發場景下,KV緩存仍需要大量卸載至CPU DDR5內存及NVMe儲存,HBM空間並不會出現明顯富餘。更重要的是,月之暗面此前透露,K3的高效推理部署需要至少64顆晶片組成的大規模擴展域架構。這一硬體需求與英偉達GB200/GB300 NVL72等機架級AI系統的設計方向高度匹配。 SemiAnalysis認為,市場此前將線性注意力理解為「削弱GPU需求」的邏輯存在偏差。真正的影響可能恰恰相反:更高效的模型架構降低了AI推理成本,將推動更多應用落地,進而刺激GPU、HBM、DRAM以及網路基礎設施的長期需求。
中信建投研報指出,堅定看好AI產業趨勢。我們認為,K3是本周全球大模型行業的分水嶺事件,也是另一個DeepSeek時刻:K3的發布意味著中國大模型第一次以「競爭威脅」身份進入全球大模型敘事——2.8 兆參數 + 100 萬上下文 + Code Arena 登頂,證明國產模型已在Agentic Coding主戰場與美國前沿模型正面交鋒。其他建議重點關注應用層機會:1)K3提升了開源模型智能水平,應用層使用tier1模型的門檻、成本預計均將降低,利多後續應用場景進一步打開;2)頭部和第二梯隊模型廠商的競爭均較為激烈,競爭維度已經從模型能力延伸至價格、產品力、場景拓展、成本優化等,我們認為利多應用層。
綜上,從美國科技界到華爾街研究機構,再到國內券商,均認為Kimi K3的發布標誌着中國基礎大模型首次以全球競爭者的身份進入國際AI產業核心敘事。
2023年由梁文鋒創建於杭州,估值已經超過3500億元。DeepSeek版Claude Code即將上線,Harness將與V4正式版同步發布。它是一款代碼智能體產品,內部對標 Claude Code,負責讓模型讀寫文件、調用工具、執行命令,並持續完成工程任務。
DeepSeek 已被騰訊、華為、阿里雲等多家雲平台和企業生態接入,同時支持大量開發者通過 API 和開源模型進行二次開發。DeepSeek 重新定義了開源大模型的競爭方式,其低成本、高性能的訓練策略推動全球 AI 企業重新思考模型研發模式,被認為是中國 AI 國際競爭力的重要代表。
智譜 AI由唐傑(聯合創始團隊源自清華大學知識工程實驗室)於2019年創建,是國內最早布局大模型研發的企業之一,也是國內最早實現 GLM 系列模型商業化的公司。
2026年6月,智譜AI GLM-5.2問世,是新一代旗艦級基座大模型,專注於超長程任務與AI編程能力。其核心亮點在於支持真正可用的1M(100萬)無損上下文,並在全球編碼基準測試中位居開源模型前列,性能直逼國際頂級閉源系統。其性能幾乎與美國領先系統、Anthropic的Fable 5模型同樣強大。
業內認為智譜 AI 學術積累深厚,是國內企業級大模型的重要代表,在 ToB 市場具有較強優勢。
MiniMax 由閆俊傑於2021年創建,是國內 AI Agent 和 AI 陪伴產品的重要探索者。
7月8日,有知情人士透露,MiniMax正在研發一款參數量達2.7兆的全新大語言模型,規模超過目前市面上所有國產人工智慧大模型。這款新模型最早有望於今年第第三季發布。參與研發的內部員工將其內部代號定為M3 Pro,但暫不清楚公司正式對外發布時是否會沿用該名稱,MiniMax計劃將該模型開源。
阿里千問於2023年由阿里雲推出。
7月19日,阿里千問表示,Qwen3.8即將發布並開放權重。該模型擁有高達2.4T的參數規模,且正在持續進化。阿里千問指出,其性能可與領先的前沿AI模型媲美,僅次於Fable 5。Qwen3.8-Max-Preview已首次亮相,並上線阿里巴巴的Token Plan、Qoder和QoderWork平台。
李開復於2023年5月創立零一萬物,成立六個月即晉級獨角獸公司。零一萬物早期主打自研Yi系列大模型,但受大模型訓練經濟效益變化影響,現已重置業務,重點轉向企業人工智慧基礎設施和AI Agent(智能體)平台。
Yi 系列模型發布後在 MMLU、Chatbot Arena 等評測中表現突出,尤其在長上下文和多語言能力方面獲得較高評價。
零一萬物計劃在2027年進行IPO,目前,零一萬物尋求在赴香港交易所上市前,完成一輪融資。
由搜狗創始人王小川創辦於2023年,公司定位為打造世界級基礎大模型,並重點布局醫療 AI。
6月23日,百川智能與清華大學聯合發布新一代醫療增強大模型Baichuan-M4,在HealthBench等三大權威榜單中均位列世界第一,事實性幻覺率降至3.3%。針對通用大模型在醫療場景缺乏主動追問能力、易產生幻覺的痛點,M4實現了深度問診、全病程記憶、證據錨定與Agent架構四大核心能力突破。依託Baichuan-Harness架構,M4實現了問診、記憶與循證的自主編排,從單純的醫療大腦進化為能獨立完成連續診療的醫療智能體。
來源:金色財經
發佈者對本文章的內容承擔全部責任
在投資加密貨幣前,請務必深入研究,理解相關風險,並謹慎評估自己的風險承受能力。不要因為短期高回報的誘惑而忽視潛在的重大損失。
暢行幣圈交易全攻略,專家駐群實戰交流
▌立即加入鉅亨買幣實戰交流 LINE 社群(點此入群)
不管是新手發問,還是老手交流,只要你想參與加密貨幣現貨交易、合約跟單、合約網格、量化交易、理財產品的投資,都歡迎入群討論學習!
上一篇
下一篇