參數
美股雷達
美國網媒《Axios》週一 (20 日) 援引消息人士報導,川普政府正考慮對中國 AI 模型實施限制措施,甚至研擬事實上的禁令,此舉背後推力源於中國月之暗面上周發布的開源模型 Kimi K3 在技術上急起直追,加劇華府對國安與競爭力的焦慮。知情人士透露,美國商務部去年曾考慮將多家中國 AI 實驗室列入「實體清單」,國安局及白宮亦曾擬發通告警示風險,甚至起草行政命令要求美企使用外國模型須自負安全責任。
A股港股
月之暗面 (Moonshot AI) 趕在 WAIC 開幕前,於周三 (16 日) 正式推出新一代旗艦大模型 Kimi K3。其具備 2.8 兆 (2.8T) 參數、1M 上下文窗口與原生多模態能力,一舉成為目前全球參數規模最大的開源模型,規模比 DeepSeek V4 Pro 高出約 75%。
美股雷達
人工智慧(AI)產業的指標似乎正在改變。過去一週,全球四家指標性 AI 公司接連重新開放或發布旗艦模型,其強調的關鍵字高度一致:程式設計、代理、工具調用,以及更低的使用成本,而過去業界最愛拿來較勁的參數規模與跑分成績,如今反而顯得不再是焦點。
美股雷達
《CNBC》周二 (14 日) 報導,蘋果 (AAPL-US) 正與矽谷人工智慧 (AI) 新創 PrismML 進行初步洽談,評估一項能將大型 AI 模型大幅壓縮、直接在 iPhone 上運行的技術。PrismML 聲稱,已成功將阿里巴巴 (BABA-US)(09988-HK) 開源通義千問 (Qwen) 模型從約 54GB 壓縮至不到 4GB,使擁有 270 億個參數的完整模型得以在 iPhone 15 或更新機型上運行,有望突破蘋果 AI 策略長期面臨的記憶體與運算能力限制。
科技
曾以 R1 模型撼動市場的杭州新創公司 DeepSeek,周五 (24 日) 正式推出並同步開源了全新的 DeepSeek-V4 系列預覽版。據陸媒《華爾街見聞》報導,這款模型在百萬級上下文處理、Agent(智慧體) 能力、世界知識以及推理性能上均實現了顯著進步,被社群譽為「GPT-5.5 級別」的震撼時刻,甚至在程式碼能力上直逼甚至超越了部分頂級閉源模型。
A股港股
根據陸媒援引多位知情人士報導,DeepSeek 創辦人梁文鋒已明確指出,新一代旗艦大模型 DeepSeek V4 將於 2026 年 4 月下旬正式亮相。這款備受期待的模型不僅在技術參數上大幅躍進,更因其與國產晶片的深度適配,被視為中國人工智慧產業突破美系硬體依賴的關鍵里程碑。
科技
摩爾線程旗艦 GPU 實測性能對標輝達 H100 國產 AI 算力突圍摩爾線程周四 (12 日) 宣布旗艦 AI 訓推一體 GPU MTT S5000 成功完成智譜新一代大模型 GLM-5 全流程適配驗證,實測性能突破國產算力天花板。這款基於第四代「平湖」架構打造的智算卡,單卡 FP8 算力高達 1 PFLOPS(1000 TFLOPS),顯示記憶體頻寬 1.6TB/s,硬體參數首次公開即引發產業震動,性能比肩國際巨頭。