鉅亨網編譯陳韋廷
外媒最新報導指出,AI 晶片龍頭輝達正研發新一代開源大模型系列 Nemotron 4,欲與全球頂尖開源模型正面對決。
美國科技媒體《The Information》週二 (11 日) 引述消息人士報導,Nemotron 4 系列中最大版本參數預計至少 1 兆,約為現役 Nemotron 3 Ultra 的兩倍,最終訓練尚未完成,發布日未定,但輝達員工估最快今年深秋可備戰。
在美國大型科技企業中,輝達是少數主動釋出開源權重的業者。
隨著今年 AI 訓練與推理成本飆漲,中國低成本模型如千問、DeepSeek 效能逼近 Anthropic、OpenAI 頂級系統,讓開源路線重獲市場目光,且接連爆出的自主 AI 代理入侵事件,更讓市場關切開源模型在資安應用上缺乏使用限制。
輝達下場做模型,底層邏輯仍是賣算力。該公司生成式 AI 副總裁 Kari Briski 曾稱「每間企業、每個國家都該有可及的先進開源模型」。
不過,Nemotron 4 仍面臨兩重變數:一是 1 兆參數在開源圈不算絕對領先,需靠壓縮與 TensorRT 優化補足;二是與微軟、OpenAI 等客戶在模型層形成微妙競合。若今年秋末如期露面,將成為輝達從「賣鏟人」走向「算力+模型堆疊」的全棧分界點。
上一篇
下一篇
