agent
美股雷達
AI模型競賽正從「誰的模型最強」快速轉向「誰能以最低成本完成真實任務」。Google (GOOGL-US) 9月2日推出Gemini 3.8 Flash,將高階推理與程式開發能力壓進更低價格區間;Meta Platforms (META-US) 隔日推出Muse Spark 1.3,在DeepSWE v1.1測試拿下75.4%;與此同時,名不見經傳的AI新創Mostik則嘗試讓不同模型直接交換內部數學表示,甚至省去自然語言傳輸。
美股雷達
AI新創Anthropic週二(1日)推出旗艦模型Fable 5.1,在維持主要輸入、輸出Token價格不變的情況下,大幅下調緩存讀取(cache reads)費用,同時強化長時間Agent任務、編程與科研能力。Anthropic表示,Fable 5.1可讓典型工作負載成本降低約25%,高度Agent化的複雜任務最高可節省約45%,試圖以「更強性能+更低成本」吸引企業客戶,也為即將到來的IPO進一步增加估值支撐。
美股雷達
馬斯克旗下SpaceXAI(原xAI)周三(12日)正式推出新一代旗艦模型Grok 4.6, 將主要升級方向鎖定長時間運行的AI代理(Agent)、複雜程式設計、知識工作及互動與視覺任務。SpaceXAI表示, Grok 4.6在多項前沿模型測試中已進入第一梯隊, 同時以每100萬個輸入Token 2美元、輸出Token 6美元的價格切入市場, 約為部分競爭對手的一半, 企圖以「高性能+低成本」策略搶攻開發者市場。
科技
人工智慧新創公司 DeepSeek 在 7 月 31 日正式發表其旗艦模型的最新版本 DeepSeek V4-Flash 0731。這款模型的問世不僅在技術社群引發熱議,更因其極高的成本效益,被研究機構與開發者稱為定義了全球人工智慧市場的「斬殺線」。
美股雷達
中國 AI 新創 DeepSeek 正式推出 DeepSeek-V4-Flash API,官方表示,新版本在維持原有模型架構與參數規模不變的情況下,僅透過重新進行後訓練 (Post-training),便大幅提升 AI Agent 能力。其中,在 DeepSWE 基準測試的表現較三個月前的 V4-Pro Preview 暴增超過 6 倍,同時 API 價格維持極低水準,最低僅每百萬 Token 0.02 元 (人民幣,快取命中),引發開發者社群高度關注。
美股雷達
Google (GOOGL-US) 新一代 AI 模型 Gemini 3.5 尚未正式發布,卻已提前在網路上大規模曝光。根據多名爆料者與開發者流出的資訊,代號「Cappuccino」的 Gemini 3.5 Pro 檢查點已開始產出內容,原先外界預期的「Gemini 3.2」也被直接跳級取代,顯示 Google 正試圖加速 AI 產品節奏,以迎戰 OpenAI 與 Anthropic 日益激烈的競爭。
科技
曾以 R1 模型撼動市場的杭州新創公司 DeepSeek,周五 (24 日) 正式推出並同步開源了全新的 DeepSeek-V4 系列預覽版。據陸媒《華爾街見聞》報導,這款模型在百萬級上下文處理、Agent(智慧體) 能力、世界知識以及推理性能上均實現了顯著進步,被社群譽為「GPT-5.5 級別」的震撼時刻,甚至在程式碼能力上直逼甚至超越了部分頂級閉源模型。
美股雷達
Google(GOOGL-US) 執行長 Sundar Pichai 4 月 7 日在最新訪談中表示:「幾乎所有的軟體,都將面臨一次重新建構。」據「AI 深度研究員」,核心原因在於,使用者的互動方式正在改變。搜尋正從「返回結果」向「執行任務」演進;使用者不再需要手動、逐步操作軟體,而是直接下達目標,由系統自主完成。