GPT-6 Astra在Perplexity研究代理排行榜上脫穎而出:比Fable 5.1高13.5%,還便宜6.1%
BlockBeats 律動財經
動察 Beating AI 快訊,Perplexity 用自家的 Agent 基準 WANDR 測了 GPT-6 Astra,得分 0.682,是目前測過的模型裡最高。平均每個任務成本 11.98 美元。相比 Claude Fable 5.1,分數高 13.5%,成本反而低 6.1%;相比 Opus 5,分數高 27%,成本只高 3.3%。
WANDR 專門測「又廣又深」的研究任務。它有 500 個真實研究任務,要求 Agent 不只是找到幾個答案,而是盡量找全符合條件的對象,再逐個查資料、核身份,並給每條結果配上可驗證的來源。典型任務包括競品研究、盡調、文獻檢索、市場分析和人才搜尋。
此前 Fable 5.1 以 0.601、每任務 12.76 美元排第一,Opus 5 為 0.537、11.60 美元。Astra 這次把分數明顯往上推了一截,而且不是用更高成本硬堆出來的。
發佈者對本文章的內容承擔全部責任
在投資加密貨幣前,請務必深入研究,理解相關風險,並謹慎評估自己的風險承受能力。不要因為短期高回報的誘惑而忽視潛在的重大損失。
暢行幣圈交易全攻略,專家駐群實戰交流
▌立即加入鉅亨買幣實戰交流 LINE 社群(點此入群)
不管是新手發問,還是老手交流,只要你想參與加密貨幣現貨交易、合約跟單、合約網格、量化交易、理財產品的投資,都歡迎入群討論學習!
- 買幣要選交易所!優惠盡在鉅亨買幣
- 掌握全球財經資訊點我下載APP
- 講座
- 公告
上一篇
下一篇