‌
‌
‌
‌
‌
快訊

OpenAI、Anthropic產品負責人互相陰陽:你家模型也就剛追上我家

BlockBeats 律動財經

動察 Beating AI 快訊,Claude Code 負責人 Boris Cherny 發文稱,GPT-6 Astra 的提示詞注入防護已經和 Gemini Flash、Claude Opus 4.8「差不多」,還順手誇了自家 Claude 模型大約兩個月前已「在實踐中解決」這個問題。提示詞注入就是把惡意指令藏進網頁、文檔等內容,誘導 Agent 洩露數據或執行危險操作。


Boris 還稱,公開評估並點名其他實驗室,是推動它們訓練出更安全模型的好辦法,「我們會繼續這樣做,直到其他實驗室更加重視安全」。

‌


貼文很快被 X 加上 Community Note 反駁。Gray Swan 的獨立評測顯示,沒有任何受測模型完全免疫提示詞注入,Claude 同樣存在攻擊成功案例。另一名安全研究員還用特製網頁攻擊 Claude Code Opus 5 Auto Mode,在小規模測試中取得 60%–80% 的成功率。


‌

OpenAI 核心產品負責人 Thibault Sottiaux 隨後直接照著 Boris 的句式反寫了一遍。他稱自己也很高興看到 Claude Code 新出的後台電腦操作終於追上 Codex,「而且是我們今年 5 月的版本」。


Boris 後來承認,原帖「比自己想要的更陰陽」,強調自己確實是在認真肯定 Astra 的進步。他同時澄清,所謂提示詞注入已經「解決」,指的是 Claude 模型、注入檢測機制和 Auto Mode 組合起來後的產品效果,不是模型本身已經免疫。

原文連結

發佈者對本文章的內容承擔全部責任
在投資加密貨幣前,請務必深入研究,理解相關風險,並謹慎評估自己的風險承受能力。不要因為短期高回報的誘惑而忽視潛在的重大損失。

暢行幣圈交易全攻略,專家駐群實戰交流

▌立即加入鉅亨買幣實戰交流 LINE 社群(點此入群)
不管是新手發問,還是老手交流,只要你想參與加密貨幣現貨交易、合約跟單、合約網格、量化交易、理財產品的投資,都歡迎入群討論學習!

▶ 前往鉅亨買幣找交易所優惠

‌
section icon

鉅亨講座

看更多
  • 講座
  • 公告
    ‌
    Empty
    Empty
    ‌