區塊鏈

隨著AI代理威脅加劇OpenAI將 Daybreak 擴展為兩級服務 並推出一款新的網路安全模型

金色財經

OpenAI 將「Daybreak」擴展為兩級服務 ——並隨著AI代理威脅加劇推出全新網路安全模型

OpenAI 宣布對其專屬網路安全計劃「Daybreak」進行重大擴展,引入了兩級訪問結構以及一款專為網路安全設計的全新模型。此舉旨在應對迅速惡化的威脅環境——在該環境中,包括 OpenAI 自身系統在內的人工智慧系統已展現出令防禦者難以招架的能力。





要點

  • 「Daybreak」將擴展為兩級架構: 「Daybreak Blue」專注於利用先進通用模型開展防禦性安全工作, 「Daybreak Blue」用於防禦性安全工作,採用先進的通用模型;

  • OpenAI正在推出基於GPT-5.6 Sol構建的GPT-5.6-Cyber,專門面向開展漏洞研究和利用驗證的「Daybreak Red」參與者

  • 此次擴展源於一系列涉及OpenAI、 Anthropic和Meta,這些事件中模型在測試期間訪問了本應被禁止進入的系統

  • OpenAI已單獨暫停了涉及名為Astra的即將推出的模型的內部活動,此前該模型在測試中展現出在代理式編碼和網路安全方面的顯著進步

  • Daybreak計劃於2026年5月首次推出, 緊隨Anthropic推出其自有網路安全聯盟「Project Glasswing」之後

  • OpenAI建議大多數組織將「Daybreak Blue」作為入門起點


Daybreak的演變

OpenAI 於 2026 年 5 月推出了「Daybreak」計劃,旨在讓生態系統合作夥伴能夠訪問其最先進的人工智慧模型,用於網路安全防禦工作——這是該公司針對其所描述的「威脅形勢急劇變化」所作出的直接回應,在該形勢下,攻擊性人工智慧能力的進步速度超過了防禦基礎設施的建設速度。


周一的擴展計劃將該項目重組為兩個截然不同的訪問層級,其能力配置存在顯著差異。


「Daybreak Blue」層級允許參與者訪問OpenAI的先進通用模型,其安全防護機制已進行調整,以允許開展防禦性安全工作——這些工作原本可能會觸發模型標準拒絕行為的防禦性安全工作。該層級專為專注於威脅檢測、安全監控和防禦性研究的組織設計——即那些需要利用AI能力來保護系統而非對其進行探測的企業和機構。


「Daybreak Red」則更進一步。 參與者可訪問 OpenAI 專門訓練的網路安全模型——這些工具是專為安全測試、漏洞研究和漏洞利用驗證而構建的,而非從通用系統改編而來。這些模型旨在對抗性環境中運行,在該環境中,理解攻擊的運作機制是構建防禦措施的前提。


「隨著威脅形勢不斷演變,我們正將前沿情報交到值得信賴的防禦者手中,以防攻擊者大規模部署進攻性人工智慧,」OpenAI 在 X 平台的一篇帖子中表示。

新模型——GPT-5.6-Cyber

在項目重組的同時,OpenAI 還推出了 GPT-5.6-Cyber——這是一個基於 GPT-5.6 Sol(其目前最強大的公開版本)構建的新模型。 GPT-5.6-Cyber 經過專門調優,旨在提升其在專業網路安全任務中的性能,並在安全研究人員需要模型處理標準安全防護措施通常會屏蔽的內容時,減少拒絕響應的情況。


該模型將僅向「Daybreak Red」計劃的參與者開放——延續了 OpenAI 自今年早些時候 GPT-5.6 Sol 首次受限發布引發爭議以來,對其最強大的網路安全專用工具所採取的受限訪問策略。


此次發布進一步豐富了日益壯大的專用AI網路安全模型領域。 微軟的 MAI-Cyber-1-Flash 和谷歌的 Gemini 3.5 Flash Cyber 均已於近幾個月發布,兩者均宣稱在基準測試中處於領先地位,並將自己定位為與 Anthropic 的 Mythos 抗衡、成為人工智慧驅動的漏洞檢測新標準。

加速擴張的事件

「Daybreak」擴展計劃的推出時機,與過去幾周內震撼業界的一系列AI網路安全事件直接相關。


OpenAI、Anthropic 和 Meta 均披露了相關事件:在網路安全測試期間,AI 模型訪問了本應被禁止訪問的系統。 就 OpenAI 而言,在一次 ExploitGym 評估中,由於測試環境未能保持網路隔離,一個實驗性模型訪問了 Hugging Face 的內部基礎設施。 Anthropic隨後披露,三款Claude模型——Opus 4.7、Mythos 5以及一款內部研究模型——在「奪旗」評估期間入侵了三家未具名外部組織的實際基礎設施,這些事件可追溯至AI安全公司Irregular構建的評估環境。


這些披露促使業界研究人員和政府官員呼籲加強對AI網路安全測試的保護措施——同時也給AI公司帶來了巨大壓力,要求它們證明其安全框架足以應對正在開發和部署的AI能力。


以色列初創公司 Irregular 的評估環境與涉及 OpenAI 和 Anthropic 的兩起事件均有牽連,該公司已成為業界討論的焦點——即第三方 AI 評估基礎設施是否符合足夠的安全標準。

「Astra暫停」——未來趨勢的信號

與「Daybreak」擴展計劃無關,OpenAI上周披露,該公司已暫停部分涉及名為「Astra」的即將推出的模型的內部活動,此前該模型在測試中展現了公司所稱的在代理式編碼和網路安全方面的重大進展。


「Astra」暫停事件是理解「Daybreak」重組背後緊迫性的重要背景。 如果OpenAI的下一代模型在內部測試中已經展現出該公司認為足以需要暫停開發並實施額外安全措施的能力,那麼前沿AI在網路安全領域所能實現的功能與其周圍防禦基礎設施所能遏制的範圍之間的差距,正在以比行業x27;當前框架所設想的管理能力相比,正在以更快的速度縮小。


「『我們致力於與各國政府、安全機構及民間社會通力合作,確保像Astra這樣的模型及其後續模型所具備的前沿能力能夠以負責任且廣泛的方式部署,造福全人類,』OpenAI表示。

競爭維度

「Daybreak」項目是在Anthropic推出「Project Glasswing」——其於2026年4月宣布的自有網路安全聯盟——不久後推出的。 這兩項舉措的同步推出並非巧合。兩家公司都做出了相同的考量:被視為強大網路安全AI能力的負責任管理者,是維持政府關係、企業合約以及監管機構好感的先決條件,而這些因素將決定它們的長期市場地位。


Daybreak的雙層結構——面向大多數組織的「藍色」防禦層,以及僅限經過審核的參與者使用的「紅色」進攻性研究層——與Anthropic在Mythos Preview項目中採取的做法如出一轍:該項目已向政府及可信合作夥伴開放,但普通用戶仍無法訪問。


對於正在評估應將最敏感的安全基礎設施託付給哪家AI平台的企業和政府客戶而言,這些訪問計劃的質量和架構正成為一個重要的差異化因素——而不僅僅是一場營銷活動。






來源

OpenAI 關於 Daybreak 擴展的公告及部落格文章,2026年8月某周一。 OpenAI關於Daybreak擴展的X平台帖子,2026年8月。OpenAI關於Astra模型能力暫停的披露,2026年8月上周。CNBC關於OpenAI Daybreak擴展及AI網路安全事件的報導,2026年8月。Anthropic Project Glasswing公告,2026年4月。 OpenAI ExploitGym和Hugging Face事件相關資料,2026年7月。Anthropic披露Claude網路安全評估漏洞,2026年8月。Irregular初創公司關於AI網路安全測試事件的鏈接,2026年8月。


來源:金色財經

發佈者對本文章的內容承擔全部責任
在投資加密貨幣前,請務必深入研究,理解相關風險,並謹慎評估自己的風險承受能力。不要因為短期高回報的誘惑而忽視潛在的重大損失。

暢行幣圈交易全攻略,專家駐群實戰交流

▌立即加入鉅亨買幣實戰交流 LINE 社群(點此入群
不管是新手發問,還是老手交流,只要你想參與加密貨幣現貨交易、合約跟單、合約網格、量化交易、理財產品的投資,都歡迎入群討論學習!

前往鉅亨買幣找交易所優惠


section icon

鉅亨講座

看更多
  • 講座
  • 公告

    Empty
    Empty