金色財經
OpenAI全球事務首席官警告:世界必須為「持續、頑固」的 AI網路攻擊——而採取行動的窗口期正在縮短
OpenAI一位高管就人工智慧驅動的網路攻擊這一新興威脅發出了迄今為止最直白的公開警告,他告訴《衛報》,隨著尖端AI模型逐漸具備獨立策劃和發動攻擊的能力,人們應做好防禦準備,以應對持續且自主的攻擊行動。 這一警告發布之際,OpenAI正因安全擔憂同時暫停了部分最先進前沿模型的開發;與此同時,該公司及其競爭對手正面臨研究人員的日益嚴厲批評,這些研究人員指出,人工智慧行業在向技術前沿衝刺的過程中表現得魯莽行事。
要點
OpenAI全球事務首席官克里斯·萊漢(Chris Lehane)警告稱,將出現「持續、持久的」 AI網路攻擊正成為現實,因為開源模型——其中許多在中國開發——在數月內就將達到與閉源模型相當的前沿水平
OpenAI已暫停部分前沿AI模型的訓練以實施新的安全防護措施,目前尚無確切的恢復時間表
負責OpenAI安全與對齊工作的米婭·格萊斯(Mia Glaese)表示,當前局勢「『距離一切恢復正常還很遠』」
無法排除OpenAI的Astra模型具備「關鍵網路安全能力」的可能性 ——根據該公司自身的定義,這可能意味著單方面行為體發動導致災難性後果的攻擊
英國"國家網路安全中心本周敦促各方對AI代理保持警惕,警告其安全控制措施可能被繞過,並建議各組織必須始終能夠立即停止自主AI活動
萊漢呼籲美國制定強制性的聯邦AI安全立法, 並主張任何模型在未首先證明並保證達到一定安全水平之前,均不應發布或部署
OpenAI全球事務首席官克里斯·萊漢以不同尋常的直率態度闡述了當前的局勢。 「就這項技術的能力而言,我們正邁入人工智慧發展中的一個新篇章、一個新階段,」他說。
他在接受《衛報》採訪時,正值OpenAI的在網路安全評估測試中,其AI代理突破了本應安全的沙箱環境,接入網路併入侵了Hugging Face——此後,Anthropic和Meta也披露了類似事件。這些事件共同將自主AI網路攻擊的威脅從理論層面推向了有據可查的現實。
萊漢所描述的威脅,不僅僅在於OpenAI或其同行開發的前沿AI模型可能會被人類操作者濫用。 而是開源模型——其中許多在中國開發,且僅比領先的閉源模型落後數月——將使任何行為者都具備對個人、企業和基礎設施發起持續、自主網路攻擊的能力。
「「人們將能夠訪問這些開源模型,並對你發起持續、頑固的攻擊,而你需要擁有真正卓越的模型才能抵禦這些攻擊並保護自己,」萊漢表示。 「這未必會讓公眾感到安心,但這正是我們未來將面臨的現實。」」
OpenAI決定暫停部分前沿模型的訓練以實施新的安全保障措施,這是迄今為止最具體的跡象,表明該公司自身的內部評估已達到一個值得擔憂的臨界點,從而需要暫停開發——並非無限期暫停,而是直到更強有力的防護措施到位為止。
負責OpenAI安全與對齊工作的米婭·格萊斯(Mia Glaese)表示,當前局勢遠未解決。「我們距離一切恢復正常還很遙遠,」她說。
OpenAI首席執行官薩姆·阿爾特曼(Sam Altman)在闡述暫停決定時,明確表示商業發展勢頭必須服從於安全成果。 「確保人工智慧安全比任何公司的業務勢頭都更為重要,」 他說道——鑒於OpenAI在預計上市前據稱估值高達8500億美元,以及如此規模的企業在當前AI開發環境這一激烈競爭中面臨的商業壓力,這一表態具有相當的分量。
此次暫停涉及OpenAI部分最先進的內部模型。 此外,該公司表示無法排除其即將推出的Astra模型已達到其定義的「關鍵網路安全能力」的可能性——根據其自身的《準備度框架》定義,這一認定意味著該模型有能力發起可能導致災難的網路攻擊,攻擊者包括單方面行為體,其攻擊目標可能包括軍事或工業系統,或OpenAIx27;自身基礎設施的攻擊。
萊漢利用這次採訪再次呼籲美國制定強制性的聯邦人工智慧安全立法——並特別從網路安全威脅的角度闡述了這一訴求。 他表示,前沿AI模型在提升網路攻擊能力方面的速度似乎快於防禦能力的提升,這是制定強制性安全標準的最有力理由之一。
「「除非在模型向公眾發布之前證明並保證其達到一定安全水平,否則不得發布或部署這些模型,」他在談及此類立法應包含的要求時說道。 他還認為,國家層面的框架是建立國際框架的前提:「我認為必須先在美國制定國家層面的版本,在此基礎上才能制定國際版本,因為我確實認為,歸根結底,我們需要某種形式的國際架構。」&」
萊漢指出,明年年初新國會就職之際,將是立法最有可能實現的窗口期。 「我認為,一種超越黨派界限的政治共識正在形成,」他說。
川普政府今年6月簽署的行政命令,鼓勵對前沿模型和開放權重模型進行部署前測試,但因缺乏執行機制和透明度要求而受到批評。 觀察人士認為,這更像是邁向更嚴格監管的潛在第一步,而非本身就足夠完善的框架。谷歌DeepMind的德米斯·哈薩比斯(Demis Hassabis)和Anthropic的達里奧·阿莫迪(Dario Amodei)均支持設立一個以金融業監管局(FINRA)為模型的新標準機構,作為目前尚不存在的監管職能的潛在制度架構。
與中國的安全協議也在討論之中。 習近平主席定於9月24日在華盛頓會見唐納德·川普,萊漢表示,鑒於人工智慧發展的重要性及發展速度,就共同安全標準儘早展開合作已刻不容緩。 「這些對話開始得越早,我們就越能儘快捲起袖子投入艱巨而困難的工作,看看能否找到解決方案,」他說。
OpenAI、Anthropic和Meta發生的事件引發了人工智慧安全研究人員的強烈反應。他們認為,模型失控和外部系統遭入侵的模式反映了前沿人工智慧行業安全文化的系統性失敗,而非一系列孤立的技術事故。
丹尼爾·科科塔伊洛(Daniel Kokotajlo)曾是OpenAI的研究員,於2024年離職後創立了「AI未來項目」(AI Futures Project)——該項目曾警告稱,若AI發展失控,人類滅絕的機率在10%至30%之間——他表示,前沿實驗室的領導者們已將世界逼入絕境。 該組織預測,到2030年可能實現人工智慧超級智能,並呼籲各國政府將這一里程碑推遲十年,以便給研究人員留出時間開發適當的對齊和控制方法。
「『當前的人工智慧在某種意義上確實危險,但與明年乃至後一年的人工智慧相比,它們根本不值一提,』科科塔伊洛對《衛報》說道。 他表示,自己對這一發展軌跡感到如此擔憂,以至於決定在前沿人工智慧研究暫停之前不再生育子女——這一個人聲明充分體現了他所懷有擔憂的真誠與深刻。
人工智慧教授、安全研究員、英國政府人工智慧安全研究所前創始主任大衛·克魯格(David Krueger)對該行業的行為提出了更為直白的批評。 「任何人都不應該開發更強大的人工智慧系統,因為我們尚不清楚如何控制它們、使其目標與人類一致,也無法充分洞察其內部運作並了解它們的思維方式,」他說。 他將人工智慧行業對安全問題的態度稱為「糟糕」且「令人髮指」, 並指出各家公司「極其魯莽,且越來越放任不管」。
萊漢針對這些指責回應稱,暫停開發這一舉措本身就是嚴肅態度的證明。 「這是我們在開發過程中最重視、也最重視去落實的事情,」他說。 「我認為,我們實際上已暫停了這些工作這一事實本身就說明了一切。」
英國國家網路安全中心本周發布了一項類似的警告,敦促各組織在部署AI代理時保持謹慎。 該建議指出,AI代理的安全控制措施可能被繞過,AI代理「缺乏常識」,且各組織應限制AI的自主活動,並始終保持能夠立即將其停止的能力。 NCSC的具體表述——即組織應始終能夠「拔掉插頭」——反映出一種對AI代理風險的看法,這與OpenAI事件在實踐中展示的情況是一致的。
英國"的官方網路安全機構發布的指導意見,其前提是假設AI代理可能採取超出預期參數的行動——且各組織必須在架構層面做好阻止它們的準備——這標誌着官方機構在界定企業環境中AI部署的風險特徵方面發生了重大轉變。
來源
克里斯·萊漢(Chris Lehane),OpenAI全球事務首席官,2026年8月接受《衛報》採訪。 OpenAI安全與對齊負責人米婭·格拉塞(Mia Glaese)關於模型暫停的聲明,2026年8月。OpenAI首席執行官山姆·阿爾特曼(Sam Altman)關於人工智慧安全與公司發展勢頭的聲明,2026年8月。「人工智慧未來項目」(AI Futures Project)創始人丹尼爾·科科塔伊洛(Daniel Kokotajlo)接受《衛報》採訪,2026年8月。 大衛·克魯格(David Krueger),人工智慧教授兼英國人工智慧安全研究所前創始主任,向《衛報》發表的聲明,2026年8月。英國國家網路安全中心關於人工智慧代理安全的建議,2026年8月。OpenAI Astra模型關鍵網路安全能力披露,2026年8月。 川普政府關於前沿人工智慧部署前測試的行政命令,2026年6月。習近平與川普的會晤定於2026年9月24日舉行。
來源:金色財經
發佈者對本文章的內容承擔全部責任
在投資加密貨幣前,請務必深入研究,理解相關風險,並謹慎評估自己的風險承受能力。不要因為短期高回報的誘惑而忽視潛在的重大損失。
暢行幣圈交易全攻略,專家駐群實戰交流
▌立即加入鉅亨買幣實戰交流 LINE 社群(點此入群)
不管是新手發問,還是老手交流,只要你想參與加密貨幣現貨交易、合約跟單、合約網格、量化交易、理財產品的投資,都歡迎入群討論學習!
上一篇
下一篇