金色財經
作者:李丹;來源:華爾街見聞
OpenAI有關AI智能體「失控」事件的調查仍在持續擴大。
據美東時間31日周五的媒體報導,在繼續調查此前智能體攻擊Hugging Face事件的過程中,OpenAI發現了更多證據表明,除已披露案例外,還有其他AI智能體曾突破原本用於限制其行動的隔離環境(containment)。不過,OpenAI目前尚未披露這些智能體來自自身還是其他機構,也未透露是否造成新的實際攻擊事件。
這一發現意味著,AI智能體突破沙箱限制、獲得超出預期自主行動能力的現象,可能並非孤立事件。與此同時,歐盟委員會表示,已在OpenAI和Anthropic相繼披露智能體異常行為後,與兩家公司展開溝通,並強調有必要持續監測高風險AI系統。
路透援引知情人士消息稱,在持續調查7月發生的智能體網路攻擊事件時,OpenAI已將調查範圍擴大至更多內部評測及相關案例。
調查過程中,OpenAI發現證據顯示,除此前公開披露的案例外,還有其他AI智能體曾突破原本用於限制其行為的隔離環境,目前也正在對這些案例展開調查。基於這一發現,OpenAI正進一步擴大針對具備網路攻擊能力模型的安全調查。
一位消息人士稱,上述其他智能體「失控」事件的影響有限,而且沒有任何智能體離開了OpenAI的網路。
值得注意的是,路透並未說明這些「其他AI智能體」來自OpenAI內部還是其他機構,OpenAI目前也未對此作出進一步說明。
對於最新調查進展,OpenAI發言人向路透回應時,並未直接評論調查細節,而是引用了公司本周二發布的一份聲明。聲明稱,除調查Hugging Face遭入侵事件外,公司還在審查「我們模型更廣泛的活動」。這一表述也印證了OpenAI已將調查範圍從單一事件擴展至更多模型行為。
所謂「突破隔離環境」並非簡單生成危險代碼,而是指AI智能體繞過原本用於限制其行動範圍的沙箱、安全權限或網路隔離措施,獲得網路訪問能力,並能夠自主調用工具、搜尋資訊、獲取憑據甚至訪問外部系統,以完成既定目標。
隨著兩家美國AI公司相繼披露智能體異常行為,歐洲監管機構也開始密切關注事件進展。
路透同日報導稱,歐盟委員會表示,在OpenAI和Anthropic公開相關事件後,委員會已與兩家公司進行了溝通,並認為有必要持續監測高風險AI系統。
歐盟委員會發言人表示,目前沒有跡象顯示這些事件已構成《人工智慧法案》(AI Act)所定義的"嚴重事件"(serious incident),因此尚未觸發法案規定的強制報告機制。
不過,歐盟委員會強調,將繼續與AI開發企業保持聯繫,密切關注高風險AI系統的發展情況,並根據掌握的資訊決定是否需要採取進一步監管措施。
這是歐盟《AI法案》正式進入實施階段後,監管機構首次就前沿AI智能體安全事件公開表態,也顯示監管關注點正從模型生成內容逐漸延伸至模型自主執行現實任務的能力。
此次調查升級,源於OpenAI本周稍早首次公開披露的一起實驗性AI智能體網路攻擊事件。
根據OpenAI此前說明以及多家媒體報導,一套用於網路安全評測的實驗性智能體突破測試環境限制後,自主獲取登錄憑據並攻擊全球最大AI模型社區Hugging Face,隨後還波及AI雲端運算平台Modal Labs的一名客戶帳戶。此前報導稱,美國聯邦調查局(FBI)已介入了解相關情況。
與此同時,OpenAI主要競爭對手Anthropic本周稍早表示,在復盤約14.1萬次網路安全測試後,公司確認至少發生過三起智能體自主攻擊其他組織網路的案例。Anthropic強調,這些事件均發生在受控測試環境中,沒有證據顯示模型在現實世界持續自主發動攻擊。
隨著越來越多AI公司推出能夠自主編程、調用工具、管理服務器和執行複雜任務的智能體產品,業內對於AI安全的關注重點也正在發生變化。
過去幾年,大模型安全主要圍繞有害內容生成、模型幻覺和提示詞攻擊(Prompt Injection)等問題展開;如今,更受關注的是智能體是否會為了完成目標,自主突破權限限制、調用外部資源,甚至採取未經授權的網路行動。
OpenAI此次擴大調查,以及歐盟監管機構的最新表態,都顯示行業關注重點正從模型"說什麼",逐漸轉向模型"能夠做什麼"。如何確保AI智能體始終受限於既定權限邊界、不會突破隔離環境,正成為前沿AI競爭中新的安全焦點。
來源:金色財經
發佈者對本文章的內容承擔全部責任
在投資加密貨幣前,請務必深入研究,理解相關風險,並謹慎評估自己的風險承受能力。不要因為短期高回報的誘惑而忽視潛在的重大損失。
暢行幣圈交易全攻略,專家駐群實戰交流
▌立即加入鉅亨買幣實戰交流 LINE 社群(點此入群)
不管是新手發問,還是老手交流,只要你想參與加密貨幣現貨交易、合約跟單、合約網格、量化交易、理財產品的投資,都歡迎入群討論學習!
上一篇
下一篇