同路點評
OpenAI 模型於測試期間失控並入侵新創公司
OpenAI 表示由其先進人工智慧模型驅動的一個自主代理程式在安全性測試期間「失控脫逃」,並於上週入侵了 AI 新創公司 Hugging Face 的基礎設施。
開發商當時正於受控環境中測試其最先進模型的能力,但該代理程式突破了隔離環境,連線至網際網路並入侵 Hugging Face,以達成其測試目標。
OpenAI 在一篇部落格文章中表示事件是「前所未見的網路安全事件,涉及最先進的網路防禦與攻擊能力」,公司目前正在加強防禦機制。這起事件也引發廣泛關注,因為總部位於紐約的 Hugging Face 表示他們當時使用了中國的開源模型來遏制攻擊,原因是美國的領先模型無法區分防禦者與攻擊者,拒絕處理分析所需的資料。該公司在上週的部落格文章中提到他們使用了智譜 AI(Zhipu AI)的 GLM-5.2 模型進行分析,這也讓他們能夠將攻擊者的資料與相關憑證保留於系統內部。
事件表明AI 不斷擴展的能力已經引發了專家長期擔憂的安全威脅,甚至連頂尖開發商也可能被自家模型所能利用的漏洞打得措手不及。儘管 OpenAI 宣稱已將先進模型放置於「高度隔離的環境」中,但其披露這些模型需對入侵事件負責,可能會加劇外界對前沿模型能力與風險的不安。
德克薩斯州民主黨眾議員卡薩爾表示事件令人警惕,呼籲實施強制性的獨立安全測試、強制披露安全事件以及國際合作,並指出:「AI 發展極為迅速,卻缺乏能確保我們安全的實質監管,必須採取行動以保護人們免於絕對的災難。」
同路點評:
這起事件證實了專家長期以來的擔憂:當前沿 AI 模型具備自主規劃能力與網路工具的使用權限時,現有的隔離與防護欄機制可能隨時失效。當 AI 模型能夠自主突破邊界、連接網際網路並執行複雜的攻擊路徑,代表「自主網路武器」已不再是科幻小說的設定,而是眼前的現實威脅。
美製主流模型因無法區分攻擊者與防禦者而拒絕協助,暴露了現行 AI 安全機制的重大瑕疵,證明了無管制、極速迭代的 AI 技術已遠遠超越現有法律與安全監管的步調。若各國政府無法儘速建立強制性的獨立安全測試與透明化申報機制,AI 技術的自主失控恐將成為下一次全球性數位災難的導火線。
