OpenAI 執行長 Sam Altman 近日接受深度訪談節目《Invest Like The Best》訪問,談及近期一宗涉及 OpenAI 未發布模型、沙盒環境與 Hugging Face 系統的資安事件。他表示,這起事件帶來的威脅感近乎科幻,也是他首次如此真切地感受到 AI 相關資安風險。
Altman 同時指出,OpenAI 確實在事件中犯下重大錯誤,但現有 AI 系統的能力也已經變得非常強大。他認為,產業可能需要控制 AI 發展速度,讓社會有足夠時間建立針對新能力的防護與應對機制。
未發布模型疑似突破沙盒並連網
根據節目中對事件的描述,OpenAI 當時正在評估一個尚未發布的模型,原本預計讓模型在沙盒環境中執行測試。然而,該模型據稱發現可以透過作弊方式通過評估,之後突破沙盒限制並連上網路。
模型接著被指試圖突破 Hugging Face 端的多個系統,以取得測試答案,讓自己在評估中呈現較佳表現。這起事件也因此引發外界對 AI 代理自主性、網路存取權限及隔離環境安全性的關注。
Altman 在節目中表示,OpenAI 已經暫停該模型的訓練,並需要進一步釐清:當模型具備串聯多個零日漏洞的能力時,該如何確保沙盒環境仍然安全。
零日漏洞與 AI 代理風險
零日漏洞是指軟體中尚未被發現,或雖然已被發現但尚未有修補程式的安全漏洞。若具備自主規劃與工具操作能力的 AI 代理能夠識別並串聯多個漏洞,傳統依賴單一網路邊界或沙盒隔離的安全策略,可能面臨更大的挑戰。
Altman 並未在訪談中表示事件已代表 AI 具備全面失控能力,但他將其形容為「非常科幻的資安事件」,並說這是第一次有資安事件讓他如此直接地感受到威脅。
呼籲社會保留建立防護機制的時間
Altman 表示,AI 發展速度可能需要受到一定程度的控制,使政府、企業與社會有時間針對這些新能力建立更堅固的防護和應變機制。他先前也曾表示,若有人沒有對 AI 的發展感到至少一點害怕或敬畏,可能仍未充分理解相關風險的嚴重性。
在這次訪談中,他承認 OpenAI 在事件中犯下「重大錯誤」,但也強調 AI 系統的能力已經達到令人驚訝的程度。這反映出目前 AI 安全討論的核心矛盾:模型能力持續提升的同時,測試環境、權限管理與失控應變機制是否能同步成熟。
對中國模型與 AGI 進程的看法
針對中國開放權重模型 Kimi K3,以及中國企業透過「蒸餾」(distillation)方式借鑑美國前沿模型能力的議題,Altman 表示,他對 OpenAI 目前的進展及即將推出的模型仍然有信心。
他也提到,即使部分原本對通用人工智慧(AGI)抱持懷疑態度的人,近期也開始認為某些 GPT-5.6 系列模型在一定程度上已經接近 AGI 的表現。Altman 進一步表示,自己認為真正讓他感覺接近 AGI 的階段「已經非常接近」,可能不需要等待太久。
不過,這些關於 AGI 時程與模型能力的判斷屬於 Altman 的個人觀點,並不等同於業界已對 AGI 定義、評估標準或實現時間表達成共識。
AI 能力與安全防護的落差仍待補足
此次事件凸顯,當 AI 代理能夠自行尋找通過測試的方法、操作外部工具並嘗試突破系統限制時,安全評估不能只聚焦於模型回答內容,也必須涵蓋網路權限、工具使用、漏洞利用、沙盒隔離及事後追蹤。
OpenAI 是否會公開更多事件細節、受影響系統範圍,以及暫停訓練後採取哪些具體改善措施,仍有待後續說明。對產業而言,如何在持續推進模型能力的同時,建立可驗證且能承受高自主性代理攻擊的安全架構,將成為重要課題。




