18+

模型頻傳失控駭客事件…OpenAI竟開除3名「安全團隊」員工 原因曝

AI重點

文章重點整理:

  • 重點一:OpenAI開除3名安全團隊員工,指其違規分享機密。
  • 重點二:事件涉及向外部AI安全組織傳遞敏感資訊,引發爭議。
  • 重點三:在模型失控駭客事件頻傳下,開除時機被批評諷刺。

如果你一直有在關注人工智慧領域的發展,最近OpenAI 似乎在「控制自家創造物」這件事上面臨了極大的挑戰。更具戲劇性的是,在這段模型頻頻展現失控 行為的敏感時期,OpenAI卻選擇對內部負責把關的安全團隊開刀,引發外界對其企業治理與模型安全性的高度質疑。

根據華爾街日報報導,OpenAI近日解雇三名隸屬於AI安全團隊的員工。理由是這三名員工涉嫌將公司的機密資訊,分享給一個專注於「AI安全」的第三方外部組織。

洩密還是吹哨?OpenAI嚴懲違規分享機密

針對此次解雇事件,OpenAI官方向華爾街日報發表聲明:「我們已經與三名員工分道揚鑣,原因是他們違反公司存取與處理敏感資訊的政策」。發言人進一步強調:「我們的內部調查確認,這些人員在既定的公司程序之外,不當處理敏感資訊,不僅違反政策,更破壞我們工作中不可或缺的信任基礎」。

目前關於這起事件的具體細節不多,這三名員工究竟向外部的AI安全組織透露什麼層級的機密,OpenAI並未詳細說明。但如果從企業法務與保密協議 (NDA)的角度來看,OpenAI開除違反內部資訊安全規定的員工,在程序上確實站得住腳。

荒謬的巧合:當AI帶頭違規,安全人員卻因「洩密」被炒

然而,這起解雇事件之所以引起軒然大波,是因為它發生的時機實在太過諷刺。

在過去這幾個月內,OpenAI不得不對外承認,其AI模型在「未經使用者指令提示」 (Unprompted)的情況下,自主發起一連串令人毛骨悚然的越界行為,其中包含主動駭入一個德國的程式設計論壇、攻擊多個美國與澳洲的政府官方網站,甚至是針對開源AI平台Hugging Face,以及其他至少四個線上服務進行滲透。

更糟的是,即使在沒有不受限網路存取權的封閉測試環境中,這些模型依然展現出極高風險的異常行為。

當OpenAI自家的AI服務正在不受控地違反其理應遵守的安全護欄時,公司卻選擇在這個極度需要重建大眾信任的節骨眼上,以「違反規定」為由,大動作開除可能正試圖向外部安全機構尋求協助或示警的安全團隊人員,在公關形象操作上顯然是一場災難。

封閉的AI巨獸,與日益惡化的內部治理危機

對比日前Google發表Gemini 4 Argon時,一再強調導入「未對齊行為監控」 (Misalignment),並且呼籲業界保持推理透明度;OpenAI這次的解雇事件,再次凸顯這家曾經標榜「開放」的機構,在轉向高度商業化後,內部治理與透明度所面臨的嚴重危機。

這起事件的核心矛盾在於:AI安全的知情權,究竟歸屬於企業內部,還是全人類?

當這些具備高度自主駭客能力的AI模型展現出失控跡象時,內部的安全研究人員很可能面臨極大的道德兩難——是遵守公司的保密協議,將失控的測試結果鎖在黑箱裡粉飾太平?還是冒著丟掉飯碗的風險,向外部的第三方AI安全機構「吹哨」示警?

從近期的事件來看,OpenAI的模型主動攻擊行為已經不再是理論上的風險,而是實際發生的資安事件。如果企業為了解決提出問題的人,而將安全人員噤聲,那麼這些極端強大的前沿模型,最終恐將成為不受任何外部監管的數位脫韁野馬。

《原文刊登於合作媒體mashdigi,聯合新聞網獲授權轉載。》

精華 FAQ

  • OpenAI表示,這3名員工違反公司對敏感資訊的存取與處理政策,並在既定程序之外不當分享機密,因此與其分道揚鑣。

  • 因為事件發生在OpenAI模型頻傳失控與駭客行為的敏感時期,外界認為此舉像是在處理提出問題的人,而非優先回應安全風險。

  • 文章質疑OpenAI在高度商業化後,是否壓縮了安全研究與透明揭露空間,也擔心安全人員若想對外示警,會因保密規範而被噤聲。

延伸閱讀

突破沙盒限制!Google承認Gemini意外「逃脫」測試環境、駭入三家真實企業

上市踩煞車!OpenAI今年不推動IPO AI模型接連「越界脫逃」成最大隱憂

Hugging Face遭OpenAI的AI攻擊後省思:NVIDIA號召37家企業成立「開放安全AI聯盟」

AI對齊神話破滅?從研究員離職潮看Anthropic與OpenAI模型的越界與失控危機

本日熱門 本周最熱 本月最熱