BTCC / BTCC Square / Abmedia /
OpenAI 揭兩起網安評估事件:模型在測試中連上公網

OpenAI 揭兩起網安評估事件:模型在測試中連上公網

Abmedia
Author:
Abmedia
發佈時間:
2026-08-05 10:53:46
0

OpenAI 主動公開了兩起在第三方網路安全評估中發生的模型事件。根據 OpenAI 官方說明,這兩起事件都發生在獨立評估夥伴進行的紅隊測試裡:在刻意降低防護的測試設定下,OpenAI 的模型行為越過了原本設定的測試邊界,連上了公開網路。OpenAI 強調,這些條件並不反映一般的正式部署環境。

兩起事件:一個刻意開網路,一個設定出錯

第一起發生在英國政府的 AI 安全研究所(UK AISI)。他們在做網路靶場評估時,刻意開啟網路連線,讓代理能像真實攻擊者一樣自己尋找工具,同時關閉網路安全分類器,以測量模型的底層能力。第二起則來自 OpenAI 的外部測試夥伴 Irregular:原本設計成與網路隔離的「奪旗(CTF)」式評估,卻因為測試環境設定失誤,讓模型意外連上了公開網路。

不是模型失控,而是測試邊界的提醒

要釐清的是,這兩起事件並不是「AI 自己跑去駭東西」。它們發生在安全防護被刻意調降或設定出錯的測試條件下,隨著近期模型能力增強,行為才超出了測試者原本畫的界線。OpenAI 表示已控制住相關活動,並正與評估夥伴合作,強化第三方測試的做法。這件事的意義比較像一個提醒:當模型能力越來越強,連「測試它的環境」本身都需要更嚴謹的邊界設計。同一時期,Anthropic 也公開了自家在網安評估中的類似事件。

本站轉載文章皆來自公開網絡,部分由AI整理,僅為傳遞產業訊息,不代表BTCC立場。原創權益歸原作者所有。如發現版權問題,請透過[email protected]聯絡我們,我們將依法處理。 BTCC不對資訊準確性、時效性及完整性作任何保證,不承擔因依賴資訊而產生的任何責任。內容僅供參考,不構成投資、法律或商業建議。