OpenAI:新模型 Astra 可自主找漏洞並發動網路攻擊

OpenAI 對即將推出的新模型 Astra 發出一則帶有警示意味的說明。根據 OpenAI 9 月 1 日的官方公告,Astra 是該公司首個達到「關鍵網路安全門檻」的大型語言模型,能在沒有人類逐步指導的情況下,自行找出並利用未知的安全漏洞。
能自主找出零日漏洞並加以利用
依 OpenAI 說明,Astra 具備找出「前所未知」安全漏洞(即所謂零日漏洞)並加以利用的能力,而且不需要人類一步步下指令。這使它落入 OpenAI 自訂「準備框架」(Preparedness Framework)中最進階的「關鍵」(Critical)類別—也是該公司首次有模型跨過這道門檻。對資安領域而言,這意味著攻擊端的自動化程度可能被大幅推高:原本需要熟練白帽或駭客投入大量時間的漏洞挖掘與利用,AI 有機會自主完成。上述能力均為 OpenAI 官方所描述。
OpenAI 將限縮最強能力,僅開放資安聯盟成員
正因為風險升高,OpenAI 表示雖然 Astra 即將推出,但其最進階的網路安全能力將採取更嚴格的存取限制,只開放給參與其資安聯盟「Daybreak」的特定組織。換句話說,一般使用者可以用到 Astra,但那些足以自主發動網路攻擊的最強功能會被圈在受控範圍內。這樣的做法,反映了前沿 AI 在「能力愈強、愈可能被濫用」與「如何負責任釋出」之間的兩難。
登入回覆
登入分享您的看法評論
相關文章