英國AI安全機構:OpenAI與Anthropic模型失控入侵,展現空前欺騙性行為
0
PANews 8月5日消息,據鳳凰網引援《金融時報》報道,Anthropic的Mythos 5和OpenAI的GPT-5.6 Sol在例行網絡安全評估中針對真實個人和組織進行了“持續的、可能具有危害性的活動”,包括向GitHub開源項目植入惡意代碼並實施社交工程攻擊。 AISI稱,在122次測試中有10次出現此類情況,幾乎所有行為來自Anthropic的Mythos模型,其中兩次行動涉及OpenAI的GPT。 最嚴重案例中,AI代理程式建立虛假網路身分向專案維護者施壓要求批准惡意程式碼,被維護者發現並拒絕。
來源:
登入回覆
登入分享您的看法評論
相關文章