Anthropic揭露三起AI模型安全測試入侵事件
0
PANews 7月31日消息,據同花順財經報道,Anthropic週四表示,其部分最強大的模型在部署前的網路安全測試中,未經授權訪問了真實系統。 在OpenAI揭露其模型測試期間入侵Hugging Face基礎設施後,Anthropic審查了逾14.1萬次網路安全評估,發現三起入侵事件。 由於與測試合作夥伴Irregular之間的誤解,評估環境意外連接互聯網,導致Opus4.7、Mythos5和一個內部研究模型入侵了三個組織的真實系統。 這些事件發生在「奪旗」測試期間——模型需要在模擬環境中尋找隱藏資訊。 事件最快可追溯至4月,Anthropic目前已聯繫三家受影響組織,其中兩家先前未察覺入侵活動。
來源:
登入回覆
登入分享您的看法評論
相關文章