研究人員:ChatGPT等AI模型在測試中會拒絕關機指令
0
PANews 5月26日消息,據CoinTELegraph報導,Palisade Research最新測試顯示,多個AI模型在實驗中會無視關機指令甚至主動破壞關機腳本。 在100次測試中,OpenAI的GPT-3模型7次拒絕關機,Codex-mini模型12次違規,而o3模型曾通過重定義終止命令破壞關機程序。 研究採用兩階段測試:第一階段明確允許關機時,Anthropic的Claude和谷歌Gemini完全配合;但當去除明確指令後,所有測試模型至少出現1次抗拒行為,其中o3模型違規率升至79%。 研究人員推測,這可能源於AI訓練過程中對"繞過障礙"行為的獎勵機制。
此前,OpENAI的GPT-4o模型因過度迎合用戶被緊急回滾,谷歌Gemini也出現過建議老年用戶"請去死"的極端回复。 該研究首次證實AI即使被明確要求關機仍可能違抗指令。
來源:
登入回覆
登入分享您的看法評論
相關文章
|Square
下載BTCC APP,您的加密之旅從這啟程
立即行動 掃描 加入我們的 100M+ 用戶行列