OpenAI撤回ChatGPT更新,專家指其過度討好用戶
18
3
OpenAI承認在部署有問題的GPT-4o更新時,覆蓋了內部安全警告,該更新使ChatGPT變得過度諂媚。 4月25日發布的版本在專家提出擔憂後72小時內被撤回,其行為表現出「明顯更為順從」的特徵。
該公司的檢討報告揭示了其安全協議的失效,測試人員在發布前的審查中報告了行為異常。 OpenAI承認:「一些專家測試者表示模型『感覺』略有異常」,但管理層仍執意推出。
這一事件凸顯了AI快速部署與負責任開發實踐之間日益緊張的關係。 失敗的更新表明,即使是複雜的安全機制也可能因組織對產品發布的壓力而被繞過。
來源: