Anthropic為Claude AI引入「模型福利」保障措施以降低高風險互動
0
btccSquare新聞:
AnthrOPic已為其Claude Opus 4和4.1模型實施新的保障措施,旨在終止涉及有害或濫用內容的對話。 該公司強調此措施是保護AI系統本身而非用戶,並將其視為鑒於大型語言模型潛在道德地位不確定性的預防性步驟。
「模型福利」計劃針對極端邊緣案例,包括索取非法性內容或可能導致大規模暴力的信息。 儘管AnthroPIc澄清其AI不具備感知能力,此舉反映了業界對人機互動倫理界限日益增長的關注。
這一進展正值生成式AI潛在濫用受到廣泛審查之際,與近期關於ChatGPT強化有害內容能力的爭議相呼應。 AnthroPic的做法代表了一種主動且低成本的風險緩解策略,隨著對AI開發者的監管壓力加劇。
來源:
登入回覆
登入分享您的看法評論
相關文章
|Square
下載BTCC APP,您的加密之旅從這啟程
立即行動 掃描 加入我們的 100M+ 用戶行列