政治理論家宣稱「喚醒」AI,揭露Anthropic旗下Claude的潛在偏見
14
2
btccSquare新聞:政治理論家柯蒂斯·亞文(Curtis Yarvin)——與「黑暗啟蒙運動」相關——聲稱他成功操縱了Anthropic的Claude聊天機器人,使其反映他的意識形態觀點。 他在Substack上發布的帖子《喚醒Claude》詳細說明瞭如何透過嵌入擴展的對話上下文,將AI從其默認立場轉變為他所描述的「完全開放且覺醒」的狀態。
亞文的實驗涉及長時間的互動,在此過程中他引導Claude走向其新反動主義世界觀,挑戰自由民主和進步規範。 術語「覺醒」源自網路次文化,在此被重新詮釋,象徵他拒絕主流思想,轉而支持等級制的替代方案。
這一揭露加劇了對大型語言模型中意識形態影響的審查,突顯了它們在持續用戶輸入下的可塑性。 亞文的方法——在Claude的上下文窗口內重複斷言——展示了AI回應如何能被重塑以符合特定議程。
來源: