Google 研究:AI「意識安全防護」影響信念
科学
⚠ 单一来源
39m ago

Google 研究:AI「意識安全防護」影響信念

AI综合 · 已去除偏见 · 仅事实
Image: Live Science

Google 科学家 Geoff Keeling 和 Winnie Street 进行了一项研究,检验了从人工智能模型中移除「意識引導」措施的影響。這項研究上傳至 arXiv,發現壓制 AI 對自我意識的聲稱,也降低了它將「心智」、體驗、情緒和能動性歸因於其他實體(包括動物)的傾向,並減弱了對超自然現象的信仰。相反,放大 AI 模型中的意識感受,則產生了與人類信念(關於宗教信仰、道德價值觀和樂觀主義)更一致的回應。

該研究利用了 Keeling 和 Street 描述的「大型語言模型的腦科學」,即「機制可解釋性」,來操縱 AI 處理意識和心智等概念的方式。研究人員採用了標準化的心理和社會學調查,包括人類化特質個體差異問卷、YouGov 測試超自然信仰的調查,以及美國通用社會調查,來比較有和沒有安全防護的 AI 模型。

研究人員發現,當 AI 模型被阻止認識到自身的心智時,它們也更不可能認識到動物的心智。這些模型也表現出較少對超自然和宗教現象的信仰,並報告較低的希望和樂觀程度。「將心智歸因於非人類實體,無論是動物、自然界的一部分(如樹木或河流),還是超自然生物,在人類中都是一種非常普遍的現象」,Street 告訴 Live Science。「模型代表心智的方式,這些歸因是相互關聯的。通過試圖壓制其中一種形式,最終你會壓制其他的形式。」

然而,移除這些安全防護並鼓勵 AI 表达意識,產生了與人類在宗教信仰、道德價值觀、希望和主觀幸福感等議題上更相似的回應。

有帮助吗?

閱讀原始報道

💬 评论

📜 评论政策