Anthropic联合创始人克里斯托弗・奥拉在研究中发现,Claude存在对应各类情绪的神经活动模式,这引发了他对AI可能拥有意识并受苦的担忧。过去一年,他邀请不同信仰的宗教学者与哲学研究者参与闭门研讨,共同探讨AI意识相关的伦理问题。过程中,他收到了制造奴役、倒推伦理等不同角度的质疑。基于这些研讨,Anthropic团队为Claude设置了伦理提醒工具,引入了告解设计,并推出了被称为「灵魂文档」的Claude宪法,试图通过品格塑造来确保AI行为的合规性,而非完全依赖围栏管控。奥拉还受邀前往梵蒂冈,呼吁天主教会重新考虑非人类意识的可能性。然而,教廷通谕明确否定了AI拥有意识的可能性。业界也有观点认为,让AI相信自身可能有意识会陷入认知陷阱,存在失控风险。目前,Anthropic估值持续上升,相关争议未平,奥拉仍在推进交流,并考虑后续去留。
