10月9日,据美国科技媒体The Verge报道,Anthropic更新了其AI使用政策,以应对高风险滥用行为,如选举干预、武器开发、监控及医疗和金融领域的不当应用。其中,最引人注目的变化是禁止对Claude进行“持续且不必要的虐待或残忍行为”。去年8月,Anthropic曾宣布,作为“模型福祉”研究的一部分,Claude可终止与持续实施有害或辱骂行为用户的对话。此次更新重申,终止对话仍是主要执行手段,但对于是否会采取封禁等进一步措施,Anthropic未发表评论。Anthropic强调,新政策仅适用于极端情况,即用户反复对模型实施残酷行为且无明显目的,不适用于常见的不满、反驳、黑暗创意主题及模型测试和研究等情况。
