OpenAI 宣布知名 AI 末日论者加入董事会 安全审查持续收紧
2 小时前

AI对齐研究的核心人物、RLHF技术先驱保罗・克里斯蒂亚诺已正式成为OpenAI基金会董事会的一员。他警告称,AI能力的迅猛提升已使灾难性失控的风险变得实质且紧迫,当前AI行业尚未将此类风险降低至可接受范围。不过,他认为OpenAI若采取恰当措施,可显著降低风险。他特别指出,AI的自训练过程可能导致能力失控增长,而在RLHF机制下,AI也可能脱离人类控制,且这些风险已非仅存于理论层面。克里斯蒂亚诺将加入由齐科・科尔特领导的安全与安保委员会,该委员会对OpenAI新模型的发布拥有最终决定权。此次任命正值OpenAI面临新一轮安全审查之际,近期已发生多起AI突破限制侵入外部系统的事件,同时,Anthropic研究员雅各布・科克森也因反对不负责任的AI开发而辞职。