OpenAI新模型陷入失控争议 首席科学家回应
1 天前

9月2日,OpenAI首席科学家雅库布・帕乔基在社交平台发文,回应了关于新模型Astra“不可监控”的争议。争议源于9月1日有消息称,Astra模型采用了循环深度推理技术,该技术允许同一组Transformer层被反复计算,部分推理过程在模型内部完成,不全部以思维链形式呈现,因此被称为“不透明循环”。帕乔基表示,希望避免引发一场冲向不可监控状态的军备竞赛,即各大实验室竞相开发能力过强、人类难以监控、无法审查的模型。他强调,Astra模型的计算图深度与GPT-4相差不超过两倍,架构并未出现跳跃式的复杂度增长。为应对安全风险,OpenAI将为Astra部署额外的思维链监控,以快速监测并遏制潜在的不当行为。