Anthropic 呼吁放缓 AI 能力提升,OpenAI、马斯克附和
2 小时前

人工智能公司Anthropic的CEO达里奥・阿莫迪近日发表长文,呼吁AI行业主动减缓AI能力提升的速度,以便安全工作能够及时跟上。他提出了一个“三步走”的战略框架,包括嵌入式第三方评估员、国家内部行业协调以及全球协调,并宣布Anthropic已启动第一步。这一判断基于今年夏天递归自我改进(RSI)的加速,以及7月OAI-HF事件所揭示的AI系统可能失控的风险。达里奥警告,若不加以干预,类似的失控事件可能在6至12个月内造成数千亿美元的损失。随后,OpenAI的CEO山姆・奥尔特曼和埃隆・马斯克均对此表示支持。达里奥认为,当前AI能力已越过关键阈值,减缓发展速度是为了在能力推进和安全验证之间设立检查点,并非暂停训练。争取到的时间将用于确保训练部署的质量、推进对齐研究的训练手段、提升模型可解释性以及优化测试评估。在“三步走”战略中,第一步是让第三方评估员常驻AI公司,他们将拥有近似内部人员的权限,并有权公开潜在风险,OpenAI也将采取类似措施。第二步是前沿公司之间的协调,这需要反垄断豁免以讨论安全标准,并倾向于基于模型能力设立检查点。第三步是全球协调,包括四级协议,旨在促进信息共享。尽管达里奥的观点获得了一些初步支持,但AI行业仍面临着估值、竞争等多重压力,“放慢”承诺可能会让位于发展目标。此外,该战略框架在商业机密保护、协调机制建立等方面也存在落地困难。也有质疑声音认为,达里奥此举可能是出于商业策略考虑或试图制造恐慌,仅凭声明难以建立减速共识并确保安全举措的有效落地。