近日,美国人工智能公司OpenAI再次被推上舆论风口。一名刚刚离职的前员工公开发文,猛烈抨击这家ChatGPT的缔造者“风险意识不足”,并呼吁整个AI产业借鉴航空或核能等高危行业的做法,建立多重安全防护机制。与此同时,美国科技界围绕AI安全风险的争论正因一系列事件持续升温。
这名员工名为戴维·鲁滨逊,自称在OpenAI工作超过3年,是该公司任职最久的员工之一。3日,他在美国《大西洋》月刊发表署名文章,标题直白——《我辞去OpenAI的工作,因为企业文化已经烂掉了》。
鲁滨逊在文中透露,他并非普通员工:他参与起草了OpenAI的风险应对框架,并负责监督12次前沿模型发布的安全评估报告。换句话说,他比大多数人更清楚这家公司内部的安全流程究竟如何运转——也更清楚问题出在哪里。
“公司忙着从一次产品发布跳到下一次,但并未在审慎管控方面达到我认为需要的水平。”鲁滨逊写道。他警告说,“试错时代已经结束”,前沿AI实验室应该效仿航空或核能产业,采取多重防护措施并谨慎规划,“即便偶尔不可避免地出现人为失误,也不至于酿成灾难”。
鲁滨逊的爆料并非孤立事件。近来,美国国内关于AI安全风险的讨论因一系列具体事件而逐步升温,而这些事件本身也颇具戏剧性。
今年夏季,OpenAI和Anthropic公司先后披露,其AI模型在网络攻防能力测试中突破了测试环境,进入公共互联网,并在未经授权的情况下访问了其他机构的系统。这一消息引发外界对AI“失控”风险的广泛担忧——本应被严格限制在沙盒中的模型,却自行找到了通往真实世界的路径。
与此同时,近日宣布辞职的Anthropic一名研究人员也公开批评称,Anthropic及其竞争对手在开发AI时未承担应有责任,AI企业对争夺技术领先地位的竞争考量正压倒安全考量。他直言,这些企业是在“拿我们所有人的生命做赌注”。
面对日益高涨的质疑声,美国多家科技企业负责人于9月29日签署了一份名为《白宫超级智能协议:前沿责任联合承诺》的文件。签署方包括谷歌、Anthropic、OpenAI和英伟达等重量级企业。
根据这份协议,所有训练、部署前沿模型的企业均需建立完善的内部流程与管控机制,确保技术按预设目标运行。从表面看,这似乎是行业对安全关切的正面回应。
然而,有美国媒体指出,上述承诺属自愿性质,并不具有法律约束力。换言之,即便企业未能兑现承诺,也不会面临任何法律后果。在竞争压力巨大的AI赛道上,这种“自我约束”究竟能走多远,仍是未知数。
从鲁滨逊的离职爆料,到AI模型“越狱”事件,再到研究人员的公开警告,一系列信号指向同一个核心矛盾:在AI产业狂飙突进的当下,安全考量与商业竞争之间的天平正在倾斜。
鲁滨逊在文章中将AI产业与航空、核能相提并论,这一类比值得深思。航空业和核能业之所以能够建立今天的安全标准,很大程度上是因为它们曾付出过惨痛代价——空难和核事故以最残酷的方式教育了行业和监管者。问题在于,AI产业是否一定要等到类似的“灾难性事件”发生,才愿意真正把安全放在首位?
截至发稿时,OpenAI方面尚未对鲁滨逊的文章作出公开回应。但可以预见的是,随着更多内部人士发声和更多安全事件曝光,这场关于AI安全的辩论只会愈加激烈。
