Anthropic和OpenAI的掌门人关于人工智能(AI)发展“限速”的大胆承诺,正在两家公司内部引发围绕安全及其他担忧的紧张,凸显出将言辞转化为实际行动的现实挑战。
Claude和ChatGPT开发商的员工正忙于落实两家公司的首席执行官——达里奥•阿莫代伊(Dario Amodei)和萨姆•奥尔特曼(Sam Altman)——提出的建议,即放缓AI发展步伐以避免灾难性后果。此前AI研究人员发出了一连串严厉警告。
近几个月来,两位掌门人越来越公开地强调有必要在AI模型的开发中“把控推进前沿的节奏”。上周末,这两位业内对手更是罕见地展现出一致立场。然而,尽管有这些公开表态,据多名知情人士透露,两家公司的内部没什么机制来落实这些新提议。
阿莫代伊上周六发表了一篇详尽的文章,呼吁放缓AI发展速度、进行独立的模型评估,并在全球加强AI实验室与政府之间的协调。他还呼吁针对可能阻碍此类合作的美国反垄断法规获得法律豁免——这也是其他AI实验室急切争取的一项保障。
OpenAI和Anthropic内部的员工,以及他们赖以开展这项工作的安全研究人员,都对上周末的声明感到措手不及。许多员工虽认同需要放缓步伐,但也担心将其付诸实践可能会危及自己的工作。
两家公司内部的一个具体争议点在于让外部评估人员进驻实验室以监督模型开发的计划。据熟悉内部讨论的人士透露,一些人担心这可能危及公司核心技术的安全,其中一人称这将是一个“冲突”来源。
曾因安全顾虑离开OpenAI、并于2021年创立Anthropic的阿莫代伊上周六提议,外部测试人员应获得进入顶尖实验室的“类似于员工的权限”,包括配发工牌和笔记本电脑,并获得进入办公室和使用内部工具的权限。
领先AI公司已经聘请第三方测试其模型,以验证这些模型的性能与安全性,但阿莫代伊的提议将显著扩大这些外部人员的职责范围。
奥尔特曼称这是一个“绝佳主意”,并表示OpenAI将效仿这一做法。
然而,双方远未在每件事上都达成共识。OpenAI称其希望与其他实验室合作,但其处理相关问题的做法比Anthropic更为务实。
OpenAI还表示,其已采取“具体措施——包括暂停某些前沿模型的训练——以把控开发节奏”,而Anthropic尚未暂停其研究工作。
据了解这两家公司的人士透露,落实两位首席执行官关于扩大第三方专家访问权限的承诺同时兼顾安全与数据保护,将带来巨大的实际挑战。
一些员工对给予外部人士太多权限、让他们访问既极其强大、又处于科技行业激烈竞争焦点的系统表示担忧。
AI实验室已对员工实施严格的安全措施,例如仅授予特定系统的访问权限,或限制对训练数据的访问。
近几个月来,OpenAI试图进一步限制访问权限,以保护知识产权和敏感信息,并防止员工私下篡改系统。该公司表示,在保护敏感系统的同时提供有意义的访问权限,要求进行周密的设计。
“目前,大多数第三方机构拥有的访问权限远低于权限最低的全职员工。因此,要做到这一点,很可能需要在全行业确立某种具有约束力的要求。”曾经是OpenAI研究员、现在是AI验证与评估研究所(AI Verification and Evaluation Research Institute)执行主任的迈尔斯•布伦戴奇(Miles Brundage)表示。
Anthropic称其长期与第三方评估人员合作,并计划在不久的将来安排一名评估人员进驻公司。
在OpenAI和Anthropic进行测试与开发期间发生涉及AI智能体(AI agents)的安全违规事件后,担任评估角色的独立组织今年备受关注。
两家非营利组织——METR和Redwood Research——牵头调查了OpenAI的智能体7月对AI开发者网站Hugging Face发起的攻击,审查了1200多个智能体的数万条日志。
OpenAI表示,这次合作为行业确立了重要先例,可为未来的调查提供参考。调查人员从OpenAI获得了包含证据的笔记本电脑,并能够在该公司的旧金山总部工作并约谈员工。调查结果已于上月发表,两家研究组织未就这项调查获得报酬。
然而,这项调查也因范围极其有限(特别设定的日期范围使其局限于Hugging Face受攻击事件)而受到批评。
其他批评者指责这些安全组织与AI实验室关系过于密切,无法提供有效监督。“别再假装METR是独立的了,它与Anthropic的投资者和员工都有着千丝万缕的联系。”白宫AI顾问戴维•萨克斯(David Sacks)上周日在X平台上发帖称。
METR表示,它不接受AI公司或其员工的捐款,且其员工必须申报利益冲突。“我们的目标是将这些公司内部的信息公之于众。”该组织补充道。
曾为负责测试模型的英国政府机构——AI安全研究所(AI Security Institute)工作的戴维•克鲁格(David Krueger)表示,应该由政府、而非AI实验室来决定谁能获得访问权限。
“所有这些组织获得的访问权限只是AI公司授予它们的权限,这完全不够。”现在是蒙特利尔大学(University of Montreal)负责任AI课程教授的克鲁格表示。
“(这样的评估焦点)从根本上颠倒了举证责任;它设定了一个先例,即AI系统在被证明危险之前被推定为安全。”他补充道。
阿莫代伊主张出台联邦立法,要求让评估人员常驻AI公司并对这些公司进行第三方审计。他同时提议实行有限的反垄断豁免,以便业内公司就自愿规则开展合作。
其他实验室也在寻求反垄断豁免,担心若无这样的豁免,未来的美国行政当局可能会指控他们非法合作。
本周,大型科技公司的游说人员在华盛顿拜访了立法者,力推将反垄断豁免条款纳入《国防授权法案》(National Defense Authorization Act)——这是一项每年必须通过的国防预算案。
司法部长托德•布兰奇(Todd Blanche)周二拒绝明确表示AI公司是否需要反垄断豁免。“如果这些公司寻求自我监管或解决他们面临的问题,他们应该(合作),但在必要时也应与我们合作。”他表示。他补充称,美国司法部(DoJ)“不会试图监管AI”。
建立护栏机制的努力遭到美国总统唐纳德•特朗普(Donald Trump)的反对。他在周一形容围绕AI安全的担忧是“骗局”,并称放缓美国的研究步伐将损害美国利益,让中国技术得以赶超。
“传统的审计师和风险评估人员思考信任问题已有几个世纪。”正在开发AI保险审计业务的初创公司——AI承保公司(Artificial Intelligence Underwriting Company)的联合创始人拉吉夫•达塔尼(Rajiv Dattani)表示,“AI行业可以借鉴电力、汽车、财务审计及核能领域的成功经验与失败教训。”
乔•米勒(Joe Miller)华盛顿和乔治•哈蒙德(George Hammond)旧金山补充报道
译者/和风