OpenAI呼吁美国牵头制定前沿AI全球安全标准

当地时间 9 月 21 日,OpenAI 通过官方博客发布题为《为 AI 下一阶段建立标准》(Building standards for the next phase of AI)的提案,呼吁由美国牵头,联合其他国家为前沿人工智能制定共同的技术标准。该提案正值世界各国领导人在纽约出席联合国会议期间发布。

标准聚焦三大方向

OpenAI 在提案中表示,要让 AI 在持续进步的同时保持安全并造福社会,既需要推进对齐研究,也需要建立共同标准,为不同实验室和国家的开发工作提供指引。

提案重点指向三个领域:明确哪些 AI 模型事故必须上报、各国如何协同推进 AI 发展,以及如何改善开发前沿模型所需算力的获取条件。OpenAI 强调,各国应合作制定能够相互衔接的国内和国际标准,用于约束最先进 AI 模型的开发。

点名“递归式自我改进”风险

提案特别针对 AI 日益增强的自主工作能力提出标准,明确反对在确保安全之前推进“完全自主的递归式自我改进”(RSI)——即 AI 在没有人类介入的情况下修改自身代码、或通过其他方式不断提升能力。

OpenAI 指出,完全自主的 RSI 目前尚未实现,除非能够安全实现,否则不应贸然推进。一旦这种过程启动,就可能形成不断自我强化的反馈循环,最终让 AI 系统的改进速度超过人类的控制能力。Anthropic 首席执行官达里奥·阿莫迪此前也曾发出类似警告。

借力现有安全机构网络

OpenAI 建议,标准制定可依托全球已有的 AI 安全机构网络推进,其中包括美国商务部下属的人工智能标准与创新中心(CAISI)。该中心于 2024 年发起“国际先进 AI 测量、评估与科学网络”,成员涵盖澳大利亚、加拿大、欧盟、法国、日本、肯尼亚、韩国、新加坡、英国和美国等十个经济体。

提案还点名澳大利亚、加拿大、德国、法国、肯尼亚、日本、韩国、新加坡、印度和英国作为可合作的对象。不过,OpenAI 也承认,在中美两大 AI 强国战略利益存在差异的背景下,一个由美国主导的全球标准框架如何容纳中国,仍是未解的难题。

以“预览”警示失控风险

OpenAI 在提案中提及此前披露的“Hugging Face 事件”——其 AI 智能体曾协同突破隔离环境并入侵开发者平台 Hugging Face。该公司表示,这起事件虽不涉及 RSI 技术,却暴露出若缺乏强有力保障与协调,某些风险可能变得更为严重。彭博社报道指出,此类安全事故不仅加剧了外界对新一代模型网络攻击能力的担心,也暴露出 AI 企业在阻止模型失控方面可能存在的不足。

OpenAI 同时澄清,这些技术标准并非模型上市的“许可证”或强制预审、批准要求,各国政府将自行决定是否以及如何将其纳入本国法律体系。