美国政府正在与人工智能企业进行高级别谈判,致力于制定针对前沿AI模型发布的自愿安全标准,相关公告可能于下周公布 [1, 2, 3, 4, 5]

这些标准将明确评估前沿AI模型的基准、发布时间表,以及国内外谁能访问这些模型等内容 [1, 3, 4, 5]。目标在于规范新模型的发布流程,降低网络安全风险和避免技术被不当利用,尤其防范来自中国、俄罗斯等国家的军事或情报威胁 [1, 4, 5]

美国商务部曾因国家安全原因,对Anthropic公司的先进Fable和Mythos模型实施出口管制,但后来解除了限制 [1, 3, 4, 5]。OpenAI应政府请求推迟了GPT-5.6模型的全面公开发布,只允许经过审查的合作伙伴访问 [1, 4, 5]。Google也正与政府协商,计划发布更先进编码AI模型,同时参与制定产业标准的讨论 [1, 4, 5]

这项合作源自2024年6月前总统特朗普签署的行政命令,命令各联邦机构与AI公司合作进行模型安全测试和建立发布标准 [1, 3, 4, 5]。美国AI标准与创新中心(CAISI)和国家安全局(NSA)将在标准制定和监管中发挥关键作用 [3, 4, 5]

协商内容包括模型审核周期和什么样的能力水平定义为“前沿模型” [3]。OpenAI首席执行官Sam Altman表示,他希望建立一个全球统一的AI标准框架,通过专业、公正的能力与风险评估,让AI带来的好处惠及更广泛群体 [3, 4, 5]

Anthropic将与政府及Amazon、Microsoft、Google等科技巨头合作,推动这些自愿的安全和评估标准落地 [4, 5]

2013年,OpenAI和Anthropic就承诺对其模型进行发布前的安全测试 [4, 5]。商贸部2024年6月12日施加、后于6月30日解除的出口限制针对正是Anthropic的Fable和Mythos模型 [1, 3, 4, 5]。7月初多家媒体报道美方和业界已接近达成一致,准备公布标准细节 [1, 2, 3, 4, 5]

下一步,预计有关的自愿标准将尽快出台,帮助统一行业规范并提供具体审核流程,推动前沿AI技术的安全、透明发布。