帮助建立先进人工智能的共享标准

发布于

随着人工智能模型不断增强,它们不仅能加强网络防御、加速科学发现,还能扩展专业知识的获取。但如果对其能力的理解出现偏差,或其安全措施不足,都会带来安全和风险隐患。为了安全有效地利用这些优势,社会需要具备技术和治理能力的机构,以评估、保障和管理日益复杂的系统。

这也是 OpenAI 参与创立 [Appia Foundation](https://appiafoundation.org/) 的原因,该基金会由 Linux 基金会主办。Appia 将开发开放的、模块化的规范,旨在将国际标准和已建立的框架转化为整个人工智能价值链的实用评估标准。其工作将帮助建立一个至关重要的信任层,让第三方能够检查标准的符合性,在不同组织开发模型、基础设施和应用时,提供更清晰和可重用的证据。通过这一工作,Appia 将创建一个共享的技术语言,使国家和国际机构能够信任彼此的工作。

**我们认为,这项努力是加强先进人工智能系统所需机构、标准和评估实践的更广泛工作的一个重要下一步。**

我们最近的 [前沿人工智能民主治理蓝图](https://openai.com/index/frontier-safety-blueprint/) 为这项工作提供了路线图。该蓝图呼吁建立持久的美国框架、强化人工智能标准与创新中心 (CAISI),以及在政府中实施更广泛的抗风险策略。同时,它也认识到前沿风险的国际特征,各国应共同制定兼容的安全框架、可信的风险发现共享渠道,以及针对事件的协调响应。

国家能力与国际合作之间应相互增强。像 CAISI 这样强有力的机构可以培养专业知识,评估前沿系统,并支持独立评估生态系统。然后,一系列强有力的国家机构可以建立共享的方法,认可可信的证据,从而为各国政府提供必要的共同技术理解,以便采取联合行动。

标准在此过程中至关重要,必须建立在可信的评估实践和技术严谨的基础上。在我们的 [可信第三方评估共享手册](https://openai.com/index/trustworthy-third-party-evaluations-foundations/) 中,我们阐述了前沿评估日益需要披露的内容:被测试的系统、其工具访问与评估环境、用来引导能力的方式、可用资源,以及验证结果的检查。我们还通过与美国 CAISI 和英国 AISI 进行的 [测试合作](https://openai.com/index/us-caisi-uk-aisi-ai-update/) 实践了这些原则,针对前沿能力评估和生物误用保障的工作,推动我们的系统取得实质性改进。这项工作为创建可标准化的实践奠定了基础,以便以可比较的方式检查性能。

这些实践补充了 OpenAI 更广泛的安全基础设施。我们的 [准备框架](https://openai.com/safety/) 是定义和操作我们管理先进人工智能系统最严重风险的基础,包括我们的内部实践。我们的 [前沿治理框架](https://openai.com/index/openai-frontier-governance-framework/) 将相关的部分应用到一份公共治理文件中,专注于特定的监管义务,包括风险评估、模型报告、安全控制、事件响应,以及引入外部专家意见。这些文稿共同帮助将广泛承诺转化为可验证和改进的操作实践。

**Appia 的工作致力于下一个挑战:使这些实践在组织、辖区和供应链之间实现互通。**

OpenAI 已在更广泛的标准和预标准化工作中贡献力量。我们参与了 [国际标准化组织和国际电工委员会联合技术委员会 1,第 42 子委员会关于人工智能](https://www.iso.org/committee/6794475.html),以及由国家标准与技术研究所主导的 [人工智能安全研究所联盟](https://www.nist.gov/artificial-intelligence/artificial-intelligence-safety-institute-consortium-aisic);帮助创立了 [前沿模型论坛](https://openai.com/index/frontier-model-forum/) 和 Linux 基金会的 [Agentic 人工智能基金会](https://www.linuxfoundation.org/press/linux-foundation-announces-the-formation-of-the-agentic-ai-foundation);参与了 [安全人工智能联盟](https://www.coalitionforsecureai.org/);担任 [内容来源和真实性联盟](https://c2pa.org/) 的指导委员会成员;并参与 [互联网工程任务组](https://www.ietf.org/about/introduction/) 和 [快速身份在线联盟](https://fidoalliance.org/fido-alliance-agentic-ai/) 的相关工作,以推动互操作性技术标准。

在这些论坛中,包括通过 Appia,我们的目标是将前沿开发的经验教训转化为开放、技术驱动的实践,以便政府、公司和独立评估者能够在不同辖区使用。

---

原文链接:[点击查看](https://openai.com/index/helping-build-shared-standards-for-advanced-ai)

评论

暂无评论。