OpenAI提出前沿人工智能独立评估原则
OpenAI News··作者 OpenAI News
关键信息
公告关注的不仅是模型行为,也包括安全防护措施,并强调评估过程的严谨性、安全性和独立性。现有材料说明了优先事项和原则,但没有具体说明评估机构、测试协议、法律授权或实施时间表。
资讯摘要
OpenAI发布了一份关于如何有效开展前沿人工智能系统第三方安全评估的原则说明。该方案同时针对前沿模型,以及用于控制或降低模型风险的安全防护措施。OpenAI将严谨性列为核心要求,这表明评估应当产生可靠证据,而不能只依赖开发者自身的安全承诺。安全性也是另一项明确优先事项,因为评估可能涉及对高能力模型的访问、敏感测试信息或与安全有关的发现。
公司还强调独立性,将外部评估与模型开发者内部进行的测试区分开来。在更广泛的治理讨论中,独立评估者普遍欢迎外部监督的方向,但也警告说,只有在其角色得到清晰保护的情况下,他们才能真正充当监督者,而不是按照人工智能公司的条件工作的供应商。因此,这份公告参与了一个正在形成的公共讨论:前沿人工智能安全评估应如何组织、建立信任,并可能逐步形成统一标准。
资讯正文
OpenAI 概述了针对前沿模型及其安全防护措施开展严谨、安全且独立的第三方 AI 安全评估时应遵循的优先事项和原则。
来源与参考
收录于 2026-09-23