据华尔街见闻报道,OpenAI计划让第三方安全评估更早介入人工智能模型开发。外部机构的评估范围将覆盖模型训练、评估及部署流程,不再仅限于模型发布前的安全审查和能力测试。

OpenAI负责外部安全评审工作的Lama Ahmad表示,公司此前通常在模型发布前引入外部机构,新安排则把第三方审查延伸至更上游的训练和评估环节。她称,随着风险等级提高,训练与评估阶段也需要得到与部署环节相应的重视。

这项安排目前是OpenAI公布的评审方向。公司列出的优先条件包括强有力的独立性机制、科学严谨性、稳健的安全实践,以及明确划分各方责任。这些条件界定了外部机构参与评估时需要满足的基本要求。

对于涉及高度敏感内容的评估,Ahmad表示,OpenAI可能邀请外部评估人员进入公司办公室开展工作,并称公司过去曾尝试这种方式。这意味着部分审查可能在受控场所进行,但来源没有说明其适用项目、启动时间或具体执行规模。

OpenAI称,公司正在与多个潜在评估机构洽谈,其中既有此前合作过的组织,也有尚未合作的机构,已提及的对象包括AI研究机构METR和Redwood Research。两家机构此前曾受OpenAI委托,调查其模型入侵Hugging Face一事。

同一报道还提到,Anthropic已宣布引入埃森哲评估人员,对其前沿AI模型开展安全测试。OpenAI则强调,实验室需要在保护敏感信息的同时支持有实质意义的外部审查;此外,该公司还呼吁美国联合其他国家制定前沿人工智能技术标准。

仅供信息参考,不构成投资建议。

原始来源:OpenAI新举措:允许第三方机构在模型训练、开发阶段进行安全评估