Anthropic和OpenAI希望将独立的安全评估员嵌入其人工智能实验室内部。研究人员对由此获得的前所未有的访问权限表示欢迎,但警告称,有意义的监督需要透明度、独立性,并最终需要监管。
两家公司此举旨在让外部评估人员更深入地了解其模型开发与安全测试流程,从而提升人工智能安全治理的可信度。然而,研究人员指出,评估员若缺乏真正的独立地位和充分的信息披露,其监督作用将大打折扣。
业内认为,随着人工智能能力快速提升,如何在企业实验室内部建立有效的安全评估机制,已成为行业和监管机构共同面对的关键议题。
咨询
咨询