Base Labs宣布与Hugging Face和Goodfire建立开放权重AI安全合作伙伴关系,将开发并公开发布用于训练和监控开放模型的方法。
Base Labs是Baseten于今年早些时候成立的研究团队。此次合作聚焦开放权重模型的安全训练与监测,目标是形成可公开复用的技术方案,而非仅停留在内部研究层面。
Hugging Face是开放模型生态的主要平台,Goodfire则专注于模型可解释性研究。三方联手意味着开放权重模型的安全问题正获得更多工具和标准层面的支持。
随着开放权重模型能力持续提升,如何在保持开放性的同时实现有效监控,成为行业关注焦点。Base Labs表示,相关方法将以公开形式发布,供更广泛的研究者和开发者使用。
咨询
咨询