Base Labs、Hugging Face与Goodfire建立开放模型安全合作

TechCrunch AI··作者 Aditya Mehta

关键信息

Hugging Face目前列出了超过6,000个被称为“abliterated”的模型,但合作方尚未公布具体技术架构或评估指标。Goodfire的模型可解释性技术可能为该项目提供支持,而Baseten则可利用其作为AI推理服务商的经验。

资讯摘要

Baseten宣布,其研究部门Base Labs将与Hugging Face和Goodfire AI共同启动一项AI安全基础设施计划。三方计划为开放权重模型建立评估和监控工具,这类模型的参数可以被开发者下载和修改。此次宣布正值业界关注“abliteration”技术之际,该技术被用于移除模型中的安全护栏。Hugging Face目前列出了超过6,000个被标记为“abliterated”的模型,显示出报道所述问题的规模。

Base Labs表示,它将开发并发布开放模型的训练与监控方法,并希望最终形成一套透明的安全标准。该方法将安全机制整合进模型开发和部署流程,而不是在模型发布后再作为附加功能加入。合作方尚未说明系统的具体技术实现,但Goodfire专注于解释模型如何作出决策,因此可能负责其中的内置安全部分。Baseten最近以130亿美元估值完成15亿美元的Series F融资,Goodfire也完成了由B Capital领投的1.5亿美元Series B融资,Base Labs同时邀请更广泛的开发者生态参与框架建设。

Base Labs、Hugging Face与Goodfire建立开放模型安全合作

来源与参考

  1. 原始链接
  2. Base Labs launches an open-weight AI safety partnership with Hugging Face and Goodfire | TechCrunch

收录于 2026-09-18