跳到正文
中文
FikirPilot 内容

Base Labs 与 Hugging Face 和 Goodfire 启动开放权重 AI 安全合作

更新于: 2026年9月20日 · 3 分钟阅读

发布于: · 消息抵达: · 处理时长: 33 小时 47 分钟

Base Labs 与 Hugging Face 和 Goodfire 启动开放权重 AI 安全合作
现代数据中心的走廊

Baseten宣布与Hugging Face和Goodfire AI建立合作关系并推出一项标准,将通过其研究部门Base Labs为开放权重模型开发安全评估和监测基础设施。2026年9月17日发布的声明旨在将安全措施从一开始就融入模型训练和部署流程,而不是事后添加。

开放权重模型正因一种名为“abliteration”的技术而引发争议,该技术可以移除安全措施。目前,Hugging Face上列出了超过6,000个经过abliteration处理的模型。Base Labs将开发并发布用于训练和监测开放模型的方法。

目前尚未公布该合作将在技术层面如何运作。Goodfire AI致力于研究模型如何做出决策,有望在将安全性嵌入模型这一目标中发挥作用。Baseten是一家人工智能推理服务提供商,于6月获得1.5十亿 美元的Series F轮融资,估值升至13十亿 美元。Goodfire AI则在今年早些时候获得了由B Capital领投的150百万 美元Series B轮融资。

Baseten向开发者生态发出公开邀请,希望各方为框架的开发作出贡献。该公司表示,目标是建立一个让开放模型安全且人人都能访问的生态系统。

为何重要

开放权重模型中的安全措施可以被移除,这表明模型发布后采取的措施可能并不足够。因此,对于开发者、使用模型的机构以及访问开放模型生态系统的用户而言,安全评估应在何时、依据哪些标准进行,正变得越来越重要。此次公布的方法旨在让安全性成为模型开发过程的一部分,同时不牺牲可访问性;但如何将其应用于现有模型的监测,目前尚不明确。由于合作的技术运作方式尚未公布,标准将如何对经过abliteration处理的模型进行分类、如何衡量风险,以及如何将开发者的贡献纳入这一流程,仍是悬而未决的问题。

背景

Face并不是FikirPilot档案中的新名字:过去90天里,我们发布了8篇提到这一名字的新闻;最新一篇的日期是2026年9月13日。

术语:开放权重

开放权重是指人工智能模型经过训练的参数可以被下载;由于训练数据和代码可能并未公开,因此它与开源并不具有相同含义。

来源: TechCrunch AI