开源工具·TechCrunch AI

Base Labs携手Hugging Face与Goodfire,推出开源AI安全合作

Base Labs与Hugging Face和Goodfire AI合作,建立开源模型安全评估与监控基础设施。项目旨在通过透明、可操作的控制手段应对模型安全威胁,目前已有超6000个模型被去除防护。对开发者而言,这为开源AI的安全部署提供了新标准。

本周三,Baseten旗下研究机构Base Labs与Hugging Face及Goodfire AI建立合作伙伴关系,共同为开源权重模型构建安全评估与监控基础设施。此举正值开源模型安全性讨论激烈之际——一种名为“去防护”的技术可通过移除模型安全机制使其产生危险,而Hugging Face平台目前已列出超6000个此类模型。\n\nBase Labs是Baseten今年早些时候成立的研究团体,将开发并发布训练和监控开源模型的方法。Baseten将其未来工作定位为开源模型的“标准”,强调这种安全机制应透明地内置在模型的训练和部署过程中,而非事后补充。公司表示,开放性为AI安全带来优势,提供更多模型行为可见性,并使安全研究转化为可操作、透明的控制手段。\n\nGoodfire,专注打开展示模型决策过程的“黑箱”,被视为此项目中“内置”安全机制的关键技术伙伴。尽管合作的具体技术细节尚未披露,但Goodfire表明目标是将安全内置到开源模型中。同时,Baseten和Goodfire均资金充足——Baseten刚完成15亿美元融资,Goodfire也获得1.5亿美元投资。\n\n目前,Baseten正向开发者社区发出公开邀请,鼓励更多贡献者参与该框架的构建,旨在打造一个安全且对所有人可及的开源模型生态系统。

#开源#AI安全#合作#模型监控

本文由程序自动抓取公开报道,经 AI 筛选与改写生成,未经人工逐条核实,事实以原文为准。