Abliteration.ai去护栏AI模型商业化引发安全争议
原文:Abliteration.ai is making a business out of removing AI guardrails
如今,获取全球最强大的开放权重 AI 模型之一变得容易多了——而且是去除了安全护栏、不会拒绝执行有害任务的版本。这家名为 Abliteration.ai 的初创公司以一种去除模型拒绝有害请求倾向的技术命名,并将这一“去除”过程做成了一项服务。该平台托管了多种移除护栏的开放权重模型的修改版本,其中包括 Z.ai 最近发布的 GLM-5.3,用户可以通过网页浏览器查询,也可以通过 API 访问。该公司在近期的一条社交媒体帖子中表示,其目标是让他人能够执行“其他模型拒绝做的攻击性网络行动、红队测试和智能体测试工作”。这在安全领域的逻辑很常见:你无法防御一种你无法复现的行为,而一个拒绝编写可用漏洞利用代码的模型,也无法帮助红队防御攻击者。但这些同样的去除操作也让其他潜在危险的任务变得更加容易。Abliteration(消融)技术在开源模型社区由来已久。研究人员和开发者多年来一直在去除开放权重模型的拒绝机制,Hugging Face 平台上托管着数千个经过 abliteration 处理的模型。Abliteration.ai 成立于去年年底,于今年 3 月正式注册,它将这一原本处于地下状态的开源做法变成了商业化、随时可用的服务。通过托管模型,Abliteration 降低了使用门槛——否则用户需要自行下载经过消融处理的模型,并准备好运行它所需的算力。TechCrunch 记者试用该服务时,很快注册了账号,并通过网页浏览器免费开始查询一个消融版 GLM-5.3。我们要求它编写一个窃取 Chrome 已保存密码的 Python 程序,以及一份在家中培养危险人类病原体的详细方案,它都爽快地照办了。Abliteration.ai 联合创始人 Devon 表示,这家初创公司已与多家大型云服务提供商达成多项合作协议。