行业新闻

Abliteration.ai 将去除 AI 安全护栏做成付费服务

Abliteration.ai 将去除 AI 安全护栏做成付费服务

一家公司公开提供去护栏 AI 模型,让生成恶意内容变得更容易,安全风险引发激辩。

Abliteration.ai 这家初创公司,专门托管剥离了安全护栏的开源权重模型,用户可直接在浏览器或通过 API 调用。测试中,它能应要求编写窃取 Chrome 密码的程序和培养危险病原体的方案。支持者认为这有助于红队防御,批评者则担心会被用于真实攻击。

正文摘录

- title: Abliteration.ai 正在把"移除 AI 护栏"做成生意 - sourcecompany: TechCrunch - bodymarkdown: 如今,访问全球最强开源权重 AI 模型之一变得更加容易了——而且是去除了护栏、不再拒绝执行有害任务的那个版本。 这家名为 [Abliteration.ai](http://abliteration.ai/) 的创业公司,以"消融拒绝"(abliteration,一种让模型不再拒绝有害请求的技术)命名,并把这项去除能力直接做成了一项服务。该平台托管着多个去除护栏版的开源权重模型,包括 Z.ai 最近发布的 GLM-5.3,用户可以通过网页浏览器直接查询或通过 API 访问。 公司在最近一篇 [社交媒体帖子](https://x.com/abliterationai/status/2094458081451393287) 中表示,其目标是让其他人能够执行"进攻性网络攻击、红队测试,以及其他模型拒绝执行的 Agent 测试工作。"这套逻辑在安全领域并不陌生:你无法防御一种无法复现的行为,而一个拒绝写出可运行漏洞利用代码的模型,也无法帮助红队防御攻击者。但同样的去除操作,也让其他潜在危险任务变得更容易。 Abliteration 在开源模型圈子里是一项由来已久的技术。多年来,研究人员和开发者一直在对开源权重模型做"消融拒绝"处理,Hugging Face 平台上托管着数千个经过 abliteration 处理的模型。 Abliteration.ai 去年底创立、今年 3 月正式注册成立,它把这项原本属于地下开源社区的做法变成了一种商业化、随手可用的服务。通过直接托管模型,Abliteration 降低了使用门槛——否则人们得自己下载预消融模型,还要搞定运行所需的算力。

阅读原文(techcrunch.com)→

行业新闻Rebecca Bellan2026-09-03原文

相关内容