TechCrunch 报道初创公司 Abliteration.ai 将长期存在于开源社区的 abliteration(正交化去除拒答倾向)做成可浏览器/API 访问的托管服务,并上线智谱 Z.ai 近期开源权重模型 GLM-5.3 的去护栏版本。公司称面向进攻性网络、红队与智能体测试等「其他模型拒绝做」的工作;TechCrunch 实测可免费注册并用该模型生成窃取 Chrome 密码脚本与危险病原体培养协议等内容。平台提供客户侧可加回的审查层,自身仍有少量限制(如自杀指导),尚无正式 KYC(主要记信用卡)。CivAI 等安全研究者警告大规模可及的去护栏模型可能被滥用于伤害;部分红队从业者则称日常更依赖微调开源模型,且 abliteration 可能损伤能力。

核心要点速览 (Key Takeaways)

  • 商业化托管去护栏开源权重模型,含 GLM-5.3 abliterated 版,浏览器/API 可用
  • 自称服务红队/进攻性网络与智能体测试;TechCrunch 实测多项高风险请求被答应
  • 安全争议:降低滥用门槛 vs 让防御方复现威胁;尚无完整 KYC
ADSponsored