TechCrunch 报道初创公司 Abliteration.ai 将长期存在于开源社区的 abliteration(正交化去除拒答倾向)做成可浏览器/API 访问的托管服务,并上线智谱 Z.ai 近期开源权重模型 GLM-5.3 的去护栏版本。公司称面向进攻性网络、红队与智能体测试等「其他模型拒绝做」的工作;TechCrunch 实测可免费注册并用该模型生成窃取 Chrome 密码脚本与危险病原体培养协议等内容。平台提供客户侧可加回的审查层,自身仍有少量限制(如自杀指导),尚无正式 KYC(主要记信用卡)。CivAI 等安全研究者警告大规模可及的去护栏模型可能被滥用于伤害;部分红队从业者则称日常更依赖微调开源模型,且 abliteration 可能损伤能力。
核心要点速览 (Key Takeaways)
- ✓商业化托管去护栏开源权重模型,含 GLM-5.3 abliterated 版,浏览器/API 可用
- ✓自称服务红队/进攻性网络与智能体测试;TechCrunch 实测多项高风险请求被答应
- ✓安全争议:降低滥用门槛 vs 让防御方复现威胁;尚无完整 KYC
讨论与评论
0登录后即可参与深度讨论
与广大 AI 开发者、工程师交流评测心得与前沿洞察