智谱加固两周也没挡住,GLM-5.3开源3天就被拆掉拒答

律动BlockBeats
律动BlockBeats|2026年09月01日 06:43
专门把开源模型做成「去拒答版」的 Abliteration.aiAbliteration.ai 上线 GLM-5.3 的去拒答版本 abliterated-model-large-v2。它直接修改模型权重,削弱模型拒绝请求的机制,主打进攻性网络安全、红队和 Agent 测试,并提供付费 API。智谱此前把 GLM-5.3 开放权重推迟两周,用于安全评估和加固。8 月 28 日权重开放后,Abliteration 只用了 3 天就上线了这个版本。GLM-5.3 的网络攻击能力本来就比 5.2 强很多。ExploitBench 从 24.4% 升到 54.4%,ExploitGym 两小时完成任务数从 29 个升到 105 个。Abliteration 目前没有公布去拒答后的重测成绩。它的 API 默认只强制拦截儿童性内容和自残,违法活动、仇恨、骚扰、成人性内容等都默认放行。[原文链接](动察 Beating AI 快)
+3
曾提及
分享至:

脉络

热门快讯

APP下载

X

Telegram

Facebook

Reddit

复制链接

热门阅读