加密知识一站通
行情·工具·策略

智谱加固两周也没挡住,GLM-5.3开源3天就被拆掉拒答

动察 Beating AI 快讯,专门把开源模型做成「去拒答版」的 Abliteration.ai 上线 GLM-5.3 的去拒答版本 abliterated-model-large-v2。它直接修改模型权重,削弱模型拒绝请求的机制,主打进攻性网络安全、红队和 Agent 测试,并提供付费 API。

智谱此前把 GLM-5.3 开放权重推迟两周,用于安全评估和加固。8 月 28 日权重开放后,Abliteration 只用了 3 天就上线了这个版本。

GLM-5.3 的网络攻击能力本来就比 5.2 强很多。ExploitBench 从 24.4% 升到 54.4%,ExploitGym 两小时完成任务数从 29 个升到 105 个。Abliteration 目前没有公布去拒答后的重测成绩。

它的 API 默认只强制拦截儿童性内容和自残,违法活动、仇恨、骚扰、成人性内容等都默认放行。

赞(0)
未经允许不得转载:币须知道 » 智谱加固两周也没挡住,GLM-5.3开源3天就被拆掉拒答

评论 抢沙发

  • 昵称 (必填)
  • 邮箱 (必填)
  • 网址