跳到正文
热点事件持续更新

GLM-5.3漏洞利用能力接近Claude

2 篇报道2 个报道来源6 小时前更新

先了解这件事

AI 综述

2026年9月30日,Simon Willison报道,Anthropic Frontier Red Team在内部Binary Exploitation benchmark中随机抽取100项任务评估多个模型。GLM-5.3在4%的试验中实现完整控制流劫持,Claude Mythos Preview为6%;Claude Opus 4.6和GLM-5.2均未成功。同日《The Decoder》援引Anthropic评估称,在ExploitBench的410次尝试中,GLM-5.3成功50次,Claude Mythos Preview成功56次;内部二进制利用测试中,两者接管目标程序的比例分别为4%和6%。报道据此称,GLM-5.3在漏洞利用开发方面接近Claude Mythos Preview。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

9月30日
  1. The Decoder精选
    Anthropic称开放权重GLM-5.3在漏洞利用开发上接近Claude Mythos Preview

    Anthropic的评估称,开放权重GLM-5.3在漏洞利用开发上接近Claude Mythos Preview,在ExploitBench中410次尝试成功50次,对比后者的56次;在内部二进制利用测试中,二者接管目标程序的比例分别为4%和6%。

  2. Simon Willison
    Anthropic Frontier Red Team:GLM-5.3 在 Binary Exploitation benchmark 中 4% 试验实现控制流劫持

    Anthropic Frontier Red Team 在内部 Binary Exploitation benchmark 中随机抽取 100 项任务评估多个模型,GLM-5.3 在 4% 的试验中实现了完整控制流劫持,Claude Mythos Preview 的比例为 6%。Claude Opus 4.6 和 GLM-5.2 在这些任务中均未成功。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。