热点事件持续更新
GLM-5.3漏洞利用能力接近Claude
2 篇报道2 个报道来源6 小时前更新
先了解这件事
AI 综述
2026年9月30日,Simon Willison报道,Anthropic Frontier Red Team在内部Binary Exploitation benchmark中随机抽取100项任务评估多个模型。GLM-5.3在4%的试验中实现完整控制流劫持,Claude Mythos Preview为6%;Claude Opus 4.6和GLM-5.2均未成功。同日《The Decoder》援引Anthropic评估称,在ExploitBench的410次尝试中,GLM-5.3成功50次,Claude Mythos Preview成功56次;内部二进制利用测试中,两者接管目标程序的比例分别为4%和6%。报道据此称,GLM-5.3在漏洞利用开发方面接近Claude Mythos Preview。
AI 根据报道生成 · 2 小时前更新
最新进展9月30日 19:05
Anthropic披露了GLM-5.3在两项漏洞利用测试中的具体表现。报道时间线
沿着报道,了解事件的不同侧面。
9月30日
- The Decoder精选Anthropic称开放权重GLM-5.3在漏洞利用开发上接近Claude Mythos Preview
Anthropic的评估称,开放权重GLM-5.3在漏洞利用开发上接近Claude Mythos Preview,在ExploitBench中410次尝试成功50次,对比后者的56次;在内部二进制利用测试中,二者接管目标程序的比例分别为4%和6%。
- Simon WillisonAnthropic Frontier Red Team:GLM-5.3 在 Binary Exploitation benchmark 中 4% 试验实现控制流劫持
Anthropic Frontier Red Team 在内部 Binary Exploitation benchmark 中随机抽取 100 项任务评估多个模型,GLM-5.3 在 4% 的试验中实现了完整控制流劫持,Claude Mythos Preview 的比例为 6%。Claude Opus 4.6 和 GLM-5.2 在这些任务中均未成功。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。