Anthropic称开放权重GLM-5.3在漏洞利用开发上接近Claude Mythos Preview
Anthropic的评估称,开放权重GLM-5.3在漏洞利用开发上接近Claude Mythos Preview,在ExploitBench中410次尝试成功50次,对比后者的56次;在内部二进制利用测试中,二者接管目标程序的比例分别为4%和6%。
推荐理由:文章将GLM-5.3与Claude Mythos Preview及其他模型放在漏洞利用基准中比较,并补充开放权重模型安全防护易被移除的测试结果。