Anthropic 红队:GLM-5.3 在 4% 测试中实现完整控制流劫持
速览
- Anthropic 红队用 100 个内部二进制漏洞利用任务评估多个模型
- GLM-5.3 实现完整控制流劫持的比例为 4%
- Claude Mythos Preview 的比例为 6%,高于 GLM-5.3
- Claude Opus 4.6 和 GLM-5.2 在此测试中零成功
- Anthropic 判断高级网络能力扩散已跨过关键门槛
Anthropic Frontier Red Team 发布题为《GLM-5.3 与高级网络能力的扩散》的评估结果。团队从内部 Binary Exploitation benchmark 中随机抽取 100 个任务,对多个模型进行测试。结果显示,GLM-5.3 在 4% 的试验中成功开发出完整的控制流劫持(full control flow hijacks),Claude Mythos Preview 的成功率为 6%。Anthropic 指出,尽管 GLM-5.3 在此项上低于 Claude Mythos Preview,但一个有意义的能力门槛已被跨过:更早的模型如 Claude Opus 4.6 和 GLM-5.2 在这些任务中一次都没有成功。该结论来自 Anthropic 官方红队账号,Simon Willison 以引用形式转发。
关键事实
- 测试基于 Anthropic 内部 Binary Exploitation benchmark 中随机选取的 100 个任务
- GLM-5.3 在 4% 的试验中开发出完整控制流劫持
- Claude Mythos Preview 在同一测试中的成功率为 6%
- Claude Opus 4.6 与 GLM-5.2 在这些任务中成功率为零
- Anthropic 认为一个有意义的能力门槛已被跨过
为什么值得关注
对安全行业而言,这意味着具备实际漏洞利用能力的模型不再只来自少数头部实验室,防御方需要把开源与第三方模型的网络能力一并纳入威胁评估。
背景与影响
Anthropic Frontier Red Team 长期评估前沿模型的网络攻防能力,此次将中国模型 GLM 系列纳入同一内部基准。结果说明模型在二进制漏洞利用这一高门槛任务上正从「完全做不到」进入「偶尔能做到」的阶段。
本文整理自公开报道,版权归原作者所有;文中观点仅供参考,不代表本站立场。如有版权问题,请联系我们。