AI资讯

Anthropic 红队:GLM-5.3 在 4% 测试中实现完整控制流劫持

速览

  • Anthropic 红队用 100 个内部二进制漏洞利用任务评估多个模型
  • GLM-5.3 实现完整控制流劫持的比例为 4%
  • Claude Mythos Preview 的比例为 6%,高于 GLM-5.3
  • Claude Opus 4.6 和 GLM-5.2 在此测试中零成功
  • Anthropic 判断高级网络能力扩散已跨过关键门槛

Anthropic Frontier Red Team 发布题为《GLM-5.3 与高级网络能力的扩散》的评估结果。团队从内部 Binary Exploitation benchmark 中随机抽取 100 个任务,对多个模型进行测试。结果显示,GLM-5.3 在 4% 的试验中成功开发出完整的控制流劫持(full control flow hijacks),Claude Mythos Preview 的成功率为 6%。Anthropic 指出,尽管 GLM-5.3 在此项上低于 Claude Mythos Preview,但一个有意义的能力门槛已被跨过:更早的模型如 Claude Opus 4.6 和 GLM-5.2 在这些任务中一次都没有成功。该结论来自 Anthropic 官方红队账号,Simon Willison 以引用形式转发。

关键事实

  • 测试基于 Anthropic 内部 Binary Exploitation benchmark 中随机选取的 100 个任务
  • GLM-5.3 在 4% 的试验中开发出完整控制流劫持
  • Claude Mythos Preview 在同一测试中的成功率为 6%
  • Claude Opus 4.6 与 GLM-5.2 在这些任务中成功率为零
  • Anthropic 认为一个有意义的能力门槛已被跨过

为什么值得关注

对安全行业而言,这意味着具备实际漏洞利用能力的模型不再只来自少数头部实验室,防御方需要把开源与第三方模型的网络能力一并纳入威胁评估。

背景与影响

Anthropic Frontier Red Team 长期评估前沿模型的网络攻防能力,此次将中国模型 GLM 系列纳入同一内部基准。结果说明模型在二进制漏洞利用这一高门槛任务上正从「完全做不到」进入「偶尔能做到」的阶段。

信源:Simon Willison

原文标题:Quoting Anthropic Frontier Red Team

阅读原文 →

本文整理自公开报道,版权归原作者所有;文中观点仅供参考,不代表本站立场。如有版权问题,请联系我们。