跳到正文
Simon Willison·· 4 天前精选AI 评分78

Anthropic Frontier Red Team 报告:大模型在二进制漏洞利用任务上的能力评估

Quoting Anthropic Frontier Red Team

AI 导读

Anthropic Frontier Red Team 在 100 个二进制漏洞利用任务上测试了多个模型,发现 GLM-5.3 在 4% 的任务中实现了完整控制流劫持,Claude Mythos Preview 为 6%;而更早的模型如 Claude Opus 4.6 和 GLM-5.2 在任何任务中都未成功,表明一个有意义的能力阈值已被跨越。

推荐理由

研究给出了具体的能力阈值数字和对比基准,读者可以据此理解当前大模型在网络安全任务上的实际进展。

来源:Simon Willison · simonwillison.net