跳到正文
原文
Simon Willison·· 2 天前AI 评分70

Anthropic 红队评估 GLM-5.3 与 Claude Mythos Preview 的漏洞利用能力

Quoting Anthropic Frontier Red Team

AI 导读

Anthropic 前沿红队报告指出,GLM-5.3 和 Claude Mythos Preview 在利用漏洞方面均展现出显著能力,其中 Claude Mythos Preview 在特定基准测试中表现优于 GLM-5.3。该评估基于对多个模型在复杂任务中的实际表现对比,强调了新一代模型在网络安全领域的潜在影响。

来源:Simon Willison · simonwillison.net