Simon Willison·· 2 天前AI 评分70
Anthropic 红队评估 GLM-5.3 与 Claude Mythos Preview 的漏洞利用能力
Quoting Anthropic Frontier Red Team
AI 导读
Anthropic 前沿红队报告指出,GLM-5.3 和 Claude Mythos Preview 在利用漏洞方面均展现出显著能力,其中 Claude Mythos Preview 在特定基准测试中表现优于 GLM-5.3。该评估基于对多个模型在复杂任务中的实际表现对比,强调了新一代模型在网络安全领域的潜在影响。
来源:Simon Willison · simonwillison.net