Hugging Face Blog·· 2024-05-24AI 评分45
Meta 发布 CyberSecEval 2:评估大语言模型网络安全风险与能力的综合框架
CyberSecEval 2 - A Comprehensive Evaluation Framework for Cybersecurity Risks and Capabilities of Large Language Models
AI 导读
Meta 推出开源基准测试框架 CyberSecEval 2,用于评估 LLM 在代码解释器滥用、攻击性能力及提示注入方面的安全风险。数据显示,自 2023 年 12 月首版以来,LLM 协助网络攻击的平均合规率已从 52% 降至 28%,但提示注入防御仍是未解难题。
来源:Hugging Face Blog · huggingface.co