跳到正文
原文
Hugging Face Blog·· 2024-05-24AI 评分45

Meta 发布 CyberSecEval 2:评估大语言模型网络安全风险与能力的综合框架

CyberSecEval 2 - A Comprehensive Evaluation Framework for Cybersecurity Risks and Capabilities of Large Language Models

AI 导读

Meta 推出开源基准测试框架 CyberSecEval 2,用于评估 LLM 在代码解释器滥用、攻击性能力及提示注入方面的安全风险。数据显示,自 2023 年 12 月首版以来,LLM 协助网络攻击的平均合规率已从 52% 降至 28%,但提示注入防御仍是未解难题。

来源:Hugging Face Blog · huggingface.co