Hugging Face Blog·· 2024-01-26AI 评分38
Hugging Face 发布 LLM Safety Leaderboard:基于 DecodingTrust 评估大模型安全性
An Introduction to AI Secure LLM Safety Leaderboard
AI 导读
Hugging Face 推出由 HF leaderboard template 驱动的 LLM Safety Leaderboard,聚焦大模型安全评估。该榜单基于获 NeurIPS 2023 最佳论文奖的 DecodingTrust 平台,覆盖毒性、偏见等八个可信度维度。研究发现 GPT-4 比 GPT-3.5 更脆弱,且无单一模型在所有维度均表现最优。
来源:Hugging Face Blog · huggingface.co