跳到正文
原文
Hugging Face Blog·· 2022-10-24AI 评分40

Hugging Face 在 🤗 Evaluate 中新增语言模型偏见评估指标

Evaluating Language Model Bias with 🤗 Evaluate

AI 导读

Hugging Face 为 🤗 Evaluate 库添加偏见度量,支持评估 GPT-2、BLOOM 等因果语言模型的毒性、极性和伤害性。该功能利用 R4 Target 模型检测仇恨言论,通过对比不同代词提示下的生成结果量化偏见差异,帮助社区理解模型编码的社会问题。

来源:Hugging Face Blog · huggingface.co