Hugging Face Blog·· 2022-10-24AI 评分40
Hugging Face 在 🤗 Evaluate 中新增语言模型偏见评估指标
Evaluating Language Model Bias with 🤗 Evaluate
AI 导读
Hugging Face 为 🤗 Evaluate 库添加偏见度量,支持评估 GPT-2、BLOOM 等因果语言模型的毒性、极性和伤害性。该功能利用 R4 Target 模型检测仇恨言论,通过对比不同代词提示下的生成结果量化偏见差异,帮助社区理解模型编码的社会问题。
来源:Hugging Face Blog · huggingface.co