Hugging Face Blog·· 2025-08-12AI 评分30
Hugging Face 发布 FilBench:评估 LLM 在菲律宾语言中的能力
🇵🇭 FilBench - Can LLMs Understand and Generate Filipino?
AI 导读
Hugging Face 推出 FilBench,用于系统评估大语言模型在 Tagalog、Filipino 和 Cebuano 上的表现。该基准涵盖文化知识与生成等四大类共12项任务,测试了20多个前沿模型。结果显示,SEA-LION 等区域专用开源模型虽参数效率高,但整体性能仍落后于 GPT-4o,且所有模型在翻译生成任务中均面临挑战。
来源:Hugging Face Blog · huggingface.co