跳到正文
原文
Hugging Face Blog·· 2025-08-12AI 评分30

Hugging Face 发布 FilBench:评估 LLM 在菲律宾语言中的能力

🇵🇭 FilBench - Can LLMs Understand and Generate Filipino?

AI 导读

Hugging Face 推出 FilBench,用于系统评估大语言模型在 Tagalog、Filipino 和 Cebuano 上的表现。该基准涵盖文化知识与生成等四大类共12项任务,测试了20多个前沿模型。结果显示,SEA-LION 等区域专用开源模型虽参数效率高,但整体性能仍落后于 GPT-4o,且所有模型在翻译生成任务中均面临挑战。

来源:Hugging Face Blog · huggingface.co