跳到正文
原文
Hugging Face Blog·· 2024-04-19AI 评分35

Hugging Face 推出 Open Medical-LLM Leaderboard:基准测试医疗领域大语言模型

The Open Medical-LLM Leaderboard: Benchmarking Large Language Models in Healthcare

AI 导读

Hugging Face 发布 Open Medical-LLM Leaderboard,通过 MedQA、MedMCQA 等数据集以准确率评估 LLM 在医疗问答中的表现。该榜单旨在解决 GPT-3 等模型在医疗场景下可能产生严重错误的问题,推动更可靠的医疗 AI 发展。

来源:Hugging Face Blog · huggingface.co