Hugging Face Blog·· 2024-04-19AI 评分38
Hugging Face 推出 Open Medical-LLM Leaderboard:医疗领域大语言模型评测基准
The Open Medical-LLM Leaderboard: Benchmarking Large Language Models in Healthcare
AI 导读
Hugging Face 推出 Open Medical-LLM Leaderboard,为医疗领域大语言模型提供标准化评测平台,以 accuracy 为主要指标,覆盖 MedQA、MedMCQA、PubMedQA 及 MMLU 医学相关子集等多个数据集。
来源:Hugging Face Blog · huggingface.co