跳到正文
原文
Hugging Face Blog·· 2024-04-19AI 評分47

Open Medical-LLM Leaderboard:醫療領域大語言模型基準評測

The Open Medical-LLM Leaderboard: Benchmarking Large Language Models in Healthcare

AI 導讀

Open Medical-LLM Leaderboard 為醫療大語言模型提供標準化評測平台,按多種醫療任務與資料集比較表現。平台以準確率為主要指標,涵蓋 MedQA、MedMCQA、PubMedQA 及 MMLU 的醫學與生物學子集。

來源:Hugging Face Blog · huggingface.co