Hugging Face Blog·· 2024-04-19AI 評分47
Open Medical-LLM Leaderboard:醫療領域大語言模型基準評測
The Open Medical-LLM Leaderboard: Benchmarking Large Language Models in Healthcare
AI 導讀
Open Medical-LLM Leaderboard 為醫療大語言模型提供標準化評測平台,按多種醫療任務與資料集比較表現。平台以準確率為主要指標,涵蓋 MedQA、MedMCQA、PubMedQA 及 MMLU 的醫學與生物學子集。
來源:Hugging Face Blog · huggingface.co