Large-scale multi-task language understanding benchmark
Hugging Face's open-source large model ranking list
AI Large Model Evaluation Community
Shanghai Artificial Intelligence Laboratory Launches Large Model Open Evaluation System
A comprehensive large-scale Chinese evaluation benchmark
A comprehensive multimodal large model capability evaluation system
Stanford University's Large Model Evaluation System
AI Model Evaluation Platform
Large Model Evaluation Benchmarks Developed by Fudan University NLP Lab
Biomedical research question-answering dataset and model score leaderboard