AI model evaluation, performance comparison, and leaderboard
15 tools
Biomedical research question-answering dataset and model score leaderboard
H2O.ai's large-scale model evaluation system based on the Elo rating methodology
Large Model Evaluation Benchmarks Developed by Fudan University NLP Lab
AI Model Evaluation Platform
Stanford University's Large Model Evaluation System
A comprehensive multimodal large model capability evaluation system
A comprehensive large-scale Chinese evaluation benchmark
Shanghai Artificial Intelligence Laboratory Launches Large Model Open Evaluation System
AI Large Model Evaluation Community
Comprehensive Evaluation Benchmark for Chinese Universal Model
The FlagEval (Libra) large-scale model evaluation platform launched by the Academy of Artificial Intelligence
A comprehensive Chinese basic model evaluation kit
Hugging Face's open-source large model ranking list
Large-scale multi-task language understanding benchmark
ByteDance's Visual Generative Model Battle Platform