Large-scale model pool
Benchmarks
Task NameDataset NameSOTA ResultTrendResults
Large-scale model pool 15 LLMs
51.9Accuracy
3
Large-scale model pool Math Reasoning 15 LLMs
73.3Accuracy
3
Large-scale model pool Logic Reasoning 15 LLMs
95.6Accuracy
3
Large-scale model pool Reading&QA 15 LLMs
88Accuracy
3
Large-scale model pool Language Understanding
84Accuracy
3