Model Merging Benchmark
Benchmarks
Task NameDataset NameSOTA ResultTrendResults
20-task Model Merging Benchmark (14-task + EMNIST, CIFAR10, Food101, FashionMNIST, RenderedSST2, KMNIST)
94.7Avg Absolute Accuracy
30
model merging benchmark Many-shot
1.015Average
9