Text-to-Image Generation on T2I-CompBench standard (Compositional Attributes & Overall)
88.613D Spatial ScoreShow-O2
Evaluation Results
| Method | Links | |||||||||
|---|---|---|---|---|---|---|---|---|---|---|
| Show-O2Model Category=Unified Multimodal Models2025.10 | 88.61 | 87.73 | 87.88 | 85.91 | 69.74 | 73.99 | 86.6 | 82.17 | 82.83 | |
| Bagel(CoT) + SRUMModel Category=Unified Multimodal Models, Evaluation Protocol=CoT mode, Enhancement=SRUM2025.10 | 88.6 | 92.9 | 91.31 | 90.48 | 80.12 | 84.47 | 89.93 | 89.15 | 88.37 | |
| Bagel(CoT)Model Category=Unified Multimodal Models, Evaluation Protocol=CoT mode2025.10 | 84.66 | 88.85 | 86.1 | 85.64 | 75.36 | 84.33 | 82.71 | 88.07 | 84.46 | |
| BLIP3o + SRUMModel Category=Unified Multimodal Models, Enhancement=SRUM2025.10 | 83.78 | 90.22 | 86.57 | 85.1 | 74.52 | 85.44 | 93.88 | 86.52 | 85.75 | |
| Bagel + SRUMModel Category=Unified Multimodal Models, Enhancement=SRUM2025.10 | 83.1 | 92.9 | 88.69 | 88.47 | 78.52 | 84.23 | 86.92 | 89.57 | 86.55 | |
| OmniGen2Model Category=Unified Multimodal Models2025.10 | 82.21 | 92.22 | 86.87 | 88.51 | 72 | 83.95 | 90.07 | 90.88 | 85.84 | |
| BLIP3oModel Category=Unified Multimodal Models2025.10 | 81.73 | 89.92 | 85.55 | 84.78 | 71.67 | 83.75 | 92.47 | 87.45 | 84.66 | |
| FLUX.1-schnellModel Category=T2I Models2025.10 | 79.38 | 84.53 | 81.96 | 85.55 | 72.82 | 82.2 | 85.49 | 86.38 | 82.29 | |
| BagelModel Category=Unified Multimodal Models2025.10 | 77.98 | 89.3 | 83.32 | 85.03 | 70.4 | 81.94 | 81.52 | 87.93 | 82.18 | |
| SD-3-mediumModel Category=T2I Models2025.10 | 77.83 | 91.63 | 84.73 | 86.12 | 72.8 | 83.72 | 88.2 | 89.03 | 84.26 | |
| FLUX.1-devModel Category=T2I Models2025.10 | 76.39 | 90.63 | 83.51 | 87.47 | 75.3 | 80.2 | 84.23 | 87.07 | 83.1 | |
| Janus-ProModel Category=Unified Multimodal Models2025.10 | 76.17 | 84.25 | 80.28 | 80.47 | 56.43 | 65.14 | 79.67 | 69.67 | 74.01 | |
| SD-xl-base-1Model Category=T2I Models2025.10 | 72.25 | 77.75 | 75 | 85.28 | 57.14 | 72.18 | 77.08 | 78.38 | 74.38 |