Image-centric Multimodal Understanding on SEED-I
76.3ScoreNEO
Evaluation Results
| Method | Links | |
|---|---|---|
| NEOLLM=Qwen3-8B, # Data=345M / 40M / 4M, Model Scale=8B, Architecture Category=Native, Reinforcement Learning=false2025.10 | 76.3 | |
| Encoder-BasedLLM=Qwen3-8B, # Data=>6B / 40M / 4M, Model Scale=8B, Architecture Category=Modular, Reinforcement Learning=false2025.10 | 76.2 | |
| NEOLLM=Qwen3-1.7B, # Data=345M / 40M / 4M, Model Scale=2B, Architecture Category=Native, Reinforcement Learning=false2025.10 | 74.2 | |
| Encoder-BasedLLM=Qwen3-1.7B, # Data=>6B / 40M / 4M, Model Scale=2B, Architecture Category=Modular, Reinforcement Learning=false2025.10 | 73.6 | |
| SAILLLM=Mistral-7B, # Data=512M / 86M / 6M, Model Scale=8B, Architecture Category=Native, Reinforcement Learning=false2025.10 | 72.9 | |
| EVEv2LLM=Qwen2.5-7B, # Data=77M / 15M / 7M, Model Scale=8B, Architecture Category=Native, Reinforcement Learning=false2025.10 | 71.4 | |
| HoVLELLM=InternLM2-1.8B, # Data=550M / 50M / 7M, Model Scale=2B, Architecture Category=Native, Reinforcement Learning=false2025.10 | 70.9 | |
| OneCATLLM=Qwen2.5-1.5B, # Data=436M / 70M / 13M, Model Scale=2B, Architecture Category=Native, Reinforcement Learning=false2025.10 | 70.9 | |
| VoRALLM=Qwen2.5-7B, # Data=30M / 0M / 0.6M, Model Scale=8B, Architecture Category=Native, Reinforcement Learning=false2025.10 | 68.9 | |
| Emu3LLM=from scratch, # Data=- / - / -, Model Scale=8B, Architecture Category=Native, Reinforcement Learning=false2025.10 | 68.2 | |
| Mono-InternVLLLM=InternLM2-1.8B, # Data=1.2B / 143M / 7M, Model Scale=2B, Architecture Category=Native, Reinforcement Learning=false2025.10 | 67.4 | |
| Mono-InternVL-1.5LLM=InternLM2-1.8B, # Data=400M / 150M / 7M, Model Scale=2B, Architecture Category=Native, Reinforcement Learning=false2025.10 | 66.9 | |
| EVELLM=Vicuna-7B, # Data=33M / 0M / 1.8M, Model Scale=8B, Architecture Category=Native, Reinforcement Learning=false2025.10 | 64.6 | |
| SOLOLLM=Mistral-7B, # Data=44M / 0M / 2M, Model Scale=8B, Architecture Category=Native, Reinforcement Learning=false2025.10 | 64.4 | |
| FuyuLLM=Persimmon-8B, # Data=- / - / -, Model Scale=8B, Architecture Category=Native, Reinforcement Learning=false2025.10 | 59.3 | |
| ChameleonLLM=from scratch, # Data=1.4B / 0M / 1.8M, Model Scale=8B, Architecture Category=Native, Reinforcement Learning=false2025.10 | 30.6 |