GUI Grounding on UI-Vision (Accuracy)
58.7AccuracyGROUNDNEXT-7B (SFT)
Evaluation Results
| Method | Links | |
|---|---|---|
| GROUNDNEXT-7B (SFT)Model Scale=7B, Training Paradigm=SFT2025.11 | 58.7 | |
| GROUNDNEXT-3B (SFT)Model Scale=3B, Training Paradigm=SFT2025.11 | 58.2 | |
| ZoomOnceSize=4B2026.06 | 40.2 | |
| MAI-UISize=4B2026.06 | 37 | |
| GUI-SDTime/epoch=4.22026.05 | 33.3 | |
| OpenCUASize=7B2026.06 | 29.7 | |
| Propose-then-Critic-8B2026.05 | 28.9 | |
| Qwen3-VL-Instruct + GRPO-GaussianTime/epoch=16.82026.05 | 28.2 | |
| Qwen3-VL-Instruct + GRPO-BinaryTime/epoch=16.92026.05 | 27.6 | |
| Qwen3-VL-Instruct + GRPO-DistanceTime/epoch=16.72026.05 | 27.5 | |
| ZoomUI-7B2026.05 | 27.1 | |
| Qwen3-VLSize=32B2026.06 | 26.9 | |
| UI-VenusSize=7B2026.06 | 26.5 | |
| InfiGUI-G1Size=7B2026.06 | 26.1 | |
| HyperClick-7B2026.05 | 25.7 | |
| UI-TARS-DPOSize=72B2026.06 | 25.5 | |
| JEDI-7B2026.05 | 25.2 | |
| Qwen3-VL-Instruct2026.05 | 25.2 | |
| JEDI-7BModel Scale=7B, Training Paradigm=SFT2025.11 | 24.8 | |
| Qwen3-VLSize=8B2026.06 | 23.3 | |
| UI-TARS-1.5Size=7B2026.06 | 22.3 | |
| InfiGUI-G1Size=3B2026.06 | 22 | |
| GUI-Actor-7BModel Scale=7B, Training Paradigm=SFT2025.11 | 21.9 | |
| PhiGround-4B-7CModel Scale=4B, Training Paradigm=SFT2025.11 | 20.5 | |
| GUI-Actor-3BModel Scale=3B, Training Paradigm=SFT2025.11 | 19.7 | |
| JEDI-3BModel Scale=3B, Training Paradigm=SFT2025.11 | 18.7 | |
| TongUI-7B2026.05 | 18 | |
| UI-TARS-7B2026.05 | 17.6 | |
| UI-TARSSize=7B2026.06 | 17.6 | |
| Qwen2.5-VL-7B (Agent mode)Model Scale=7B, Evaluation Mode=Agent mode, Training Paradigm=SFT2025.11 | 16.5 | |
| Aguvis-7BModel Scale=7B, Training Paradigm=SFT2025.11 | 13.7 | |
| UGround-V1-7BModel Scale=7B, Training Paradigm=SFT2025.11 | 12.9 | |
| UGroundSize=7B2026.06 | 12.9 | |
| OS-Atlas-7BModel Scale=7B, Training Paradigm=SFT2025.11 | 9 | |
| OS-AtlasSize=7B2026.06 | 9 | |
| Qwen2.5-VL-3BModel Scale=3B, Training Paradigm=SFT2025.11 | 6.3 | |
| Qwen2.5-VL-3B (Agent mode)Model Scale=3B, Evaluation Mode=Agent mode, Training Paradigm=SFT2025.11 | 6.3 | |
| Qwen2.5-VL-7BModel Scale=7B, Training Paradigm=SFT2025.11 | 0.9 |