General Medical AI Evaluation on GMAI
58.04AccuracyHulu-Med-32B
Evaluation Results
| Method | Links | |
|---|---|---|
| Hulu-Med-32BModel Size=>10B, Model Domain=Domain-specific2026.06 | 58.04 | |
| GPT-5.2Model Size=Large, Model Domain=General2026.06 | 57.98 | |
| Qwen3-VL-30B-A3B-InstructModel Size=>10B, Model Domain=General2026.06 | 57.34 | |
| Aloe-Vision-72B-ARModel Size=>10B, Model Domain=Domain-specific2026.06 | 55.12 | |
| Aloe-Vision-72BModel Size=>10B, Model Domain=Domain-specific2026.06 | 54.79 | |
| Qwen3-VL-8B-InstructModel Size=<10B, Model Domain=General2026.06 | 54.4 | |
| Aloe-Vision-7B-ARModel Size=<10B, Model Domain=Domain-specific2026.06 | 53.96 | |
| GLM-4.5VModel Size=>10B, Model Domain=Domain-specific2026.06 | 53.74 | |
| Hulu-Med-7BModel Size=<10B, Model Domain=Domain-specific2026.06 | 53.58 | |
| Lingshu-32BModel Size=>10B, Model Domain=Domain-specific2026.06 | 53.54 | |
| Aloe-Vision-7BModel Size=<10B, Model Domain=Domain-specific2026.06 | 52.81 | |
| Lingshu-7BModel Size=<10B, Model Domain=Domain-specific2026.06 | 52.31 | |
| Qwen2-VL-72B-InstructModel Size=>10B, Model Domain=General2026.06 | 51.03 | |
| HuatuoGPT-Vision-7BModel Size=<10B, Model Domain=Domain-specific2026.06 | 49.36 | |
| Kimi-VL-A3B-InstructModel Size=>10B, Model Domain=General2026.06 | 48.44 | |
| HuatuoGPT-Vision-34BModel Size=>10B, Model Domain=Domain-specific2026.06 | 48.33 | |
| Qwen2-VL-7B-InstructModel Size=<10B, Model Domain=General2026.06 | 46.42 | |
| MiMo-VL-7B-RLModel Size=<10B, Model Domain=Domain-specific2026.06 | 44.33 | |
| Chiron-o1-8BModel Size=<10B, Model Domain=Domain-specific2026.06 | 41.41 |