Medical Agent Task on MedAgentBench (Accuracy)
48.6AccuracyNemotron-Terminal-8B
Evaluation Results
| Method | Links | |
|---|---|---|
| Nemotron-Terminal-8BTrain Size=264K, Training Method=SFT2026.06 | 48.6 | |
| OT-Agent-SFT-8B (100K)Base Model=OpenThinker-Agent-v1-SFT, Train Size=100K, Training Method=SFT2026.06 | 36.2 | |
| OT-Agent-ColdSFT+RL-8BBase Model=OpenThinker-Agent-v1-SFT, Train Size=10K+5K, Training Method=SFT+RL2026.06 | 31.1 | |
| OT-Agent-SFT-8B (10K)Base Model=OpenThinker-Agent-v1-SFT, Train Size=10K, Training Method=SFT2026.06 | 25.8 | |
| Endless TerminalsBase Model=Qwen3-8B, Train Size=15K+3K, Training Method=SFT+RL2026.06 | 18.4 | |
| SWE-Lego-Qwen3-8BBase Model=Qwen3-8B, Train Size=18K, Training Method=SFT2026.06 | 5 | |
| Qwen3-8BBase Model=N/A, Train Size=N/A, Training Method=N/A2026.06 | 3.8 |