Function Calling on BFCL Parity
85.9AccuracyOpenThinkerAgent-32B
Evaluation Results
| Method | Links | |
|---|---|---|
| OpenThinkerAgent-32BTrain Size=100K, Method=SFT, Backbone=Qwen3-32B2026.06 | 85.9 | |
| SWE-Lego-Qwen3-32BTrain Size=18K, Method=SFT, Backbone=Qwen3-32B2026.06 | 81 | |
| OT-Agent-SFT-8B (10K)Base Model=OpenThinker-Agent-v1-SFT, Train Size=10K, Training Method=SFT2026.06 | 79.4 | |
| DeepSWE-PreviewTrain Size=4.5K, Method=RL, Backbone=Qwen3-32B2026.06 | 77.2 | |
| SWE-Lego-Qwen3-8BBase Model=Qwen3-8B, Train Size=18K, Training Method=SFT2026.06 | 75.3 | |
| SA-SWE-32BTrain Size=4.5K, Method=RL, Backbone=Qwen3-32B2026.06 | 74.8 | |
| OT-Agent-ColdSFT+RL-8BBase Model=OpenThinker-Agent-v1-SFT, Train Size=10K+5K, Training Method=SFT+RL2026.06 | 71.5 | |
| Nemotron-Terminal-32BTrain Size=264K, Method=SFT, Backbone=Qwen3-32B2026.06 | 69.1 | |
| SERA-32BTrain Size=25K, Method=SFT, Backbone=Qwen3-32B2026.06 | 69.1 | |
| Qwen3-32BTrain Size=N/A, Method=N/A, Backbone=Qwen3-32B2026.06 | 68.3 | |
| OT-Agent-SFT-8B (100K)Base Model=OpenThinker-Agent-v1-SFT, Train Size=100K, Training Method=SFT2026.06 | 65.9 | |
| Nemotron-Terminal-8BTrain Size=264K, Training Method=SFT2026.06 | 59.9 | |
| Endless TerminalsBase Model=Qwen3-8B, Train Size=15K+3K, Training Method=SFT+RL2026.06 | 48.8 | |
| Qwen3-8BBase Model=N/A, Train Size=N/A, Training Method=N/A2026.06 | 34.4 |