First Integral Prediction on First Integral Discovery Normal (test)
74.7AccuracyFISolver-Base
Evaluation Results
| Method | Links | |
|---|---|---|
| FISolver-Basebeam size (bs)=70, Training Strategy=RL, RL Training Data=HardSplit (HS), RL Reward Scheme=LD-based Reward (LD)2026.05 | 74.7 | |
| FISolver-Basebeam size (bs)=70, Training Strategy=RL, RL Training Data=NormalSplit (NS), RL Reward Scheme=LD-based Reward (LD)2026.05 | 74.2 | |
| Mathematica2026.05 | 74 | |
| FISolver-Basebeam size (bs)=70, Training Strategy=SFT-only2026.05 | 72.7 | |
| FISolver-Basebeam size (bs)=70, Training Strategy=RL, RL Training Data=HardSplit (HS), RL Reward Scheme=Binary Reward (Bin)2026.05 | 71.1 | |
| FISolver-Basebeam size (bs)=70, Training Strategy=RL, RL Training Data=NormalSplit (NS), RL Reward Scheme=Binary Reward (Bin)2026.05 | 49.5 | |
| FISolver-Basebeam size (bs)=5, Training Strategy=RL, RL Training Data=NormalSplit (NS), RL Reward Scheme=LD-based Reward (LD)2026.05 | 49 | |
| FISolver-Basebeam size (bs)=5, Training Strategy=RL, RL Training Data=NormalSplit (NS), RL Reward Scheme=Binary Reward (Bin)2026.05 | 45.1 | |
| FISolver-Basebeam size (bs)=5, Training Strategy=SFT-only2026.05 | 43.2 | |
| FISolver-Basebeam size (bs)=5, Training Strategy=RL, RL Training Data=HardSplit (HS), RL Reward Scheme=LD-based Reward (LD)2026.05 | 41.8 | |
| FISolver-Basebeam size (bs)=5, Training Strategy=RL, RL Training Data=HardSplit (HS), RL Reward Scheme=Binary Reward (Bin)2026.05 | 37 | |
| Qwen2.5-Math-7Bbeam size (bs)=52026.05 | 36.6 | |
| Qwen2.5-Math-1.5Bbeam size (bs)=52026.05 | 12.9 |