Agentic Memory on Memory-Rec_Sum
46.5AccuracyGoLongRL (w. TMN-Reweight)
Evaluation Results
| Method | Links | |
|---|---|---|
| GoLongRL (w. TMN-Reweight)Model=Qwen3-4B-Thinking-2507, Optimization Method=TMN-Reweight2026.05 | 46.5 | |
| Qwen3-4B-Thinking-2507 BaseModel=Qwen3-4B-Thinking-2507, Optimization Method=Base2026.05 | 36.8 | |
| QwenLong L1.5-30BModel=QwenLong L1.5-30B2026.05 | 36.1 | |
| GoLongRL (w. GRPO)Model=Qwen3-30B-A3B-Thinking-2507, Optimization Method=GRPO2026.05 | 35.5 | |
| Qwen3-30B-A3B-Thinking-2507 BaseModel=Qwen3-30B-A3B-Thinking-2507, Optimization Method=Base2026.05 | 31 |