Agentic Memory on Memory-Vec
21.9AccuracyGoLongRL (w. GRPO)
Evaluation Results
| Method | Links | |
|---|---|---|
| GoLongRL (w. GRPO)Model=Qwen3-30B-A3B-Thinking-2507, Optimization Method=GRPO2026.05 | 21.9 | |
| QwenLong L1.5-30BModel=QwenLong L1.5-30B2026.05 | 21.3 | |
| GoLongRL (w. TMN-Reweight)Model=Qwen3-4B-Thinking-2507, Optimization Method=TMN-Reweight2026.05 | 20 | |
| Qwen3-30B-A3B-Thinking-2507 BaseModel=Qwen3-30B-A3B-Thinking-2507, Optimization Method=Base2026.05 | 18.7 | |
| Qwen3-4B-Thinking-2507 BaseModel=Qwen3-4B-Thinking-2507, Optimization Method=Base2026.05 | 15.5 |