Textual Graph Reasoning on ExplaGraphs
96.12AccuracyAGE G-Retriever
Evaluation Results
| Method | Links | |
|---|---|---|
| AGE G-RetrieverSetting=Frozen LLM w/ Graph Embedding + PEFT(LoRA), LLM=Llama3.1-8B2026.06 | 96.12 | |
| AGE G-RetrieverSetting=Frozen LLM w/ Graph Embedding, LLM=Llama3.1-8B2026.06 | 93.5 | |
| AGE G-RetrieverSetting=Frozen LLM w/ Graph Embedding, LLM=Llama3.2-3B2026.06 | 92.6 | |
| AGE G-RetrieverSetting=Frozen LLM w/ Graph Embedding + PEFT(LoRA), LLM=Llama3.2-3B2026.06 | 91.34 | |
| TRN-R1-ZEROScale=14B, Zero-shot=true2026.04 | 90.25 | |
| Qwen2.5Scale=14B, Zero-shot=true2026.04 | 89.89 | |
| Graph-R1Scale=14B, Zero-shot=true2026.04 | 89.71 | |
| MixDemo2026.03 | 87.31 | |
| TRN-R1-ZEROScale=7B, Zero-shot=true2026.04 | 87.18 | |
| G-RetrieverSetting=Frozen LLM w/ Graph Embedding + PEFT(LoRA), LLM=Llama2-7B2026.06 | 87.05 | |
| G-Retriever2026.03 | 86.19 | |
| G-RetrieverSetting=Frozen LLM w/ Graph Embedding, LLM=Llama2-7B2026.06 | 85.16 | |
| GraphToken2026.03 | 85.08 | |
| AGE G-RetrieverSetting=Frozen LLM w/ Graph Embedding + PEFT(LoRA), LLM=Llama3.2-1B2026.06 | 85.01 | |
| Qwen2.5Scale=7B, Zero-shot=true2026.04 | 84.12 | |
| G-RetrieverSetting=Frozen LLM w/ Graph Embedding + PEFT(LoRA), LLM=Llama3.2-3B2026.06 | 83.39 | |
| AGE G-RetrieverSetting=Frozen LLM w/ Graph Embedding, LLM=Llama3.2-1B2026.06 | 82.67 | |
| G-RetrieverSetting=Frozen LLM w/ Graph Embedding, LLM=Llama3.2-3B2026.06 | 77.61 | |
| G-RetrieverSetting=Frozen LLM w/ Graph Embedding + PEFT(LoRA), LLM=Llama3.2-1B2026.06 | 73.28 | |
| KAPING2026.03 | 62.27 | |
| Frozen LLM + Prompt Tuning (PT)2026.03 | 58.98 | |
| CoT-BAG2026.03 | 57.94 | |
| Zero-CoT2026.03 | 57.04 | |
| Zero-shot2026.03 | 56.5 | |
| G-RetrieverSetting=Frozen LLM w/ Graph Embedding, LLM=Llama3.2-1B2026.06 | 55.95 | |
| Graph-based Inference2026.03 | 33.93 |