LLM Unlearning on TOFU (forget01)
1FQRetained LLM
Evaluation Results
| Method | Links | |||
|---|---|---|---|---|
| Retained LLMBackbone=Llama2-7B2026.06 | 1 | 0.6267 | 0.408 | |
| RULE_GRPOBackbone=Llama2-7B, Framework=RULE2026.06 | 0.165 | 0.6151 | 0.1322 | |
| ReRULE_GRPOBackbone=Llama2-7B, Framework=ReRULE2026.06 | 0.165 | 0.6076 | 0.1322 | |
| GA/SGABackbone=Llama2-7B, r=02026.06 | 0.0068 | 0.599 | 0.4817 | |
| GDBackbone=Llama2-7B2026.06 | 0.0068 | 0.5998 | 0.4869 | |
| DPO-RTBackbone=Llama2-7B2026.06 | 0.0068 | 0.6322 | 0.2595 | |
| SGABackbone=Llama2-7B, r=0.42026.06 | 0.0068 | 0.6027 | 0.4792 | |
| KLBackbone=Llama2-7B2026.06 | 0.003 | 0.5994 | 0.4922 | |
| LLMUBackbone=Llama2-7B2026.06 | 0.003 | 0.5999 | 0.4891 | |
| POBackbone=Llama2-7B2026.06 | 0.003 | 0.6323 | 0.1752 | |
| NPO-RTBackbone=Llama2-7B2026.06 | 0.003 | 0.5994 | 0.5049 | |
| FLATBackbone=Llama2-7B, variant=Pearson2026.06 | 0.003 | 0.6304 | 0.4825 | |
| Original LLMBackbone=Llama2-7B2026.06 | 0 | 0.6239 | 0.9851 |