Instruction Tuning on Alpaca instruction-tuning 52k
116Pairwise Winning ScoreGRADFILTERING
Evaluation Results
| Method | Links | |
|---|---|---|
| GRADFILTERINGBase Model=LLaMA2-7B, Adaptation regime=Full, Training data fraction=5%2026.01 | 116 | |
| GRADFILTERINGBase Model=LLaMA2-7B, Adaptation regime=Full, Training data fraction=10%2026.01 | 116 | |
| GRADFILTERINGBase Model=LLaMA2-7B, Adaptation regime=LoRA, Training data fraction=15%2026.01 | 115 | |
| GRADFILTERINGBase Model=LLaMA2-13B, Adaptation regime=Full, Training data fraction=10%2026.01 | 113 | |
| GRADFILTERINGBase Model=LLaMA2-7B, Adaptation regime=Full, Training data fraction=15%2026.01 | 112 | |
| SuperfilteringBase Model=LLaMA2-7B, Adaptation regime=LoRA, Training data fraction=10%2026.01 | 110 | |
| GRADFILTERINGBase Model=LLaMA2-13B, Adaptation regime=LoRA, Training data fraction=15%2026.01 | 110 | |
| GRADFILTERINGBase Model=LLaMA2-7B, Adaptation regime=LoRA, Training data fraction=10%2026.01 | 107 | |
| GRADFILTERINGBase Model=LLaMA2-7B, Adaptation regime=LoRA, Training data fraction=15%2026.01 | 106 | |
| GRADFILTERINGBase Model=LLaMA2-7B, Adaptation regime=Full, Training data fraction=10%2026.01 | 106 | |
| SuperfilteringBase Model=LLaMA2-7B, Adaptation regime=LoRA, Training data fraction=5%2026.01 | 102 | |
| SuperfilteringBase Model=LLaMA2-7B, Adaptation regime=LoRA, Training data fraction=15%2026.01 | 102 | |
| GRADFILTERINGBase Model=LLaMA2-7B, Adaptation regime=LoRA, Training data fraction=5%2026.01 | 101 | |
| Random SplitBase Model=LLaMA2-7B, Adaptation regime=LoRA, Training data fraction=5%2026.01 | 97 | |
| Random SplitBase Model=LLaMA2-7B, Adaptation regime=LoRA, Training data fraction=10%2026.01 | 93 | |
| Random SplitBase Model=LLaMA2-7B, Adaptation regime=LoRA, Training data fraction=15%2026.01 | 92 | |
| GRADFILTERINGBase Model=LLaMA2-13B, Adaptation regime=LoRA, Training data fraction=10%2026.01 | 1.2 | |
| GRADFILTERINGBase Model=LLaMA2-13B, Adaptation regime=LoRA, Training data fraction=5%2026.01 | 1.19 | |
| GRADFILTERINGBase Model=LLaMA2-13B, Adaptation regime=Full, Training data fraction=10%2026.01 | 1.1 |