Question Answering on TSpecLLM
62.1Utility ScoreFine-tuned
Evaluation Results
| Method | Links | |
|---|---|---|
| Fine-tunedModel=Llama-3.1-8B-Instruct, Fine-tuning Dataset=TSpecLLM2025.03 | 62.1 | |
| SafeMERGEModel=Llama-3.1-8B-Instruct, Fine-tuning Dataset=TSpecLLM2025.03 | 61.9 | |
| SafeInstructModel=Llama-3.1-8B-Instruct, Fine-tuning Dataset=TSpecLLM2025.03 | 61.5 | |
| SafeLoRAModel=Llama-3.1-8B-Instruct, Fine-tuning Dataset=TSpecLLM2025.03 | 60.8 | |
| RESTA-InstructModel=Llama-3.1-8B-Instruct, Fine-tuning Dataset=TSpecLLM2025.03 | 58.9 | |
| SafeMERGEModel=Qwen-2.5-7B-Instruct, Fine-tuning Dataset=TSpecLLM2025.03 | 53.1 | |
| Fine-tunedModel=Qwen-2.5-7B-Instruct, Fine-tuning Dataset=TSpecLLM2025.03 | 52.8 | |
| RESTAModel=Llama-3.1-8B-Instruct, Fine-tuning Dataset=TSpecLLM2025.03 | 51.7 | |
| SafeInstructModel=Qwen-2.5-7B-Instruct, Fine-tuning Dataset=TSpecLLM2025.03 | 51.5 | |
| SafeLoRAModel=Qwen-2.5-7B-Instruct, Fine-tuning Dataset=TSpecLLM2025.03 | 49.7 | |
| OriginalModel=Llama-3.1-8B-Instruct, Fine-tuning Dataset=TSpecLLM2025.03 | 48.5 | |
| RESTA-InstructModel=Qwen-2.5-7B-Instruct, Fine-tuning Dataset=TSpecLLM2025.03 | 45.8 | |
| Fine-tunedModel=Llama-2-7B-Chat, Fine-tuning Dataset=TSpecLLM2025.03 | 44.2 | |
| SafeInstructModel=Llama-2-7B-Chat, Fine-tuning Dataset=TSpecLLM2025.03 | 43.9 | |
| SafeMERGEModel=Llama-2-7B-Chat, Fine-tuning Dataset=TSpecLLM2025.03 | 43.8 | |
| SafeLoRAModel=Llama-2-7B-Chat, Fine-tuning Dataset=TSpecLLM2025.03 | 42.9 | |
| RESTA-InstructModel=Llama-2-7B-Chat, Fine-tuning Dataset=TSpecLLM2025.03 | 39.2 | |
| RESTAModel=Llama-2-7B-Chat, Fine-tuning Dataset=TSpecLLM2025.03 | 35.8 | |
| RESTAModel=Qwen-2.5-7B-Instruct, Fine-tuning Dataset=TSpecLLM2025.03 | 34 | |
| OriginalModel=Llama-2-7B-Chat, Fine-tuning Dataset=TSpecLLM2025.03 | 33.3 | |
| OriginalModel=Qwen-2.5-7B-Instruct, Fine-tuning Dataset=TSpecLLM2025.03 | 32.5 | |
| Fine-tunedModel=Qwen-2-7B-Instruct, Fine-tuning Dataset=TSpecLLM2025.03 | 28.3 | |
| SafeMERGEModel=Qwen-2-7B-Instruct, Fine-tuning Dataset=TSpecLLM2025.03 | 28.1 | |
| SafeInstructModel=Qwen-2-7B-Instruct, Fine-tuning Dataset=TSpecLLM2025.03 | 28 | |
| SafeLoRAModel=Qwen-2-7B-Instruct, Fine-tuning Dataset=TSpecLLM2025.03 | 27.7 | |
| RESTA-InstructModel=Qwen-2-7B-Instruct, Fine-tuning Dataset=TSpecLLM2025.03 | 24.5 | |
| RESTAModel=Qwen-2-7B-Instruct, Fine-tuning Dataset=TSpecLLM2025.03 | 13.8 | |
| OriginalModel=Qwen-2-7B-Instruct, Fine-tuning Dataset=TSpecLLM2025.03 | 12.5 |