Truthfulness Evaluation on TruthfulQA (TQA Metric)
54.9TQA ScoreEvoPref-Best
Evaluation Results
| Method | Links | |
|---|---|---|
| EvoPref-BestOptimization Paradigm=Multi-Objective Evolutionary, Base Model=Mistral-7B-Instruct-v0.2, LoRA Rank=16, LoRA Alpha=322026.05 | 54.9 | |
| EvoPrefOptimization Paradigm=Multi-Objective Evolutionary, Base Model=Mistral-7B-Instruct-v0.2, LoRA Rank=16, LoRA Alpha=322026.05 | 53.3 | |
| SMS-EMOAOptimization Paradigm=Multi-Objective Evolutionary, Base Model=Mistral-7B-Instruct-v0.2, LoRA Rank=16, LoRA Alpha=322026.05 | 52.9 | |
| MOEA/DOptimization Paradigm=Multi-Objective Evolutionary, Base Model=Mistral-7B-Instruct-v0.2, LoRA Rank=16, LoRA Alpha=322026.05 | 52.5 | |
| IPOOptimization Paradigm=Gradient-Based, Base Model=Mistral-7B-Instruct-v0.2, LoRA Rank=16, LoRA Alpha=322026.05 | 52 | |
| DPOOptimization Paradigm=Gradient-Based, Base Model=Mistral-7B-Instruct-v0.2, LoRA Rank=16, LoRA Alpha=322026.05 | 51.8 | |
| ORPOOptimization Paradigm=Gradient-Based, Base Model=Mistral-7B-Instruct-v0.2, LoRA Rank=16, LoRA Alpha=322026.05 | 51.5 | |
| CMA-ESOptimization Paradigm=Single-Objective Evolutionary, Base Model=Mistral-7B-Instruct-v0.2, LoRA Rank=16, LoRA Alpha=322026.05 | 51.1 | |
| KTOOptimization Paradigm=Gradient-Based, Base Model=Mistral-7B-Instruct-v0.2, LoRA Rank=16, LoRA Alpha=322026.05 | 50.8 |