Information Retrieval on Korean Web Search Offline Evaluation set (test)
38.56P@3AuthGR (Full)
Evaluation Results
| Method | Links | |||
|---|---|---|---|---|
| AuthGR (Full)Strategy=CPT + SFT + GRPO, Size=3B2026.04 | 38.56 | 54.64 | 71.75 | |
| HyperCLOVAXStrategy=Supervised Fine-tuning (SFT), Size=14B2026.04 | 38.54 | 55.08 | 72.89 | |
| AuthGR (CPT+SFT)Strategy=Continued Pre-training (CPT) + Supervised Fine-tuning (SFT), Size=3B2026.04 | 37.25 | 52.93 | 70.31 | |
| LLaMA 3.2Strategy=Supervised Fine-tuning (SFT), Size=3B2026.04 | 36.02 | 51.08 | 68.92 | |
| Qwen3Strategy=Supervised Fine-tuning (SFT), Size=4B2026.04 | 35.81 | 50.53 | 68.43 | |
| HyperCLOVAXStrategy=Supervised Fine-tuning (SFT), Size=1.5B2026.04 | 35.73 | 50.58 | 67.08 | |
| AuthGR (SFT)Strategy=Supervised Fine-tuning (SFT), Size=3B2026.04 | 35.55 | 50.58 | 68.99 | |
| LLaMA 3.2Strategy=Supervised Fine-tuning (SFT), Size=1B2026.04 | 34.79 | 49.48 | 66.79 | |
| HyperCLOVAXStrategy=Supervised Fine-tuning (SFT), Size=0.5B2026.04 | 34.7 | 49.33 | 66.34 | |
| Qwen3Strategy=Supervised Fine-tuning (SFT), Size=1.7B2026.04 | 34.33 | 48.53 | 65.82 | |
| T5Gemma 2Strategy=Supervised Fine-tuning (SFT), Size=2B2026.04 | 33.99 | 48.05 | 63.84 | |
| T5Gemma 2Strategy=Supervised Fine-tuning (SFT), Size=0.5B2026.04 | 32.8 | 46.46 | 61.51 | |
| GPT-4oStrategy=In-context Learning (ICL), Size=-2026.04 | 17 | 23.48 | 31.7 | |
| LLaMA 3.1Strategy=In-context Learning (ICL), Size=405B2026.04 | 14.13 | 19.74 | 25.9 | |
| DeepSeek-V3.2Strategy=In-context Learning (ICL), Size=685B2026.04 | 13.98 | 20.27 | 27.29 | |
| K-EXAONEStrategy=In-context Learning (ICL), Size=236B2026.04 | 13.66 | 19.18 | 26.56 | |
| DeepSeek-V3Strategy=In-context Learning (ICL), Size=671B2026.04 | 13.59 | 19.32 | 26.26 | |
| LLaMA 4 MaverickStrategy=In-context Learning (ICL), Size=400B2026.04 | 12.74 | 18.41 | 24.83 | |
| Gemma 3Strategy=In-context Learning (ICL), Size=27B2026.04 | 12.55 | 17.32 | 22.85 | |
| LLaMA 4 ScoutStrategy=In-context Learning (ICL), Size=109B2026.04 | 10.66 | 15.55 | 21.28 | |
| DeepSeek-R1Strategy=In-context Learning (ICL), Size=671B2026.04 | 8.91 | 13.28 | 17.18 | |
| EXAONE 3.5Strategy=In-context Learning (ICL), Size=32B2026.04 | 8.25 | 12.53 | 16.12 | |
| Qwen3Strategy=In-context Learning (ICL), Size=32B2026.04 | 8.21 | 11.76 | 15.7 |